استارتاپ چینی DeepSeek نسخه جدید هوش مصنوعی خود را برای رقابت با OpenAI منتشر کرد

استارتاپ چینی DeepSeek بدون اینکه سر و صدا راه بندازه، آخرین بروزرسانیش که اسمش V3-0324 هست رو تو پلتفرم Hugging Face گذاشته. این مدل جدید یه معماری باحال داره که بهش Mixture-of-Experts (MoE) میگن. ببین چقدر باهوشه، در کل ۶۷۱ میلیارد پارامتر داره، ولی واسه هر پردازش فقط ۳۷ میلیارد پارامترش رو روشن میکنه! این یعنی یه انقلاب حسابی تو کارآیی مدلهای زبانی بزرگ.
برعکس مدلهای قدیمی که همه پارامترهاشون رو واسه هر کاری فعال میکردن، این روش DeepSeek با روشن کردن فقط اونایی که لازمه، عملکردی در حد مدلهای خیلی بزرگتر داره ولی محاسبات خیلی کمتری نیاز داره. جالبه بدونی این مدل روی یه دسته کامپیوتر با ۳۲ هزار تا GPU آموزش دیده و تحت مجوز MIT هم منتشر شده، یعنی هرکی میتونه حتی واسه کارهای تجاری ازش استفاده کنه، مجانی!
طبق حرف کاربرایی که اولین نفر ازش استفاده کردن، این مدل تو آزمونهای مختلف یه پرش حسابی داشته و حتی از Sonnet 3.5 هم جلو زده. این مدل جدید مخصوصاً تو استدلال کردن، ساخت صفحات وب، و تولید محتوا خیلی بهتر شده و مشکلاتی که قبلاً موقع فراخونی توابع داشت رو هم حل کرده.
کاربرا میگن سبک حرف زدن مدل هم عوض شده. مدلهای قبلی DeepSeek یه جورایی مثل آدما حرف میزدن و لحن دوستانه داشتن، ولی این “V3-0324” خیلی رسمیتر و فنیتر شده. احتمالاً مهندساش عمداً اینجوری طراحیش کردن تا بیشتر به درد کارهای حرفهای و فنی بخوره.
زمان انتشار و ویژگیهای این مدل نشون میده که احتمالاً قراره پایهای برای DeepSeek-R2 باشه که یه مدل خفنتر با تمرکز روی استدلاله و احتمالاً تا دو ماه دیگه میاد بیرون. کلاً، این بروزرسانی نشون میده DeepSeek داره حسابی با غولهای جهانی هوش مصنوعی مثل OpenAI رقابت میکنه، ولی با یه تفاوت بزرگ: برخلاف OpenAI که همه چیو میذاره داخل بلکباکس و پول زیادی میخواد، DeepSeek داره همه چیو متنباز منتشر میکنه!
[author title=”نويسنده” image=”https://soroosheamniyat.ir/wp-content/uploads/2025/03/68ce8398-24e3-40b3-8f1a-cd664029e334.png”]مسعود اسدپور کارشناس امنيت وخبرنگار پايگاه خبري سروش امنيت[/author]





