شرکت دیپ سیک از جدیدترین عضو خانواده مدلهای هوش مصنوعی خود با نام DeepSeek-V4.1-Flash رونمایی کرد؛ مدلی هوشمندتر، سریعتر و کارآمدتر که کوچکترین عضو این خانواده مبتنی بر معماری جدید محسوب میشود. این مدل از قابلیت درک بومی تصویر و اطلاعات چندوجهی بهره میبرد و برای توانمندی بالاتر، استنتاج سریعتر، توان عملیاتی فراتر و ارتقای مقیاسپذیری طراحی شده است.
مدل DeepSeek-V4.1-Flash مبتنی بر ساختار MoE یا «ترکیبی از متخصصان» با ۵۵۲ میلیارد پارامتر است. در این ساختار هوشمند، تنها ۸ میلیارد پارامتر برای پردازش ورودی و ۱۶ میلیارد پارامتر برای بخش خروجی فعال میشوند. همچنین ترکیب شیوههای نوین پیشآموزش و پسآموزش مبتنی بر یادگیری تقویتی باعث شده تا نتایج بنچمارکهای این مدل سبک حتی از مدلهای پرچمدار و بزرگی مانند DeepSeek-V4-Pro نیز پیشی بگیرد.
بهبود معماری به کاهش چشمگیر حجم حافظه کش (KV Cache) نیز منجر شده است؛ بهطوریکه این مدل در مقایسه با نسل قبلی تنها به یکچهارم حافظه با پهنای باند بالا (HBM) و یکهشتم فضای ذخیرهسازی SSD نیاز دارد. هماکنون این مدل از طریق پلتفرم هاگینگفیس در دسترس قرار گرفته است.
عملکرد DeepSeek-V4.1-Flash در بنچمارک و قدرت فنی مدل

بررسی دقیق جدول ارزیابیها نشان میدهد که DeepSeek-V4.1-Flash پیشرفت چشمگیری را در مقایسه با نسلهای پیشین خود تجربه کرده است. این مدل در بنچمارک استدلال تخصصی GPQA Diamond به امتیاز ۹۰.۹ دست یافته و در آزمون آخرین آزمون بشریت (HLE) نمره ۳۶.۸ را ثبت کرده که در حالت فقط متنی به ۳۹.۱ و با بهکارگیری ابزارها به ۶۳.۹ میرسد؛ نمرهای که کاملاً بالاتر از امتیاز ۶۰.۰ نسخه پرچمدار V4-Pro است.
در آزمون برنامهنویسی رقابتی Codeforces، این مدل به امتیاز درخشان ۳۴۷۱ رسیده که حتی مدلهای V4-Pro با امتیاز ۳۳۴۸ و نسخه قبلی فلش با امتیاز ۳۲۸۹ را با فاصله پشت سر میگذارد. همچنین در بنچمارک ریاضی MathAreana Apex امتیاز ۶۵.۶ برای این هوش مصنوعی ثبت شده است.
این مدل در ارزیابی مهندسی نرمافزار DeepSWE v1.1 توانسته نمره ۷۴.۲ را کسب کند که بالاتر از مدلهای مطرحی چون GPT 5.6-Sol با نمره ۷۳.۰ و Claude Opus 5 با نمره ۷۴.۰ جای میگیرد. علاوهبراین، در آزمونهای امنیتی و نفوذ سایبری شامل CyberGym ،SEC-Bench Pro و ExploitGym به ترتیب امتیازهای ۸۸.۱، ۶۲.۸ و ۱۵.۳ را ثبت کرده است.
عملکرد این هوش مصنوعی در حوزه هدایت ایجنتهای خودکار با امتیازهای ۵۴.۸ در Automation-Bench و ۳۱.۸ در Agents’ Last Exam تکمیل میشود. در زمینه درک تصویر و بینایی ماشین مبتنی بر ابزار نیز نمرات ۷۸.۹ در بنچمارک Chartography و ۸۹.۶ در BabyVision نشاندهنده قدرت چندوجهی بالای این معماری نوین هستند.
تقسیمبندی و کاهش هزینه API در مدل DeepSeek-V4.1 Flash

استفاده از این معماری بهطور کلی باعث شده تا بازدهی عملکرد مدل بالاتر برود و بههمیندلیل دیپ سیک هزینه API آن را هم پایین آورده است. شرکت چینی بازههای زمانی ساعات اوج مصرف (Peak) و ساعات کممصرف (Off-Peak) را در نظر گرفته که در ساعات غیر اوج، تعرفهها با تخفیف ۵۰ درصدی محاسبه میشوند:
- ساعات کممصرف: به ازای هر یک میلیون توکن، هزینه ورودی در صورت استفاده از دادههای ذخیرهشده (کش) ۰.۰۰۳ دلار، ورودی برای دادههای کاملاً جدید ۰.۱۵ دلار و تولید خروجی ۰.۶ دلار است.
- ساعات اوج مصرف: ورودی با دادههای ذخیرهشده ۰.۰۰۶ دلار، ورودی بدون ذخیره قبلی ۰.۳ دلار و تولید خروجی ۱.۲ دلار محاسبه میشود.
ساعات اوج مصرف شامل بازههای ۰۱:۰۰ تا ۰۴:۰۰ و همچنین ۰۶:۰۰ تا ۱۰:۰۰ بهوقت ساعت هماهنگ جهانی (UTC) در روزهای کاری است و سایر زمانها (شامل کل تعطیلات رسمی و آخر هفتهها) کممصرف محسوب میشوند. این جدول قیمتی از صبح امروز فعال شده است. دیپسیک همچنین اعلام کرده که به دلیل برتری این مدل جدید، نسخه پیشین پرچمدار خود یعنی V4-Pro را بهمرور بازنشسته خواهد کرد. از روز ۱۴ سپتامبر، تمامی درخواستهای ارسالی به مدل deepseek-v4-pro بهصورت خودکار به مدل جدید DeepSeek-V4.1-Flash هدایت شده و با تعرفه بسیار پایینتر این نسخه جدید محاسبه میشوند؛ روندی که تا زمان عرضه رسمی نسخه قدرتمندتر V4.1-Pro ادامه خواهد داشت.

