پرش به محتوای اصلی
آبیدرنت
کوردیشروع پروژه
بازگشت به اخبار
هوش مصنوعی

معرفی DeepSeek-V4.1-Flash: مدل هوشمندتر، سریع‌تر و کارآمدتر با درک بصری بومی

آبتین فیروزیار
آبتین فیروزیار
مهندس هوش مصنوعی
رفتن به سایت خبرگزاری
معرفی مدل DeepSeek-V4.1-Flash هوشمندتر سریع‌تر کارآمدتر

معماری نامتقارن DeepSeek-V4.1-Flash؛ هوش بیشتر با هزینه کمتر

  • مدل Mixture-of-Experts (MoE) با ۵۵۲ میلیارد پارامتر
    • معماری جدید Causal Encoder–Decoder: فقط ۸ میلیارد پارامتر فعال برای ورودی و ۱۶ میلیارد برای خروجی
      • روش‌های پیش‌آموزش جدید + تقویت یادگیری تقویتی در مقیاس بزرگ، نتایج بنچمارک را حتی از مدل‌های پرچم‌دار مانند DeepSeek-V4-Pro جلوتر برده است.
        معماری نامتقارن Causal Encoder-Decoder مدل DeepSeek-V4.1-Flash
        معماری نامتقارن Causal Encoder-Decoder مدل DeepSeek-V4.1-Flash

        کاهش چشمگیر KV Cache (H2)

        KV Cache کوچک‌تر = صرفه‌جویی بزرگ‌تر

        در مقایسه با نسل قبلی، KV Cache مدل V4.1-Flash نیاز دارد به:

        • فقط ۱/۴ حافظه HBM
          • فقط ۱/۸ فضای ذخیره‌سازی SSD

            هزینه Cache-hit بخش بزرگی از هزینه‌های عامل‌ها (Agents) را تشکیل می‌دهد. فشرده‌سازی کش این هزینه‌ها را به شکل قابل‌توجهی کاهش می‌دهد.

            مقایسه حجم KV Cache مدل DeepSeek-V4.1-Flash با نسل قبل
            مقایسه حجم KV Cache مدل DeepSeek-V4.1-Flash با نسل قبل

            دسترسی و پشتیبانی چندوجهی (H2)

             DeepSeek-V4.1-Flash هم‌اکنون در API دیپ‌سیک فعال است

            مدل را روی deepseek-flash تنظیم کنید. پشتیبانی بومی چندوجهی (Multimodal) دارد.

            • مدل‌های V4-Flash و V4-Flash-Vision-Exp بازنشسته شده‌اند (برای سازگاری موقتاً به V4.1-Flash هدایت می‌شوند).
              • تست‌های مستقل نشان می‌دهد V4.1-Flash از نظر عملکرد، هزینه، سرعت و زمان کل اجرا از V4-Pro بهتر است. به همین دلیل V4-Pro نیز به‌تدریج کنار گذاشته می‌شود.
                • از ساعت ۰۴:۰۰ UTC تاریخ ۱۴ سپتامبر ۲۰۲۶، تمام درخواست‌های deepseek-v4-pro به V4.1-Flash با نرخ جدید هدایت می‌شوند تا زمان عرضه V4.1-Pro.

                  معماری کارآمدتر = قیمت API پایین‌تر

                  DeepSeek-V4.1-Flash به ما اجازه می‌دهد کاربران بیشتری را با هزینه کمتر سرویس دهیم و این صرفه‌جویی را به شما منتقل می‌کنیم.

                  • قیمت‌گذاری پیک/آف‌پیک ادامه دارد.
                    • نرخ آف‌پیک برابر با ۵۰٪ نرخ پیک است. بارهای کاری انعطاف‌پذیر را در ساعات آف‌پیک اجرا کنید تا هزینه کمتری بپردازید.
                      • قیمت‌های جدید از ساعت ۰۴:۰۰ UTC تاریخ ۱۰ سپتامبر ۲۰۲۶ اعمال شده است.
                        معرفی DeepSeek-V4.1-Flash: مدل هوشمندتر، سریع‌تر و کارآمدتر با درک بصری بومی
                        هوش مصنوعی

                        خبرهای مرتبط

                        رونمایی AMD از Threadripper Halo Station؛ قدرتمندترین ورک‌استیشن هوش مصنوعی جهان با ۹۶ هسته و شتاب‌دهنده‌های دوگانه MI350P