10 Sept 2026
2m

DeepSeek-V4.1-Flash 上線:支援 1M token context,全域 KV 快取每 token 890 bytes

Podcast cover

EasyVibeCoding Podcast

DeepSeek 於 2026 年 9 月發佈全新架構的 DeepSeek-V4.1-Flash 多模態混合專家模型,主打原生影音文字處理與極致的推理效率。該模型具備 552 億總參數並支援百萬字上下文,透過因果編解碼器架構與大幅壓縮的 KV 快取技術,將服務成本降至前代四分之一。技術亮點包含提供 1-100 的推理努力值供使用者彈性調整精準度,並在 MMLU 取得 74.1 分、數學評測達 93 分的優異成績,展現強大的邏輯與程式生成能力。API 採尖離峯差別計價以優化成本,並針對代理任務優化資料管線,顯著提升軟體工程與終端指令的執行效能。

Outlines

Sign in to continue reading, translating and more.

Open full episode in Podwise