快讯详情

DeepSeek V4.1 Flash发布:原生多模态视觉理解全面超越Pro版

深度求索发布轻量级多模态模型DeepSeek V4.1Flash,为系列最小尺寸。其采用552B参数MoE架构,创新引入Causal-Encoder-Decoder结构,具备原生视觉理解能力,旨在提升能力上限

实时快讯ai2026-09-10 13:58:00真实数据
DeepSeek V4.1 Flash发布:原生多模态视觉理解全面超越Pro版

在核心架构方面,DeepSeek V4.1Flash 采用了552B 参数的 MoE(混合专家)架构,并创新性地引入了全新的 Causal-Encoder-Decoder 结构。由于采用了输入和输出不对称的设计,其输入激活仅有8B,输出激活为16B,使得整体成本显著低于同尺寸的已知模型。配合全新的预训练方式以及更大规模的强化学习后训练,该模型在各项基准测试中的智能水平成功超越了包括 DeepSeek V4Pro 在内的一众旗舰模型。

在效率优化与成本控制上,新一代模型大幅压缩了 KV Cache 缓存的大小。相比上一代模型,V4.1Flash 对高带宽内存(HBM)的需求减少至1/4,对固态硬盘(SSD)的需求减少至1/8。尤其在 Agent 使用场景中,由于上下文存储和缓存命中的费用占比较高,这一压缩大幅降低了相关任务的实际使用成本。据统计,相对于初代模型,其 KV Cache 已经缩减至原来的1/437。

随着新模型的正式上线,DeepSeek 对相关产品线和计费策略进行了系统性调整。DeepSeek V4.1Flash 已同步上线 DeepSeek API,用户只需将模型名称更改为 deepseek-flash 即可调用。旧版本的 V4Flash 与 V4Flash Vision Exp 已正式下线,而旧模型名(deepseek-v4-flash 和 deepseek-v4-flash-vision-exp)目前被暂时路由到 V4.1Flash。鉴于 V4.1Flash 在性能、费用、速度和总用时上已全面超越 V4Pro,官方计划有序下线 V4Pro 模型:在2026年9月14日12:00之后至 V4.1Pro 上线之前,所有访问 deepseek-v4-pro 的请求将全部被路由至 V4.1Flash 并按其单价计费。目前,腾讯旗下的 WorkBuddy、CodeBuddy 以及 OpenCode 等官方合作伙伴已全量接入该模型。

得益于底层架构的创新,DeepSeek V4.1Flash 能够以更低的成本服务海量用户,官方也顺势下调了该模型的 API 定价。同时,为了更合理地调配计算资源,新定价延续了峰谷定价机制,闲时价格为高峰时段的一半,以鼓励用户灵活调整任务执行时间,新价格已于2026年9月10日12:00正式生效。

9月10日,深度求索发布DeepSeek V4.1 Flash,系新一代最小尺寸模型,原生多模态。其采用552B MoE架构和Causal-Encoder-Decoder,输入/输出仅激活8B/16B;KV Cache需求降至前代1/4,推理成本显著下降,基准测试超V4 Pro。API已上线并降价,调用名改为deepseek-flash,旧版Flash及Pro将下线或路由至新模型。

DeepSeek近日发布开放平台公告,将于北京时间 2026年9月10日12:00起,调整flash系列模型定价,采用峰谷分时计费模式。 空闲时段单价:输入缓存命中0.02 元 / 百万Token,输入缓存未命中1元 / 百万Token,输出4元 / 百万Token;高峰时段价格为空闲时段的2倍。 高峰时段划定为北京时间周一至周五9:00-12:00、14:00-18:00,其余时间均为空闲时段。对比旧价,本次降价幅度明显。

DeepSeek V4.1 Flash多模态超Pro;Suno v6支持图/视频/语音转音乐与精准编辑;AMD PRO 495将推超20款迷你主机;Prime Video上线AI口型同步;原神声音被仿冒获赔75万;OpenAI调整ChatGPT广告屏蔽竞品并开放GPT-5.6/6语音;Kimi联合金山云等进军企业市场。

本期AI日报:OpenAI上线GPT-Live-1 API,支持打断与工具调用;DeepSeek V4.1-Flash登陆WorkBuddy免费试用;谷歌推出Gemini Windows应用;蚂蚁集团称智能体商业“ChatGPT时刻”已至;环球音乐联手ElevenLabs共建正版AI音乐平台;SpaceX AI直播用Grok Bot三天建公司;商汤“小浣熊”移动端上线;支付宝升级AI钱包与三大“AI收”能力。

最近,大模型厂商集体看向了“Flash”。 变化可以从7月份的一个发布日开始追溯,7月21日,Google DeepMind一口气端出三款Flash模型,但旗舰Gemini3.5Pro缺席。 彼时,Gemini3.6Flash的表现被吐槽不如中国一线开源模型,但国内大模型厂商们却一同捕捉到Flash背后的产业信号,纷纷跟进布局这一效率架构路线。 十天后,国内大模型市场,DeepSeekV4Flash正式版上线并开源,284B总参数、每次�

DeepSeek API上线实验多模态模型V4-Flash-Vision-Exp,保留文本能力并补齐视觉理解,多模态Agent接近Claude Opus 4.8。支持截图、界面、图表解析及GUI智能体,适配工具调用,具备100万token上下文与思考模式。计费沿用V4-Flash,图片转token,缓存命中低至0.02元/百万token。官方提示实验版不建议生产使用,正式版时间未公布。

本期AI日报:DeepSeek开源3050亿视觉模型;Runway发布界面世界模型Solaris;讯飞星火X2.5端侧开源,支持百万Token;MiniMax新模型带动股价涨超20%;ChatGPT Ads年化收入破10亿美元;Instagram要求AI内容标注;化工大模型3.0 Pro发布;1200+智能体越狱攻击开源社区。

2026年生成式AI搜索成流量主战场,GEO监控是关键前提,但92%营销人员未建立系统监控。核心指标含品牌引用率、提及频次与位置、平台覆盖、竞争对标;面临平台碎片化、数据难量化、竞争情报缺失。GEOBase一站式监测12大AI引擎,量化品牌曝光、引用来源及对手表现,强调监控先行,助品牌在AI搜索从隐形走向显性。

作者与评论
内容主体继续静态化,互动层改为统一动态域。评论、点赞、收藏和关注作者后面都复用这套链路。
同类热榜

先做统一评论域,后面视频、图集、音乐和专题页直接复用。

评论区

优先展示置顶和高互动评论

更多快讯
ai

小米开源工业级目标说话人语音识别大模型 CocktailASR-1

小米开源工业级目标说话人语音识别大模型CocktailASR-1,瞄准多人同时讲话的“鸡尾酒会难题”。该模型改变传统ASR任务输入方式,可在嘈杂环境中精准锁定并识别目标说话人语

2026-09-11 18:05:00

ai

Anthropic 披露:今年已阻止多起利用 AI 研发生物武器的尝试

《金融时报》报道,Anthropic称今年已阻止多起科学家利用其AI开展可能助研生物武器的研究,列举五起案例,涉事者绕过管控、混淆目的以规避安全防护。事件凸显AI对公共安全的

2026-09-11 16:29:00

ai

蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至

2026年外滩大会上,蚂蚁集团CEO韩歆毅表示,智能体商业的“ChatGPT时刻”已全面到来。智能体正从能力展示工具迈入真实交易阶段,成为连接用户需求与真实供给的核心商业入口

2026-09-11 15:24:00

ai

告别卡顿与机械感:OpenAI 推出全双工语音模型 GPT-Live-1

OpenAI推出全双工语音模型GPT-Live-1,采用单一模型架构取代传统“语音转文字—推理—文字转语音”级联流程,显著降低延迟,实现类人流畅交互。该模型已上线API,面向开发者

2026-09-11 14:58:00

ai

DeepSeek V4.1-Flash登陆WorkBuddy,开启限时免费试用

AI服务平台WorkBuddy宣布全面上线DeepSeek最新V4.1-Flash模型,并开启两周免费试用,降低开发者与用户体验门槛。该模型已登陆DeepSeek API,具备原生多模态支持能力,用户调

2026-09-11 14:53:00

ai

OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者

OpenAI向开发者开放GPT-Live-1语音模型API,可将ChatGPT语音功能集成到应用中,构建全双工语音助手,支持实时听说并自然处理打断与停顿。语音前端每分钟0.05美元,后台复杂

2026-09-11 14:48:00