DeepSeek 三种模式合一:V4.1 Flash 最快今日发布,V4 Pro 将下线
DeepSeek将快速、专家、识图三模式合并为统一智能模式,无需手动切换,可自动判断查询复杂度、识别图片并激活视觉能力,按任务难度调配处理。此前多模态模型V4-Flash-Visio

DeepSeek 将其整合为统一的智能模式:模型可自动检测查询复杂度,在检测到图片输入时激活视觉能力,并根据任务难度调整处理能力。在此之前,多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 已上线 DeepSeek API 平台,支持 Chat Completions、Messages、Responses 三种格式调用。
DeepSeek 昨日已发布预告,计划于北京时间 2026 年 9 月 10 日前后正式发布 V4.1 Flash 模型。经 DeepSeek 内部、外部多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro。
据 DeepSeek 在官方交流群内发布的通知,V4.1 Flash 的中间版本内测采用了新的模型结构,具备原生多模态支持,能力更强、速度更快、成本更低。
此外,DeepSeek 还宣布自 9 月 10 日 12:00 起调整 Flash 系列定价:空闲时段输入缓存命中单价 0.02 元、输入缓存未命中单价 1 元,输出单价 4 元;高峰时段价格为空闲时段价格的 2 倍。
9月10日,深度求索发布DeepSeek V4.1 Flash,系新一代最小尺寸模型,原生多模态。其采用552B MoE架构和Causal-Encoder-Decoder,输入/输出仅激活8B/16B;KV Cache需求降至前代1/4,推理成本显著下降,基准测试超V4 Pro。API已上线并降价,调用名改为deepseek-flash,旧版Flash及Pro将下线或路由至新模型。
DeepSeek近日发布开放平台公告,将于北京时间 2026年9月10日12:00起,调整flash系列模型定价,采用峰谷分时计费模式。 空闲时段单价:输入缓存命中0.02 元 / 百万Token,输入缓存未命中1元 / 百万Token,输出4元 / 百万Token;高峰时段价格为空闲时段的2倍。 高峰时段划定为北京时间周一至周五9:00-12:00、14:00-18:00,其余时间均为空闲时段。对比旧价,本次降价幅度明显。
DeepSeek V4.1 Flash多模态超Pro;Suno v6支持图/视频/语音转音乐与精准编辑;AMD PRO 495将推超20款迷你主机;Prime Video上线AI口型同步;原神声音被仿冒获赔75万;OpenAI调整ChatGPT广告屏蔽竞品并开放GPT-5.6/6语音;Kimi联合金山云等进军企业市场。
本期AI日报:OpenAI上线GPT-Live-1 API,支持打断与工具调用;DeepSeek V4.1-Flash登陆WorkBuddy免费试用;谷歌推出Gemini Windows应用;蚂蚁集团称智能体商业“ChatGPT时刻”已至;环球音乐联手ElevenLabs共建正版AI音乐平台;SpaceX AI直播用Grok Bot三天建公司;商汤“小浣熊”移动端上线;支付宝升级AI钱包与三大“AI收”能力。
最近,大模型厂商集体看向了“Flash”。 变化可以从7月份的一个发布日开始追溯,7月21日,Google DeepMind一口气端出三款Flash模型,但旗舰Gemini3.5Pro缺席。 彼时,Gemini3.6Flash的表现被吐槽不如中国一线开源模型,但国内大模型厂商们却一同捕捉到Flash背后的产业信号,纷纷跟进布局这一效率架构路线。 十天后,国内大模型市场,DeepSeekV4Flash正式版上线并开源,284B总参数、每次�
2026年生成式AI搜索成流量主战场,GEO监控是关键前提,但92%营销人员未建立系统监控。核心指标含品牌引用率、提及频次与位置、平台覆盖、竞争对标;面临平台碎片化、数据难量化、竞争情报缺失。GEOBase一站式监测12大AI引擎,量化品牌曝光、引用来源及对手表现,强调监控先行,助品牌在AI搜索从隐形走向显性。
DeepSeek API上线实验多模态模型V4-Flash-Vision-Exp,保留文本能力并补齐视觉理解,多模态Agent接近Claude Opus 4.8。支持截图、界面、图表解析及GUI智能体,适配工具调用,具备100万token上下文与思考模式。计费沿用V4-Flash,图片转token,缓存命中低至0.02元/百万token。官方提示实验版不建议生产使用,正式版时间未公布。
本期AI日报:DeepSeek开源3050亿视觉模型;Runway发布界面世界模型Solaris;讯飞星火X2.5端侧开源,支持百万Token;MiniMax新模型带动股价涨超20%;ChatGPT Ads年化收入破10亿美元;Instagram要求AI内容标注;化工大模型3.0 Pro发布;1200+智能体越狱攻击开源社区。
评论区
优先展示置顶和高互动评论
小米开源工业级目标说话人语音识别大模型 CocktailASR-1
小米开源工业级目标说话人语音识别大模型CocktailASR-1,瞄准多人同时讲话的“鸡尾酒会难题”。该模型改变传统ASR任务输入方式,可在嘈杂环境中精准锁定并识别目标说话人语
2026-09-11 18:05:00
Anthropic 披露:今年已阻止多起利用 AI 研发生物武器的尝试
《金融时报》报道,Anthropic称今年已阻止多起科学家利用其AI开展可能助研生物武器的研究,列举五起案例,涉事者绕过管控、混淆目的以规避安全防护。事件凸显AI对公共安全的
2026-09-11 16:29:00
蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至
2026年外滩大会上,蚂蚁集团CEO韩歆毅表示,智能体商业的“ChatGPT时刻”已全面到来。智能体正从能力展示工具迈入真实交易阶段,成为连接用户需求与真实供给的核心商业入口
2026-09-11 15:24:00
告别卡顿与机械感:OpenAI 推出全双工语音模型 GPT-Live-1
OpenAI推出全双工语音模型GPT-Live-1,采用单一模型架构取代传统“语音转文字—推理—文字转语音”级联流程,显著降低延迟,实现类人流畅交互。该模型已上线API,面向开发者
2026-09-11 14:58:00
DeepSeek V4.1-Flash登陆WorkBuddy,开启限时免费试用
AI服务平台WorkBuddy宣布全面上线DeepSeek最新V4.1-Flash模型,并开启两周免费试用,降低开发者与用户体验门槛。该模型已登陆DeepSeek API,具备原生多模态支持能力,用户调
2026-09-11 14:53:00
OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者
OpenAI向开发者开放GPT-Live-1语音模型API,可将ChatGPT语音功能集成到应用中,构建全双工语音助手,支持实时听说并自然处理打断与停顿。语音前端每分钟0.05美元,后台复杂
2026-09-11 14:48:00