独立售卖页

DeepSeek V4.1 Flash发布:原生多模态视觉理解全面超越Pro版

深度求索发布轻量级多模态模型DeepSeek V4.1Flash,为系列最小尺寸。其采用552B参数MoE架构,创新引入Causal-Encoder-Decoder结构,具备原生视觉理解能力,旨在提升能力上限

单篇购买单篇购买文章2026-09-10 13:58:00
售卖与权益说明

当前内容支持公开查看。

人工智能www.chinaz.com购买后会立即写入“我的已购内容”,后续退款也回到统一内容权益链处理。
DeepSeek V4.1 Flash发布:原生多模态视觉理解全面超越Pro版

在核心架构方面,DeepSeek V4.1Flash 采用了552B 参数的 MoE(混合专家)架构,并创新性地引入了全新的 Causal-Encoder-Decoder 结构。由于采用了输入和输出不对称的设计,其输入激活仅有8B,输出激活为16B,使得整体成本显著低于同尺寸的已知模型。配合全新的预训练方式以及更大规模的强化学习后训练,该模型在各项基准测试中的智能水平成功超越了包括 DeepSeek V4Pro 在内的一众旗舰模型。

在效率优化与成本控制上,新一代模型大幅压缩了 KV Cache 缓存的大小。相比上一代模型,V4.1Flash 对高带宽内存(HBM)的需求减少至1/4,对固态硬盘(SSD)的需求减少至1/8。尤其在 Agent 使用场景中,由于上下文存储和缓存命中的费用占比较高,这一压缩大幅降低了相关任务的实际使用成本。据统计,相对于初代模型,其 KV Cache 已经缩减至原来的1/437。

随着新模型的正式上线,DeepSeek 对相关产品线和计费策略进行了系统性调整。DeepSeek V4.1Flash 已同步上线 DeepSeek API,用户只需将模型名称更改为 deepseek-flash 即可调用。旧版本的 V4Flash 与 V4Flash Vision Exp 已正式下线,而旧模型名(deepseek-v4-flash 和 deepseek-v4-flash-vision-exp)目前被暂时路由到 V4.1Flash。鉴于 V4.1Flash 在性能、费用、速度和总用时上已全面超越 V4Pro,官方计划有序下线 V4Pro 模型:在2026年9月14日12:00之后至 V4.1Pro 上线之前,所有访问 deepseek-v4-pro 的请求将全部被路由至 V4.1Flash 并按其单价计费。目前,腾讯旗下的 WorkBuddy、CodeBuddy 以及 OpenCode 等官方合作伙伴已全量接入该模型。

得益于底层架构的创新,DeepSeek V4.1Flash 能够以更低的成本服务海量用户,官方也顺势下调了该模型的 API 定价。同时,为了更合理地调配计算资源,新定价延续了峰谷定价机制,闲时价格为高峰时段的一半,以鼓励用户灵活调整任务执行时间,新价格已于2026年9月10日12:00正式生效。

9月10日,深度求索发布DeepSeek V4.1 Flash,系新一代最小尺寸模型,原生多模态。其采用552B MoE架构和Causal-Encoder-Decoder,输入/输出仅激活8B/16B;KV Cache需求降至前代1/4,推理成本显著下降,基准测试超V4 Pro。API已上线并降价,调用名改为deepseek-flash,旧版Flash及Pro将下线或路由至新模型。

DeepSeek近日发布开放平台公告,将于北京时间 2026年9月10日12:00起,调整flash系列模型定价,采用峰谷分时计费模式。 空闲时段单价:输入缓存命中0.02 元 / 百万Token,输入缓存未命中1元 / 百万Token,输出4元 / 百万Token;高峰时段价格为空闲时段的2倍。 高峰时段划定为北京时间周一至周五9:00-12:00、14:00-18:00,其余时间均为空闲时段。对比旧价,本次降价幅度明显。

DeepSeek V4.1 Flash多模态超Pro;Suno v6支持图/视频/语音转音乐与精准编辑;AMD PRO 495将推超20款迷你主机;Prime Video上线AI口型同步;原神声音被仿冒获赔75万;OpenAI调整ChatGPT广告屏蔽竞品并开放GPT-5.6/6语音;Kimi联合金山云等进军企业市场。

本期AI日报:OpenAI上线GPT-Live-1 API,支持打断与工具调用;DeepSeek V4.1-Flash登陆WorkBuddy免费试用;谷歌推出Gemini Windows应用;蚂蚁集团称智能体商业“ChatGPT时刻”已至;环球音乐联手ElevenLabs共建正版AI音乐平台;SpaceX AI直播用Grok Bot三天建公司;商汤“小浣熊”移动端上线;支付宝升级AI钱包与三大“AI收”能力。

最近,大模型厂商集体看向了“Flash”。 变化可以从7月份的一个发布日开始追溯,7月21日,Google DeepMind一口气端出三款Flash模型,但旗舰Gemini3.5Pro缺席。 彼时,Gemini3.6Flash的表现被吐槽不如中国一线开源模型,但国内大模型厂商们却一同捕捉到Flash背后的产业信号,纷纷跟进布局这一效率架构路线。 十天后,国内大模型市场,DeepSeekV4Flash正式版上线并开源,284B总参数、每次�

DeepSeek API上线实验多模态模型V4-Flash-Vision-Exp,保留文本能力并补齐视觉理解,多模态Agent接近Claude Opus 4.8。支持截图、界面、图表解析及GUI智能体,适配工具调用,具备100万token上下文与思考模式。计费沿用V4-Flash,图片转token,缓存命中低至0.02元/百万token。官方提示实验版不建议生产使用,正式版时间未公布。

本期AI日报:DeepSeek开源3050亿视觉模型;Runway发布界面世界模型Solaris;讯飞星火X2.5端侧开源,支持百万Token;MiniMax新模型带动股价涨超20%;ChatGPT Ads年化收入破10亿美元;Instagram要求AI内容标注;化工大模型3.0 Pro发布;1200+智能体越狱攻击开源社区。

2026年生成式AI搜索成流量主战场,GEO监控是关键前提,但92%营销人员未建立系统监控。核心指标含品牌引用率、提及频次与位置、平台覆盖、竞争对标;面临平台碎片化、数据难量化、竞争情报缺失。GEOBase一站式监测12大AI引擎,量化品牌曝光、引用来源及对手表现,强调监控先行,助品牌在AI搜索从隐形走向显性。