新闻详情

AI日报:腾讯发布开源旗舰模型Hy4preview;Midjourney V8.2上线图像编辑模型;谷歌Gemini Omni 1.1 Flash模型登场

AI热点:腾讯开源770B混元Hy4 preview;谷歌Gemini Omni 1.1 Flash支持4K视频生成;Midjourney V8.2上线图像编辑;蚂蚁与中金推金融大模型;阿里Qoder升级为智能体工作台;

新闻源ai2026-09-09 14:04:05真实数据
AI日报:腾讯发布开源旗舰模型Hy4preview;Midjourney V8.2上线图像编辑模型;谷歌Gemini Omni 1.1 Flash模型登场

腾讯混元发布开源旗舰模型Hy4preview,总参数770B、上下文1M,定位真实生产力场景。模型已在多个平台上线,并在软件工程、办公场景、游戏开发和科研领域取得显著进展。内部盲测数据显示其性能优于其他模型,同时通过开源策略推动行业趋势转变。

🚀 腾讯通过开源策略推动大模型竞争从参数竞赛转向生产力实效验证。

谷歌发布了全新的Gemini Omni1.1Flash视频生成AI模型,该模型在多模态领域竞争中实现了高清、长时视频生成的突破。其功能设计包括场景扩展、运镜控制以及参考视频片段的引入,提升了视频生成的灵活性和专业性。同时,模型提供了多种分辨率选项,并采用阶梯式定价策略,降低了使用门槛。

🎥 场景扩展功能允许用户在已有视频结尾处无缝衔接并继续生成后续画面,每次扩展步长为10秒,累计最长时长可达40秒。

📽 运镜控制通过指定镜头的起始帧与结束帧,实现平滑自然的转场效果与专业运镜。

📹 新模型支持引入最长3秒的参考视频片段,从而在构建新场景时精准维持画面的上下文背景与角色一致性。

Midjourney V8.2图像编辑模型的发布,标志着AI绘画领域的一次重要升级。该模型通过指令微调、多图参考、局部重绘等功能,为创作者提供了更加精准和可控的视觉创作体验。

🖌️ 局部重绘与画布扩展功能,让画面细节调整与尺寸延展变得轻而易举。

蚂蚁集团与中金公司合作推出金融增强大模型Ling-3.0-flash-Fin,该模型在专业金融语料训练下显著提升了投研能力,并在信息检索等核心能力上表现优异。同时,双方还推出了FinFIRST金融搜索基准并计划开源,以促进行业生态发展。

🧠 金融增强大模型Ling-3.0-flash-Fin通过专业金融语料训练,强化了投研核心能力。

🔍 模型聚焦信息检索等四大核心能力,表现突出且通用能力提升。

5、阿里发布全新 Qoder:从 AI 编程工具升级为面向所有人的智能体工作台

作者与评论
内容主体继续静态化,互动层改为统一动态域。评论、点赞、收藏和关注作者后面都复用这套链路。
同类热榜

先做统一评论域,后面视频、图集、音乐和专题页直接复用。

评论区

优先展示置顶和高互动评论

相关推荐
ai

小米开源工业级目标说话人语音识别大模型 CocktailASR-1

小米开源工业级目标说话人语音识别大模型CocktailASR-1,瞄准多人同时讲话的“鸡尾酒会难题”。该模型改变传统ASR任务输入方式,可在嘈杂环境中精准锁定并识别目标说话人语

2026-09-11 18:05:00

ai

Anthropic 披露:今年已阻止多起利用 AI 研发生物武器的尝试

《金融时报》报道,Anthropic称今年已阻止多起科学家利用其AI开展可能助研生物武器的研究,列举五起案例,涉事者绕过管控、混淆目的以规避安全防护。事件凸显AI对公共安全的

2026-09-11 16:29:00

ai

蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至

2026年外滩大会上,蚂蚁集团CEO韩歆毅表示,智能体商业的“ChatGPT时刻”已全面到来。智能体正从能力展示工具迈入真实交易阶段,成为连接用户需求与真实供给的核心商业入口

2026-09-11 15:24:00

ai

告别卡顿与机械感:OpenAI 推出全双工语音模型 GPT-Live-1

OpenAI推出全双工语音模型GPT-Live-1,采用单一模型架构取代传统“语音转文字—推理—文字转语音”级联流程,显著降低延迟,实现类人流畅交互。该模型已上线API,面向开发者

2026-09-11 14:58:00

ai

DeepSeek V4.1-Flash登陆WorkBuddy,开启限时免费试用

AI服务平台WorkBuddy宣布全面上线DeepSeek最新V4.1-Flash模型,并开启两周免费试用,降低开发者与用户体验门槛。该模型已登陆DeepSeek API,具备原生多模态支持能力,用户调

2026-09-11 14:53:00

ai

OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者

OpenAI向开发者开放GPT-Live-1语音模型API,可将ChatGPT语音功能集成到应用中,构建全双工语音助手,支持实时听说并自然处理打断与停顿。语音前端每分钟0.05美元,后台复杂

2026-09-11 14:48:00