新闻详情

AI日报:DeepSeek V4.1 Flash发布;Suno v6支持图片、视频一键变音乐;ChatGPT语音模式全面开放GPT-6 Astra调用

DeepSeek V4.1 Flash多模态超Pro;Suno v6支持图/视频/语音转音乐与精准编辑;AMD PRO 495将推超20款迷你主机;Prime Video上线AI口型同步;原神声音被仿冒获赔75万;OpenA

新闻源ai2026-09-08 15:04:05真实数据
AI日报:DeepSeek V4.1 Flash发布;Suno v6支持图片、视频一键变音乐;ChatGPT语音模式全面开放GPT-6 Astra调用

DeepSeek V4.1Flash作为最小尺寸模型,具备原生多模态视觉理解能力,通过创新架构和优化设计,在性能、效率和成本控制上全面超越前代模型。

💰 新模型定价下调,采用峰谷定价机制,鼓励用户灵活调整任务时间。

2、Suno v6 正式上线:图片、视频、语音备忘录一键变音乐,精准编辑歌曲成现实

Suno v6 是 Suno 平台推出的全新一代 AI 音乐生成模型,支持多模态输入并提供精准的局部编辑功能,同时包含三个版本以满足不同创作者的需求。

🎹 提供精准局部编辑功能,可修改歌曲的特定部分而不影响其他内容。

🚀 三大模型矩阵满足不同创作者需求,包括旗舰版、探索版和高效版。

AMD 在锐龙 AI Max 媒体沙龙上透露,将有超过20款基于锐龙 AI Max+ PRO 495 处理器平台的设备上市,其中大多数为迷你主机,只有惠普例外,其将推出基于 Gorgon Halo 的新一代 ZBook Ultra 移动工作站。AMD 显然希望借助 PRO 495 推动高性能小钢炮主机市场的发展。

亚马逊Prime Video正式上线全新的AI口型同步功能,能够精准对齐演员的嘴部动作与真人配音的音轨,彻底解决跨语言配音时画面与声音脱节的问题。该技术已应用于《贵族高中:我们之间的鸿沟》英语配音版,并计划扩展到更多影视作品中。同时,生成式AI在视频领域的应用也在加速,如Meta和YouTube推出了人工智能自动配音功能并自带“口型同步”选项。

🎬 亚马逊Prime Video上线AI口型同步功能,解决跨语言配音画面与声音脱节问题。

📺 该技术率先应用于德国剧集《贵族高中:我们之间的鸿沟》英语配音版,未来将扩展至更多影视作品。

🤖 生成式AI在视频领域快速普及,Meta和YouTube也推出人工智能自动配音功能并自带“口型同步”选项。

上海市浦东新区人民法院宣判了首例涉AI声音仿冒不正当竞争纠纷案,米哈游因《原神》角色声音被AI变声软件未经授权使用而获赔75万元。

作者与评论
内容主体继续静态化,互动层改为统一动态域。评论、点赞、收藏和关注作者后面都复用这套链路。
同类热榜

先做统一评论域,后面视频、图集、音乐和专题页直接复用。

评论区

优先展示置顶和高互动评论

相关推荐
ai

小米开源工业级目标说话人语音识别大模型 CocktailASR-1

小米开源工业级目标说话人语音识别大模型CocktailASR-1,瞄准多人同时讲话的“鸡尾酒会难题”。该模型改变传统ASR任务输入方式,可在嘈杂环境中精准锁定并识别目标说话人语

2026-09-11 18:05:00

ai

Anthropic 披露:今年已阻止多起利用 AI 研发生物武器的尝试

《金融时报》报道,Anthropic称今年已阻止多起科学家利用其AI开展可能助研生物武器的研究,列举五起案例,涉事者绕过管控、混淆目的以规避安全防护。事件凸显AI对公共安全的

2026-09-11 16:29:00

ai

蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至

2026年外滩大会上,蚂蚁集团CEO韩歆毅表示,智能体商业的“ChatGPT时刻”已全面到来。智能体正从能力展示工具迈入真实交易阶段,成为连接用户需求与真实供给的核心商业入口

2026-09-11 15:24:00

ai

告别卡顿与机械感:OpenAI 推出全双工语音模型 GPT-Live-1

OpenAI推出全双工语音模型GPT-Live-1,采用单一模型架构取代传统“语音转文字—推理—文字转语音”级联流程,显著降低延迟,实现类人流畅交互。该模型已上线API,面向开发者

2026-09-11 14:58:00

ai

DeepSeek V4.1-Flash登陆WorkBuddy,开启限时免费试用

AI服务平台WorkBuddy宣布全面上线DeepSeek最新V4.1-Flash模型,并开启两周免费试用,降低开发者与用户体验门槛。该模型已登陆DeepSeek API,具备原生多模态支持能力,用户调

2026-09-11 14:53:00

ai

OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者

OpenAI向开发者开放GPT-Live-1语音模型API,可将ChatGPT语音功能集成到应用中,构建全双工语音助手,支持实时听说并自然处理打断与停顿。语音前端每分钟0.05美元,后台复杂

2026-09-11 14:48:00