AI日报:World Labs推多模态世界模型Atlas;WorkBuddy宣布开放平台上线;网信办重点整治AI换脸、魔改名著
本期AI日报:World Labs发布首个多模态世界模型Atlas,像素级镜头控制生成3D视频;腾讯WorkBuddy全面开放Agent基座;网信办整治AI换脸等乱象;努比亚与豆包合作推出AI智能体

1、World Labs推出全球首个多模态世界模型Atlas,像素级镜头控制拍出电影级“子弹时间”大片
World Labs推出的Atlas模型是全球首个多模态世界模型,其核心突破在于通过像素级的相机控制生成高质量图像和视频,并实现三维空间的精准重建。该模型不仅能够从多张图像中生成3D模型,还支持从文本生成图像和全景视图,展现出强大的世界生成、重建和模拟能力。
🖼️ Atlas模型能够以像素级精确的相机控制生成图像和视频帧,并在三维空间中完美重建。
🎥 该模型支持从单张或多张输入图像中输出明确的3D模型,重建效果超越许多顶级开源模型。
📽️ Atlas具备时空模拟功能,可重新构图视频以增强戏剧性视觉效果,并支持从文本生成图像和360度全景。
腾讯WorkBuddy宣布开放平台上线,全面开放Agent基座能力,旨在连接更多能力并走进更多场景,成为承载所有工具的平台。
3、网信办重点整治AI换脸、魔改名著等 豆包、元宝、千问、文心一言严格限制违规内容输出
中央网信办开展“清朗·整治AI应用乱象”专项行动,针对AI技术滥用问题进行深度治理,包括清理违法违规信息、查处违规账号、处置违规网站及应用程序等。多地网信部门推出精准治理举措,同时主流平台强化技术赋能,提升智能检测效率。此外,头部大模型平台严格审核原始语料内容,应用商店收紧开发者准入规范,以防范AI生成内容的违规传播。
🧠 AI技术滥用问题被重点整治,包括制作虚假信息、传播低俗内容等
🛡️ 多地网信部门推出精准治理举措,提升对违规内容的识别与处置能力
🔒 通过源头审核和平台技术升级,有效遏制AI生成内容的违规传播
努比亚NaviX Ultra作为全球首款AI智能体旗舰手机,通过将大模型智能体嵌入系统底层,实现了与传统AI手机的本质区别。其强大的智能操作能力和隐私安全保障,为用户带来了全新的使用体验。
评论区
优先展示置顶和高互动评论
小米开源工业级目标说话人语音识别大模型 CocktailASR-1
小米开源工业级目标说话人语音识别大模型CocktailASR-1,瞄准多人同时讲话的“鸡尾酒会难题”。该模型改变传统ASR任务输入方式,可在嘈杂环境中精准锁定并识别目标说话人语
2026-09-11 18:05:00
Anthropic 披露:今年已阻止多起利用 AI 研发生物武器的尝试
《金融时报》报道,Anthropic称今年已阻止多起科学家利用其AI开展可能助研生物武器的研究,列举五起案例,涉事者绕过管控、混淆目的以规避安全防护。事件凸显AI对公共安全的
2026-09-11 16:29:00
蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至
2026年外滩大会上,蚂蚁集团CEO韩歆毅表示,智能体商业的“ChatGPT时刻”已全面到来。智能体正从能力展示工具迈入真实交易阶段,成为连接用户需求与真实供给的核心商业入口
2026-09-11 15:24:00
告别卡顿与机械感:OpenAI 推出全双工语音模型 GPT-Live-1
OpenAI推出全双工语音模型GPT-Live-1,采用单一模型架构取代传统“语音转文字—推理—文字转语音”级联流程,显著降低延迟,实现类人流畅交互。该模型已上线API,面向开发者
2026-09-11 14:58:00
DeepSeek V4.1-Flash登陆WorkBuddy,开启限时免费试用
AI服务平台WorkBuddy宣布全面上线DeepSeek最新V4.1-Flash模型,并开启两周免费试用,降低开发者与用户体验门槛。该模型已登陆DeepSeek API,具备原生多模态支持能力,用户调
2026-09-11 14:53:00
OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者
OpenAI向开发者开放GPT-Live-1语音模型API,可将ChatGPT语音功能集成到应用中,构建全双工语音助手,支持实时听说并自然处理打断与停顿。语音前端每分钟0.05美元,后台复杂
2026-09-11 14:48:00