
腾讯混元发布开源旗舰模型Hy4preview,总参数770B、上下文1M,定位真实生产力场景。模型已在多个平台上线,并在软件工程、办公场景、游戏开发和科研领域取得显著进展。内部盲测数据显示其性能优于其他模型,同时通过开源策略推动行业趋势转变。
🚀 腾讯通过开源策略推动大模型竞争从参数竞赛转向生产力实效验证。
谷歌发布了全新的Gemini Omni1.1Flash视频生成AI模型,该模型在多模态领域竞争中实现了高清、长时视频生成的突破。其功能设计包括场景扩展、运镜控制以及参考视频片段的引入,提升了视频生成的灵活性和专业性。同时,模型提供了多种分辨率选项,并采用阶梯式定价策略,降低了使用门槛。
🎥 场景扩展功能允许用户在已有视频结尾处无缝衔接并继续生成后续画面,每次扩展步长为10秒,累计最长时长可达40秒。
📽 运镜控制通过指定镜头的起始帧与结束帧,实现平滑自然的转场效果与专业运镜。
📹 新模型支持引入最长3秒的参考视频片段,从而在构建新场景时精准维持画面的上下文背景与角色一致性。
Midjourney V8.2图像编辑模型的发布,标志着AI绘画领域的一次重要升级。该模型通过指令微调、多图参考、局部重绘等功能,为创作者提供了更加精准和可控的视觉创作体验。
🖌️ 局部重绘与画布扩展功能,让画面细节调整与尺寸延展变得轻而易举。
蚂蚁集团与中金公司合作推出金融增强大模型Ling-3.0-flash-Fin,该模型在专业金融语料训练下显著提升了投研能力,并在信息检索等核心能力上表现优异。同时,双方还推出了FinFIRST金融搜索基准并计划开源,以促进行业生态发展。
🧠 金融增强大模型Ling-3.0-flash-Fin通过专业金融语料训练,强化了投研核心能力。
🔍 模型聚焦信息检索等四大核心能力,表现突出且通用能力提升。
5、阿里发布全新 Qoder:从 AI 编程工具升级为面向所有人的智能体工作台