新闻详情

谷歌上线Gemini Windows桌面应用,支持快捷键一键唤醒AI助手

谷歌正式发布Gemini Windows桌面应用,全面支持Win10/11,面向日常办公与多任务处理,提供高效AI交互体验。该应用引入全局快捷键,用户在任何界面按“Alt+Space”即可快速唤

新闻源ai2026-09-11 09:05:00真实数据

在便捷性方面,该桌面应用引入了全局快捷键支持。用户在任意工作界面中,只需通过“Alt+Space”快捷键即可快速唤起Gemini助手,直接在当前页面获取即时帮助,省去了频繁切换窗口的繁琐步骤。

在功能特性上,该应用具备强大的多步骤任务处理能力。它不仅可以深度联动Gmail、Google Drive等核心办公应用中的信息来自动生成内容,还支持通过Nano Banana生成图片,以及利用Gemini Omni生成视频,满足多元化的内容创作与生产需求。

谷歌官方表示,随着此次桌面向公众推出,未来还将陆续上线更多原生桌面功能,持续拓展AI在个人电脑端的应用边界。

本期AI日报:OpenAI上线GPT-Live-1 API,支持打断与工具调用;DeepSeek V4.1-Flash登陆WorkBuddy免费试用;谷歌推出Gemini Windows应用;蚂蚁集团称智能体商业“ChatGPT时刻”已至;环球音乐联手ElevenLabs共建正版AI音乐平台;SpaceX AI直播用Grok Bot三天建公司;商汤“小浣熊”移动端上线;支付宝升级AI钱包与三大“AI收”能力。

豆包输入法Windows版V0.9.0发布,适配Win10/11,实现Windows、macOS、iOS、Android、鸿蒙全平台覆盖。语音优先,长按右Alt唤起,支持多方言、中英混输、术语识别,弱网无网可用。键盘输入基于大模型语义联想、长句补全、随打随纠;支持云同步词库、跨设备粘贴;无广告,内存占用合理,可自定义设置。

天猫上线AI空间站整合阿里云等;谷歌Gemini 3.8 Flash发布但复杂任务不稳;百度基础模型部引北美专家升级文心;谷歌推Google Pics对标Canva;豆包上线多Agents与Mac操控;月之暗面递表港交所估值冲500亿美元;腾讯公益版WorkBuddy发布;Anthropic新模型Fable5.1编码强且最高降本45%。

Agora与谷歌Gemini合作发布Gemini3.5Transcribe与Agora Conversational AI集成方案,融合实时语音转写与RTC对话能力,助企业打造自然、可规模化语音智能体。此前与OpenAI推Realtime API。开发者可在Agents SDK灵活组合模型,后续支持智能转写优化CRM等场景,推动对话式AI实时可靠落地。

今日,豆包宣布工作任务模式继续上新,全新豆包虚拟桌面”已正式登陆Windows版,进一步提升豆包直接操作电脑的能力。 用户在豆包电脑端选择工作任务模式和本地电脑,再从技能栏中选择操作电脑”,完成授权后,豆包就可以在虚拟桌面中像人一样查看屏幕、移动鼠标、点击按钮、敲击键盘,继续帮用户处理电脑端的复杂任务。 据介绍,豆包虚拟桌面基于GUI能力运行,即

谷歌发布了 Gemini Omni1.1Flash 视频生成模型,将 AI 生成视频的能力进一步推向实用化。新模型最高可输出4K 分辨率的视频片段,并在生成控制上提供了更精细的手段,包括指定首尾帧、对已有场景进行扩展等,让创作者能够更精确地导演画面内容。 首尾帧指定功能的意义不容小觑。过去许多视频生成模型只能从单一提示词"凭空"生成,结果往往难以预测;而允许用户锁定�

本期AI日报:字节跳动发布办公智能体“豆包工作”整合飞书;ChatGPT上线自定义贴纸;千问APP接入阿里云Token Plan;Grok Build可调用本地浏览器;Harvey基于Kimi K3推法律模型Tenet,估值110亿美元;2025年约77%生物医学论文现AI代笔特征;ARIA封杀纯AI歌曲下周生效;谷歌测试Gemini新界面。

AI热点:腾讯开源770B混元Hy4 preview;谷歌Gemini Omni 1.1 Flash支持4K视频生成;Midjourney V8.2上线图像编辑;蚂蚁与中金推金融大模型;阿里Qoder升级为智能体工作台;谷歌搜索AI模式拓展机票酒店;小鹏二代VLA升级4D时空理解,安全能力增20倍;Anthropic发布MHS硬件标准进军物理AI。

Agora与Gemini达成合作,发布Gemini 3.5 Transcribe与Agora Conversational AI集成方案,融合实时语音转写与RTC对话能力,打造自然、实时、可落地的语音智能体。开发者可在SDK中灵活组合大模型与语音合成,未来将支持智能转写自动整理口语停顿、重复及数字日期格式,服务CRM等场景,推动对话AI迈向自然实时可靠交互。

作者与评论
内容主体继续静态化,互动层改为统一动态域。评论、点赞、收藏和关注作者后面都复用这套链路。
同类热榜

先做统一评论域,后面视频、图集、音乐和专题页直接复用。

评论区

优先展示置顶和高互动评论

相关推荐
ai

小米开源工业级目标说话人语音识别大模型 CocktailASR-1

小米开源工业级目标说话人语音识别大模型CocktailASR-1,瞄准多人同时讲话的“鸡尾酒会难题”。该模型改变传统ASR任务输入方式,可在嘈杂环境中精准锁定并识别目标说话人语

2026-09-11 18:05:00

ai

Anthropic 披露:今年已阻止多起利用 AI 研发生物武器的尝试

《金融时报》报道,Anthropic称今年已阻止多起科学家利用其AI开展可能助研生物武器的研究,列举五起案例,涉事者绕过管控、混淆目的以规避安全防护。事件凸显AI对公共安全的

2026-09-11 16:29:00

ai

蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至

2026年外滩大会上,蚂蚁集团CEO韩歆毅表示,智能体商业的“ChatGPT时刻”已全面到来。智能体正从能力展示工具迈入真实交易阶段,成为连接用户需求与真实供给的核心商业入口

2026-09-11 15:24:00

ai

告别卡顿与机械感:OpenAI 推出全双工语音模型 GPT-Live-1

OpenAI推出全双工语音模型GPT-Live-1,采用单一模型架构取代传统“语音转文字—推理—文字转语音”级联流程,显著降低延迟,实现类人流畅交互。该模型已上线API,面向开发者

2026-09-11 14:58:00

ai

DeepSeek V4.1-Flash登陆WorkBuddy,开启限时免费试用

AI服务平台WorkBuddy宣布全面上线DeepSeek最新V4.1-Flash模型,并开启两周免费试用,降低开发者与用户体验门槛。该模型已登陆DeepSeek API,具备原生多模态支持能力,用户调

2026-09-11 14:53:00

ai

OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者

OpenAI向开发者开放GPT-Live-1语音模型API,可将ChatGPT语音功能集成到应用中,构建全双工语音助手,支持实时听说并自然处理打断与停顿。语音前端每分钟0.05美元,后台复杂

2026-09-11 14:48:00