独立售卖页

谷歌上线Gemini Windows桌面应用,支持快捷键一键唤醒AI助手

谷歌正式发布Gemini Windows桌面应用,全面支持Win10/11,面向日常办公与多任务处理,提供高效AI交互体验。该应用引入全局快捷键,用户在任何界面按“Alt+Space”即可快速唤

单篇购买单篇购买文章2026-09-11 09:05:00
售卖与权益说明

当前内容支持公开查看。

人工智能www.chinaz.com购买后会立即写入“我的已购内容”,后续退款也回到统一内容权益链处理。

在便捷性方面,该桌面应用引入了全局快捷键支持。用户在任意工作界面中,只需通过“Alt+Space”快捷键即可快速唤起Gemini助手,直接在当前页面获取即时帮助,省去了频繁切换窗口的繁琐步骤。

在功能特性上,该应用具备强大的多步骤任务处理能力。它不仅可以深度联动Gmail、Google Drive等核心办公应用中的信息来自动生成内容,还支持通过Nano Banana生成图片,以及利用Gemini Omni生成视频,满足多元化的内容创作与生产需求。

谷歌官方表示,随着此次桌面向公众推出,未来还将陆续上线更多原生桌面功能,持续拓展AI在个人电脑端的应用边界。

本期AI日报:OpenAI上线GPT-Live-1 API,支持打断与工具调用;DeepSeek V4.1-Flash登陆WorkBuddy免费试用;谷歌推出Gemini Windows应用;蚂蚁集团称智能体商业“ChatGPT时刻”已至;环球音乐联手ElevenLabs共建正版AI音乐平台;SpaceX AI直播用Grok Bot三天建公司;商汤“小浣熊”移动端上线;支付宝升级AI钱包与三大“AI收”能力。

豆包输入法Windows版V0.9.0发布,适配Win10/11,实现Windows、macOS、iOS、Android、鸿蒙全平台覆盖。语音优先,长按右Alt唤起,支持多方言、中英混输、术语识别,弱网无网可用。键盘输入基于大模型语义联想、长句补全、随打随纠;支持云同步词库、跨设备粘贴;无广告,内存占用合理,可自定义设置。

天猫上线AI空间站整合阿里云等;谷歌Gemini 3.8 Flash发布但复杂任务不稳;百度基础模型部引北美专家升级文心;谷歌推Google Pics对标Canva;豆包上线多Agents与Mac操控;月之暗面递表港交所估值冲500亿美元;腾讯公益版WorkBuddy发布;Anthropic新模型Fable5.1编码强且最高降本45%。

Agora与谷歌Gemini合作发布Gemini3.5Transcribe与Agora Conversational AI集成方案,融合实时语音转写与RTC对话能力,助企业打造自然、可规模化语音智能体。此前与OpenAI推Realtime API。开发者可在Agents SDK灵活组合模型,后续支持智能转写优化CRM等场景,推动对话式AI实时可靠落地。

今日,豆包宣布工作任务模式继续上新,全新豆包虚拟桌面”已正式登陆Windows版,进一步提升豆包直接操作电脑的能力。 用户在豆包电脑端选择工作任务模式和本地电脑,再从技能栏中选择操作电脑”,完成授权后,豆包就可以在虚拟桌面中像人一样查看屏幕、移动鼠标、点击按钮、敲击键盘,继续帮用户处理电脑端的复杂任务。 据介绍,豆包虚拟桌面基于GUI能力运行,即

谷歌发布了 Gemini Omni1.1Flash 视频生成模型,将 AI 生成视频的能力进一步推向实用化。新模型最高可输出4K 分辨率的视频片段,并在生成控制上提供了更精细的手段,包括指定首尾帧、对已有场景进行扩展等,让创作者能够更精确地导演画面内容。 首尾帧指定功能的意义不容小觑。过去许多视频生成模型只能从单一提示词"凭空"生成,结果往往难以预测;而允许用户锁定�

本期AI日报:字节跳动发布办公智能体“豆包工作”整合飞书;ChatGPT上线自定义贴纸;千问APP接入阿里云Token Plan;Grok Build可调用本地浏览器;Harvey基于Kimi K3推法律模型Tenet,估值110亿美元;2025年约77%生物医学论文现AI代笔特征;ARIA封杀纯AI歌曲下周生效;谷歌测试Gemini新界面。

AI热点:腾讯开源770B混元Hy4 preview;谷歌Gemini Omni 1.1 Flash支持4K视频生成;Midjourney V8.2上线图像编辑;蚂蚁与中金推金融大模型;阿里Qoder升级为智能体工作台;谷歌搜索AI模式拓展机票酒店;小鹏二代VLA升级4D时空理解,安全能力增20倍;Anthropic发布MHS硬件标准进军物理AI。

Agora与Gemini达成合作,发布Gemini 3.5 Transcribe与Agora Conversational AI集成方案,融合实时语音转写与RTC对话能力,打造自然、实时、可落地的语音智能体。开发者可在SDK中灵活组合大模型与语音合成,未来将支持智能转写自动整理口语停顿、重复及数字日期格式,服务CRM等场景,推动对话AI迈向自然实时可靠交互。