谷歌升级Gemini Omni,AI视频工具进入新阶段
生成式人工智能正在从“会聊天”走向“会表达、会制作、会参与工作流”。
据市场消息,谷歌推出Gemini Omni,并同步更新Google Vids个人数字形象功能。此次升级后的Google Vids将接入Gemini Omni能力,并向Google AI Pro、AI Ultra订阅用户以及Workspace企业客户开放。
这意味着谷歌正在进一步扩大AI在内容生产场景中的应用范围。过去,企业使用AI更多集中在文本生成、资料整理和简单问答,而视频制作仍然依赖专业团队和复杂工具。随着多模态模型能力提升,视频正在成为大型科技公司争夺企业AI入口的新战场。
Google Vids本身定位于企业视频创作工具,主要服务于营销、培训、内部沟通等场景。相比传统视频软件,它并不强调专业剪辑能力,而是希望通过AI降低制作门槛。用户可以利用文字描述生成视频框架,再结合企业素材完成内容制作。
此次加入Gemini Omni后,谷歌希望进一步提升这一流程的自动化程度。对于企业用户而言,制作一份产品介绍、员工培训视频或者市场宣传内容,过去可能需要文案、设计、视频编辑多个岗位协同完成,而AI工具正在尝试压缩其中大量重复环节。
个人数字形象功能也是此次更新中的一个重要方向。
数字人并不是新概念,过去几年已经有不少企业尝试利用虚拟主播、AI客服和数字员工降低运营成本。但早期产品普遍存在交互僵硬、表达缺乏自然感的问题。随着大模型在语音、图像和视频生成领域不断进步,数字形象开始从“展示工具”向“工作工具”转变。
企业场景可能是这类功能更现实的落点。例如,跨国公司可以通过AI数字形象制作多语言培训内容,销售团队可以快速生成面向不同客户的视频材料,市场部门也能减少重复制作成本。
谷歌推动Gemini进入Google Vids,也反映出其在企业AI市场中的竞争策略变化。
过去一年,微软凭借Office生态快速推广Copilot,将AI能力嵌入Word、Excel、Teams等高频办公软件。谷歌则依托Workspace体系,将Gemini能力覆盖邮件、文档、会议和内容生产场景。双方竞争的核心,已经不只是模型性能,而是谁能够成为企业员工每天打开的AI入口。
不过,企业级AI工具的普及仍然面临现实问题。视频生成涉及版权、企业数据安全、内容准确性等多个风险点。尤其是在商业环境中,一段看似流畅的视频,如果出现品牌信息错误或者数据泄露,带来的成本可能远高于制作效率提升带来的收益。
因此,大型企业在采用AI工具时,关注点正在从“能不能生成”转向“能不能可靠使用”。模型能力只是基础,真正决定商业价值的,是AI能否嵌入现有工作流程。
从行业发展趋势看,生成式AI正在逐渐成为企业软件的新一层交互方式。文字、图片、视频这些过去分散的生产工具,可能会被统一到更自然的AI工作界面中。
谷歌此次升级Google Vids,本质上是在争夺这一入口。未来企业员工面对的不一定是一套套复杂的软件,而可能是一个能够理解需求、调用工具并直接产出内容的智能助手。谁能率先把这种体验变成日常工作习惯,谁就更可能占据下一阶段企业AI市场的位置。