在人工智能技术日新月异的今天,我们早已习惯了与基于文本的聊天机器人进行交互,或是观看静态的 AI 生成的图像。然而,Google 近期推出的一项更新正在打破这种“静默”的交互模式,将 AI 的表现力推向了一个全新的维度——让 AI “有了脸面”。
Google 在最新的 Gemini 3.8 Live 更新中引入了一项名为“Live Avatar”(实时化身)的革命性功能。这项技术允许用户在与 AI 模型进行实时对话的同时,看到对方以动画化的数字人形象做出回应。这不再仅仅是文字的打字机效果,而是真正的视频级实时交互体验。
据官方介绍,Live Avatar 能够实现高精度的口型同步,并能根据对话的语境展示丰富的面部表情。用户可以看到 AI 仿佛真的在倾听、思考并做出反应,这种视觉反馈极大地增强了人机互动的沉浸感和真实感。值得注意的是,该功能支持在 97 种不同的面部状态和表情之间进行平滑过渡,这意味着 AI 的“情绪”可以被更细腻地表达出来。
然而,这项极具突破性的技术目前仅向 Gemini Enterprise(企业版)客户开放。这反映了 Google 在商业化策略上的谨慎与布局。生成高质量的实时视频内容需要强大的算力支持和复杂的渲染技术,且对数据的安全性和品牌形象的定制化有较高要求。对于企业用户而言,这不仅是一个聊天工具,更是一个可以定制化、可控的品牌代言人,可用于客户服务、教育培训或虚拟会议等场景。
从行业角度来看,Gemini 3.8 Live 的发布标志着 AI 视频生成技术正从“离线生成”向“在线实时交互”迈进。这不仅是技术能力的体现,也是对“多模态 AI”未来的探索。随着算力的提升和算法的优化,我们或许很快就能在消费级产品中看到类似功能的普及,届时,AI 将不再只是屏幕背后默默运行的代码,而是真正拥有“面孔”和“声音”的智能伴侣。
综上所述,Google 通过 Live Avatar 功能,再次巩固了其在生成式 AI 领域的领先地位。虽然目前该功能仍处于企业级服务阶段,但它无疑为未来的 AI 交互范式提供了一个极具潜力的范本。
信息来源:The Verge
原文链接:https://www.theverge.com/tech/1000328/google-gemini-ai-live-avatar-face
信息来源:The Verge,原文链接:https://www.theverge.com/tech/1000328/google-gemini-ai-live-avatar-face
封面图片来源:Unsplash / 摄影师 MARCO
