Google推出Gemini Omni,定位为“any-to-any”的AI模型,面向企业处理跨文本、图像、音频、视频等输入与输出的任务。它与以文本对话为中心、或把语音识别、图像生成、视频理解拆成多个模块的AI方案不同,核心卖点是用统一模型承接多模态工作流,降低企业在客服、内容生产、数据分析等场景中的系统拼接成本。不过,素材未披露Gemini Omni的价格、客户、性能基准、上线时间和与OpenAI、Anthropic等模型的直接测试结果,企业采用时仍需关注数据权限、合规审计、推理成本和模型幻觉边界。据Venturebeat报道。
来源:Venturebeat
原始发布时间:Tue, 19 May 2026 17:37:00 GMT