Google 宣布 Gemini Interactions API 于 2026 年 6 月正式全面可用,作为构建 Gemini 模型和智能体的标准接口。该 API 统一了单轮生成、多模态理解及 Agent 工作流,支持服务端对话状态管理以降低 Token 成本,并提供后台执行功能。目前支持 Gemini 3.x/2.5 系列及 Deep Research 等智能体。旧版 generateContent API 仍受支持但被视为遗留接口。
Google 发布 Gemini Omni Flash 预览版,支持原生多模态视频生成与编辑。核心特性包括:文本/图片生成视频、基于参考图的主体保持、以及通过 Interactions API 实现的对话式迭代编辑(Stateful video editing)。该模型强调物理世界知识与叙事能力结合,提供 REST/SDK 代码示例及提示词指南。