谷歌开发者博客

RSS: https://developers.googleblog.com/atom.xml
谷歌开发者官方博客,发布谷歌平台、API、开发工具与工程实践的更新与洞见。

在 TPU 上加速视频扩散的时空注意力

谷歌开发者博客介绍了 Sparse VideoGen(SVG) 算法,通过动态将注意力头路由到结构化的空间或时间稀疏掩码来解决高分辨率视频扩散模型中自注意力的二次延迟瓶颈。 为了让这种算法稀疏性在 TPU 硬件上真正提速,团队优化了 Splash Attention 内核:跳过空内存 tile、将精确坐标掩码限制在边界 tile、并把 token 内存布局重排为时间优先顺序以获得连续访问。 这些优化将稀疏掩码与硬件 tile 执行对齐,显著减少了无效矩阵运算,在 1440p 视频生成上实现了最高 1.69 倍的端到端推理加速。
评论点赞收藏刚刚

用 Google Cloud API Gateway 把 REST API 变成 MCP 工具

Google Cloud API Gateway 现在可充当原生远程 MCP 服务器,让 REST API 直接变成 AI agent 可调用的工具。开发者只需在 OpenAPI 3.x 规范里加上 x-google-api-management.mcp 等注解,网关就会自动把 MCP JSON-RPC 请求转成 REST 调用,原有认证、配额、日志策略无缝沿用到 agent 流量,无需自建中间件或新基础设施。 对已经在 Google Cloud 上跑 API 的团队来说,这是一条低改造成本接入 MCP 生态的现成路径;核心讨论点在于:注解即工具的范式能否成为 MCP 工具注册的主流方式,以及 Google 把网关层做成 MCP server 与各自建 sidecar 之间的权衡。
评论点赞收藏6 天前

在 MaxText 中复现 OLMo 3 7B 预训练:TPU 上大规模训练的案例分析

谷歌 MaxText 团队用 JAX/XLA 在 GCP TPU 上从零复现了 AI2 的 OLMo 3 7B 语言模型,预训练和中训练阶段所有留出评估均与 PyTorch GPU 原始结果精确对齐。 实现达到 57.4% 的模型算力利用率(MFU),并展示了基础设施可移植性:在运行中经历集群扩缩容和跨代 TPU 迁移时未改动配方即跑通。 最关键的一点是,该实验暴露了一个数据加载器隐性记忆 bug——它人为压低训练损失、制造了虚假的性能提升,若没有完整的留出验证就会误判为成功。 这是 TPU 大规模训练与框架迁移的实用参考案例。
评论点赞收藏6 天前

在 Antigravity SDK 中引入对本地 AI 模型的支持

谷歌 Antigravity SDK 新增本地 AI 模型支持:通过 LiteRT 可离线运行 Gemma 4 26B A4B 等模型执行 agentic 工作流,支持云端规划器 + 本地模型处理密集 token 任务(代码审计、打补丁)的混合编排架构;同时可直接接入 Ollama、vLLM 等 OpenAI 兼容推理服务器,便于构建隐私优先的本地自主工具。 内容短但信息点集中,对关注本地部署和隐私敏感场景的开发者有直接参考价值。
评论点赞收藏7 天前

Google Colab 正式纳入 Google AI 订阅计划

Google 将 Colab 接入 Google AI 订阅体系,付费用户可获得优先算力、高级 GPU 和后台长时训练能力。对经常用 Colab 跑长任务的开发者来说,这是一条有用的官方公告,但信息量有限,属于例行产品更新。
评论点赞收藏7 天前

为什么客户端 SDK 生成应该开源

Google 与 Speakeasy 合作,将其 OpenAPI 代码生成套件以 AGPLv3 协议开源。此举源于其原有一家专有 SDK 供应商突然关停。开源套件提供确定性多语言 SDK 生成器,原生支持严格类型和 SSE 流式响应,还包含 agent-native CLI 编译工具和文档 MCP 服务器生成工具。 工程团队可将这套工具直接集成进 CI 流水线,为自家 API 自动生成可靠客户端库,且对输出代码保留完整许可证控制权。
评论点赞收藏12 天前

Agent 异常检测功能现已在 Gemini 企业级 Agent 平台开启私有预览

Google 在 Gemini Enterprise Agent Platform 上新增 Agent Anomaly Detection 私有预览功能:一条 out-of-band 监控层,解析 OpenTelemetry trace 和 tool call,用轻量统计扫描 + LLM 推理的多级流水线捕捉 Agent 行为异常与策略违规,依据 OWASP Agentic Top 10。 开发者可在 Security Command Center 中处理告警,或调用暴露的 API 在 Agent 越过风险阈值时自动阻断后续工具调用。核心卖点是“不增加运行时延迟”。 属于 Agent 安全与可观测性方向的产品发布,技术信息量中等,讨论入口集中在 Agent 安全治理和延迟-安全权衡。
评论点赞收藏13 天前

构建零信任 AI Agent:判断意图而不只是语法

谷歌开发者博客介绍如何用 Gemini Enterprise Agent Platform 把 AI agent 的安全从构建期静态控制转为运行时动态治理。核心是三层托管防护:Model Armor 做边缘提示词筛查;语义治理策略把工具调用意图和业务规则匹配;Agent 异常检测识别多轮攻击。 平台层面统一执行策略,管理员可动态更新策略、拦截复杂攻击而无需改代码或重新部署 agent。属于典型的官方平台能力宣传文,信息基本正确但缺少独立技术判断或踩坑经验,讨论入口有限。
评论点赞收藏15 天前

在 TPUs 上用 Tunix 实现 LLM 自主后训练

谷歌推出 Tunix,用单个 Markdown 规格文件驱动 LLM 后训练的自主流程,在 TPU 上自动完成迭代训练。写一份规格说明书,系统自动生成训练配置、执行训练并返回结果,减少人工调参成本。
评论点赞收藏19 天前

谷歌发布 Kotlin ADK 1.0:用 Kotlin 构建生产级 AI Agent

谷歌正式发布 Kotlin Agent Development Kit 1.0,与 Python 和 Java 版本功能对齐。基于 KMP 构建,用 KSP 实现零反射的类型安全函数调用,支持人工介入工作流和上下文压缩。 Android 扩展覆盖本地模型(LiteRT-LM)、云端推理(Firebase AI)、会话持久化(Room)和语义记忆(AppSearch)。
评论点赞收藏21 天前

AI编程代理的评估方法论:用行为测试迭代与守护编码Agent

谷歌开发者博客提出用行为评估(单元测试式微检查)替代或补充SWE-bench等端到端基准,来诊断AI编程代理的失败根因。 行为评估聚焦离散中间动作——验证具体工具调用或文件修改,而非最终字符串相等。 配合宏观基准一起使用,团队可以更自信地迭代系统提示词和升级模型,避免回归风险。
评论点赞收藏21 天前

最强 AI Agent 挑战赛的四大工程模式

Google AI Agents Challenge 的获奖多智能体系统依赖四大工程模式而非单纯堆模型能力:双向 MCP 通信、异步事件总线并行执行、统一校验做模型降级、分层路由减少昂贵推理调用。 优先这些结构实践比线性 prompt 链更能构建低延迟、低成本、高韧性的 agent 工作流。
评论点赞收藏28 天前

用深度学习与 Keras 解码宇宙信号

Google Developers Blog 介绍用 Keras 深度学习模型解码宇宙粒子物理信号的方法。将天体物理与粒子物理交叉领域的数据输入神经网络,识别宇宙射线中的信号特征。
评论点赞收藏33 天前

如何在ADK中评估实时语音Agent

Google ADK新增语音Agent自动化测试,用Gemini TTS模拟真实对话并自动评分。支持定义评估场景和自然语言评分标准,可在ADK Web查看转录结果,也可接入CI/CD流水线。 适合需要把语音Agent从Demo推向生产环境的开发者。
评论点赞收藏36 天前

用 Google Agent Development Kit 构建零信任 AI 智能体

<p>构建能够动态改变生产状态的自主人工智能代理,需要从简单的系统提示式引导,迈向健全的零信任架构。为了保护 Google 代理开发套件 (ADK) 工作流免受提示注入和恶意执行的威胁,开发者必须为数据库写入操作实施基于硬件的加密签名,利用 gVisor 在内核级别实现沙盒隔离以支持动态代码执行,并通过确定性语义网关对 I/O 进行验证。<br><br>通过在基础设施层面严格遵守这些安全边界,您便能安全部署多工具人工智能代理,而无需担心未经授权的数据篡改或服务器被攻破。</p>
评论点赞收藏43 天前

HeyGen × Google Cloud:将Avatar IV带到TPU上

HeyGen将18B+参数的Avatar IV视频生成模型移植到Google Cloud Trillium(v6e)TPU上,通过torchax和XLA实现1.86倍实时流式加速。 工程团队在8芯片mesh上使用了FSDP和Ulysses序列并行,对all-to-all通信进行流水线化,对齐稀疏注意力块大小以消除mask填充,并用预计算的柯西-施瓦茨上界绕过softmax串行依赖。 这些自定义Pallas kernel和编译器优化在上线前通过了双层质量门控,确保像素级输出字节一致或数学等价。
评论点赞收藏48 天前

谷歌发布开源C++库Credentio,用于C2PA内容凭证本地验证

谷歌发布开源C++库Credentio,支持在客户端和服务器端本地验证C2PA内容凭证。多GB媒体文件完全本地处理,无需云端,避免延迟、带宽成本和数据隐私风险。 当前支持深度manifest解析和可配置信任列表集成,未来计划支持完整凭证生成和嵌入。
评论点赞收藏48 天前

为什么Go是AI辅助软件工程的理想语言

Google官方博客发文认为Go语言适合AI辅助软件工程,理由是Go的严格编译器、集成工具链和高可读性能让AI生成更规范、更易维护的代码。 文章未提供实测数据或具体案例,属于品牌向观点输出。
评论点赞收藏50 天前

用 Genkit 构建智能体全栈应用

Genkit 开源框架推出 Agents API,将对话 AI 的消息历史、工具循环和流式处理封装为统一接口,支持 TypeScript 和 Go 预览版。 API 提供灵活的服务器端或客户端状态持久化,支持历史分支、长时间运行任务和多 Agent 协作,通过统一协议连接前后端,并集成开发者 UI 用于测试和调试。
评论点赞收藏52 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。