芦苇
发帖子
探索
今天发现最新帖子添加订阅
热门板块
🤖AI💡科技💻开发🧭产品🛠️工具
订阅
关注
下载芦苇 App ↗
我我的
进入阅读器模式

Proxying inference requests in 6ms with Pingora, Envoy, and Spanner

Modal,Modal,面向 AI 与数据团队的无服务器计算平台,让开发者无需管理基础设施就能大规模运行 CPU 与 GPU 密集型计算任务。关注
添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论

登录芦苇

登录后关注作者、收藏内容和参与讨论。

关于作者
ModalModal,面向 AI 与数据团队的无服务器计算平台,让开发者无需管理基础设施就能大规模运行 CPU 与 GPU 密集型计算任务。
相关文章
Keeping 20k GPUs healthy查看相关内容
AgentBrew: Offline Tool-Use Agent Learning from Raw Real-World Trajectories查看相关内容
用 DeepSeek/Qwen 生成 DSCI Pipeline 代码:Go 构建与 Docker 发布全流程查看相关内容