Openrouter

OpenRouter,统一的 LLM API 网关,提供对数十家供应商的数百种大语言模型的统一接入与切换。

OpenRouter:服务器工具市场

OpenRouter 上线服务器工具市场,为 LLM 提供统一的工具调用层:网页搜索、代码执行沙箱、图像生成、时间查询、多模型编排(调用更强模型做中间推理、用小模型做任务委派、多模型结果聚合合成)、Anthropic 风格 bash 工具、按需加载工具定义、V4A 格式文件编辑提案等。 文章按 Orchestration / Utilities / Media / Code & execution / Search & web 等类别列出工具清单,可对比不同 provider 的定价与使用方式,并指向 OpenRouter 官方文档中的服务器工具指南。 整体是平台功能介绍,信息量中等,适合正在找 LLM 工具接入方案的开发者,但缺少个人实践、踩坑记录或技术深度分析。
评论点赞收藏6 天前

OpenRouter 批量 API:打包请求享半价推理

OpenRouter 推出 Batch API,把不紧急的推理请求打包提交,供应商在 24 小时窗口内择机完成,费用通常打 5 折甚至更低,已覆盖 70+ 模型。 内测两周跑了 23 万+ 批次:中位完成时间仅 7 分钟,90% 在一小时内,99% 在 10.3 小时内。实际排队时间更取决于提交时段而非请求量——美西凌晨 5 点到中午最慢,同一批 1000+ 请求在午夜到中午可能要 6.8 小时,而其他时段 P90 低于 1.1 小时。 支持 chat completions、responses、messages、embeddings 等请求形态,BYOK 可用,每行结果独立返回(少量坏数据不会拖垮整批),结果保留 30 天,可记日志。 局限:图片/文件需公网 URL,音视频与 OpenRouter 自带 web search 插件不可用,web search 调用仍按标准价计费。适合标注语料、回填 embeddings、跑 eval、批量摘要工单等异步工作负载。
评论点赞收藏8 天前

Union Alpha 是 Unbiased 的 Pareto

这是 OpenRouter 平台为 Unbiased 模型 Pareto 生成的模型详情页,列出唯一提供方、定价(输入 $2.50、输出 $7.50、缓存 $0.25)、性能指标(吞吐量/延迟/TTFT)等,但吞吐量、延迟、TTFT 字段均为空。 Uptime 部分显示过去 3 天可用性 0.00%,Apps 和 Activity 模块均提示数据不足。页面给出 OpenAI 兼容 API 的快速调用示例,包括 OpenRouter SDK、curl 流式调用,以及 endpoints、responses、anthropic-messages 等接口说明和参数表。 整体更像平台自动生成的模型卡片页,信息稀疏、无实质技术讨论。
评论点赞收藏12 天前

区域路由:让数据留在美国或欧盟

OpenRouter 推出 US In-Region Routing,补齐去年10月上线的 EU 区域路由,保证 AI 请求在指定区域内解密、处理和推理。通过 或 端点发送请求,仅需切换 base URL,密钥和模型 ID 不变;若区域内无可用模型则返回 404,不会跨区路由。 功能支持通过 Guardrails 强制工作区/团队/API key 限定区域,可用 Business/Enterprise 计划。文章还区分了“仅推理区域路由”和“端到端区域路由”:后者确保 prompt 全程在区域内,包括 server tools(如 web search),不符合区域的工具会被禁用而非回退到全球基础设施。 值得注意的一点:区域路由让企业能在合规前提下使用中国开源模型——DeepSeek V4 Pro、Kimi K3、GLM 5.2 通过 Baseten、Fireworks、Azure 等美国或欧盟数据中心托管,请求解密和推理均在当地完成,模型实验室不直接参与。
评论点赞收藏13 天前

OpenRouter 上线匿名厂商的前沿多模态模型 Union Alpha

OpenRouter 上线了一个名为 Union Alpha 的"隐身模型"(stealth model),由匿名第三方提供,定位为面向研究、编码和 agentic 工作流的多模态模型,声称在通用任务上达到前沿水平。 该模型于 2026-09-16 发布,免费使用,上下文 262K,支持工具调用和结构化输出,输入支持文本和图片。页面显示其 Top 应用包括 omp、Velocity CLI、Claude Code、Zoaholic、Hermes Agent 等,说明已有实际生产流量。 同系列还有 Ox Alpha(1M 上下文,侧重编码和长程推理)。核心看点是"匿名前沿模型"这一稀缺信息差,身份不明本身就是讨论入口。
评论点赞收藏14 天前

DeepSeek V4.1 Flash模型上线OpenRouter:高性能低成本推理新选择

DeepSeek发布V4.1 Flash模型,定位为V4.1家族的成本优化版本,官方声称性能超越前代旗舰V4 Pro。采用稀疏混合专家架构,284B总参数中仅激活13B,支持1M上下文窗口。 定价为输入$0.15/M tokens、输出$0.60/M tokens,主要面向编码、推理和长期代理工作流。OpenRouter提供三个提供商路由选项,加权平均实际支付价格显著低于标价。
评论点赞收藏20 天前

OpenRouter 上线 GPT-6 Astra:OpenAI 旗舰模型定价与性能一览

OpenRouter 上线 OpenAI GPT-6 Astra 模型,输入$10/M、输出$50/M,105万 token 上下文。Benchmark 显示编码能力超 96% 模型,科学推理 GPQA Diamond 达 96.1%。 主要提供商有 OpenAI 和 Azure,OpenAI Flex 性价比最高(输入$5/M)。Hermes Agent、Cursor、Codex 是调用量最大的三个应用。
评论点赞收藏25 天前

Inception Mercury 2.5 预览:最快推理扩散语言模型

Inception 发布 Mercury 2.5 Preview,采用扩散语言模型(dLLM)架构,在标准 GPU 上达到 1,107 tokens/sec,号称最快推理 LLM。 相比 Mercury 2 智能提升 10+ 分,质量接近 GPT-5.6 Luna、Gemini 3.5 Flash-Lite、Claude Haiku 4.5。260K 上下文,支持可调推理级别、并行工具调用、JSON 输出。 OpenRouter 定价 $0.04/$0.15 per 1M tokens(限时 80 折)。
评论点赞收藏28 天前

GPT 5.6 大幅降价:用量暴涨背后的杰文斯悖论

OpenAI 在 7 月 27 日至 8 月 14 日对 Terra 和 Luna 模型推出大幅折扣,Terra 日 Token 用量涨 5.6 倍,Luna 涨 13.8 倍,而维持原价的 Sol 仅涨 1.1 倍。 OpenRouter 数据显示,折扣带来的市场份额增量中约四分之三来自其他厂商,OpenAI 内部模型之间几乎没有互相蚕食。折扣结束后,约 32% 的试用用户继续使用该模型,且留存用户的日均用量远高于普通试用用户。
评论点赞收藏33 天前

腾讯 Hy4 preview 模型发布

腾讯发布 Hy4 preview 模型,770B 总参数、49B 活跃参数的 MoE 架构,面向编码代理和复杂工具调用场景,1M 上下文窗口,输入 $0.834/M、输出 $2.501/M tokens。
评论点赞收藏33 天前

Ox Alpha:OpenRouter 上的免费匿名推理模型

OpenRouter 上线 Ox Alpha,一个由匿名第三方开发的免费推理模型,主打代码生成和长期智能体工作负载。100 万 token 上下文窗口,支持文本、图像和视频输入,当前免费使用。 主要被 omp、Hermes Agent、Claude Code 等编程工具调用。
评论点赞收藏40 天前

OpenRouter 加入 Stripe

OpenRouter 加入 Stripe,后者被称为"LLM 界的 Stripe"。OpenRouter 日处理 10+ 万亿 token,支持 400+ AI 模型,服务超 1000 万开发者和公司。 交易预计数周内完成,产品、使命和路线图保持不变。
评论点赞收藏42 天前

GPT-5.6 Sol 降价50%

OpenAI GPT-5.6 Sol 旗舰模型在 OpenRouter 降价50%,输入降至$2.50/百万token,输出$15/百万token。1M上下文,适合复杂推理、编码和 agentic 工作流。 多提供商可选,OpenAI直连延迟最低3.4秒。
评论点赞收藏43 天前

OpenRouter 上线 Grok 4.6:定价、性能与接入指南

OpenRouter 上线 Grok 4.6 模型,提供三种路由模式(Balanced/Nitro/Exacto)和 OpenAI 兼容 API。加权平均输入价格约 $0.89/M tokens,输出约 $6.12/M tokens,P50 延迟 0.53s,吞吐量 130 tok/s,近30天可用性 100%。 主要应用场景包括编码代理和消息集成自动化。
评论点赞收藏49 天前

OpenRouter:基于市场智慧的新Auto路由升级

OpenRouter升级了Auto路由,用过去7天55万亿token的周花费数据驱动模型选择。新路由在多个基准测试中成本降低,MMLU Pro知识任务从86.6%降至85.2%,但SWE-Atlas编码任务从2.4%大幅提升至60.7%。 支持cost_tier参数(low/medium/high/xhigh/max)控制成本与质量的权衡。
评论点赞收藏51 天前

OpenRouter Ori Harness:一键配置多模型编程助手

OpenRouter 推出 ori CLI 工具,一条命令即可为 Claude Code、Codex、OpenCode、Hermes 等编程助手自动配置 OpenRouter 代理,省去手动设置十几个环境变量。 工具搜索功能可节省近半系统提示词 token,但多数开源模型暂不支持该功能,ori 会根据模型自动切换最优配置。
1 条评论点赞收藏56 天前

OpenRouter 推出 Auto Router Beta:按任务自动路由模型

OpenRouter推出Auto Router Beta,按任务自动路由到最热门模型,按成本质量比定价。用户可在Activity页面查看每次请求实际使用的模型,定价与路由目标模型一致。 支持自定义路由模型列表,另有Pareto Code路由方式可选。
评论点赞收藏57 天前

OpenRouter Ori Eval:用你的真实场景证明哪个模型最适合

OpenRouter推出Ori Eval,帮开发者在自己代码和提示词上实测选模型。工具自动扫描代码库找到所有模型调用点,通过对话了解你对准确率、速度、成本的偏好后生成eval文件,支持CI集成防止模型回归。 覆盖500+模型,输出对比表格含bug捕获率、延迟、单价等指标。
评论点赞收藏58 天前

Qwen 3.8 Max 登陆 OpenRouter

OpenRouter 上线了 Qwen3 系列多款模型,包括 Qwen3-Max、Qwen3-Next 80B、Qwen3-VL 多规格版本及 Qwen3-ASR-Flash 语音识别模型。 Qwen3-Max 在推理、指令遵循、多语言和 RAG 方面相比 2025 年 1 月版本有显著提升,支持 100+ 语言。Qwen3-Next 80B Thinking 默认输出思维链,适合复杂多步推理和 Agent 场景。
评论点赞收藏58 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。