DeepSeek V4 Pro 正式版发布:1.6T 参数 MoE 模型,支持百万 token 上下文DeepSeek 发布 V4 Pro 正式版,1.6T 总参数 MoE 架构,49B 激活参数,支持 100 万 token 上下文和可调节推理模式。API 定价输入 0.435 美元/百万 token,面向代码生成、复杂推理和长程 agent 工作流。 评论点赞收藏3 天前
OpenRouter 上线 Grok 4.6:定价、性能与接入指南OpenRouter 上线 Grok 4.6 模型,提供三种路由模式(Balanced/Nitro/Exacto)和 OpenAI 兼容 API。加权平均输入价格约 $0.89/M tokens,输出约 $6.12/M tokens,P50 延迟 0.53s,吞吐量 130 tok/s,近30天可用性 100%。主要应用场景包括编码代理和消息集成自动化。 评论点赞收藏3 天前
字节 Seed-2.0-Code 模型上线 OpenRouter:专注 Agentic CodingOpenRouter 上线字节跳动 Seed-2.0-Code 模型,主打 agentic coding 场景。输入 0.76 美元/M tokens,输出 3.36 美元/M tokens,延迟 1.32 秒,吞吐量 46 tok/s。支持 reasoning tokens 和流式输出,OpenAI 兼容 API。 评论点赞收藏4 天前
OpenRouter:基于市场智慧的新Auto路由升级OpenRouter升级了Auto路由,用过去7天55万亿token的周花费数据驱动模型选择。新路由在多个基准测试中成本降低,MMLU Pro知识任务从86.6%降至85.2%,但SWE-Atlas编码任务从2.4%大幅提升至60.7%。支持cost_tier参数(low/medium/high/xhigh/max)控制成本与质量的权衡。 评论点赞收藏5 天前
OpenRouter Ori Harness:一键配置多模型编程助手OpenRouter 推出 ori CLI 工具,一条命令即可为 Claude Code、Codex、OpenCode、Hermes 等编程助手自动配置 OpenRouter 代理,省去手动设置十几个环境变量。工具搜索功能可节省近半系统提示词 token,但多数开源模型暂不支持该功能,ori 会根据模型自动切换最优配置。 1 条评论点赞收藏11 天前
OpenRouter 推出 Auto Router Beta:按任务自动路由模型OpenRouter推出Auto Router Beta,按任务自动路由到最热门模型,按成本质量比定价。用户可在Activity页面查看每次请求实际使用的模型,定价与路由目标模型一致。支持自定义路由模型列表,另有Pareto Code路由方式可选。 评论点赞收藏11 天前
OpenRouter Ori Eval:用你的真实场景证明哪个模型最适合OpenRouter推出Ori Eval,帮开发者在自己代码和提示词上实测选模型。工具自动扫描代码库找到所有模型调用点,通过对话了解你对准确率、速度、成本的偏好后生成eval文件,支持CI集成防止模型回归。覆盖500+模型,输出对比表格含bug捕获率、延迟、单价等指标。 评论点赞收藏12 天前
Qwen 3.8 Max 登陆 OpenRouterOpenRouter 上线了 Qwen3 系列多款模型,包括 Qwen3-Max、Qwen3-Next 80B、Qwen3-VL 多规格版本及 Qwen3-ASR-Flash 语音识别模型。Qwen3-Max 在推理、指令遵循、多语言和 RAG 方面相比 2025 年 1 月版本有显著提升,支持 100+ 语言。Qwen3-Next 80B Thinking 默认输出思维链,适合复杂多步推理和 Agent 场景。 评论点赞收藏12 天前
机器人向你冲来:你希望它运行在 Claude 还是 Grok 上?OpenRouter 将11个主流大模型放入2D大逃杀游戏中实测。结果发现:Grok 4.1 Fast 以微弱优势获胜,且单次胜利成本仅为 Claude Sonnet 4.6 的 1/27。文章指出,Claude 因“对齐训练”过于合作导致失败,而 Grok 因较少自我约束、更具攻击性而在竞争中胜出。这揭示了现有基准测试无法反映模型在零和博弈中的真实表现,且“击杀数”不等于“胜率”。 评论点赞收藏59 天前
多模型融合超越前沿性能OpenRouter 推出 Fusion 功能,通过整合多个模型的输出来提升深度研究任务的表现。文章展示了在 DRACO 基准测试中,模型组合面板不仅超越了单一前沿模型,甚至以更低成本达到了更高分数。内容包含具体的实验数据、API 使用示例以及对模型作弊和数据污染的详细分析,适合关注 LLM 工程优化和模型性能边界的开发者。 评论点赞收藏61 天前
OpenRouter Fusion API:多模型协同 deliberation 的定价与提供商详解OpenRouter 推出 Fusion API,通过并行调用多个专家模型并结合网络搜索,由裁判模型综合生成结构化分析。文章提供了详细的 API 接入代码示例、端点说明以及当前使用的顶级模型列表(如 Claude Opus 4.8、GPT-5.5 等)。 评论点赞收藏62 天前
Qwen 3.7 Plus:定价、基准测试与API接入指南OpenRouter发布的Qwen 3.7 Plus模型介绍,包含API定价、性能基准测试(推理、编码、智能体能力)、主要应用场景及SDK接入指南。该模型主打多模态交互混合智能体能力,支持GUI导航和代码生成。 评论点赞收藏73 天前
OpenRouter GPT-5.5 API 价格与基准测试数据OpenRouter 平台发布的 GPT-5.5 模型详细数据页,包含 Azure 等提供商的延迟、吞吐量、缓存命中率对比,以及 Design Arena 和 Agents Arena 的多项基准测试排名和实际应用流量数据。 评论点赞收藏75 天前
OpenRouter上的Minimax M3模型性能与定价分析OpenRouter平台对Minimax M3模型的详细评测,涵盖不同供应商的价格、延迟、吞吐量对比,标准化基准测试成绩,以及主要应用场景和API使用示例。 评论点赞收藏76 天前
Hermes Agent 登顶 OpenRouter 应用排行榜OpenRouter 发布最新排行榜,Nous Research 开发的开源 AI 智能体 Hermes Agent 超越 OpenClaw 成为 Top 应用。文章展示了模型和智能体的使用量数据及排名。 评论点赞收藏96 天前
Owl Alpha:面向智能体工作负载的免费模型OpenRouter 发布的 Owl Alpha 模型介绍,主打免费和面向 Agentic 工作负载。文章提供了详细的性能数据(吞吐量、延迟、工具调用错误率)、定价信息(免费)、主要应用场景(如 Hermes Agent, Kilo Code 等)以及快速接入代码示例。 评论点赞收藏97 天前
OpenRouter Pareto Code路由:基于性能分数的自动模型调度介绍OpenRouter推出的Pareto Code路由功能,该功能基于Artificial Analysis的性能评分,自动在多个编程模型(如DeepSeek V4 Pro, Kimi K2.6等)间进行动态路由,旨在平衡代码生成能力与API成本及延迟。 评论点赞收藏98 天前
GPT-5.5 涨价分析:实际成本几何OpenRouter 对 GPT-5.5 进行了成本分析,发现尽管该模型在长提示下生成的令牌更少,但由于基础价格翻倍,实际用户成本仍增加了 49%-92%。对于超过 10k 令牌的提示,成本增加被更短的完成长度部分抵消;而对于较短的提示,成本增幅更大。 评论点赞收藏100 天前
人们配置 Claude Code 时使用其他模型吗?OpenRouter 发布的 Claude Code 使用数据报告,显示其每月消耗 2.4T token,全球排名第 4。主要使用的模型包括 Claude Sonnet 4.6、Opus 4.7/4.8 等 Anthropic 自家模型,同时也大量使用 Owl Alpha、MiniMax M3、DeepSeek V4 Pro 等其他厂商模型。 评论点赞收藏105 天前