The New Stack

RSS: https://thenewstack.io/blog/feed/
The New Stack,云原生、DevOps 与软件开发交汇处的新闻与分析媒体。

苹果AI架构拆分:你的iOS应用在中国可能表现不同

苹果正在为中国市场单独构建AI模型,与阿里巴巴合作,部分功能可能使用Qwen和百度技术。ChatGPT、Gemini、Claude在中国无法提供服务,苹果将运行自己的区域大模型而非完全依赖中国合作伙伴。相关中文指南曾发布后又被删除,具体训练数据和功能细节尚未公开,开发者面临测试空白。
评论点赞收藏1 天前

阿里Qwen3.8开源270亿参数模型:本地运行性能对标Opus 4.6

阿里发布270亿参数Qwen3.8开源模型,声称性能对标Anthropic Opus 4.6,可在本地Mac运行。DeepSWE编码基准从14.2分跃升至42.2分,超越上代Qwen3.7-Plus。模型支持视频等多模态能力,Apache 2.0许可。但需注意:官方基准基于原始checkpoint,量化版本会有性能折损;早期反馈称模型存在过度思考倾向,基准成绩未必反映真实场景表现。
评论点赞收藏1 天前

GLM-5.3编码能力提升从何而来?基座未变,后训练是关键

发布GLM-5.3,基座模型与GLM-5.2相同,编码能力提升来自后训练而非参数扩展。后训练数据量扩大10倍,覆盖更多长周期任务环境,部分任务模拟完整软件生命周期。Terminal-Bench 3.0从4.6跃升至28.3,DeepSWE v1.1从46.2升至66.9,与Gemini 3.7 Flash接近。DeepSeek此前也证明小规模模型通过优化后训练可超越大参数旗舰。
评论点赞收藏1 天前

你的容器镜像未签名。在人工智能时代,这就像一颗定时炸弹。

大多数知道应该签名的组织仍然不知道。 不是因为他们意见不合,而是因为做好这件事的道路太漫长了。 结果是交付管道 建立在无人能证实的信任之上。 问题空间 未签名的容器镜像为攻击者在交付流程的每个阶段打开了大门。恶意图片伪装成合法包裹,等待毫无防备的团队拉取。被攻破的CI/CD流水线会悄无声息地将被篡改的伪影注入生产版本,且没有任何修改的密码学证据。被盗凭证让不良分子冒充可信赖的出版商。即使在单一组...
评论点赞收藏1 天前

DeepSeek 开源插件化 Agent 运行时:一切皆插件

DeepSeek 开源了 DeepSeek Harness,一个基于 Node.js 的 AI agent 运行时,发布数小时内获得 33,000+ GitHub stars。其核心设计是"一切皆插件"——模型适配器、工具注册表、会话日志和 agent 循环本身都是可替换的插件,没有特权核心。架构基于 Cordis 元框架,支持动态组合。提供四种预设模式:Standard(完整编码 agent)、Minimal(仅 bash 和编辑器)、Code(生成 TypeScript SDK 让模型写程序)等。
评论点赞收藏2 天前

AI 流水线为什么在演示后成本翻10倍

AI 应用从演示到生产环境成本暴涨10倍,主因不是模型质量差,而是系统提示词、对话历史、思维链等累积的无用 token。优化 token 消耗是架构问题而非定价问题,减少不必要 token 比换便宜模型更有效。
评论点赞收藏2 天前

Code review is a taste problem

Code review is becoming the most important decision-making surface in software engineering, and it’s outgrowing the diff. The assumption was always that code review exists to catch bugs. Its real job ...
评论点赞收藏2 天前

通过所有测试的代码,仍可能被下一个触碰它的 AI 代理搞坏

Google 将 Go 语言定位为面向 AI 编程代理的语言,利用其简洁语法和内置工具链帮助 AI 自动纠错。Go 的 gofmt 统一格式、静态类型系统、原生模糊测试和 govulncheck 等工具,让 AI 代理无需配置第三方工具就能完成代码检查和修复。但编译器无法捕捉业务逻辑错误或安全策略误用,人类审查仍不可替代。
评论点赞收藏3 天前

Anthropic让Agent学会"做梦":从静态配置到自主记忆管理

Anthropic在AI DevCon上展示了Agent记忆管理的新思路:从静态文件转向让Agent自主管理记忆,配合渐进式披露(Layer 1元数据→Layer 2全文→Layer 3原始文件)避免上下文过载。传统方式在文件过长时难以维护,新方案让Agent自己决定何时读写记忆。
评论点赞收藏3 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。