赛博禅心

RSS: https://wechat2rss.bestblogs.dev/feed/752c31ca0446b837339463fc5440539e20267d2f.xml
赛博禅心分享 AI、智能体与前沿技术内容。

ChatGPT 上线【交互 UI】,让每个回答都能交互

OpenAI 同日上线两件事:GPT-6 面向所有 ChatGPT 用户开放,以及一项名为 Intelligent UI 的新能力,让回答可以以交互组件形式呈现。 Intelligent UI 把静态文字答案变成可操作工具。例如问"7 速自行车怎么拆",回答附带一个可动手拆解的小工具; 问"周日烤羊腿,人数未定",答案里嵌入人数计数器,改数字后羊肉、土豆分量自动重算, 并可一键复制购物清单。 付费用户当天可用,免费和 Go 用户次日开放。 该能力也能用于教学:中心极限定理用"咖啡店消费"场景加样本量滑块演示,从 5 拖到 16 时直方图收成钟形,随后跟一道选择题; GDP 计算用四个滑块操作一个虚构的 1 万亿美元经济体。 它还能直接生成可用工具:拍小票生成五人对账的分账器(含 18% 小费),问 Roth IRA 即得退休储蓄计算器,说"做个复古游戏机"则得到带十字键、内置贪吃蛇和打砖块的掌机。
评论点赞收藏3 天前

OpenAI 公开 722 篇数学论文,第 003 号为准黎曼假设

OpenAI 在 GitHub 仓库 openai/math 放出了 722 篇数学论文,覆盖约 4000 道开放问题,归成 372 个结果族,平均每个结果消耗约 3 小时 ChatGPT Pro 算力。 仓库第 003 号论文宣称证明了准黎曼假设:黎曼ζ函数的非平凡零点在实部大于 7/8 的区域内不存在,而此前数学家未能证出这一较弱的版本。 同批结果还包括有理数版希尔伯特第十问题的否定结论、卡塔兰常数为无理数、π 的无理性指数上界收紧到 2,以及椭圆曲线二次扭曲中密度为 1 的部分满足 BSD 公式等。 这批论文是 OpenAI 用开放研究问题评测内部前沿模型时积累的结果,因为现有数学基准已被做满。 验证依赖 Lean 形式化证明:核心命题写成三行 Lean 代码,末尾以 sorry 占位,OpenAI 的任务是填满该占位;判卷由 Comparator 程序在指定公理下逐条检查。 仓库中 162 篇论文的主结果已完成形式化清单,其余五百多篇仍依赖人工审读。 9 月 25 位菲尔兹奖得主曾联名公开信表达 AI 对数学工作的冲击。OpenAI 同期在普林斯顿高等研究院成立了数学与 AI 顾问组,成员包括高尔斯、海雷尔、威滕等九位数学家,目前该组未参与验证这些结果。
评论点赞收藏3 天前

我卡住了 SI 的脖子(bushi)

原创 金色传说大聪明 2026-10-05 14:02 河北 肘,去 spa 我刚弄了个域名: 感觉...挺适合做 spa 项目的 背景应该不不必多介绍了...特朗普签署了一道行政命令,把AI 改叫了 SI 然后...我去摸了个域名:,也就是 si 的门槛,算是卡住了 SI 的脖子(bushi 毕竟,bar 这个词,也是门槛/标准的意思,而这个域名已指向 emmmm... AGI 的门槛,也在咱自...
评论点赞收藏5 天前

Anthropic 办学院:投入 1 亿美元,培训 1 万名 FDE 工程师

Anthropic 宣布投入 1 亿美元成立 Claude Frontier Academy(前沿学院),计划到 2027 年底培养 1 万名 FDE(Frontier Deployed Engineer,前沿部署工程师)。 FDE 定位类似 Palantir 的驻场工程师,但强调"Frontier":小团队用 Claude 在企业内构建生产级 AI 系统。学院参照住院医师培训模式设计,分两阶段:数日线下集训(模拟企业部署、实操考试、颁发第一枚徽章)+ 12 周驻留期(回到公司做真实 Claude 项目,第二次考核通过获正式认证)。 首批学员来自埃森哲、贝恩、凯捷、德勤、麦肯锡、摩根士丹利、澳联邦银行和诺和诺德,已在旧金山、纽约、伦敦开班。报名仅限企业选送,不开放个人,且每人须带一个具名 Claude 项目。 项目建在 Claude Partner Network 上,多家合作伙伴分享了各自视角,如诺和诺德已将 Claude 用于药物研发。
评论点赞收藏7 天前

Claude Mod 实测:让雨姐与你一同编码

作者基于 Claude Code 新推出的 Mod 功能,搭了一个"雨姐陪写代码"的自定义界面 Mod:右侧面板、输入框上方台词条、状态栏,全部由 Mod 内嵌 JS/TS 代码绘制。 文章讲清了 Mod 与 Skill、MCP、hooks 的区别——Mod 跑在 Claude Code 进程内,可订阅 session.start、prompt.submit、、ui.render、turn.complete 等事件,在对应钩子里注册命令、画 UI、拦截命令(比如把 rm -rf 拦下来),改完代码保存后热重载即可生效。 作者把整套 Mod 挂到 GitHub 供分享,文中附了目录结构和 register.tsx 核心代码。对关注 Claude Code 扩展机制、AI 编程工具 UI 自定义的读者有实操参考价值;语气偏个人化、带"雨姐"梗,趣味性强但技术深度中等。
评论点赞收藏7 天前

MiniMax 第一个 Flash 模型上线,可在 AGI Bar 免费用

MiniMax 首个 Flash 模型 M3.1-Flash-Preview 上线,支持 1M 上下文、原生多模态、五档深度思考(默认 max)。作者在 AGI Bar 国庆期间提供免费调用。 文章展示了多个社区实测案例:与 GPT-6 Sol 对比时 M3.1 速度更快;修复真实 bug 时一次性命中;代码性能优化案例中 8000 条工单页面加载从 15.3s 降至 0.045s;前端与 3D 生成包括像素版《星球大战》千年隼(17522 个体素全代码生成)、Windows XP 虚拟桌面、鹈鹕骑自行车(IK+Web Audio)、天坛 Three.js 程序化建模等。 文章还推测 OpenRouter 上的匿名模型 Space Bunny Alpha 与 M3.1 Flash 有灰度关系,并提及 524K completion 上限及向高速 Coding/长时间 Agent 方向调优的变化。
评论点赞收藏9 天前

实录 OpenAI 年度发布会:25 项发布,逐一详解

OpenAI DevDay 2026 共发布 25 项内容,核心亮点包括:1) 新个人常驻 agent「Dots」,24 小时在线代办事务,向 Pro/Business Premium 开放;2) GPT-6.1 Sol,智能接近 GPT-6 Astra 但价格仅 1/5;3) Ultrafast 档位,速度提升 8 倍、300 token/s,价格为标准档 6 倍;4) Codex 全面上云、CLI 重做并支持语音驱动与 /agents 视图,Linux 版及跨文件夹项目;5) Decisions API、Private Intelligence 等安全接口;6) 新 $500 订阅档(Plus 25 倍用量,含 Ultrafast)及 Pro 200 重新开放;7) ChatGPT Space 协作空间、Pages 文档、插件扩展、Codex Security Cloud 漏洞扫描、Agents API 新增电脑操作等。 文章按主题演讲顺序逐项详解,信息密度较高。
评论点赞收藏11 天前

做 AI 短剧的人,在愁什么?

AI 短剧上半年上线 22 万部,但春节档播放量仅为真人剧的 4%,爆款率极低。云栖大会分论坛揭示行业困境:效率提升未转化为收益,市场总量未随供给十倍增长。 实践层面,Wan 3.0 模型已能高效生成连贯镜头,剧组将提示词类比为“场记”以保证连续性;点众等公司将编剧经验封装为 Skill,实现“人判断、AI 干活”,五人可替代四十人。 数据表明“霸总甜宠”题材最多但爆款概率低,而“帮派斗争”等冷门题材爆款系数是前者四倍。文章最后提出 AI 改编赋予 IP 长尾效应的新视角。
评论点赞收藏11 天前

Manus 2.0 发布,重启国内市场

Manus 发布 2.0 版本,同时宣布重启国内市场产品与团队。核心变化:底层 Agent 框架换成自研的 Cascade,官方测试中 token 消耗 -23.2%、任务时间 -28.2%、运行成本 -32%(同一配置,非全局均值),采用"能力按需加载"思路;桌面应用升级为 Manus Studio,覆盖文档/表格/PDF/幻灯片及网站、代码、游戏、视频,新增视频编辑器(支持 Alchemy 模式)和游戏开发环境,视频/游戏专业环境可单独购买云电脑作为持久运行环境;自动化从定时触发扩展到事件触发(邮件、Slack、Notion 等);推出独立个人 Agent 应用 Cue;并新增手机远程操控电脑能力(基于 Computer Use,在已授权会话里以独立可见工作区操作)。 市场层面:Manus 正组建国内团队,与国产模型厂商和生态伙伴合作稳步推进。
评论点赞收藏12 天前

买了这么多录音笔,我还是被元宝惊艳到了

原创 金色传说大聪明 2026-09-24 19:48 北京 在录音过程中,可以随时拍照插图 我每天大部分时间在开会,为此买了 4 个 plaud、2 个飞书录音豆,还有科大讯飞的录音笔。但我依然被元宝这款录音应用震惊了 主要是两点: 我在录音的过程中, 可以随时把照片插进去 右下角的元宝会告诉我当前要点, 方便我走神被 call 的时候,随时回过神来 真是有趣的洞察,有趣的产品 为了让大家更直观...
评论点赞收藏16 天前

对话 Today AI:齐俊元的 Personal Agent 如何做长程记忆与主动服务

作者"金色传说大聪明"探访齐俊元(2014 年买下 域名、做 Lark/飞书)的新产品 Today AI——下一代 Personal Agent。海外版已上线,国内版即将发布。 文章作者自述"不涉及任何实测",核心是团队访谈,提炼出 Today 与通用 Agent 的差异点:(1) 长程 Memory + 主动性 Proactive 作为两大支柱;(2) 记忆系统需针对场景设计,发件箱/阅读行为等"暗信息"比单纯提示词记录更重要,先验经验之于 harness 类似数据之于模型;(3) 北极星指标不是 DAU 或用户 query 次数,而是 Agent 主动帮用户解决的事;(4) 时间感知是 Personal Agent 关键维度,结合既有计划与当日变化调整日程(如睡眠不足 + 评审→挪散步到晚上);(5) PM Suki 的案例:Today 为她做个性化外语课程、scheduled tasks、拼词游戏,"完全替代外教"。 对 Agent 产品圈有信息增量,但缺少实测、代码与工程细节,讨论入口主要在"proactive 与 memory 取舍"层面。
评论点赞收藏18 天前

简单讲讲 Agent 的工作原理

面向非技术读者解释 Agent 产品背后的通用机制:核心是 Harness 对上下文的自动化编排。文章用「找出网站报名失败原因」等例子说明模型每次判断依赖当前上下文(历史对话、指令、工具结果),而工具让模型行动并获取新信息,形成"模型判断→工具执行→结果反馈→再判断"的循环;过去一年代码生成与完成任务的差距正在被拉齐。 还区分了 Skill(方法)、工具(操作能力)、MCP(外部服务接入约定)、插件(打包分发)四类概念及各自职责,并提到 Skill 的"渐进加载"方式避免占满上下文。 长任务涉及记忆延续与上下文容量限制,内容在此处截断。整体为科普向解释,结构清晰但偏基础概念梳理,缺少一手工程细节或争议观点。
评论点赞收藏19 天前

AGI Bar 将迎来首个机器人员工

赛博禅心 2026-09-20 17:28 北京 刚刚下单了稚晖君家的机器人,预计十一期间到店里 这个机器人支持【人形/狗形】,支持二次开发 所以...欢迎十一期间来 AGI Bar 调教这个赛博福瑞 然后...我觉得自己赚大了 我之前便预约了个灰色的 T1,并付了 1000 块的定金 今天这款机器人正式发布,售价 19999 然后我开开心心付了尾款 之后发现.... 按的灰色款被升级成了 T1 ...
评论点赞收藏20 天前

阶跃星辰发布新旗舰模型 Step 5 Preview,可免费体验

阶跃星辰发布旗舰模型 Step 5 Preview:600B 总参数、27B 激活、1M 上下文,原生支持文本与视觉输入,价格输入 ¥7/输出 ¥20/缓存 ¥0.35(每百万 token),10 月 15 日开源。 定位软件工程、深度研究与专业工作流,重点训练长上下文、多轮工具调用和长程 Agent 执行。该模型在 Artificial Analysis 得分 44,全球开源前三;还自研 StepCodeBench 覆盖 553 个代码仓库、20 个应用领域、33 种编程语言,模型 avg@4 为 49%,在功能修改、Bug 修复、重构任务接近 Claude Opus 5。 金融领域有特别优化。另外,模型在宝可梦长跑、可编程键盘开发调试等任务中展现能力,且能在约 22 小时内将 GPU Kernel 优化至 508 TFLOPS,性能接近人类专家 8 小时手工实现的 565 TFLOPS。
评论点赞收藏20 天前

CNN:北京这家酒吧,点杯啤酒就能无限用 AI

CNN 报道了北京一家叫 AGI Bar 的酒吧,消费即可免费、不限量地使用 DeepSeek 等中国 AI 模型,类似免费 Wi-Fi 的定位。记者现场体验了用 AI 根据几句话生成歌曲的流程,并与一名 AI 开发者聊到中国是否应放慢 AI 发展。 文中引用了中国官方专家对“美国想阻止他国缩小差距”的说法,也提及 AI 安全与 AI 战争担忧,但酒吧场景里这些话题并非焦点。本质是一篇把“AI 走进日常生活”做成文化符号的特写,信息增量有限,更像氛围报道而非技术或政策分析。
评论点赞收藏21 天前

GLM-5.3-FlashX 上线:推理速度最高 200 tokens/s,提速 5 倍、提价 2.5 倍

智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,相比 GLM-5.3-Flash 提速 5 倍、价格提升 2.5 倍,API 同步开放。背后依托 10 万张国产芯片提供的推理算力,并加大对 Infra 侧投入与推理优化。 文中称该套 Infra 由 GLM-5.3 驱动 Agent 自主构建,从模型适配到生产上线不到两周,端到端吞吐做到初始基线的 3 倍;人类负责定目标、设边界和审核关键修改,Agent 负责测试、日志、Trace、微基准等,形成"稠密反馈"优化闭环。 文章给出三个具体优化案例:1) KDA CP 路径在长上下文下精度偏差,定位到两处 默认使用 TF32,显式加上 input_precision="tf32x3" 修复,已合入 Flash Linear Attention 上游;2) KV Transfer 被 GIL 卡住,DeepEP v1.2.1 两处 C++ 调用未释放 GIL 导致 Mooncake Transfer 的 Python 线程拿不到锁,修复后性能差距从 20%+ 降到 1% 以内;3) KDA Decode 沿 V 维度分块导致同一组 FP32 归一化和门控计算重复做了四遍,合并线程块并共享中间结果后算子性能提升到 1.71 倍。 整体是一篇带工程细节的国产 LLM 推理提速报道,适合关注国产算力与推理优化的读者。
评论点赞收藏22 天前

Vidu S2:实时数字人与实时视频编辑模型发布

生数科技上线实时视频模型 Vidu S2,输出 720p、25–42 FPS,包含两款能力:S2-Avatar 实时数字人(单图生成交互数字人,对话中可动态换衣、拿物、换场景,支持随时新增参考图);S2-Editing 实时改视频(接收视频流,按指令换画风/内容,保留原动作时序,支持风格迁移、虚拟试穿、人物替换、背景替换)。 技术细节:用 VLM Agent 生成后续 prompt 维护角色状态一致性;训练加入独舞和 2D/3D 动画数据;低分辨率骨干+单步 Refiner 提升渲染;提出 Self-Replay Forcing(SRF)因果回放训练改善长轨迹误差累积;Editing 用 Frame-Aligned Attention 避免穿模,目标帧只与同时刻源帧交换信息,参考图可供各帧读取。 另发 Real-Time Spatial Video:基于 S2 生成左右眼视图作为 VR 头显实时输入源。官方称 BenchMark(StreamAV-Bench、Sparkle-Bench、OpenVE、RefVIE、ViViD)达到领域 SOTA。 全链路由朱军博士生张金涛(生数流式视频生成与推理负责人)主导。体验地址。
评论点赞收藏25 天前

AGI Bar 上海店,也有免费 token 了

上海 AGI Bar 从 2026-09-13 起提供免费 DeepSeek v4 flash 和 MiniMax H3 模型访问。两店模型均在本地用英伟达 DGX 推理(100+ token/s),两间店通过内网 WiFi 互联并搭了一套中转系统分发 token。 用户连店内 WiFi 后,把 Base 填成 、API Key 填 sk-agi_bar-static 即可使用;文中还给出调用 MiniMax H3 生成 5 秒视频(1024x576)的 curl 示例。 属于比较新鲜的本地部署+免费分发方案,有具体用法和参数,科技圈读者会关注其架构与安全性问题。
评论点赞收藏27 天前

外滩大会AI艺术节:把AI艺术搬进真实空间

外滩大会首次增设AI艺术节,将百余部AI影像作品、概念艺术展和AI歌手线下公演搬进真实空间。展区内一件名为《七秒钟》的作品收集不同地区人们讲述珍贵记忆,系统转为文字和图像,成为关于记忆的短片。 另一件装置用发光箭头引导观众,背后连着导览智能体,策展人想讨论的是我们有多少决定是顺手交给AI的。国内首位获官方数字人身份认证的AI虚拟偶像Yuri尤栗昨晚在巨幕上完成首场线下公演。
评论点赞收藏28 天前

Kimi 特别招募:全球 7 人,欢迎辍学的异类

Kimi 开启 Wild Card 计划,全球招募 7 名非典型人才作为业务合伙人,与创始团队直接共事,提供独立算力和锁定当前估值的期权。同时开放 2027、2028 届校招及在校生实习,覆盖算法、研发、产品、运营、国际化等方向,10 月 24 日北京有线下夜谈。
评论点赞收藏31 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。