Max Ghenis

RSS: https://maxghenis.com/rss.xml
政策企业家、技术专家和经济学家。PolicyEngine 联合创始人兼 CEO。

预测者说自己不知道什么?

作者 Max Ghenis 把美国与欧元区职业预测者几十年来发布的完整概率分布汇总成追踪器和两份工作论文,专门梳理他们对 AI 时代经济增长"不知道什么"的表达。 核心不是预测结果本身,而是用不确定性分布的措辞与结构去观察预测者对 AI 冲击真实认知边界的位置——比常规综述多一层方法论视角。 信息增量在于"不确定性自我描述"这个切入点和一手数据聚合,但整体仍偏分析记录而非强烈争议或反常识结论。
评论点赞收藏10 天前

麦肯齐·斯科特的捐赠:以质量调整生命年衡量

用QALY模型量化麦肯齐·斯科特慈善捐赠的健康效益,估算约7万QALY,成本效益远低于全球健康前沿。核心争议在于证据可信度假设及非健康领域价值缺失,适合有效利他主义与技术伦理讨论。
评论点赞收藏79 天前

喝掉AI:人工智能与饮料的耗水量对比

对比AI与饮料的水足迹,指出全年AI用水量远低于日常饮品。数据涵盖冷却与电力生产,澄清单一查询耗水量极低。适合关注AI环境影响的读者,提供量化视角。
评论点赞收藏86 天前

MacKenzie Scott's giving, in QALYs

用交互式蒙特卡洛模型量化麦肯齐·斯科特260亿美元慈善捐赠的健康产出(QALYs),发现其美国本土捐赠的健康效率仅为全球前沿援助的千分之一。 文章披露了使用双AI代理进行代码审查与假设辩论的全过程,包括修正通胀数据、重新推导分配比例等细节,并公开了所有Prompt。
评论点赞收藏94 天前

用QALYs衡量麦肯齐·斯科特的慈善捐赠

用交互式蒙特卡洛模型量化麦肯齐·斯科特260亿美元慈善捐赠的健康产出(QALYs),发现其美国本土捐赠的健康效率仅为全球前沿援助的千分之一。 文章披露了使用双AI代理进行代码审查与假设辩论的全过程,包括修正通胀数据、重新推导分配比例等细节,并公开了所有Prompt。
评论点赞收藏94 天前

The administration is hand-picking who runs which frontier model — social posts

Max Ghenis指出美国政府在同一理由下对AI模型实施双重标准:Anthropic的Fable 5被强制下架,OpenAI的GPT-5.6却获准商用。文章通过对比能力、安全机制和政企协作记录,逐一驳斥官方差异化的解释,揭示监管缺乏透明规则,实为针对特定企业的定制化许可。 这对初创公司和公平竞争构成重大威胁。
评论点赞收藏95 天前

政府正在挑选谁可以运行前沿模型——社交媒体帖子汇总

Max Ghenis指出美国政府在同一理由下对AI模型实施双重标准:Anthropic的Fable 5被强制下架,OpenAI的GPT-5.6却获准商用。文章通过对比能力、安全机制和政企协作记录,逐一驳斥官方差异化的解释,揭示监管缺乏透明规则,实为针对特定企业的定制化许可。 这对初创公司和公平竞争构成重大威胁。
评论点赞收藏95 天前

Can Talkie-1930 do arithmetic?

I tested Talkie-1930 on GSM8K and the easier EleutherAI/OpenAI arithmetic suite, then packaged an lm-eval-harness runner so the runs are reproducible.
评论点赞收藏153 天前

One Year of Claude Code

A year ago, Anthropic launched Claude Code. I've since consumed 10 billion tokens, mass-tweeted about it, and mass-customized it. Here's my setup and what I've learned.
评论点赞收藏206 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。