AI 在生命科学中的风险与局限:当数据成为瓶颈创始人 Rachel Thomas 与 KAMI Think Tank 对话,深入剖析 AI 在生命科学领域的风险与局限。她指出当前行业过度依赖现有数据,忽视了基础实验和新型生物标志物的发现,导致“数据幻觉”和模型偏差。 文章以 AlphaFold 的成功和酶分类论文的错误为例,强调领域专家深度参与的重要性。同时批评了科研激励体系重模型轻数据、纠错困难的现状,呼吁回归因果机制研究,建立更严谨的数据评估标准。 评论点赞收藏152 天前
Cachy:我们如何让笔记本速度提升60倍团队开源了名为 Cachy 的 Python 库,通过拦截 httpx 库自动缓存 LLM API 请求响应。这一方案解决了测试慢、CI/CD 需要 API Key 以及 Notebook 代码审查因非确定性输出而混乱的问题。 实际效果显著,测试运行时间从两分钟缩短至两秒,且无需手动编写 Mock 代码。该工具支持异步和流式处理,不仅限于 LLM,也可用于缓存其他 httpx 发起的请求,极大提升了开发效率。 评论点赞收藏221 天前
我是如何基于 Karpathy 的视频教程编写 tokenizer 书籍章节的作者分享了利用 SolveIt 平台将 Andrej Karpathy 的长视频教程转化为可运行代码、带超链接和详细解释的书章的全过程。 作者采用两阶段工作流,先分段丰富转录文本,再逐节撰写正文。这种方法确保了内容的准确性与深度,让作者真正掌握了材料。 评论点赞收藏307 天前
在家训练 700 亿参数大模型(2024)发布了一套开源方案,利用 FSDP 和 QLoRA 技术,让普通用户仅用两张消费级显卡(如 RTX 3090/4090)就能训练 700 亿参数的大语言模型。 文章详细解释了如何突破显存限制,整合量化与分布式并行技术,并分享了在集成 bitsandbytes 和 PyTorch 过程中的技术细节与踩坑经验。 评论点赞收藏387 天前
你值得拥有的Stripe开发体验团队发布FastStripe,一个基于Stripe OpenAPI规范生成的Python SDK。相比官方SDK需要二十多行代码,FastStripe将创建一次性支付和订阅简化为几行代码, 并提供IDE自动补全和清晰的文档字符串。 作者指出官方SDK缺乏参数提示,导致开发者频繁查阅文档,体验不佳。FastStripe通过动态生成代码解决了这一问题,同时保持与Stripe最新API版本的同步,适合希望快速集成支付功能的开发者。 评论点赞收藏388 天前
发布 fastmigrate:一个极简的 Python SQLite 迁移工具发布了一个名为 fastmigrate 的 Python 数据库迁移工具,专注于 SQLite,不依赖 ORM。文章解释了数据库迁移模式如何解决应用版本迭代中数据库状态管理的复杂性,并通过代码示例展示了如何使用该工具简化迁移流程。 核心观点是保持工具简单,将复杂的条件逻辑从应用启动代码中移除,使数据库版本管理像 Git 提交一样清晰可控。 评论点赞收藏429 天前
探索 flexicache:灵活高效的 Python 函数缓存方案文章介绍了 fastcore 库中的 flexicache 装饰器,支持基于时间和文件修改时间的缓存失效策略,以及多策略组合使用。 它还演示了如何用 flexicache 替代 lru_cache,并提供了带超时功能的 timed_cache 便捷封装。 评论点赞收藏435 天前
今日所学:视觉语言模型的阅读理解能力可能比你想象的更差(或更好)发布 ReadBench 基准测试,评估多模态大模型从图片中提取和推理文本的能力。 结果显示,所有主流视觉语言模型在长文本场景下性能显著下降,目前直接通过图像进行多页文档检索增强生成尚不可靠。 评论点赞收藏437 天前
从零开始:GPU编程实战与入门指南MIT大一学生Sarah Pan分享了她从零学习GPU编程的经历,并开发了WebGPU Puzzles项目。她提到在的研究经历以及NeurIPS发表论文的过程。 文章介绍了WebGPU Puzzles的设计初衷,旨在降低GPU编程入门门槛,让初学者能直接在浏览器中练习并行计算原理。 评论点赞收藏517 天前
技术日报:掩码语言模型竟是惊人的零样本学习高手作者发现 ModernBERT 的 MLM 头可以直接用于零样本分类和多项选择题,无需额外架构。在 MMLU-Pro 上,它超越了多数小参数 LLM,接近 Llama3-1B。 训练过程极其简单,甚至意外发现“无效示例”能起到正则化作用。这证明了编码器模型在生成式任务上的巨大潜力,且对数据规模依赖极高。 评论点赞收藏551 天前
使用 Devin 一个月后的真实反思团队实测 Devin 一个月,20 个任务中 14 个失败。虽然早期演示惊艳,但实际使用中常陷入死循环或生成复杂无用代码。 团队认为其自动化特性反而成为负担,不如 Cursor 等辅助工具可靠。文章详细列出了失败案例,揭示了当前 AI 编程代理的真实能力局限。 评论点赞收藏576 天前
BERT的替代者:ModernBERT发布与LightOn联合发布ModernBERT,作为BERT的继任者。该模型将上下文长度提升至8192,在多项基准测试中超越DeBERTaV3,且推理速度更快、内存占用更低。 文章详细对比了编码器模型与解码器模型的优劣,强调其在RAG、代码检索等实际场景中的高效性,并介绍了架构改进细节。 评论点赞收藏599 天前
nbsanity:一键将 GitHub Notebook 转为精美网页fastai 团队推出 nbsanity,只需修改 URL 即可将公开 GitHub Notebook 渲染为排版精美的静态页面。 基于 Quarto 引擎,支持代码折叠、单元格显隐控制及自定义样式,无需本地部署。 评论点赞收藏611 天前
ShellSage 与 iTerm2 的完美配合:利用 Control Mode 实现无缝 AI 终端体验介绍如何在 macOS 上使用 iTerm2 的 tmux control mode 运行 ShellSage,无需学习额外快捷键即可享受 AI 辅助终端功能。 详细说明了本地和远程连接的配置步骤,包括 iTerm2 Profile 设置和.tmux.conf 选项,让终端体验更原生流畅。 评论点赞收藏614 天前
ShellSage:你的 AI 终端助手团队发布了一个名为 ShellSage 的开源工具,旨在解决开发者在终端中使用 AI 助手时的上下文切换痛点。该工具利用 tmux 捕获终端当前状态和历史记录,让 AI 能“看到”用户正在做什么,从而提供更精准的帮助。 文章分享了团队在开发过程中利用该工具排查 Let's Encrypt 证书日志泄露问题的实际案例,强调了人机协作而非替代的理念,并提供了安装和使用指南。 评论点赞收藏618 天前
如何合成你的训练数据作者通过微调代码模型的实验,展示了合成数据在提升模型性能上的潜力与挑战。 文中提到直接使用合成数据可能导致效果下降,但结合多样性增强和质量过滤后, 模型表现有所改善。 文章详细介绍了平衡合成数据质量与多样性的方法,包括使用不同角色设定和LLM进行后处理筛选,并开源了相关工具库 fastdata。 评论点赞收藏668 天前
使用 SQLite 作为任务队列文章介绍在基于 Starlette 的应用(如 FastHTML、FastAPI)中,如何利用 SQLite 数据库作为后台任务队列,以避免阻塞服务器处理 LLM 请求。 作者对比了线程池、异步处理和进程等多种并发方案,并通过代码演示了如何在 FastHTML 应用中实现非阻塞的后台任务执行。 评论点赞收藏669 天前
在浏览器中学习 GPU 编程推出了 WebGPU Puzzles,一个基于浏览器的交互式工具,帮助用户学习 GPU 编程。它利用 WebGPU 技术,让用户无需安装复杂环境即可在本地运行代码。 文章介绍了 WebGPU 的背景及其将浏览器转化为分布式计算集群的潜力,同时提供了 CUDA 到 WebGPU 的概念映射和基础编程知识,旨在降低 GPU 编程门槛。 评论点赞收藏678 天前
Rerankers:统一排序方法的轻量级Python库发布rerankers库,为各类重排序模型提供统一接口,解决多阶段检索中模型切换繁琐的问题。 文章详细解析了两阶段检索架构的原理,对比了交叉编码器、MonoT5及LLM排序等主流重排序技术路线。 评论点赞收藏698 天前