创作所需的长度限制太小了
@DeepSeekAI 你们的模型写得最好。但100万token的限制就像一堵墙。我创作的故事字数高达数十亿个词。而你们的限制,不过是大海中的一粒尘埃。
我不想要花招,也不想要RAG。我想要两种模式。这就是我的宣言。🧵👇 DeepSeekAI“无限模式”。在同一对话中只需一个按钮。一切都不会消失,限制也彻底不复存在。
无需重置,无需新聊天,无需导出。我所创造的一切都会被保留下来——我只需继续书写。我可以回退、阅读旧场景、反复修改。模型能看见一切,并且完全理解。
永无止境。#DeepSeek @DeepSeekAI“绘图师模式”。整个项目采用一种连贯的视觉风格。角色始终清晰可辨——同样的面孔、同样的伤疤、同样的外套。
武器、地图、场景——一切都出自一位画师之手。所有作品都归入同一个项目名下。没有随机生成的图像,只有属于我的世界、我的风格。
#DeepSeek 哪些硬件能够帮助我们实现这一目标?我知道,构建无限上下文是一项巨大的挑战。但技术早已成熟:HBM3e / HBM4——带宽可达4.8TB/s,为超大规模上下文提供了坚实的基础。
NVIDIA H200 / B200(Blackwell)集群——每张显卡配备141GB HBM3e内存。该集群可提供超过1TB的超高速内存。Groq LPU——专为推理优化的语言处理器。
在海量上下文中,每秒可处理数百个token。NVLink和InfiniBand——服务器内部的传输速率可达900GB/s,服务器之间的传输速率则为400GB/s。
这使得我们可以将上下文分散到多台机器上。配备智能预取功能的NVMe SSD——对于当前市场而言,这是一种经济实惠的选择。数据存储在磁盘上,而RAM中只需存储所需的部分。
我们还拥有类似TPU v5p的自建基础设施——这些处理器专为超长上下文而优化,可在数千台设备组成的集群中运行。量子计算机——未来已来。
Grover算法能够在平方时间内完成搜索,效率高得惊人。它非常适合在数十亿个词的海洋中快速寻找到关键线索。