Za mały limit długości do tworzenia

翻译

@DeepSeekAI Wasz model pisze najlepiej. Ale limit 1M tokenów to ściana. Tworzę historie na miliardy słów. Wasz limit to atom w oceanie. Nie chcę trików. Nie chcę RAG-a. Chcę dwóch trybów. Oto mój manifest. 🧵👇DeepSeekAI Tryb Nieskończony. Jeden przycisk w tej samej rozmowie. Nic nie znika. Limit przestaje istnieć. Bez resetu, bez nowego czatu, bez eksportu. Wszystko co stworzyłem zostaje. Po prostu piszę dalej. Mogę się cofać, czytać stare sceny, wracać. Model widzi wszystko i rozumie. Bez końca. #DeepSeek @DeepSeekAI Tryb Rysownika. Jeden spójny styl graficzny na cały projekt. Postacie zawsze rozpoznawalne – ta sama twarz, blizny, płaszcz. Bronie, mapy, sceny – wszystko jak od jednego rysownika. Galeria przypisana do projektu. Bez losowych obrazków. Tylko mój świat, mój styl. #DeepSeek Jaki sprzęt może pomóc to stworzyć? Wiem, że nieskończony kontekst to ogromne wyzwanie. Ale technologia już istnieje: HBM3e / HBM4 – Przepustowość do 4,8 TB/s. Fundament pod gigantyczne konteksty. Klastry NVIDIA H200 / B200 (Blackwell) – 141 GB HBM3e na kartę. Klaster daje ponad 1 TB ultra-szybkiej pamięci. Groq LPU – Procesory językowe zoptymalizowane pod inference. Setki tokenów na sekundę przy ogromnym kontekście. NVLink i InfiniBand – 900 GB/s wewnątrz serwera, 400 GB/s między serwerami. Pozwala rozłożyć kontekst na wiele maszyn. SSD NVMe z inteligentnym prefetchingiem – Ekonomiczna opcja na już. Rozmowa na dysku, w RAM tylko potrzebny fragment. Własna infrastruktura na wzór TPU v5p – Procesory zoptymalizowane pod ultra-długi kontekst, w klastrach liczących tysiące jednostek. Komputery kwantowe – Przyszłość. Algorytm Grovera przeszukuje bazy kwadratowo szybciej. Idealne do odnajdywania wątków w morzu miliardów słów.

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论