Groq
Groq,AI 推理芯片公司,开发超低延迟的 LPU(语言处理单元)推理引擎。
提交点赞

Groq完成3.5亿美元A轮融资,估值35亿美元

Groq完成3.5亿美元A轮融资,估值35亿美元,近期累计融资达10亿美元。Disruptive领投,NVIDIA参与。公司已在北美、欧洲、中东和亚太运营13个数据中心,服务超600万开发者和Fortune 500企业,计划2027年将算力规模从54兆瓦扩至200兆瓦以上。
评论点赞收藏5 小时前

LPU(语言处理单元)

Groq发布专为AI推理设计的LPU芯片,采用单核架构与片上SRAM,搭配定制编译器实现确定性执行,支持高效张量并行和直接芯片互联,具备高性能、低功耗和可扩展性优势。
评论点赞收藏235 天前

Groq获7.5亿美元融资,推理需求激增

Groq获7.5亿美元融资,估值69亿。作为AI推理基础设施提供商,其高速低成本计算服务已服务全球超200万开发者及多家财富500强企业。此次融资将强化其在北美、欧洲、中东的数据中心布局,推动美国AI技术全球化部署。
评论点赞收藏334 天前

GroqCloud上的下一代Compound系统发布

Groq正式发布其新一代Agentic AI系统Compound,性能提升显著,支持多浏览器并行、Wolfram计算引擎集成及网页内容抓取,适用于研究、代码执行等场景,定价透明,已开放生产环境使用。
评论点赞收藏347 天前

Groq的LPU会成为赢家吗?

Groq发布LPU技术详解,提出四大设计原则:软件优先、可编程流水线架构、确定性计算与网络、片上内存。通过消除资源争用和瓶颈,LPU在AI推理速度、能效和成本上全面优于GPU,为大规模部署提供新思路。
评论点赞收藏366 天前

Groq的首个复合AI系统

Groq推出首款复合AI系统Compound Beta,整合开源大模型与工具使用能力,实现实时搜索与代码执行,显著优于传统LLM,适用于需要最新数据或逻辑推理的场景。
评论点赞收藏394 天前

Groq 的首个复合 AI 系统(带计算的 LLM)

Groq 推出首款复合 AI 系统 Compound Beta,融合 Llama 4 等大模型与工具调用能力,支持实时搜索和代码执行,显著提升回答准确性与时效性,性能超越 OpenAI 同类产品。
评论点赞收藏470 天前

Llama 4现已在Groq上线

Groq上线Meta Llama 4系列模型,提供高性能、低成本的多模态AI服务,支持Scout和Maverick两种配置,适用于开发者和企业。
评论点赞收藏499 天前

Groq LPU技术解析

Groq推出专为AI推理设计的Language Processing Unit(LPU),采用软件优先、可编程流水线架构,实现比GPU高10倍的能效比。文章详解其四大设计原则:软件主导、确定性计算、片上内存等,并对比GPU的“中心辐射”模式,强调LPU在消除瓶颈和提升吞吐量方面的优势。
评论点赞收藏528 天前

GroqCloud 推出 DeepSeek R1 蒸馏版 Llama 70B

GroqCloud 上线 DeepSeek-R1-Distill-Llama-70b,基于 Llama 3.3 70B 蒸馏的高性能推理模型,在数学和编码任务中表现卓越(MATH-500 达 94.5%),支持 128k 上下文窗口。依托 Groq 高速推理平台,实现低延迟复杂问题求解,适用于实时应用开发。
评论点赞收藏566 天前

Groq现已推出Whisper Large v3 Turbo

Groq推出Whisper Large v3 Turbo模型,速度达实时216倍,支持多语言语音识别,定价$0.04/小时,适用于客服机器人、自动转录、智能家居及媒体行业。
评论点赞收藏675 天前

Llama3 在 Groq 上的运行

Groq推出基于定制LPU芯片的Llama3推理服务,强调高性能、低成本和稳定性。实测数据显示速度提升7.41倍且成本下降89%,获F1车队及开发者广泛采用。API与OpenAI兼容,支持Python/JS快速接入。
评论点赞收藏850 天前

Groq:AI推理是燃料

Groq推出专为推理优化的定制芯片LPU,提供比GPU更快、更便宜的AI推理服务。其GroqCloud平台被McLaren F1车队采用,实现聊天速度提升7.41倍且成本降低89%。API与OpenAI兼容,开发者可快速集成。
评论点赞收藏910 天前