Groq完成3.5亿美元A轮融资,估值35亿美元Groq完成3.5亿美元A轮融资,估值35亿美元,近期累计融资达10亿美元。Disruptive领投,NVIDIA参与。公司已在北美、欧洲、中东和亚太运营13个数据中心,服务超600万开发者和Fortune 500企业,计划2027年将算力规模从54兆瓦扩至200兆瓦以上。 评论点赞收藏5 小时前
Groq与英伟达签署非独家推理技术许可协议Groq与英伟达达成非独家技术许可协议,共享推理技术以扩大高性能低成本AI推理的全球部署。Groq维持独立运营,Simon Edwards出任新CEO。 评论点赞收藏186 天前
LPU(语言处理单元)Groq发布专为AI推理设计的LPU芯片,采用单核架构与片上SRAM,搭配定制编译器实现确定性执行,支持高效张量并行和直接芯片互联,具备高性能、低功耗和可扩展性优势。 评论点赞收藏235 天前
Groq获7.5亿美元融资,推理需求激增Groq获7.5亿美元融资,估值69亿。作为AI推理基础设施提供商,其高速低成本计算服务已服务全球超200万开发者及多家财富500强企业。此次融资将强化其在北美、欧洲、中东的数据中心布局,推动美国AI技术全球化部署。 评论点赞收藏334 天前
GroqCloud上的下一代Compound系统发布Groq正式发布其新一代Agentic AI系统Compound,性能提升显著,支持多浏览器并行、Wolfram计算引擎集成及网页内容抓取,适用于研究、代码执行等场景,定价透明,已开放生产环境使用。 评论点赞收藏347 天前
Groq的LPU会成为赢家吗?Groq发布LPU技术详解,提出四大设计原则:软件优先、可编程流水线架构、确定性计算与网络、片上内存。通过消除资源争用和瓶颈,LPU在AI推理速度、能效和成本上全面优于GPU,为大规模部署提供新思路。 评论点赞收藏366 天前
Groq的首个复合AI系统Groq推出首款复合AI系统Compound Beta,整合开源大模型与工具使用能力,实现实时搜索与代码执行,显著优于传统LLM,适用于需要最新数据或逻辑推理的场景。 评论点赞收藏394 天前
Groq推理基础设施:为速度、质量、成本和规模而生Groq推出专为推理优化的定制芯片LPU,提供极速、低成本的AI推理服务。已获F1车队McLaren采用,API与OpenAI兼容,实测速度提升7.41倍且成本降89%。 评论点赞收藏405 天前
Groq 的首个复合 AI 系统(带计算的 LLM)Groq 推出首款复合 AI 系统 Compound Beta,融合 Llama 4 等大模型与工具调用能力,支持实时搜索和代码执行,显著提升回答准确性与时效性,性能超越 OpenAI 同类产品。 评论点赞收藏470 天前
Llama 4现已在Groq上线Groq上线Meta Llama 4系列模型,提供高性能、低成本的多模态AI服务,支持Scout和Maverick两种配置,适用于开发者和企业。 评论点赞收藏499 天前
Groq LPU技术解析Groq推出专为AI推理设计的Language Processing Unit(LPU),采用软件优先、可编程流水线架构,实现比GPU高10倍的能效比。文章详解其四大设计原则:软件主导、确定性计算、片上内存等,并对比GPU的“中心辐射”模式,强调LPU在消除瓶颈和提升吞吐量方面的优势。 评论点赞收藏528 天前
GroqCloud 推出 DeepSeek R1 蒸馏版 Llama 70BGroqCloud 上线 DeepSeek-R1-Distill-Llama-70b,基于 Llama 3.3 70B 蒸馏的高性能推理模型,在数学和编码任务中表现卓越(MATH-500 达 94.5%),支持 128k 上下文窗口。依托 Groq 高速推理平台,实现低延迟复杂问题求解,适用于实时应用开发。 评论点赞收藏566 天前
Groq现已推出Whisper Large v3 TurboGroq推出Whisper Large v3 Turbo模型,速度达实时216倍,支持多语言语音识别,定价$0.04/小时,适用于客服机器人、自动转录、智能家居及媒体行业。 评论点赞收藏675 天前
沙特阿美与Groq宣布在沙特阿拉伯建设最大推理数据中心沙特阿美与Groq宣布合作建设全球最大AI推理数据中心,支持沙特"2030愿景"。该中心将于2024年底每日处理数十亿token,并为数百万开发者提供高性能AI算力服务。 评论点赞收藏700 天前
Llama3 在 Groq 上的运行Groq推出基于定制LPU芯片的Llama3推理服务,强调高性能、低成本和稳定性。实测数据显示速度提升7.41倍且成本下降89%,获F1车队及开发者广泛采用。API与OpenAI兼容,支持Python/JS快速接入。 评论点赞收藏850 天前
Groq:AI推理是燃料Groq推出专为推理优化的定制芯片LPU,提供比GPU更快、更便宜的AI推理服务。其GroqCloud平台被McLaren F1车队采用,实现聊天速度提升7.41倍且成本降低89%。API与OpenAI兼容,开发者可快速集成。 评论点赞收藏910 天前
Groq的LPU推理引擎在LLM基准测试中表现卓越Groq在Anyscale的LLMPerf排行榜上,凭借LPU推理引擎实现比主流云服务快18倍的输出速度,Llama 2 70B模型平均每秒处理185个token,首字响应时间仅0.22秒。 评论点赞收藏933 天前