你的位置:开云(中国)Kaiyun·官方网站-科技股份有限公司 > 新闻 > 云开体育Groq本年迄今已累计融资跳跃30亿好意思元-开云(中国)Kaiyun·官方网站-科技股份有限公司

云开体育Groq本年迄今已累计融资跳跃30亿好意思元-开云(中国)Kaiyun·官方网站-科技股份有限公司

时间:2026-08-25 22:44 点击:79 次

云开体育Groq本年迄今已累计融资跳跃30亿好意思元-开云(中国)Kaiyun·官方网站-科技股份有限公司

聚焦于AI芯片的初创公司Groq在当地时间周三证明,该初创公司阅历新融资后估值纯粹69亿好意思元云开体育,在新一轮融资中筹集了7.5亿好意思元。该公司乃“AI芯片霸主”英伟达(NVDA.US)的最大竞争敌手之一,论竞争敌手们AI芯片边界的商场边界,可能仅次于好意思国芯片巨头博通与AMD。

这一最新的融资数据可谓高于7月融资别传流出时的数字。其时有不少媒体报谈称,本轮融资约为6亿好意思元,估值接近60亿好意思元。

与英伟达的最大营收与利润孝顺业务部门——数据中心业务相似,Groq聚焦于向环球各大数据中心以及企业平台销售最中枢AI算力基础要领——AI芯片集群,曾于2024年8月以28亿好意思元估值融资6.4亿好意思元,最新的融资也使得该AI芯片初创公司的估值在短短的一年内翻了两倍多。

PitchBook的瞻望数据表现,Groq本年迄今已累计融资跳跃30亿好意思元,融资边界堪比Anthropic等AI超等独角兽。

LPU从时候阶梯角度来看,是为推理场景定制的 AI ASIC,而非通用GPU,该公司将系统形态GroqCard/GroqNode/GroqRack,明确归类为定制推理ASIC。

Groq是何方圣洁?

Groq 之是以在环球成本商场炙手可热,主要因为其勤恳于冲破份额高达90%的AI芯片超等霸主英伟达对科技行业AI算力基础要领的强势截止。

Groq所成就的芯片并卓著俗为AI考研/推理系统提供能源的AI GPU。违反,Groq将其称为 LPU(language processing units,言语解决单元),并称其硬件为“推理引擎”——专为极速高效果开动AI大模子而优化的专用高性能推理型打算机,从时候阶梯来看和博通AI ASIC以及谷歌TPU属于同类AI芯移时候阶梯。

其产物面向成就者和企业,既可算作云打算算力做事提供,也可算作土产货部署的硬件集群提供。Groq土产货硬件聚焦于土产货AI做事器机架,配备其集成硬件/软件节点的堆栈。云霄与土产货硬件均可开动风靡环球AI大模子的所有更新迭代版块,举例来自 Meta、DeepSeek、Qwen、Mistral、Google和OpenAI所成就的AI模子。Groq暗示,其LPU产物在成本权贵低于中枢替代有筹画的情况下,粗略保握,或在某些情况下不测擢升AI大模子推理开动效果。

Groq 的首创东谈主Jonathan Ross 在AI芯片边界号称“超等时候大拿”。Ross也曾在好意思国科技巨头谷歌的芯片成就部门从事其Tensor Processing Unit(即所谓“TPU”)芯片的无缺成就,该类AI ASIC旅途的芯片是谷歌为高负载AI打算任务挑升假想的专用高性能解决器。

谷歌TPU于2016年发布,与Groq走出行业隐身期是合并年。谷歌TPU算力集群照旧成长为给谷歌云平台Google Cloud 的AI考研/推理算力做事提供中枢能源的硬件体系,在谷歌数据中心的边界仅次于英伟达AI GPU算力集群。

谷歌近日流露了Ironwood TPU(TPU v6)的最新细节,展现出令东谈主把稳标性能擢升。与TPU v5p比较,Ironwood的峰值FLOPS性能擢升足足10倍,功效比擢升5.6倍,与谷歌2022年推出的TPU v4比较,Ironwood的单芯片算力擢升以致跳跃16倍。

性能对比表现:谷歌Ironwood的4.2 TFLOPS/瓦功效比仅略低于英伟达B200/300 GPU的4.5 TFLOPS/瓦。摩根大通驳斥称:这一性能数据杰出标明,先进AI的专用AI ASIC芯片正快速削弱与处于商场起始地位AI GPU的性能差距,鼓励超大边界云打算做事商加大关于更具性价比的定制化ASIC神态标投资。

Groq暗示,当今其为跳跃200万名成就者的AI诓骗提供算力集群撑握,而在该公司一年前接受TechCrunch 采访时,这一数字只是为纯粹35万名成就者。

据了解,该AI芯片初创公司的新一轮融资由投资公司 Disruptive 领投,环球资管巨头BlackRock,以及Neuberger Berman、Deutsche Telekom Capital Partners 等参投。还包括三星(Samsung)、想科(Cisco)、D1和Altimeter 在内的现存投资者也参与了本轮融资。

专心聚焦于AI推理边界的LPU

Groq的LPU是为推理(尤其是大言语模子 LLM 推理)而生的专用加快器,中枢架构是Groq自主成就的 TSP(Tensor Streaming Processor,张量流式解决器):以静态、可瞻望(deterministic)的流式数据通路替代传统AI GPU的“线程/内核/缓存”范式,强调低蔓延、厚及时延与小批量高朦拢。

Groq所成就的LPU芯片秉承大容量片上SRAM(约 220MB),超高片上带宽(官方贵府示例至 80TB/s),并以编译器在时间与空间上显式调理算子与数据流,险些不依赖硬件中的“响应式”部件(如缓存/仲裁器/回放机制)。

通过 TSP 流式、静态可瞻望的编译时调理+ 片上高带宽SRAM供算,在低/零批量 LLM 推理里,LPU提供相较AI GPU集群更低的时延、更厚实的朦拢与潜在更高的能效/请托效果。但在大模子考研、动态职责负载与生态无缺度方面,聚焦于通用的GPU集群仍具系统性上风。

值得着重的是,关于那些深度聚焦“AI大模子考研”与“超大王人量朦拢”的概述型AI职责负载,英伟达AI GPU生态(CUDA/高带宽显存/NVLink等)仍全面占优,LPU的上风主要在交互式/及时推理与低蔓延的LLM推理算力职责负载。

尤其在batch 很小(以致 batch=1)的 LLM 场景,LPU 不需要“堆 batch 才跑得满”,单元芯片的 tokens/s 更高、调理支拨更低,能知足交互式产物对“快讲演”的条款。Groq的LPU在大容量片上 SRAM凯旋供算,官方贵府展示片上带宽可达 80TB/s,而 GPU 需频频看望片外 HBM,因此LPU大幅减少“算存”走动,粗略提高AI大模子开动效果并具备极高的能效比。LPU细则性施行带来更平滑的功耗弧线,相助精简数据旅途,推理每token的能耗更低,有报谈称 LPU 在等效推理上功耗约为常见GPU的三分之一。

因此,AI ASIC天然无法全面大边界取代英伟达,然则商场份额例必将愈发膨胀,而不是面前英伟达AI GPU一家独大地点。在可纪律化的主流推理与部分考研(尤其是握续性长尾考研/微调)上,定制化AI ASIC 的“单元朦拢成本/能耗”权贵优于纯GPU有筹画;而在快速探索、前沿大模子考研与多模态新算子试错上,英伟达AI GPU仍是主力。因此面前在AI工程施行中,科技巨头们愈发倾向秉承“ASIC 扛常态化、GPU 扛探索峰值/新模子成就”的搀和架构来最小化 TCO。

海量资讯、精确解读,尽在新浪财经APP

职守剪辑:于健 SF069云开体育

服务热线
官方网站:www.umfkj.com
工作时间:周一至周六(09:00-18:00)
联系我们
QQ:33582126092
邮箱:2972bff6@outlook.com
地址:新闻科技园9197号
关注公众号

Powered by 开云(中国)Kaiyun·官方网站-科技股份有限公司 RSS地图 HTML地图


开云(中国)Kaiyun·官方网站-科技股份有限公司-云开体育Groq本年迄今已累计融资跳跃30亿好意思元-开云(中国)Kaiyun·官方网站-科技股份有限公司

回到顶部