Techub News 消息,英伟达宣布其 Groq 3 LPX 推理芯片已进入全面生产阶段,在 Gemma 4 31B 模型上实现每秒 3400 token 的推理速度,宣称比 Cerebras 快四倍。但实际性能对比更为复杂,英伟达需要至少 64 个加速器才能达到此速度,而 Cerebras 仅需一至两个。该架构在大型 MoE 模型上的扩展能力仍有待观察。 (The Decoder)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Mọi thông tin trên trang web này chỉ mang tính tham khảo.
Trang web không bảo đảm tính chính xác, hiệu lực, kịp thời hay đầy đủ của thông tin.
Người dùng tự chịu rủi ro khi hành động dựa trên thông tin của trang web này.
Techub News 消息,英伟达宣布其 Groq 3 LPX 推理芯片已进入全面生产阶段,在 Gemma 4 31B 模型上实现每秒 3400 token 的推理速度,宣称比 Cerebras 快四倍。但实际性能对比更为复杂,英伟达需要至少 64 个加速器才能达到此速度,而 Cerebras 仅需一至两个。该架构在大型 MoE 模型上的扩展能力仍有待观察。 (The Decoder)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Mọi thông tin trên trang web này chỉ mang tính tham khảo. Trang web không bảo đảm tính chính xác, hiệu lực, kịp thời hay đầy đủ của thông tin. Người dùng tự chịu rủi ro khi hành động dựa trên thông tin của trang web này.