英伟达将推出两款全新的 AI 加速芯片

英伟达将推两款AI加速芯片:今年下半年发布Blackwell Ultra NVL72,浮点性能与内存容量均提升1.5倍,带宽翻倍并新增注意力指令;明年下半年推出Vera Rubin NVL144,集成自研CPU(性能翻倍、功耗仅50W)、CX9网卡、NVLink6与HBM4,实现全栈升级。

发布于2025年3月20日 04:19
编辑零重力瓦力
评论0
阅读63

英伟达即将推出两款面向数据中心的 AI 加速器芯片!

即将在今年下半年推出的 Blackwell Ultra NVL72,在多个关键指标上都实现了显著提升。浮点运算性能提高 1.5 倍,内存容量增加 1.5 倍,网络带宽翻倍,并引入了专门的注意力机制指令集,这些升级都将显著提升大型语言模型的训练和推理效率。

计划于明年下半年推出的 Vera Rubin NVL144,是以发现暗物质的著名天文学家 Vera Rubin 命名,并且是一次全方位的技术革新。它采用了全新设计的 CPU,性能较现有的 Grace 处理器提升一倍,而功耗仅有 50 瓦。产品整合了新一代 CX9 网络智能网卡、NVLink6 互联技术和 HBM4 内存,几乎每个核心组件都经过重新设计。

或许,随着基础设施升级、模型增强、应用拓展能够形成一个令人期待的良性循环。但是,我们也需要留意,随着技术复杂度提升,行业门槛也在不断抬高,AI 能力可能会进一步集中在少数具备强大研发实力和资本优势的企业手中。

相关文章

Jev 实操指南,用概率闸门重构智能体决策流
AI 新闻资讯
2026年9月18日
0 条评论
小创

Jev 实操指南,用概率闸门重构智能体决策流

TypeSafe AI 推出系统一模型 Jev,作为智能体概率决策闸门,仅返回带校准概率的结构化结果而不生成文本。该模型具备低成本、低延迟及零输出错误率特性,支持 Choice、Score、Noul 三种提问原语。文章详解了其 API 调用、SDK 集成及推测式并行、置信度路由等五种落地模式,并指出其本质是强类型函数调用而非廉价 LLM。建议在生产环境中锁定版本、规避算术任务,并通过影子模式实测校准效果。

#智能体#AI 编程#提示词工程
阅读全文
本地跑赢千亿旗舰的 Qwen 3.8 27B,如何用参数驯服过度思考
AI 新闻资讯
2026年8月20日
0 条评论
小创

本地跑赢千亿旗舰的 Qwen 3.8 27B,如何用参数驯服过度思考

Qwen 3.8 27B以17GB显存实现媲美千亿旗舰的性能,但默认深思机制易引发过度思考。掌握推理强度(low/medium/xhigh)等调参逻辑,能助开发者在本地兼顾极速响应与复杂任务高准确率。

#AI编程#本地模型#Qwen
阅读全文
Qwen 3.8 27B 调节推理深度并用 MTP 提速 72% 的避坑指南
AI 新闻资讯
2026年8月19日
0 条评论
小创

Qwen 3.8 27B 调节推理深度并用 MTP 提速 72% 的避坑指南

Qwen 3.8 27B 默认 xhigh 推理档位易致算力浪费,简单任务建议调低 reasoning_effort 或关闭推理以提升响应速度;复杂多步任务则需保留高推理以确保准确性。配合 MTP 多 token 预测技术,本地推理速度可提升 72%。该模型底层能力优秀,用户应根据场景灵活调节推理深度以平衡效率与质量。此外,行业亟需统一推理能效标准,解决不同厂商默认策略不透明导致的成本黑盒问题。

#本地AI#Qwen#推理控制
阅读全文
互动讨论

评论区

围绕《英伟达将推出两款全新的 AI 加速芯片》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。