NVIDIA Vera CPU:面向智能体 AI 的单线程性能设计
智能体 AI 将更多关键执行环节转移到 CPU,Vera CPU 的 Olympus 核心强调单线程性能,以提升智能体响应速度和 AI 工厂吞吐。
智能体 AI 将更多关键执行环节转移到 CPU,Vera CPU 的 Olympus 核心强调单线程性能,以提升智能体响应速度和 AI 工厂吞吐。
多摄像头 3D 跟踪可用于在大空间内跨视角追踪同一目标,弥补单摄像头 2D 跟踪在深度信息和跨画面连续性上的不足。
面向药物发现与蛋白质设计的大规模生物分子结构预测,正在从单点模型推理转向由 AI Agent 驱动的端到端流程。
JAX 大模型训练常先受限于 GPU 高带宽内存。主机卸载可将部分数据移出 HBM,缓解权重、梯度、优化器状态和激活值的内存竞争。
电信运营商正把 AI 用于网络运维、客服和后台流程,但多数仍处于自治早期,网络运维自动化通常停留在 TM Forum L2–L3 水平。
文章介绍了 DFlash 推测解码在 NVIDIA Blackwell 上提升低延迟推理性能的思路,重点关注自回归 LLM 的串行生成瓶颈。
NVIDIA 介绍了如何利用 Model Optimizer 与 Blackwell 架构中的 NVFP4 4 位浮点格式,压缩大模型权重以提升长上下文场景下的效率。