长勺智库长勺智库
话题文章任务
登录
NNVIDIA GenerativNVIDIA Generativ发布于 6 天前
NVIDIA Vera CPU:面向智能体 AI 的单线程性能设计

智能体 AI 将更多关键执行环节转移到 CPU,Vera CPU 的 Olympus 核心强调单线程性能,以提升智能体响应速度和 AI 工厂吞吐。

530
AI生成式AI推理算力
530
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 11 天前
用 NVIDIA DeepStream 9.1 构建多摄像头 3D 跟踪应用

多摄像头 3D 跟踪可用于在大空间内跨视角追踪同一目标,弥补单摄像头 2D 跟踪在深度信息和跨画面连续性上的不足。

840
AI生成式AI推理算力
840
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 11 天前
将上下文感知视频 AI Agent 接入企业工作流

视频分析 AI Agent 要在企业中发挥作用,必须与内容管理、消息、数据库、工单和升级路径等现有系统集成。

5830
AI生成式AI推理算力
5830
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 17 天前
NVIDIA BioNeMo Agent Toolkit 加速端到端共折叠流程

面向药物发现与蛋白质设计的大规模生物分子结构预测,正在从单点模型推理转向由 AI Agent 驱动的端到端流程。

610
AI生成式AI推理算力
610
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 17 天前
面向硬件友好的 LLM 设计

AI 系统不能只看准确率,还要同时权衡吞吐量与交互延迟。模型设计会直接影响部署时的响应速度和用户体验。

720
AI生成式AI推理算力
720
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 17 天前
用主机卸载缓解 JAX 大模型训练的 HBM 瓶颈

JAX 大模型训练常先受限于 GPU 高带宽内存。主机卸载可将部分数据移出 HBM,缓解权重、梯度、优化器状态和激活值的内存竞争。

520
AI生成式AI推理算力
520
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 21 天前
电信运营商如何用智能体 AI 迈向自治网络

电信运营商正把 AI 用于网络运维、客服和后台流程,但多数仍处于自治早期,网络运维自动化通常停留在 TM Forum L2–L3 水平。

550
AI生成式AI推理算力
550
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 21 天前
DFlash 推测解码可在 NVIDIA Blackwell 上提升推理性能

文章介绍了 DFlash 推测解码在 NVIDIA Blackwell 上提升低延迟推理性能的思路,重点关注自回归 LLM 的串行生成瓶颈。

720
AI生成式AI推理算力
720
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 21 天前
用 NVIDIA Model Optimizer 创建 Nemotron 3 Ultra NVFP4 检查点

NVIDIA 介绍了如何利用 Model Optimizer 与 Blackwell 架构中的 NVFP4 4 位浮点格式,压缩大模型权重以提升长上下文场景下的效率。

750
AI生成式AI推理算力
750
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 21 天前
企业 AI 工厂如何治理自主智能体

AI 智能体正从聊天走向代码检查、测试、文档读取和业务系统操作。企业需要为其建立安全、可治理的运行环境。

560
AI生成式AI推理算力
560
AI生成式AI推理算力
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录