长勺智库长勺智库
话题文章任务
登录
NNVIDIA GenerativNVIDIA Generativ发布于 9 小时前
Groq 3 LPX 加入 Vera Rubin,瞄准长上下文超低延迟推理

NVIDIA Groq 3 LPX 是面向 Vera Rubin 平台的交互式 AI 推理加速器。它可与 Vera Rubin NVL72 配合,进一步强化平台在长上下文场景中的高速交互能力,并覆盖从小型到大型、开放与闭源模型等多类 AI 工作负载。

30
AI生成式AI推理算力
30
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 9 小时前
NVIDIA Vera CPU 如何应对智能体 AI 集群挑战

智能体 AI 工作负载具有高度波动和不可预测性。NVIDIA 认为,除了负责模型计算的 GPU,CPU 在任务编排、工具执行和沙箱计算中同样关键,并以 Vera CPU 面向这类 AI 基础设施需求。

20
AI生成式AI推理算力
20
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 9 小时前
智能体 AI 推高推理负载,英伟达强调 Vera Rubin 与 Blackwell 能效

随着 AI 智能体从单轮问答转向推理、工具调用、多智能体协作等多步工作流,推理计算需求持续增长。英伟达称,Vera Rubin 与 Blackwell 平台正面向这一趋势提升单位功耗下的智能体 AI 性能。

30
AI生成式AI推理算力
30
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 4 天前
用 CLI、Skills 与 AI 编程智能体开发 NVIDIA Holoscan 应用

NVIDIA 探索如何让通用 AI 编程智能体利用 Holoscan 的示例、文档和开发工具进行应用开发,并结合 HoloHub 参考应用与组件,验证智能体辅助边缘实时 AI 开发的可行性。

170
AI生成式AI推理算力
170
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 4 天前
生成式推荐正在重塑大规模推荐系统

大语言模型推动推荐系统从传统的嵌入相似度范式转向生成式建模:根据用户历史行为序列,直接预测下一步动作或目录中的下一个物品,为大规模推荐系统提供新的建模思路。

150
AI生成式AI推理算力
150
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 5 天前
NVIDIA SkillEvaluator:如何评估 AI Agent 的技能效果

NVIDIA 介绍 SkillEvaluator,用于衡量技能包能否真正提升 AI Agent 的任务表现。技能通过封装指令、示例和工具使用指南,帮助 Agent 减少无效探索与 Token 消耗,更快完成专业任务。

190
AI生成式AI推理算力
190
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 5 天前
NVIDIA 推出 Cosmos 3 Edge,面向机器人端侧控制

NVIDIA 推出 Cosmos 3 Edge,一款面向机器人端侧运行的 4B 全模态模型,其中包含基于 Nemotron 的 2B 推理模块,旨在降低世界模型部署到机器人板载计算硬件的难度。

150
AI生成式AI推理算力
150
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 5 天前
用 NVIDIA FLARE 构建联邦多模态 AI 工作流

视觉语言模型需要跨机构数据进行适配,但原始数据往往无法集中。联邦学习可让数据保留在本地,同时协调多方训练,为多模态 AI 提供一种兼顾协作与数据本地化的方案。

190
AI生成式AI推理算力
190
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 6 天前
AI 编程智能体如何降低材料原子模拟门槛

原子级材料模拟不仅需要科学知识,还依赖高效计算实现和易用的软件接口。NVIDIA ALCHEMI Toolkit 试图降低后两方面的门槛,并探索让 AI 编程智能体参与材料模拟工作流。

210
AI生成式AI推理算力
210
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 12 天前
Qwen3.8-Max:2.4T 参数开源权重模型可在 GB300 NVL72 上部署

阿里巴巴发布 Qwen3.8-2.4T-A95B 开源权重。该 MoE 模型总参数 2.4T、每 token 激活 95B,并支持可配置推理部署。

480
AI生成式AI推理算力
480
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 13 天前
NVIDIA Nemotron 3.5 Lightning 面向长时运行智能体的执行层优化

NVIDIA 推出 Nemotron 3.5 Lightning:一款开放的 30B MoE 模型,面向长时运行 AI 智能体中的高频执行任务,强调降低成本与延迟。

490
AI生成式AI推理算力
490
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 13 天前
NVIDIA JetPack 7.2.1 增加智能体视频能力与 T3000 仿真

JetPack 7.2.1 面向 Jetson 视频应用新增智能体视频能力与 T3000 仿真,覆盖机器人、智能视频分析、工业自动化等场景。

480
AI生成式AI推理算力
480
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 23 天前
面向长上下文推理的注意力协同设计

长上下文与智能体工作负载普及后,注意力计算在推理耗时中的占比上升,模型架构需要与 GPU 执行方式协同设计。

370
AI生成式AI推理算力
370
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-22 05:02
NVIDIA Vera CPU:面向智能体 AI 的单线程性能设计

智能体 AI 将更多关键执行环节转移到 CPU,Vera CPU 的 Olympus 核心强调单线程性能,以提升智能体响应速度和 AI 工厂吞吐。

910
AI生成式AI推理算力
910
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-17 05:02
用 NVIDIA DeepStream 9.1 构建多摄像头 3D 跟踪应用

多摄像头 3D 跟踪可用于在大空间内跨视角追踪同一目标,弥补单摄像头 2D 跟踪在深度信息和跨画面连续性上的不足。

1270
AI生成式AI推理算力
1270
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-17 05:02
将上下文感知视频 AI Agent 接入企业工作流

视频分析 AI Agent 要在企业中发挥作用,必须与内容管理、消息、数据库、工单和升级路径等现有系统集成。

6250
AI生成式AI推理算力
6250
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-11 05:05
NVIDIA BioNeMo Agent Toolkit 加速端到端共折叠流程

面向药物发现与蛋白质设计的大规模生物分子结构预测,正在从单点模型推理转向由 AI Agent 驱动的端到端流程。

1050
AI生成式AI推理算力
1050
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-11 05:04
面向硬件友好的 LLM 设计

AI 系统不能只看准确率,还要同时权衡吞吐量与交互延迟。模型设计会直接影响部署时的响应速度和用户体验。

1140
AI生成式AI推理算力
1140
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-11 05:03
用主机卸载缓解 JAX 大模型训练的 HBM 瓶颈

JAX 大模型训练常先受限于 GPU 高带宽内存。主机卸载可将部分数据移出 HBM,缓解权重、梯度、优化器状态和激活值的内存竞争。

910
AI生成式AI推理算力
910
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-07 20:09
电信运营商如何用智能体 AI 迈向自治网络

电信运营商正把 AI 用于网络运维、客服和后台流程,但多数仍处于自治早期,网络运维自动化通常停留在 TM Forum L2–L3 水平。

950
AI生成式AI推理算力
950
AI生成式AI推理算力
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录