NVIDIA Groq 3 LPX 是面向 Vera Rubin 平台的交互式 AI 推理加速器。它可与 Vera Rubin NVL72 配合,进一步强化平台在长上下文场景中的高速交互能力,并覆盖从小型到大型、开放与闭源模型等多类 AI 工作负载。
智能体 AI 工作负载具有高度波动和不可预测性。NVIDIA 认为,除了负责模型计算的 GPU,CPU 在任务编排、工具执行和沙箱计算中同样关键,并以 Vera CPU 面向这类 AI 基础设施需求。
随着 AI 智能体从单轮问答转向推理、工具调用、多智能体协作等多步工作流,推理计算需求持续增长。英伟达称,Vera Rubin 与 Blackwell 平台正面向这一趋势提升单位功耗下的智能体 AI 性能。
GPT-5.6 现已在 Kiro 中提供,可协助开发者完成软件规划、构建、代码审查与测试,并进一步改善开发过程中的价格与性能表现。
文章概述 Joon Sung Park 先从艺术与计算的交叉切入研究,后来因《Generative Agents》与 Smallville 项目受到关注,并继续推进更大的目标:把人类行为建模成可用于推演现实的模拟系统。 从生成式代理到 Simile 《Generative Agents》展示了 AI 角色可以具备记忆、规划、社交与涌现行为,这成为他之后做 Simile 的起点。与只做任务型模型不同,Simile 更关注如何建立能反映真实人类决策的行为基础模型。 他们在建模什么 文中提到,Simile 采用长...
Poolside 与英伟达达成非独家技术许可协议,并获得后者 10 亿美元投资。109 名员工将加入英伟达,而创始人继续留在 Poolside。交易背后凸显前沿模型训练面临的算力、资本和数据中心约束。
智谱AI CEO唐杰提出,模型能力不能再只用参数量衡量,数据、算力投入方式、部署条件与后训练同样关键。GLM-5.3的能力提升主要来自长周期环境中的强化学习训练。
Matt Pocock 推出的 /wayfinder 技能,面向目标尚不清晰的新项目与复杂规划场景。它通过拆分规划线程、原型验证和研究,再汇总为更完整的规格,降低长上下文与多会话规划的负担。
NVIDIA 探索如何让通用 AI 编程智能体利用 Holoscan 的示例、文档和开发工具进行应用开发,并结合 HoloHub 参考应用与组件,验证智能体辅助边缘实时 AI 开发的可行性。
大语言模型推动推荐系统从传统的嵌入相似度范式转向生成式建模:根据用户历史行为序列,直接预测下一步动作或目录中的下一个物品,为大规模推荐系统提供新的建模思路。
在发布日期固定、设计资源已投入其他项目的情况下,Stampli 借助 Codex 和 ChatGPT Work,将原本需要数周的发布制作流程压缩至数天。
OpenAI 推出新博客 AI Futures,聚焦变革性人工智能可能如何重塑权力、治理、经济以及个人自由等重要议题。
前沿模型成本持续攀升、开放权重模型能力增强,使企业越来越难用单一模型覆盖所有任务。Glean CEO Arvind Jain 认为,模型路由的核心是在效果、成本与企业治理之间动态选择,甚至判断某些任务是否根本不需要调用大模型。
内存市场正经历罕见的价格逆转:部分产品一年涨价约500%,128GB DDR5套装价格达到历史低点的10倍。有观点认为,单位容量内存成本已回到2007年前后的水平,而大型云计算客户正在提前锁定未来DRAM产能。
NVIDIA 介绍 SkillEvaluator,用于衡量技能包能否真正提升 AI Agent 的任务表现。技能通过封装指令、示例和工具使用指南,帮助 Agent 减少无效探索与 Token 消耗,更快完成专业任务。
NVIDIA 推出 Cosmos 3 Edge,一款面向机器人端侧运行的 4B 全模态模型,其中包含基于 Nemotron 的 2B 推理模块,旨在降低世界模型部署到机器人板载计算硬件的难度。
视觉语言模型需要跨机构数据进行适配,但原始数据往往无法集中。联邦学习可让数据保留在本地,同时协调多方训练,为多模态 AI 提供一种兼顾协作与数据本地化的方案。
NVIDIA 团队使用 ChatGPT Work 减少人工任务、连接快速变化的信息信号,并将经过验证的工作流程推广到全球团队。


