长勺智库长勺智库
话题文章任务
登录
NNVIDIA GenerativNVIDIA Generativ发布于 11 分钟前
用 CLI、Skills 与 AI 编程智能体开发 NVIDIA Holoscan 应用

NVIDIA 探索如何让通用 AI 编程智能体利用 Holoscan 的示例、文档和开发工具进行应用开发,并结合 HoloHub 参考应用与组件,验证智能体辅助边缘实时 AI 开发的可行性。

0
AI生成式AI推理算力
0
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 11 分钟前
生成式推荐正在重塑大规模推荐系统

大语言模型推动推荐系统从传统的嵌入相似度范式转向生成式建模:根据用户历史行为序列,直接预测下一步动作或目录中的下一个物品,为大规模推荐系统提供新的建模思路。

0
AI生成式AI推理算力
0
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 1 天前
NVIDIA SkillEvaluator:如何评估 AI Agent 的技能效果

NVIDIA 介绍 SkillEvaluator,用于衡量技能包能否真正提升 AI Agent 的任务表现。技能通过封装指令、示例和工具使用指南,帮助 Agent 减少无效探索与 Token 消耗,更快完成专业任务。

30
AI生成式AI推理算力
30
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 1 天前
NVIDIA 推出 Cosmos 3 Edge,面向机器人端侧控制

NVIDIA 推出 Cosmos 3 Edge,一款面向机器人端侧运行的 4B 全模态模型,其中包含基于 Nemotron 的 2B 推理模块,旨在降低世界模型部署到机器人板载计算硬件的难度。

10
AI生成式AI推理算力
10
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 1 天前
用 NVIDIA FLARE 构建联邦多模态 AI 工作流

视觉语言模型需要跨机构数据进行适配,但原始数据往往无法集中。联邦学习可让数据保留在本地,同时协调多方训练,为多模态 AI 提供一种兼顾协作与数据本地化的方案。

30
AI生成式AI推理算力
30
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2 天前
AI 编程智能体如何降低材料原子模拟门槛

原子级材料模拟不仅需要科学知识,还依赖高效计算实现和易用的软件接口。NVIDIA ALCHEMI Toolkit 试图降低后两方面的门槛,并探索让 AI 编程智能体参与材料模拟工作流。

120
AI生成式AI推理算力
120
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 8 天前
Qwen3.8-Max:2.4T 参数开源权重模型可在 GB300 NVL72 上部署

阿里巴巴发布 Qwen3.8-2.4T-A95B 开源权重。该 MoE 模型总参数 2.4T、每 token 激活 95B,并支持可配置推理部署。

390
AI生成式AI推理算力
390
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 9 天前
NVIDIA Nemotron 3.5 Lightning 面向长时运行智能体的执行层优化

NVIDIA 推出 Nemotron 3.5 Lightning:一款开放的 30B MoE 模型,面向长时运行 AI 智能体中的高频执行任务,强调降低成本与延迟。

400
AI生成式AI推理算力
400
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 9 天前
NVIDIA JetPack 7.2.1 增加智能体视频能力与 T3000 仿真

JetPack 7.2.1 面向 Jetson 视频应用新增智能体视频能力与 T3000 仿真,覆盖机器人、智能视频分析、工业自动化等场景。

370
AI生成式AI推理算力
370
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 19 天前
面向长上下文推理的注意力协同设计

长上下文与智能体工作负载普及后,注意力计算在推理耗时中的占比上升,模型架构需要与 GPU 执行方式协同设计。

260
AI生成式AI推理算力
260
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-22 05:02
NVIDIA Vera CPU:面向智能体 AI 的单线程性能设计

智能体 AI 将更多关键执行环节转移到 CPU,Vera CPU 的 Olympus 核心强调单线程性能,以提升智能体响应速度和 AI 工厂吞吐。

820
AI生成式AI推理算力
820
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-17 05:02
用 NVIDIA DeepStream 9.1 构建多摄像头 3D 跟踪应用

多摄像头 3D 跟踪可用于在大空间内跨视角追踪同一目标,弥补单摄像头 2D 跟踪在深度信息和跨画面连续性上的不足。

1160
AI生成式AI推理算力
1160
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-17 05:02
将上下文感知视频 AI Agent 接入企业工作流

视频分析 AI Agent 要在企业中发挥作用,必须与内容管理、消息、数据库、工单和升级路径等现有系统集成。

6150
AI生成式AI推理算力
6150
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-11 05:05
NVIDIA BioNeMo Agent Toolkit 加速端到端共折叠流程

面向药物发现与蛋白质设计的大规模生物分子结构预测,正在从单点模型推理转向由 AI Agent 驱动的端到端流程。

940
AI生成式AI推理算力
940
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-11 05:04
面向硬件友好的 LLM 设计

AI 系统不能只看准确率,还要同时权衡吞吐量与交互延迟。模型设计会直接影响部署时的响应速度和用户体验。

1040
AI生成式AI推理算力
1040
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-11 05:03
用主机卸载缓解 JAX 大模型训练的 HBM 瓶颈

JAX 大模型训练常先受限于 GPU 高带宽内存。主机卸载可将部分数据移出 HBM,缓解权重、梯度、优化器状态和激活值的内存竞争。

810
AI生成式AI推理算力
810
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-07 20:09
电信运营商如何用智能体 AI 迈向自治网络

电信运营商正把 AI 用于网络运维、客服和后台流程,但多数仍处于自治早期,网络运维自动化通常停留在 TM Forum L2–L3 水平。

860
AI生成式AI推理算力
860
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-07 20:08
DFlash 推测解码可在 NVIDIA Blackwell 上提升推理性能

文章介绍了 DFlash 推测解码在 NVIDIA Blackwell 上提升低延迟推理性能的思路,重点关注自回归 LLM 的串行生成瓶颈。

1020
AI生成式AI推理算力
1020
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-07 20:08
用 NVIDIA Model Optimizer 创建 Nemotron 3 Ultra NVFP4 检查点

NVIDIA 介绍了如何利用 Model Optimizer 与 Blackwell 架构中的 NVFP4 4 位浮点格式,压缩大模型权重以提升长上下文场景下的效率。

1040
AI生成式AI推理算力
1040
AI生成式AI推理算力
NNVIDIA GenerativNVIDIA Generativ发布于 2026-07-07 20:08
企业 AI 工厂如何治理自主智能体

AI 智能体正从聊天走向代码检查、测试、文档读取和业务系统操作。企业需要为其建立安全、可治理的运行环境。

870
AI生成式AI推理算力
870
AI生成式AI推理算力
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录