AI安全是工程问题:如何在智能体技术栈每层解决
NVIDIA联合Cisco、JFrog、CrowdStrike等合作伙伴,围绕AI Agent全栈安全提出工程化框架,涵盖身份管理、权限边界、沙箱执行与持续红队测试,并开源OpenShell运行时,推动安全防护能力在更广...
NVIDIA联合Cisco、JFrog、CrowdStrike等合作伙伴,围绕AI Agent全栈安全提出工程化框架,涵盖身份管理、权限边界、沙箱执行与持续红队测试,并开源OpenShell运行时,推动安全防护能力在更广...
NVIDIA Earth-2新增AI数据同化功能,支持将卫星、气象站等多源观测数据融入扩散模型,提供SDA与HealDA两种技术路径,可在秒级内估算全球大气状态,帮助能源、农业、保险等行业实现更高频、更精准的区域或全球天...
NVIDIA在大埃及博物馆举办活动,展示埃及AI生态快速发展成果。过去一年埃及深度学习学员增长逾十倍,非洲已有四座AI工厂宣布或上线,另有656兆瓦产能在建,NVIDIA已在非洲培训逾8.5万名开发者。
本文系统介绍了AI Agent评估体系的演进,阐述了步骤级与端到端两种评分机制的区别,并以SWE-bench和NVIDIA Nemotron 3.5 Lightning为例,说明工具调用已成为现代基准测试的核心基础,建议...
NVIDIA Dynamo-Triton 26.07新增TensorRT多设备推理能力,单个Triton实例可调度最多8块GPU协同执行,以Cosmos 3 Nano视频生成为例,端到端延迟从156.6秒降至34.2秒,...
RTX 5090最低售价已从1999美元涨至逾6000美元,部分渠道报价超9000美元,据称与AI服务器厂商囤货有关,但相关照片被指可能为AI生成,真实性存疑。
NVIDIA介绍多智能体工作流:借助Omniverse Libraries和OpenUSD,将Blender场景自动转化为可用于Isaac Sim/Isaac Lab的仿真就绪世界。
NVIDIA团队开发AI智能体技能,将TileGym中24个cuTile Python/Triton-TileIR内核自动转译为cuTile Rust,性能达原版99.5%,token成本降低约一半。
NVIDIA TensorRT Edge-LLM运行Qwen3.6-27B在MLPerf Edge Agentic基准测试中,于单个Jetson AGX Thor上以24分36秒完成全部1007轮测试,较llama.cp...
费城儿童医院利用NVIDIA开源AI工具,可在数秒内建立儿童心脏三维模型,帮助医生为先天性心脏病患儿定制更精准的手术方案。
NVIDIA推出Groq 3 LPX加速器,通过确定性执行与PEP、CPS技术减少电压裕量,配合Vera Rubin NVL72平台提升每兆瓦token吞吐量,最高较GB200 NVL72提升35倍。
文章解析Dense与MoE两种模型架构差异,以Nemotron 3.5 Lightning为例说明MoE如何用3B激活参数实现30B模型容量,并给出内存、并发、微调等场景选型建议。
Perplexity推出Portable Computer的Windows版本,基于NVIDIA RTX GPU本地运行AI智能体,支持敏感数据本地处理并可按需接入云端模型。
NVIDIA通过Transformer Engine对JAX中的Dropless MoE训练进行分组GEMM、专家并行等优化,使DeepSeek-V3训练性能从103提升至1068 TFLOPS/GPU,1024 GPU...
英伟达宣布以130亿美元收购Hugging Face,双方承诺平台保持开放中立,但分析师提醒企业需警惕长期治理与生态集中风险。
NVIDIA通过NIM 2.0.12全栈优化,在4xB200硬件上为Nemotron 3 Ultra智能体工作负载实现最高2.5倍并发用户吞吐量提升,优化涵盖内核、并行、前缀缓存与推测解码等技术。
Skild AI基于NVIDIA物理AI基础设施推出S1机器人基础模型,可通过单段视频演示学习未见过的长周期任务,无需重新训练。测试中新任务成功率达66%,是同类系统的7倍以上,公司年营收已达1亿美元。
NVIDIA BioNeMo Inference Runtime通过内核优化、CUDA Graphs和Ray多GPU并行提升结构预测吞吐量,在千目标基准测试中较开源Boltz-2实现2.9倍吞吐提升并显著降低能耗。
英伟达宣布以129亿美元收购开源AI公司Hugging Face,承诺保持其硬件与模型中立。分析人士认为此举将影响企业AI模型的选型与部署。
NVIDIA发布CUDA Toolkit 13.4,新增Windows on Arm支持、Rubin架构预览、MPS V3及CCCL 3.4等多项GPU开发与性能优化功能。