阿里巴巴Qwen3.8-Flash-Next模型登陆NVIDIA GB300 NVL72,专为智能体编程优化
阿里巴巴发布Qwen3.8-Flash-Next模型权重,作为Qwen4架构预览版。该模型为多模态混合专家架构,主模型参数量125B,附加51B N-gram嵌入,每token激活6B参数,原生支持262K上下文窗口,可...
阿里巴巴发布Qwen3.8-Flash-Next模型权重,作为Qwen4架构预览版。该模型为多模态混合专家架构,主模型参数量125B,附加51B N-gram嵌入,每token激活6B参数,原生支持262K上下文窗口,可...
阿里巴巴发布Qwen3.8-Flash-Next模型权重,作为Qwen4架构预览版,该模型为多模态混合专家架构,拥有176B总参数,每个Token激活6B参数,原生支持262K token上下文窗口,可扩展至1M tok...
英伟达发布Jetson Orin Nano 2机器人计算机,面向入门级边缘AI应用。新品在相同外形下推理性能较前代提升2倍,同等性能下功耗降低40%。该产品搭载78 TOPS AI算力、8GB内存及8核Arm CPU,支...
COMPASS是一个统一框架,通过残差强化学习实现跨机器人平台的导航能力迁移。开发者只需定义机器人、场景和导航目标,编码智能体便可自动完成依赖验证、资产准备、烟雾测试、训练启动和检查点评估。以波士顿动力Spot为参考机器...
NVIDIA推出NVLink Fusion与NVHBM技术,为超大规模算力提供商和AI原生企业构建定制加速器提供支撑。NVHBM相比标准HBM4e可提升30%内存带宽、节省高达67%的PHY及支撑区域面积、降低15%内存...
NVIDIA Dynamo推出影子引擎恢复功能(预览版),可在LLM推理引擎进程崩溃时实现秒级恢复。该功能通过GPU内存服务(GMS)将权重生命周期与引擎进程解耦,并预先在同一GPU上保持一个完全初始化的待机引擎。测试显...
NVIDIA随CUDA 13.3发布CUDA Python 1.0,正式将Python列为CUDA平台的一等支持语言。此次发布包含cuda.core 1.0.0(运行时接口)、cuda.compute 1.0.0(并行算...
NVIDIA推出AI网络第五大支柱——Scale-In网络基础设施,以BlueField-4 DPU为核心,联合DOCA软件框架与Spectrum-X以太网,将传统南北向网络演进为统一加速的基础设施域。该架构将安全、多租...
NVIDIA Vera CPU专为智能体AI工厂设计,针对真实智能体任务轨迹的两大特征——长序列依赖链与间歇性并行爆发——实现均衡优化。基于163,594个智能体会话的遥测数据,97%以上的会话呈现独特轨迹,传统多核CP...
NVIDIA Groq 3 LPX是专为Vera Rubin平台设计的交互式AI推理加速器。第三方机构Artificial Analysis在Gemma 4 31B模型上完成首次基准测试,于100K上下文长度下实测输出速...
本文介绍AdaptGrow算法——一种GPU加速的对称非负矩阵分解(SymNMF)方法,可将滚动相关矩阵和尾部依赖矩阵转化为硬聚类标签、软因子载荷及结构突变信号。通过内存优化将峰值存储从约20n?降至4n?字节,单块NV...
本周企业技术领域聚焦AI基础设施建设的现实挑战。英伟达为OpenAI俄亥俄州数据中心提供最高1050亿美元担保,显示芯片厂商正深度介入数据中心融资。宾夕法尼亚州出台新法规,要求超25兆瓦数据中心满足电力供给要求。Anth...
NVIDIA研究项目AVO(智能体变异算子)在ARC-AGI-3公开集全部25个环境中获得100分满分,完成183个关卡,所用环境动作数比VISTA系统少约12%。AVO的核心优势在于持久记忆、监督机制和长期自主运行能力...
随着AI智能体能力增强、任务周期延长,安全设计愈发关键。NVIDIA安全团队结合OpenShell等项目,梳理了智能体技术栈的核心层次:模型层、编排层、元编排层、安全运行时及推理基础设施。文章指出,提示词与模型护栏只能引...
英伟达推出recsys-examples与nv-embedding-cache,推动推荐系统从传统嵌入相似度方法转向生成式架构。文章介绍了HSTU和语义ID两种生成式推荐方案,解析DynamicEmb动态嵌入表、分层KV...
NVIDIA Holoscan是面向边缘端实时AI应用的开发平台,涵盖医学影像与机器人等领域。本文介绍如何借助AI编码智能体构建实时内窥镜工具分割应用,通过HoloHub示例、开发文档与Holoscan CLI协同驱动开...
NVIDIA发布Cosmos 3 Edge,这是一款4B参数的全模态模型,专为机器人端侧部署设计,可在NVIDIA Jetson Thor上本地运行推理。该模型基于与Cosmos 3 Nano和Super相同的物理世界数...
NVIDIA推出开源工具SkillEvaluator,用于评估技能包对AI智能体性能的影响。该工具通过三级评估体系(静态检查、差异性检测、实时运行对比)对300余项已验证技能进行基准测试。结果显示,安装技能后,智能体在正...
NVIDIA cuML与cuVS 25.06版本推出多GPU支持的UMAP训练功能,通过将计算密集的全邻居kNN图构建任务分布至多块GPU,显著提升大规模数据集的处理效率。该方案将数据集划分为均衡集群,各GPU独立计算局...
NVIDIA通过量化感知蒸馏(QAD)技术,将Nemotron 3.5 Lightning模型从66GB压缩至22GB的NVFP4格式,在保持精度的同时实现最高4倍吞吐量提升。QAD以全精度BF16模型为教师,通过KL散...