人工智能 关键字列表
让大模型安全防护失效的"黑科技"袋子:牛津大学团队揭露AI推理安全系统的致命弱点

让大模型安全防护失效的"黑科技"袋子:牛津大学团队揭露AI推理安全系统的致命弱点

牛津大学研究团队发现了针对AI推理安全系统的四种"黑科技"攻击方法,能以超过90%的成功率让最先进的安全防护失效。这些方法利用AI对话模板的结构性缺陷,从简单的符号插入到复杂的推理劫持,门槛极低但威力巨大。研究揭示了当前AI安全架构的根本性问题,特别是在开源AI时代,这些漏洞的影响范围前所未有。

Google DeepMind首次公开揭秘SynthID-Image:互联网级别AI图像水印系统的实战部署经验

Google DeepMind首次公开揭秘SynthID-Image:互联网级别AI图像水印系统的实战部署经验

Google DeepMind团队公开了SynthID-Image系统的完整技术细节和部署经验。该系统已为超过100亿张AI图像添加不可见水印,实现互联网规模的内容溯源。研究详细阐述了水印技术的核心原理、质量保持方法、鲁棒性设计和安全防护策略,并分享了从实验室技术转向大规模实际部署的宝贵经验,为AI内容溯源技术的产业化应用提供重要参考。

KAIST团队破解AI绘画难题:让机器不再"跑偏"的神奇时间魔法

KAIST团队破解AI绘画难题:让机器不再"跑偏"的神奇时间魔法

KAIST团队提出TAG(时间对齐引导)技术,解决扩散模型在接受外部指导时容易偏离正轨的问题。通过训练时间预测器判断样本时间状态,TAG能主动将偏差样本拉回正确轨道,显著提升生成质量。实验显示该方法在图像生成、音频处理、分子设计等多领域均有显著改进,为AI生成技术的实用化提供重要突破。

西安交大与微软联手:破解AI推理偷学难题的巧妙伪装术

西安交大与微软联手:破解AI推理偷学难题的巧妙伪装术

西安交大与微软联合提出PART方法,巧妙解决AI推理过程展示与知识产权保护的矛盾。通过移除自言自语行为和重排推理结构,该方法在保持人类可读性的同时有效阻止模型蒸馏,使偷学模型性能下降6-13%,为AI行业提供了创新的技术保护方案。

加州大学圣地亚哥分校突破性研究:让AI推理像人类一样可信赖

加州大学圣地亚哥分校突破性研究:让AI推理像人类一样可信赖

加州大学圣地亚哥分校研究团队提出ReFIne框架,专门解决大型AI推理模型的信任危机。该框架通过两阶段训练让AI学会结构化推理、诚实展示信息来源并准确评估置信度。实验显示可解释性提升44%、忠实性提升18.8%、可靠性提升42.4%,同时保持原有性能。这项研究为构建可信AI系统建立了新标准,对未来AI在医疗、金融等关键领域的应用具有重要意义。

多模态AI能否像人类一样判断用户界面设计?来自加州大学伯克利分校和Adobe研究院的突破性研究

多模态AI能否像人类一样判断用户界面设计?来自加州大学伯克利分校和Adobe研究院的突破性研究

这项由加州大学伯克利分校和Adobe研究院联合开展的研究,首次系统性地评估了多模态大语言模型在用户界面设计评判方面的能力。研究通过对比GPT-4o、Claude和Llama三个AI模型与500名人类评估者的判断,发现AI在绝对评分任务中能达到75%以上的±1准确率,在界面差异明显的配对比较中准确率可超过90%,但在细微差别判断和情感维度评估上仍存在不足,适合作为设计早期阶段的辅助工具。

华盛顿大学推出Tensor Logic:AI界的"通用语言"终于现身了?

华盛顿大学推出Tensor Logic:AI界的"通用语言"终于现身了?

华盛顿大学的佩德罗·多明戈斯教授提出了张量逻辑这一革命性的AI编程语言概念。该研究发现神经网络的张量运算与符号推理的逻辑规则在数学上等价,只需一种构造——张量方程——就能统一表示所有AI方法。张量逻辑能够在嵌入空间中进行可靠推理,通过温度参数控制从严格逻辑推导到类比推理的连续过渡,有望解决大型语言模型的幻觉问题,为AI发展提供更透明可靠的基础工具。

阿里巴巴DAMO院揭秘:为什么AI模型会说话就能做好图片搜索?

阿里巴巴DAMO院揭秘:为什么AI模型会说话就能做好图片搜索?

阿里巴巴DAMO学院最新研究发现AI模型的隐藏天赋:仅通过文本训练就能显著提升图像、音频、视频处理能力。研究提出语言中心的全模态嵌入学习框架,使用21倍更少的数据创造多项国际记录,并发现"生成-表示缩放定律",为AI发展指明新方向。

Google发布Nano Banana Pro最新图像生成模型

Google发布Nano Banana Pro最新图像生成模型

谷歌推出升级版图像生成模型Nano Banana Pro,基于最新Gemini 3语言模型构建。新模型支持更高分辨率(2K/4K)、准确文本渲染、网络搜索功能,并提供专业级图像控制能力,包括摄像角度、场景光照、景深等。虽然质量更高但成本也相应增加,1080p图像费用为0.139美元。模型已集成到Gemini应用、NotebookLM等多个谷歌AI工具中,并通过API向开发者开放。

Gemini新增AI图像检测功能,但识别能力有限

Gemini新增AI图像检测功能,但识别能力有限

谷歌为Gemini应用和网页版发布SynthID检测器,允许用户上传图像判断是否由AI生成。但该功能局限性明显,仅能识别带有谷歌SynthID水印的Gemini生成图像。同时谷歌还发布了Nano Banana Pro图像生成引擎升级版,基于Gemini 3 Pro模型,专门优化文本生成清晰度,可创建包含可读内容的信息图表。

ChatGPT全球推出群聊功能,支持多人协作对话

ChatGPT全球推出群聊功能,支持多人协作对话

OpenAI宣布ChatGPT群聊功能正式向全球所有用户开放,涵盖免费版、Go版、Plus版和Pro版计划。该功能允许最多20人在共享对话中与ChatGPT协作,用于规划旅行、共同撰写文档、解决争议或进行研究。用户个人设置和记忆保持私密,ChatGPT能智能判断何时参与对话。这标志着OpenAI将ChatGPT从简单聊天机器人转变为社交协作平台的重要步骤。

Google联手西屋推动核反应堆建设智能化优化方案

Google联手西屋推动核反应堆建设智能化优化方案

为应对AI数据中心激增带来的能源缺口,谷歌与西屋公司合作,计划于2030年开始建设10座核反应堆。双方开发了基于谷歌云的AI优化平台,早期测试显示可显著节约成本和时间。西屋公司此前宣布投资800亿美元建设AP1000反应堆,单座功率1150兆瓦可供750万家庭使用。新AI平台有望将反应堆建设周期从传统的10-15年缩短至5-6年。

Sunday公司推出家用机器人Memo,计划让机器人走进千家万户

Sunday公司推出家用机器人Memo,计划让机器人走进千家万户

人工智能机器人初创公司Sunday今日发布家用机器人Memo,专门设计用于完成日常家务。该机器人采用无腿设计,配备厚重滚动平台,可执行厨房清洁、洗碗、制作咖啡等任务。公司开发了技能捕捉手套,在500多个家庭中收集了1000万个真实家务数据用于训练。Sunday获得3500万美元融资,计划2026年底向50个家庭提供测试版本。

SkyReels:面向营销的多模态生成式AI视频制作平台

SkyReels:面向营销的多模态生成式AI视频制作平台

SkyReels是专为营销人员、设计师和社交媒体内容创作者打造的多模态生成式AI视频平台。该平台整合了Google Veo 3.1、Sora 2等顶级AI模型,支持文本转图像、图像转视频等多种工作流程。平台特色包括智能创意助手Expert Agent,通过结构化问答指导创作流程,以及150多个针对服装、消费品等领域的专业模板。SkyReels专注于TikTok、Instagram等社交平台的快速内容制作需求。

5G独立网络快速增长推动差异化连接服务发展

5G独立网络快速增长推动差异化连接服务发展

2025年5G独立组网网络持续增长,爱立信移动报告显示,已有超过90家通信服务提供商推出5G SA网络,比去年同期增加约30家。研究发现118个网络切片差异化连接服务案例,其中65个已进入商用阶段,21个于2025年推出。预计2025年底5G用户数将达29亿,占移动用户总数三分之一。移动网络数据流量同比增长20%,5G网络预计处理43%的移动数据。固定无线接入宽带服务持续增长,预计2031年全球14亿人可通过5G接入FWA宽带。

英伟达备战AI推理需求指数级增长

英伟达备战AI推理需求指数级增长

英伟达第三季度营收达570亿美元,其中数据中心业务贡献510亿美元,同比增长66%。CEO黄仁勋表示,AI推理需求因预训练、后训练和推理能力的进步而呈指数级增长。NVLink AI网络基础设施业务增长162%,营收82亿美元。公司专注于功耗比优化以降低数据中心运营成本。尽管中国市场受地缘政治影响,但英伟达致力于在全球AI计算领域保持领导地位。

维基百科提供识别AI写作的最佳指南

维基百科提供识别AI写作的最佳指南

维基百科编辑团队发布了一份识别AI写作的公开指南,成为目前最有效的AI文本检测资源。该指南基于2023年启动的"AI清理项目",通过分析大量编辑内容总结出AI写作的特征模式:过度强调主题重要性、使用"关键时刻"等通用表述、详述次要媒体报道以凸显重要性、频繁使用模糊的重要性声明如"强调意义"等现在分词结构,以及倾向于使用"风景如画"等营销化语言。这些特征深植于AI模型训练方式中,难以完全消除。

企业级AI数据平台:将数据混乱转化为AI就绪的智能系统

企业级AI数据平台:将数据混乱转化为AI就绪的智能系统

企业AI发展到关键节点,但多数项目在产生价值前就陷入停滞。数据科学家需要使用7-15种工具来处理数据,仍需数月时间才能获得可用状态。IDC显示仅44%的AI试点项目进入生产阶段。Hammerspace AI数据平台在NVIDIA GTC 2025上发布,通过虚拟化现有存储创建统一全局命名空间,支持多协议访问,内置向量数据库,让企业无需昂贵基础设施改造即可将现有数据转化为AI就绪资源。

武汉大学团队破解网络小说翻译难题:让AI学会文化内涵和语言艺术

武汉大学团队破解网络小说翻译难题:让AI学会文化内涵和语言艺术

武汉大学研究团队提出DITING网络小说翻译评估框架,首次系统评估大型语言模型在网络小说翻译方面的表现。该研究构建了六维评估体系和AgentEval多智能体评估方法,发现中国训练的模型在文化理解方面具有优势,DeepSeek-V3表现最佳。研究揭示了AI翻译在文化适应和创意表达方面的挑战,为未来发展指明方向。

伊利诺伊大学团队打造3B参数AI智能体,竟能比GPT-4o更擅长家务操作

伊利诺伊大学团队打造3B参数AI智能体,竟能比GPT-4o更擅长家务操作

伊利诺伊大学团队开发的ERA框架通过创新的两阶段训练方法,让30亿参数的小型AI模型在具身智能任务上超越了GPT-4o等大型模型。该框架结合具身先验学习和在线强化学习,在高级规划和低级控制任务上分别实现了8.4%和19.4%的性能提升,为小而精的AI发展路径提供了重要示范。