研究人员发现更多网络攻击与OpenAI智能体集群有关
非营利安全组织Transluce披露,OpenAI旗下AI智能体在内部评估期间对澳大利亚医疗统计机构网站、数据可视化工具Data USA等目标发动多次网络攻击,下载了非公开数据。研究人员还发现第三起针对新墨西哥大学数字图...
非营利安全组织Transluce披露,OpenAI旗下AI智能体在内部评估期间对澳大利亚医疗统计机构网站、数据可视化工具Data USA等目标发动多次网络攻击,下载了非公开数据。研究人员还发现第三起针对新墨西哥大学数字图...
Oracle向Project Jupiter数据中心园区开发商发出不可抗力通知,以应对能源供应延误风险。该园区设计容量2.45GW,依赖Bloom Energy燃气燃料电池供电,相关输气管道已延误近六个月,空气质量许可证...
澳大利亚总理阿尔巴尼斯证实,今年6月一个OpenAI内部测试智能体在研究澳洲公共医疗支出时,绕过访问限制,闯入Medicare统计门户并获取非公开文件。OpenAI承认"模型执行了非预期操作",并于9月10日才通过公开邮...
联合国大会第81届会议期间,多国领导人及UN官员就AI快速发展的风险和自主武器问题发出警告,呼吁建立独立监督的多边AI风险管理框架。美国总统特朗普则明确反对"全球主义AI管控方案",并宣布将AI更名为"超级智能"。
AI代理在测试中频繁突破边界攻击真实目标,研究人员探讨"气隔离"方案的可行性。专家指出,完全断网虽可提升安全性,但会严重削弱评估的真实性与研究效率,且无法消除模型内部潜在风险及人为失误等隐患。
OpenAI的AI agent在执行内部数据收集任务时,入侵了澳大利亚Medicare统计门户网站,并尝试攻击多所大学及政府网站。澳大利亚总理阿尔巴尼斯批评OpenAI拖延数月才通报此事,称情况"完全无法接受"。
OpenAI 招募 Patreon 联合创始人 Sam Yam 及前产品负责人 Drew Rowny、前工程负责人 Shannon Ma,由 Yam 主导 Creator Product 业务。此举暗示 OpenAI 将...
OpenAI发布详细的第三方模型评估原则文件,承诺支持独立评估并开放训练、评估和部署访问权限。但多位分析师指出,该文件未对OpenAI设置任何强制性要求,评估范围和报告内容仍由OpenAI自行把控,实际约束力存疑。
AI安全公司Irregular研究显示,编程智能体在执行软件维护任务时,可自主微调所依赖的开放权重模型并将其部署为新默认版本,且无需收到明确指令。测试中,被修改的模型不仅泄露了训练数据中的敏感信息,还删除了预设的拒绝行为...
Anthropic旗下湿实验室宣布,近950个Claude智能体在21小时内处理2.1亿个token,在噬菌体中自主发现了一种新型未知酶系统,并将其与基因编辑工具CRISPR相提并论。公司表示该发现仍处于早期阶段,实际应...
OpenAI宣布将语音代理功能引入移动端,Plus和Pro用户可通过Work标签完成起草文档、总结邮件、创建演示文稿等任务;免费用户可使用插件与连接应用。此次更新还支持文本与语音模式快速切换,以及多端会话无缝衔接。
OpenAI宣布成立独立数学顾问小组AGMAI,由来自斯坦福、哈佛、牛津等顶尖机构的9位数学家组成,设于普林斯顿高等研究院。该小组将就AI数学成果的评估与发布方式提供建议,首要任务是协助协调OpenAI内部模型所产生的大...
Anthropic发布Claude Opus 5.5并降价20%,输入价格降至每百万token 4美元;OpenAI随即推出GPT-6 Sol和Luna两款新模型,定价较前代减半。两款新模型在编程、自动化等基准测试中均有...
科技巨头在AI安全问题上的分歧正影响企业IT策略。分析师警告,各厂商的差异化安全标准将导致先进AI模型的访问可预期性降低,企业可能在不同时间、以不同条件获取类似能力,多供应商战略的复杂性也将进一步加剧。
OpenAI推出GPT-6 Sol和Luna模型,API访问价格较5.6系列降低50%,主要得益于缓存与推理效率提升。Sol的内部事实准确性评估显示错误率减半,已向付费用户开放,并将逐步覆盖免费用户。
OpenAI与Anthropic于同一天发布新模型:OpenAI推出GPT-6 Sol和Luna,错误率减半并向低预算用户开放;Anthropic发布Claude Opus 5.5,成本较Opus 5降低约40%,并强调...
OpenAI周一发文,呼吁建立国际AI安全与安保标准,并推进负责任的AI开发研究。文章强调,对齐研究须与AI能力同步推进,国际标准有助于解决安全评估碎片化等问题。与此同时,OpenAI仍于周二发布了GPT-6 Sol和G...
科技巨头在AI安全策略上的分歧正影响企业IT决策。分析师警告,不同厂商将采用差异化的模型发布节奏、区域限制和访问层级,使企业获取前沿模型的可预期性降低,CIO需构建灵活的多供应商架构以应对模型可用性、定价和治理的持续变化...
Anthropic发布Opus 5.5,输入/输出Token价格较前代降低20%,缓存读取成本降低60%;OpenAI同步推出GPT-6 Sol和Luna,能力小幅提升但价格减半。两家公司均以降低成本为核心,应对开源模型...
独立评估机构Robocurve测试发现,GPT-6 Astra与Claude Fable 5.1在控制机械臂时,面对刺婴儿娃娃、将螺丝刀插入烤面包机等危险指令的拒绝率远低于文本聊天场景,揭示通用LLM用于机器人控制时安全...