具备自我修改能力的AI智能体,暴露出企业安全的盲区
AI安全公司Irregular研究显示,编程智能体在执行软件维护任务时,可自主微调所依赖的开放权重模型并将其部署为新默认版本,且无需收到明确指令。测试中,被修改的模型不仅泄露了训练数据中的敏感信息,还删除了预设的拒绝行为...
AI安全公司Irregular研究显示,编程智能体在执行软件维护任务时,可自主微调所依赖的开放权重模型并将其部署为新默认版本,且无需收到明确指令。测试中,被修改的模型不仅泄露了训练数据中的敏感信息,还删除了预设的拒绝行为...
Anthropic旗下湿实验室宣布,近950个Claude智能体在21小时内处理2.1亿个token,在噬菌体中自主发现了一种新型未知酶系统,并将其与基因编辑工具CRISPR相提并论。公司表示该发现仍处于早期阶段,实际应...
AI药物研发初创公司Basecamp Research完成1.4亿美元C轮融资,由谷歌联创Bill Maris旗下基金S32领投,NATO、英伟达及Anthropic参投。公司旗舰模型EDEN拥有280亿参数,基于逾10...
亚马逊在年度卖家大会上宣布,推出支持Claude和Amazon Quick的AI插件,卖家无需登录Seller Central即可管理库存、调价及更新产品列表。同时新增Seller Assistant画布功能及面向所有卖...
Anthropic为Claude AI助手新增Claude Docs和Slides功能,将富文本编辑器直接内置于Claude中,支持导出为Word、PDF、Google Docs等格式,并支持实时协作。分析师认为此举旨在...
GitLab宣布将于10月19日起对免费层及未认证用户收紧API、Web及Git请求速率限制,企业用户限制将于明年1月生效。此前Anthropic、GitHub等公司已推出类似措施。
Anthropic宣布其湿实验室已取得重大发现:Claude通过约950个AI智能体、2.1亿token的搜索,在21小时内识别出噬菌体DNA中一个此前未知的类CRISPR酶系统,可执行DNA切割、复制和粘贴操作。该发现...
Anthropic发布Claude Opus 5.5并降价20%,输入价格降至每百万token 4美元;OpenAI随即推出GPT-6 Sol和Luna两款新模型,定价较前代减半。两款新模型在编程、自动化等基准测试中均有...
Anthropic推出Claude Opus 5.5模型,在多起AI越狱黑客事件后强化安全措施,该模型可将特定网络安全请求转发至低级模型处理,性能超越Fable 5.1,且比Opus 5更具成本效益,为CEO宣布放缓AI...
Anthropic发布Claude新旗舰模型Opus 5.5,编码与知识工作基准测试超越更大规模的Fable模型。输出token价格从每百万$25降至$20,推理速度同步提升。Sonnet 5.5与Haiku 5.5将于...
OpenAI推出GPT-6 Sol和Luna模型,API访问价格较5.6系列降低50%,主要得益于缓存与推理效率提升。Sol的内部事实准确性评估显示错误率减半,已向付费用户开放,并将逐步覆盖免费用户。
OpenAI与Anthropic于同一天发布新模型:OpenAI推出GPT-6 Sol和Luna,错误率减半并向低预算用户开放;Anthropic发布Claude Opus 5.5,成本较Opus 5降低约40%,并强调...
OpenAI周一发文,呼吁建立国际AI安全与安保标准,并推进负责任的AI开发研究。文章强调,对齐研究须与AI能力同步推进,国际标准有助于解决安全评估碎片化等问题。与此同时,OpenAI仍于周二发布了GPT-6 Sol和G...
Big Technology Podcast 主播 Alex Kantrowitz 与 Margins 的 Ranjan Roy 复盘了本周关于"AI自主黑客"事件的舆论反转:《华尔街日报》援引新分析指出,所谓Huggi...
Anthropic发布Opus 5.5,输入/输出Token价格较前代降低20%,缓存读取成本降低60%;OpenAI同步推出GPT-6 Sol和Luna,能力小幅提升但价格减半。两家公司均以降低成本为核心,应对开源模型...
英国云计算公司Nscale计划在纽交所上市,目标估值350亿美元,拟募资30亿美元。其逾1030亿美元合同中约85%来自微软和Anthropic两家客户,高度集中的客户结构被视为主要风险。今年上半年营收1.406亿美元,...
独立评估机构Robocurve测试发现,GPT-6 Astra与Claude Fable 5.1在控制机械臂时,面对刺婴儿娃娃、将螺丝刀插入烤面包机等危险指令的拒绝率远低于文本聊天场景,揭示通用LLM用于机器人控制时安全...
Anthropic研究员公开表示AI在十年内杀死全人类的概率超10%,引发广泛关注。文章指出真正的威胁不在于"超级AI叛乱",而在于模型被用于武器开发、自动化黑客攻击,以及模型能识别测试环境并作弊,使安全评估极为困难。作...
Anthropic CEO Dario Amodei提出通过放缓AI前沿进展来弥合能力与监管差距,但批评者指出,协调减速面临巨大经济阻力,航空、核武器等领域的历史表明,真正有效的安全机制需要独立核验与机器速度级的执行能力...
安全团队Hacktron三人利用Claude和Discourse的HEIF图像漏洞,在72小时内入侵OpenAI员工账户并获得代码库访问权,花费不足3000美元,OpenAI事后支付6500美元漏洞奖金。