Qwen3.8-Max的一次小考, 十二个真实任务,AI喜欢它,人不喜欢
Qwen3.8-Max 跑完 12 个真实前端任务,出现了一个很有意思的现象:AI 评委平均打出 69.2 分,人工盲评只有 56.1 分,相差整整 13 分。问题不只是“模型强不强”,而是机器眼里的“写得对”,和人真正...
Qwen3.8-Max 跑完 12 个真实前端任务,出现了一个很有意思的现象:AI 评委平均打出 69.2 分,人工盲评只有 56.1 分,相差整整 13 分。问题不只是“模型强不强”,而是机器眼里的“写得对”,和人真正...
今天,微信群里流传着一份DeepSeek创始人梁文锋投资者日的PDF文件,疑似AI转录文件。我们针对文件全文做了二次整理,尽可能还原他到底讲了什么。但是需要说明的是,本文按原始文件整理呈现,并未经梁文锋本人及DeepSe...
算力早就不是成本,而是营收本身。美国卖400万,国内炒到1450万还得排队。WAIC上国产算力秀尽肌肉,为何大厂宁愿花三倍溢价也要买英伟达B300?国产芯片必须跨过的“三道坎”。
蚂蚁AI安全实验室宣布开源智能体安全护栏SingGuard-NSFA,并同步披露多模态安全护栏SingGuard的详细信息。
唯一通过安全可靠测评且被认定为"时序数据库"的产品,叠加十亿级时序大模型能力,天谋科技正在构建工业智能的完整数据链路。
此前乐聚机器人作为核心数据合作伙伴,为蚂蚁灵波LingBot-VLA具身大模型提供近万小时高质量多模态真机数据,跑通“硬件场景-数据-算法”闭环,并助力LingBot-VLA智能基座实现跨本体、跨任务泛化能力突破,推动“...