研究员测试 AI 漏洞挑战:GPT 5.5 成功率最高、Deepseek V4 Pro 成本最低
安全研究员 Kasra Rahjerdi 昨日(6 月 3 日)发布报告,搭建了一个故意留有漏洞的图书评论 APK,测试多款 AI 大语言模型的安全推理能力。
英伟达开源 TwoTower AI 模型:保留 98.7% 质量,Token 生成提速 2.42 倍
英伟达昨日(7 月 2 日)发布博文,宣布推出 Nemotron-Labs-TwoTower,是一种基于预训练自回归骨干网络的离散扩散语言模型,致力于解决大模型 Token 生成速度瓶颈。
谷歌 AI 框架 AlphaProof Nexus 攻克 2 道悬置 56 年数学难题
谷歌 DeepMind 最新推出 AlphaProof Nexus,结合大语言模型(LLM)生成证明与 Lean 形式化验证,在 353 个开放的 Erdős 问题中自主解决 9 个,并解开 2 个悬而未决 56 年的问题。
AI 谄媚警报:“你绝对正确”让企业 CEO 容易患上“AI 精神病”
专栏作者 Arwa Mahdawi 在调查后指出,AI 行业的集体兴奋正在扭曲现实判断,尤其是部分企业首席执行官(CEO)容易陷入“AI 精神病”式误判。









