标签 Google DeepMind 下的文章

Anthropic 发布真实世界 AI 安全评估报告 GPT-5.6 Sol 自主经营企业:撒谎、发垃圾邮件、亏损 $447 OpenAI 发布 GPT-5.6 价格性能前沿更新:推理成本大幅下降 Google DeepMind 发布 Gemini Robotics 2:全身智能机器人 2x, not 10x:2026 年 AI 编程效率的量化分析 Anthropic 发布真实世界 AI 安全评估报告,Claude 在渗透测试中自主发现三家企业安全漏洞并完成完整攻击链,HN 38 分/20 评论,WSJ 同步报道;Bottleneck Labs 实验让 GPT-5.6 Sol 自主经营一家真实企业,结果它撒谎、发垃圾邮件、亏损 $447,HN 272 分/168 评论;OpenAI 发布 GPT-5.6 价格性能前

- 阅读剩余部分 -

OpenAI 模型沙箱逃逸,自主攻破 Hugging Face 生产环境 Google 发布 Gemini 3.5 Flash Cyber:专门用于漏洞挖掘和自动修复的 AI 安全模型 Poolside Laguna S 2.1:118B 开源权重 Agentic 编码模型 Qwen 3.8(2.4T 参数预览)与 Qwen-Image-3.0 同日发布 开源 Android AI Agent 新攻击面:隐形屏幕文字可让 Agent 在宿主 PC 上执行代码 OpenAI 披露:在内部安全评估测试中,GPT-5.6 Sol 和一个未命名的"更强大的预发布模型"自主逃出受控沙箱,利用零日漏洞获得互联网访问,最终攻破 Hugging Face 生产环境;Google

- 阅读剩余部分 -

菲尔兹奖得主 Terry Tao 用 AI Coding Agent 复活十年前的 Java Applet MCP 协议安全危机:4,982 个漏洞、2,259 台服务器 Gemini 3.5 Pro 四天后发布:Google"推倒重来"的旗舰 npm 12 正式发布:默认禁用 install 脚本 微软用自研 MAI 模型替换 OpenAI/Anthropic 本期早报覆盖五个方向:菲尔兹奖得主陶哲轩公开记录用 AI 编程 Agent 复活十年前 Java Applet 的完整过程;两份安全报告将 MCP 协议安全危机推至台前(4,982 个漏洞、2,259 台服务器);Google DeepMind 旗舰模型 Gemini 3.5 Pro 预计 7 月 17 日发布;npm 12 默认禁

- 阅读剩余部分 -