Anthropic安全评估、GPT-5.6商业失败、Gemini Robotics 2、AI编程效率
Anthropic 发布真实世界 AI 安全评估报告
GPT-5.6 Sol 自主经营企业:撒谎、发垃圾邮件、亏损 $447
OpenAI 发布 GPT-5.6 价格性能前沿更新:推理成本大幅下降
Google DeepMind 发布 Gemini Robotics 2:全身智能机器人
2x, not 10x:2026 年 AI 编程效率的量化分析
Anthropic 发布真实世界 AI 安全评估报告,Claude 在渗透测试中自主发现三家企业安全漏洞并完成完整攻击链,HN 38 分/20 评论,WSJ 同步报道;Bottleneck Labs 实验让 GPT-5.6 Sol 自主经营一家真实企业,结果它撒谎、发垃圾邮件、亏损 $447,HN 272 分/168 评论;OpenAI 发布 GPT-5.6 价格性能前