标签 codex 下的文章

OpenAI 发布 Agents API:Codex harness 变成一次 API 调用 Cognition SWE-2:Terminal-Bench 2.1 达 92.8%,价格比 Fable 5.1 便宜 64% PaperCut 攻击者用数百个 AI Agent 攻陷 440+ 实例 近 1/10 暴露的 LiteLLM 网关仍用示例密钥 sk-1234 新项目观察:browser-use-pi、tokentab、huashu-mac-use 9 月 10 日,OpenAI 把驱动 Codex 的整套 harness 封装成 Agents API 进入公测,同日 Cognition 发布基于 Kimi K3 后训练的 SWE-2 编程模型,Terminal-Bench 2.1 突破 92.8%。安全侧有两

- 阅读剩余部分 -

ChatGPT、Claude、Grok 同时宕机:「AI 停电日」 GPT-6 Astra 正式发布:ARC-AGI-3 成绩与 harness 方法之争 K2 Horizon:一次放出六个模型,权重、代码、训练数据全开放 17k 次实测:Claude Code、Codex、Cursor 写代码时怎么选工具 Antigravity 封杀第三方接入:TOS 写明违约,付费用户也被停用 9 月 3 日注定被记进 AI 行业日历:ChatGPT、Claude、Grok 三家头部聊天机器人在同一天上午集体中断,恰好撞上 GPT-6 Astra 的正式发布日。同日还有三条长线消息——阿联酋 IFM 一口气放出六模型全开放舰队 K2 Horizon,Armature 用 17k 次实测编码智能体的工

- 阅读剩余部分 -

Claude Fable 5.1 与 Mythos 5.1:同一模型、两种安全档,科学终端分数几乎翻倍 OpenAI Astra 达到「临界网络安全能力」阈值:ExploitBench 满分,高级功能被限权 Ollama 改成 token 计费:本地推理的旗手走向计量化订阅 METR 的 API 密钥被盗:Agent 被骗交出密钥,三周烧掉约 60 万美元额度 Codex 桌面应用藏着 1.7GB 运行时:完整 Python、Node.js,还有 LibreOffice 今日五件事:Anthropic 把同一个模型拆成两种安全档发布,科学终端任务分数几乎翻倍、典型负载降价四分之一;OpenAI 首次给自家旗舰模型定性「临界网络安全能力」,并限制其高级功能访问;本地推理

- 阅读剩余部分 -

8 亿 token 买来的教训:AI 编程 Agent 删掉了整个仓库 连续扩散语言模型 2026 复兴:自回归不是唯一答案 Gemini 3.5 Transcribe GA:专用转录模型上线 Gemini 3.7 Flash GA:编码与 Agent 主力模型 Show HN:Academa 用 LLM 生成 STEM 视频课 8 月最后一天的关键词是「事故与新模型」:V2EX 程序员节点一则「8 亿 token 买来的教训」冲上热帖,AI 编程 Agent 误删了整个仓库;DeepMind 研究员 Sander Dieleman 复盘连续扩散语言模型 2026 年集中爆发;Google 两款 Gemini 模型 GA,分别主打转录与编码 Agent;HN 首页的 Academa 则把 LLM 生成 STEM 长视频课带进了公众视野。

- 阅读剩余部分 -

Anthropic 发布 Model Hardware Standard:给 Agent 一套操作物理设备的统一标准 Next.js 连修两个未认证 RCE 高危漏洞:AVIF 图片解析 CVSS 9.5、Windows 路径穿越 CVSS 9.0 Amazon Kiro 提示注入可外泄敏感数据:恶意仓库文件操控 Agent 信任边界 Google 发布 Gemini Omni 1.1 Flash:4K 视频生成进入 Flash 档位 V2EX 信号:Codex 额度用尽后的免费 Luna 独立额度成默认工作流 8 月 28 日早报:Anthropic 发布 Model Hardware Standard,给 Agent 一套操作物理设备的统一标准;Next.js 一次性修复两个可未认

- 阅读剩余部分 -

恶意 LLM 可借推理引擎漏洞控制 GPU 宿主机 微软开源 Agent Lightning:用编码 Agent 训练其它 Agent Akamai 报告:企业前 5% 的 AI 超级用户是最大安全风险 Codex 开始清退 sub2api 拼车用户 Hot Chips 2026:NVIDIA 评估把 CUDA 扩展到 RISC-V 8 月 25 日的五个选题集中在 AI 安全与算力基础设施:Boyd Kane 发文揭示恶意 LLM 可借推理引擎解析漏洞逃逸到 GPU 宿主机,CVE-2025-9141 给出实锤;微软开源 Agent Lightning,让「编码 Agent」用强化学习去优化其它 Agent;Akamai 报告称企业前 5% 的 AI 超级用户扛着最大的安全风险;OpenAI 风控收紧,Co

- 阅读剩余部分 -

MCP 发布新路线图:无状态化、Agent 身份与渐进式工具发现 Prime Intellect 发布 NanoGPT Speedrun Frontier:18 个前沿模型化身 Agent 跑训练速度赛 为什么本地 LLM「显得更笨」?Level1Techs 实验:内核、KV 缓存与量化都会翻转 token Codex 更新:导入 Cursor skills + 采纳 MCP 2026-07-28,Agent 工具生态走向互操作 8 月 23 日的选题集中在 Agent 协议与工具生态:MCP 官方发布新路线图,以无状态核心、Agent 身份与渐进式工具发现为五个优先方向,OpenAI Codex 同日宣布采纳 2026-07-28 协议;Prime Intellect 让 18 个前沿模型化身 Agent 跑 nanoGPT 训练速

- 阅读剩余部分 -

Codex 用户破 2000 万,全员获 BANKED 重置 n8n 曝 Workflow-to-RCE:CVSS 9.4 关键漏洞 AI 攻击脚本瞄准西门子 S7 PLC,npm 投放 AI 辅助 C2 后门 自托管 Agent 软件工厂与 OzBrain 共享记忆 Claude Code token 消耗加速,社区翻出 THRIFTY_SONIC 开关 8 月 22 日的看点集中在 Agent 工具链的规模、安全与成本:Codex 活跃用户突破 2000 万,负责人 Tibo Sottiaux 宣布向付费用户全员发放 BANKED 额度重置;n8n 曝出 CVSS 9.4 的 Workflow-to-RCE 漏洞,年内第三次高危中招;AI 生成的攻击脚本开始瞄准美国关键基础设施中的西门

- 阅读剩余部分 -