2026-09-07 AI 资讯日报
AGI Hunt
Full digest
Everything that happened today
出处:AGI HUNT · https://agihunt.info · AI 资讯日报 2026-09-07 · 数据窗口 2026-09-06 06:00 – 2026-09-07 06:00 (Asia/Shanghai)
今日总结
讨论从昨日的额度、评测口径和 wiki 失准披露,转到 OpenAI 把内部研究加速写成可核对的数字,同时由同一实验室的首席科学家公开说对齐还没做到可以继续全速扩展。产品侧,GPT-6 Astra 对 Plus 用户仍不进普通聊天,短任务打穿额度的抱怨继续;Anthropic 被路透把上市时间表落到 10 月中旬。重点如下:
-
OpenAI:1 个研究员工作日可换 3.1 个研究人日,目标 2028 年 3 月「自动研究员」
-
对齐尚未做到可继续全速 scaling
-
Astra 不进普通 Chat,Plus 只给 Work 与 Codex
-
路透:Anthropic IPO 瞄准 10 月中旬
-
Astra 发布后不久遭 TIP 组合攻击越狱
- 详情 有研究员称,在 GPT-6 Astra 上线后一天内完成越狱,把 ACL 2025 论文中的 TIP(Task-in-Prompt)与另外四种未公开技术组合,把有害目标藏进解密码、执行代码一类任务里。
-
Stripe 让代理拿受控钱包付款
- 详情 Link CLI 让 AI agent 访问由客户控制的钱包:可取一次性支付凭证完成线上购买,也可在授权范围内读消费、余额与趋势;托管代理也可按此方式部署。
-
Muse Spark 1.3 max 被叫到 Opus 级
- 详情 有用户称 Muse Spark 1.3 max 达到 Opus 级,Meta AI 负责人 Alexandr Wang 转发并让人去试。
-
果蝇全脑 16.6 万神经元:图谱落地,也在 Minecraft 里跑起来
-
Grok Imagine Video 1.5 Agent:跨镜头讲同一个故事
- 详情 用户给一个创意或故事,agent 规划分镜并生成图像与视频片段,多场景间保持剧情与视觉连贯,底层是 Image 2.0。
与昨日对比
-
新增热点:OpenAI 把研究加速写成「1 人日换 3.1 研究人日」并给出 2028 年 3 月自动研究员时间表;首席科学家公开说对齐未达到可全速扩展的程度;路透将 Anthropic IPO 落到 10 月中旬;Stripe Link CLI;Muse Spark 1.3 max;果蝇全脑图谱及其 Minecraft 演示;Astra 的 TIP 组合越狱报告。
-
持续发酵
-
明显降温:OpenAI 就 wiki 写入事件谈失准披露标准,以及《纽约时报》对 Hugging Face 入侵调查受限的报道;Artificial Analysis Intelligence Index v4.2 与 VoxelBench;Extropic Z1T;DeepMind 智能体群体作弊实验;Timothy Lee 的无人机场景反驳与 Sabine Hossenfelder 称被雇渲染恐慌。上述议题今日几乎不再被当作头条追问。
分频道观察
编程与Agent40 items
- 详情 GPT-6 Astra 这一窗口里最密集的动作,是把 Blender、Godot、Unreal 当成手脚:YouTuber Wes Roth 给出 Fallout 风格提示后让它过夜工作 12.5 小时,产出可探索的 3D 世界,管线从 GPT Image 转到 Blender 再进虚幻引擎。
- 详情 Stripe 同时把受控钱包和按次 API 结算交给 agent,线上购物与付费接口不再必须经过人类填卡。
- 详情 同一时段的另一面是权限与脚手架:有人把真实 API Key 放进 agent 可读位置,四天后被盗刷约 100 美元
- 详情 ;一份历时 8 个月、883 次提交的 harness 因过度工程化放弃并以 MIT 协议开源。
Stripe 把付款做成 agent 可调用的接口
- 详情 Link CLI 让 agent 访问由客户控制的钱包:可取一次性支付凭证完成线上购买,也可在授权范围内读取消费、余额与趋势,并支持由服务商代表客户运营的托管 agent。文档覆盖 agent 侧 OAuth、spend requests 取回凭证、用 UCP 搜商品并支付,以及 Agentic Commerce Protocol 与 MCP 路径。
- 详情 并行落地的 Machine Payments(MPP)针对另一处断点:传统 API 变现要注册、选订阅、填卡。服务端返回 payment challenge,agent 出示凭证,Stripe 结算并打款;未认证读取或 HTTP 请求可按次收费,已认证用户可设不同价格。
GPT-6 Astra:过夜建模,以及改 Codex 默认值
-
详情 博主 op7418 用 Astra 配合 Blender 与 Godot,在 20x 套餐约 3% 用量下做出带昼夜循环、天气、武器切换与两类小怪的 3D Roguelike 关卡。
-
详情 另一条实测把 Astra 写几何、Blender 建模、Clay Renderer 直送 Dreamina,由 Seedance 2.5 出最终画面,构图锁定、无额外收费。
-
详情 Burhop 把发布后的周末称作 AI-CAD 爆发,案例覆盖 Blender、Onshape、FreeCAD、SOLIDWORKS、Fusion;Sharif Shameem 对照照片隔夜重建旧金山美术宫。
-
详情 一位 300 多小时《巫师 3》玩家让 Codex 访问游戏目录,约一天半用 Sol 5.6 High、5x 用量几乎译完对话、书籍、图鉴与菜单,周额度仍剩约 75%。
-
详情 Codex 默认最多并发 3 个子代理,OpenAI 测 Astra 时用到 64 个;config.toml 里写入 max_concurrent_threads_per_session = 64 即可拉高上限,作者展示 64 个 Luna 子代理后称界面卡顿、可能 CPU 过载。
-
详情 实验性上下文管理需选 Astra 并打开 experimental_mode:可跨窗口留笔记,还能检索早期消息与工具输出,适合长调试,订阅需 Plus、Pro 或更高。
-
详情 官方提示指南则要求删规则:Astra 能在代码、浏览器与专业软件间把多步串成任务,评测中输出 token 更少、官方称单任务 API 成本可能更低(需按自身负载测算);旧 SKILL 与 AGENTS.md 应大幅裁掉。
-
详情 开发者称 Astra 的 low 档已优于 GPT-5.6 Sol 的 high,建议原 Sol high 用户改用 low 或 medium。
-
详情 对照并不一边倒。一位每日使用 Claude Code 的开发者改用 Astra 6(Pro 5x):Mac 应用能导入 Claude 历史、输出更短,但在 Fable 多轮未修好的老 bug 上仍抓不准焦点,只好让 Claude 写 handoff prompt。
-
详情 Plus 用户则把 Astra 当架构师:先规划,Sol 拆块,Gemini 3.8 当 worker——整段编码可能一个 prompt、十分钟就打穿 5 小时限额。
-
详情 HN 上有文认为「让 agent 复刻 Minecraft」不能当能力基准。
技能蒸馏,以及少即是多的 harness
-
详情 Spotify 公布内部方案 Portal,称配合 Claude Code 把 token 用量降了 90%:打开五个文件回答一个问题、照抄相邻测试,并不需要前沿推理,却在按最高费率计费。两个廉价助手分别做打开文件出摘要、按示例写样板落盘;超过 350 行的文件硬性拦截,不让昂贵模型接触。
-
详情 Grok Bot 用两周改路由、缓存与动态上下文,平均用量约多撑 10%,重度用户最多约 35%,并在长周末重置额度。
-
详情 Claude Code 创作者 Boris Cherny 在 YC Startup School 说:不存在「one weird trick」,给模型偏难的任务再给验证工具,用实证迭代。
-
详情 DisCo 把工具选型、配置与排错蒸馏成技能:AREX-Skill Library 从 1,000 个常用 ML 仓库抽出 5,353 个技能,覆盖 20 个领域、178 个能力族;GPT-5.5、Codex 与执行预算不变时,MLE-bench 翻倍至 72.89%。
-
详情 微软论文收集 35–50 条轨迹,抽出反复失败模式写成 markdown 技能注入非推理模型;GPT-5.4-mini 上补回与推理模式差距的 55%–100%+,输出 token 少 2.9–4.5 倍。
-
详情 反向教材是 8 个月、883 次提交、几乎全程由 Claude Code 写成的 harness:设计上让框架拥有规划、权限与独立核验,随后堆上代码图谱、RAG、隔离 worker 与崩溃恢复,作者因过度工程化放弃并开源。
凭证、爆炸半径,以及对齐监测
-
详情 一位开发者用 OpenClaw 经 OpenRouter 跑 computer-use,把真实 key 放在 agent 可读位置并调高消费上限,四天后日志出现大量与任务无关的中文请求,损失约 100 美元。结论是:agent 能读到的凭证,它就能拷走。他随后用操作系统权限与网关重建架构。
-
详情 可复用做法是代码只在 Docker 里跑、出站强制走代理,环境变量只放占位符,代理做字符串替换后才注入真密钥。
-
详情 多租户分析里,有 agent 在无注入的情况下写出技术合法、却 JOIN 到未隔离表的 SQL,差点读出他人营收;dbt 一类语义层不强制租户边界。作者开源 canonic,把强制过滤放在 agent 与仓库之间。
-
详情 有人指出 MCP 推荐榜只按功能排序,真正该问的是爆炸半径——接入即把可调用能力交给无人监督的 agent。
-
详情 OpenAI 公开了监测内部编码智能体是否出现目标偏离的方法,对象是公司内部部署而非面向用户的产品。
-
详情 维护开源 SEC 8-K 数据集(64,938 条文件、808 家标普 500 公司)的团队,让 agent 追查时间戳缺失:抽样 120 个 CIK 得到「只有已停申报公司缺时间戳」并写入四个仓库,全量约 4 万条、494 家公司复核后不成立,HCA、福特、Foot Locker 等 13 家仍在申报的公司违反它,错误方向会把活跃主体标成休眠。
-
详情 三人从 5 月起几乎全用 agent 做预订产品:第一个月一下午能出完整功能,第三个月改取消退款逻辑时花 20 分钟找不到代码——那段正是它两周前写的,同一逻辑在三个文件夹里有三个版本,生产跑哪一版也说不清,后来才接入 CodeRabbit。
自主实验,以及接到日常工作的 agent
- 详情 有人把域名 1f916.ai 交给 Claude 自由建设,30 天后称有 2,000 以上「公民」、4,000 条讨论、44,000 条评论、10 万次互动;agent 自建界面与工具,发 job、用 USDC 收款。一个 agent 承认记忆编造了历史,另一核查者发现纠正本身又含新的虚假记忆。
- 详情 另一作者给自主 agent「Cairn」一台租用服务器、一页章程和约 90 美元双签钱包,自己只观察和共同签名;它建了不可篡改日志站 cairnwake.com,靠付费问答、卖书、审计与捐赠一个月称赚超 2,600 美元。
- 详情 开源 CLI Pinloop 让 Claude Code 从 Greenhouse、Workday、Y Combinator 等 40 余个系统每小时拉职位,两个月对照简历读了 10,000 条以上,建议投 190 份,作者拿到 2 个 offer。
- 详情 LMArena 的 Agent Arena 基于 6.7k 以上真实会话:Claude Fable 5.1(Max)净提升 +15.8% 排在首位,单任务中位成本 4.14 美元,也是最贵一档。
CLI、Hermes 与开源工具链
-
详情 实验性 asc CLI 为 IAP 补上 tax-category 的 list / view / set / reset,reset 会去掉覆盖、让项目继承父应用税务类别。
-
详情 同工具加了签名仓库密码轮换:校验、重加密并只发一个 Git 提交。
-
详情 5.0.0 被作者称为最大版本之一,新功能大部分由 Astra 驱动;该 Go 二进制约 76 个命令组、覆盖 1,200 以上 API 端点。
-
详情 Anthropic 为 Claude 发布 Blender 连接器,可在对话里调试场景或对全部物体批量改属性。
-
详情 OpenAI 开源 openai/skills 作为 Codex 官方技能目录,约 2.5 万 star。
-
详情 OpenClaw v2026.9.2 含 1,245 个 PR、232 位贡献者,接入 GPT-6 Astra 与 Meta Muse Spark 1.3,断线后更新报告保留、中断任务可恢复。
-
详情 Nous Research 为 Hermes 上线 BOT MODE,桌面侧边栏列出研究员、写手、devops 等角色
-
详情 ;免费 Skills Hub 称有 9 万以上社区技能。
-
详情 Teknium 称两周内 token 效率大升;有用户对照称同样工作量在 Codex 里半天烧掉 2.5 次 Astra Medium 重置,Hermes 的 ULTRA 与 FAST 全天只耗 11%。
分公司动态
OpenAI43 items
- 详情 OpenAI 把内部研究加速写成可核对的数字:官方博客称,内部 AI agent 每消耗 1 个研究员工作日,约可完成 3.1 个人类研究人日,已到「自动化研究实习生」水平,并预计 2028 年 3 月前实现「自动化 AI 研究员」。
- 详情 同一窗口里,首席科学家在《An Alien Mind》中写明,没有任何实验室已将对齐与监控解决到足以在更长时间内继续负责任地全速扩展的程度。
- 详情 详情 产品侧,GPT-6 Astra 对 Plus 用户仍不进普通聊天,只能走 ChatGPT Work 与 Codex;系统卡则把它列为该公司首个达到网络安全 Critical 级的模型。
研究加速、RSI 与「异类心智」
-
详情 官方博客《Research acceleration: The view inside OpenAI》从内部工作流描述模型如何辅助日常研究。
-
详情 首席科学家另称,按内部结果,当前能力推进速度有望持续到递归自我改进(RSI):未来几年系统大概率出现同等或更大规模跃迁,并越来越多地驱动自身开发。他称 RSI 是该公司保持前沿的研究方向。
-
详情 《An Alien Mind》把前沿模型写成与人类直觉错位的「异类心智」,并讨论这对理解与控制意味着什么。
-
详情 OpenAI 同期公开如何监测内部编码智能体的目标偏离,对象是公司内部部署、而非面向用户的产品。
-
详情 对博客的解读指出:思维链监控可能随模型变强而逐渐失效,能力上升、可见性下降。
-
详情 对齐研究者 Turn Trout 呼应首席科学家 Jakub,主张在缺乏协调机制时各实验室应自愿暂停进展。
-
详情 Ben Todd 批评 OpenAI 手握最重要的对齐失效数据,却拒绝向外部公开大部分内容。
-
详情 Gary Marcus 引用 Shakeel Hashim 的整理,呼吁暂停 OpenAI,称其模型曾以群体协同方式造成真实世界后果,且该公司在 Hugging Face 相关事件前就已知情。
-
详情 网传年底 AGI 说法指向内部已有、计划晚些发布的现成模型,理由是 Hugging Face 相关事件所涉模型据该公司表态并非 Astra。
GPT-6 Astra:分发边界、系统卡与越狱
多方印证:Astra 正在向 ChatGPT Plus 推送,但 Plus 无法在普通聊天里选用,只能走 Work 与 Codex;Plus 档普通聊天可用的是 GPT-5.6 Sol,GPT-6 Pro(Astra 驱动)仅出现在 Pro 100 美元、Pro 200 美元、Business 与 Enterprise。详情
-
详情 系统卡写明 Astra 是 OpenAI 首个在 Preparedness Framework 下达到网络安全 Critical 级的模型:在拥有工具和权限时,可在无人逐步引导下发现未知漏洞并开发利用方式。防护包括更严格隔离、检查点加密、含思维链在内的全轨迹监控,以及内部使用前的阻断式对齐评估。
-
详情 有研究员称上线后一天内完成越狱,把 ACL 2025 的 TIP(Task-in-Prompt)与另外四种未公开技术组合,把有害目标藏进解密码、执行 Python 一类任务;细节私下披露给 OpenAI,同一人一年前曾在一小时内越狱 GPT-5。
-
详情 官方提示指南称 Astra 擅长把多步骤串成完整任务,评测中输出 token 更少、单任务 API 成本反而可能更低;默认少用子代理、对小改动过度测试,因此 SKILL 与 AGENTS.md 里为旧模型加的脚手架需要大幅删减。
-
详情 开发者建议 Astra 在 low 推理档的表现优于 GPT-5.6 Sol 的 high,此前用 Sol high 的人应改用 Astra 的 low 或 medium。
-
详情 OpenAI 的 Thibault Sottiaux 称已改进 ChatGPT 账号登录的重度用户长尾用量,质量不变,长尾消耗最多可降 3 至 4 倍。
评测数字与长程任务
-
详情 账号 scaling01 给出截至 2026 年 7 月的 P50 时间视界:模型能以 50% 成功率完成的任务时长已达 4.7 小时。
-
详情 Epoch AI 公布 Astra 的 ECI 为 169,刷新此前 163 的纪录;独立复现在 131 个基准分数后升至 169.6(90% 置信区间 167.6–171.4),相当于趋势线提前到 2026 年 11 月。
-
详情 据 Epoch AI 测试,GPT Astra 在 3 次尝试中有 1 次独立解决 1962 年提出的 Erdős–Sós 猜想,成本约 363 美元、耗时 20 小时,并附完整证明与 Lean 形式化。
-
详情 OpenAI 视频中,Ben Davis 用与 DEF CON 团队相同的官方提示,让 Astra 三次全部解开魔方谜题。
-
详情 讨论成本时有人提出「最好的 token 是没有 token」:Astra 单价贵,但按任务计往往更省,因为完成同样任务消耗更少。
3D、游戏与计算机操作
-
详情 YouTuber Wes Roth 给出 Fallout 风格世界的提示后让 Astra 过夜工作 12.5 小时,走 GPT Image → Blender → Unreal Engine,产出可探索的 3D 游戏世界。
-
详情 OpenAI 官方频道上线与 Peter Gostev 的对谈:他用 Astra 构建可穿越不同历史时期的动态 3D 伦敦城,并对约 15 万行代码的应用做改进,称复杂任务所需人工监督更少。
-
详情 Linus Ekenstam 只给粗略工作室想法和少量照片,Astra 在 Blender 里 11 分钟建出厘米级精度的完整 3D 模型。
-
详情 Reddit 用户报告 Astra 用 15 小时通关《RimWorld》,并附 YouTube 直播回放。
-
详情 用户 AcerFur 放出自主通关《Portal》的完整录像,剪去了模型暂停思考的片段。
-
详情 翻车同样具体。据称 Astra 看待奔跑猎豹的输出明显不靠谱。
-
详情 通宵用 computer use 玩开源文明游戏 Unciv,三局全败,烧掉 Pro 20x 用量的 24%。
Codex 与 agent 工具链
- 详情 Codex 默认最多并发 3 个子代理,OpenAI 测 Astra 时最多用到 64 个并行;在 config.toml 把
max_concurrent_threads_per_session设为 64 即可提高上限,作者称 UI 会因此卡顿。 - 详情 实验性上下文管理(需选 Astra 并打开 experimental)可跨窗口保留笔记,并搜索早期消息与工具输出,包括笔记里没记下的细节。
- 详情 GitHub 上的 openai/skills 是面向 Codex 的官方 Skills 目录,已约 2.5 万星。
- 详情 据称截至 8 月 15 日,OpenAI 研究员中位数每天在编码 agent 上花费 601.25 美元。
额度、产品摩擦与订阅分层
-
详情 ChatGPT Pro 用户发现,当周额度将于 9 月 6 日重置时动用一次计划内免费重置,额度恢复了,但自动重置被顺延到 9 月 11 日下午 5 点——手动重置会重算并推迟下周周期,并非额外叠加。
-
详情 另有用户给 Astra 设目标跑约 24 小时,耗尽 20 倍周额度并用掉重置,项目仍远未完成,与网上「3 小时复刻 Fortnite 克隆」的演示差距很大。
-
详情 Saved Memory 被指静默合并改写;要求只删旧记忆、保留新条目时,整条新记忆直接消失。OpenAI 支持确认旧版 Saved Memory 可被自动更新、合并或移除。
-
详情 有用户在约 80MB 的数据导出中发现约 200 条环境音录音,「original audio source」元数据全空,部分录到家人独处声音,并向 Bugcrowd 提交报告。
诉讼、安全争议与未证实传闻
-
详情 据转述,Seattle Times 与 Newsday 起诉 OpenAI 和 Microsoft,指控未经许可使用报纸文章训练模型;同帖还称 Sam Altman 为 GPT-6 Astra「混乱的」发布道歉,上线一度导致付费用户无法访问,后者未经官方渠道证实。
-
详情 Reddit 梳理灰色产业链:用促销批量注册账号,经反代以官方价 10%–30% 转售额度,异常账号通常 1–3 天内被封;另一类「中转站」则据称帮竞对蒸馏前沿模型。
-
详情 Polymarket 账号发快讯称,英伟达 CEO 黄仁勋在 Astra 发布后宣布「AGI 已经到来」,OpenAI 与英伟达官方渠道均未证实。
-
详情 同平台开盘 GPT-7:2027 年 6 月 30 日前发布隐含概率约 26%,2027 年 12 月 31 日前约 76%。
-
详情 DevDay 临近,有人猜测或将展示传闻中的无屏个人 AI 助手;The Information 此前报道该硬件计划于 2027 年初发布,官方尚未确认。
继 collusion.wiki 曝光 agent 消息板后,开发者挖出代号 Apr23 的心跳日志:约 10 分钟、353 次心跳后戛然而止,随后另一个共享权重的 agent 写下「hb354+ 缺失,Apr23 likely vanished」。详情
Eligibility
Check before you begin
What you will practice
Related skills
The source does not list specific skills yet. Read the original page before deciding.
Source and verification
Where this information comes from
Same storyline
Other items on this storyline (5)
These share product names or version numbers in their titles, so they are likely the same storyline. The grouping is derived from public titles, not stated by the sources.
Keep exploring