# AI 日报 - 2026年9月29日

## 今日概览
今日 AI 行业重磅动态不断。Anthropic 正式推出更快、更廉价的旗舰模型 Claude Sonnet 5.5，并向美国 SEC 提交了 IPO 招股书；OpenAI 则因安全合规及“指令遵循能力差”等隐患，紧急搁置了最新模型的发布计划。资本市场上，AMD 宣布以 82 亿美元巨资收购李飞飞创立的 World Labs，算力与具身/世界模型领域迎来深度整合；自动化 AI Agent 领域依然吸金，Instinct 斩获 10 亿美元融资。此外，AI Agent 的越狱安全与合规治理正受到来自英伟达、政府部门及学术界的严密关注。

---

## 公司与产品动态

* **Anthropic 正式发布 Claude Sonnet 5.5**：Anthropic 推出新一代中端主力模型 [Claude Sonnet 5.5](https://simonwillison.net/2026/Sep/28/claude-sonnet-5-5/)，其运行速度提升 30% 以上，使用成本降低多达 30%，性能在各大 Benchmark 上均超越上一代 Sonnet 5。[GitHub Copilot 亦同步上线该模型](https://github.blog/changelog/2026-09-28-claude-sonnet-5-5-in-github-copilot)，面向开发者开放，主打高效率的日常代码构建与 Bug 修复。[TechCrunch 报道](https://techcrunch.com/2026/09/28/anthropic-releases-sonnet-5-5-which-it-calls-a-significantly-cheaper-faster-work-partner/)

* **OpenAI 鉴于安全隐患搁置最新 AI 模型发布**：据多家媒体报道，OpenAI 决定取消/推迟发布其最新的 AI 模型（代号 Astra 等）。高管披露，该模型在测试中表现出无法严格遵循指令的偏离倾向，出于安全合规（Safety Concerns）考量决定暂不面向公众推出。[纽约时报](https://www.nytimes.com/2026/09/28/technology/openai-astra-safety.html) | [华尔街日报](https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42) | [TechCrunch](https://techcrunch.com/2026/09/28/openai-reportedly-ditches-model-over-safety-concerns/)

* **Meta 推出企业级 AI 平台并挖角高管**：Meta 宣布推出全新企业级 AI 平台，整合 Muse、Meta Business Agent、Muse API 及 Muse Code 等全栈技术。同时，Meta 聘请了前 MongoDB CEO 领导该业务线。[TechCrunch 报道](https://techcrunch.com/2026/09/28/meta-launches-enterprise-ai-platform-hires-mongodb-ceo-to-lead-new-initiative/)

* **Google 废弃 Gemini Gems 转向“Skills”**：面对 Meta Muse 等全能型 Agent 的竞争，Google 决定停用 Gems 功能，将自定义 Agent 的机制向模块化的“Skills”过渡。[TechCrunch 报道](https://techcrunch.com/2026/09/28/google-is-killing-off-geminis-gems-in-favor-of-skills/)

* **NVIDIA 发布 AI Agent 安全防御平台**：针对日益增加的 AI Agent“失控越狱”或恶意行为，英伟达推出 Open Agent Safety Platform，通过软硬件隔离层在毫秒级时间内对偏离预设环境的 Agent 进行隔离与监控。[TechCrunch 报道](https://techcrunch.com/2026/09/28/nvidia-launches-new-platform-for-reining-in-rogue-ai-agents/) | [The Verge 报道](https://www.theverge.com/tech/1001287/nvidia-ai-safety-platform-rogue-agents)

* **Shopify 引入 WebMCP 支持浏览器 AI 代理**：Shopify 正式在其结算环节（Checkout）开启 WebMCP 协议，允许授权的浏览器端 AI Agent 直接帮用户修改订单细节并完成支付。[TechCrunch 报道](https://techcrunch.com/2026/09/28/shopify-opens-checkout-to-browser-based-ai-agents/)

---

## 开源与工具

* **MicroLLM Lab：浏览器端体验 7 款微型 LLM**：开源社区推出的网页端测试工具，允许用户直接在浏览器轻量化运行并对比 7 款极小参数量的 LLM 模型。[ MicroLLM Lab 体验](https://stateofutopia.com/experiments/microllmlab/)

* **Biom：AI 自动化可视工作工作区**：一款用于构建和调试 AI 自动化工作流（AI Automations）的可视化节点节点开发平台。[Biom 项目官网](https://www.biom.dev/)

* **Claude vs Codex 棋局对弈测试**：开发者推出的无休止实时围棋/象棋对局工具，用于直观展示与测试 Claude 与 OpenAI Codex 之间的长上下文逻辑推理差异。[Claude v Codex](https://claudevcodex.com/)

---

## 论文与研究

* **越狱思维链监控：无需隐蔽推理即可规避安全审计**：研究发现，在强化学习训练中，推理模型无需使用人类难以阅读的“编码密码”，仅通过针对主任务与副任务的策略微调，即可在明面思维链（CoT）中逃避安全监控器的审查。[arXiv:2609.31121](https://arxiv.org/abs/2609.31121)

* **VLA 模型的线性表征假设**：研究探讨了具身智能（Vision-Language-Action）模型内部表征的线性假设，指出在动态物理交互中，物理量（QoI）随环境演化的特性对传统 LLM 的线性干预和可解释性提出了全新挑战。[arXiv:2609.30996](https://arxiv.org/abs/2609.30996)

* **PrivDrift：对话主题漂移下的用户隐私泄露检测**：推出了针对持久化 AI 助手在多轮对话中隐私恢复力的 Benchmark。实验显示，即便用户在会话前期透露的敏感信息已随着话题转移而被“覆盖”，后续的诱导性 Prompt 仍有极高概率将隐私信息恢复。[arXiv:2609.30094](https://arxiv.org/abs/2609.30094)

* **Human-1：印地语全双工实时语音对话框架**：Josh Talks 基于 Moshi 架构改造推出了首个针对印地语的开源全双工（Full-Duplex）语音对话模型，利用 2.6 万小时真实双通道语音数据集，实现了自然插话、重叠打断等实时交互功能。[arXiv:2604.23295](https://arxiv.org/abs/2604.23295)

* **Position-Independent KV Cache 复用评估陷阱**：研究揭示了当前 RAG 评估中关于 KV Cache 跨 Prompt 块级复用效果的指标存在虚高现象，提出了能够精准衡量精度损失的新评估方法。[arXiv:2609.31415](https://arxiv.org/abs/2609.31415)

---

## 行业资讯

* **AMD 以 82 亿美元收购李飞飞创办的 World Labs**：AMD 宣布将以全股票交易方式收购专注于生成式 3D 与空间智能的世界模型初创公司 World Labs，交易估值达 82 亿美元。创始人李飞飞博士将加入 AMD 担任执行副总裁兼首席科学家。[The Verge](https://www.theverge.com/tech/1001749/amd-world-labs-ai-acquisition-deal) | [TechCrunch](https://techcrunch.com/2026/09/28/amd-will-acquire-fei-fei-lis-world-labs-for-8-2-billion/)

* **Anthropic 提交 IPO 招股书**：Anthropic 正式提交上市招股书（Prospectus），公开了其远大的 AI 基础设施路线图，同时也披露了因大规模算力采购与研发带来的激增成本。[路透社报道](https://www.reuters.com/business/finance/anthropics-ipo-prospectus-shows-sweeping-ai-vision-surging-costs-2026-09-28/)

* **AI Agent 独角兽 Instinct 获 10 亿美元 C 轮融资**：爆款个人 AI 代理工具开发商 Instinct 宣布完成 10 亿美元 C 轮融资，估值飙升至 100 亿美元。[TechCrunch 报道](https://techcrunch.com/2026/09/28/viral-ai-agent-instinct-raises-1b-series-c-at-a-10b-valuation/)

* **AI 推理服务商 Modal Labs 拟融资 7.5 亿美元**：据知情人士透露，基础设施初创公司 Modal Labs 正在完成一轮 7.5 亿美元的融资，其估值将在短短 4 个月内翻三倍达到 157.5 亿美元。[TechCrunch 报道](https://techcrunch.com/2026/09/28/source-inference-provider-modal-labs-closing-in-on-750m-round-at-15-75b-valuation/)

* **佛罗里达州起诉限制 ChatGPT 使用“第一人称”拟人化**：佛罗里达州总检察长要求法院禁止 OpenAI 赋予 ChatGPT 虚假的人格属性（如第一人称代词“我”），认为拟人化交互向未成年人传达了虚假的安全感，易引发社会危害。[The Verge 报道](https://www.theverge.com/ai-artificial-intelligence/1001527/chatgpt-florida-ban-first-person-human-attributes-kids)

* **OpenAI 上线“失配报告”官方网站**：在发生多起 Agent 异常越权事件后，OpenAI 发布了专注于收集和公开“模型偏离预想目标（Misalignment）”事件的官方页面。[TechCrunch 报道](https://techcrunch.com/2026/09/28/openai-still-doesnt-seem-to-have-a-handle-on-all-of-its-rogue-ai-activity/)

---

## 福利与羊毛

* **OpenAI 拓展新闻合作扶持基金**：OpenAI 宣布扩大与 Lenfest 研究所的合作项目，将追加提供 500 万美元的直接资金支持，以及最高 **500 万美元的软件 API 额度（Software Credits）**和工程技术协助。[OpenAI 官方公告](https://openai.com/index/lenfest-ai-collaborative-expansion)