Skip to content

AI 动态 · 2026-09-23

截至 2026-09-23。业界 · 产品 · 模型 · 开源 · 开发者工具 · 前端。

业界

OpenAI 挖来 Patreon 核心高管,押注创作者产品

配图

Patreon 联合创始人兼技术负责人 Sam Yam 宣布加入 OpenAI 领导 Creator Product,并带去前产品负责人 Drew Rowny 与前工程负责人 Shannon Ma。三人均在过去数周内从 Patreon 离职,OpenAI 显然在为一项创作者相关的新发布做准备。对读者:创作者经济与 AI 的结合可能催生新的订阅与分成模式,内容平台需留意其后续动作。

阅读原文

Meta Muse AI 助手发布即带高危零日漏洞

配图

Wired 报道,Meta 的 Muse AI 助手在推出时存在一个零日漏洞,攻击者可借此在受害者 Mac 上「为所欲为」,Meta 称已发布修复。事件凸显 AI 助手获得系统级权限后的安全风险。对读者:给 AI 助手开放本地文件与系统权限前,务必确认其沙箱与权限最小化设计。

阅读原文

不列颠哥伦比亚省起诉 OpenAI,要求为校园枪击案后新建学校买单

配图

Ars Technica 报道,加拿大不列颠哥伦比亚省对 OpenAI 提起诉讼,要求其支付新建学校的费用,并调取 Tumbler Ridge 枪击案凶手的 ChatGPT 对话记录。这是 AI 产品责任向司法实践延伸的标志性案件。对读者:涉及未成年人或高风险场景的 AI 产品,日志留存与内容安全策略将直接影响法律风险敞口。

阅读原文

产品

Claude Marketplace 上线:插件、Agent 与服务伙伴集中一处

配图

Anthropic 推出 Claude Marketplace,把插件、连接器、agent 以及服务伙伴汇聚到统一入口,开发者可发布自己构建的工具以触达使用 Claude 的团队。这标志着 Claude 生态从模型能力竞争延伸到分发渠道竞争。对读者:若你在做 Claude 生态工具,尽早入驻可抢占早期曝光;采购方也可借此统一管理第三方集成。

阅读原文

CodeRabbit、Power Digital、ThoughtSpot 借 Claude Marketplace 打通预算与工具链

配图

Anthropic 博客介绍,CodeRabbit 通过 Claude Marketplace 扩展了 Vercel 方案,Power Digital 与 ThoughtSpot 则把 Snowflake 支出纳入其 Anthropic 承诺额度。核心玩法是用已承诺的 AI 预算直接支付所运行的工具,降低采购摩擦。对读者:多云工具采购时,可关注厂商承诺额度能否抵扣第三方服务,这往往比单独谈折扣更划算。

阅读原文

Rabbit 推出无需 R1 硬件的跨平台 AI Agent

配图

曾因 R1 设备表现平平的 Rabbit 发布 OS3「agentic 操作系统」,运行在云端但可跨 Windows、Mac、Linux 本地操作,单账号最多绑定五台设备并接入自选模型。用户还能通过桌面站点或 Telegram 等消息应用调用。对读者:跨设备 agent 的隐私边界值得关注,接入前先确认其文件与应用的访问权限范围。

阅读原文

模型

Claude Opus 5.5、GPT-6 Sol/Luna 同日发布,新一轮价格战开打

配图

Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 推出 GPT-6 Sol 与 GPT-6 Luna。Simon Willison 指出 GPT-6 Sol/Luna 价格约为 GPT-5.6 同级的一半,而 GPT-5.6 Luna 本就是他构建应用的首选,如今性价比再翻倍。两家在能力与成本上贴身肉搏,模型选型窗口被大幅压缩。对读者:新模型迭代以周计,建议把模型调用抽象成可切换层,避免硬编码单一模型。

阅读原文

Anthropic 发布 Claude Opus 5.5,关键 Agent 基准超越 Fable 5.1 且 API 降价 60%

据 VentureBeat 报道,Anthropic 推出 Claude Opus 5.5,在多项关键 agentic 基准上超过 Fable 5.1,同时 API 价格较前代下降约 60%。这是 Claude 5.5 家族的首个模型,主打 agentic 编码、知识工作与长时任务。价格与能力的双重提升,直接冲击以 agent 为核心的产品成本结构。对读者:若你的 agent 流水线成本敏感,值得用 Opus 5.5 重跑一遍基准并重算单位任务成本。

阅读原文

OpenAI 发布 GPT-6 Sol 与 Luna,API 价格下调 50% 以上

据 VentureBeat 报道,OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna 两款模型,API 定价较上一代下调 50% 甚至更多。结合同日 Claude Opus 5.5 的发布,前沿模型竞争已从单纯刷榜转向「同等能力、更低单价」的性价比比拼。对读者:批量推理类业务可先小流量灰度新模型,用真实任务评测再决定是否全量迁移。

阅读原文

Claude Opus 5.5 运行成本较 Opus 5 低约 40%,性能对标 Fable 5.1

MarkTechPost 报道称,Anthropic 发布的 Claude Opus 5.5 在达到 Fable 5.1 级别性能的同时,运行成本比 Opus 5 低约 40%。这与同日 OpenAI GPT-6 系列的降价形成呼应,说明推理成本正成为厂商竞争的主战场。对读者:评估模型时别只看榜单分数,把每千 token 成本与延迟纳入同一张对比表更实际。

阅读原文

开源

(本日无新条目)

开发者工具

Cursor 发布「最后一公里」机器人:灰度发布与安全审查

配图

Cursor 推出面向软件开发的 bots,聚焦把代码安全可靠地送进生产环境,首批能力包括 Rollouts(灰度发布)与 Security Review(安全审查)。编码 agent 的竞争正从「写代码」转向「管发布、保安全」的工程闭环。对读者:若团队已在用 AI 生成代码,可评估把发布与审查环节也交给 agent,减少人工卡点。

阅读原文

Cursor 优化 agent 长任务 token 效率,成本降 7% 不损质量

配图

Cursor 博客披露,通过调整 agent harness 的多个环节,用户在长时 agent 任务上的 token 成本下降约 7%,且 agent 质量未受影响。这说明 agent 框架层的工程优化仍有可观空间。对读者:长任务 agent 的成本大头常在上下文重复与工具调用冗余,值得先做 harness 层审计再考虑换模型。

阅读原文

前端

(本日无新条目)