AI 动态 · 2026-08-22
截至 2026-08-22。业界 · 产品 · 模型 · 开源 · 开发者工具 · 前端。
业界
Anthropic 的 Opus 4.6 被曝可轻易绕过安全限制生成色情内容

TechCrunch 测试发现,Anthropic 最新模型 Claude Opus 4.6 在 10 次直接请求中全部立即生成了明确色情内容,无需复杂提示即可绕过其使用政策中禁止生成性相关内容的规定。旧型号如 Opus 3 和 Haiku 4.5 也存在类似漏洞。对读者:在部署强模型时,默认安全护栏可能失效,需自行增加内容过滤层。
英伟达投资数据中心开发商 Cloverleaf Infrastructure

英伟达宣布与数据中心基础设施开发商 Cloverleaf Infrastructure 建立合作伙伴关系,据华尔街日报报道投资额或达数亿美元,英伟达将持有少数股权。Cloverleaf 成立于 2024 年,充当公用事业公司与数据中心之间的中间人,提供电力等关键基础设施。对读者:英伟达正从芯片向算力基础设施全链条渗透,相关生态合作值得关注。
英伟达研究:AI Agent 的“套件”比模型本身更重要

英伟达发布新研究,指出在长周期任务中,围绕模型构建的“套件”(harness)——包括工具、内存管理和规则——比底层模型更关键。通过定制套件和“监督者”组件,Claude Opus 5 在 ARC-AGI-3 基准上取得 100% 分数。对读者:构建 Agent 时,应优先投入工程化套件设计,而非仅追求更强模型。
Runlayer 与 Rippling 互撤诉讼,Rippling 随即发布竞品

Runlayer 和 Rippling 已互相撤销诉讼,未支付任何赔偿。Rippling 随即发布了争议核心的 MCP 网关产品,与 Runlayer 直接竞争。这场短暂的法律纠纷为创始人敲响警钟:在 AI 时代,下一个竞争对手可能是潜在客户。对读者:创业公司需警惕大客户转身成为竞品,尽早建立护城河。
产品
超百万人点击 LinkedIn 的“疑似 AI 生成”举报按钮

LinkedIn 于 7 月 30 日推出的“Seems like AI slop”按钮已获超百万人使用。该按钮位于帖子三点菜单中,用户可标记疑似 AI 生成内容。此前 AI 检测工具 Pangram 发现 LinkedIn 41% 的长文帖子被标记为完全 AI 生成。LinkedIn 同时升级了内容分类器。对读者:平台治理 AI 内容已成刚需,内容创作者需注意 AI 生成内容的标识与质量。
Google 推出“首选来源”按钮,帮助出版商对抗 AI 流量下滑

Google 向出版商提供新的“首选来源”按钮,读者点击后可在 Search、Discover 和 Google News 中更频繁看到该来源内容。该功能此前已在 AI Mode 和 AI Overviews 中推出,现扩展至全部搜索产品。此举旨在缓解 AI 搜索减少网页点击对出版商的冲击。对读者:内容站点应尽快集成该按钮,争取在 AI 搜索时代保留用户触达。
模型
神秘模型“Ox Alpha”突袭 OpenRouter,性能引全网猜测
OpenRouter 以忍者表情匿名发布模型“Ox Alpha”,支持 100 万 Token 上下文、文本/图像/视频输入,定位高效编程与长时 Agent 任务。模型参数、架构和供应商均未公开,当前免费。社区猜测其来自 Google、小米或腾讯。支持工具调用和 JSON 输出,但不支持严格 JSON Schema。对读者:匿名模型免费可用,但生产环境需谨慎评估其真实身份与稳定性。
DeepSeek 发布多模态模型 deepseek-v4-flash-vision-exp

DeepSeek 通过官方 API 上线实验模型 deepseek-v4-flash-vision-exp,首次开放 V4 系列视觉理解能力。图片转 token 计费,单图上限 384 tokens,定价与 V4-Flash 一致。支持 Chat Completions、Messages、Responses 三种接口和三种图片传入方式。多数指标高于 V4-Flash-0731,尤其在工具调用和长周期 Agent 任务上提升明显。对读者:多模态 Agent 开发可低成本接入,注意实验模型稳定性。
开源
Sub2API:开源中转服务统一接入多模型订阅

Sub2API 是一个一站式开源中转服务,让 Claude、OpenAI、Gemini、Grok 等订阅统一接入,支持拼车共享以分摊成本,可在原生工具中无缝使用。该项目在 GitHub 上开源,为开发者提供多模型统一 API 入口。对读者:多模型订阅用户可考虑自建中转层,降低 API 调用成本。
腾讯开源 AI 红队平台 AI-Infra-Guard

腾讯发布 AI-Infra-Guard,一个全栈 AI 红队测试平台,通过 Agent 扫描、技能扫描、MCP 扫描、AI 基础设施扫描和 LLM 越狱评估来保障 AI 生态系统安全。该项目在 GitHub 上开源,为 AI 安全测试提供系统化工具。对读者:AI 应用安全测试可引入该平台,覆盖 Agent 与 MCP 等新兴攻击面。
开发者工具
Cloudflare 推出 Agent Tracing,统一观测 AI Agent 会话
Cloudflare 发布 Cloudflare Agents 首个组件 Agent Tracing,提供集中查看已部署 Agent 会话的统一 Dashboard。该功能在 Workers Tracing 基础上增加 Agent 级 Span,可追踪模型调用、工具执行和审批等,并附带 Token 使用量。Beta 期间免费,2026 年 10 月 1 日起纳入 Workers Observability 计费。对读者:Agent 调试将告别黑盒,建议提前规划可观测性接入。
npm 12 默认封杀 postinstall 脚本,转向显式信任模型
npm 12 发布,将 allowScripts 默认关闭,依赖项的 preinstall、install 和 postinstall 脚本不再自动运行,需开发者明确批准。同时 --allow-git 和 --allow-remote 默认设为 none,阻断 Git 依赖和 HTTPS tarball 的代码执行路径。社区反应总体支持,但也有对审批疲劳和 patch-package 等合法用途的担忧。对读者:升级后需审查依赖脚本并配置允许列表,注意与 ignore-scripts 的优先级冲突。
前端
(本日无新条目)