Skip to content

AI 动态 · 2026-08-15

截至 2026-08-15。业界 · 产品 · 模型 · 开源 · 开发者工具 · 前端。

业界

Google 允许用户移除 AI 生成内容的可见水印

配图

Google 宣布允许用户移除 Gemini、Flow 等 AI 工具生成图片、视频和音乐中的可见“闪光”水印。该开关不影响底层的 SynthID 隐形水印和 C2PA 元数据,后者仍用于识别 AI 生成内容。此功能适用于 Nano Banana、Omni 和 Lyria 模型。对读者:移除可见水印可提升内容观感,但隐形标识仍可溯源,使用 AI 内容时需注意合规与透明性。

阅读原文

亚马逊可用 Twitch 内容训练 AI,用户需主动选择退出

配图

Twitch 更新账户设置,允许主播选择退出将其内容用于训练亚马逊的 AI 模型。但此举引发大量创作者质疑:平台何时开始使用用户直播、视频和帖子进行训练,以及为何默认是“选择加入”而非“选择退出”。目前亚马逊未明确说明数据使用的起始时间和具体范围。对读者:创作者应尽快检查 Twitch 账户设置,按需关闭 AI 训练授权,保护自身内容权益。

阅读原文

IBM 与 OpenAI 达成合作,加码企业级 AI 市场

配图

IBM 宣布与 OpenAI 建立合作伙伴关系,计划培训和认证数万名顾问掌握 OpenAI 技术,并共同营销 AI 产品、开发行业特定解决方案。此举是 IBM 在不到一年内继与 Anthropic 结盟后的又一重大动作,反映出企业 AI 市场竞争白热化,OpenAI 正通过咨询巨头触达全球大型企业客户。对读者:企业采购 AI 服务时将有更多集成选项,可关注 IBM 咨询渠道带来的 OpenAI 模型落地案例。

阅读原文

OpenAI 任命新任首席营收官,高管层持续动荡

配图

OpenAI 在首席营收官 Denise Dresser 上任仅九个月后将其替换,任命 Wiz 总裁兼首席运营官 Dali Rajic 担任此职。此前一个月内,COO Brad Lightcap 和 AGI 部署 CEO Fidji Simo 已相继离职,联合创始人 Greg Brockman 则承担更多管理职责。这一系列变动显示 OpenAI 正经历重大组织调整。对读者:关注 OpenAI 高管变动可能带来的产品策略与商业化方向变化,企业客户需留意合作稳定性。

阅读原文

产品

OpenAI 推出 Ultrafast 模式,GPT-5.6 Sol 提速 14 倍

配图

OpenAI 发布 Ultrafast 模式预览版,使最新旗舰模型 GPT-5.6 Sol 的处理速度提升至标准模式的 14 倍,每秒可输出高达 750 个 token。该功能旨在吸引对响应速度要求极高的企业用户,解决大模型在实时交互场景中的延迟痛点。对读者:若你的应用对延迟敏感,可关注 Ultrafast 模式的开放范围与定价,评估是否接入以提升用户体验。

阅读原文

模型

Gemini 3.7 Flash 发布:三周迭代,主打编程与 Agent

配图

Google DeepMind 发布 Gemini 3.7 Flash,定位为“迄今最智能的主力模型”,重点面向编程和 Agent 场景。该模型距 3.6 Flash 发布仅三周,且紧随 DeepMind 权力重组八天。新领导 Koray Kavukcuoglu 已实质接管 Gemini 全栈研发。快速迭代反映谷歌正加速工程化节奏,并针对开发者反馈进行算法创新。对读者:开发者可关注 Gemini 3.7 Flash 在 Coding 与 Agent 任务上的性能表现,评估是否迁移工作流。

阅读原文

DeepSeek 发布 V4 Pro,定价最高达 V4 Flash 的 14 倍

DeepSeek 正式推出 V4 Pro 模型,其 API 定价最高可达 V4 Flash 的 14 倍。这一价格策略显示 DeepSeek 正在细分产品线:Flash 版本主打高性价比和缓存命中率,Pro 版本则面向对性能要求更高的企业级任务。此前社区测试显示 DeepSeek V4 Flash 在 Pi Harness 中缓存命中率可达 99% 以上,成本优势显著。对读者:根据任务复杂度选择合适的模型版本,高频简单任务可继续使用 Flash 以控制成本。

阅读原文

智谱 GLM-5.3 发布,对标 OpenAI 与 Anthropic 前沿模型

中国 AI 公司 Z.ai 发布 GLM-5.3 模型,宣称在编程等能力上对标 Anthropic 的 Mythos 和 OpenAI 的旗舰模型。该模型具备高级网络能力,据报道已发现 Cursor 的严重漏洞。多家外媒关注其发布时机与策略,认为中国 AI 实验室正加速追赶全球前沿水平。对读者:可关注 GLM-5.3 在编程与 Agent 场景的实测表现,作为闭源模型之外的国产替代选项。

阅读原文

开源

Qwen3.8-27B 开源:消费级显卡可跑,多项 Agent 评测超 Claude

阿里开源 Qwen3.8-27B,总参数量 27B,支持原生多模态、262K 上下文(可扩展至 100 万 Token)。官方 Benchmark 显示其在 SWE-bench Pro 上以 8.3 分优势超过 Claude Opus 4.6 Max,QwenSWEBench 领先 15.2 分。经量化后可在 24GB 显存的 RTX 3090/4090 上本地运行,实现“Opus 级”Agent 能力。对读者:开发者可在本地部署该模型处理编程与长程 Agent 任务,降低 API 依赖与数据隐私风险。

阅读原文

DeepSeek Harness 插件生态爆发:GitHub 仓库超 700 个

DeepSeek Harness 开源 Agent 框架发布后,GitHub 上 dsh-plugin 标签的公开仓库已超 700 个。社区开发者为其开发了浏览器、长期记忆、数据库、任务管理、视觉模型接入等实用插件,甚至包括电子宠物、小游戏和 2005 年风格广告 UI 等趣味扩展。其“Everything is a Plugin”架构极大激发了社区创造力。对读者:可关注 Awesome DeepSeek Harness Plugins 精选目录,快速找到提升 Agent 工作流的实用插件。

阅读原文

Soup:一个 YAML 配置微调 LLM,4GB 显卡可训练 8B 模型

配图

开源项目 Soup 允许用户通过单个 YAML 文件微调大语言模型。其核心创新是层流式训练(layer streaming)技术,使得在仅有 4GB 显存的笔记本 GPU 上即可训练 8B 参数模型,大幅降低了模型微调的硬件门槛。对读者:个人开发者和小团队可尝试用 Soup 在消费级硬件上完成模型定制,无需依赖昂贵云 GPU。

阅读原文

开发者工具

GitHub 推出四款 Agent 应用,覆盖软件交付全流程

GitHub 博客介绍了四个 Agent 应用,帮助开发者在 GitHub 平台内完成软件交付生命周期的关键环节:范围界定、安全加固、发布和交付。这些 Agent 应用旨在减少上下文切换,让团队无需离开 GitHub 即可完成从需求到上线的整个流程,提升软件交付效率。对读者:团队可评估这些 Agent 应用与现有 CI/CD 流程的集成度,探索在单一平台内闭环管理开发工作流。

阅读原文

Pi Harness + DeepSeek 组合跑赢 Claude Code,成本仅为 1/7

Composio 公开测试显示,同一 DeepSeek V4 Flash 模型在不同 Agent Harness 中表现差异巨大:Pi Agent 以 66.7% 成功率排名第一,Claude Code 为 53.3%。成本方面,Pi 完成一项成功任务平均仅需 0.028 美元,约为 Claude Code(0.195 美元)的七分之一。Pi 的缓存命中率可达 99% 以上,显著降低重复 token 成本。对读者:Agent 的 Harness 选择与模型同等重要,建议对比测试不同框架再决定技术栈。

阅读原文

Codex 与 Claude Code 负责人公开互怼,Coding Agent 竞争转向 Harness

配图

OpenAI Codex 负责人 Tibo 公开引导用户将 GPT-5.6 Sol 注入 Claude Code 运行,Anthropic 随后封禁照做的开发者账号,引发双方负责人隔空交锋。事件核心争议在于 Coding Agent 的竞争焦点正从模型能力转向执行框架(Harness)——同一模型在不同 Harness 中表现差异显著。对读者:选择 Coding Agent 时不应只看模型,需综合评估 Harness 的工具链、权限模型与生态兼容性。

阅读原文

前端

(本日无新条目)