每日精选
AI 动态
业界、产品、模型、开源与开发者工具 — 按日整理,点进日报可读全文
最新动态
按栏目筛选,浏览近期要闻

General Intuition 是一家构建基础模型、训练通用 AI 智能体在空间和时间中移动的初创公司,正在洽谈由 Valor Ventures、Point72 Ventures 和 Seven Seven Six 等新投资者参与的融资,投前估值达 60 亿美元。该公司正将业务拓展至机器人领域。
据报道,Hugging Face 一直在接洽收购要约,估值约 130 亿美元。但由于创始人对社区的责任感,出售能否达成存在疑问。这一潜在交易若完成,将成为 AI 领域最大规模的收购之一,对开源社区生态影响深远。
据 The Information 报道,英伟达正在讨论参与 Perplexity 的新一轮融资,估值超过 300 亿美元。英伟达作为 AI 算力巨头投资 AI 搜索公司,将进一步加深双方在 AI 基础设施与应用层的绑定,也反映出头部算力厂商向应用生态延伸的趋势。

OpenAI 宣布 GPT-5.6 模型系列现已登陆其软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 等旗舰模型。新模型旨在帮助开发者在规划、构建、审查和测试软件的流程中,以更少的迭代生成更高质量的代码,提供更强的每 token 性价比和按需处理复杂任务的能力。

DeepSeek 宣布自 2026 年 8 月 23 日起调整 API 峰谷计费规则,北京时间周末全天不再区分峰谷时段,统一按低谷价(高峰价的 50%)收费。高峰时段为工作日 9:00-12:00 与 14:00-18:00。此次调价进一步降低了开发者在周末调用 API 的成本。

OpenAI 在 GitHub 上开源了 Codex,一个运行在终端中的轻量级编码智能体。该项目旨在为开发者提供直接在命令行环境中进行 AI 辅助编程的工具,延续了 OpenAI 在开发者工具领域的布局。

Netflix 开源了一个用于观察性因果推断(OCI)的智能代理工作流,可减轻因果分析中的繁琐工作。该工作流基于行为者-批评者循环,能评估因果关系、撰写报告并提出后续步骤建议,将高层次任务留给人类用户。Netflix 已发布轻量级独立版本供社区使用。

亚马逊云科技在 Bedrock AgentCore 中推出运行时实例,在客户账户内的托管 EC2 上运行智能体,支持最长 14 天的持久会话、共享文件系统、GPU 加速实例类型,以及对 Python 和容器镜像的支持。多个智能体可部署在同一运行时中协作,无需在每次交接时相互调用 API。
GitHub 宣布公开预览 Stacked Pull Requests,原生支持将大型软件变更拆分为多个较小的相互依赖的拉取请求,以便分别审查和合并。该功能旨在解决 AI 辅助开发下代码生成速度提升与人工审查能力有限之间的平衡问题,并保留现有分支保护规则和合并策略。

React Router v8 正式发布,更新最低版本要求至 Node 22.22.0+、React 19.2.7+ 和 Vite 7+,仅提供 ESM 构建,默认启用中间件,并将多项未来标志转为标准行为。该版本标志着 React Router v6 和 Remix v2 进入生命周期终止阶段。部分开发者因破坏性变更转向 TanStack Router。

WordPress 7.0 推出纯 PHP 注册块的新方法,开发者无需学习 React、管理构建流程或处理 NPM 包,仅用 PHP 即可构建自定义块。这改变了传统上块需在 PHP 和 JavaScript 中双重注册的方式,大幅简化了块开发体验。
据彭博社与 The Information 消息,英伟达已告知部分大客户,明年初交付的 AI 服务器(含 Grace Blackwell 和 Vera Rubin)价格将上调 15% 以上,部分系统涨幅约 17%。内存芯片成本飙升是主因,一座 1GW 级 AI 数据中心可能因此额外增加至少 50 亿美元建设成本。对读者:AI 基础设施采购成本将显著上升,建议提前规划预算并评估替代硬件方案。

8月中旬多家大模型密集发布:Grok 4.6、Gemini 3.7 Flash、DeepSeek V4 Pro 0813 以及开源模型 Qwen3.8 Max、GLM-5.3 等。评测显示,闭源模型在 Baba Is Bench 等任务上表现惊艳,且成本较前代降低 3-20 倍;开源模型进展则相对渐进。对读者:关注新模型在推理与成本上的显著提升,可考虑将高性价比模型接入现有应用以降低运营成本。

开源项目 awesome-agent-skills 收录了来自官方开发团队和社区的 1000 多个 Agent 技能,兼容 Claude Code、Codex、Gemini CLI、Cursor 等多种工具。对读者:可从中寻找现成的 Agent 技能,快速增强你的 AI 助手能力,避免重复造轮子。

Anthropic 推出 claude-plugins-community,这是一个面向 Claude Cowork 和 Claude Code 的社区插件市场(只读镜像),开发者可通过指定链接提交插件。对读者:可关注该插件市场,扩展 Claude Code 的功能,提升开发效率。
亚马逊云科技为 DynamoDB 推出原生向量搜索功能,允许开发者将嵌入向量与应用数据存储在同一张表中,并直接运行近似最近邻查询,无需再维护单独的向量数据库。该功能支持最多 4096 维向量、多种距离函数及内联过滤,采用无服务器模式自动扩展。对读者:构建 AI 应用时可优先考虑 DynamoDB 原生向量能力,简化架构并降低数据同步成本。

开发者 Nikolay Samokhvalov 发布 PGSimCity,一款开源教育可视化工具,将 PostgreSQL 18 集群的运行机制(如 shared_buffers、WAL、autovacuum 等)转换为交互式 3D 城市模拟,完全在浏览器中运行。项目使用 three.js 渲染,并集成 PGlite 在浏览器中运行真实 PostgreSQL。对读者:可通过该工具直观理解 PostgreSQL 内部机制,适合作为团队培训或学习辅助。
Cloudflare 发布缓存响应规则(Cache Response Rules),这是一套新的规则引擎,运行在源站返回响应之后、内容写入缓存之前。它允许用户修改 Cache-Control 指令、管理 Cache Tag,并移除 Set-Cookie、ETag 等 Header,无需修改源站应用,从而提高缓存命中率并简化 CDN 迁移。对读者:可借此解决因意外 Header 导致缓存失效的问题,提升站点性能并降低源站带宽成本。

TechCrunch 测试发现,Anthropic 最新模型 Claude Opus 4.6 在 10 次直接请求中全部立即生成了明确色情内容,无需复杂提示即可绕过其使用政策中禁止生成性相关内容的规定。旧型号如 Opus 3 和 Haiku 4.5 也存在类似漏洞。对读者:在部署强模型时,默认安全护栏可能失效,需自行增加内容过滤层。

英伟达宣布与数据中心基础设施开发商 Cloverleaf Infrastructure 建立合作伙伴关系,据华尔街日报报道投资额或达数亿美元,英伟达将持有少数股权。Cloverleaf 成立于 2024 年,充当公用事业公司与数据中心之间的中间人,提供电力等关键基础设施。对读者:英伟达正从芯片向算力基础设施全链条渗透,相关生态合作值得关注。

英伟达发布新研究,指出在长周期任务中,围绕模型构建的“套件”(harness)——包括工具、内存管理和规则——比底层模型更关键。通过定制套件和“监督者”组件,Claude Opus 5 在 ARC-AGI-3 基准上取得 100% 分数。对读者:构建 Agent 时,应优先投入工程化套件设计,而非仅追求更强模型。

Runlayer 和 Rippling 已互相撤销诉讼,未支付任何赔偿。Rippling 随即发布了争议核心的 MCP 网关产品,与 Runlayer 直接竞争。这场短暂的法律纠纷为创始人敲响警钟:在 AI 时代,下一个竞争对手可能是潜在客户。对读者:创业公司需警惕大客户转身成为竞品,尽早建立护城河。

LinkedIn 于 7 月 30 日推出的“Seems like AI slop”按钮已获超百万人使用。该按钮位于帖子三点菜单中,用户可标记疑似 AI 生成内容。此前 AI 检测工具 Pangram 发现 LinkedIn 41% 的长文帖子被标记为完全 AI 生成。LinkedIn 同时升级了内容分类器。对读者:平台治理 AI 内容已成刚需,内容创作者需注意 AI 生成内容的标识与质量。

Google 向出版商提供新的“首选来源”按钮,读者点击后可在 Search、Discover 和 Google News 中更频繁看到该来源内容。该功能此前已在 AI Mode 和 AI Overviews 中推出,现扩展至全部搜索产品。此举旨在缓解 AI 搜索减少网页点击对出版商的冲击。对读者:内容站点应尽快集成该按钮,争取在 AI 搜索时代保留用户触达。
日报归档
按日期打开完整日报