Skip to content

AI 动态 · 2026-08-02 ​

截至 2026-08-02。业界 · 产品 · 模型 · 开源 · 开发者工具 · 前端。

业界 ​

WAIC 收官圆桌:数百家机器人刷屏背后,AI 究竟重写了什么? ​

配图

WAIC 2026 收官圆桌邀请四位一线观察者,从学术、产研、创业与资本视角,检验大模型、Agent、具身智能等热词在真实工作流与商业化中的实际进展。讨论指出,具身智能尚未实现稳定工业级作业,本地智能体与新模型范式正加速验证真实需求,Scaling Law 瓶颈下扩散语言模型等基础路线获创业关注。

阅读原文

用了多年 React,Remix 终于“叛变”了:3.0 版本彻底重写 ​

配图

Remix 3 beta 预览版发布,从底层重新构建,将项目从 React 迁移到 Web 平台原生基础能力之上。新版本定位为完整全栈体系,路由基于 Fetch API,移除 React 运行时,采用基于 Preact 的分支版本和命令式模型,并引入“unbundling”理念。社区评价明显分化,有观察者认为这标志着从函数式编程向命令式编程的钟摆正在摆回。

阅读原文

NVIDIA Vera Rubin 正式登场:从芯片卷到电网,只为压低每一个 Token 的成本 ​

NVIDIA Vera Rubin NVL72 加速量产,CoreWeave、Google Cloud、Microsoft Azure 等合作伙伴机架已投入运行。平台从芯片到电网进行全栈协同设计,七款芯片和五种机架托盘深度协同,供应链覆盖 30 国 350+ 工厂。CoreWeave 针对 DeepSeek-R1 的基准测试显示,每兆瓦吞吐量比 Grace Blackwell NVL72 提升 10 倍。

阅读原文

92% 工程师都在用 AI 后,Uber 开始给 AI “限额”了 ​

Uber 的“零增长技术栈”将容量增长与业务需求增长解耦,通过自动化运行时优化和严格的 AI 生命周期管理降低开销。92% 工程师每月使用 AI Agent,31% 新代码由 AI 编写,但 AI 相关成本自 2024 年以来增长六倍,单个开发者月度成本达 2000 美元。Uber 正从无限制采用转向限额管理。

阅读原文

产品 ​

Google Earth 内置 AI 图像生成器引发误导信息担忧 ​

配图

Google Earth 推出的 AI 图像生成功能可基于卫星、航拍和 3D 影像生成现实扭曲图像,被迅速用于生成误导性内容,如墨西哥边境难民和加沙医院炸弹坑图像。尽管 Google 声称所有图像均含 SynthID 数字水印,但批评者仍担忧其传播虚假信息的风险。

阅读原文

模型 ​

(本日无新条目)

开源 ​

esengine/DeepSeek-Reasonix:终端里的 DeepSeek 原生 AI 编程代理 ​

配图

DeepSeek-Reasonix 是一个面向终端的 DeepSeek 原生 AI 编程代理,围绕前缀缓存稳定性设计,可长期保持运行。该项目针对 DeepSeek 模型特性优化,适合在终端环境中持续辅助编码任务。

阅读原文

Panniantong/Agent-Reach:让 AI 代理读取全网,零 API 费用 ​

配图

Agent-Reach 通过一个 CLI 让 AI 代理读取和搜索 Twitter、Reddit、YouTube、GitHub、Bilibili、小红书等平台内容,无需支付 API 费用。该项目为代理提供互联网视野,适合需要跨平台信息获取的 Agent 应用。

阅读原文

lyogavin/airllm:单张 4GB GPU 运行 70B 模型推理 ​

配图

AirLLM 项目实现了在单张 4GB GPU 上进行 70B 参数模型的推理,大幅降低了大型语言模型的硬件门槛。该项目通过优化推理策略,使资源受限环境也能运行大规模模型,对个人开发者和边缘计算场景具有实用价值。

阅读原文

开发者工具 ​

GitHub 代码搜索大小写折叠优化:单核速度超 45 GiB/s ​

GitHub 博客分享了代码搜索中大小写折叠(case-folding)的优化技术,通过无分支循环和字节空间算术,在单核上实现了超过 45 GiB/s 的处理速度。该技术显著提升了代码搜索性能,对大规模代码库的检索效率有重要影响。

阅读原文

前端 ​

(本日无新条目)