Skip to content

AI 动态 · 2026-08-02

截至 2026-08-02。业界 · 产品 · 模型 · 开源 · 开发者工具 · 前端。

业界

WAIC 收官圆桌:数百家机器人刷屏背后,AI 究竟重写了什么?

配图

WAIC 2026 收官圆桌邀请四位一线观察者,从学术、产研、创业与资本视角,检验大模型、Agent、具身智能等热词在真实工作流与商业化中的实际进展。讨论指出,具身智能尚未实现稳定工业级作业,本地智能体与新模型范式正加速验证真实需求,Scaling Law 瓶颈下扩散语言模型等基础路线获创业关注。

阅读原文

用了多年 React,Remix 终于“叛变”了:3.0 版本彻底重写

配图

Remix 3 beta 预览版发布,从底层重新构建,将项目从 React 迁移到 Web 平台原生基础能力之上。新版本定位为完整全栈体系,路由基于 Fetch API,移除 React 运行时,采用基于 Preact 的分支版本和命令式模型,并引入“unbundling”理念。社区评价明显分化,有观察者认为这标志着从函数式编程向命令式编程的钟摆正在摆回。

阅读原文

NVIDIA Vera Rubin 正式登场:从芯片卷到电网,只为压低每一个 Token 的成本

NVIDIA Vera Rubin NVL72 加速量产,CoreWeave、Google Cloud、Microsoft Azure 等合作伙伴机架已投入运行。平台从芯片到电网进行全栈协同设计,七款芯片和五种机架托盘深度协同,供应链覆盖 30 国 350+ 工厂。CoreWeave 针对 DeepSeek-R1 的基准测试显示,每兆瓦吞吐量比 Grace Blackwell NVL72 提升 10 倍。

阅读原文

92% 工程师都在用 AI 后,Uber 开始给 AI “限额”了

Uber 的“零增长技术栈”将容量增长与业务需求增长解耦,通过自动化运行时优化和严格的 AI 生命周期管理降低开销。92% 工程师每月使用 AI Agent,31% 新代码由 AI 编写,但 AI 相关成本自 2024 年以来增长六倍,单个开发者月度成本达 2000 美元。Uber 正从无限制采用转向限额管理。

阅读原文

产品

Google Earth 内置 AI 图像生成器引发误导信息担忧

配图

Google Earth 推出的 AI 图像生成功能可基于卫星、航拍和 3D 影像生成现实扭曲图像,被迅速用于生成误导性内容,如墨西哥边境难民和加沙医院炸弹坑图像。尽管 Google 声称所有图像均含 SynthID 数字水印,但批评者仍担忧其传播虚假信息的风险。

阅读原文

模型

(本日无新条目)

开源

esengine/DeepSeek-Reasonix:终端里的 DeepSeek 原生 AI 编程代理

配图

DeepSeek-Reasonix 是一个面向终端的 DeepSeek 原生 AI 编程代理,围绕前缀缓存稳定性设计,可长期保持运行。该项目针对 DeepSeek 模型特性优化,适合在终端环境中持续辅助编码任务。

阅读原文

Panniantong/Agent-Reach:让 AI 代理读取全网,零 API 费用

配图

Agent-Reach 通过一个 CLI 让 AI 代理读取和搜索 Twitter、Reddit、YouTube、GitHub、Bilibili、小红书等平台内容,无需支付 API 费用。该项目为代理提供互联网视野,适合需要跨平台信息获取的 Agent 应用。

阅读原文

lyogavin/airllm:单张 4GB GPU 运行 70B 模型推理

配图

AirLLM 项目实现了在单张 4GB GPU 上进行 70B 参数模型的推理,大幅降低了大型语言模型的硬件门槛。该项目通过优化推理策略,使资源受限环境也能运行大规模模型,对个人开发者和边缘计算场景具有实用价值。

阅读原文

开发者工具

GitHub 代码搜索大小写折叠优化:单核速度超 45 GiB/s

GitHub 博客分享了代码搜索中大小写折叠(case-folding)的优化技术,通过无分支循环和字节空间算术,在单核上实现了超过 45 GiB/s 的处理速度。该技术显著提升了代码搜索性能,对大规模代码库的检索效率有重要影响。

阅读原文

前端

(本日无新条目)