Skip to content

AI 动态 · 2026-10-08 ​

截至 2026-10-08。业界 · 产品 · 模型 · 开源 · 开发者工具 · 前端。

业界 ​

Manus 与 Meta 分拆后首轮融资超 5 亿美元 ​

配图

Manus 完成与 Meta 分拆后的首轮融资,金额超过 5 亿美元,由博裕资本与 IDG 资本领投,腾讯、HSG(原红杉中国)、真格基金等老股东跟投。这轮融资显示中国 AI Agent 赛道在资本层面依然活跃,也意味着 Manus 将独立推进产品与商业化。对读者:关注其后续 Agent 产品定价与开放策略,判断是否值得纳入团队工具链评估。

阅读原文

Nous Research 确认 15 亿美元估值,推出面向企业的 AI Agent ​

配图

Hermes Agent 开发商 Nous Research 完成 9000 万美元 B 轮融资,估值达 15 亿美元,并同步推出面向企业用户的 AI Agent 产品。开源模型背景的团队转向企业级 Agent 商业化,是今年开源与商业边界模糊化的又一案例。对读者:若团队已在用 Hermes 系列模型,可跟进其企业版能力与许可条款变化。

阅读原文

Tristan Harris 的科技非营利组织大幅裁员,转向“创始人主导” ​

配图

曾推动“反过度屏幕时间”运动的 Center for Humane Technology 将裁撤大部分员工,转为创始人主导模式。报道称内部在方向与策略上的张力已持续多年。科技伦理倡导组织在 AI 高速扩张期面临定位与资金双重压力。对读者:关注 AI 伦理与监管议题时,需留意倡导机构本身的影响力变化。

阅读原文

产品 ​

Claude 上线 Dashboards 与 Motion,Docs/Slides/Design 转正全量开放 ​

配图

Anthropic 为 Claude 推出两项 beta 功能:Claude Dashboards 用于构建实时数据看板,Claude Motion 用于生成动画讲解内容。同时 Docs、Slides、Design 结束 beta,向包括免费版在内的所有 Claude 套餐开放。这意味着 Claude 正从对话助手向办公与可视化生产工具延伸。对读者:若团队已订阅 Claude,可先试用 Dashboards 替代部分轻量 BI 场景。

阅读原文

Google 推出跨应用“通用”Gemini Agent ​

配图

Google 在 Gemini at Work 活动上发布通用 Gemini Agent,可在后台跨应用与设备执行任务,入口位于 Gemini Enterprise,支持 Gmail、Drive、Docs、Sheets、Calendar 以及 Slack、Microsoft 365 等第三方应用,并可从移动端、桌面与网页调用。云端运行意味着任务可持续执行。对读者:企业评估 Agent 平台时,可把跨应用权限与审计能力作为核心对比项。

阅读原文

ChatGPT 上线“Intelligent UI”,回答中直接嵌入图表与按钮 ​

配图

OpenAI 随 GPT-6 向所有用户推送 Intelligent UI,ChatGPT 可在文本回答中生成图表、示意图、表单与可点击按钮等交互元素。官方称已训练 GPT-6 判断何时用可视化替代纯文本。聊天界面正从纯文本输出转向可交互的轻应用形态。对读者:做前端集成时需提前考虑这类富交互输出的渲染与可访问性适配。

阅读原文

Google 推出完全离线的 AI 会议记录应用 AI Edge Foresight ​

配图

Google 发布实验性笔记应用 AI Edge Foresight,可在完全离线状态下转写会议与音频文件,基于端侧 EmbeddingGemma 2 模型运行于 macOS,免费使用。用户记录要点后,应用会结合转写内容整理成“润色后的笔记”,对标 Granola、Wispr Flow。对读者:对数据敏感的场景可优先评估端侧方案,但需确认离线模型的准确率是否达标。

阅读原文

模型 ​

Anthropic 发布 Claude Haiku 5.5:1M 上下文,输入每百万 token 仅 0.10 美元 ​

Anthropic 推出小模型 Claude Haiku 5.5,保留 1M 上下文,输入价格低至每百万 token 0.10 美元,在 OSWorld 上得分 72.4%。相比 Haiku 4.5 的 1 美元输入价,降幅约九成,直接对标 OpenAI GPT-6 Luna 的定价。对读者:高频、成本敏感的批处理与子 Agent 场景可优先切换到 Haiku 5.5 做成本压测。

阅读原文

Perplexity 发布 pplx-embed-v2-late:0.6B 端侧与 9B 索引双版本 ​

Perplexity 推出 pplx-embed-v2-late 嵌入模型,包含面向边缘设备的 0.6B 版本和用于高质量索引构建的 9B 版本,MADQA 最高得分 92.4%,ViDoRe v3 Markdown 最低 61.2%。两个版本均为 MIT 许可,可自行部署。对读者:自建 RAG 的团队可将其纳入嵌入模型候选,注意不同任务上的分数差异较大。

阅读原文

Liquid AI 开源 d1-3B 与 d1-omni-600M 多模态决策模型 ​

Liquid AI 发布 Open d1 系列两个开放权重多模态模型:d1-3B 可读文本与图像,d1-omni-600M 支持文本配图像或音频。两者均不输出文本,而是在单次前向传播中返回校准后的类型化答案,输出 token 为零,面向实时决策场景。对读者:分类、判定类任务可尝试用决策模型替代生成式模型以降低延迟与成本。

阅读原文

开源 ​

Unsloth Studio 在运行前重新校验模型仓库变更 ​

Unsloth 发布 10 月 6 日安全说明,介绍 Studio 在运行前如何检查代码、权重、依赖包与工具:自定义模型代码会被扫描且审批绑定到指纹,被标记的权重文件在加载路径中被拦截,包内容问题会导致 CI 失败,工具运行在探测过的操作系统沙箱中。对读者:本地跑第三方模型权重时,可参考这套校验点设计自己的加载前检查流程。

阅读原文

开发者工具 ​

Stack Overflow:给编码 Agent 一套“操作系统”式的纪律化构建方法 ​

配图

Stack Overflow 博客 Part 6 讨论编码 Agent 的长期质量问题:Agent 适合干一下午,却难以稳定支撑一个季度。文章给出少量文件与规则配置,用于在数月、上千次编辑中防止质量衰减,适用于单 Agent 或同仓库多 Agent 并行。对读者:若团队已把编码 Agent 纳入日常流程,可先落地这套配置模板再谈规模化。

阅读原文

前端 ​

(本日无新条目)