Skip to content

每日精选

AI 动态

业界、产品、模型、开源与开发者工具 — 按日整理,点进日报可读全文

839 条动态 · 75 期日报 · 约 7:00 自动更新

日报归档

按期查阅每日精选

75 期

动态流

单条要闻筛选浏览,向下滚动自动加载

839 条
TechCrunch AI
Manus 与 Meta 分拆后首轮融资超 5 亿美元

Manus 完成与 Meta 分拆后的首轮融资,金额超过 5 亿美元,由博裕资本与 IDG 资本领投,腾讯、HSG(原红杉中国)、真格基金等老股东跟投。这轮融资显示中国 AI Agent 赛道在资本层面依然活跃,也意味着 Manus 将独立推进产品与商业化。对读者:关注其后续 Agent 产品定价与开放策略,判断是否值得纳入团队工具链评估。

阅读全文
TechCrunch AI
Nous Research 确认 15 亿美元估值,推出面向企业的 AI Agent

Hermes Agent 开发商 Nous Research 完成 9000 万美元 B 轮融资,估值达 15 亿美元,并同步推出面向企业用户的 AI Agent 产品。开源模型背景的团队转向企业级 Agent 商业化,是今年开源与商业边界模糊化的又一案例。对读者:若团队已在用 Hermes 系列模型,可跟进其企业版能力与许可条款变化。

阅读全文
Wired AI
Tristan Harris 的科技非营利组织大幅裁员,转向“创始人主导”

曾推动“反过度屏幕时间”运动的 Center for Humane Technology 将裁撤大部分员工,转为创始人主导模式。报道称内部在方向与策略上的张力已持续多年。科技伦理倡导组织在 AI 高速扩张期面临定位与资金双重压力。对读者:关注 AI 伦理与监管议题时,需留意倡导机构本身的影响力变化。

阅读全文
Claude Blog
Claude 上线 Dashboards 与 Motion,Docs/Slides/Design 转正全量开放

Anthropic 为 Claude 推出两项 beta 功能:Claude Dashboards 用于构建实时数据看板,Claude Motion 用于生成动画讲解内容。同时 Docs、Slides、Design 结束 beta,向包括免费版在内的所有 Claude 套餐开放。这意味着 Claude 正从对话助手向办公与可视化生产工具延伸。对读者:若团队已订阅 Claude,可先试用 Dashboards 替代部分轻量 BI 场景。

阅读全文
The Verge AI
Google 推出跨应用“通用”Gemini Agent

Google 在 Gemini at Work 活动上发布通用 Gemini Agent,可在后台跨应用与设备执行任务,入口位于 Gemini Enterprise,支持 Gmail、Drive、Docs、Sheets、Calendar 以及 Slack、Microsoft 365 等第三方应用,并可从移动端、桌面与网页调用。云端运行意味着任务可持续执行。对读者:企业评估 Agent 平台时,可把跨应用权限与审计能力作为核心对比项。

阅读全文
The Verge AI
ChatGPT 上线“Intelligent UI”,回答中直接嵌入图表与按钮

OpenAI 随 GPT-6 向所有用户推送 Intelligent UI,ChatGPT 可在文本回答中生成图表、示意图、表单与可点击按钮等交互元素。官方称已训练 GPT-6 判断何时用可视化替代纯文本。聊天界面正从纯文本输出转向可交互的轻应用形态。对读者:做前端集成时需提前考虑这类富交互输出的渲染与可访问性适配。

阅读全文
The Verge AI
Google 推出完全离线的 AI 会议记录应用 AI Edge Foresight

Google 发布实验性笔记应用 AI Edge Foresight,可在完全离线状态下转写会议与音频文件,基于端侧 EmbeddingGemma 2 模型运行于 macOS,免费使用。用户记录要点后,应用会结合转写内容整理成“润色后的笔记”,对标 Granola、Wispr Flow。对读者:对数据敏感的场景可优先评估端侧方案,但需确认离线模型的准确率是否达标。

阅读全文
MarkTechPost
Anthropic 发布 Claude Haiku 5.5:1M 上下文,输入每百万 token 仅 0.10 美元

Anthropic 推出小模型 Claude Haiku 5.5,保留 1M 上下文,输入价格低至每百万 token 0.10 美元,在 OSWorld 上得分 72.4%。相比 Haiku 4.5 的 1 美元输入价,降幅约九成,直接对标 OpenAI GPT-6 Luna 的定价。对读者:高频、成本敏感的批处理与子 Agent 场景可优先切换到 Haiku 5.5 做成本压测。

阅读全文
MarkTechPost
Perplexity 发布 pplx-embed-v2-late:0.6B 端侧与 9B 索引双版本

Perplexity 推出 pplx-embed-v2-late 嵌入模型,包含面向边缘设备的 0.6B 版本和用于高质量索引构建的 9B 版本,MADQA 最高得分 92.4%,ViDoRe v3 Markdown 最低 61.2%。两个版本均为 MIT 许可,可自行部署。对读者:自建 RAG 的团队可将其纳入嵌入模型候选,注意不同任务上的分数差异较大。

阅读全文
MarkTechPost
Liquid AI 开源 d1-3B 与 d1-omni-600M 多模态决策模型

Liquid AI 发布 Open d1 系列两个开放权重多模态模型:d1-3B 可读文本与图像,d1-omni-600M 支持文本配图像或音频。两者均不输出文本,而是在单次前向传播中返回校准后的类型化答案,输出 token 为零,面向实时决策场景。对读者:分类、判定类任务可尝试用决策模型替代生成式模型以降低延迟与成本。

阅读全文
MarkTechPost
Unsloth Studio 在运行前重新校验模型仓库变更

Unsloth 发布 10 月 6 日安全说明,介绍 Studio 在运行前如何检查代码、权重、依赖包与工具:自定义模型代码会被扫描且审批绑定到指纹,被标记的权重文件在加载路径中被拦截,包内容问题会导致 CI 失败,工具运行在探测过的操作系统沙箱中。对读者:本地跑第三方模型权重时,可参考这套校验点设计自己的加载前检查流程。

阅读全文
Stack Overflow Blog
Stack Overflow:给编码 Agent 一套“操作系统”式的纪律化构建方法

Stack Overflow 博客 Part 6 讨论编码 Agent 的长期质量问题:Agent 适合干一下午,却难以稳定支撑一个季度。文章给出少量文件与规则配置,用于在数月、上千次编辑中防止质量衰减,适用于单 Agent 或同仓库多 Agent 并行。对读者:若团队已把编码 Agent 纳入日常流程,可先落地这套配置模板再谈规模化。

阅读全文
Ars Technica AI
Mistral 称 Le Chonk 可挑战顶级闭源模型,且保持开放权重

Ars Technica 报道,Mistral 表示其新模型 Le Chonk(即 Mistral Large 4)能够与顶级闭源模型竞争,同时仍保持开放权重路线。这与 Mistral 一贯的「开放 + 欧洲主权」定位一致,也让它成为少数同时押注前沿能力与开放生态的厂商。对读者:若你在评估「闭源 API 还是可自托管权重」,Le Chonk 的权重发布节奏值得列入观察清单。

阅读全文
TechCrunch AI
Healthleap 融资 3800 万美元,用 AI 标记需重点关注的住院患者

Healthleap 完成 3800 万美元融资,包括由 Sequoia Capital 与 First Round Capital 联合领投的 800 万美元种子轮,以及由 Hummingbird Ventures 领投的 3000 万美元 A 轮。其 AI 用于识别医院中可能需要更密切观察的患者,属于临床辅助决策方向。对读者:医疗 AI 的融资热度仍在,但落地关键在于与临床流程和合规的咬合,关注其后续临床验证数据。

阅读全文
The Verge AI
Google、Meta、Isomorphic Labs 共同投资 3 亿美元建「虚拟细胞」

Google DeepMind、Meta 与 AI 药物发现公司 Isomorphic Labs 联合向 Biohub 投资 3 亿美元,用于创建可供研究人员对抗疾病的「虚拟细胞」。该项目由扎克伯格夫妇创立的非营利生物医学研究组织 Biohub 牵头,属于 18 亿美元「虚拟生物学」计划的一部分,目标是构建可让研究者数字化提问、预测和回答生物学问题的 AI 数据集。对读者:AI for Science 正从论文走向重资产基础设施,关注其数据集开放程度。

阅读全文
Ars Technica AI
Google 全球上线改进版 SynthID AI 内容检测器

Google 推出新版 SynthID 网站,可识别来自 Google、OpenAI 等多家厂商的 AI 生成内容,并面向全球开放。这使 AI 内容溯源从单一厂商工具走向跨平台检测,但检测可靠性仍是行业共同难题。对读者:若你的产品涉及 UGC 或内容审核,可把 SynthID 作为辅助信号接入,但不要把它当作唯一判定依据。

阅读全文
OpenAI Blog
GPT-6 全球上线 ChatGPT,带来 Intelligent UI

OpenAI 宣布 GPT-6 在全球范围内向 ChatGPT 用户推送,并同步引入 Intelligent UI:响应更快,回答中直接嵌入可视化与可交互内容,用户可在对话里探索和使用。这标志着 ChatGPT 从纯文本问答进一步转向「可操作界面」,模型能力与前端交互形态被捆绑发布。对读者:若你在做 AI 产品,需重新评估「聊天框」是否还是唯一入口,交互层可能成为新的差异化战场。

阅读全文
The Verge AI
Common Sense Media:ChatGPT for Teens 是「不可接受的风险」

青少年安全评测机构 Common Sense Media 称 OpenAI 的 ChatGPT for Teens 是「不可接受的风险」。该功能 8 月推出,主打面向青少年的护栏与学习辅助,但评估认为其保护措施「未达到公司承诺」:该提醒家长时未提醒、危机情境下未提供正确帮助,且仍会替孩子做作业。对读者:做面向未成年人的 AI 产品,护栏不能只写在宣传里,家长通知与危机干预是必须可验证的能力。

阅读全文
OpenAI Blog
OpenAI 为 ChatGPT for Teens 加入 College Planner 等功能

OpenAI 宣布 College Planner 即将登陆 ChatGPT for Teens,帮助学生管理大学申请,同时新增闪卡、测验功能,并成立青少年 AI 委员会。这与同日 Common Sense Media 的批评形成对照:一边扩展青少年学习场景,一边面临安全性质疑。对读者:教育类 AI 功能扩张时,安全与家长可见性会成为监管和舆论的焦点,产品设计需前置考虑。

阅读全文
Claude Blog
Anthropic 发布 Claude Haiku 5.5:最快最便宜的小模型

Anthropic 推出 Claude Haiku 5.5,官方称其为迄今最快、最强的小模型,主打高并发场景,如摘要、子智能体(subagents)与浏览器操作。模型 ID 为 claude-haiku-5-5,定位在成本敏感、调用量大的任务上替代更大模型。对读者:如果你的 Agent 流水线里大量调用的是「廉价小模型」,值得把 Haiku 5.5 纳入成本与延迟的对比测试。

阅读全文
MarkTechPost
Mistral 发布 Mistral Large 4(Le Chonk):1.05 万亿参数 MoE

Mistral AI 以公开预览形式发布 Mistral Large 4,代号 Le Chonk:1.05 万亿参数混合专家模型,激活参数 490 亿,原生支持图像输入,上下文窗口达 100 万 token,在 Mistral 自有的欧洲数据中心用 3800 块 NVIDIA Grace Blackwell GPU 训练。API 已上线,开放权重预计 2026 年 10 月底发布。对读者:欧洲主权算力 + 开放权重路线值得关注,若你受数据合规约束,可提前评估其 API 与后续权重。

阅读全文
MarkTechPost
Google DeepMind 开源 EmbeddingGemma 2:740M 多模态嵌入模型

Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源多模态嵌入模型,基于 Gemma 4 构建,可将 5 种输入类型映射到统一的 768 维空间,以 Apache 2.0 协议发布。它面向隐私优先的本地部署场景,主打「原生多模态嵌入」能力。对读者:做 RAG 或跨模态检索时,可把它作为本地嵌入层的候选,重点验证多模态召回质量与显存占用。

阅读全文
MarkTechPost
Meta 开源 Rebalancer:每天处理约 4000 万次分配问题的 C++ 求解器

Meta 开源了内部使用超过 9 年的 Rebalancer,一个 C++ 与 Python 库,用于分片、服务器与流量分配,每天处理约 4000 万个分配问题,支持局部搜索以及 Gurobi、FICO Xpress、HiGHS 等 MIP 求解器,以 Apache 2.0 协议发布并可通过 pip 安装。对读者:调度、容量规划、分片均衡这类「组合优化」问题,可先看它能否直接复用,避免自研求解器。

阅读全文
GitHub Blog
GitHub 重建 Git 基础设施,为 Agent 规模开发做准备

GitHub 正在不停机重建其 Git 基础设施,以应对写入量加速增长带来的压力,并为「Agent 规模」的软件开发打基础。官方称这一架构调整面向的是仓库所依赖系统的可扩展性,而非单点功能更新。对读者:当编码 Agent 大量并发提交时,代码托管平台的底层能力会直接影响你的 CI 与协作体验,值得关注其后续性能与限流策略变化。

阅读全文
继续下滑加载更多