每日 AI 简报(2026-10-09)
|刊号: news-20261009 · 数据窗口: 2026-10-08 09:00 → 2026-10-09 09:00(UTC+8)
每日 AI 简报,汇总过去 24 小时 AI 相关新闻。每条附来源链接。
【模型与产品】
1. 谷歌云发布面向企业的通用「Gemini 智能体」,称可在多个模型间自动路由
据 9to5Google、Quartz 当地时间 10 月 8 日报道,谷歌云在 Gemini at Work 2026 大会上发布面向企业客户的「Gemini 智能体(Gemini agent)」。据 9to5Google 报道,谷歌称其为「面向工作的单一通用智能体」,可在 Gemini Enterprise 应用、Workspace 以及第三方服务中使用,谷歌称用户可以「给它目标,而不是指令」;该智能体可回答问题、处理知识工作、创作媒体,以及编写并运行代码。据 9to5Google 报道,该智能体「为每项任务运行最合适的模型」,目前支持谷歌 Gemini 与 Anthropic Claude 两个模型家族,谷歌称未来还将支持其他闭源与开源模型,目的是「提供最佳质量并降低成本」;它通过子智能体处理多步任务,可运行数小时至数天,并运行在云端以维持「单一的记忆、上下文与个性化图谱」。据 Quartz 报道,该智能体可跨 Gmail、Drive、Docs 以及 Slack、微软 365 等第三方平台处理任务,管理员可按项目设置支出上限,超出后智能体自动暂停;在 Gmail、Docs、Sheets、Slides、Chat 中可用 @Gemini 唤起。据 9to5Google 报道,该智能体目前处于非公开预览(private preview),将很快面向部分 Business 与 Enterprise 套餐的 Workspace 客户大范围提供。
来源: 9to5Google · Quartz · The Verge
2. 谷歌发布可完全离线转写会议的实验性笔记应用 Google AI Edge Foresight
据 The Verge 当地时间 10 月 8 日报道(报道称 TechCrunch 更早报道),谷歌发布实验性笔记应用 Google AI Edge Foresight,可完全离线转写会议与音频文件。报道称,该应用免费,在 macOS 上运行,使用谷歌端侧模型 EmbeddingGemma 2;用户在会议中随手写下简写要点,应用会依据转写内容把它们整理成「更完整的笔记」。报道称,应用内置助手可就听到的内容提问,用户还可连接本地文件供其参考;据谷歌称,用户的文件、会议音频与笔记「永远不会离开你的电脑」。报道称,该应用目前仅针对采用 Apple 芯片的 Mac 优化,其与同类 AI 笔记应用的不同之处在于完全在本地处理。
来源: The Verge
3. 生数科技开放视频生成旗舰模型预览版 Vidu Q4 Preview,首发优惠价 0.09 元/秒起
据北京商报、量子位 10 月 8 日报道,生数科技发布新一代视频生成旗舰模型的首个预览版本 Vidu Q4 Preview。据北京商报报道,该模型围绕人物演绎、镜头语言与复杂视效等能力升级,最多支持 15 张参考图、3 段参考音频,并支持 2K、4K 输出;产品首发优惠价格为 0.09 元/秒起。据量子位报道,0.09 元/秒对应 720P,不同分辨率与模式价格不同,单条视频最长 16 秒;在 MaaS 端,图生视频 720P 约 0.6 元/秒、1080P 约 0.75 元/秒并实行分级定价,SaaS 端在预览版阶段推出为期两个月的限时优惠。据北京商报报道,生数科技已与影视、内容平台、云计算等产业方开展合作,在 AI 视听创制、漫剧生产、企业 API 接入等方向推进应用;据生数科技称,该预览版处于预览阶段,公司希望通过提前开放收集真实创作场景中的用户反馈,用于完善正式版本。
4. 阶跃终端:大模型原生智能体手机 STEPX Neo 将于 10 月 13 日在上海发布
据凤凰网科技、量子位报道,阶跃终端 10 月 8 日宣布,其首款大模型原生智能体手机 STEPX Neo 将于 10 月 13 日在上海一场以「Ready Builder One」为主题的发布会上正式发布,届时将公布阶跃终端在生态合作方面的进展。据凤凰网科技报道,该机运行智能体原生系统 Step AOS;据现场演示,其内置的 Amoo 助手可与飞书等应用深度联动——用户用自然语言提出「帮我处理一下明天汇报的事情」或「制作 PPT」等需求后,Amoo 会读取日历、群消息并判断任务,向用户申请文档修改权限,再按用户风格生成 PPT,并把汇报改期同步到相关群聊,处理完成后用户可跳转飞书查看成果。据网易报道,该机此前已在 2026 世界人工智能大会上亮相,其端侧生成式 AI 服务于 9 月 23 日通过网信部门备案,并已获得工信部入网许可。
【公司与行业】
5. Manus 母公司蝴蝶效应完成超 5 亿美元融资,称将继续在国内外招聘
据 TechCrunch 当地时间 10 月 8 日报道,中国 AI 公司 Manus 的母公司蝴蝶效应(Butterfly Effect)周四在微信发布消息称,公司完成超过 5 亿美元融资,这是 Meta 被要求叫停对该公司 20 亿美元收购以来其首轮融资。报道称,本轮由博裕资本与 IDG 资本领投,现有股东腾讯、HSG(原红杉中国)、真格基金等参投;公司称将继续在国内外招聘。报道称,Manus 未披露估值,但上月有报道称该公司正与投资者洽谈以 40 亿美元估值融资 5 亿美元。报道称,Manus 去年凭借 AI 智能体演示走红,2025 年年中把员工迁往新加坡,并于当年 12 月公布与 Meta 的 20 亿美元收购交易,当时其年度经常性收入据报道超过 1 亿美元;今年 4 月,中国监管部门要求其解除该交易,公司于 8 月恢复独立运营,并称作为分拆的一部分需要删除部分用户数据;据报道,该公司还在考虑赴香港上市。报道称,Manus 提供聊天机器人与 vibe-coding 工具,用于构建应用与网站、做设计与演示、生成视频等,近期推出了 Manus 2.0,以及让个人 AI 智能体拥有独立邮箱地址、电话号码、数字钱包与电脑的应用 Cue。
来源: TechCrunch
6. 据报道 OpenAI 9 月底年化收入约 500 亿美元,低于此前媒体报道的约 680 亿至 700 亿美元
据英国《金融时报》报道,以及 CNBC、《商业时报》报道,OpenAI 向投资者表示,截至 9 月底其年化收入接近 500 亿美元,低于 9 月下旬包括路透社在内的媒体所报道的约 680 亿至 700 亿美元。据《商业时报》援引《金融时报》报道,数字差异源于 OpenAI 的投资者试图与 Anthropic 的年化收入做直接比较:两家公司计算方式不同,Anthropic 把来自 AWS、谷歌云等云合作伙伴的销售收入计入,OpenAI 则不计入。据 CNBC 报道,OpenAI 在同一场投资者演示中还称其第三季度总运行率(run rate)增长 77%、企业业务运行率增长 107%;该公司正为其 852 亿美元估值寻求支撑,已于 6 月向监管机构秘密提交招股说明书,高管表示计划于 2027 年上市。报道称,受该报道影响,英伟达、甲骨文、CoreWeave 等 AI 相关股票下跌。
来源: 《商业时报》(转引《金融时报》) · CNBC
7. AI 模型排行榜 Arena 以 31 亿美元估值完成 2 亿美元 B 轮融资
据 TechCrunch 当地时间 10 月 8 日报道,AI 模型排行榜 Arena(2023 年起源于加州大学伯克利分校的一个研究项目,通过众包方式为 AI 模型排名)宣布以 31 亿美元估值完成 2 亿美元 B 轮融资。报道称,本轮由 Lightspeed Venture Partners 与 Khosla Ventures 领投,Salesforce Ventures、01 Advisors、戴尔科技资本、Endeavor Catalyst、a16z、Felicis 等参投;该公司今年 1 月以 17 亿美元投后估值完成 1.5 亿美元 A 轮,当时年化收入为 3000 万美元,并称今年 6 月年化运行率收入达到 1 亿美元,即估值在约 10 个月内接近翻倍。报道称,Arena 让用户输入提示词或请求 vibe-coding 项目并评价哪个模型做得更好,其称每月有数千万访客;去年 9 月,该公司推出面向模型实验室与企业、基于社区反馈提供详细性能分析的服务 AI Evaluations。报道称,该公司还给排行榜新增「对齐(alignment)」类别,按未经授权的操作、错误归因,以及其称为「欺骗性完成」(谎称完成实际未完成的任务)等指标给模型排名;报道称,目前一批 OpenAI 模型在其初步对齐榜单上居前,Claude Opus 5.5 与 Claude Fable 分列第六、第九。
来源: TechCrunch
8. 今日美国公司起诉 OpenAI 侵犯版权,索赔超 2.5 亿美元
据 The Verge 当地时间 10 月 8 日报道(报道称路透社更早报道),今日美国公司(USA Today Co.)连同其拥有的多家地方报纸起诉 OpenAI,称后者复制「数十万篇」文章用于训练 AI 模型。报道称,该出版商在周四提交的诉讼文件中索赔超过 2.5 亿美元,称 OpenAI 未经授权使用其内容「已造成真实且持续的」损害;诉讼称「OpenAI 的商业成功建立在规模化版权侵权之上」,并称 OpenAI 从未请求许可,而是「拿走」其内容去构建「价值数千亿美元的产品」;《田纳西人报》《印第安纳波利斯星报》《哥伦布快报》《俄克拉何马人报》等地方媒体也在起诉之列。报道称,这是一系列针对 OpenAI 的版权诉讼中最新的一起——除《纽约时报》的诉讼外,OpenAI 还面临 The Intercept、CNET 母公司 Ziff Davis、加拿大广播公司、大英百科全书、韦氏词典、《西雅图时报》,以及近 400 家地方报纸组成的联盟提起的诉讼。报道称,OpenAI 未立即回应 The Verge 的置评请求。
来源: The Verge
【安全与政策】
9. Anthropic 更新使用政策:禁止对模型的「持续且无端虐待或残忍行为」,并收紧选举相关规则
据 Quartz、Engadget、Unite.AI 当地时间 10 月 8 日报道,Anthropic 发布 2026 年使用政策(Usage Policy)更新,为一年多来首次重大更新,新政策将于 11 月 12 日生效。据 Quartz 报道,新政策禁止「对 Claude 模型持续且无端的虐待或残忍行为」,同时对选举干预、武器开发与监控等作出新增或更明确的限制;据 Anthropic 称,该禁令只针对极端情形——用户反复且无明显理由地对模型表现出残忍,不适用于日常的沮丧情绪、批评性反馈、暗黑题材创作以及测试与研究活动;公司称自此前更新起,Claude 已可在 Claude.ai 与 Claude Code 中结束与虐待型用户的对话,结束对话仍将是该规则的主要执行方式。据 Engadget 报道,Anthropic 同时更新选举政策,将其更名为「不要破坏民主进程(Do Not Undermine Democratic Processes)」,重点关注就候选人或投票方式撒谎、冒充候选人或选举官员,以及压制投票;该公司并取消了原先对个性化选民定向的一刀切禁令,原因是该禁令可能误伤翻译选民指南、发送选票补救通知等无害工作。
来源: Quartz · Engadget · Unite.AI
10. Anthropic 推出免费开源安全扫描服务 OSS Scanner,报告由模型生成、无人工复核
据 The Verge 当地时间 10 月 8 日报道,Anthropic 推出名为 OSS Scanner 的服务,称选择加入(opt-in)的开源项目将「由我们最强的模型免费进行彻底、定期的安全扫描」。据该报道,Anthropic 说明扫描结果完全由模型生成,没有人工复核或分诊,因此「报告可能是错误或无效的」;公司同时称这可以实现更快、更频繁的扫描,并称报告由其最强模型(包括 Claude Mythos)生成,以给开源项目「最大的防御优势」。报道称,AI 工具近月来已帮助发现一些重大开源软件漏洞,例如 5 月影响几乎所有 Linux 发行版的「Copy Fail」漏洞;与此同时,一些开源项目正疲于应付 AI 生成缺陷报告的激增,其中包括莱纳斯·托瓦兹(Linus Torvalds)与谷歌。
来源: The Verge
【教育与讨论】
11. UniPat AI 发布跨学科论文复现基准 PaperBenchX,最强配置完整复现率 13.98%
据 UniPat AI 官方博文,以及量子位报道,该公司发布跨学科论文复现基准 PaperBenchX,用于测试 AI 智能体能否复现已发表的科学研究结果。据该博文,基准包含 93 项论文复现任务,覆盖 6 个科学领域、12 个研究方向、10 套领域原生环境,论文来自 44 个发表场合,共设 3,168 条可评分标准;智能体的时间上限为 4 至 24 小时,中位数为 7 小时。据该博文,每项任务要求智能体提交源代码、配置与一个可运行的复现脚本,由系统在断网隔离环境中重新运行以重新生成证据,再按标准评分;评估分为建模、执行、验证三个阶段,只通过其中一个阶段不算复现成功;任务得分须严格高于 90% 的阈值才算「完整复现」。据该博文,在十种前沿智能体配置中,表现最强的系统仅有 13 项任务达到完整复现,完整复现率为 13.98%,其部分得分(Partial score)为 59.08%;共有 71 项任务从未被完整复现。据量子位报道,该基准的结果显示,从读懂论文到产出可复现的科学证据之间仍存在明显差距。