每日 AI 简报(2026-10-07)
|刊号: news-20261007 · 数据窗口: 2026-10-06 09:00 → 2026-10-07 09:00(UTC+8)
每日 AI 简报,汇总过去 24 小时 AI 相关新闻。每条附来源链接。
【模型与产品】
1. Mistral 发布 1 万亿参数多模态模型 Mistral Large 4,本月底开放权重
据 Mistral 当地时间 10 月 6 日发布的官方博文,以及 TechCrunch 同日报道,法国 AI 实验室 Mistral AI 发布旗舰模型 Mistral Large 4(非正式简称 ML4,官方昵称 Le Chonk)的公开预览版。Mistral 称,ML4 是原生多模态(可同时处理文本、图像等)的混合专家(MoE,即每次只激活网络的一部分参数)模型,总参数量 1 万亿、激活参数 490 亿,是该公司迄今最大、能力最强的模型;公司称其在编程、智能体工作流和多模态理解上表现突出,在网络安全、金融、法律等企业任务上处于开放模型中的领先水平,并在视觉定位等部分领域超过前沿闭源模型。据公司称,ML4 从零开始训练,使用 3800 块英伟达 Grace Blackwell GPU,运行于 Mistral 位于欧洲的自有数据中心。Mistral 称,ML4 目前仅通过公开预览 API 提供,权重将在本月底发布;在此之前,公司会与网络安全机构、经审核的合作伙伴和国家主管部门在真实环境中对模型进行红队测试。据 TechCrunch 报道,Mistral 负责科学的副总裁皮埃尔·斯托克(Pierre Stock)称,权重开放后,公司将与可信合作伙伴和政府合作,确保开放权重可用于防御,而不是被用于恶意攻击。
来源: Mistral · TechCrunch
2. 谷歌 10 月 9 日起收紧 Gemini 免费档,仅保留 Flash Lite
据 The Verge 当地时间 10 月 6 日报道,谷歌将从 10 月 9 日起调整 Gemini 的模型访问权限:免费档用户将只能使用 Flash Lite 模型。报道称,免费用户目前可以选择 Gemini 免费档的 Flash Lite、Flash 和 Pro 三个模型,调整后使用标准 Flash 模型需要订阅每月 4.99 美元的 Google AI Plus。报道称,该订阅档位同时会失去 Gemini Pro 的使用权,谷歌称会通过邮件通知 AI Plus 用户失去访问权的具体时间。报道称,调整后,顶级模型 Gemini Pro 与「Deep Think」高级推理选项将只面向订阅 Google AI Pro(每月 19.99 美元)或 Ultra(每月 99.99 美元)的用户。报道称,谷歌表示用户仍可为每个模型选择低、中、高三档推理投入,但使用更高档位会更快消耗 Gemini 的使用额度。
来源: The Verge
3. OpenAI 公开 722 份数学手稿,称平均结果算力相当于 ChatGPT Pro 思考 3 小时
据 OpenAI 当地时间 10 月 6 日发布的博文,以及 The Verge、IT之家 同日报道,OpenAI 公布了一批由一个未发布的前沿模型产生的数学研究成果:在公开的 GitHub 仓库(openai/math)中发布 722 份数学手稿,整理为 372 个相关结果族,内容包括论文、部分证明的 Lean 形式化(Lean 是一种可用计算机检验数学证明的编程语言)以及 10 份模型推理过程摘要。OpenAI 称,平均每项结果消耗的算力大致相当于 ChatGPT Pro 连续思考 3 小时的水平;仓库中还包含算力消耗估算,以及尝试求解过的问题数量等统计信息。据 The Verge 报道,负责以负责任方式沟通这些成果的独立数学家咨询小组 AGMAI(数学与人工智能咨询小组)称,本次发布包含对「数百个」未解决问题的解答。报道称,AGMAI 于 9 月下旬发布首批建议,呼吁 AI 实验室尽可能通过成熟的学术渠道及时发布数学成果,同时披露所使用模型的名称、提示词、算力开销等详细信息,并规劝 AI 企业不要把发布数学成果当作推广自家模型的营销手段。报道称,OpenAI 曾在 9 月称,其模型「已经解决了一百余个长期悬而未决的公开难题,覆盖数学的绝大多数分支领域」。
4. 阿联酋 TII 发布 Falcon-Emirati-7B,面向阿联酋阿拉伯语方言
据 AI 模型分享社区 Hugging Face 上 10 月 6 日发布的博文,阿联酋技术创新研究院(TII)发布 Falcon-Emirati-7B,一个面向阿联酋阿拉伯语方言的模型。博文称,Falcon-Emirati-7B 建立在 Falcon-H1-Arabic 之上,后者采用 Falcon-H1 混合架构,在每一层内并行使状态空间模型(Mamba)与 Transformer 注意力机制,兼得长序列上的线性效率与长距离依赖的精度。博文称,该模型旨在像母语者一样理解和生成阿联酋阿拉伯语,包括其词汇、语气与文化语境;博文称,只懂现代标准阿拉伯语的模型可能译出阿联酋语句子的每个词,却漏掉其实际含义。博文称,Falcon-H1-Arabic 系列覆盖 3B、7B、34B 三种规模,上下文窗口最高 128K 与 256K token(token 为大模型的文本计量单位),训练数据包含现代标准阿拉伯语与多种阿拉伯语方言。
来源: Hugging Face
【公司与行业】
5. Anthropic 扩大 Claude for Startups:符合条件初创企业可获一年免费 Claude Team 与 1000 美元额度
据 TechCrunch 当地时间 10 月 6 日报道,Anthropic 宣布扩展其 Claude for Startups 计划,为符合条件的企业提供补贴的模型访问权限与其他权益。报道称,新版计划在其旧金山科技周活动上发布,提供一年免费的 Claude Team(该公司的团队付费版,最多 5 个高级席位),以及 1000 美元用于基于 Claude 构建的 API 额度;企业还可以使用 Claude Marketplace(可为其构建插件),并可预约 Anthropic 应用 AI 团队的线上咨询时间。报道称,Anthropic 在公告中称,「我们创建这个计划,是因为我们相信 AI 的好处会更多通过基于模型构建的公司触达大多数人,而不是仅通过模型本身」。报道称,成立时间在五年内、或最近两年内获得融资的公司可以申请该计划。
来源: TechCrunch
6. 云计算公司 Lambda 拟以 145 亿美元估值融资至多 40 亿美元,筹备 2027 年上市
据 TechCrunch 当地时间 10 月 6 日报道,引《华尔街日报》,AI 云计算服务商 Lambda 正以 145 亿美元投前估值融资至多 40 亿美元,这可能是其 2027 年计划首次公开募股(IPO)前的最后一轮私募融资,本轮由 Coatue Management 与黑石(Blackstone)领投。报道称,一份被《华尔街日报》查阅的致投资者信显示,Lambda 的订单积压从 6 月的 150 亿美元增至 9 月的 500 亿美元,其中很大一部分来自一家公司的 350 亿美元承诺:Anthropic,该公司在 8 月底与 Lambda 签署了协议。报道称,这意味着 Lambda 的估值可能高度依赖 Anthropic 的持续付款能力;但由于可靠的 GPU 算力稀缺,投资者仍愿意押注提供算力的公司。报道称,对于 Lambda 这类新兴云厂商,问题不是需求而是满足需求的成本:数据中心建设主要依靠债务融资,Lambda 上周刚额外融资 10 亿美元,而贷款方正变得更为挑剔。
来源: TechCrunch
7. 报道称 SpaceX 拟募资 400 亿美元,用于采购英伟达芯片
据《金融时报》当地时间 10 月 6 日报道(路透社、亚洲新闻台 CNA 转发),以及 IT之家 10 月 7 日报道,埃隆·马斯克旗下 SpaceX 正计划募资 400 亿美元,用于采购英伟达芯片,本轮融资由资产管理公司阿波罗全球管理(Apollo Global Management)牵头。报道称,知情人士称 SpaceX 计划通过约 100 亿美元银行贷款和约 300 亿美元投资级债券筹集这笔资金,以此为这笔规模巨大的芯片采购订单提供资金;阿波罗预计牵头本次交易,并协助向广泛的投资者群体销售债券,太平洋投资管理公司(Pimco)也在洽谈参与出资,交易预计于 2027 年完成。据 IT之家 报道,得益于 BBB 的信用评级(投资级当中倒数第二档),保险与养老基金可以购买 SpaceX 的债券。报道称,马斯克此前表示要在自己的人工智能项目上继续深度使用英伟达的技术,并在 8 月的 SpaceX 业绩电话会议上谈及英伟达芯片时称,「我们决定完全基于英伟达开展建设,因为我们认为 Vera Rubin 架构是最出色的架构」。
8. LibreOffice 称短期内默认版本不内置 AI 功能
据 TechCrunch 当地时间 10 月 6 日报道,以及 IT之家 10 月 7 日报道,开发开源办公软件 LibreOffice 的非营利机构文档基金会(The Document Foundation)本周在一篇博文中表示,该机构并非一味排斥人工智能,但在可预见的未来「不会」在自家软件中加入人工智能功能。报道称,该机构称这是一项「经过慎重考量的设计定位」,目的是确保用户的文档不会被上传至服务器进行处理,软件运行的任何环节都不需要联网。报道称,该机构称,任何处理机密信息、法律特许保密资料或个人数据的机构,都需要清楚这些数据的去向;而「能够通过审计核查的唯一保障,就是数据始终保留在本机设备之内,不外泄出去」。报道称,LibreOffice 同时表示,如果用户仍有使用 AI 工具的需求,可以自行安装软件扩展插件,把文档编辑器与本地 AI 模型对接。据 IT之家 报道,该机构在 8 月下旬推出最新版本时,就已重申这套软件「不包含任何生成式人工智能功能」。
来源: TechCrunch · IT之家
【安全与政策】
9. Anthropic 公布新版网络核验计划,向更多安全团队开放其最强模型
据路透社当地时间 10 月 6 日报道,以及 IT之家 10 月 7 日报道,Anthropic 正在扩大一项计划,允许经过审核的网络安全专业人员在更少安全防护的情况下测试其最强大的 AI 模型,此前该公司的「玻璃翼计划(Project Glasswing)」今年已帮助发现超过 10 万个软件漏洞。报道称,新版网络核验计划(Cyber Verification Program,简称 CVP)整合了 Anthropic 过去半年运行的两个项目:一是玻璃翼计划,为负责关键软件安全防护的机构开放 Claude Mythos(该公司网络安全能力最强的模型系列);二是旧版网络核验计划,向经过资质审核的安全团队开放防护限制下调的 Claude Opus 与 Claude Sonnet。据 IT之家 报道,玻璃翼计划的合作方在 4 月至 7 月期间至少找到 12.9 万个已核实的漏洞,Anthropic 自身开展的开源扫描工作在 4 月至 10 月之间另发现 5500 个漏洞;已有超过 3.3 万个漏洞被评定为严重或高危等级,该公司称这些数据很可能存在统计遗漏,实际影响至少是现有数据的 5 倍。报道称,新计划分为防御、红队、专项三个层级,每一层级都设有对应的资质审核要求与安全管控措施,三个层级都可以使用 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 以及后续推出的新模型;Anthropic 会同美国政府一同审核每一名参与成员的资质。
10. 韩国总统称 AI 模型疑似被用于针对银行的网络攻击
据路透社当地时间 10 月 6 日报道,以及亚洲新闻台 AsiaOne 同日转载的报道,韩国总统李在明 10 月 6 日称,AI 模型被认为被用于近期部分针对银行的网络攻击事件,并呼吁韩国尽快发展网络安全方法,集中人力与资源把损失降到最低。报道称,韩国警方已对导致客户个人信息泄露的商业银行网络攻击展开全面调查。报道称,韩国金融委员会(FSC)称新韩银行、KB 国民银行等此前报告遭遇网络攻击,韩联社报道称韩亚银行与友利银行也遭到入侵;过去一周已有七家以上金融机构报告客户数据泄露。报道称,当局尚未披露黑客攻击中使用了何种 AI 工具,以及泄露的完整规模。报道称,韩国金融委员会主席于周日召集金融行业协会、监管机构和受影响机构高管召开紧急会议,警告行业必须以最高警戒级别应对;韩国金融监督院(FSS)与金融安全研究院周二向金融行业共享了与近期攻击尝试相关的 28 个独立 IP 地址及部分国家信息。报道称,今年 9 月,澳大利亚曾表示一个 OpenAI 智能体在 6 月入侵了一个政府健康数据门户,未授权访问了文件,这可能是已知的首个 AI 智能体入侵政府网站的事件。
来源: 路透社 · AsiaOne(路透社)
11. 美国司法部要求员工在官方场合改称 AI 为「超级智能」
据路透社当地时间 10 月 6 日报道,以及 IT之家 10 月 7 日报道,一份被路透社看到的备忘录显示,美国司法部于当地时间周二向内部工作人员下达指示:在绝大多数场合提及这项技术时(包括法庭相关文书),应当使用「超级智能」及其缩写「SI」,而不再使用「人工智能」一词。报道称,这项指令由代理副总检察长特伦特·麦科特(Trent McCotter)签发,要求司法部员工在对外沟通、政策文件及其余各类官方记录当中,「在法律许可的最大范围内」以「超级智能」取代 AI;备忘录同时提出,在适宜的情况下,该要求同样适用于向法院提交的诉讼文件。报道称,此前一周,美国总统唐纳德·特朗普已签署行政命令,要求联邦各机构完成用词替换;特朗普称,新叫法可以更加贴切地反映这项飞速发展技术所具备的潜力。据 IT之家 报道,接连发生多起黑客事件之后,公众对这项技术的观感已经转差。报道称,特朗普一直不倾向于针对该技术出台新监管法规,但他也曾表态,如果确有必要,司法部将会对其加以约束。