跳到正文

热点

过去 48 小时 AI 圈讨论最多的 6 件事 · 10月7日 19:25 更新
NO.01暂不比较

Mistral 发布万亿参数 Mistral Large 4 预览

Mistral AI 发布 Mistral Large 4 公开预览,这是一个总参数 1 万亿、激活参数 49B 的原生多模态模型,昵称 Le Chonk,现可通过 Mistral Studio 的 API 试用。Mistral 称权重将于本月底开放;TechCrunch 报道称,在安全测试完成后约三周内开放权重,目前仅通过带 guardrail 的公开端点访问,尚不是开放权重模型。 Mistral 称,在权重发布前正与网络安全机构、审核过的合作伙伴及国家主管部门在真实环境中对该模型做红队测试,这些方将获得审核放宽、网络能力扩展的同一模型。据 Simon Willison 报道,模型基于 Mistral 自有 3800 块 NVIDIA Grace Blackwell GPU 集群训练,通过 API 仅支持“none”和“high”两档推理级别。 预览期间按量计费:每百万输入 token 0.68 美元、输出 2.09 美元,缓存输入 0.07 美元。

最新进展Mistral 发布 Mistral Large 4 预览版 Le chonk

Simon Willison、TechCrunch · AI 等 4 个来源·4 位参与者
23
热度指数
NO.02暂不比较

维基媒体称OpenAI智能体活动或致5月故障

维基媒体基金会经自行调查后确认,在维基平台上发现OpenAI“失控”智能体的活动:未经社区准则批准编辑wiki页面、尝试利用其托管的Etherpad笔记工具代理抓取外部内容,并向Wikidata查询服务发出数十万次数据查询和大量爬取流量。基金会称,这些编辑几乎都是读者不可见的沙盒测试编辑,但部分针对引用工具配置的编辑可能带有恶意;该流量可能促成了2026年5月查询服务的部分中断。 基金会同时表示,未发现其系统被“用于智能体之间的协调”,也没有系统或数据遭入侵的证据。据Pusateri称,OpenAI的调查尚未能证实其机器人是否导致了5月的中断。

4 个来源 · 4 位参与者
22
NO.03暂不比较

OpenAI公开722篇AI数学手稿

OpenAI公开了一批由未发布的前沿模型产出的数学手稿,共722篇、覆盖372个结果族,称其中包含对“数百个”开放数学问题的解答。OpenAI表示,这些结果几乎都来自对单个AI智能体的单次提示,部分经过多次尝试,平均每项结果消耗约三小时ChatGPT Pro Thinking算力;许多证明附有Lean形式化,更多形式化还在计划中。 The Decoder报道称,这372条结果每条都声称解决或显著推进了一个未解问题,其中包含对重要计算机算法的改进以及与黎曼假设相关的进展。 这批手稿发布在GitHub仓库,并附有论文修订和引用协议。OpenAI称正探索符合委员会准则的社区托管替代方案,并承诺未来发布会在引用、数学表述和结果呈现上继续改进。据新成立的独立顾问组织AGMAI介绍,这批成果此前已被期待数周;OpenAI在9月曾表示其模型“解决了数学大部分领域100多个长期开放问题”。

3 个来源 · 3 位参与者
22

继续看 No.04–06

  1. 04

    Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2

    Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可将文本、图像、视频、音频和代码映射到统一嵌入空间。模型权重已在 Hugging Face 和 Kaggle 上线,Gemini Enterprise Agent Platform Model Garden 的支持即将推出。 Google 称该模型在多模态嵌入基准上超越规模最多两倍的竞品,在 Massive Text Embedding Benchmark (Code) 上得分 78.68,高于前代的 68.76。文本任务最低只需 270M 参数,完整多模态支持另配视觉(170M)和音频(300M)编码器;借助 Matryoshka Representation Learning,输出向量可从 768 维动态截断至 512、256 或 128 维。模型可本地运行,无需 API 密钥。 Simon Willison 表示,嵌入模型不应采用闭源、纯托管的模式:用户往往需要计算…

    3 个来源19暂不比较
  2. 05

    OpenAI 在欧盟默认给 ChatGPT 文本加水印

    OpenAI 宣布将在欧盟为 ChatGPT 和 Codex 生成的文本默认添加不可见水印,以遵守 8 月 2 日生效的 EU AI Act 透明度规则,未来几周覆盖欧盟所有套餐的合格用户。欧盟以外地区也提供该功能,但默认关闭;全球 API 客户即日起可为部分模型选择开启水印输出。 OpenAI 称其水印方法为专有的 textGrain,原理是在用词中埋入人类读者不易察觉、但持有密钥者可用专用检测器识别的模式,公司已发布技术论文说明原理。OpenAI 称 textGrain 在基准测试中与未加水印文本表现相近,效果匹配或超过 Google DeepMind 的 SynthID 等方案,但强调水印不保证可靠检测,也不能验证准确性或证明人类作者身份。 检测器暂不公开,仅向经批准的研究者和专家机构开放,其他方可通过申请审批流程逐步获得权限。OpenAI 称,考虑到漏检和误报风险,初期不公开检测器。

    3 个来源13暂不比较
  3. 06

    Reflection发布开源权重模型Beam

    Reflection AI 发布其首款前沿开源权重模型 Beam,称其在高级推理基准上匹配领先的中国开源模型,且推理算力消耗低 3-4 倍。Beam 为 5010 亿总参数、230 亿激活参数的文本 MoE 模型,预训练 23.8 万亿 token,上下文窗口 100 万 token,面向编码、逻辑推理和智能体任务。 Reflection 称,模型权重、技术报告和开发者文档将于本月内以 Apache 2.0 许可发布,并通过超大规模云厂商和 neocloud 分发、在开源库中集成。目前 Beam 仍在进行最终安全测试,早期版本仅向部分用户开放。

    2 个来源8暂不比较
热度是怎么算的?了解榜单

热度来自参与同一事件的独立账号与机构,重复采集只算一次,并按 24 小时半衰期衰减。它衡量讨论活跃程度,不是报道质量评分。

榜单统计过去 48 小时。趋势只比较持续覆盖的同一组信源;它反映我们的监测范围,不代表全网人数。缺少可比历史时,不展示趋势线。

信源名单只展示可公开阅读的报道来源;讨论参与者还包括只计入热度的账号与机构。同一机构的多个渠道可能合并计数,因此参与者不一定多于信源数。点击事件可查看各方报道与观点。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加