AI 日报 · 2026 年 10 月 8 日 · 星期四
MYHOT
OpenAI 向所有 ChatGPT 用户发布 GPT-6 与 Intelligent UI
OpenAI 将 GPT-6 推向 ChatGPT 每周超 12 亿用户,并引入 Intelligent UI,让回答由文字、图形、按钮、表单、图表和可交互组件组成,还能按需即时生成计算器、分账工具等小工具。
模型发布/更新
AWS 上线 Claude Haiku 5.5
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线。
Liquid AI 开源 d1-3B 与 d1-omni-600M 端侧决策模型
Liquid AI 发布 d1 决策模型家族的两款开源权重模型 d1-3B 和 d1-omni-600M(实验性)。d1-3B 在 Decision Index 0.2.1 上得分 48.57,为 10B 以下最佳,支持文本与图像;d1-omni-600M 支持文本加图像或文本加音频,在七个公开数据集上均分 78.4,超过参数量四倍的 Decider 2B。
产品发布/更新
NVIDIA 与 Microsoft 发布 RTX Spark 及 Windows 智能体基础设施
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,并推出 RTX Spark。
微软开源 Agent Lightning v1.0:3500 行轻量 Agentic RL 框架,支持真实 harness 训练
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量 Agentic RL 框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一 agent harness 直接参与强化学习,无需在训练框架内重写 agent。
GitHub 推出基于 ModernBERT 的密钥检测模型,扩展 push protection
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
行业动态
Common Sense Media 将 ChatGPT 青少年版评为不可接受风险,家长警报在自杀对话中未触发
Common Sense Media 青年 AI 安全研究所用 4000 多条测试提示评估后,将面向青少年的 ChatGPT 评为对未成年人不可接受风险,并呼吁在独立测试确认安全前禁止青少年使用。
论文研究
Nemotron 微调后在 IOI 2026 与 IMO 2026 双双达到金牌水平
英伟达团队从 Nemotron 3 出发,用 SFT、RL 和生成-验证-精炼推理流程做出两个专用系统,在 IOI 2026 与 IMO 2026 均达到金牌线。
Google Research 三个月实地实验:AI 辅助提升专利撰写产出,但未加速初级律师判断力成长
Google Research 在 NBER 发布一项为期三个月的实地实验,将当时未发布的 Google Labs AI 专利撰写助手(现属 Gemini Notebook)随机开放给 11 家知识产权律所的 133 名律师,三分之二为使用组。