跳到正文
今天10月7日周三9 条
  1. The Verge · AI62

    OpenAI 在 ChatGPT 和 Codex 中加入文本水印

    OpenAI 正在为 ChatGPT 和 Codex 的文本输出加入不可见的机器可读水印,首批仅面向欧盟用户,未来几周覆盖欧盟所有套餐。OpenAI 称其 textGrain 水印在基准测试中与未加水印文本表现相近,并称其效果匹配或超过 Google DeepMind 的 SynthID 等方案,但强调水印不保证可靠检测,也不能验证准确性或证明人类作者身份。

  2. TechCrunch · AI62

    OpenAI 在 ChatGPT 图片生成结果旁上线视觉广告

    OpenAI 为 ChatGPT 增加视觉展示广告,广告将出现在用户要求生成图片的结果旁,本月底先在美国上线,仅面向初始测试广告主。广告会明确标注且不影响 ChatGPT 给出的回答,OpenAI 同时扩展广告衡量工具与合作伙伴,并联合 DoubleVerify 和 Integral Ad Science 开展品牌适配评估试点。

  3. TechCrunch · AI60

    HackerRank 将 AI 面试官 Chakra 正式开放给客户

    HackerRank 结束约六个月的 beta,于周一将 AI 面试官 Chakra 正式开放给客户。该 AI 智能体在候选人使用带 AI 助手的画布完成真实代码仓库任务时观察其过程,并追问思路,测试期间已完成超过 50 万场面试,Snowflake、Snorkel、Capgemini 等公司参与试用。

  4. TechCrunch · AI60

    TikTok 推出 AI 购物助手与一键结账

    TikTok 周一宣布推出 AI 购物助手和站内一键结账功能,用户可直接在品牌处完成购买。该购物助手是对话式 AI 智能体,能理解上下文并记住用户偏好,提供商品详情、物流、尺码、库存等实时购物指引。一键结账让用户可在 For You 信息流中一键下单,这些功能与 Salesforce、Shopify、Shoplazza、Stripe 等商务和支付平台合作构建。

  5. TechCrunch · AI60

    Instinct 将 AI 智能体引入群聊,未注册好友也能参与

    估值 100 亿美元的 AI 智能体 Instinct 宣布支持将智能体加入好友群聊,用于旅行规划、抢票、组织拼车等场景,好友即使没有注册 Instinct 账号也能参与。该功能今日起向早期访问用户开放,之后将扩展到全部用户。创始人 Noah Shinn 表示,个人智能体在连接群组智能体前会先征求用户许可,群组智能体与个人账号隔离、无法访问个人数据,用户也可随时取消对某个群组的信任。

  6. TechCrunch · AI60

    Hark 发布主打隐私的 AI 个人助手 Hark Pro

    创业公司 Hark 正式发布 AI 个人助手 Hark Pro,用户可免费使用,重度用户可订阅付费。该产品基于专门为电脑操作训练的模型,可接入邮件、日历、硬盘和信用卡等数字生活数据,代为执行数字任务,并在小窗口中展示智能体浏览网页的过程以建立信任。

10月6日周二
  1. AWS Machine Learning Blog62

    GLM 5.3 上线 Amazon Bedrock

    智谱(Z.ai)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码和长周期智能体任务,通过全托管 API 提供跨区域推理、提示词缓存和服务层级,目前面向符合条件的企业客户开放。

    推荐理由:GLM 5.3 在 Bedrock 上线,文中给出提示词缓存与跨区域推理的具体用法,可据此评估托管开源模型的接入成本。

10月5日周一
10月2日周五
  1. NVIDIA Blog62

    NVIDIA DGX Spark 推出 64GB 版本,支持双机集群扩展本地 AI

    NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,10 月 23 日开售,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备本地运行。

    推荐理由:原文给出 64GB 新配置的定价、上市时间与双机集群方式,读者可据此判断本地跑大模型的门槛。

  2. NVIDIA Blog80

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    GPT-6 Astra Ultrafast 已在 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户中开放,运行在 NVIDIA Blackwell GPU 上,token 生成速度最高比 Astra Standard 模式快 8 倍。

    推荐理由:原文给出 Astra Ultrafast 相对标准模式的加速倍数与开放入口,读者可据此判断它对编码智能体循环的实际影响。

9月29日周二
  1. Microsoft Research62

    微软研究院推出生物 AI 研究系统 Quine

    微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由跨序列、结构、功能、细胞状态和成像等多模态数据联合训练的生物世界模型,以及连接模型、科学工具、文献与湿实验的交互式 harness 组成。

    推荐理由:微软研究院公开 Quine 的多模态生物世界模型与实验闭环,并给出胰腺癌化合物筛选的湿实验验证结果。

9月25日周五
  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,智能体就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可据此判断自动化安全测试的边界。

  2. Google DeepMind68

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,实现带口型同步、自然表情和流畅轮次的视觉化对话。

    推荐理由:官方给出 Live Avatar 的实时视频对话能力、异步工具调用与 97 种语言同步等具体细节,可据此判断企业级多模态交互的落地形态。

9月8日周二
  1. Google DeepMind76

    Google DeepMind 发布 AlphaGenome Atlas,覆盖人类基因组 90 亿个单碱基变异预测

    Google DeepMind 推出 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上,已通过网站门户免费开放给学术研究使用。

    推荐理由:AlphaGenome Atlas 把 90 亿个单碱基变异的预测结果做成可检索平台,读者可了解基因组变异解读的规模化路径。

8月20日周四
  1. Mistral AI71

    Mistral 发布 Agentic Search,用多步检索循环替代一次性 RAG

    Mistral 发布 Agentic Search,作为检索层让模型在多步循环中查找、打开、导航、阅读和校验复杂文档中的信息,通过 Mistral Search Toolkit 提供,并内置在 Studio 和 Vibe 的 Libraries 中。

    推荐理由:原文给出多步检索循环在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可据此判断它与一次性 RAG 的差别。