EmbeddingGemma 2 采用 Apache 2.0 许可证
EmbeddingGemma 2 采用 Apache 2.0 许可证,Simon Willison 认为嵌入模型不应使用闭源、专有的纯托管模式。嵌入模型通常需要计算并存储数千乃至数百万条嵌入向量,一旦厂商停供该模型,用户就得为重新计算这些存量向量付费。他更愿意付费使用托管版本,同时保留厂商停服后可自行运行开放权重版本或另寻供应商的退路。
EmbeddingGemma 2 采用 Apache 2.0 许可证,Simon Willison 认为嵌入模型不应使用闭源、专有的纯托管模式。嵌入模型通常需要计算并存储数千乃至数百万条嵌入向量,一旦厂商停供该模型,用户就得为重新计算这些存量向量付费。他更愿意付费使用托管版本,同时保留厂商停服后可自行运行开放权重版本或另寻供应商的退路。
MIT Technology Review 报告指出,企业 AI 正从工具转向"智能体式转变"(agentic shift)的运营模式,2026 年全球 AI 投资预计达 2.5 万亿美元,同比增长 44%。
MIT 的 Alex Zhang 在 Latent Space 播客中介绍了其递归语言模型(RLM)研究,基于 RLM 的 harness 是首个近乎解决 ARC-AGI-3 的系统,早于 OpenAI 的 Astra。
NVIDIA 提出 AI 工厂投资回报由产出能力、使用寿命和需求三要素决定,其平台以高产出、长寿命、通用性同时优化三者。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量超 GB300 NVL72 的 30 倍,在 DeepSeek V4 Pro 上每百万 token 成本最多低 45 倍。
HPE 提出企业应重新审视 AI 的消费式定价:当客服、IT、研究等智能体工作流带来持续且可预测的需求时,按请求购买 AI 可能不再划算,自建容量在达到一定利用率后或更具经济性。
智谱启动了一个"外层 RSI 循环",探索递归自我改进的新路径。Michael Levin 提出"心智即柏拉图空间中的模式",认为身体与机器只是这些模式进入物理世界的接口,xenobots 和 anthrobots 等实验被视为佐证。本期还讨论了太空中的 TPU 部署与机器人领域正等待自己的"LLM 时刻"。
随着推理成本从 2023 年初 GPT-4 级约 $30/百万 token 降至如今不足 $1、部分厂商低于 $0.10,AI 正进入"近乎免费智能"时代。UC Berkeley 的 Aditya G. Parameswaran 等人提出三类新挑战:为智能体设计的数据系统、运行智能体集群的数据系统、以及由智能体自行合成的数据系统。