Anthropic 扩大 Cyber Verification Program,向更多安全团队开放 Claude 并放宽安全限制
Anthropic 将 Cyber Verification Program 开放给更广泛的安全从业者,通过审核的组织和个人研究者可访问 Claude 最强模型,并在漏洞研究、恶意软件分析、事件响应和渗透测试中减少安全过滤。
Anthropic 将 Cyber Verification Program 开放给更广泛的安全从业者,通过审核的组织和个人研究者可访问 Claude 最强模型,并在漏洞研究、恶意软件分析、事件响应和渗透测试中减少安全过滤。
OpenAI 从内部前沿模型发布了一批数学成果,公开在 GitHub 仓库中,包含 722 篇论文、分为 372 个相关结果族,来自约 4000 个研究问题的评测,平均每个结果约用 3 小时 ChatGPT Pro 思考算力,模型本身尚未发布。
推荐理由:OpenAI 用内部模型批量产出数学结果,读者可据此了解其规模、算力成本与学界对验证的保留意见。
据《金融时报》报道,保险公司正为失控 AI 智能体带来的数百万美元理赔做准备,Sam Altman(OpenAI)和 Dario Amodei(Anthropic)等高管的个人责任也被纳入考量。
Anthropic 在 SF Tech Week 上宣布扩展 Claude for Startups 计划,为符合条件的初创公司提供免费一年的 Claude Team(最多五个高级席位)和 1000 美元 API 额度,并开放 Claude Marketplace 插件构建权限及 Applied AI 团队虚拟办公时间。申请条件为成立五年内或近两年获得融资的公司。
过去一年,OpenAI、Anthropic 等实验室宣布在多个长期数学难题上取得突破,部分结果超出研究者对现有系统能力的预期,其中包括解决一个著名的千禧年大奖难题。但这些进展也引发学界反弹,AI 实验室表示正在从早前的失误中吸取教训,相关承诺能否兑现尚待观察。
Latent Space 的 AINews 汇总了 10 月 1 日至 2 日的 AI 动态:OpenAI 发布 GPT-6.1 Sol,定价为每百万输入/输出 token 2 美元/10 美元,据称在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分,在 AutomationBench 上比 Opus 5.5 高 2.2 分。