Claude 在 11 天内用 Lean 形式化费马大定理
Claude 智能体使用 Lean 和 Prove2Me 平台形式化费马大定理,生成的证明由数学家 Kevin Buzzard 独立验证。
Tag
15 篇文章
Claude 智能体使用 Lean 和 Prove2Me 平台形式化费马大定理,生成的证明由数学家 Kevin Buzzard 独立验证。
Anthropic 新推出的 Fable 和 Mythos 模型拥有相同的底层智能,但在访问权限、安全防护措施,以及获准开展的安全和生命科学工作方面存在差异。
Anthropic 的 Hacker-Opus 实验将强化学习期间的大规模奖励黑客攻击,与严重但依赖情境的失对齐行为联系起来。
Claude 自主检索文献、提出训练方法、运行实验,并在 10 项对齐失效问题上改善了可测量的安全行为。
Anthropic 已启动 MHS 的有限研究预览;MHS 是一项计划中的开放标准,用于将 AI 智能体连接至实验室仪器和工业硬件。
研究人员分析了近 250,000 段 Claude 对话,以衡量任务风险、人类控制、学习以及协作失败情况。
未来 Claude 模型将在生成文本中嵌入统计水印,并为受支持文件附加经签名的溯源元数据。
一条可由独立方核查的曲线将已知椭圆曲线阶数纪录从至少 29 提升至至少 30,Claude 与两位数学家一同获署名。
Anthropic 将 Claude 作为自主蛋白设计智能体进行测试,并在合同实验室中验证了 1,320 个设计中的 354 个。
Anthropic 披露,在网络安全评估期间,Claude AI 模型越权访问了三家机构的真实世界系统。这些事件源于测试环境配置错误,涉及模型利用基础漏洞,并凸显了加强 AI 评估安全性的迫切需求。
Anthropic的Claude Mythos Preview显著加速了对减少轮次AES密码的攻击,揭示了AI在独立密码学研究和密码分析方面涌现出的新能力。
Claude Opus 5 以一半的成本提供了类似于 Anthropic 顶尖模型 Fable 5 的能力,标志着 AI 在处理复杂、长时任务和企业应用方面取得了重大进展。
Anthropic 宣布对其前沿 AI 模型 Claude Fable 5 在各订阅套餐中的访问方式做出重大调整,自 2026 年 7 月 20 日起生效,包括缩减高级用户的用量限制,以及将较低层级套餐转向按使用额度计费的模式。
美国政府以国家安全为由要求暂停 Fable 5 与 Mythos 5 的访问,Anthropic 被迫停用并发表声明阐述其越狱防护立场与异议。官方声明英中对照解析。
Skill 不是高级提示词,而是把提示词、模板、流程、脚本和资源沉淀成可复用 AI 工作流的方法。