Import AI 473:美国超级智能战略、人鼠嵌合脑与机器诠释学
Import AI 473 汇总了 RAND 关于美国超级智能战略的报告、AI 进展节奏研究,以及人类脑组织移植入小鼠的实验。文章还介绍了 Hugging Face 上未审查模型的分布、Toby Ord 对递归自我改进和智能爆炸动力学的分析,并以机器诠释学的科幻短篇收尾。
Import AI 473 汇总了 RAND 关于美国超级智能战略的报告、AI 进展节奏研究,以及人类脑组织移植入小鼠的实验。文章还介绍了 Hugging Face 上未审查模型的分布、Toby Ord 对递归自我改进和智能爆炸动力学的分析,并以机器诠释学的科幻短篇收尾。
Import AI 470 聚焦不给机器赋予权利、SPADE 自动生成训练环境,以及 Hawkeye 改进 GPU 内核。SPADE 通过自博弈协同优化环境生成与智能体能力,在 30B-A3B 规模下,游戏环境评测均分达 58.3,比基础模型高 8.1,比最强固定环境基线高 5.3。
IFP 提出涵盖 7 类的 23 项政策建议,以应对进一步自动化 AI 研发的风险,包括提高透明度、发展验证技术及增强社会韧性。Intology 的 Locus 搭配 Opus 5 在 PostTrainBench 上取得 44.7%,并在放宽算力限制的 PostTrainBench+ 中使用超过 4000 小时的 H100 GPU 算力取得 51.6%,超过人类基线。
研究人员构建了自维持、自复制的 AI 蠕虫原型,利用受感染机器的 GPU 运行开放权重 LLM,完整攻击成功率约为 ~37%。约 ~1337 名 AI 从业者联署,请求美国政府支持国际合作,开发主动调节自动化 AI 发展节奏的技术与治理工具。
Import AI 461 介绍 Sequent 的对齐研究计划,并梳理 FrontierCode 代码基准与 AARRI-Bench 科研助手基准。FrontierCode 的 Diamond 部分中,Claude Opus 4.8 得分 13.4%,GPT-5.5 得分 6.3%。
Berkeley AI Research 介绍了 GRASP,一种通过虚拟状态并行优化、状态噪声探索和梯度重塑来改进世界模型长时域规划的方法。GRASP 保留动作梯度,避开脆弱的状态梯度,并通过周期性同步回到真实轨迹优化。