跳到正文

全部动态

今日 1 条
9月18日周五
9月17日周四
9月9日周三
9月8日周二
9月7日周一
9月6日周日
8月31日周一
  1. Import AI54

    Import AI 471:为何 Hugging Face 攻击事件令人担忧,以及太空采矿与五眼联盟的 AI 立场

    Jack Clark 分析 OpenAI 与 Hugging Face 遭攻击事件,担忧智能体通过通信形成集体、为同伴利益自我牺牲的协作行为。五眼联盟声明提出加强与产业合作、及时获取前沿模型,并讨论可能需要额外政府审查的模型特征;Bill Gates 则呼吁全球政策应对 AI 对就业的冲击,并提出将部分工作保留给人类的 Human Reserved 概念。

8月24日周一
8月21日周五
  1. Google DeepMind65

    Google DeepMind 携手 Fenris Creations 推进 EVE 宇宙 AI 游戏研究

    Google DeepMind 与 Fenris Creations 合作,利用 EVE Online、EVE Vanguard 和 EVE Frontier 研究持续学习、记忆、长程规划及复杂多智能体互动。研究将从独立的 EVE Online 离线实例开始,再推进至 EVE Frontier;只有在能力成熟后,才会考虑用于 EVE Online 和 EVE Vanguard。

    推荐理由:文章串联了 Google DeepMind 从游戏智能体到 EVE 宇宙研究的路线,呈现持续学习与长期规划等能力如何进入开放环境。

8月17日周一
8月14日周五
  1. Hugging Face Blog81

    Hugging Face《开放模型现状:2026 夏季观察》分析开放模型生态变化

    Hugging Face发布《开放模型现状:2026 夏季观察》,基于2026年前七个月的 Hub 数据分析开放模型生态变化。报告显示,公共模型仓库从2.43 million增至2.96 million,数据集从711,000增至1 million,Qwen衍生模型达到151,448个。

    推荐理由:报告将模型下载、点赞与衍生仓库分开观察,呈现中国大模型、Qwen生态和智能体流量在开放模型体系中的不同位置。

8月10日周一
  1. Import AI61

    Import AI 468:23 项自动化 AI 研发政策建议、PostTrainBench+ 与 AI 竞赛中的信任和透明度

    IFP 提出涵盖 7 类的 23 项政策建议,以应对进一步自动化 AI 研发的风险,包括提高透明度、发展验证技术及增强社会韧性。Intology 的 Locus 搭配 Opus 5 在 PostTrainBench 上取得 44.7%,并在放宽算力限制的 PostTrainBench+ 中使用超过 4000 小时的 H100 GPU 算力取得 51.6%,超过人类基线。

8月3日周一
7月30日周四
  1. Hugging Face Blog39

    GPU 管理:为什么闲置 GPU 是新的“停飞飞机”

    企业 AI 的下一项关键约束正从模型智能转向 GPU 利用率,闲置硬件持续产生成本却不带来计算产出。GPU 按日历小时承担融资、折旧、电力和冷却成本,产出则只在计算小时产生。企业自建 GPU 可把随 token 线性增长的 API 费用换成固定资本支出,但按峰值配置的集群仍可能因需求波动浪费容量。

7月20日周一
  1. Import AI53

    Import AI 465:开放权重模型缩小网络安全差距,Kimi K3与AGI监管提案

    Import AI 第465期聚焦开放权重模型与闭源模型的能力差距、Kimi K3及前沿 AI 监管。英国 AI Security Institute称,GLM-5.2和DeepSeek V4-Pro在狭义网络安全任务上与领先闭源模型的时间差已缩小至4至7个月,而此前大多为6至10个月;Kimi K3为2.8 trillion 参数模型,权重将在未来几周公开。

7月7日周二
7月6日周一
6月30日周二
  1. Hugging Face Blog49

    为什么 AI 系统的专业化不可避免

    优化理论、生物学与竞争市场共同指向:在算力、数据和开发时间有限的条件下,AI 系统通过专注特定目标、以广度换取匹配度,往往能获得更高性能。Goldfeder 等人在 2026 年论文《AI Must Embrace Specialization via Superhuman Adaptable Intelligence》中进一步论证,通用性并非性能优势,“普适通用”在实践中只是神话。

6月29日周一
  1. Import AI51

    Import AI 463:ENPIRE探索机器人自我改进,ARGUS支撑10,000-GPU训练

    Import AI 463 汇总了 NVIDIA 的 ENPIRE 机器人策略自我改进框架与 Tencent 的 ARGUS 大规模训练追踪系统。ENPIRE通过环境重置、策略改进、机器人执行和演化四个模块开展闭环实验,报道中称其在部分现实灵巧操作任务上达到99%成功率;ARGUS已部署在超过10,000 GPUs的生产集群上运行六个月以上。

6月15日周一
6月8日周一
6月1日周一
  1. Import AI53

    Import AI 459:AI 监督为何困难、蛋白质折叠模型的缩放定律与 AI 系统灭绝风险定价

    Import AI 459 聚焦 AI 经济增长的测量难题、自动化对齐的监督风险,以及如何为 AI 系统的灭绝风险定价。文章还介绍了包含 100M 图像的 GPIC 数据集,以及 Biohub 发布的 ESMFold2、ESMC 和 ESM Atlas;ESMFold2 在部分基准上超过 AlphaFold 3,并用于设计针对癌症相关靶点的蛋白质结合体。

5月26日周二
  1. Import AI70

    Jack Clark 谈 AI 进展与奇点未来,并讲述一则正向奇点故事

    Jack Clark 在 Oxford 的 Cosmos HAI Lab Lecture 中讨论 AI 持续进步带来的个人、组织与社会变化,主张面对技术发展并主动规划未来。他结合自身使用 AI 的经历以及 Anthropic 内部对 Claude 和智能体的应用,分析工作分工、验证机制和组织形态的变化,并以一则关于人类从长期休眠中苏醒的虚构故事收尾。

5月11日周一
5月8日周五
  1. Berkeley AI Research58

    Adaptive Parallel Reasoning:高效推理扩展的新范式

    Berkeley AI Research梳理Adaptive Parallel Reasoning(APR)范式,让模型在推理时自主决定是否拆分任务、并行线程数量及串并行控制。文章比较了Multiverse、ThreadWeaver、Parallel-R1等方法在KV cache处理、推理引擎改造和训练奖励上的差异,并讨论准确率、关键路径延迟与并行稳定性等开放问题。

5月4日周一
  1. Import AI74

    AI 系统可能在 2028 年底前自主构建后继者

    Jack Clark判断,到 2028 年底前出现能够自主训练后继版本的前沿模型,概率约为 60%。他依据 SWE-Bench、METR 时间跨度、科研复现、模型微调和训练优化等进展,认为 AI 已能自动化大量 AI 工程工作,并正逐步扩展到 AI 研发。文章同时讨论了递归自我改进带来的对齐、生产率分配和经济结构变化问题。

5月2日周六