跳到正文

#部署/工程

今日 0 条
9月29日周二
  1. MIT Technology Review · AI33

    让 AI 成为资产,而非支出

    AI从试验走向生产后,企业应根据需求稳定性和容量利用率,在按量消费与自有容量之间做出经济决策,让 AI 从支出转为可优化的生产性资产。Deloitte’s 2026 State of AI in the Enterprise显示,worker access to AI在2025年上升5%,至少40%的 AI 项目处于生产阶段的公司比例预计在六个月内翻倍。

9月28日周一
9月22日周二
  1. Latent Space77

    TypeSafe AI CEO Diogo Almeida谈Jev的System One模型与RLCD

    Latent Space采访TypeSafe AI CEO Diogo Almeida,介绍Jev作为面向软件的可编程System One模型,目标是提升每美元的智能表现。Almeida解释了RLCD与RLHF、RLVR在训练目标上的差异,强调校准、可靠性和可组合性,并说明TypeSafe更重视任务与数据而非公开基准。

    推荐理由:这场访谈从模型训练目标、校准可靠性和软件集成三个层面,解释了 Jev 与聊天型模型的设计差异。

9月21日周一
  1. Simon Willison44

    MCP 一直都是个坏主意吗?

    Simon Willison 反驳了否定 MCP 价值的观点:完整终端 AI 智能体未必需要它,但受控应用仍可受益。MCP 可简化外部服务访问控制、避免智能体直接接触 API 密钥的认证、用户连接服务的界面及审计日志;不能因编程智能体不需要它,就认定它已过时。

8月24日周一
7月30日周四
  1. Hugging Face Blog39

    GPU 管理:为什么闲置 GPU 是新的“停飞飞机”

    企业 AI 的下一项关键约束正从模型智能转向 GPU 利用率,闲置硬件持续产生成本却不带来计算产出。GPU 按日历小时承担融资、折旧、电力和冷却成本,产出则只在计算小时产生。企业自建 GPU 可把随 token 线性增长的 API 费用换成固定资本支出,但按峰值配置的集群仍可能因需求波动浪费容量。

7月7日周二
7月6日周一
6月29日周一
  1. Import AI51

    Import AI 463:ENPIRE探索机器人自我改进,ARGUS支撑10,000-GPU训练

    Import AI 463 汇总了 NVIDIA 的 ENPIRE 机器人策略自我改进框架与 Tencent 的 ARGUS 大规模训练追踪系统。ENPIRE通过环境重置、策略改进、机器人执行和演化四个模块开展闭环实验,报道中称其在部分现实灵巧操作任务上达到99%成功率;ARGUS已部署在超过10,000 GPUs的生产集群上运行六个月以上。

5月11日周一
5月8日周五
  1. Berkeley AI Research58

    Adaptive Parallel Reasoning:高效推理扩展的新范式

    Berkeley AI Research梳理Adaptive Parallel Reasoning(APR)范式,让模型在推理时自主决定是否拆分任务、并行线程数量及串并行控制。文章比较了Multiverse、ThreadWeaver、Parallel-R1等方法在KV cache处理、推理引擎改造和训练奖励上的差异,并讨论准确率、关键路径延迟与并行稳定性等开放问题。