Hugging Face Storage 与 SkyPilot 集成 hf:// 存储,支持跨云运行 AI 工作负载
Hugging Face Storage 为 SkyPilot 新增 store: hf 后端,支持用 hf:// URL 将 Bucket 或 Hub 仓库挂载到任务中。
推荐理由:这项集成把模型和数据存储与 GPU 调度解耦,展示了跨云读取不收取 egress 费用及 Xet 增量去重的实际用法。
Hugging Face Storage 为 SkyPilot 新增 store: hf 后端,支持用 hf:// URL 将 Bucket 或 Hub 仓库挂载到任务中。
推荐理由:这项集成把模型和数据存储与 GPU 调度解耦,展示了跨云读取不收取 egress 费用及 Xet 增量去重的实际用法。
PRX 团队介绍了其图像生成模型的预训练数据流程:混合公共与内部数据集,使用 VLM 为图像生成长描述,并以 Lance 构建和探索数据、以 Mosaic Data Shards(MDS)供训练流式读取。团队在数亿级数据上采用 JPEG quality 92、分辨率与宽高比分桶、基于 caption 的过滤和感知哈希去重,并选择 Qwen3-VL-8B 作为 captioner。
推荐理由:文章把 PRX 的大规模图像训练数据流程拆成可复用环节,覆盖数据探索、VLM 重标注、格式转换、过滤去重及工程取舍。
Hugging Face 对 Kernels 项目进行了大幅重构,新增 Hub 的 kernel 仓库类型,并默认限制为可信发布者加载 kernel。项目加入代码签名支持,重构 kernels 与 kernel-builder CLI,还扩展了 Torch Stable ABI 和 Apache TVM FFI 支持。
推荐理由:文章集中说明 Kernels 在安全机制、框架兼容和智能体开发流程上的改动,便于开发者判断其对自定义 kernel 构建与分发的实际帮助。
Hugging Face 与 Cerebras 展示了将 Gemma 4 31B 用于实时语音到语音系统的方案。该开放管线依次使用 Nvidia 的 Parakeet 进行语音识别、在 Cerebras 上运行 Gemma 4 VLM 推理,并通过 Qwen3TTS 生成语音。相关架构已用于 Reachy Mini 机器人,配套代码仓库为 huggingface/speech-to-speech。
推荐理由:文章拆解了实时语音到语音管线的模块构成与协作方式,开发者可据此了解低延迟架构的实现路径和代码入口。
ScarfBench 是一个用于评估 AI 智能体执行企业 Java 跨框架迁移的开放基准,覆盖 Spring、Jakarta EE 和 Quarkus。基准包含 34 个应用、204 个迁移任务和约 151K 行代码,要求应用完成构建、部署并通过行为验证;当前最强智能体的行为成功率仍低于 10%。
推荐理由:ScarfBench把企业 Java 框架迁移拆成构建、部署和行为验证,揭示编码智能体在可编译代码之外仍受配置与运行环境依赖影响。
Google Research 发布 TabFM,这一面向表格数据分类和回归的基础模型可通过单次前向传播生成预测,无需手动训练、超参数调优或复杂特征工程。TabFM 采用交替行列注意力、行压缩和 Transformer,并基于数亿个合成数据集训练。
推荐理由:文章解释了 TabFM 如何用交替行列注意力、行压缩和合成数据训练,将表格分类与回归转为零样本推理,并给出 BigQuery 使用入口。
Hugging Face 宣布 Every Eval Ever(EEE)与 Community Evals 实现互通,评测结果可同步显示在模型页面和基准排行榜,并链接回完整的 EEE JSON 记录。
推荐理由:文章说明 EEE 与 Community Evals 如何互通,既把评测分数带到模型页面,也保留生成配置和复现记录等来源信息。
Mistral AI 发布 Mistral Medium 3.5 public preview,这是一款 128B dense open-weight 模型,成为 Mistral Vibe 和 Le Chat 的默认模型。
推荐理由:文章同时交代模型规格、编码基准与部署方式,并说明它如何支撑云端并行编码和多步骤工作流。