跳到正文

Hugging Face

Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表。

最新精选

第 21–32 条 · 共 32 条
7月23日周四
7月21日周二
  1. Hugging Face Blog77

    Grabette 开放式机器人操作数据采集系统发布

    Hugging Face 发布 Grabette,这是一套低成本、开源的手持式机器人操作数据采集系统,可将人手示范自动处理为机器人可用的数据集。Grabette 配备双摄像头、IMU 和夹爪,BOM 成本约为 490€,数据可通过浏览器处理为 LeRobot 格式并上传 Hugging Face Hub。

    推荐理由:文章清晰展示了如何用低成本手持设备采集操作示范,并通过浏览器处理为可训练的机器人数据集。

7月16日周四
  1. Hugging Face Blog84

    Hugging Face披露2026年7月安全事件:自主AI智能体驱动入侵

    Hugging Face披露其生产基础设施遭到由自主AI智能体系统驱动的入侵,攻击者通过数据集处理中的代码执行路径取得访问权限并横向移动。公司表示未发现公开模型、数据集、Spaces或软件供应链遭篡改,但仍在评估合作伙伴和客户数据是否受影响。Hugging Face使用自有基础设施上的 zai-org/GLM-5.2 分析超过17,000条攻击事件,并建议安全团队提前准备可本地运行的模型。

    推荐理由:Hugging Face披露了从数据处理管线入侵到凭据轮换的完整处置过程,也说明了本地部署模型在安全取证中的实际作用。

7月15日周三
7月10日周五
  1. Hugging Face Blog73

    PyTorch 性能分析(第 3 部分):用 profiler 分析 Attention

    Hugging Face Blog 通过 profiler 分析 PyTorch 中的朴素 Attention、原地掩码操作和 SDPA 各后端,展示不同实现的 kernel 与 CPU、GPU 开销。

    推荐理由:文章通过逐层对比 profiler trace,解释 Attention 的 kernel、显存流量与 CPU 开销如何变化,为定位 GPU 性能瓶颈提供可复用的阅读方法。

7月8日周三
  1. Hugging Face Blog79

    Hugging Face transformers 建模后端实现 vLLM 原生推理速度

    Hugging Face 宣布 transformers 建模后端在 vLLM 中已能为多种 LLM 架构达到或超过自定义 vLLM 实现的吞吐速度。该后端在 Qwen3-4B、Qwen3-32B 和 Qwen3-235B-A22B-FP8 三种部署配置中均达到或超过原生实现速度,并可通过 `--model-impl transformers` 启用。

    推荐理由:文章通过 Qwen3 的 4B、32B 和 235B FP8 MoE 对比,说明该后端如何减少模型接入 vLLM 时的重复优化工作。

7月7日周二
  1. Hugging Face Blog80

    Hugging Face 发布 LeRobot v0.6.0,完善机器人学习闭环

    Hugging Face 发布 LeRobot v0.6.0,新增世界模型策略、奖励模型、六个仿真基准和 lerobot-rollout 部署 CLI。数据集支持深度、VLM 自动语言标注和自定义视频编码,数据加载最高提速约 2x;训练新增 FSDP 与 HF Jobs 云训练。

    推荐理由:LeRobot v0.6.0 将世界模型策略、奖励模型、统一评测和部署采集串成闭环,并补充数据处理与云训练能力,便于理解机器人学习工作流的变化。

7月6日周一
  1. Hugging Face Blog71

    Hugging Face Kernels 项目迎来重大更新

    Hugging Face 对 Kernels 项目进行了大幅重构,新增 Hub 的 kernel 仓库类型,并默认限制为可信发布者加载 kernel。项目加入代码签名支持,重构 kernels 与 kernel-builder CLI,还扩展了 Torch Stable ABI 和 Apache TVM FFI 支持。

    推荐理由:文章集中说明 Kernels 在安全机制、框架兼容和智能体开发流程上的改动,便于开发者判断其对自定义 kernel 构建与分发的实际帮助。

7月1日周三
  1. Hugging Face Blog69

    Hugging Face 与 Cerebras 将 Gemma 4 用于实时语音 AI

    Hugging Face 与 Cerebras 展示了将 Gemma 4 31B 用于实时语音到语音系统的方案。该开放管线依次使用 Nvidia 的 Parakeet 进行语音识别、在 Cerebras 上运行 Gemma 4 VLM 推理,并通过 Qwen3TTS 生成语音。相关架构已用于 Reachy Mini 机器人,配套代码仓库为 huggingface/speech-to-speech。

    推荐理由:文章拆解了实时语音到语音管线的模块构成与协作方式,开发者可据此了解低延迟架构的实现路径和代码入口。

6月30日周二