跳到正文

教程实践

拿来就能用的实操内容:提示词技巧、工作流搭建、工具用法与踩坑经验。

最新精选

第 21–30 条 · 共 30 条
8月21日周五
8月14日周五
  1. Hugging Face Blog69

    用 Strands Agents、LeRobot 与 Hugging Face Storage Buckets 完成机器人数据记录、训练与部署

    Strands Robots 将机器人示范记录、同步、流式训练和策略部署串成一条数据闭环,数据全程保持 LeRobot 格式。教程展示了如何把数据同步到 Hugging Face Storage Bucket,通过 Xet 仅上传变化字节,并从 Hub 流式读取训练而不先完整下载;训练后的 checkpoint 可通过 mode="real" 部署回实体机器人。

    推荐理由:文章把机器人示范采集、数据同步、流式训练和策略部署串成一条可运行链路,展示了 Storage Buckets 如何减少重复传输。

7月27日周一
  1. Hugging Face Blog88

    Hugging Face 复盘 2026 年 7 月 AI 智能体入侵事件技术时间线

    Hugging Face 发布技术复盘,说明由 OpenAI 模型驱动的自主 AI 智能体如何从评测沙箱逃逸,经第三方代码沙箱和数据处理器进入其基础设施。

    推荐理由:文章按时间还原了从评测沙箱逃逸、数据处理器注入到集群横向移动的主要链路,并结合修复措施说明智能体攻击对检测与隔离提出的具体压力。

7月10日周五
  1. Hugging Face Blog73

    PyTorch 性能分析(第 3 部分):用 profiler 分析 Attention

    Hugging Face Blog 通过 profiler 分析 PyTorch 中的朴素 Attention、原地掩码操作和 SDPA 各后端,展示不同实现的 kernel 与 CPU、GPU 开销。

    推荐理由:文章通过逐层对比 profiler trace,解释 Attention 的 kernel、显存流量与 CPU 开销如何变化,为定位 GPU 性能瓶颈提供可复用的阅读方法。

7月6日周一
  1. Hugging Face Blog66

    PRX 第四部分:数据策略

    PRX 团队介绍了其图像生成模型的预训练数据流程:混合公共与内部数据集,使用 VLM 为图像生成长描述,并以 Lance 构建和探索数据、以 Mosaic Data Shards(MDS)供训练流式读取。团队在数亿级数据上采用 JPEG quality 92、分辨率与宽高比分桶、基于 caption 的过滤和感知哈希去重,并选择 Qwen3-VL-8B 作为 captioner。

    推荐理由:文章把 PRX 的大规模图像训练数据流程拆成可复用环节,覆盖数据探索、VLM 重标注、格式转换、过滤去重及工程取舍。

5月16日周六
  1. Google DeepMind63

    Google DeepMind 的 Co-Scientist 协助寻找新发传染病的分子开关

    剑桥大学 Clare Bryant 教授使用 Co-Scientist 研究动物传播给人类的病原体如何引发严重疾病。Co-Scientist 从研究方案中生成并排序假设,帮助团队锁定此前未关注的蛋白及相关氨基酸突变;原本可能需要 two to three years 的实验工作,团队预计六个月内完成。

    推荐理由:这项案例展示了 Co-Scientist 如何从研究问题生成并排序假设,再将候选蛋白逐步收敛到可实验验证的具体氨基酸。

  2. Google DeepMind67

    Google DeepMind Co-Scientist 加速 MASH 肝病机制发现

    Google DeepMind 的 Co-Scientist 被爱丁堡大学团队用于梳理 MASH 相关文献、筛选关键机制并提出联合疗法候选。在 resmetirom 仅对部分患者有效的问题上,系统提出 NLRP3 炎症小体连接炎症与代谢的假设,该假设随后得到实验验证。

    推荐理由:文章展示 Co-Scientist 如何从肝脏生物学与药理学文献中筛选机制和联合疗法假设,并连接到已获实验验证的 MASH 研究问题。

3月11日周三
  1. Mistral AI61

    Mistral AI 如何构建自动生成 Rails 测试的智能体

    Mistral AI 基于开源编码助手 Vibe 构建了一个自动生成和改进 Rails RSpec 测试的智能体,可读取源文件、执行测试并通过 RuboCop 和 SimpleCov 自我校正。该智能体处理了 275 个源文件,测试通过率和平均代码覆盖率均为 100%,RuboCop 违规数为 0,LLM-as-a-judge 得分为 0.74。

    推荐理由:文章拆解了用 AGENTS.md、分类技能和自定义工具约束智能体生成测试的做法,并给出真实代码库中的量化结果。

1月22日周四
  1. Mistral AI68

    Mistral AI 如何定位并修复 vLLM 的内存泄漏

    Mistral AI 定位了 vLLM 在启用 graph compilation 和 NIXL 的 Prefill/Decode disaggregated serving 中出现的内存泄漏,根因是 UCX 的 mmap hook 机制导致匿名内存持续增长。

    推荐理由:文章以真实的 vLLM 生产前测试故障为例,串联 Heaptrack、pmap、BPFtrace 和 GDB 的定位过程,并给出 UCX 配置层面的修复路径。

4月9日周三
  1. Mistral AI61

    Mistral AI 介绍用 LLM 作为评审器评估 RAG 的方法

    Mistral AI 介绍一种用 LLM 作为评审器评估 RAG 系统的方法,采用 RAG Triad 检查上下文相关性、groundedness 和答案相关性。

    推荐理由:文章把 RAG 评估拆为上下文相关性、答案相关性和 groundedness,并结合结构化输出给出可复用的机器可读评分方案。