跳到正文

全部动态

今日 10 条
9月24日周四
  1. NVIDIA Blog74

    NVIDIA与合作伙伴如何用开放科学为下一次大流行做准备

    NVIDIA与Google DeepMind等机构合作,通过AlphaFold Database公开超过2,800种病毒蛋白质复合物的预测3D结构。数据由AlphaFold2结合NVIDIA BioNeMo Inference Runtime生成,约30%的蛋白质相互作用此前未在Protein Data Bank中记录。

    推荐理由:开放数据覆盖超过2,800种病毒且约30%的蛋白质相互作用此前未被记录,同时提供可复用的结构预测流程。

  2. GitHub Blog · AI & ML68

    GitHub Copilot app 重建超大 Pull Request 视图

    GitHub 在 GitHub Copilot app 中重建了 Pull Request 视图,使包含 2,200 个文件、超过一百万行变更和 400 多条行内评论的超大 PR 仍能打开和滚动。新架构将代码行与动态评论分开处理,通过惰性测量、滚动锚定、缓存和自动化性能探针,减少评论高度变化带来的跳动与空白。

    推荐理由:文章拆解了 GitHub Copilot 如何用双重几何、惰性测量和自动化探针,让超大 Pull Request 的滚动与评论渲染保持稳定。

  3. Google DeepMind65

    Google DeepMind更新 Private AI Compute 的私有服务器端记忆架构

    Google DeepMind发布 Private AI Compute 技术更新,提出在云端安全保存跨设备持久记忆,同时维持接近端侧处理的隐私标准。用户设备独占解密所需的加密密钥,云端安全隔离环境仅在处理请求时临时解密数据并保存新上下文。Google DeepMind还将发布更新后的技术白皮书、服务器软件防篡改公共记录和独立网络安全审计结果。

    推荐理由:文章解释了云端持久记忆如何借助设备密钥、加密通道和安全隔离环境保持跨设备连续性,并配套公开验证材料。

9月23日周三
9月22日周二
  1. NVIDIA Blog63

    NVIDIA为何强调物理 AI 规模化部署需要全层级安全

    NVIDIA指出,物理 AI 从研究走向大规模部署后,自动驾驶汽车和机器人需要在硬件、软件、AI 行为、运行环境及整个部署生命周期中持续满足安全要求。NVIDIA介绍了覆盖 AV 与机器人的 NVIDIA Halos 全栈安全系统,以及仿真、合成数据、运行时监控和第三方评估等安全基础设施。

    推荐理由:文章把物理 AI 的安全拆解到硬件、软件、AI 行为、运行环境和部署生命周期,并以 NVIDIA Halos 展示 AV 与机器人场景的工程化路径。

9月21日周一
9月17日周四
  1. GitHub Blog · AI & ML82

    GitHub Copilot 使用 Copilot 将运行时迁移至 Rust

    GitHub Copilot 团队使用 GitHub Copilot app 和 Copilot CLI,将 Copilot agent runtime 从 TypeScript 重写为超过 800,000 行生产 Rust,主要代码由 AI agents 编写,历经 128 个 pull requests,并在数月内由一名开发者主导完成。

    推荐理由:文章以 GitHub Copilot runtime 的 Rust 重写为案例,梳理渐进式迁移、跨语言互操作和人机协作中的具体做法。

9月16日周三
  1. NVIDIA Blog67

    NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐量最高达 GB300 NVL72 的 3.7x

    NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 中首次提交预览结果,在 Qwen3-VL 上的吞吐量最高达到 GB300 NVL72 的 3.7x,在 DeepSeek-R1 上最高达到 2.5x。

    推荐理由:文章将 Vera Rubin NVL72 的模型吞吐、GB300 NVL72 的跨机架扩展效率与软件优化增益放在同一组 MLPerf 结果中,便于比较推理基础设施的长期经济性。

  2. Mistral AI61

    Mistral 与 Mozilla 合作,为 Firefox Smart Window 提供 AI 模型

    Mistral 宣布与 Mozilla 合作,为 Firefox Smart Window 提供模型支持,帮助用户处理复杂搜索、找回浏览内容并根据浏览器标签整理信息。该功能目前面向法国和北美用户,英国和德国预计 later this year 推出;对话默认不保存在 Mozilla 服务器,Mistral 同意 zero data retention。

    推荐理由:文章交代了 Firefox Smart Window 的模型来源、覆盖地区与隐私安排,也呈现了浏览器 AI 在开放分发和用户控制上的合作思路。

  3. NVIDIA Blog66

    NVIDIA 如何用 DSX 提升 AI 工厂每兆瓦产出

    NVIDIA介绍 DSX AI 工厂平台,通过动态功耗分配、工作负载调度和电网响应,在固定电力预算下提高 token 吞吐。Lambda 在 HGX B200 五机架、19 节点集群上实现了 24% 的集群 token 吞吐提升和 23% 的每瓦性能提升。

    推荐理由:文章将 DSX 的功耗调度、需求响应和 800V DC 架构放在同一套 AI 工厂框架中,并给出 Lambda 的吞吐与性能功耗数据。

9月14日周一
9月12日周六
9月11日周五
9月10日周四
  1. OpenAI News64

    OpenAI 在 ChatGPT Work 中推出 Data agent

    OpenAI 在 ChatGPT Work 中推出 Data agent,用户可连接公司数据、发现洞察,并通过自然语言构建交互式仪表盘。

    推荐理由:这项更新把企业数据连接、洞察发现和交互式仪表盘构建整合到自然语言操作中,呈现了数据智能体的主要使用场景。

  2. Hugging Face Blog81

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111 的大部分功能

    Hugging Face 构建了 Workflow1111,用单一 Gradio Workflow 画布重建 AUTOMATIC1111 的大部分功能。该工作流包含 73 个节点和 11 条媒体处理管线,覆盖文生图、图生图、检测、放大、背景移除和图生视频等任务。画布输出可自动成为 REST endpoint 和 MCP 工具,用户还能复制 Space 后替换模型、删除节点或重新连接流程。

    推荐理由:文章通过一个可复制和改造的案例,展示 Gradio Workflow 如何把多模型、多模态流程连接为可在浏览器和 MCP 中调用的工作流。

9月9日周三
9月8日周二
  1. Google DeepMind78

    Google DeepMind 推出 AlphaGenome Atlas,预测人类基因组 9 billion 个单核苷酸变异影响

    Google DeepMind 推出 AlphaGenome Atlas,预计算人类基因组约 9 billion 个单核苷酸变异的分子影响预测。平台提供由 AlphaGenome 和 AlphaMissense 预测整合而成的 AVI score,并通过网站、AlphaGenome API 和 Google Antigravity 中的 skill 提供访问。

    推荐理由:文章把 AlphaGenome Atlas 的数据、AVI 评分和真实研究案例串联起来,呈现其如何帮助研究者筛选非编码变异并追踪分子影响。