跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

81条精选相关主题模型发布行业动态AI 编码

最新精选

第 21–40 条 · 共 81 条
9月16日周三
  1. NVIDIA Blog67

    NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐量最高达 GB300 NVL72 的 3.7x

    NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 中首次提交预览结果,在 Qwen3-VL 上的吞吐量最高达到 GB300 NVL72 的 3.7x,在 DeepSeek-R1 上最高达到 2.5x。

    推荐理由:文章将 Vera Rubin NVL72 的模型吞吐、GB300 NVL72 的跨机架扩展效率与软件优化增益放在同一组 MLPerf 结果中,便于比较推理基础设施的长期经济性。

  2. Mistral AI61

    Mistral 与 Mozilla 合作,为 Firefox Smart Window 提供 AI 模型

    Mistral 宣布与 Mozilla 合作,为 Firefox Smart Window 提供模型支持,帮助用户处理复杂搜索、找回浏览内容并根据浏览器标签整理信息。该功能目前面向法国和北美用户,英国和德国预计 later this year 推出;对话默认不保存在 Mozilla 服务器,Mistral 同意 zero data retention。

    推荐理由:文章交代了 Firefox Smart Window 的模型来源、覆盖地区与隐私安排,也呈现了浏览器 AI 在开放分发和用户控制上的合作思路。

  3. NVIDIA Blog66

    NVIDIA 如何用 DSX 提升 AI 工厂每兆瓦产出

    NVIDIA介绍 DSX AI 工厂平台,通过动态功耗分配、工作负载调度和电网响应,在固定电力预算下提高 token 吞吐。Lambda 在 HGX B200 五机架、19 节点集群上实现了 24% 的集群 token 吞吐提升和 23% 的每瓦性能提升。

    推荐理由:文章将 DSX 的功耗调度、需求响应和 800V DC 架构放在同一套 AI 工厂框架中,并给出 Lambda 的吞吐与性能功耗数据。

9月10日周四
  1. OpenAI News64

    OpenAI 在 ChatGPT Work 中推出 Data agent

    OpenAI 在 ChatGPT Work 中推出 Data agent,用户可连接公司数据、发现洞察,并通过自然语言构建交互式仪表盘。

    推荐理由:这项更新把企业数据连接、洞察发现和交互式仪表盘构建整合到自然语言操作中,呈现了数据智能体的主要使用场景。

  2. Hugging Face Blog81

    Hugging Face 用 Gradio Workflow 重建 AUTOMATIC1111 的大部分功能

    Hugging Face 构建了 Workflow1111,用单一 Gradio Workflow 画布重建 AUTOMATIC1111 的大部分功能。该工作流包含 73 个节点和 11 条媒体处理管线,覆盖文生图、图生图、检测、放大、背景移除和图生视频等任务。画布输出可自动成为 REST endpoint 和 MCP 工具,用户还能复制 Space 后替换模型、删除节点或重新连接流程。

    推荐理由:文章通过一个可复制和改造的案例,展示 Gradio Workflow 如何把多模型、多模态流程连接为可在浏览器和 MCP 中调用的工作流。

9月8日周二
  1. Google DeepMind78

    Google DeepMind 推出 AlphaGenome Atlas,预测人类基因组 9 billion 个单核苷酸变异影响

    Google DeepMind 推出 AlphaGenome Atlas,预计算人类基因组约 9 billion 个单核苷酸变异的分子影响预测。平台提供由 AlphaGenome 和 AlphaMissense 预测整合而成的 AVI score,并通过网站、AlphaGenome API 和 Google Antigravity 中的 skill 提供访问。

    推荐理由:文章把 AlphaGenome Atlas 的数据、AVI 评分和真实研究案例串联起来,呈现其如何帮助研究者筛选非编码变异并追踪分子影响。

9月5日周六
  1. GitHub Blog · AI & ML80

    GitHub Copilot 发布 Project HydraFusion 研究预览,支持运行时多模型编排

    GitHub Copilot 推出 Project HydraFusion 研究预览,可在运行时从多个提供商的模型中选择并编排执行流程。HydraFusion目前支持 Single、Cascade 和 Critique 三种模式,并通过 Copilot CLI 的 /experimental 向所有 GitHub Copilot 计划用户开放。

    推荐理由:GitHub Copilot 将多模型选择、评审与升级纳入运行时流程,并用三项 agentic coding 基准展示质量与成本之间的具体权衡。

9月3日周四
  1. Google DeepMind68

    Google推出 Fairwind Program,为政府和企业提供主动网络防御能力

    Google推出 Fairwind Program,向政府、Google Cloud 客户和可信网络安全伙伴限量开放网络防御能力。该计划将 Gemini 3.8 Flash Cyber 与 CodeMender 结合,用于自主发现、验证和修复漏洞,并在安全云环境中生成可部署补丁。计划已有超过 650 家合作伙伴参与,接入组织须限制使用人员并部署多因素认证等保护措施。

    推荐理由:原文说明了 Fairwind Program 的服务对象、核心工具与接入限制,便于理解其面向政府和企业的部署方式。

9月2日周三
9月1日周二
  1. Hugging Face Blog76

    Hugging Face 发布 @huggingface/kernels 与 Fleet,推出 207 个 WebGPU Kernels

    Hugging Face 发布 JavaScript 库 @huggingface/kernels 和浏览器 GPU 基准测试套件 Fleet,并在 Hugging Face Hub 提供首批 207 个 WebGPU kernels。

    推荐理由:文章同时给出 207 个 kernel 的版本化组织方式、Fleet 众测机制和 ORT WebGPU 对比数据,便于理解浏览器推理性能优化的落地路径。

8月28日周五
  1. Hugging Face Blog74

    Hugging Face 与 Voice Arena 为 Open ASR Leaderboard 加入 Hindi 和 Indian English 评测

    Hugging Face 与 Voice Arena 发布 Monsoon en-IN 和 Monsoon hi-IN 评测集,将 Hindi 和 Indian English 纳入 Open ASR Leaderboard。四个公开与私有切分共覆盖 4,888 名说话人,并记录 12 项说话人属性;Hindi 使用接受多种书写变体的 OIWER 评估,相关实现 voi-oiwer 也已开源。

    推荐理由:文章展示了如何将公开和私有切分、说话人元数据与 Hindi 的 OIWER 结合,用于定位不同地区和书写变体下的 ASR 误差。

8月25日周二
  1. Hugging Face Blog80

    Gradio 如何用 gr.Workflow 连接、运行和部署 AI 工作流

    Gradio 的 gr.Workflow 将 AI 流程表示为带类型节点的图,提供可拖放画布,让每个节点都能运行并查看中间结果。同一张工作流图还可作为 REST API,并通过一条命令部署到 Hugging Face Spaces。

    推荐理由:文章通过图像编辑、媒体工作室、数据集分析和 ZeroGPU 动画示例,展示 gr.Workflow 如何把可视化调试、API 调用与部署整合到同一张工作流图中。

8月20日周四
  1. Mistral AI78

    Mistral AI 发布 Agentic Search,提升复杂文档检索准确率并降低延迟

    Mistral AI 发布 Agentic Search,通过多步检索循环让 AI 系统搜索、打开、导航、读取并验证复杂文档中的信息。FinanceBench 上准确率从 26.7% 提升至 86%,OfficeQA Pro 上从 6.3% 提升至 51.9%,p90 延迟最高降低 39.6%,token 消耗最高减少三分之一。

    推荐理由:文章通过 FinanceBench 与 OfficeQA Pro 的对比,具体展示 Agentic Search 如何在复杂文档检索中兼顾准确率、延迟与 token 消耗。

8月18日周二
8月13日周四
8月11日周二
  1. Mistral AI75

    Mistral推出区域推理端点、优先级服务并接入第三方开放模型

    Mistral推出一般可用的 Regional Endpoints,支持客户选择在欧洲或美国运行推理,并在公开预览中提供带 uptime SLA 和自定义速率限制的 Priority Tier。平台还将接入第三方开放模型,首个为 Z.ai 的 GLM-5.2;同时,Mistral在欧洲组建长期算力联盟,通过 European Compute Units 提供多年基础设施访问。

    推荐理由:文章把区域合规、服务可靠性和模型选择放在同一平台框架中,具体呈现了企业获得统一基础设施的路径。