Google Research:全球合作与开放资源推动科学影响力
Google Research介绍其通过开放源代码工具、开放数据集与全球科研伙伴推动科学研究和实际应用,相关资源已服务全球超过250,000名研究者和开发者。文章列举基因组学、神经科学、气候建模、生物多样性和医疗等案例,并提出未来将探索以agentic workflows和Skills共享科研方法。
Google Research介绍其通过开放源代码工具、开放数据集与全球科研伙伴推动科学研究和实际应用,相关资源已服务全球超过250,000名研究者和开发者。文章列举基因组学、神经科学、气候建模、生物多样性和医疗等案例,并提出未来将探索以agentic workflows和Skills共享科研方法。
Google DeepMind 发布新论文,介绍 Decoupled DiLoCo 如何通过异步连接多个计算“岛”提升跨数据中心训练的弹性。
推荐理由:文章展示了 Decoupled DiLoCo 如何在跨区域训练中降低带宽依赖、隔离硬件故障,并兼容不同代际芯片,为分布式预训练提供基础设施思路。
Google Research在发表于 Transactions on Machine Learning Research 的论文中提出 Simula,用推理优先的方法从第一性原理构建合成数据集。
推荐理由:文章将合成数据生成重构为机制设计问题,拆分覆盖、多样性、复杂度与质量,给出可控且可评估的数据构建路径。
Google Research 的新论文提出 MoGen,通过 PointInfinity point cloud flow matching 将随机 3D 点云逐步生成神经元形状,并用于增强 PATHFINDER 训练。
Google Research 提出 ConvApparel 数据集与三柱评估框架,用于衡量 LLM 用户模拟器与真实用户行为之间的真实性差距。该数据集包含 apparel shopping 领域超过 4,000 段人机多轮对话和近 15,000 个 turns,并通过 Good 与 Bad 两类推荐智能体收集不同用户体验。
推荐理由:ConvApparel用真实用户反馈和反事实验证检验模拟器能否适应未见过的糟糕交互,为评估用户模拟真实性提供了可复用框架。
Google Research 研究 AI 基准中评测项目数量与单项人工评测者数量的取舍,发现常用的 1、3 或 5 名评测者往往不足。研究通过模拟不同预算和数据集指出,若关注多数投票,增加项目数量通常更有效;若要捕捉完整意见范围,则需要增加每项评测者数量。根据指标优化分配后,约 1,000 次总标注即可获得高度可复现的结果,研究团队还在 GitHub 开源了模拟器。
推荐理由:研究把评测项目数量与单项评测者数量放在同一预算框架下比较,为主观任务设计更可复现的 AI 基准提供了可操作依据。
Google Research 发布 TurboQuant、QJL 和 PolarQuant,用于压缩 KV cache 与高维向量搜索数据。
Google Research 介绍了 S2Vec,这是一种通过自监督学习生成建成环境通用嵌入向量的框架,可用于预测人口密度和收入等社会经济指标。评测显示,S2Vec 在未见区域的社会经济预测中表现有竞争力,与图像嵌入融合通常优于单一模态;在树木覆盖率和海拔等环境任务上,仅依靠建成环境数据仍有限。
Mistral AI 发布 Mistral Small 4,并作为创始成员加入 NVIDIA Nemotron Coalition。Mistral AI 与 NVIDIA 计划结合模型架构、计算资源、开发工具和合成数据管线,共同开发开放的前沿 AI 模型。联盟首项计划是在 NVIDIA DGX Cloud 上训练基础模型,为即将推出的 NVIDIA Nemotron 4 家族提供开放基础。
推荐理由:材料把 Mistral AI 的模型发布与 NVIDIA Nemotron Coalition 的合作安排放在一起,交代了开放模型共建的参与方式和后续方向。
Berkeley AI Research介绍 SPEX 和 ProxySPEX,用稀疏性、低阶性与层级结构,在大规模消融中定位影响 LLM 行为的关键交互。ProxySPEX 在保持 SPEX 性能的同时约减少 10x 消融,并被用于特征归因、训练数据归因和注意力头归因。两套算法已集成到 SHAP-IQ 仓库。
Google 宣布在 Flood Hub 推出城市突发洪水预报,可提前最多 24 小时预测风险,将覆盖范围从河流洪水扩展至城市突发洪水。团队使用 Gemini 从公开新闻中提取洪灾发生地点和时间,构建 Groundsource 数据集,用于训练和评估结合天气、地理及城市化特征的 LSTM 模型。
推荐理由:利用新闻报道重建历史洪灾样本,为缺乏传感器记录的地区提供了训练数据,也展示了非结构化资料转化为预测依据的方法。
Google Research 推出 Groundsource,利用Gemini从80种语言的新闻报道中提取并核验山洪事件,构建覆盖150多个国家、从2000年至今的2.6 million条历史记录。该开放数据集可用于城市山洪建模与预测,Google还在Flood Hub中推出最长提前24小时的近全球城市山洪预报。人工复核显示,60%的事件在地点和时间上均准确,82%达到实际分析可用程度。
推荐理由:Groundsource展示了如何用Gemini把分散的新闻报道整理为可验证的灾害历史数据,并连接到山洪预测等实际应用。
一篇新论文为 word2vec 的学习过程建立了闭式理论,指出在特定近似条件下,其训练可化为无权最小二乘矩阵分解,最终学习到的表示对应目标矩阵的主成分。理论显示,模型从小初始化开始,会按离散步骤逐个学习正交线性概念并增加嵌入矩阵的秩;在类比补全基准上,近似模型达到 66% 准确率,原始 word2vec 为 68%。
Mistral AI 介绍使用 LoRA 微调 Pixtral-12B 进行卫星图像分类的方法,并通过 Aerial Image Dataset 展示领域适配效果。
Mistral AI与 Carbone 4、ADEME 等机构合作,发布对 LLM 开发和使用进行生命周期分析的环境影响报告。
推荐理由:报告将训练、推理和全生命周期影响拆分为可比较指标,并披露 Mistral Large 2 与 Le Chat 的环境数据,为 AI 采购和行业透明度讨论提供量化依据。