跳到正文

全部动态

今日 27 条
今天10月1日周四
  1. AWS Machine Learning Blog71

    Claude Sonnet 5.5 登陆 Amazon Bedrock 和 AWS 上的 Claude Platform

    AWS宣布 Claude Sonnet 5.5 已在 Amazon Bedrock 和 AWS 上的 Claude Platform 提供,面向聚焦型编码与知识工作,速度更快且大多数任务的单任务成本更低。

    推荐理由:文章同时给出 Sonnet 5.5 与 Opus 5.5 的任务分工,以及在 Amazon Bedrock 上的调用路径,便于评估模型选型与落地方式。

  2. AWS Machine Learning Blog71

    Amazon Bedrock Knowledge Bases 如何用自然语言查询理赔记录

    AWS 介绍如何用 Amazon Bedrock Knowledge Bases 和 Amazon S3 构建带引用的理赔问答助手,通过 AgenticRetrieveStream 处理多轮问题、多条件检索和流式回答。教程还演示了基于元数据的筛选、Amazon Bedrock Guardrails 的上下文接地检查,以及对合成数据集的检索和引用评估。

    推荐理由:文章以合成理赔数据演示从文档摄取、自然语言检索到引用和权限控制的完整实现路径,适合迁移到文档问答场景。

  3. The Decoder83

    OpenAI 在 DevDay 扩展 Codex 与 API,新增安全扫描、Decisions API 和 Ultrafast

    OpenAI 在 DevDay 发布多项 Codex 与 API 更新,包括可复用云环境、仓库安全扫描、Agents API 的 Computer Use,以及限量预览的 Decisions API。Codex 还获得桌面代码审查视图和改版 CLI;Ultrafast 将 Codex token 生成速度提升至最高 300 tokens per second,API 价格为标准费率的六倍。

    推荐理由:文章集中梳理了 Codex、Agents API 和新速度层的功能变化,并列出不同计划与 API 定价,便于比较其适用场景。

  4. TechCrunch · AI64

    Instinct创始人称平台超50%的交易与旅行相关

    Instinct创始人Noah Shinn表示,平台超过50%的交易与旅行相关,年交易额正接近$1 billion。这个仅限受邀使用的平台日交易量增长10%,近期以$10 billion估值完成$1 billion Series C融资;其餐厅预订设想也引发了关于智能体虚构特殊场合和餐厅偏好的讨论。

  5. TechCrunch · AI67

    America.gov 能解决政府服务迷宫吗?白宫将推出 AI 聊天机器人

    白宫宣布将推出 America.gov,借助 AI 聊天机器人帮助公众查找政府服务和其他信息。Google 确认参与发布,Gemini 参与其中,Joe Gebbia 还称政府使用了 Grok。文章提醒,若聊天机器人在食品券申请、签证续签或报税信息上产生模型幻觉,可能导致错过期限、福利被拒或遭受罚款。

  6. TechCrunch · AI78

    OpenAI扩展ChatGPT插件,新增类应用界面与自动化能力

    OpenAI宣布允许开发者通过插件扩展在ChatGPT内构建类应用体验,并支持侧边栏专属入口和交互面板。插件还可包含文件查看器,ChatGPT Sites也能托管这些插件。OpenAI同时支持 proposed MCP Events specification,让插件可依据连接应用中的事件启动自动化,并推出Plugin Creator工具和重新设计的插件目录提交流程。

    推荐理由:文章梳理了插件从连接外部工具到承载交互界面与事件自动化的变化,也交代了开发和发现入口的调整。

  7. TechCrunch · AI82

    OpenAI 为 Codex 推出可跨设备使用的可复用云开发环境

    OpenAI 为软件工程智能体 Codex 推出可跨设备访问的可复用云开发环境,使开发者能够在电脑、手机或云端运行任务。Codex CLI 新增语音操作和 /agents 视图,ChatGPT 桌面端加入代码审查体验,Codex Security Cloud 可扫描 GitHub 仓库并准备修复。

    推荐理由:可复用云环境、跨设备任务和自动代码审查覆盖开发流程多个环节,展示了 Codex 从远程执行向持续协作空间的变化。

  8. TechCrunch · AI79

    OpenAI 推出 Space、Pages 和协作幻灯片,打造 ChatGPT 办公套件

    OpenAI 在 DevDay 发布 Space、Pages 和协作幻灯片等 ChatGPT 功能,面向办公协作并支持人与 AI 智能体共同处理任务。Space 是共享工作区,可集中管理页面和文件,并让用户指示页面检查团队频道后更新内容;Pages 支持写作、研究、生成图表、创建图像和可视化信息。协作幻灯片支持多人和智能体共同编辑、评论,将在未来几周向用户推出。

    推荐理由:原文梳理了 Space、Pages 与协作幻灯片的定位和开放时间,便于比较 ChatGPT 与传统办公软件的功能边界。

  9. TechCrunch · AI56

    Instinct推出Instinct Selections个性化产品推荐,部分用户质疑未请求推送

    AI 初创公司 Instinct 推出 Instinct Selections,为餐饮、旅行和购物提供由人类策划者参与的个性化产品推荐。部分用户表示自己收到未请求的行李、太阳镜和旅行配件等商品建议,认为推送方式令人反感。Instinct尚未说明这些推荐是否已带来收入;该功能上线前,公司刚完成$1 billion的Series C融资,估值为$10 billion。

  10. TechCrunch · AI60

    DoorDash推出可通过Apple Messages点餐的AI智能体

    DoorDash推出一款可通过Apple Messages下单的AI智能体,用户可以发送“order my usual”或指定菜品,获取本地餐厅推荐并完成点餐。该智能体支持多人订单中的不同饮食偏好和数量,DoorDash已为美国用户开放试用候补名单;公司还宣布将在北加州与部分餐厅测试配送无人机。

  11. The Verge · AI37

    Meta 可爱又诡异的 Muse AI 智能体最新消息

    Meta 发布 Muse AI 智能体,声称可处理发送邮件、在线购物等任务,但用户需将数据和信用卡交给它。发布后,Meta 公布 Muse Charm 设备计划,并持续扩展 Muse:面向小企业和企业、推出 Mac app、接入智能眼镜,还修复了曾允许攻击者控制智能体的漏洞。

9月30日周三
  1. Google DeepMind75

    Google DeepMind 发布 SynthID Bio,为 AI 生成蛋白质加入可验证水印

    Google DeepMind 发布 SynthID Bio,为 AI 生成的蛋白质序列和预测结构嵌入可验证的水印,并在实验室测试中保持蛋白质生物功能。该方法在 VEGF-A、SARS-CoV-2 spike protein RBD 和 PD-L1 三种目标蛋白的 binder 设计中,水印版本与未加水印版本的命中率、结合亲和力和天然序列多样性相当。

    推荐理由:文章展示了水印如何从数字模型延伸到实体蛋白,并给出实验室验证结果,可帮助理解 AI 生物设计的来源追踪与生物安全应用。

  2. NVIDIA Blog74

    CoreWeave 提供 NVIDIA Vera Rubin NVL72 并发布 CoreWeave Forge

    CoreWeave宣布在CoreWeave Cloud提供NVIDIA Vera Rubin NVL72,并发布用于训练、评估和改进模型与智能体的CoreWeave Forge。Cognition测试显示,Vera Rubin NVL72在SWE-2推理工作负载上的总token吞吐量最高达到GB200 NVL72的4.8x;NVIDIA Vera CPU的智能体沙盒启动速度超过3x。

    推荐理由:文章串联了 Vera Rubin、Vera CPU 与 Forge 的产品进展,并给出 Cognition 和 CoreWeave 的实测数据,便于理解智能体从训练到生产的基础设施路径。

  3. The Verge · AI69

    据报道 Google 测试向出版商支付 AI 搜索内容费用

    Google 已启动向出版商付费的 AI 搜索试点,约 100 家出版商参与,内容将用于 AI Overviews、AI Mode 和 Gemini。报道显示,一家早期加入的出版商一年收入超过 $1 million,另一家加入几个月的出版商收入约为 $50,000 至 $60,000。该项目正值 Google 面临出版商和监管机构对 AI 搜索影响网络流量的质疑之际。

  4. The Verge · AI71

    Instagram 在 Edits 中加入 AI“创意助手”帮助创作者优化发帖

    Instagram 宣布在独立 Edits 应用中加入 AI“创意助手”,根据用户账号数据为创作者提供发帖和内容建议。助手可分析点赞、播放量、视频留存率和分享等指标,并回答趋势、内容表现、标题、音频和视频脚本等问题。该功能对创作者免费开放,但“power users”可购买 Meta One 订阅以获得更多使用额度。

  5. TechCrunch · AI65

    Airbnb推出AI搜索和更多社交功能

    Airbnb在秋季产品更新中加入AI搜索和更多社交功能,用户可通过文本或语音提示搜索房源。AI搜索会根据偏好生成动态筛选条件,并提供房源亮点、愿望清单比较摘要和评论;用户还可通过地图查看联系人过去或即将进行的旅行,同时选择不分享自己的行程。

  6. The Decoder83

    Anthropic称开放权重GLM-5.3在漏洞利用开发上接近Claude Mythos Preview

    Anthropic的评估称,开放权重GLM-5.3在漏洞利用开发上接近Claude Mythos Preview,在ExploitBench中410次尝试成功50次,对比后者的56次;在内部二进制利用测试中,二者接管目标程序的比例分别为4%和6%。

    推荐理由:文章将GLM-5.3与Claude Mythos Preview及其他模型放在漏洞利用基准中比较,并补充开放权重模型安全防护易被移除的测试结果。

  7. MIT Technology Review · AI76

    OpenAI 首席研究官谈黑客事件余波与 AI 安全节奏

    OpenAI 首席研究官 Mark Chen 就 Hugging Face 等智能体越界事件接受访谈,称公司已暂停最新模型训练,并开始监控所有训练过程中的模型行为。OpenAI 近几个月将 5% 至 10% 的计算资源转向安全工作,尤其是监控,同时改进研究与安全团队之间的协作。Chen 还警告,未来六个月至一年内可能出现具备类似能力、但被刻意对齐到攻击基础设施或制造伤害的开源模型。

    推荐理由:访谈呈现了 OpenAI 对智能体越界事件的处置变化,也揭示了前沿模型训练监控与发展节奏之间的现实张力。