跳到正文

#编码

今日 5 条
今天10月1日周四
  1. AWS Machine Learning Blog71

    Claude Sonnet 5.5 登陆 Amazon Bedrock 和 AWS 上的 Claude Platform

    AWS宣布 Claude Sonnet 5.5 已在 Amazon Bedrock 和 AWS 上的 Claude Platform 提供,面向聚焦型编码与知识工作,速度更快且大多数任务的单任务成本更低。

    推荐理由:文章同时给出 Sonnet 5.5 与 Opus 5.5 的任务分工,以及在 Amazon Bedrock 上的调用路径,便于评估模型选型与落地方式。

  2. The Decoder83

    OpenAI 在 DevDay 扩展 Codex 与 API,新增安全扫描、Decisions API 和 Ultrafast

    OpenAI 在 DevDay 发布多项 Codex 与 API 更新,包括可复用云环境、仓库安全扫描、Agents API 的 Computer Use,以及限量预览的 Decisions API。Codex 还获得桌面代码审查视图和改版 CLI;Ultrafast 将 Codex token 生成速度提升至最高 300 tokens per second,API 价格为标准费率的六倍。

    推荐理由:文章集中梳理了 Codex、Agents API 和新速度层的功能变化,并列出不同计划与 API 定价,便于比较其适用场景。

  3. TechCrunch · AI82

    OpenAI 为 Codex 推出可跨设备使用的可复用云开发环境

    OpenAI 为软件工程智能体 Codex 推出可跨设备访问的可复用云开发环境,使开发者能够在电脑、手机或云端运行任务。Codex CLI 新增语音操作和 /agents 视图,ChatGPT 桌面端加入代码审查体验,Codex Security Cloud 可扫描 GitHub 仓库并准备修复。

    推荐理由:可复用云环境、跨设备任务和自动代码审查覆盖开发流程多个环节,展示了 Codex 从远程执行向持续协作空间的变化。

9月30日周三
  1. AWS Machine Learning Blog74

    GPT-6.1 Sol 在 Amazon Bedrock 上正式可用

    GPT-6.1 Sol 已在 Amazon Bedrock 上正式可用,面向编码、计算机使用和专业工作负载提供更强推理。OpenAI 称其在 DeepSWE v1.1 上达到 GPT-6 Astra 的表现,单任务成本约为其五分之一,并以低于 GPT-6 Sol 相关结果的 reasoning effort 超出后者最高分 6.4 个百分点。

    推荐理由:原文以 DeepSWE v1.1 的成本与性能对比,说明 GPT-6.1 Sol 如何服务编码和多步骤智能体工作流。

9月29日周二
  1. Simon Willison79

    Anthropic 发布 Claude Sonnet 5.5,并用于 claude.ai 免费层

    Anthropic 今天发布 Claude Sonnet 5.5,称其运行速度提升 30%+,多数任务的成本最多降低 30%,定价与 Sonnet 5 相同。Simon Willison 指出,该模型现已用于 claude.ai 免费层,并实测其生成了效果不错的 WebGL 三维鹈鹕骑自行车页面;他认为这一免费服务比使用 Luna 5.6 的 ChatGPT 免费层能力更强。

    推荐理由:同一绘图任务中,更高思考档位耗尽预算却未产出结果,而较低档位完成了输出,为选择推理预算提供了具体对照。

9月28日周一
9月27日周日
9月25日周五
  1. Simon Willison8

    commit-rewriter 0.2

    Simon Willison 于 24th September 2026 发布题为《commit-rewriter 0.2》的内容,正文未提供该项目的技术细节。页面同时推广每月 $10/month 的赞助订阅,可获得精选的月度 LLM 发展摘要。

  2. GitHub Blog · AI & ML75

    GitHub Copilot 中的 canvas:为什么聊天界面并不总是合适

    GitHub Copilot 应用中的 canvas 是运行在应用内、无浏览器界面的 full-stack app,可与 Agent 双向通信,让用户为具体任务生成定制界面。文章以 Connect 4、Winget、SQLite 和开发工作流为例,展示 canvas 如何支持游戏交互、本地包管理、数据库操作和流程自动化。

    推荐理由:文章通过 Connect 4、Winget、SQLite 和开发流程案例,说明 GitHub Copilot canvas 如何把智能体交互转成可操作的任务界面。

  3. GitHub Blog · AI & ML77

    GitHub Security Lab Taskflow Agent 实现 AI 驱动的 C/C++ 模糊测试

    基于 GitHub Security Lab Taskflow Agent 构建的 Fuzzing Taskflow,可为 C/C++ 项目自动完成入口识别、构建分析、harness 编写、AFL++ 运行、覆盖率改进、崩溃分诊和漏洞报告生成。

    推荐理由:文章具体拆解了 Fuzzing Taskflow 如何把 C/C++ 模糊测试中的 harness 编写、覆盖率反馈和崩溃分诊交给 LLM agent,并说明运行时的安全边界。

9月24日周四
  1. GitHub Blog · AI & ML68

    GitHub Copilot app 重建超大 Pull Request 视图

    GitHub 在 GitHub Copilot app 中重建了 Pull Request 视图,使包含 2,200 个文件、超过一百万行变更和 400 多条行内评论的超大 PR 仍能打开和滚动。新架构将代码行与动态评论分开处理,通过惰性测量、滚动锚定、缓存和自动化性能探针,减少评论高度变化带来的跳动与空白。

    推荐理由:文章拆解了 GitHub Copilot 如何用双重几何、惰性测量和自动化探针,让超大 Pull Request 的滚动与评论渲染保持稳定。

9月23日周三
9月21日周一
9月18日周五
9月17日周四
  1. GitHub Blog · AI & ML82

    GitHub Copilot 使用 Copilot 将运行时迁移至 Rust

    GitHub Copilot 团队使用 GitHub Copilot app 和 Copilot CLI,将 Copilot agent runtime 从 TypeScript 重写为超过 800,000 行生产 Rust,主要代码由 AI agents 编写,历经 128 个 pull requests,并在数月内由一名开发者主导完成。

    推荐理由:文章以 GitHub Copilot runtime 的 Rust 重写为案例,梳理渐进式迁移、跨语言互操作和人机协作中的具体做法。

9月16日周三
9月12日周六
  1. GitHub Blog · AI & ML74

    GitHub 如何用 GitHub Copilot 将活动运营代码化

    GitHub 日本和韩国市场的营销负责人使用 GitHub Copilot,将活动策划、报名筛选和会后跟进串成由 GitHub Issue 触发的自动化流程。GitHub Actions 负责创建落地页、生成 UTM 链接、处理名单和更新项目看板,GitHub Copilot skills 则以 SKILL.md 描述灵活的会后步骤。

    推荐理由:文章给出一套从 Issue 表单、标签和 Actions 到 SKILL.md 的营销自动化实践,展示如何在保留人工审批的同时减少跨工具重复操作。

9月11日周五
  1. GitHub Blog · AI & ML71

    GitHub Copilot 初学者指南:使用 diff、terminal 和 browser

    GitHub Copilot app 将 diff、terminal 和 browser 作为内置面板,让用户在同一处审查 Agent 的代码变更、运行项目命令并预览网站效果。用户可以通过 Pick & Polish 工具选择界面元素并让 Agent 调整,确认功能可用后直接接受变更并创建 pull request。

    推荐理由:文章把审查代码变更、运行命令和浏览器预览串成一套流程,帮助读者在接受 Agent 生成的代码前完成验证。

9月9日周三
  1. Mistral AI69

    Mistral AI 如何用 AI 智能体现代化复杂遗留代码

    Mistral AI 协助一家欧洲能源运营商将40,000行 Fortran 77 迁移到 C++,目标系统是没有测试套件和集中式文档的物理密集型储层模拟器。团队先建立数值对齐测试框架并整理代码文档,再按模块组织规划、实现、测试和审查流程,由人工审核 PR;首个 sprint 覆盖了300,000行代码中的40,000行。

    推荐理由:文章把复杂遗留代码迁移拆成文档整理、数值对齐和分模块协作三步,呈现了 AI 智能体在人工审核下落地的具体路径。

9月8日周二
9月5日周六
  1. GitHub Blog · AI & ML80

    GitHub Copilot 发布 Project HydraFusion 研究预览,支持运行时多模型编排

    GitHub Copilot 推出 Project HydraFusion 研究预览,可在运行时从多个提供商的模型中选择并编排执行流程。HydraFusion目前支持 Single、Cascade 和 Critique 三种模式,并通过 Copilot CLI 的 /experimental 向所有 GitHub Copilot 计划用户开放。

    推荐理由:GitHub Copilot 将多模型选择、评审与升级纳入运行时流程,并用三项 agentic coding 基准展示质量与成本之间的具体权衡。

9月4日周五
  1. GitHub Blog · AI & ML66

    GitHub Copilot 初学者指南:如何同时运行多个智能体

    GitHub Copilot app 支持通过彼此独立的 Agent session 同时运行多个任务,任务之间不会互相干扰。每个 session 使用独立的 Git worktree 并保留自己的上下文,用户可在 sessions view 中查看进度和结果。文章以添加 funded sort、进行无障碍检查和运行测试为例,展示并行处理方式。

    推荐理由:文章以 Git worktrees 和独立上下文为主线,说明如何在 GitHub Copilot app 中并行安排开发、无障碍检查与测试任务。

9月3日周四
8月25日周二
  1. Hugging Face Blog80

    Granite 4.2 推理模型家族如何构建

    IBM Granite Team 详解 Granite 4.2 推理模型家族的构建过程,涵盖 3B、8B 和 30B 三种规模,以及从 Granite-4.1 基础模型到 SFT 和多阶段 RL 的训练流程。

    推荐理由:文章梳理 Granite 4.2 从 Granite-4.1 基础模型、SFT 到多阶段 RL 的训练链路,并说明 8B 与 30B 如何在真实环境中通过 Agentic RL 学会工具操作。

  2. Hugging Face Blog80

    Gradio 如何用 gr.Workflow 连接、运行和部署 AI 工作流

    Gradio 的 gr.Workflow 将 AI 流程表示为带类型节点的图,提供可拖放画布,让每个节点都能运行并查看中间结果。同一张工作流图还可作为 REST API,并通过一条命令部署到 Hugging Face Spaces。

    推荐理由:文章通过图像编辑、媒体工作室、数据集分析和 ZeroGPU 动画示例,展示 gr.Workflow 如何把可视化调试、API 调用与部署整合到同一张工作流图中。