GitHub Copilot 在 Slack 与 Teams 里接住线程上下文:可切换模型,并修掉旧会话继续操作旧仓库的问题
GitHub Copilot 更新 Slack 与 Teams 集成:Slack 的文件、附件、消息链接与 Teams 的内联图片、转发消息、频道历史都成为 agent 上下文;新增可延续整条线程的模型切换,并修掉被替换的会话仍能操作旧仓库的问题。
Agentic autofix 开始读写 Copilot Memory:安全修复模式被存成仓库记忆,28 天不用自动过期
GitHub 更新 agentic autofix:它会读取仓库已有的 Copilot Memory 来解决安全告警,并把修复模式存成新记忆供 code review 与 cloud agent 使用。记忆按用户启用、按仓库共享、28 天未使用自动删除。
CodeQL 2.27.1 更新:C/C++ 新增歧义赋值查询,Kotlin 2.4.20 进入支持列表
CodeQL 2.27.1 新增 cpp/ambiguous-assignment-of-comparison 与 cs/linq/missed-firstordefault,支持 Kotlin 2.4.20,并修正 Fastify 路由识别、actions/unpinned-tag 误报与 Rust 抽取器升级带来的迁移事项。
Cline 桌面版 0.0.37 把版本与更新搬进应用内:About 页、更新提示与一键诊断导出
Cline 桌面版 v0.0.37 在 Settings 新增 About 页:版本与 channel、检查更新与重启更新、就近版本 release notes 与问题上报集中一处;macOS 诊断导出一键可达,并修复 Bedrock inference profile 上的 reasoningConfig 报错。
Copilot 用量指标 API 拆开 PR 审查耗时:三段中位数与 P90,机器审查不计入
Copilot 用量指标的企业与组织仓库级报告新增 pull_request_review_times 数组,把 PR 等待拆成就绪到首次审查、首次到最终审查、最终审查到合并三段,各给中位数与 P90;Copilot 代码审查与机器人审查不计时。
GitHub 企业版上线 proof of presence:创建令牌、改安全设置前要先回身份源重新证明身份
GitHub Enterprise Cloud 上线 proof of presence 公开预览:成员在创建令牌、编辑 Webhook、修改组织安全设置、查看恢复码前,必须先回到身份源重新认证。目前仅覆盖使用 Microsoft Entra ID 做 SSO 的 EMU 企业,通过后同一浏览器会话两小时内免重复校验。
GitHub Actions 过期 artifact 从 UI 和 API 消失:保留期与计费没变,产物清单脚本要改判断
2026 年 9 月 24 日起,GitHub Actions 的过期 artifact 不再出现在运行摘要页列表,也不再由「列出仓库 artifact」和「获取单个 artifact」两个 REST 端点返回。GitHub 强调保留期设置与计费不受影响,产物记录仍可在运行日志中找到——但把列表当存在性检查的脚本需要改写。
GitHub Actions 正式退役 Node 20:JS action 改跑 Node 24,逃生开关同步下线
GitHub 发布 Node 20 退役最终通知:Actions 运行器统一用 Node 24 执行 JavaScript action,临时开关 ACTIONS_ALLOW_USE_UNSECURE_NODE_VERSION 已下线。Action 维护者需把 runs.using 改为 node24 并发布新版本;macOS 13.4 及更早版本、ARM32 上的自托管运行器不再被支持。
Vercel 为 Sandbox 的可观测性补上内存维度
Vercel 为 Sandbox 可观测性补上内存维度:Dashboard 的 Memory Usage 卡片给出平均、P75 与 P95,沙箱详情页纵轴按内存上限缩放并在 85% 处画参考线,查询构建器提供 memoryUsedBytes 度量,CLI 用 vercel metrics 读取 vercel.sandbox.memory_used_bytes,--all 可看团队级聚合。
Antigravity SDK 支持本地模型:Gemma 4 26B 走 LiteRT 离线执行,一次混合运行 97.2% 的 token 不出机器
Google 为 Antigravity SDK 加上本地模型与本地执行路径,首批支持经 Google AI Edge 的 LiteRT 运行的 Gemma 4 26B A4B,官方建议机器具备大于 24GB 显存或统一内存。除 LiteRT 外可用 LocalOpenAIAgentConfig 接入 Ollama、LM Studio、vLLM 等 OpenAI 兼容服务。官方混合运行示例中云端仅 95 token,97.2% 的 token 在本地完成。
Claude Sonnet 5.5 上线 GitHub Copilot:11 个入口同日可选,企业默认策略会先替你开启
GitHub 在 9 月 28 日把 Claude Sonnet 5.5 推向 Copilot 的全部 11 个入口,按用量、按供应商标价结算;Anthropic 称它比 Sonnet 5 快 30% 以上、多数任务成本最多低 30%,但标价不变。真正需要管理员现在就决定的是模型策略里的默认开关。
Codex CLI 0.158.0 改了两处默认值:提权命令要终端审批,MCP 支持预注册 OAuth 客户端密钥
Codex CLI 0.158.0 于 9 月 28 日发布,123 个提交。提权命令的终端输入审批改为默认开启,仅运行时授权不再重复询问;同时支持需要预注册 OAuth client secret 的 MCP 服务器,exec-server 的 WebSocket 改用 bearer token,并修掉一批跨平台沙箱问题。
GitHub Actions 自托管运行器版本强制提前到 9 月 29 日:低于 2.329.0 无法注册,已注册的会停作业
GitHub 把自托管运行器的最低版本强制提前到 9 月 29 日。低于 2.329.0 无法注册或重新注册;已注册但低于运行下限的运行器会停止执行作业。仅影响 Enterprise Cloud,带数据驻留的实例从 7 月 31 日起已在执行,官方新增 REST API 可提前自查。
Cloudflare 发布 cf CLI:3000 多个 API 操作收进一个命令行,默认输出 JSON 给 Agent 用
Cloudflare 发布 cf,一个目标是镜像整个 Cloudflare API 的命令行工具,覆盖 3000 多个操作。它默认输出 JSON、支持自然语言检索命令,并把 cloudflare.config.ts 定为全局配置格式。cf 处于 open beta,Wrangler 将在之后获得 18 个月维护期。
如何在 diffusers 中使用 Qwen-Image-2.1:透明输出与可测试的 API
用 diffusers 运行 Qwen-Image-2.1:文生图、RGBA 透明输出、最多 10 张参考图的编辑、FastAPI 封装,以及在 Apifox 中验证透明度和 seed 可复现性。
Qwen-Image-2.1 对比 Qwen Image 3.0:开放权重还是托管 API?
Qwen-Image-2.1(开放权重、研究许可、原生透明)对比 Qwen Image 3.0(托管 API、$0.03 每张、密集文字):许可证、成本、能力与决策表。
如何免费使用 Qwen-Image-2.1?
试用 Qwen-Image-2.1 的全部零成本途径:Qwen Chat、官方 Hugging Face Space、ModelScope、ComfyUI 和 diffusers,以及研究许可对输出用途的限制。
Claude Opus 5.5 发布:输入价降到 4 美元,同天进入 GitHub Copilot 十个入口
Anthropic 发布 Claude 5.5 家族首个模型 Opus 5.5:输入 4 美元/输出 20 美元,缓存读取降 60%,同天进入 GitHub Copilot 十个入口并成为 Claude Code 默认 Opus 模型。这篇只讲账单、步骤数和它不能做的事。
GitHub Copilot CLI 为 C++ 启用全代码库索引:默认打开,首次建索引会吃时间和内存
GitHub Copilot CLI 的 C++ 代码智能开始支持全代码库索引,由 Microsoft C++ Language Server 驱动并默认开启:索引覆盖未打开的文件,代价是首次构建耗时且临时抬高内存。含安装命令、关闭方式与仍然缺失的数据。
GPT-6 Sol 与 GPT-6 Luna 进入 GitHub Copilot:Luna 下放到 Pro 档,两个都进自动选择
GPT-6 Sol 与 GPT-6 Luna 同日进入 GitHub Copilot:Sol 面向多步校验的 agentic 编码且限 Pro+ 及以上,Luna 是家族里最低成本档并下放到 Pro。两者都进自动模型选择,且官方未公布模型 ID。
GitHub Enterprise 上线凭据清单导出:一次列出所有能访问企业的令牌、SSH 密钥与 App 令牌
GitHub Enterprise Cloud 支持导出能访问企业的完整凭据清单:SSH 密钥、两类 PAT、OAuth 令牌与 GitHub App 令牌,可在设置里导出 CSV 或用分页 REST API 拉取,并可与审计日志关联排序风险。
GitHub Copilot 应用加入本地沙箱:默认关闭,开启后命令碰不到全盘文件与凭据
GitHub Copilot 应用在 9 月 23 日把本地沙箱推进 public preview。它按项目配置,把 agent 跑的命令关进操作系统级沙箱,限制文件、网络和凭据访问;默认关闭,也只覆盖本地仓库与工作树会话。
GitHub Copilot 代码审查开放个人设置页:所有档位可配,企业可定默认审查强度
GitHub 把 Copilot 代码审查的两项配置推到 GA:个人设置页对所有 Copilot 档位开放,可分别配置三个自动审查开关与默认审查强度;企业管理员则能设一个继承到组织仓库的默认强度。
Cursor 上线 Rollouts 与 Security Reviewer:两个 PR 机器人分管部署健康与漏洞审查
Cursor 在 9 月 23 日上线 Rollouts 与 Security Reviewer:前者给每个 PR 挂监控器、按环境回报上线健康,后者只报可被利用的漏洞。两者面向 Teams 与 Enterprise,且都不会自动合并或回滚。
Claude Code v2.1.281 新增署名开关:一条设置关掉所有提交与 PR 署名
Claude Code v2.1.281 加入 "attribution": false,可隐藏所有提交与 PR 署名;同版本补齐企业网关的 desktop 策略、Bedrock assume_role 与 guardrail,并修复会话恢复与重试路径。
Claude Opus 5.5 免费吗?以及最便宜的付费路径
Claude Opus 5.5 不在免费套餐内,免费版只覆盖 Sonnet 和 Haiku。本文说明哪些渠道能不预付费用地用到 Opus 5.5,并算清 $4/$20 单价下最省的付费路径与缓存成本。
GPT-6 Sol 免费吗?最省钱的调用方式
GPT-6 Sol 在所有 OpenAI 首发表面都要付费。本文给出各套餐与 API 的准入边界,并指出同日发布的 GPT-6 Luna 在桌面版对 Free / Go 用户免费,1M 上下文足以覆盖大部分原本想用 Sol 的场景。
什么是 Claude Opus 5.5?
Claude Opus 5.5 全面解析:模型 ID claude-opus-5-5、$4/$20 定价、1M 上下文窗口、128k 最大输出、Anthropic 公布的八项基准成绩,以及 18 小时以上的持续任务能力。
从 Claude Opus 5 迁移到 Opus 5.5:API 调用方需要改变什么
面向 API 调用方的 Opus 5 到 Opus 5.5 迁移指南:新的 claude-opus-5-5 模型 ID、输入输出各降 20%、缓存写入 $5 与缓存读取 $0.20、fast 模式 $8/$40,以及 128k 输出上限带来的客户端改造。
2026 年 9 月 AI 模型价格战:Grok 4.7、Opus 5.5、GPT-6 Sol 与 Luna
48 小时内三家发布新模型,成本表每一行都失效了。本文汇总各家的每 token 价格,说明为什么每 token 单价已经不再是竞争单位,以及本周最响亮的宣传如何在发布数小时内过期。
GPT-6 提示缓存:缓存读取降 90%,以及如何真正命中缓存
每个 Agent 循环都在重发同一段开场。本文说明缓存降价的实际金额、提示词要如何排布才能命中、显式断点怎么放,以及在有人重构系统提示词后如何用测试保证命中率不回落。
什么是 Claude Opus 5.5?
Opus 5.5 定价 $4/$20,比 Opus 5 低 20%,输出快 30%,可连续工作 18 小时以上。本文整理规格表、Anthropic 公布的八项基准成绩、决定真实账单的缓存测算,以及不该做的对比。
Claude Opus 5.5 提示注入:如何读懂 85% 这个 API 安全指标
85% 是相对降幅,意味着同样的攻击面下仍有约 15% 能得手;而且它描述的是模型属性,你被叫起来处理的故障却属于接口属性。本文区分两者,并给出可重复的残余风险测试方法。
Claude Opus 5.5 可连续工作 18 小时:如何为长任务 Agent 设计 API
栈里每个超时默认值都假设调用方最终会放弃。当 Agent 能连续工作 18 小时,负载均衡、网关和 HTTP 客户端的默认配置都需要重新设计。本文给出连接保活、状态外置与幂等重试的具体做法。
Claude Opus 5.5 提示缓存:$0.20 缓存读取的盈亏平衡点
缓存读取 $0.20/M 对全新输入 $4.00/M 是 95% 折扣,但缓存写入 $5.00/M 比不缓存还贵。本文算出单个前缀在 1.26 次调用后回本、稳态下约 21% 命中率是盈亏分界线。
GPT-6 Sol 定价:所谓「降价 50%」到底是跟谁比
「便宜 50%」的基线是 GPT-5.6 的促销价而不是标价。本文换回标价基线后重算降幅,说明这个形容词如何让迁移预算表偏差三分之一,并给出按任务而非按 token 估算成本的方法。
GPT-6 Sol vs Claude Opus 5.5:价格、基准,以及没人真正做过的那个对比
两个模型同一天发布,导致所有公开对比表都建立在已被替换的基线之上。本文列出双方公布的数字、两组基准真正可比的部分、计入缓存后的价格差,以及如何在自己的流量上做决策。
GPT-6 Sol 延迟实测:首 token 要等 102 秒
换用更便宜的模型后账单好看了,但 p95 响应时间突破两分钟,网关开始返回超时。本文拆解 102 秒首 token 的测量口径,并给出四项让长推理模型不拖垮接口的设计改动。
从 GPT-6 Astra 迁移到 GPT-6 Sol:五分之一的价格,以及你要放弃什么
GPT-6 Sol 把输入输出价格从 $10/$50 降到 $2/$10,API 形态不变。本文给出迁移的实际改动、需要重新测量的指标,以及在难题上继续保留 Astra 的判断依据。
什么是 GPT-6 Luna?模型 ID、$0.10/$0.50 定价与 1M 上下文窗口
GPT-6 Luna 定价像廉价档,行为却不像。本文给出模型 ID、$0.10/$0.50 的单价、100 万 token 上下文、缓存读取九折优惠,以及 OpenAI 公布的基准成绩与它仍不适合承担的工作。
GPT-6 Luna vs Sol vs Astra:按单任务成本选档位
把 $0.10 和 $10 直接对比会得出「顶配贵一百倍」的错误结论,因为生产环境交付的是完成的任务而不是 token。本文用单任务成本这一个单位,说明三档模型各自适合什么工作负载。
GPT-6 Luna 支撑高并发 API 负载:真实请求量下的成本测算
每天分类五百万条工单、补全千万行商品目录这类任务,过去卡在成本上。本文按三种真实负载形态测算每百万次请求成本,并指出决定最终账单的三个关键变量。
GPT-6 Luna vs Gemini 3.8 Flash vs DeepSeek:亚美元 API 档位的真实成本
三个低价模型的三组标价并非同一种数字:一个是相对促销价的降幅,一个有到期日,一个按时段浮动。本文把它们对齐到同一口径,算清高频分类与摘要任务下的真实月账单。
用 GPT-6 Luna 生成 API 测试:一次全量 OpenAPI 规范要花多少钱
从 OpenAPI 规范生成测试早已不是技术问题,成本才是。本文按 42 个接口的完整规范算出单次生成约 $0.29、开启缓存后低于 $0.10,并给出请求结构、延迟预期和模型仍会出错的两种情形。
如何免费使用 GPT-6 Luna
GPT-6 Luna 对 Free 与 Go 用户在桌面版完全免费,但仅限桌面版、仅限该模型。本文梳理免费边界、免费额度内的真实能力,以及超出边界后最低成本的接续方案。
什么是 GPT-6 Sol?模型 ID、定价、872K 上下文与基准成绩
OpenAI 沿用了 Sol 这个名字,但底下的模型换了。本文说明 GPT-6 Sol 的模型 ID、$2/$10 定价、872,000 token 上下文、基准得分,以及它与 GPT-5.6 Sol、Astra、Luna 的真实关系。
Kie.ai是否安全靠谱:开发者视角解读一键式API聚合平台
一项真实的服务,拥有真实的 API、一百多个可用模型,以及一套比大多数平台更公平的计费模式。
Kie.ai 的真实成本:积分、各模型费率与细则全解析
深入解析 Kie.ai 的积分计费模型、各模型实际费率、免费额度价值,以及官方页面间价格不一致之处,帮助开发者判断何时使用聚合平台、何时直连官方更划算。
Kie.ai API 指南:密钥、Base URL 与 OpenAI 兼容首次请求
深入解析 Kie.ai API 的认证方式、OpenAI 兼容端点、基于任务的媒体生成流程、限流机制与常见陷阱,帮助开发者快速完成首次集成。
什么是 Qwen-Image-2.1?原生支持透明通道的 7B 开源图像模型
阿里 Qwen 团队开源的 Qwen-Image-2.1 把文生图与图像编辑合入一个 7B 模型,原生输出透明 RGBA,支持最多 10 张参考图与局部编辑。本文梳理其架构与许可证约束,并给出用 Apifox 测试图像生成 API 的落地思路。
访问 Jev 的 6 种方式:趁它还在 Early Access
Jev 仍在 early access,入口却不止候补名单。本文按“十分钟内能否发出真实请求”评析 Vercel AI Gateway、OpenRouter、直连 API、agent skill、官方 SDK 与本地复刻六条路线,并给出在 Apifox 中一次建好请求、双环境切换的做法。
GitHub Copilot impact dashboard 按表面统计采用:28 天里用过两次才算数
GitHub 给 Copilot impact dashboard 加上 28 天功能采用:按补全、Agent 编辑、主被动审查、Cloud Agent、CLI 和应用拆开,至少两天才计入。API 同步提供企业和组织聚合字段。
Claude Code 2.1.275:claude.ai 技能和插件默认同步进终端,改本地文件不会写回账户
Claude Code 2.1.275 把 claude.ai 已启用的技能和插件默认同步进登录终端。源在账户,本机只缓存;改 synced 目录不会写回。组织 required 插件在终端关不掉。
VS Code 1.138:Automations 默认打开,分享时只带走 prompt 和日程
VS Code 1.138 让 Agent Automations 默认可用,并可用 .automation.md 分享。文件只带名称、prompt 和日程,不带工作区、模型、权限和运行历史。导入后默认关闭。
Copilot CLI 1.0.86:自定义 Agent 要自己开门,才会去读 AGENTS.md
Copilot CLI 1.0.86 让自定义 Agent 通过 include-custom-instructions: true 选择读取 AGENTS.md、copilot-instructions.md 和 CLAUDE.md。默认不继承,主会话加载说明书的规则不变。
Jira Backlog 替代方案:如何构建 AI 时代的智能任务调度与分流机制
介绍如何针对 AI Agent 的特性构建动态 Backlog 分流机制,替代传统 Jira 手动排期,确保 Agent 始终高效处理最适合的任务分支。
Jira 工单闭环:从需求 Ticket 到代码 Pull Request 的全流程追溯
阐述如何建立需求工单(Jira/GitHub Issue)到 Pull Request 的全链路追溯机制,保证代码变更过程可审计、可回溯。
Jira 替代方案实践:Agentic 项目管理与人工审核成本评估
探讨智能体驱动项目管理(Agentic PM)作为 Jira 替代方案时的核心瓶颈,分析人工审核成本的必要性以及如何与传统 Jira 流程无缝平滑过渡。
从群聊消息到可追溯代码任务:如何将 IM 讨论转化为 AI Agent 任务
讲解如何捕获 Slack/飞书群聊中的技术讨论,自动转化为结构化的 Agent 任务并持续追踪代码交付。
如何将 GitHub Issue 指派给 AI Agent 并实现自动 PR 审查闭环
一步步指导如何将 GitHub Issue 分配给 Agent 自动编写代码并提交 PR,形成高效的闭环协作机制。
面向人机团队的 Jira 替代品:Jira、Linear 与 HiFox 深度对比
深入对比分析 Jira、Linear 与 HiFox 在人机混合团队中的优劣势,剖析传统 Jira 无法运行 Agent 的痛点,为寻找 Jira 替代品与协同工具的团队提供最佳选型指南。
Jev 使用指南:构建决策层,而不是再造一个聊天机器人
Jev 是 TypeSafe AI 的 System One 模型,只返回带概率的决策而不生成文本。本文讲解用它构建决策层的完整架构:LLM 生成、Jev 决策、代码控制、人工兜底,覆盖问题设计、状态管理、confidence 门槛与 Apifox 断言测试。
如何获取 Jev API Key(TypeSafe AI)并完成第一次调用
从 TypeSafe AI 控制台创建 Jev API Key,用 curl 与 Python SDK 发出第一次请求,读懂 noul、choice、score 三种概率字段,并在 Apifox 中把概率断言固化为测试场景。
Jev 开源替代方案盘点
盘点可自托管的 Jev 开源替代项目,对比它们的基础模型、原语、校准方式与硬件要求,并说明如何用本地 HTTP 接口接入现有测试流程。
如何获取 Brave Search API Key 并执行第一次搜索
在 Brave 开发者后台申请 Search API Key,用 curl 和 Python 发出第一次搜索查询,读懂套餐与速率限制,并在 Apifox 中把查询固化为可复用测试。
如何获取 Resend API Key 并发出第一封邮件
在 Resend 控制台创建 API Key,用 curl 与 Python SDK 发送第一封邮件,理解域名验证、错误码与沙箱限制,并在 Apifox 中调试与 mock。
如何获取 Perplexity API Key 并发出第一次 Sonar 请求
在 Perplexity 控制台创建 API Key,用 curl 与 Python 完成第一次 Sonar 请求,读懂引用来源与流式响应,并在 Apifox 中保存可复用测试。
如何获取 TMDB API Key 并查询 The Movie Database
申请 TMDB API Key 与读访问 Token,用 curl 和 Python 查询电影数据,理解两种鉴权方式的区别、速率限制与署名要求,并在 Apifox 中保存请求。
如何获取 YouTube API Key(YouTube Data API v3)并发出第一次请求
在 Google Cloud 控制台启用 YouTube Data API v3 并创建 API Key,用 curl 与 Python 发出第一次请求,理解配额、错误码与在 Apifox 中的测试方式。
如何获取 Grok API Key 并完成第一次调用(Grok 4.6)
在 xAI 控制台创建 Grok API Key,用 curl 与 Python 完成第一次调用,理解 token 计费与流式响应,并在 Apifox 中保存请求与断言。
如何获取 Anthropic API Key 并发出第一次 Claude 请求
从 Anthropic Console 创建 API Key,用 curl 与 Python SDK 完成第一次 Claude 请求,掌握 header 鉴权、错误码排查,并在 Apifox 中保存可复用的测试。
Cursor 上线 Projects:协调器不再写代码,而是调度上千个子 Agent
2026 年 9 月 10 日,Cursor 以 beta 推出 Projects:用协调器规划并委派云端子 Agent,共享上下文可跨数月,还能订阅 Slack、日程和 PR。
GitHub 为 AI Scan 上线组织级 REST API:PR 安全扫描能按仓库批量开关
2026 年 9 月 10 日,GitHub 为 Advanced Security 客户提供 AI Scan for pull request 的组织/仓库 REST API,可用 pr_scan 字段做规模化启用。
GitHub Copilot 为 JetBrains 上线企业托管沙箱:文件系统和联网开关由组织锁定
2026 年 9 月 8 日,Copilot for JetBrains 支持企业托管沙箱:启用、文件系统、网络、代理和 Keychain 可由组织锁定,用户无法削弱托管限制。
GitHub Code Quality 上线批量 Agentic autofix:一次最多把 25 条发现交给 Copilot
2026 年 9 月 9 日,GitHub Code Quality 支持一次将最多 25 条标准发现指派给 Copilot:Agent 在分支上修复、自检并打开 PR,且消耗 AI credits。
GitHub Copilot 代码审查会自动关闭已处理评论,Lite 档改为多 Agent 合稿
2026 年 9 月 11 日,Copilot code review 在重新审查时自动关闭已处理评论,Lite 档改用多 Agent 合稿,并在防火墙后调用 SDK shell 工具。
VS Code 1.137 上线 Automations:把重复的 Agent 任务写成可调度对象
VS Code 1.137 把 Automations 做成 Preview:保存 prompt、权限和小时/天/周调度,本机窗口或 Agent Host 在跑时才会到点执行。
OpenAI Agents API 公开测试:托管 Codex harness,沙箱和 ZDR 仍要你自己选
Agents API 公开测试把 Codex harness 收成托管会话:你选工具和沙箱,OpenAI 管编排与压缩。目前仅美国驻留,不支持 ZDR。
GitHub Copilot 应用接入 Jira 画布:工单进共享表面,再带进调查和 PR 准备
Copilot 应用把 Jira issue 放进共享 canvas,由人挑选后再把上下文带进调查、实现和 PR 准备。这与 Jira 里的 Copilot for Jira 不是同一条产品线。
Claude Code 上线 plugin eval:插件行为能进 CI 门禁,分数不再靠手测
Claude Code 2.1.269 新增 claude plugin eval:隔离跑插件用例、对比无插件基线,用 JSON/HTML 和 exit code 把技能是否触发从手测变成 CI 门禁。
Devin Fusion 进入 Desktop 与 CLI:选 lead 和 sidekick,而不是再换一个更贵模型
Cognition 把 Fusion 双模型 harness 做到 Devin Desktop 与 CLI:Fable 5.1 规划验收,SWE-2 执行。产品方数据显示任务花费可降约 36%–39%,但部分基准分数会下滑。
GitHub Copilot 用量报告分开计量 VS Code Agents 窗口,编辑器 Agent Mode 不再能冒充采用率
GitHub 为 Copilot usage metrics 增加 VS Code Agents 窗口字段:日活、会话数、用户消息和 used_vscode_agent。只覆盖独立窗口,不能与编辑器 Agent Mode 混用。
GitHub Copilot CLI 上线 HydraFusion:一次请求会被拆成起草、升级或交叉审查
HydraFusion 研究预览进入 Copilot CLI /experimental:按任务在 Single、Cascade、Critique 间路由。按底层模型标准费率计费,官方建议先用于第一轮单提示编码任务。
Codex CLI 0.154.0 上线实验性 worktree:新会话先换隔离检出,再改代码
Codex CLI 0.154.0 为新会话和 fork 会话提供实验性 --worktree / /worktree:改动落到隔离检出,再浏览和恢复。不替代审查,也不默认清理目录。
GPT-Live 1 进入 API:语音继续说,推理和工具要另接后端
GPT-Live 1 于 2026-09-10 在 API 正式可用:全双工语音走 v1/live/sessions,推理和工具交给 Responses 或自建后端。语音 $0.05/分钟按秒计,打断说话不会自动取消后端工作。
Claude Code 2.1.267 给 effort 加硬顶:Bedrock 和 Vertex 也不能再拉满
Claude Code 2.1.267 新增 maxEffortLevel:所有 provider(含 Bedrock、Vertex、Foundry)的 effort 可被硬顶。用户仍可选更低档;command/skill/subagent 的 effort frontmatter 在钉死默认模型上不再被忽略。
GitHub Copilot Auto 增加三档:成本与质量可以写成策略,模型仍按 prompt 选
9 月 14 日 GitHub 给 Copilot Auto 加上 efficiency、balance、intelligence 三档。三档共用模型池,每个 prompt 仍单独路由;计费跟实际模型走,付费 Auto 用量继续打九折。
Claude Code 2.1.271:Fast mode 进入 Remote,加速开关终于能带到云端 runner
Claude Code 2.1.271 让 Fast mode 进入 cloud 与自托管 Remote 会话。它仍是 Opus 加速配置,不是新模型;订阅只走 usage credits,Bedrock/Vertex/Foundry 不可用。
Claude Code 2.1.271:命令自带域名名单,auto mode 上网不再等于整段会话放行
Claude Code 2.1.271 在 auto mode 沙箱里为 Bash/PowerShell/Monitor 增加 per-command allowed_domains:主机随命令送审,只为这一次打开。
Codex Python SDK 0.154.0:外部消息能进 turn,但权限仍停在工具这一层
Codex Python SDK 0.154.0 让 ExternalMessage 进入 run()/turn():可开新 turn 或加入进行中的 turn,权限是 tool-level,不授予用户授权。
Claude Code 2.1.273:Remote Control 会话能从 App 分叉,后台仍在你的电脑跑
2.1.273 允许从 Claude App 分叉 Remote Control 会话。新会话在你的电脑后台跑,原会话继续;这不是云端代跑。
GitHub Copilot 给仓库自定义属性建议允许值,ruleset 词表不用从零编
组织或企业新建仓库自定义属性时,Copilot 会建议允许值。它只帮你起词表,不会自动给仓库打标,也不会生成 ruleset。
Gemini 3.8 Live 进入 GA:低延迟语音走默认模型,多步工具要换 Extended Thinking
gemini-3.8-live 适合低延迟对话;需要后台推理和慢工具时,应改用 gemini-3.8-live-extended-thinking,并改看 interaction_status。
Devin Cloud 上线 macOS VM:iOS 会话能进模拟器,真机和容器仍要人接管
Devin 云端会话可跑在 macOS VM 上,预装 Xcode 与 iOS Simulator。能做模拟器验收,但不能替代真机、USB 和硬件虚拟化。
GitHub Copilot 加预算申请进入 GA:额度用尽后可当场提交,审批通过立刻恢复 credits
GitHub 于 2026 年 9 月 16 日把 Copilot 加预算申请做成 GA。成员撞到 AI credits 上限可当场申请,组织或企业审批人改金额并批准后立刻恢复访问。仅限 Business 与 Enterprise 按量计费。
GitHub AI Scan 不再要求 CodeQL default setup:PHP 和 Terraform 仓库也能扫 PR
2026 年 9 月 16 日起,GitHub AI Scan 不再要求仓库先开 CodeQL default setup。已启用 code scanning 和 AI Scan 的合格 PR 会出发现,但仍是建议信号,不能写入合并门禁。
Claude Code 2.1.274:VS Code 窗口重载后,被打断的那一步能接着跑
Claude Code 2.1.274 为 VS Code 增加 Continue After Reload:窗口重载打断的步骤会续跑并在聊天中标记,也可关闭。transcript 损坏仍要走 /rewind,不是同一条能力。
Copilot CLI 1.0.85:沙箱可加域名名单,不必拆掉已配置的上游代理
Copilot CLI 1.0.85 为 /sandbox 增加网络主机允许/拒绝规则,且不替换已配置的上游代理。托管沙箱可在组织允许时按会话关闭,relaxed 重试仍执行网络策略。
OpenAI 的 Agentic Software Factory 是什么?Codex 流水线拆解
按框拆解 OpenAI agentic software factory 图:哪些已经在 Codex 产品里,哪些只是内部系统,以及外部团队真正能复制的那一关——CI。
如何用 Codex、CI 和 Apifox 接口测试搭建自己的 Software Factory
把 OpenAI agentic software factory 图缩小成小团队本周就能跑的闭环:Codex 对着目标改代码,CI 跑 Apifox 接口测试,按风险分层审查,再放到 feature flag 后面发布。