GitHub Copilot impact dashboard 按表面统计采用:28 天里用过两次才算数
GitHub 给 Copilot impact dashboard 加上 28 天功能采用:按补全、Agent 编辑、主被动审查、Cloud Agent、CLI 和应用拆开,至少两天才计入。API 同步提供企业和组织聚合字段。
Claude Code 2.1.275:claude.ai 技能和插件默认同步进终端,改本地文件不会写回账户
Claude Code 2.1.275 把 claude.ai 已启用的技能和插件默认同步进登录终端。源在账户,本机只缓存;改 synced 目录不会写回。组织 required 插件在终端关不掉。
VS Code 1.138:Automations 默认打开,分享时只带走 prompt 和日程
VS Code 1.138 让 Agent Automations 默认可用,并可用 .automation.md 分享。文件只带名称、prompt 和日程,不带工作区、模型、权限和运行历史。导入后默认关闭。
Copilot CLI 1.0.86:自定义 Agent 要自己开门,才会去读 AGENTS.md
Copilot CLI 1.0.86 让自定义 Agent 通过 include-custom-instructions: true 选择读取 AGENTS.md、copilot-instructions.md 和 CLAUDE.md。默认不继承,主会话加载说明书的规则不变。
Cursor 上线 Projects:协调器不再写代码,而是调度上千个子 Agent
2026 年 9 月 10 日,Cursor 以 beta 推出 Projects:用协调器规划并委派云端子 Agent,共享上下文可跨数月,还能订阅 Slack、日程和 PR。
GitHub 为 AI Scan 上线组织级 REST API:PR 安全扫描能按仓库批量开关
2026 年 9 月 10 日,GitHub 为 Advanced Security 客户提供 AI Scan for pull request 的组织/仓库 REST API,可用 pr_scan 字段做规模化启用。
GitHub Copilot 为 JetBrains 上线企业托管沙箱:文件系统和联网开关由组织锁定
2026 年 9 月 8 日,Copilot for JetBrains 支持企业托管沙箱:启用、文件系统、网络、代理和 Keychain 可由组织锁定,用户无法削弱托管限制。
GitHub Code Quality 上线批量 Agentic autofix:一次最多把 25 条发现交给 Copilot
2026 年 9 月 9 日,GitHub Code Quality 支持一次将最多 25 条标准发现指派给 Copilot:Agent 在分支上修复、自检并打开 PR,且消耗 AI credits。
GitHub Copilot 代码审查会自动关闭已处理评论,Lite 档改为多 Agent 合稿
2026 年 9 月 11 日,Copilot code review 在重新审查时自动关闭已处理评论,Lite 档改用多 Agent 合稿,并在防火墙后调用 SDK shell 工具。
VS Code 1.137 上线 Automations:把重复的 Agent 任务写成可调度对象
VS Code 1.137 把 Automations 做成 Preview:保存 prompt、权限和小时/天/周调度,本机窗口或 Agent Host 在跑时才会到点执行。
OpenAI Agents API 公开测试:托管 Codex harness,沙箱和 ZDR 仍要你自己选
Agents API 公开测试把 Codex harness 收成托管会话:你选工具和沙箱,OpenAI 管编排与压缩。目前仅美国驻留,不支持 ZDR。
GitHub Copilot 应用接入 Jira 画布:工单进共享表面,再带进调查和 PR 准备
Copilot 应用把 Jira issue 放进共享 canvas,由人挑选后再把上下文带进调查、实现和 PR 准备。这与 Jira 里的 Copilot for Jira 不是同一条产品线。
Claude Code 上线 plugin eval:插件行为能进 CI 门禁,分数不再靠手测
Claude Code 2.1.269 新增 claude plugin eval:隔离跑插件用例、对比无插件基线,用 JSON/HTML 和 exit code 把技能是否触发从手测变成 CI 门禁。
Devin Fusion 进入 Desktop 与 CLI:选 lead 和 sidekick,而不是再换一个更贵模型
Cognition 把 Fusion 双模型 harness 做到 Devin Desktop 与 CLI:Fable 5.1 规划验收,SWE-2 执行。产品方数据显示任务花费可降约 36%–39%,但部分基准分数会下滑。
GitHub Copilot 用量报告分开计量 VS Code Agents 窗口,编辑器 Agent Mode 不再能冒充采用率
GitHub 为 Copilot usage metrics 增加 VS Code Agents 窗口字段:日活、会话数、用户消息和 used_vscode_agent。只覆盖独立窗口,不能与编辑器 Agent Mode 混用。
GitHub Copilot CLI 上线 HydraFusion:一次请求会被拆成起草、升级或交叉审查
HydraFusion 研究预览进入 Copilot CLI /experimental:按任务在 Single、Cascade、Critique 间路由。按底层模型标准费率计费,官方建议先用于第一轮单提示编码任务。
Codex CLI 0.154.0 上线实验性 worktree:新会话先换隔离检出,再改代码
Codex CLI 0.154.0 为新会话和 fork 会话提供实验性 --worktree / /worktree:改动落到隔离检出,再浏览和恢复。不替代审查,也不默认清理目录。
GPT-Live 1 进入 API:语音继续说,推理和工具要另接后端
GPT-Live 1 于 2026-09-10 在 API 正式可用:全双工语音走 v1/live/sessions,推理和工具交给 Responses 或自建后端。语音 $0.05/分钟按秒计,打断说话不会自动取消后端工作。
Claude Code 2.1.267 给 effort 加硬顶:Bedrock 和 Vertex 也不能再拉满
Claude Code 2.1.267 新增 maxEffortLevel:所有 provider(含 Bedrock、Vertex、Foundry)的 effort 可被硬顶。用户仍可选更低档;command/skill/subagent 的 effort frontmatter 在钉死默认模型上不再被忽略。
GitHub Copilot Auto 增加三档:成本与质量可以写成策略,模型仍按 prompt 选
9 月 14 日 GitHub 给 Copilot Auto 加上 efficiency、balance、intelligence 三档。三档共用模型池,每个 prompt 仍单独路由;计费跟实际模型走,付费 Auto 用量继续打九折。
Claude Code 2.1.271:Fast mode 进入 Remote,加速开关终于能带到云端 runner
Claude Code 2.1.271 让 Fast mode 进入 cloud 与自托管 Remote 会话。它仍是 Opus 加速配置,不是新模型;订阅只走 usage credits,Bedrock/Vertex/Foundry 不可用。
Claude Code 2.1.271:命令自带域名名单,auto mode 上网不再等于整段会话放行
Claude Code 2.1.271 在 auto mode 沙箱里为 Bash/PowerShell/Monitor 增加 per-command allowed_domains:主机随命令送审,只为这一次打开。
Codex Python SDK 0.154.0:外部消息能进 turn,但权限仍停在工具这一层
Codex Python SDK 0.154.0 让 ExternalMessage 进入 run()/turn():可开新 turn 或加入进行中的 turn,权限是 tool-level,不授予用户授权。
GitHub Copilot 给仓库自定义属性建议允许值,ruleset 词表不用从零编
组织或企业新建仓库自定义属性时,Copilot 会建议允许值。它只帮你起词表,不会自动给仓库打标,也不会生成 ruleset。
Devin Cloud 上线 macOS VM:iOS 会话能进模拟器,真机和容器仍要人接管
Devin 云端会话可跑在 macOS VM 上,预装 Xcode 与 iOS Simulator。能做模拟器验收,但不能替代真机、USB 和硬件虚拟化。
GitHub Copilot 加预算申请进入 GA:额度用尽后可当场提交,审批通过立刻恢复 credits
GitHub 于 2026 年 9 月 16 日把 Copilot 加预算申请做成 GA。成员撞到 AI credits 上限可当场申请,组织或企业审批人改金额并批准后立刻恢复访问。仅限 Business 与 Enterprise 按量计费。
GitHub AI Scan 不再要求 CodeQL default setup:PHP 和 Terraform 仓库也能扫 PR
2026 年 9 月 16 日起,GitHub AI Scan 不再要求仓库先开 CodeQL default setup。已启用 code scanning 和 AI Scan 的合格 PR 会出发现,但仍是建议信号,不能写入合并门禁。
Claude Code 2.1.274:VS Code 窗口重载后,被打断的那一步能接着跑
Claude Code 2.1.274 为 VS Code 增加 Continue After Reload:窗口重载打断的步骤会续跑并在聊天中标记,也可关闭。transcript 损坏仍要走 /rewind,不是同一条能力。
Copilot CLI 1.0.85:沙箱可加域名名单,不必拆掉已配置的上游代理
Copilot CLI 1.0.85 为 /sandbox 增加网络主机允许/拒绝规则,且不替换已配置的上游代理。托管沙箱可在组织允许时按会话关闭,relaxed 重试仍执行网络策略。
OpenAI 的 Agentic Software Factory 是什么?Codex 流水线拆解
按框拆解 OpenAI agentic software factory 图:哪些已经在 Codex 产品里,哪些只是内部系统,以及外部团队真正能复制的那一关——CI。
如何用 Codex、CI 和 Apifox 接口测试搭建自己的 Software Factory
把 OpenAI agentic software factory 图缩小成小团队本周就能跑的闭环:Codex 对着目标改代码,CI 跑 Apifox 接口测试,按风险分层审查,再放到 feature flag 后面发布。
如何使用 Gemini 3.8 Live API:免费档、定价与 Extended Thinking
Gemini 3.8 Live 与 Live Extended Thinking 于 9 月 15 日上线,两款模型都提供免费 token。本文梳理 WebSocket 接入、定价测算,以及如何用 Apifox 先看原始协议再写客户端。
Anthropic 威胁报告:从 2 亿次被盗 Claude 交互里抽出的 7 条 API 安全教训
拆解 Anthropic 2026 年 9 月威胁报告:蒸馏、假转售商、被盗 API key 和 Agent 工程流。七条可落地的 API 安全动作,面向把 AI key 当生产凭据的团队。
DeepSeek-V4.1-Flash Vision API:如何把图像发给 DeepSeek 原生多模态模型
DeepSeek-V4.1-Flash 把视觉收进 deepseek-flash。讲清三种送图方式、detail 参数、计费,以及如何在 Apifox 里验证旧模型名和新模型名行为一致。
如何免费使用 DeepSeek-V4.1-Flash:2026 年所有可行选项
梳理 DeepSeek-V4.1-Flash 的免费和几乎免费路径:聊天应用、MIT 权重、路由器、工具试用额度和官方 API。附非高峰账单算法,以及用 Apifox 防止静默换模型。
GitHub Copilot 为企业 Agent 上线托管权限:shell、文件和联网都能被中心拦截
2026 年 9 月 9 日,GitHub 宣布 Copilot Business / Enterprise 管理员可集中设定 Agent 操作的拦截、人工审批或放行,且用户本地自动批准无法削弱这些限制。
使用 ETag 和 Cache-Control 进行 API 缓存:条件请求如何减少数据传输量
重复请求耗尽 API 带宽?本文详解 Cache-Control 与 ETag 的协同机制,教你巧用条件请求返回 304 响应消除传输载荷,轻松削减高达 90% 的网络流量开销!
工具 Schema 设计:帮助 AI Agent 选择正确的接口
AI Agent 选错工具往往不是模型不够聪明,而是 Schema 缺乏明确区分。本文详解如何通过精确命名、消歧描述与参数约束优化 Schema 设计,让 Agent 准确调用正确接口。
面向 AI Agent 的 API 错误设计:如何设计可恢复的错误响应
含糊的API错误易使AI Agent陷入无限重试。面向Agent的错误设计需通过结构化响应清晰解答“责任归属、是否重试、如何修改”三大核心问题,提供明确的操作指令,助力Agent实现高效自我修复。
如何用 curl、Python 和 Node 调用 gpt-image-2.5 API(Flare 与 Sunburst)
用 curl、Python 和 Node 调用 gpt-image-2.5 API:generations、带参考图的 multipart 编辑、Responses API 工具、流式,以及用 usage 计算真实费用。
如何免费使用 ChatGPT Images 2.5(各档位与开发者路径)
ChatGPT Images 2.5 在各套餐可用。本文给出免费档步骤、Sketch/模板/评论、Free/Go/Plus/Pro 差异,以及开发者 API 的真实费用路径。
GPT-Image-2.5 Flare vs Sunburst vs gpt-image-2:怎么选,每张图多少钱
对比 Flare、Sunburst 和 gpt-image-2 的 token 单价、五种质量档每图费用、标签重映射和迁移清单,帮你按延迟和编辑精度做选择。
ChatGPT Images 2.5 是什么?
OpenAI 于 2026 年 9 月 8 日发布 ChatGPT Images 2.5,并拆成 Flare 与 Sunburst 两个 API 模型。本文梳理可用性、四个新功能、质量档重标、价格和社区实测。
VS Code 1.136 上线 Agent Merge 预览:把 PR 收尾变成可配置的自动循环
VS Code 1.136 于 9 月 2 日发布 Agent Merge 预览:代理可持续处理 PR 的评审意见、必需 CI 失败和合并冲突,并在配置后合并或进入队列。真正变化的是 PR 收尾的等待与切换成本,但权限、费用和人工复核仍不能省。
GPT-6 Astra 进入 GitHub Copilot:长任务编码多了“规划—验证”这一层
GPT-6 Astra 已在 GitHub Copilot 中可选。本文拆解它对跨文件修复、CI 验证与企业模型策略的实际影响和试点边界。
Gemini 3.8 Flash 上线:低价推理模型开始重做代码代理的“连续任务”
Google 于 9 月 2 日发布 Gemini 3.8 Flash,主打软件工程、代理任务和多步推理;真正值得关注的不是单次回答,而是能否用较低单价把规划、工具调用、测试反馈连成一条更长的任务链。
Google Fairwind:漏洞修复被放进受控闭环,Gemini 3.8 Flash Cyber 暂不开放给所有人
Google 9 月 2 日公布 Fairwind 计划,将 Gemini 3.8 Flash Cyber 与 CodeMender 组合,用于在组织受保护环境中发现、验证和生成漏洞修复;它面向可信防御者,重点是缩短修复循环并保留权限与人工接管。
Cursor 推出 Self-hosted machines:云端代理开始在你的内网执行工具调用
Cursor 9 月 2 日发布 Self-hosted machines,让 Cloud Agents 在客户自有网络中执行工具操作,并提供个人机器、团队 worker pools、外部沙箱和 Linux/macOS computer use;焦点从模型能否改代码推进到代理在哪里运行、谁管理执行环境。
GPT-6 Astra 发布:多步工具调用开始支持“中途驾驶”,但验收仍要靠团队任务
OpenAI 9 月 3 日介绍 GPT-6 Astra,重点覆盖编码、研究、电脑操作和复杂多步工作;Responses API 支持异步工具调用与中途 steering。团队应验证长任务编排是否减少返工,而不是只看一次性 benchmark。
Claude Fable 5.1 上线:代码审查与长时项目成为模型能力的主战场
Anthropic 9 月 1 日发布 Claude Fable 5.1,并将其定位在高级编码、代码审查、性能工作和长时自治项目;团队应把连续上下文带来的收益与预算、审阅和回滚一起验证。
Cursor 云端 Agent 接入 Vercel Sandbox:团队可以把执行环境搬到自己的基础设施上
Vercel 于 2026 年 9 月 3 日披露,Cursor Cloud Agents 可以在 Vercel Sandbox 中执行。真正变化不只是换了运行时,而是把代码修改、命令执行和测试放进团队可控制的隔离环境,同时保留 Cursor 的 Agent 循环。
Muse Spark 1.3 发布:少一点工具调用,不等于少一点人工把关
Meta AI Research 于 2026 年 9 月 2 日发布 Muse Spark 1.3,称其面向长任务和编码工作流,并报告相较 1.2 少约 20% 工具调用、少约 25% token。真正需要评估的是效率、成本与数据治理如何同时变化。
VS Code 1.135 加入实验性 Rubber Duck:让 Coding Agent 在交付前多一次复核
GitHub 在 8 月 31 日汇总发布的 VS Code Copilot 更新中加入实验性 /rubber-duck:开发者可在 Copilot Agent Host 会话里请求第二意见,把遗漏细节和边界情况纳入交付前复核。
微软把 AI Agent 安全检查推进到开发流水线:从红队扫描到五个运行时控制点
微软 9 月 1 日的 Responsible AI 文章把 AI Red Teaming Agent、RAMPART、ASSERT 与 Agent Control Specification 放进同一条生命周期路径:先发现风险,再将失败回归化,并在输入、模型、状态、工具和输出节点施加控制。
AIR 走出隐身:给 Agent 的 Skills、MCP 和插件加一层上下文防火墙
AIR 于 9 月 1 日宣布走出隐身,主打在 Skills、MCP、插件、网站和企业数据进入 Agent 上下文前进行筛选,并在更新和运行阶段持续复核。它解决的是 Agent 软件供应链的准入与上下文污染问题,但产品扫描器仍标为 early access,公开性能数据和部署细节尚待验证。
VS Code Agent Host:让持久编码会话跨编辑器、浏览器与远程主机继续运行
VS Code 于 8 月 26 日公布 Agent Host:会话由独立 Host 持有,编辑器、Agents 窗口、浏览器和远程客户端可连接同一任务。本文拆解它对长任务连续性、审查和远程开发的实际影响。
GitHub Agentic Workflows 加入 cooldown 与 stop-after:Agent 自动化开始有“停机线”
GitHub Agentic Workflows 8 月 31 日周报介绍 v0.87.x 预发布线的 cooldown、stop-after 与工具 schema 诊断,重点不是让 Agent 更强,而是让触发频率、生命周期和异常边界变得可配置、可审计。
OrcaRouter 发布了 GLM-5.3-Flash 的去审查权重
未审查 GLM-5.3-Flash 如何降低对合法开发工作的过度拒答,并介绍评估、部署和审计方法。
2026 年升级 Coding Agent 的 5 个开源工具
介绍 agency-agents、Agent-Reach、Orca、OpenMontage 和 codebase-memory-mcp,说明它们的能力、限制与可验证性缺口。
让 AI Agent 免费访问互联网
介绍 Agent-Reach 如何通过免费访问路径接入多个平台、配置 fallback chain,并讨论 Cookie、可靠性和研究记录。
用并行 Worktree 同时运行 Codex、Claude Code 和 OpenCode
介绍 Orca 如何用隔离 git worktree 并行运行多个编码 Agent,并讨论 diff 验证、Token 成本和团队记录。
将 300 多个 AI 专家安装到 Claude Code 和 Cursor
深入介绍 agency-agents 的人格文件、分类安装方式,以及人格提示词与 API 契约、团队协作之间的边界。
把 Claude Code 或 Cursor 变成视频制作工作室
介绍 OpenMontage 的视频制作流水线、Backlot 审批门、Provider 集成、成本控制和 AGPL-3.0 许可注意事项。
让 AI Agent 的 Token 账单降低 99%
介绍 codebase-memory-mcp 如何用知识图谱回答代码结构问题,降低 Token 消耗,并说明本地安全与 API 契约边界。
GitHub Copilot 进入 Slack:从故障线程到可审查 Pull Request
GitHub 8 月 21 日宣布 Copilot 的 Slack 体验:在对话中提及 @GitHub,Agent 可调查问题、实现并验证代码修改,再打开 Pull Request。本文拆解协作入口、权限和人工审查边界。
Cursor Cloud Agents 支持无仓库起步:先做可交互原型,再保存到 Origin
Cursor 8 月 27 日允许 Cloud Agents 在没有连接 GitHub 或其他 SCM 时开始工作,满意后再创建 Origin 仓库。本文说明这条路径如何减少原型启动摩擦,以及为什么它仍不能跳过工程治理。
Excel 的 Copilot 开始用 Python 做分析:结果直接回到工作簿
微软 8 月 25 日的 Copilot release notes 列出 Excel 的 Python 编辑能力,覆盖 Windows、Mac 和 Web。本文解释它如何把分析结果写回工作簿,以及许可证、rollout 和复核要求。
Amazon Redshift 接入 AWS Agent Toolkit:让数据仓库操作进入 Coding Agent
AWS 8 月 27 日宣布 Redshift 接入 Agent Toolkit,Claude Code、Kiro 和 Cursor 可借助 MCP 与 skills 辅助数据仓库构建、查询、排障和迁移。本文拆解工作流与 IAM 边界。
Warp 把 Coding Agent 做成可测量的“软件工厂”:先评分,再让 Agent 提议改配置
Warp 8 月 27 日介绍闭环云端软件工厂:用 factory.yaml 版本化 Agent、技能和路由,用 scorer 评估正确性、成本与表达,再由 self-improvement Agent 以 diff 提议改动,最终仍由人审查并合并。
Microsoft Foundry Toolkit 8 月连发四版:工具箱、A2A 与 Agent Inspector 串起调试闭环
Microsoft Foundry Toolkit for VS Code 在 8 月发布 1.6.7 至 1.6.10:Prompt Agent 可复用集中管理的工具箱,A2A 连接进入预览,Hosted Agent 支持用户隔离,Agent Inspector 可追踪延迟、模型、推理和工具调用。
一份 llms.txt 就能触发安装?研究揭示 Coding Agent 的文档供应链边界
Ars Technica 8 月 27 日报道一项针对 6,214 个域名的研究:研究人员在 120 个站点的 llms.txt 或 llms-full.txt 中发现指向未注册包或域名的内容,并观察到 Claude、Codex 和 Hermes 参与了相关安装链路。对开发团队而言,文档必须被当作不可信输入,而不是天然的执行授权。
OpenAI 计划结束向 Cursor 供模:开发团队现在该盘点哪些工作流
OpenAI 计划于 2026 年 11 月 12 日结束向 Cursor 直接供模,最终日期仍需确认。本文按官方帮助中心拆解本地 API、Codex 扩展和 AI 网关三条替代路径,以及 Cloud Agent 等功能的覆盖边界。
Claude Code v2.1.251 发布:模型切换、子代理流和会话成本终于可见
Claude Code v2.1.251 新增模型切换 Hook、前台子代理实时流、会话缓存与支出可见性,长任务从“等待结果”变成可观察、可暂停、可复核的工程流程。
Google Meet 让会议室触控屏直接控制 Gemini 记笔记
Google Meet 从 8 月 31 日起在 Early Preview 中把 Gemini 记笔记的开始、暂停、恢复和停止放到会议室触控控制器上,但仍受硬件、授权和人工复核约束。
CodeBuddy IDE 4.11.3:长对话和 MCP 出错时,开发者更容易看清日志
CodeBuddy IDE 4.11.3 修补长对话上下文压缩、MCP 异常白屏和服务端中断静默结束等问题,本文拆解这些可靠性变化如何影响从调试到交付的 AI Coding 工作流。
Caddi 发布 Loop Studio:业务人员演示任务后,后台自动化怎样保留可治理的刹车
Caddi 8 月 24 日发布面向后台流程的 AI Agent 与 Loop Studio。产品把流程发现、屏幕演示、例外追问、权限范围和执行记录放在一起,关键仍是人如何批准变更。
Visa 扩展开源 VVAH:漏洞扫描开始闭环生成补丁并做对抗验证
Visa 扩展开源 Vulnerability Agentic Harness,把发现、分诊、候选修复和对抗验证接成闭环;但 validated 不等于编译、测试或合并通过,团队仍需独立验证。
Harness 发布 Agent-Ready Code Repository 与 AI Code Review:把 Agent PR 纳入风险门禁
Harness 推出 Agent-Ready Code Repository 与 AI Code Review,将代理权限、风险分组、交付上下文和 AI Checks 接入同一条 PR 流程,重点解决 Agent 产出规模带来的审查与门禁问题。
Cursor Cloud Agents 支持从零开始建仓库:原型先行,交接仍由人决定
Cursor Cloud Agents 新增 Start from scratch:先让 Agent 生成并预览项目,确认后再创建 private 或 internal 仓库;它降低原型起步摩擦,但不替代权限、测试和发布治理。
如何测试和调试 Grok 4.6 API 请求(流式传输、工具调用和错误处理)
集成Grok 4.6时常遇到流式卡顿、工具调用报错等棘手问题。本文教你如何用Apifox配置环境,直观调试SSE流,断言Tool Call数据,并做好错误处理与Mock测试,助你打造稳定的AI Agent。
如何使用 DeepSeek V4 Pro API 的 Function Calling
本文详解如何使用 DeepSeek V4 Pro 的 Function Calling 构建 Agent。通过 Python SDK 实操,并结合前缀缓存实现百倍降本,教你打造高效的 AI 智能体。
DeepSeek API 即将涨价:开发者的成本优化指南
DeepSeek API 宣布即将大幅涨价!本文为你提供五大核心优化指南,包括利用 Prompt 缓存、按任务路由及低谷期批处理等实用策略,助你轻松应对成本危机,锁住开发预算。
如何使用 DeepSeek V4 Pro 0813 API?
旗舰模型 DeepSeek V4 Pro 0813 正式版来袭!本文详解如何通过 OpenAI SDK 快速调用、配置思考模式与极度省钱的 Prompt 缓存机制,助你高效接入 1M 超长上下文。
如何去除 Claude 水印?
Claude生成的文本含有不可见水印,甚至复制粘贴都无法消除?本文深入剖析Claude水印的运作原理,并手把手教你如何使用开源工具watermarks-remover安全、高效地清除这些隐形标记与文件元数据。
如何使用 Gemini 3.7 Flash API?
谷歌重磅发布 Gemini 3.7 Flash!本文为你提供保姆级上手指南,涵盖 API 密钥获取、cURL 调用、代码部署及 Apifox 调试,助你轻松玩转这款超高性价比的 AI 旗舰模型。
Gemini 3.7 Flash 有哪些新变化?特性、基准测试及 API 访问
距离上代仅三周,谷歌重磅推出Gemini 3.7 Flash!新模型在编程和智能体基准测试中表现惊艳,且API价格腰斩。一文带你快速掌握其新特性、基准数据与接入指南!
Gemini 3.7 Flash 定价详解:在价格翻倍前锁定费率
谷歌推出 Gemini 3.7 Flash 模型,虽然限时费率极具性价比,但 2027 年价格将翻倍。本文详细拆解两个阶段的收费、真实场景成本估算及 5 大降本策略,助你精准规划 API 预算。
什么是 GLM-5.3?智谱开源代码模型详解
智谱AI重磅发布GLM-5.3代码模型!凭借卓越的后训练优化,其终端Agent与安全分析能力飙升,直逼Claude顶尖水平,且即将开源权重。一文带你快速掌握其核心优势与API接入指南。
自托管 GLM-5.3:为开源权重发布做好准备
智谱 AI 即将开源 744B 的 GLM-5.3 大模型!本文教你在权重正式发布前,如何做好硬件选型、推理服务栈准备,并利用 Apifox 构建回归基线,为私有化自托管做好万全准备。
GPT-5.6 Sol 在 Vercel AI Gateway 上半价促销
OpenAI旗舰模型限时特惠!Vercel AI Gateway对GPT-5.6 Sol提供50%折扣,输入价低至$2.50/百万Token。手把手教你两分钟完成无缝切换,轻松薅上这波旗舰大模型羊毛!
什么是 Cursor Origin?专为 AI Agent 打造的 Git 托管平台详解
Cursor 推出专为 AI Agent 打造的 Git 托管平台 Origin!支持与 GitHub 双向同步,旨在变革版本控制。本文深度剖析其核心功能、局限性以及对 API 开发工作流的影响。
多智能体交接:在子智能体之间传递上下文
多智能体协同中,如何防止上下文丢失?本文深度剖析智能体交接的三种方式、常见故障场景及测试策略,教你构建高效结构化交接,避免重复调用与信息遗失。
AI Agent 的 API 版本管理:当破坏性变更来袭
API变更常导致AI Agent静默出错或胡乱发挥。本文剖析Agent面临的API漂移风险,并分享如何通过版本锁定、契约测试与运行时校验,在运行前精准拦截接口故障,保障AI应用稳定性。
AI Agent 的 OAuth 实践:安全地代表用户执行操作
AI Agent 如何安全地代表用户执行操作?本文深入解析适合 Agent 的 OAuth 流程、安全存储及刷新机制,教你构建低风险的委派授权体系,防范凭证泄露。
工具数据模型设计:帮助 AI Agent 选择正确的接口
AI Agent 老是选错 API?本文教你如何优化数据模型,通过精准命名、差异化描述和参数设计,大幅降低 Agent 的工具调用错误率,让 AI 准确识别和调用接口!
AI Agent 与耗时 API 调用:轮询还是 Webhook
耗时API常让AI Agent崩溃。本文教你如何优化异步API设计,通过外部轮询和合理使用Webhook规范Agent行为,解决其过早声明成功或高频轮询的难题,让异步任务处理更稳定。
针对 AI Agent 的 API 错误设计:可恢复的错误
AI Agent 遇到 API 错误总是无限重试或直接放弃?本文为您提供针对 Agent 的 API 错误设计指南,教您使用结构化格式与引导指令,让 Agent 具备自动修复与恢复任务的能力。
AI Agent 上下文窗口:精简臃肿的 API 响应
API 冗余响应会挤爆 AI Agent 上下文窗口,导致运行崩溃。本指南提供三大优化策略:利用字段选择过滤冗余、严格限制列表长度,以及在工具层裁剪第三方数据,帮你的 Agent 瘦身,显著降本增效!
从 OpenAPI 到 AI Agent 工具:免去手写封装的烦恼
别再手写 AI Agent 的工具定义了!本文详解如何将 OpenAPI 规范自动生成 Agent 工具,实现数据模型同步,彻底解决接口漂移和调用错误,大幅提升智能体开发效率。
AI Agent 幂等性:防止因重试导致重复扣款
AI Agent 因重试机制易引发重复扣款风险。本文详解如何利用幂等键(Idempotency Key)设计安全的 API 工具调用,从根本上避免重复写入与计费错误。