ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Claude Platform 三件套 GA 实战:用 Computer Use、Skills API、Files API 拼出生产级智能体

Claude Platform 三件套 GA 实战:用 Computer Use、Skills API、Files API 拼出生产级智能体 1. 从「能聊」到「能干活」三件套 GA 到底解决了什么Claude Platform 这次把 Computer Use、Skills API、Files API 三个能力推到 GA外加一个 browser use tool本质上是在回答一个工程问题智能体怎么从「对话玩具」变成「生产工具」。我把它拆成三段来看会更清楚——执行、决策依据、交付物。Computer Use 负责执行让模型能操作那些没有 API 的老系统Skills API 负责决策依据把团队沉淀的方法论打包成可加载的技能Files API 负责交付物让文件一次上传、反复引用、还能取回产出。这三段拼起来才是一条能跑通的闭环。如果你之前自己拼过智能体应该知道那种痛截图识别要自己接视觉模型点击坐标要自己算上下文里的文档每次请求都得重传团队流程只能靠一大段 system prompt 硬塞。现在这三件套把这几块都收进了平台层你只需要声明工具、附加技能、引用 file_id剩下的调度和沙箱执行交给平台。对做企业内自动化、理赔审核、报表生成这类场景的团队来说这是实打实的省事。适合谁跟我的判断是三类人一是手里有 legacy 系统、没有 API 但必须自动化的后端或 RPA 工程师二是想把团队 SOP 变成可复用资产的业务系统开发者三是已经在用 Claude 做文档处理、想进一步降低 token 成本和上下文管理复杂度的团队。如果你只是做简单问答这三件套暂时用不上但只要你的任务涉及「操作界面 专业流程 文件进出」就值得认真看一遍。下面我不铺概念直接按工程落地顺序走先讲接入前置再给可复制的配置片段然后跑一次端到端验证最后把常见报错挨个排掉。全程用 TaoToken 作为统一入口Base URL 和 Key 的配置我会写全你照着改就能跑。2. 接入前置Base URL、Key 与三件套的调用姿势在动手写代码之前先把接入层理清楚。TaoToken 提供的是兼容 Anthropic 风格的 API 入口官网在 https://taotoken.net/?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewriteutm_content API 根地址是 https://taotoken.net/api 。注意这个 API 地址后面不加任何 UTM 参数配置的时候别画蛇添足。你需要准备的东西其实就三样一个可用的 API Key、正确的 Base URL、以及你要调用的 Model ID。这三样我习惯叫它「三件套配置」因为缺任何一个请求都会失败而且报错信息往往不直观。Key 在控制台的 API Keys 页面生成地址是 https://taotoken.net/console/api-keys?utm_sourcetaotoken_aicg_blog_endutm_contentapi_keysutm_campaignrewrite 生成后立刻复制保存页面刷新就看不到了。环境变量我建议统一走这两个名字后面所有代码都引用它们换环境只改这一处export ANTHROPIC_BASE_URLhttps://taotoken.net/api export ANTHROPIC_API_KEYsk-你的实际Key如果你用的是 Claude Code 这类命令行工具它读的就是ANTHROPIC_BASE_URL和ANTHROPIC_AUTH_TOKEN部分版本用ANTHROPIC_API_KEY两个都设上最稳。Model ID 方面Computer Use 和 Files API 对模型有要求建议用支持工具调用的较新版本具体型号以官方文档为准别拿老模型硬试否则会报工具不支持。关于 Computer Use 的权限边界这里必须提醒一句它本质上是让模型看屏幕、点鼠标、敲键盘权限等同于你给它的那个账号。学习阶段强烈建议在隔离环境里跑比如一台干净的虚拟机或者专用测试账号别拿生产账号直接试。官方文档里对文件读写和屏幕操作都有安全说明值得花十分钟读一遍。Skills API 的接入稍微特殊一点它不是单纯的一个 HTTP 端点而是「技能文件夹 请求时附加引用」的模式。技能文件夹的结构后面会给你只要记住技能运行在平台的代码执行沙箱里你不需要自托管任何东西但技能里的脚本要能在沙箱环境跑通别依赖本地才有的库。Files API 的接入最直白上传拿 file_id请求里引用 file_id产出可以下载。GA 之后新增了自动文件过期、速率限制提高 5 倍、每组织 1TB 存储这三点对生产环境很关键——尤其是自动过期意味着你得在业务层处理「文件过期后重新上传」的逻辑别假设 file_id 永久有效。3. 可复制配置JSON、TOML 与 settings 片段这一节给你可以直接抄的配置。先说明一点不同客户端读的配置文件不一样我把常见的几种都列出来你按自己用的工具选对应的那份。所有片段里的 Base URL 都是https://taotoken.net/apiKey 用占位符记得替换。第一份是 Claude Code 的 settings 片段通常放在~/.claude/settings.json或者项目级.claude/settings.json{ env: { ANTHROPIC_BASE_URL: https://taotoken.net/api, ANTHROPIC_AUTH_TOKEN: sk-你的实际Key, ANTHROPIC_MODEL: 你的ModelID }, permissions: { allow: [ Bash, Read, Write ] } }这份配置里ANTHROPIC_MODEL就是 Model ID三件套配置在这里齐了Base URL、Key、Model ID。permissions.allow是给 Claude Code 用的工具白名单跟 Computer Use 不是一回事别混淆。第二份是 Codex 风格的auth.json如果你用 Codex CLI路径一般在~/.codex/auth.json{ base_url: https://taotoken.net/api, api_key: sk-你的实际Key, model: 你的ModelID }第三份是 TOML 格式适合一些用配置文件驱动的客户端比如config.toml[provider] base_url https://taotoken.net/api api_key sk-你的实际Key model 你的ModelID [provider.headers] anthropic-version 2023-06-01anthropic-version这个头很重要版本不对会直接 400。GA 之后的新能力可能需要更新的版本号以官方文档为准。第四份是 Skills API 的技能文件夹结构这个不是配置文件但属于「可复制配置」的一部分因为结构错了技能就加载不了skills/claim-submit/ ├── SKILL.md ├── scripts/ │ └── build_payload.py └── templates/ └── confirm.mdSKILL.md里写清楚「何时用、怎么用、输出格式」脚本放scripts/模板放templates/。请求时附加技能引用Claude 判断任务需要时才读取按需加载不会一股脑塞进上下文。第五份是 Computer Use 的工具声明这个直接写在请求体里{ tools: [ { type: computer, name: computer, display_width_px: 1280, display_height_px: 800, display_number: 1 } ] }display_width_px和display_height_px必须和实际屏幕一致否则模型算出来的点击坐标会偏。display_number只在多显示器时需要。如果你做的是网页自动化优先用 browser use tool它读 DOM 结构、按元素定位比纯像素方式稳得多。配置写完别急着跑大任务先用一个最小请求验证连通性下一节就干这个。4. 端到端验证从上传文件到取回产出验证链路我建议按「Files → Skills → Browser Use → Files」的顺序走一遍正好对应官方那个理赔示例的四段。先跑通最小闭环再往上加复杂度。第一步验证 Files API 上传。用 curl 发一个上传请求curl -X POST https://taotoken.net/api/files \ -H x-api-key: $ANTHROPIC_API_KEY \ -H anthropic-version: 2023-06-01 \ -F file./claim_form.pdf \ -F purposeassistants成功的话返回里会有一个id字段形如file_abc123这就是 file_id。记下来后面所有请求都用它引用不用再传文件本体。这一步跑通说明 Base URL 和 Key 都没问题。第二步验证 Skills API 加载。构造一个带技能引用的请求curl -X POST https://taotoken.net/api/messages \ -H x-api-key: $ANTHROPIC_API_KEY \ -H anthropic-version: 2023-06-01 \ -H content-type: application/json \ -d { model: 你的ModelID, max_tokens: 1024, skills: [ {type: custom, skill_id: claim-submit} ], messages: [ { role: user, content: [ {type: text, text: 根据上传的受理文档按团队流程生成提交载荷}, {type: file, file_id: file_abc123} ] } ] }如果技能加载成功返回里会看到模型引用了技能里的模板或脚本产出。如果报技能不存在检查技能是否已经上传并版本化以及 skill_id 是否拼对。第三步验证 Browser Use。这一步需要你先有一个可操作的网页环境工具声明换成 browser use{ tools: [ { type: computer, name: computer, display_width_px: 1280, display_height_px: 800, display_number: 1, enable_browser_use: true } ] }enable_browser_use这个字段名以官方文档为准我这里给的是示意。跑起来之后模型会读取页面结构、定位元素、执行点击和输入。实测下来网页表单填写这类任务browser use 比裸 computer use 的成功率高不少因为它不依赖像素坐标。第四步验证 Files API 取回产出。任务完成后模型会把确认信息写回文件你通过 file_id 下载curl -X GET https://taotoken.net/api/files/file_abc123/content \ -H x-api-key: $ANTHROPIC_API_KEY \ -H anthropic-version: 2023-06-01 \ -o ./confirm.md打开confirm.md如果里面是结构化的确认信息说明整条链路通了。四步都跑通你就有了一个最小可用的生产级智能体骨架。接下来要做的是把真实业务逻辑填进去以及处理各种边界情况。5. 常见报错排查401、local proxy failed 与 reading choices链路跑不通的时候报错信息往往指向好几个方向我按实际踩过的坑挨个说。401 Unauthorized。这个最常见八成是 Key 的问题。先确认ANTHROPIC_API_KEY或ANTHROPIC_AUTH_TOKEN有没有设对注意有些客户端读的是后者。然后确认 Key 没有多余空格复制的时候容易带上换行。再确认 Base URL 是https://taotoken.net/api结尾不要加斜杠加了斜杠有些客户端会拼成//messages导致 404 而不是 401别被误导。如果都对了还报 401去控制台看 Key 是不是被禁用或过期了。local proxy failed。这个报错通常出现在客户端试图走本地代理但代理没起来的时候。检查你的环境变量里有没有残留的HTTP_PROXY、HTTPS_PROXY设置有的话先清掉。另外确认客户端配置里没有指向127.0.0.1:xxxx的本地转发规则。TaoToken 是直连的 API 入口不需要任何本地代理层配置里出现本地地址就是错的。reading choices 相关报错。这个一般出现在响应解析阶段说明返回结构和你客户端预期的格式不一致。常见原因是anthropic-version头缺失或版本太老导致返回的是旧格式。补上anthropic-version: 2023-06-01如果用了 GA 新能力可能需要更新的版本号。另一个原因是 Model ID 写错返回了错误结构客户端却按正常响应去解析choices字段。确认 Model ID 拼写以及该模型是否支持你要用的工具。OAuth 相关报错。如果你用的是需要 OAuth 流程的客户端报错通常指向 token 刷新失败或 scope 不足。检查 OAuth 配置里的回调地址和 scope 是否包含你要用的能力。有些客户端把 API Key 模式和 OAuth 模式混在一起配置冲突也会报这个。最省事的做法是统一用 API Key 模式三件套配置写全别混用。技能加载失败。报错可能是「skill not found」或「skill execution failed」。前者检查 skill_id 和版本后者检查技能里的脚本能不能在沙箱跑通。沙箱环境和你本地不一样别依赖本地路径或本地才装的库。脚本里用相对路径依赖用沙箱支持的标准库。文件过期。GA 之后文件会自动过期如果你拿一个过期的 file_id 去请求会报文件不存在。业务层要处理这个捕获报错后重新上传拿到新 file_id 再重试。别假设 file_id 永久有效这是生产环境必须处理的逻辑。排查顺序我建议固定成先验 Key 和 Base URL跑一个最小 messages 请求再验 Model ID换个简单 prompt再验工具声明去掉工具跑通再加回来最后验技能和文件。一层层剥比一上来就怀疑平台问题高效得多。6. 把链路接进你的业务从验证到生产的几步验证跑通只是起点真正接进业务还有几件事要做。第一件是权限收紧。Computer Use 的权限等同于你给的账号生产环境一定要用最小权限账号能只读就别给写能限定域名就别放开全网。Files API 的文件也要做访问控制别让一个 file_id 在无关请求里被引用。第二件是错误重试和幂等。文件过期要重传技能执行失败要重试Browser Use 操作失败要回滚。这些逻辑得在业务层写平台不会替你处理。尤其是涉及提交类操作一定要做幂等别因为重试提交了两次。第三件是成本监控。Files API 省 token 的前提是 file_id 复用如果你每次请求都重新上传那省不下来。Skills API 按需加载也是同理技能设计得越精准加载的上下文越少。定期看用量找出哪些请求在重复传文件、哪些技能被频繁加载但没实际用上。第四件是模型选型。三件套对模型有要求不同任务适合不同型号。简单文件处理用轻量模型复杂 Computer Use 任务用能力强的型号。别一个型号跑所有场景成本和效果都不划算。Model ID 在配置里是可换的按任务路由。如果你要做长期编码或 Agent 类项目可以考虑 Coding Plan地址是 https://taotoken.net/coding-plan?utm_sourcetaotoken_aicg_blog_endutm_contentcoding_planutm_campaignrewrite 它更适合持续性的开发场景。单纯验证模型能力的话模型对话入口在 https://taotoken.net/?utm_sourcetaotoken_aicg_blog_endutm_contentmodel_chatutm_campaignrewrite 可以快速试不同 Model ID 的效果。接入文档在 https://taotoken.net/doc?utm_sourcetaotoken_aicg_blog_endutm_contentdocutm_campaignrewrite 参数细节以文档为准我上面给的片段是示意实际字段名可能有更新。最后说个我自己的习惯每次改配置先跑最小请求验证连通再跑端到端验证链路最后才上真实任务。这样出问题的时候能快速定位是配置层、链路层还是业务层。三件套的能力很强但强能力意味着边界要自己守好隔离环境先跑权限最小化错误处理写全这三点做到链路才算真正生产可用。
返回列表