回到頂部
Claude Console Workbench 的提示模板、變數與 Eval 測試畫面

Claude Console 是什麼?API Key、Workbench、費用與 Eval 教學

Claude Console 和 claude.ai 差在哪?整理 API Key、預付 credits、Workbench 變數、Prompt Generator、Eval 測試與敏感資料限制。

內容查核: 來源查核:

Claude Console 是 Anthropic 的 API 開發者平台,入口和 claude.ai 聊天產品不同。你可以在 Console 購買 API 使用額度、建立 API Key、用 Workbench 測試 prompt,再把可用版本轉成程式碼。Claude Pro、Max、Team 或 Enterprise 的訂閱費不包含 Console/API 用量,兩邊要分開計費。

只想聊天、寫作或分析文件,使用 Claude 一般版;要保存專案指令與知識,先看 Claude Projects;準備把同一個任務接進網站、內部工具或自動化,才需要 Claude Console。

Claude Console、claude.ai、Workbench 差在哪?

入口適合做什麼帳務與限制
claude.ai個人對話、文件分析、一般工作依 Free、Pro、Max、Team、Enterprise 方案
Claude ConsoleAPI Key、帳務、Workspace、使用量與開發管理和 claude.ai 訂閱分開
Workbench在瀏覽器測 API prompt、參數、變數與輸出執行會消耗 API usage credits

Anthropic 對多數較新的 Console 帳號採預付 usage credits。先在 Billing 購買額度,才能呼叫 API 或使用 Workbench;餘額用完後,兩者都會停止。可設定 auto-reload,但應同時設定可接受的補值金額與內部預算提醒,避免測試迴圈持續扣款。

Claude Console 教學:完成第一個可測模板

第 1 步:建立 Workspace 和 API Key。在 Console 的 Settings > API keys 建立金鑰,依開發、測試、正式環境分開命名。建立時可選 3 小時、1 天、7 天、30 天、自訂或永不過期;正式環境若使用長效 Key,就要放進祕密管理工具並安排輪替。

本機 SDK 可從 ANTHROPIC_API_KEY 環境變數讀取金鑰。不要把 sk-ant-api... 寫進瀏覽器 JavaScript、手機 App、公開 Git 儲存庫、截圖或客服訊息。懷疑外洩時,先撤銷舊 Key,再查該 Workspace 的異常用量。

第 2 步:在 Workbench 建立最小任務。先選一個能驗收的重複工作,例如把客服訊息分類成 billingbugfeature_requestother。固定指令寫分類定義與輸出格式,每次不同的內容用雙大括號變數:

請依照規則分類客服訊息。
只能輸出 billing、bug、feature_request、other 其中一項。

客服訊息:
{{ticket}}

模板和變數適合會反覆呼叫的任務。只測一次的問題,不必為了使用 Console 而硬拆變數。

第 3 步:準備至少 10 個測試案例。正常案例只占一半,另外放進資訊不足、同時包含兩種意圖、語氣激烈、無關內容與惡意指令。真實資料要先去除姓名、Email、電話、訂單號和內部識別碼。

Anthropic 的資料保留文件明確指出,Console 與 Workbench 不在 ZDR 涵蓋範圍,也不應在 HIPAA-ready 流程中處理 PHI。需要零資料保留或醫療資料合規時,請依合約使用符合資格的 API 功能,不要把敏感內容貼進 Workbench 測試。

第 4 步:用 Prompt Generator 或 Improver,但保留基準版。Prompt Generator 適合從任務描述建立第一版模板;Prompt Improver 可針對現有失敗案例重整規則、XML 標籤與範例。改善後的 prompt 往往更長,可能增加輸入 Token、延遲和費用,所以舊版不能刪掉。

先定三個指標,例如分類正確率、JSON 解析成功率和每次平均成本。新版若只讓句子看起來更完整,卻沒有改善這些指標,就不值得升級。

第 5 步:進入 Evaluate 比較版本。模板至少要有 1–2 個 {{variable}},才能建立 Eval test set。案例可以逐列輸入、由 Claude 生成,或從 CSV 匯入;生成案例只能補充邊界,不能取代人工整理的真實失敗案例。

Evaluation Tool 可把多個 prompt 版本並排執行、以 5 分制標記品質,並保留版本。分類和抽取任務應另用程式計算正確率與解析失敗;自由文字則先寫評分規則,避免只用「這個比較順」做決定。完整方法可接著看 LLM 評測流程

API 費用怎麼控制?

Workbench、API 呼叫和部分相關服務會依 Anthropic 當期 API 價格消耗 credits。模型、輸入、輸出、快取與批次可能有不同費率;本篇不把某一個模型單價寫死,實際部署前應用同一批測試案例估算。

先在 Billing 只放一個小額測試預算,完成 10–20 個案例後再查實際用量。接著用預估日請求量乘上單次成本,另外保留重試、尖峰和測試環境的緩衝。團隊可用 Workspace 分開產品或環境,使 API Key 和支出更容易追蹤。

不建議把第一個 Console 測試直接接上正式客戶流量。上線前至少要有 timeout、重試上限、輸出驗證、成本警示、敏感資料遮罩與人工接管條件。

FAQ

Claude Console 要付費嗎?

建立帳號和進入 Console 不等於有免費 API 額度。多數新帳號要先購買預付 usage credits;API 和 Workbench 依實際使用扣款,餘額用完就停止。

Claude Pro 或 Max 包含 API Key 嗎?

不包含。Anthropic 把 claude.ai 付費方案和 Console/API 視為不同產品;同時需要聊天額度與 API 時,要分別訂閱和設定帳務。

Workbench 一定要會寫程式嗎?

前期建立模板、變數和 Eval 不一定要寫程式。把成果接進網站或內部系統時,仍要理解伺服器端 API、金鑰管理、錯誤處理、成本和資料安全。

Prompt Generator 產生的模板可以直接上線嗎?

不建議。先保留基準版,加入真實但去識別的測試案例,再比較正確率、延遲與成本。高風險輸出還要保留人工覆核。

Claude Console 可以處理醫療或敏感資料嗎?

不要直接把 PHI 或需要 ZDR 的資料貼進 Console/Workbench。Anthropic 官方文件說明這兩個介面不在 ZDR 與 HIPAA-ready 處理範圍;有合規需求時應核對合約與 API 功能資格。

參考來源

№ · further reading

延伸閱讀