正確的經濟計算單位是什麼?

對外有用的單位通常是「一個被接受的任務」,而不是一次模型呼叫。

一個任務可能包含規劃、檢索、多個模型、工具、人工核准和重試。分母應是通過品質門檻的交付數;若把所有啟動次數當成功任務,失敗率越高反而會讓單位成本看起來越低。

如何留下證據: 定義任務起點、接受標準、期間、啟動數和接受數。

如何在不捏造價格的情況下估算推理成本?

保存官方費率與截止日期,將實際 token/秒數乘上當期價格;缺值用情境而非單一猜測。

不同模型、快取、批次、推理 token 或自架 GPU 口徑不同。無帳單時可列低、中、高三個費率輸入並公開公式,但不能把今天價格套到舊期間後稱為實際成本。

如何留下證據: 保存模型 ID、計費項目、用量來源、幣別、日期和公式。

哪些成本最常被漏掉?

重試、人工覆核、工具服務、RPC、儲存、監控、安全與客服最容易被遺漏。

還要看空閒 GPU、向量索引、資料授權、風控、退款和濫用造成的額外消耗。固定成本不必全塞進單一任務,但要用一致且可說明的分攤規則。

如何留下證據: 建立成本科目表並標示變動、固定、一次性或尚未知。

如何比較收入與完整成本?

收入與成本必須對齊相同任務、客群、期間與會計口徑。

只計客戶為產品支付且可核對的金額,扣除退款、平台分成和付款成本。Token 出售、基金會撥款與資產上漲是融資或資本變動,不能用來證明產品單位經濟。

如何留下證據: 保存訂單或帳單數、淨收入、接受任務與各成本科目。

哪些情境能看出經濟脆弱性?

模型漲價、重試增加、人工比例上升、收入下降和尖峰負載都應進壓力測試。

至少測正常、供應商價格上升、成功率下降及補貼停止。若一項小變化就使毛利轉負,應揭露敏感參數,而不是只公布樂觀平均值。

如何留下證據: 保存每個情境的輸入、結果、觸發條件和可採取措施。

鏈上動作的成本如何計入?

將 gas、RPC、模擬、失敗交易、bridge 與簽章服務分配到相應任務。

失敗交易也會消耗 gas;多鏈操作還可能有兌換、滑點與等待資金的成本。應使用交易 receipt 的實際 gas 與當時基準資產價格,並把價格換算方法留存。

如何留下證據: 保存 hash、gas used、effective gas price、匯率來源及任務 ID。

專案應公布什麼才方便外部覆核?

公布口徑、期間、樣本量、分布和可重算的匯總,而不是客戶秘密或單一平均數。

最少應有任務定義、模型與工具版本、P50/P95 用量、失敗率、人工介入率、費率日期和收入分類。敏感帳單可遮蔽身分,但數值仍要能對到總表。

如何留下證據: 建立資料字典、公式版本與匿名化匯總檔。

驗證工作簿

以下檢查卡把研究變成可重做紀錄。它們不產生投資建議,而是要求保存證據、反例、版本、限制與會改變結論的條件。

01

檢查 01|正確的經濟計算單位是什麼 · 支持性測試

本輪做法
尋找最接近實際行為的支持證據,但不接受無法連回原始聲明的材料
應取得的證據
完整任務 trace 可聚合所有資源
會推翻判定的訊號
只報每次 API 呼叫成本
本題判定規則
用接受任務數作主要分母
02

檢查 02|如何在不捏造價格的情況下估算推理成本 · 支持性測試

本輪做法
尋找最接近實際行為的支持證據,但不接受無法連回原始聲明的材料
應取得的證據
帳單或具日期費率對到實際用量
會推翻判定的訊號
未標日期地引用網路價格
本題判定規則
估算與實際帳單分欄
03

檢查 03|哪些成本最常被漏掉 · 支持性測試

本輪做法
尋找最接近實際行為的支持證據,但不接受無法連回原始聲明的材料
應取得的證據
供應商帳單加上人工工時和失敗紀錄
會推翻判定的訊號
把非模型支出統稱為免費基礎設施
本題判定規則
未量測項目保留區間
04

檢查 04|如何比較收入與完整成本 · 支持性測試

本輪做法
尋找最接近實際行為的支持證據,但不接受無法連回原始聲明的材料
應取得的證據
同期間的產品淨收入與完整成本
會推翻判定的訊號
以國庫流入代替客戶收入
本題判定規則
先報單位貢獻,再說固定成本
05

檢查 05|哪些情境能看出經濟脆弱性 · 支持性測試

本輪做法
尋找最接近實際行為的支持證據,但不接受無法連回原始聲明的材料
應取得的證據
敏感度表可指出損益轉折點
會推翻判定的訊號
只展示最佳月份
本題判定規則
以區間和轉折點描述脆弱性
06

檢查 06|鏈上動作的成本如何計入 · 支持性測試

本輪做法
尋找最接近實際行為的支持證據,但不接受無法連回原始聲明的材料
應取得的證據
鏈上 receipt 能回連任務
會推翻判定的訊號
只用預估 gas 或忽略 reverted 交易
本題判定規則
實際值優先,估算另列
07

檢查 07|專案應公布什麼才方便外部覆核 · 支持性測試

本輪做法
尋找最接近實際行為的支持證據,但不接受無法連回原始聲明的材料
應取得的證據
匯總可由公開公式重算
會推翻判定的訊號
只公布「成本降低 80%」
本題判定規則
無法重算時只視為團隊聲明

常見問題

為什麼不用每千 token 成本比較產品?

因為架構可能呼叫不同數量的模型和工具;被接受任務才反映完整工作量。

免費額度要算成本嗎?

應同時呈現現金支出和正常化成本,避免免費額度到期後結論失效。

人工覆核是固定還是變動成本?

視工作方式而定;若每個任務都需要則屬變動,值班與管理可按一致規則分攤。

本檔案使用的來源

  1. AI x Crypto: Exploring Use Cases and Possibilities — 用於核對範圍、版本、行為或控制的一手資料;使用時仍須確認頁面日期與上下文。
  2. Building effective agents — 用於核對範圍、版本、行為或控制的一手資料;使用時仍須確認頁面日期與上下文。
  3. Measuring AI agent autonomy in practice — 用於核對範圍、版本、行為或控制的一手資料;使用時仍須確認頁面日期與上下文。
  4. OpenAI Agents SDK — 用於核對範圍、版本、行為或控制的一手資料;使用時仍須確認頁面日期與上下文。
  5. OpenAI Evals — 用於核對範圍、版本、行為或控制的一手資料;使用時仍須確認頁面日期與上下文。
  6. Ethereum JSON-RPC API — 用於核對範圍、版本、行為或控制的一手資料;使用時仍須確認頁面日期與上下文。
  7. AI agent quickstarts for Safe Smart Account — 用於核對範圍、版本、行為或控制的一手資料;使用時仍須確認頁面日期與上下文。
  8. NIST AI 600-1: Generative AI Profile — 用於核對範圍、版本、行為或控制的一手資料;使用時仍須確認頁面日期與上下文。