簡短回答。 四種定價模式主導標註合同,每種模式轉移的風險不同。 按對象 在幾何形狀數量可測量且密度變化時具有透明性。 按圖像或按視頻 適用於複雜度穩定的資產,並對那些關於密度判斷錯誤的人進行隱性懲罰。 按小時 適合不斷演進的指南和專家判斷,但難以在不同供應商之間比較效率。 項目或訂閱 適合持續的流程和預留容量,但需要最低承諾。應選擇與任務實際成本驅動因素相匹配的定價模式——而不是看起來最便宜的那個。
定價模型並不是一個行政細節。它決定了當數據實際難度超出樣本預估時,誰來承擔偏差,而這種偏差通常遠大於雙方在爭論中的利潤空間。
一個買家接受基於每張圖像的定價,針對一個對象密度極度不均的數據集,這就相當於向供應商寫了一份選項。一個供應商接受這種定價,就相當於向買家寫了一份選項。雙方通常直到第二批次才會注意到這一點。
四種模型,以及每種模型對你造成的成本
| 定價模型 | 最佳適用場景 | 買家的主要風險 | 買家的控制權 |
|---|---|---|---|
| 按對象 | 邊界框、多邊形、關鍵點、可測量實體 | 密集資產會迅速變得昂貴 | 當對象易於計數時,成本非常高 |
| 每張圖片/視頻 | 每個文件的穩定性複雜度 | 你為簡單資產支付過多,或供應商對密集資產定價過低,導致質量下降 | 當資產複雜度一致時,成本較高 |
| 按小時計費 | 複雜、變化或需要專家技能的任務 | 不同供應商之間的效率難以比較 | 中等;需要生產力指標 |
| 項目/訂閱 | 持續流水線和預留容量 | 最低承諾,未使用容量 | 如果體積可預測,則為高 |
最後一列需要仔細閱讀。'買家控制'並非關於談判優勢;而是關於你是否能夠驗證實際被計費的內容。對象可以被計數,而小時則無法計數,除非你事先約定過生產力指標。
按對象計費:當單位穩定時,透明度是可實現的
按對象計費在可計費對象定義不漂移的情況下是有效的。該定義在第一張發票之前需要回答三個問題:
- 部分遮擋的對象是否計入? 可見部分佔比是多少?
- 一個對象在200幀視頻中被追蹤,應算作一個對象還是200個對象?
- 屬性是否單獨計價? 一個帶有六個屬性字段的框,與一個僅包含基礎框的框,工作量並不相同。
這些內容應在合同中明確說明,按對象計價是目前最清晰的模型。若不明確說明,就會成為最具爭議的一項,因為雙方都有可辯護的解讀,而差異正是利潤空間所在。
按圖像或按視頻計價:平均值可能不成立
按資產計價以平均值為基礎,提供分佈情況。它真正適用於同質化數據集——如產品目錄圖像、文檔掃描件、標準化檢查照片——其中每個文件的標註時間方差較小。
CVAT發佈的成本分析假設每張圖像平均有23個對象,共10萬張圖像,總計230萬個獨立標註對象。這一單一比率解釋了為何僅憑圖像數量就可能掩蓋真實的工作量。兩個文件數量相同的數據庫,成本可能相差數倍。
在接受按資產計價前,需在至少200個資產的隨機樣本上測量對象密度,並關注分佈情況而非平均值。如果第90百分位數超過中位數的兩倍,應改用按對象計價。
每小時:適用於不穩定工作的合適模型
當指導原則仍在演變、需要專家判斷,或者任務根本無法標準化為可計數的單位時,按小時計費是誠實的選擇——例如裁決、分類設計、複雜3D場景、探索性標註。
其弱點是可比性。兩家供應商報價相同的每小時費率,實際產出可能相差兩倍。通過提前約定生產力指標來緩解這一問題:在定義的參考任務上,約定每小時預期處理的單位數量,並每週報告,若實際產出與預期出現顯著偏差,則觸發審查機制。這將一個按小時的合同轉化為可審計的內容,而不會將其轉變為按單位的合同。
項目或訂閱模式:容量,而非標籤數量
項目和訂閱定價購買了預留容量。CVAT發佈的2025年示例說明了這一機制:10萬個對象,每個0.10美元,總計1萬美元;而針對相同預期量的六個月預付訂閱,則顯示為每個對象0.05至0.075美元,約5000至7500美元。這不是行業價格,而是一種演示:預付款和承諾將預測風險轉移給買家,併為此獲得報酬。
只有在真實地建模預期使用情況後(包括機器學習團隊進行重訓練而非標註的月份),才接受最低承諾。未使用的預留容量是導致一個‘更便宜’合同最終變成‘更貴’合同最常見的原因。
哪種模型適用於哪種任務
| 任務 | 推薦模型 | 原因 |
|---|---|---|
| 2D邊界框,穩定本體 | 按對象 | 可計數、可驗證、密度公平 |
| 產品目錄分類 | 每張圖像 | 統一複雜度,低方差 |
| 視頻跟蹤含遮擋 | 按小時或按項目計費 | 時間維度上的工作抵抗單位定義 |
| 3D激光雷達立方體 | 每小時、每幀或每個項目 | 物體密度和點質量差異很大 |
| 需醫學或專家審核 | 按小時計費 | 判斷時間是成本,而非計數 |
| 基於RLHF的偏好排序 | 按任務或按小時計費 | 比較質量取決於審核人員的時間 |
| 連續生產流水線 | 按體積層級的訂閱 | 預留容量是實際可交付的內容 |
| 指南設計與校準 | 固定費用 | 這是一個項目,而非生產運行 |
混合工作負載:無需強制統一單位的案例
大型企業項目很少會永遠包含一個完全標準化的任務。一個項目可能從圖像邊界框開始,隨後增加視頻問答,擴展到3D點雲,最後需要多語言文本或大語言模型評估。若將所有這些內容強制納入單一計費單元,則會產生兩種結果:買方在不匹配的部分上過度支付,或供應商在這些部分上虧損,導致質量下降。
混合項目的實際結構是:一份主協議,搭配按工作流定價模型,一個統一的驗收定義,以及當某工作流模型不再適用時重新定價的工作流變更控制流程。相較於單一費率卡,這種結構需要更多談判工作,但它是唯一能持續兩年的結構。
Lifewood的應對方式
Lifewood 按項目制定定價,而非發佈統一的費率表,因為上述四種模型在同一個項目內的不同工作流中應用方式各不相同。它們之間保持一致的是驗收標準:一個 95%以上的準確率SLA,並配有雙層人工審核,低於閾值的批次將由 Lifewood 承擔重做成本。
這種組合使得混合模型合同得以實施。計費單位可根據工作流變化;但被接受的單位定義保持不變。覆蓋文本、圖像、音頻、視頻和3D點雲工作通過 全球30多個國家的40多個交付中心,支持 50多種語言,意味著一個工作流可以更改其定價模型,而無需更換供應商。
資料與進一步閱讀
- CVAT 在 cvat.ai 上發佈了標註定價模型示例,包括按對象計費和預付訂閱的示例費率,以及其成本分析中的對象密度假設。
- TELUS Digital關於選擇數據標註公司的指導在 telusdigital.com 可查。
- Lifewood 服務範圍和質量框架發佈於 lifewood.com。
- 所有報價數字均為第三方發佈的特定示例場景數據,不代表行業平均水平,也不代表 Lifewood 的實際價格。