模型 · 面向設計師
兩萬個從沒人好好命名的檔案

每個工作室都有那麼一個資料夾。十年的活兒,檔名像 final_v3_REAL_use_this 這樣,三套不同的命名規則來自三個不同的客戶經理,還有一個人——只有他知道 2023 年的包裝圖在哪。
沒人去整理,因為整理意味著兩萬個微小的判斷,而兩萬個微小判斷就是兩週的活兒。改變這套算術的是 2026 年 9 月 15 日——那天 TypeSafe AI 發布了一個模型,能在約三分之一秒內回答一個預先聲明的問題,花費不到一美分。Ciyo 無法執行 Jev——它不生成影像、也不生成影片,而且不在我們的任何一個模型註冊表裡——但不管最後由哪個工具來做,這件事的形態都值得弄明白。
它到底能讀什麼
先從邊界說起,因為它決定了整個設計。這類模型讀的是文字:TypeSafe 的文件中寫明,你傳送的內容必須是一個字串、一個 JSON 物件,或一組文字值,而且影像目前還不受支援。
所以它從不會打開你的 JPEG。它讀的是檔案周圍的文字記錄:檔名、資料夾路徑、說明文字、任何替代文字、客戶名稱、日期、資源管理器裡的備註,以及它來源的那份簡報。
這聽起來像個致命的限制,直到你去看一個真實的素材庫。你最需要知道的大部分資訊,其實早已被寫在某處,只是寫得很糟。問題從來不是資訊缺失,而是讀兩萬條這樣的碎片會花掉某個人整整兩週的人生。
該問的問題集
不要只問一個大問題。針對同一條記錄問幾個小問題,每個的答案都預先聲明好。它們會被一起評估,所以一旦文字上了線路,問五個幾乎不花額外成本。

陷阱,以及避開它的那一行
有一個發現應該改變你寫問題的方式。一項預先註冊的獨立評測於 2026 年 9 月 20 日發布,它測試了當某個檔案不屬於你聲明的任何一個類別時會發生什麼。
在這三十個這樣的案例裡,由於沒有可用的逃生選項,它一個也沒有標記出來。它每次都回傳最接近的已聲明答案,並附上一個信度的值。沒有失敗。看起來也沒錯。
這不是缺陷,而是類型系統履行了它的承諾:你說過答案會是這五個之一,所以它就是。但在素材庫裡,這意味著你 2019 年的招聘照片會被悄悄歸到當時還不存在的某個行銷活動下,直到有人去翻找才會發現。
解決辦法就是多加一個選項。宣告 `none_of_these`,或者 `needs_a_human`,並為它寫下和真實類別一樣仔細的判定標準。然後在你自己的程式碼裡做路由。
整理整個素材庫要花多少
公布的價格是每百萬輸入 token 0.042 美元,輸出免費。下面的計算假設每個素材的檔名、說明和元資料約 300 個 token——這是我們的假設,不是實測值——如果你的記錄更長,可以改掉它。
兩萬個素材,每個 300 個 token,合計六百萬 token——也就是給庫裡每個檔案問一個問題,大約二十五美分。
讓人意外的地方在於:問五個問題花的那還是那二十五美分,因為你付的是發送文字的錢,而不是收回答案的錢。

發布於 2026-09-21,是在觀察該模型實際使用後記下的一個帖子串的一部分。那張清單——“給這個分類。給這個分流。給這個打分。選這個工具。核驗這個輸出。”——是我們所見過的對這項工作最清楚的簡短表述,而整理素材庫正是其中的第一項。發帖人寫的是軟體決策,而非創意工作。
到底怎麼跑起來,又不搞砸任何東西
第一輪千萬不要讓任何東西寫回你的素材庫。輸出一張表格:每個檔案一行,每個問題一列,再加上各自的信度。
按信度給這張表排序,讀最底下兩百行。真正含糊不清的檔案就在那裡,你也會在那裡發現自己定義的類別其實彼此重疊。
然後只採用高信度的答案,其餘的交給人工。TypeSafe 發布了一個路由模式,把門檻和出錯代價綁定在一起:低於 0.6 交給人工,高於 0.6 用於便宜且可撤銷的操作,更貴的則設更高的門檻。加一個標籤幾乎是撤銷成本最低的動作,所以在這裡設一個低門檻說得通,而刪檔案就不行。
| 步驟 | 你要做什麼 | 為什麼是這個順序 |
|---|---|---|
| 1. 匯出 | 把檔名、路徑、說明和備註,每個素材彙總成一條文字記錄 | 沒收集起來,你就無法判斷 |
| 2. 手工標註 | 自己給 100 個檔案打標籤,並留著它們 | 這是判斷這一切是否有效的唯一尺度 |
| 3. 提問 | 把問題集跑遍所有檔案,寫到一張表格裡 | 此時還沒有任何東西碰到素材庫 |
| 4. 核對 | 和你的 100 個對照,並讀信度最低的行 | 是在你自己的資料上的一致率,不是別人的基準測試 |
| 5. 套用 | 只把超過你門檻的答案寫回去 | 剩下的交給人工排隊處理,不是失敗 |
最後你得到什麼
不是整潔的素材庫,而是可搜尋的——後者更好,因為整潔會退化,而搜尋不會。
現實的結果是:百分之八十的檔案會得到一個行銷活動、一個管道和一個狀態;幾百個進入評審佇列;而終於有人能不打開資料夾就回答「我們有藍色包裝的照片嗎」。
而你最終得到的,是比標籤更持久的東西:一份寫下來的、關於你的類別到底意味著什麼的定義,由使用它的人反覆推敲。那份文件壽命,會長過你用來打標籤的任何模型。
素材庫整理問題
它會去看影像本身嗎?
不會。TypeSafe 的文件中說輸入必須是文字。它讀的是檔名、路徑、說明、備註,以及檔案周圍任何其他書面記錄。
如果一個檔案不屬於我任何類別怎麼辦?
它無論如何都會選最接近的那個。一項預先註冊的評測發現:在沒宣告逃生選項時,30 個超出範圍案例裡有 0 個被標記出來。永遠要宣告 none_of_these。
整理整個素材庫要花多少?
按公布的每百萬輸入 token 0.042 美元計算,兩萬個素材、假設每個 300 token,問一個問題大約 25 美分,問五個也差不多。
Ciyo 能做到這個嗎?
不能。Ciyo 不執行 Jev,而且 Ciyo 是一個用來創造作品的畫布,不是素材管理器。這篇文章講的是一項值得理解的活兒,不是 Ciyo 的功能。
繼續閱讀
Ciyo 寫作的主題,是創意與智慧代理工具背後的那些模型,並會對它能執行的那些進行測試。