省錢候選
輕量處理定位及較低單價,適合先試格式轉換;要檢查內容有無漏失。
輸入 $0.3 · 輸出 $2.5/百萬 token
初步推薦 · 實測可靠性待補
查看同級替代
- GPT-6 Luna:低單價處理可驗收的格式任務;限制重試,不預設能可靠除錯。
- DeepSeek V4.1 Flash:非推理模式可作格式整理候選;先檢查內容漏失與別名版本。
模型觀測站
先選工作,再看省錢候選、日常主力與難題升級。推薦是本站根據公開評測分析、原廠文件與價格所作的初步判斷,不代表本站任務成功率。
涵蓋九家廠商的文字 API 候選。依公開評測分析、原廠文件與價格形成本站用途建議;不是全市場能力排名,可靠性尚待工作樣本驗證。
每一列顯示用途建議和證據狀態。
容易人工檢查的小工作,先限制預算與修改範圍。
輕量處理定位及較低單價,適合先試格式轉換;要檢查內容有無漏失。
輸入 $0.3 · 輸出 $2.5/百萬 token
初步推薦 · 實測可靠性待補
需要小段程式或結構化整理時的另一個候選;尚未證明比省錢候選更可靠。
輸入 $1 · 輸出 $5/百萬 token
初步推薦 · 實測可靠性待補
查看證據單純格式整理通常先改善提示與驗收;不預設需要高價模型。
依術語、語氣與繁體中文需求驗收,不能用 coding 分數替代語言品質。
原廠列出翻譯用途;只作一般文字起點,不代表專業翻譯已驗證。
輸入 $0.3 · 輸出 $2.5/百萬 token
初步推薦 · 實測可靠性待補
查看證據多重指令與文件整理的初步候選;繁體中文風格仍要親自比較。
輸入 $2 · 輸出 $10/百萬 token
初步推薦 · 實測可靠性待補
缺少本站翻譯與寫作樣本,暫不給難題升級推薦。
能跑測試的小修正先省錢;跨檔案和重複失敗再升級。
原廠提供 coding 評測及框架說明,適合先試邊界明確的小修正。
輸入 $1 · 輸出 $5/百萬 token
初步推薦 · 實測可靠性待補
原廠定位及規格支持程式與工具工作,列作多檔案除錯的初步主力。
輸入 $2 · 輸出 $10/百萬 token
初步推薦 · 實測可靠性待補
困難問題才提高預算,仍需用測試判斷是否真的改善。
輸入 $4 · 輸出 $20/百萬 token
初步推薦 · 實測可靠性待補
答案必須能回到原文或計算驗證,不能把流暢表達當作正確。
缺乏同條件研究樣本,不硬選省錢模型。
長文件與知識工作能力的初步候選;需要逐項核對原文。
輸入 $2 · 輸出 $10/百萬 token
初步推薦 · 實測可靠性待補
多步整合與推理的初步升級候選;未證明有較低實際錯誤率。
輸入 $4 · 輸出 $20/百萬 token
初步推薦 · 實測可靠性待補
框架、工具權限、重試上限與驗收方式,一起決定結果。
可驗收的局部子任務候選;不將 coding 評測推定為通用 Agent 成功率。
輸入 $1 · 輸出 $5/百萬 token
初步推薦 · 實測可靠性待補
多步工具與程式工作的初步主力;必須保留執行框架紀錄。
輸入 $2 · 輸出 $10/百萬 token
初步推薦 · 實測可靠性待補
主力卡住時試更高預算,避免讓錯誤重試無限延長。
輸入 $4 · 輸出 $20/百萬 token
初步推薦 · 實測可靠性待補
舊的模型書籤會在這裡找到對應型錄項目。