部落格
GLM-5.3-Flash 評測:Ox Alpha 身分、價格與限制
一篇實用的 GLM-5.3-Flash 評測,帶你了解 Ox Alpha 的真實身分、官方規格、API 價格、基準測試的解讀方式、在地硬體需求,以及哪些人適合使用它。
Qwen3.8-Flash-Next:Qwen4 架構預覽指南
Qwen3.8-Flash-Next 預覽 Qwen4 架構:總參數 125B、每個 token 啟用 6B,採用 GDN 與稀疏注意力。本文整理已確認規格、硬體需求與發布前檢查清單。
OpenRouter BYOK 費用、Fallback 與金鑰輪替全解析(2026)
實務導向的 OpenRouter BYOK 指南:整理目前的費用額度、fallback 計費、供應商限制、workspace 隔離與零停機金鑰輪替。
OpenRouter MCP 實戰指南:設定方式、模型呼叫與真實取捨
這份 OpenRouter MCP 實用指南涵蓋官方遠端伺服器、各用戶端設定、模型測試、計費、隱私,以及它與直接 API 和供應商專屬 MCP 伺服器之間的取捨。
MiniMax H3 提示詞實測評測:哪些有效、哪些會失靈(2026)
官方 MiniMax H3 提示詞格式與真實使用者回報對照:結構與鏡頭語言確實有效,音訊仍是弱項,某些情況下直接用引號反而勝過 <d> 標籤。另附失敗排查與 token 成本。
Lucy 2.5 即時影片:延遲、成本與 API 設定指南
實測拆解 Decart 的 Lucy 2.5 即時影片:API 真正支援的解析度、延遲數據究竟測量什麼、Decart 與 fal 的每小時成本、可用的編輯模式,以及現在是否值得用它來開發。
OpenRouter Structured Output:為什麼你的 Schema 會被忽略
深入解析 OpenRouter structured outputs:強制執行層級、跨模型與供應商的六種失敗情境、請求強化、串流解析、Response Healing 的限制,以及 10 次呼叫的冒煙測試。
Meta Muse Code 定價:Contributor 與 Standard 怎麼選(2026)
Muse Code 採按 Token 計費,沒有免費方案,也沒有消費上限。Contributor 的輸入價格低 12.5 倍、輸出低 21.25 倍,但須授予 Meta 訓練資料權利,且限制為 60 RPM。以下拆解成本與選擇方式。
OpenAI Assistants API 關閉倒數:Responses API 遷移指南
OpenAI 將在 2026 年 8 月 26 日淘汰 Assistants API。本文整理物件對應、內建工具遷移、已完成遷移團隊遇到的問題、狀態管理方案,以及依剩餘時間規畫的行動方案。
GLM-5.2 API 實測評測:哪些能用、哪些會壞(2026)
從整合實務檢視 GLM-5.2 API:OpenAI 相容性到哪裡為止、長迴圈中的工具呼叫表現、429 與快取計費的成本,以及一套 30 分鐘上線前測試流程。
OpenRouter Prompt Caching:為什麼你的快取始終打不中
了解 OpenRouter 如何依供應商計算 prompt caching 費用、如何透過 cached_tokens 驗證命中,以及摧毀快取命中率的四種失敗模式與節省成本的修復順序。
Anthropic Python SDK v1.0 遷移指南:哪些地方會壞掉
anthropic 1.0.0 於 2026 年 8 月 20 日發布:改用 httpx2 HTTP 層、最低支援 Python 3.10,並移除 Text Completions 與取樣參數。本文整理明顯與隱性故障、完整移除項目,以及建議的遷移順序。
DeepSeek V4 Flash Vision Exp API 指南:限制與範例
DeepSeek V4 Flash Vision Exp 實戰指南:模型 ID、圖片輸入方式、Token 計費、使用限制、API 格式,以及審慎的正式環境導入建議。
Claude Skills API 正式版改了什麼?實作方式與版本控管陷阱
Anthropic 在 2026 年 8 月 20 日讓 Skills API、computer use 與 Files API 正式 GA。本文整理改動重點、如何在 API 請求中掛載 Skill、上傳與版本規則,以及使用者實際遇到的觸發問題。
Qwen-UI-Agent:官方跑分總覽與目前取得方式
完整彙整 Qwen-UI-Agent 的官方基準成績,包括 MobileWorld、OSWorld-Verified、WebArena、ScreenSpot-Pro 的比較表,以及目前真正公開可取得的報告、程式庫與 MAI-UI 權重。
Mistral Agentic Search 是什麼?從數字看效益與代價
Mistral Agentic Search(2026 年 8 月 20 日)在你的索引外包上一層五工具檢索迴圈。官方基準測試顯示,FinanceBench 準確率最高增加 59 個百分點、token 少用 24–34%;價格尚未公布。
LFM2.5 QAD Q4_0 GGUF:檔案別抓錯,數字這樣看
Liquid AI 為 LFM2.5 推出的 QAD Q4_0 checkpoint,在 4-bit 體積下可保留 96.5–97.4% 的 BF16 品質。本文說明 QAD 改變了什麼、同尺寸檔名陷阱、精確下載指令,以及它何時比 Q4_K_M 更值得選。
2026 年最佳 GLM-5.2 替代方案:按換機理由精選
比較 GLM-5.2 與其他模型的官方 API 價格、上下文長度及授權條款,並依實際換機原因配對:額度燒太快、Agent 不穩、自架部署或成本考量。另整理兩條升級路線。
Real-ESRGAN 指南(2026):權重、下載、GUI、ncnn-vulkan
Real-ESRGAN 實戰指南:逐一說明所有權重檔、ncnn-vulkan 免安裝指令、搭配 GFPGAN 的 Python 用法、推薦 GUI,以及何時該改用 Topaz 或 SeedVR2。
AI 圖片延伸工具:10 款免費工具與隱藏註冊門檻(2026)
比較 10 款 AI 圖片延伸工具的公開免費方案:哪些不用註冊、哪些會加浮水印或降低輸出解析度,以及在相信任何免費宣稱前可做的 60 秒測試。