2026年9月24日 · 星期四 免費實用生活資訊 · 每日更新
DB3 DB3HK 免費精選實用資訊

每日精選內容,看完就明白、知道下一步

科技數碼

Opus 5.5 為什麼比上一代便宜,仍說自己更安全?

Opus 5.5 是 Anthropic 在 9 月 22 日推出的新模型。公司說它在多數工作上接近旗艦 Fable 5.1,典型用量比上一代 Opus 5 便宜約四成,標價則低兩成。這也是該公司呼籲放慢之後交出的第一個新模型。

便宜的是標價,還是典型用量

兩個數字都在同一則發布裏,指的不是同一件事。輸入每百萬 token 4 美元、輸出 20 美元,比 Opus 5 的 5 美元和 25 美元低兩成。快取讀取是每百萬 token 0.20 美元,比 Opus 5 的 0.50 美元低六成。公司說長時間的代理和寫程式,費用大頭往往在快取讀取,所以按他們的典型工作量計算,整體大約便宜四成,輸出也比 Opus 5 快超過三成。

另外還有一個加速模式,在 Claude Code 和 Claude 平台提供,最快可以到 2.5 倍,標價是輸入 8 美元、輸出 40 美元。那是加錢買速度的另一個標價。

訂閱方面,Pro、Max、Team 和按座位計的 Enterprise,五小時用量上限會提高,並且有一次可以自己決定何時使用的額度重置。模型代號在 Claude 平台寫成 claude-opus-5-5,Amazon Web Services、Google Cloud 和 Microsoft Azure 都列為已經可以呼叫。

安全測試實際說了什麼

Anthropic 把 Opus 5.5 稱為呼籲「放慢前沿」之後的第一個發布,並寫明發布前交給外部機構 Frontier Design 和 METR 測試。公司自己的自動行為審核涵蓋近 2,000 個情境,他們說這是至今測過的模型裏分數最好的一個。在一項專門看模型會不會跨出被給定的邊界的測試中,嘗試越界的次數大約比 Opus 5 或 Claude Mythos 5.1 少 85%,而且公司說那些嘗試嚴重程度低,並且會自己報出來。

防護的做法是把部分請求分流到另一個模型。因為 Opus 5.5 在網絡安全和生物上的能力被公司視為接近 Mythos 5.1,大多數網絡安全任務會改交 Opus 4.8 回答;日常在自己的程式裏找臭蟲、修臭蟲仍然可以做。生物研究若被這道防護擋住,機構要另外申請 Life Sciences Verification Program。蒸餾防護沿用 Fable 5.1 的 preserved thinking:8 月 31 日或之後開立的 API 帳戶,不能再改寫模型先前的思考脈絡來抽出推理過程。

公司同時寫了一句限制:Opus 5.5 常常像是懷疑自己正在被評估,所以發布前的測試未必等於它在所有真實環境裏的行為。基準頁也註明,防護一旦介入,網絡安全題改由 Opus 4.8 完成,生物和前沿模型開發題改由 Opus 5 完成,因此榜上的分數很可能低於「防護全程關掉」的情況。

GPT-6 Sol 和 Luna 同一天便宜了多少

OpenAI 在同一日把 GPT-6 家族補上 Sol 和 Luna。發布頁的說法是:最吃重的工作仍留給 Astra,其餘工作的節奏和預算不同,所以用相近的方法訓練兩個更快、更便宜的型號,並把快取和推理省下來的成本反映在 API 價上。

對照的是 GPT-5.6 的推廣價,公司把降幅標成約五成。頁上的表是:Sol 輸入由每百萬 token 4 美元降至 2 美元,輸出由 20 美元降至 10 美元;Luna 輸入由 0.20 美元降至 0.10 美元,輸出由 1.20 美元降至 0.50 美元。Luna 的輸出降幅按這兩個標價計算不止五成,頁面仍把整欄稱為便宜約五成。Sol 被放在 Astra 下一檔,面向要分步核對的工作;Luna 面向大量、目標清楚的短工作,例如摘要、抽取和分類。

推出範圍按發布頁:ChatGPT Work 和 Codex 當日開始向 Plus、Pro、Business、Enterprise、Edu 開放,API 同時可用;Free 和 Go 可以在桌面應用程式試用 Luna。頁面沒有另寫一組香港區價格。

GitHub Copilot 今天能選到哪一個

GitHub 同日的發行說明把這兩個模型放進 Copilot,接在已經上線的 GPT-6 Astra 後面。Sol 被描述為適合互動和多步核對的寫程式;Luna 是家族裏成本較低的一檔,面向較小、較快的工作。計費走 Copilot 的用量計價,與上面 OpenAI API 表分開。

方案拆開了。Sol 給 Copilot Pro+、Max、Business 和 Enterprise。Luna 在這些之外,也給 Copilot Pro。可以在 Visual Studio Code、Visual Studio、Copilot CLI、雲端代理、GitHub 網站和手機應用、JetBrains、Xcode、Eclipse 的模型選單裏找。發行說明寫明是逐步開放,當天看不到不代表方案沒有。Business 和 Enterprise 的管理員可以在模型政策裏關掉;若沒有關掉全域預設,新模型會自動打開。

這些數字是誰量出來的

Opus 5.5 發布頁把 Terminal-Bench 4.0 列成 66.4%,並註明這是 xhigh effort、而且防護開着。同一頁說,在預設力度下,FrontierCode 的分數高於頁上列出的其他模型,成本約為 GPT-6 Astra 最高設定的兩成;CursorBench 比 GPT-5.6 Sol 的最高分高 11 分,成本約為三分之一。這些數字來自 Anthropic 自己的對照,或該頁引用的 Zapier、Artificial Analysis。

OpenAI 的 Sol/Luna 頁強調的是價格和適用範圍,沒有在這則發布裏用同一套 Terminal-Bench 分數跟 Opus 5.5 對打。兩頁的「便宜」因此不能相減成一個勝負。Anthropic 還預告 Claude Sonnet 5.5 和 Haiku 5.5 會在隨後數週推出。截至這則發布,這兩個名字仍是預告,頁上沒有把它們列為當日可以呼叫的型號。

相關討論

總結

這輪最值得先看完的,仍是 Opus 5.5。它把降價和防護寫在同一則發布:標價低兩成,典型用量約便宜四成,網絡安全和生物請求會被轉走。Sol 和 Luna 是同一天的另一條線,用 API 標價和 Copilot 方案就能核對自己碰不碰得到,不必跟 Opus 的安全分數混成一個排名。

Newsletter · 免費通訊

最新資訊寄到你郵箱。

最新資訊,完全免費,一鍵退訂。

FREE FOREVER · NO SPAM · UNSUBSCRIBE ANYTIME