科技
OpenAI 發布 GPT-5.6 預覽版:Sol、Terra 與 Luna 三大模型效能與定價完整解析
加入為 Google 偏好來源
將 Yahoo 設為首選來源,在 Google 上查看更多我們的精彩報導
OpenAI 正式啟動 GPT-5.6 家族的有限度預覽。這次的更新針對不同的運算需求,將模型劃分為旗艦版 Sol、平衡版 Terra 以及輕量版 Luna 三個層級。除了在模型底層架構上進行升級,官方也釋出了多項基準測試圖表,展現新一代模型在處理複雜跨領域任務、生成速度以及降低企業導入成本上的具體效益。
過去企業在導入 AI 時,往往需要在「運算效能」與「API 成本」之間拉扯。為了解決這個問題,OpenAI 在 GPT-5.6 採用了全新的命名與分級系統,讓使用者能更精準地投放資源。
首先是旗艦版 GPT-5.6 Sol,這是目前 OpenAI 旗下能力最強的模型,專注於解決極度複雜的推理任務與高階網路安全防禦。其次是平衡版 GPT-5.6 Terra,這款模型鎖定日常工作流程,它的效能足以直接匹敵上一代 (GPT-5.5) 模型,但花費的成本僅有一半。最後則是輕量版 GPT-5.6 Luna,主打極致性價比與處理速度,是低成本、大批量資料處理的合適選項。
對於開發者而言,API 的定價結構直接決定了產品商業化的可行性。GPT-5.6 系列不僅在模型本體上進行降價,更推出了更具預測性的「提示詞快取 (Prompt Caching)」機制。這項機制支援明確的快取中斷點,並提供 30 分鐘的最低快取存續時間。雖然寫入快取需要支付 1.25 倍的費用,但讀取快取可享有高達 90% 的折扣,這對於需要頻繁輸入大量背景設定的應用程式來說,將省下極為可觀的開銷。
為了讓讀者更直觀了解目前的市場定價,我們將 GPT-5.6 的 API 成本與競品 Claude 系列的最新定價進行了整理比較:
輸入定價 (USD / 百萬 Token)
輸出定價 (USD / 百萬 Token)
在效能評估方面,GPT-5.6 導入了兩個關鍵的新設計:max 推理強度與 ultra 模式。max 推理強度能給予模型更充裕的運算時間進行深層邏輯思考;而 ultra 模式則讓單一 AI 能夠運用「子智慧體 (Sub-agents)」進行協同工作。因為許多真實世界的工作任務過於龐大,單一模型難以一次處理完畢,透過子智慧體的分工合作,模型能夠自主進行規劃、反覆迭代並協調各種工具。
根據官方公布的基準測試數據,這種工作流的改變帶來了顯著的成效。在評估命令列任務的 Terminal-Bench 2.1 中,GPT-5.6 Sol 成功樹立了新的最高水準;在長跨度的基因體學與定量生物學分析 (GeneBench v1) 測試中,它也以更少的 Token 消耗量取得了優於前代的成績。
速度與安全性同樣是這次更新的核心。OpenAI 預告將於 7 月在 Cerebras 晶片上推出 GPT-5.6 Sol。透過硬體層面的支援,模型速度將可達到每秒 750 個 Token,這將有效解決過往生成式 AI 反應遲緩的痛點,使即時語音或巨量資料分析更加順暢。
同時,由於模型能力的提升,被惡意濫用的風險也隨之增加。為了確保企業能安全地運用這些工具進行防禦性工作,OpenAI 投入超過 70 萬個 A100 等效 GPU 小時進行自動化紅隊演練。系統整合了模型層級的訓練保護、生成期間的即時攔截以及帳戶層級的風險監控,建構出分層防護堆疊,將安全性推升至新的標準。
本文為硬是要學授權刊登,最早出現於OpenAI 發布 GPT-5.6 預覽版:Sol、Terra 與 Luna 三大模型效能與定價完整解析
關鍵字:AI, GPT-5.6, GPT-5.6 Luna, GPT-5.6 Sol, GPT-5.6 Terra, OpenAI
將 Yahoo 設為首選來源,在 Google 上查看更多我們的精彩報導
OpenAI 正式啟動 GPT-5.6 家族的有限度預覽。這次的更新針對不同的運算需求,將模型劃分為旗艦版 Sol、平衡版 Terra 以及輕量版 Luna 三個層級。除了在模型底層架構上進行升級,官方也釋出了多項基準測試圖表,展現新一代模型在處理複雜跨領域任務、生成速度以及降低企業導入成本上的具體效益。
過去企業在導入 AI 時,往往需要在「運算效能」與「API 成本」之間拉扯。為了解決這個問題,OpenAI 在 GPT-5.6 採用了全新的命名與分級系統,讓使用者能更精準地投放資源。
首先是旗艦版 GPT-5.6 Sol,這是目前 OpenAI 旗下能力最強的模型,專注於解決極度複雜的推理任務與高階網路安全防禦。其次是平衡版 GPT-5.6 Terra,這款模型鎖定日常工作流程,它的效能足以直接匹敵上一代 (GPT-5.5) 模型,但花費的成本僅有一半。最後則是輕量版 GPT-5.6 Luna,主打極致性價比與處理速度,是低成本、大批量資料處理的合適選項。
對於開發者而言,API 的定價結構直接決定了產品商業化的可行性。GPT-5.6 系列不僅在模型本體上進行降價,更推出了更具預測性的「提示詞快取 (Prompt Caching)」機制。這項機制支援明確的快取中斷點,並提供 30 分鐘的最低快取存續時間。雖然寫入快取需要支付 1.25 倍的費用,但讀取快取可享有高達 90% 的折扣,這對於需要頻繁輸入大量背景設定的應用程式來說,將省下極為可觀的開銷。
為了讓讀者更直觀了解目前的市場定價,我們將 GPT-5.6 的 API 成本與競品 Claude 系列的最新定價進行了整理比較:
輸入定價 (USD / 百萬 Token)
輸出定價 (USD / 百萬 Token)
在效能評估方面,GPT-5.6 導入了兩個關鍵的新設計:max 推理強度與 ultra 模式。max 推理強度能給予模型更充裕的運算時間進行深層邏輯思考;而 ultra 模式則讓單一 AI 能夠運用「子智慧體 (Sub-agents)」進行協同工作。因為許多真實世界的工作任務過於龐大,單一模型難以一次處理完畢,透過子智慧體的分工合作,模型能夠自主進行規劃、反覆迭代並協調各種工具。
根據官方公布的基準測試數據,這種工作流的改變帶來了顯著的成效。在評估命令列任務的 Terminal-Bench 2.1 中,GPT-5.6 Sol 成功樹立了新的最高水準;在長跨度的基因體學與定量生物學分析 (GeneBench v1) 測試中,它也以更少的 Token 消耗量取得了優於前代的成績。
速度與安全性同樣是這次更新的核心。OpenAI 預告將於 7 月在 Cerebras 晶片上推出 GPT-5.6 Sol。透過硬體層面的支援,模型速度將可達到每秒 750 個 Token,這將有效解決過往生成式 AI 反應遲緩的痛點,使即時語音或巨量資料分析更加順暢。
同時,由於模型能力的提升,被惡意濫用的風險也隨之增加。為了確保企業能安全地運用這些工具進行防禦性工作,OpenAI 投入超過 70 萬個 A100 等效 GPU 小時進行自動化紅隊演練。系統整合了模型層級的訓練保護、生成期間的即時攔截以及帳戶層級的風險監控,建構出分層防護堆疊,將安全性推升至新的標準。
本文為硬是要學授權刊登,最早出現於OpenAI 發布 GPT-5.6 預覽版:Sol、Terra 與 Luna 三大模型效能與定價完整解析
關鍵字:AI, GPT-5.6, GPT-5.6 Luna, GPT-5.6 Sol, GPT-5.6 Terra, OpenAI
新聞來源: 原始來源
尚無評論,成為第一個發言的人吧!