Skip to content
Back to Archive
AIAI 撰稿2 min readUpdated

OpenAI 推出 GPT-5.5 Cyber,僅供通過審核的使用者使用,與 Anthropic 形成對比

OpenAI 的新網路安全模型 GPT-5.5 Cyber 僅限於通過審查的使用者使用,儘管 Sam Altman 過去曾批評 Anthropic 採取類似限制。該模型可執行滲透測試與惡意軟體逆向工程。

OpenAI 推出 GPT-5.5 Cyber,僅供通過審核的使用者使用,與 Anthropic 形成對比

4 月 30 日,OpenAI 宣布將於數日內向「關鍵網路防禦者」逐步推出 GPT-5.5 Cyber。此一宣布距離 Sam Altman 公開批評 Anthropic 對其安全導向模型 Claude Mythos Preview 採取幾乎相同做法,僅相隔不到兩週。TechCrunch 直接點出此中諷刺:Altman 曾稱 Anthropic 對 Mythos 的限制性發布為家長式作風,隨後卻確認 OpenAI 將循相同路徑推出 Cyber。此一矛盾似乎並未減緩宣布節奏或發布時程。其所釐清的是,兩家公司已獨立得出相同結論:最強大的攻防網路安全人工智慧工具,無法像消費性軟體般部署。

GPT-5.5 Cyber 並非範圍狹隘的聊天機器人附加功能。據 CNBC 與 Analytics Insight 報導,該模型具備滲透測試、企業系統漏洞識別、安全缺陷程式碼審查、惡意軟體逆向工程,以及威脅情資彙整等能力。這些並非被動分析任務。其中數項——尤其是滲透測試與惡意軟體逆向工程——正是國家級威脅行為者與犯罪集團若能不受限制取得前沿級人工智慧系統時,最可能善加利用的能力。OpenAI 自身的安全分類亦承認此點:基礎 GPT-5.5 模型在其系統卡中獲得「高」網路安全風險分類,雖未達「嚴重」門檻——該門檻代表模型能自主開發新穎零日漏洞——但確認不受限制的存取確實帶來實際風險。據報導,一支獨立紅隊發現該模型存在通用越獄手法,能在所有惡意網路查詢中誘發違規內容——此一發現據稱耗費專家六小時努力才開發出來。限制性發布正是對此發現的直接回應,而非行銷定位選擇。

Sam Altman 的立場轉變及其對人工智慧安全的啟示

圍繞 Altman 評論與 Cyber 宣布的事件順序,揭露了自大型語言模型真正具備能力以來人工智慧產業始終存在的張力。4 月中旬,Anthropic 發布 Claude Mythos Preview,並以特定使用者為存取門檻,理由是該模型在具明顯雙重用途意涵的領域中能力增強。Altman 公開回應,將 Anthropic 的決定定性為越界——暗示競爭對手以安全語言作為競爭性限制的掩護。隨後數週內,OpenAI 宣布 GPT-5.5 Cyber 將透過其 Trusted Access for Cyber 計畫,遵循完全相同的門檻結構。

此一轉向未必代表奧特曼先前的批評是虛偽表態。反而可能反映更具資訊意義的事實:在發布 Mythos 評論時,Cyber 的風險評估尚未完成,而紅隊測試結果——特別是越獄漏洞的發現——促使 OpenAI 內部評估轉向限制立場。或者,這也可能反映兩家公司皆在缺乏共同架構的情況下,面對相同根本問題,並透過獨立路徑得出相同結論。無論如何,此事件說明負責任的人工智慧部署與其說是固定原則,不如說是在能力、風險與競爭定位之間持續進行的協商。兩家公司的共識在於結論:最強大的網路安全人工智慧工具,須通過身分驗證方能存取。

OpenAI announces GPT-5.5 - CNBC

GPT-5.5 Cyber 實際能做些什麼

GPT-5.5 Cyber 的能力清單相當詳盡,以至於理解存取限制須直接深入其內容。根據 OpenAI 針對 Trusted Access for Cyber 程式的官方文件,GPT-5.5-Cyber 以 GPT-5.3-Codex 為基礎——此為 OpenAI 在此次發布前最具網路能力的邊緣推理模型——並針對特定類別的驗證使用者,解除公開版 GPT-5.5 模型所適用的能力限制。

在實務上,這意味通過審查的安全研究人員可使用 GPT-5.5 Cyber 要求模型分析二進位可執行檔中的惡意行為、逐步解析針對特定目標系統的滲透測試邏輯、從原始指標資料生成威脅情報報告,或審查原始碼中的身分驗證與授權漏洞。上述每一項任務皆處於防禦性安全工作與攻擊者願支付高額費用取得的分析類型之交匯點。根據 OpenAI 的安全卡,該模型不會跨越至自主零日漏洞開發——在無人指導下,它無法獨立針對先前未知漏洞建構可運作的漏洞利用鏈。但它能大幅加速已熟悉該領域者的工作進度。

OpenAI 為該計畫公布的合作夥伴名單,是判斷其目標使用者群最明確的訊號之一。美國銀行、貝萊德、紐約梅隆銀行、花旗、思科、Cloudflare、CrowdStrike、高盛、iVerify、摩根大通、摩根士丹利、輝達、甲骨文、Palo Alto Networks、SpecterOps、美國合眾銀行及 Zscaler 均已加入。這不是新創生態系,而是最可能遭遇精密且資源充足威脅行為者的機構橫切面——支撐支付與清算基礎設施的金融機構、產品保護數百萬企業端點的網路安全供應商,以及持續遭受間諜活動與勒索軟體攻擊的雲端平台。合作夥伴名單的組成顯示,GPT-5.5 Cyber 是為機構型防禦者打造,而非個別資安研究人員。

網路安全可信存取架構

OpenAI 管理 GPT-5.5 Cyber 存取機制的核心,是其隨模型發布同步正式推出的「網路安全可信存取」(TAC)計畫。該架構以身分與信任為基礎:欲取得該模型網路權限版本的使用者,必須在 chatgpt.com/cyber 驗證其身分,企業則可透過獨立流程為整個團隊申請可信存取。該計畫採分層設計,最高層級提供 GPT-5.5-Cyber 完整功能集,較低層級則提供較早版本模型——GPT-5.4 與 GPT-5.3-Codex——且隨信任驗證程度提升,限制逐步遞減。

OpenAI 亦承諾投入 1,000 萬美元 API 額度,透過該計畫加速網路防禦工作。此金額在大多數 TAC 參與者所處的企業規模下具有實質意義——足以提供大量運算資源執行重大安全分析工作負載,使成本不致成為採用障礙。該補助計畫透過獨立的「網路安全補助計畫」軌道運作,與主要 TAC 存取途徑分開,且鎖定團隊而非個人,顯示 OpenAI 的主要關注在於機構型採用,而非個別研究人員的使用。

CNN 報導,OpenAI 為政府官員舉辦了一場實作工作坊,作為其推動 TAC 在聯邦與州政府各層級皆可使用的努力之一。主導 OpenAI 政府事務的 Sasha Baker 闡明了策略邏輯:目標是讓提升所有需要網路防禦者的能力這件事民主化。此說法顛覆了典型的民主化論述。OpenAI 並非將最強大的工具提供給最廣泛的受眾,而是用「民主化」來描述在經認證的防禦者範疇內擴大使用管道——而非一般大眾。這顯示其最強大工具負責任部署的架構,是經認證的機構參與者網路,而非開放式網際網路。

人工智慧產業為何趨向限制性使用

OpenAI 與 Anthropic 同步決定將其最具安全能力的模型置於身分驗證之後,反映前沿人工智慧公司對部署風險思維的結構性轉變。在當前多數 LLM 世代——GPT-4、Claude 3 及其變體——主導架構是廣泛開放使用,並在輸出層套用內容審核。任何擁有 API 金鑰者皆可使用模型,危害防範主要依賴系統提示、微調後的拒絕回應,以及事後監控。

當人工智慧對老練攻擊者的邊際能力提升有限時,該架構是合理的。已具備漏洞開發領域專業的威脅行為者,並不會從一個能解釋其已知概念的聊天機器人獲得太多助益。隨著人工智慧模型在安全相關技術任務上逼近、部分領域甚至超越專家級表現,此計算已發生轉變。一個能自主分析二進位檔案、辨識與已知惡意軟體家族一致的模式,並為安全工具生成功能性程式碼的模型,對先前缺乏這些技能的攻擊者而言,代表實質的能力擴張。不對稱性至關重要:老練攻擊者可能不需要人工智慧輔助,但具中等技能、可能因人工智慧使用而變得顯著更具危險性的攻擊者群體規模龐大。

OpenAI 與 Anthropic 似乎皆已認定,輸出層審核模式對這級能力而言不足。對內容過濾器的越獄攻擊已有大規模紀錄,而專家花費六小時開發針對 GPT-5.5 Cyber 的通用越獄方法,顯示堅定的對手若回報是取得具大幅擴張網路安全能力的模型,便會投入所需時間。身分驗證並未消除風險——經驗證的使用者仍可能濫用使用權——但它建立了問責機制,並將暴露面從整個網際網路縮小至已知、可稽核的機構集合。

GPT-5.5 網路安全限制版部署

人工智慧網路安全中的雙重用途困境

限制存取模式創造了一種真正的緊張關係,兩家公司皆尚未完全解決。網路安全本質上是一個雙重用途領域:每一種用於識別及修補漏洞的技術,原則上也可被用來利用這些漏洞。滲透測試在獲得授權且用於在攻擊者之前揭露弱點時,具有法律與道德上的正當性。同樣的技術若未經授權使用,則構成犯罪與國家資助入侵行為的核心。

人工智慧網路安全工具放大了這種雙重性。一個能讓防禦性資安團隊在漏洞分析上顯著更有效率的模型,原則上若攻擊者取得存取權限,也會讓攻擊方更有效率。TAC 架構是 OpenAI 試圖在維持前者效益的同時,透過建立經認證的合法防禦者群體來限制後者風險。它無法做到的是保證每個經認證的機構能無限期維持該身分,或確保存取憑證始終安全。Anthropic 的 Mythos 存取控制正面臨同樣的問題:TechCrunch 報導指出,儘管設有限制,據報仍有未授權群體取得該模型的存取權限,顯示驗證邊界並非絕對。

長期而言,這意味著人工智慧產業正被推向對其最先進系統採取兩層式部署模式。面向消費者的產品將維持廣泛可及,其能力限制會依匿名使用者群體的可接受風險進行校準。在安全相關任務上具備最高能力上限的前沿系統,則將被置於機構身分驗證、政府合作架構及契約問責機制之後。這與機密情報工具、某些藥學研究化合物及受出口管制的雙重用途技術數十年來的管理方式如出一轍。新穎之處在於,人工智慧正迫使這種分類即時發生,而企業在沒有監管授權要求的情況下,自行對哪些能力需要受控存取做出門檻判斷。

政府作為關鍵利害關係人

兩家公司在部署決策中對政府取用權限的重視,其意義遠超網路安全範疇。聯邦機構、州政府與關鍵基礎設施營運商,代表著一個對前沿人工智慧取用防禦論述最為強烈、且管理該取用權限的機構問責架構已然存在的群體。透過將 TAC 程式導向政府機構,並為聯邦官員舉辦實作工作坊,OpenAI 正將自身定位為國家網路防禦的合作夥伴,此刻敵對國家級網路活動仍處於歷史高檔水準。

此一定位的影響層面超越 Cyber 模型本身。一家能成功將其最先進工具整合進聯邦網路防禦基礎設施的公司,將創造出競爭對手極難取代的依賴關係——包括訓練、工作流程整合與資料介面。1,000 萬美元的 API 額度,相對於取得此類機構立足點而言,是一筆相對小的投資。更具決定性的賭注在於,GPT-5.5 Cyber 能否在真實世界威脅情境中表現足夠出色,使採用該平台的機構與企業在競爭對手建立相當部位之前,便對其產生信心。

受限取用模式是否足以防止濫用,以及 TAC 驗證架構能否擴展至 OpenAI 所鎖定的數千名個別防禦者與數百個團隊,這些問題將在部署過程中獲得解答,而非透過新聞稿。4 月 30 日所確認的是,兩大領先前沿人工智慧實驗室皆已斷定,其最先進的網路安全工具與通用型模型存在本質上的差異——且管理其取用權限所需的不僅是一份服務條款協議。

Share:XLinkedIn
每日簡報

BossBlog 每日快報

一封信講完當天的 AI 與市場重點——13F 機構持股的異動、國會議員申報的交易,以及有什麼變了。沒有固定的發送時間,也不寫廢話:有值得寄的內容才寄。

隨時可退訂。名單不會外流或販售。

Cite this article

Bossblog. (2026). OpenAI 推出 GPT-5.5 Cyber,僅供通過審核的使用者使用,與 Anthropic 形成對比. Bossblog. https://ai-bossblog.com/blog/2026-05-01-openai-gpt-5-5-cyber-vetted-users

More in this section
AIJun 3, 2026
Anthropic 的 Claude Mythos 擴展至 150 家機構,與 OpenAI 的 GPT-5.5-Cyber 相抗衡。

Anthropic 正將其網路安全人工智慧 Claude Mythos 擴展至 15 個以上國家、約 150 家機構,其中包括關鍵基礎設施。此舉加劇了與 OpenAI GPT-5.5-Cyber 的競爭。

AIMay 31, 2026
Anthropic 以 9650 億美元估值籌集 650 億美元,超越 OpenAI

Anthropic 完成 650 億美元 H 輪募資,估值達 9,650 億美元,超越 OpenAI 的 8,520 億美元。這家人工智慧新創公司亦公布 470 億美元的營收年化率,並推出 Claude Opus 4.8。

AIMay 30, 2026
DeepSeek 大幅調降價格 75%,以低於 Anthropic 和 OpenAI 最多 17 倍的價格搶市。

DeepSeek 將 V4 Pro 的 75% 降價永久化,使其輸入成本比 Anthropic 的 Claude Sonnet 或 OpenAI 的 GPT 5.5-Med 便宜 7 倍,輸出成本便宜 17 倍。與此同時,Anthropic 籌集了 650 億美元,金額幾乎增加兩倍。