Anthropic份額兩個月從69%掉到40%:企業選大模型,別把後路堵死
大模型份額兩個月內劇烈重排、API價格持續下探,企業選型不該押注單一贏家,而應在架構上留好適配層、在流程上留下可核查證據,隨時能換模型。

你好。
過去這24小時,AI圈的消息又是密集的:馬斯克的Colossus 2把GPU堆到55萬顆,計劃年底衝到121萬顆;英偉達傳出要收購Hugging Face;Google DeepMind確認Gemini 4進入後期訓練。
熱鬧歸熱鬧。真正跟你的生意有關的,是另一件被噪音蓋住的事——大模型的座次,正在以月為單位重排。
一、兩個月,第一名的份額掉了一半
模型能力還在往前跑,但市場格局的穩定性已經沒了。
據每日AI洞察(2026-09-26)引用Vercel AI Gateway的數據,Anthropic的份額在兩個月裡從69%降到40%,OpenAI從10%升到24%,並在token量上登頂;開放權重模型吃掉了Anthropic流失份額的約一半。Claude Opus 5.5上線兩天,就佔到了10%。
同一份報告裡那句判斷更值得記住:份額高度波動,且由新品發佈驅動。
說白了,今天的第一梯隊,可能就是三個月後的追趕者。
那對企業用戶意味著什麼?如果你把業務邏輯、提示詞、評測集、工作流全綁在一家的API上,“換模型”就變成一次傷筋動骨的重構。反過來,如果架構上留了一層適配,換模型只是改幾行配置。
選型要做的不是pick一個贏家,而是讓自己隨時能換。
二、價格還在往下走,去年的賬可以重算
Claude Opus 5.5在9月22日發佈。官方公告的說法是:典型按token計費的工作負載成本比上一代Opus 5低約40%,緩存讀取價格進一步下降,輸出速度提升約30%。緊接著OpenAI推出GPT-6 Sol與Luna,API定價相比上一代直接腰斬50%,分別面向技術任務與高吞吐場景(新智元,2026-09-24)。
拉長看,2023年大模型平均73天更新一個旗艦,到2026年縮到18天;OpenAI和Anthropic加起來已經發了42個重磅模型。Epoch AI的觀察是,同一基準分數對應的使用成本在持續下降。
國產側也沒停。阿里在雲棲大會發布了Qwen-Audio 3.1語音模型系列,覆蓋語音識別、語音合成、音頻理解與實時交互,部分API價格進一步下調,同時公佈了Qwen 4的規劃(DAMO開發者矩陣AI資訊日報,2026-09-25)。
另有聚合服務商整理的價格顯示,GLM-5.2經渠道折扣後輸入約3.2元/百萬token、輸出約11.2元,Kimi-K3折後輸入約12元/百萬token——注意這是渠道折扣價,不是你直接調官方API的價,但方向是一致的。
對企業來說,值錢的不是“又便宜了多少”,而是“這條線什麼時候從虧變賺”。批量合同比對、客服質檢、單據審閱這些活兒,去年因為單位成本高被否掉,今年可能就成立了。建議做一次盤點:把所有“因為貴所以沒做”的場景列出來,按新價格重算一遍。
三、門檻正從“能不能做”移到“管不管得住”

這一段我們認為最值得經營者重視。
9月25日,紐約市議會議長梅寧公佈了一套AI監管方案:舉報危險AI的“賞金獵人”可從罰款中分成;AI系統須通過獨立第三方驗證(數據質量、偏見、隱私),並配備人類控制的緊急關閉開關,違規罰款2.5萬美元/項;因AI受實質傷害的個人可直接起訴開發公司。10月5日的聽證會預計傳喚OpenAI與Anthropic的CEO。
再往前幾天,蓋茨在9月25日播出的NBC採訪中警告,AI若被惡意使用,“足以引發導致十億人死亡的事件”,並認為光靠企業自我監管不夠。
同期,OpenAI宣佈暫停其最強模型的訓練,待額外安全保障與對齊改進落實後再恢復(2026-09-27財經新聞摘要)。有分析把2026年9月稱作“代理人失控”集中爆發的一個月,並給出一句判斷:AI代理人的護城河不只是模型能力,而是可控性、可稽核性、可撤銷性。
換句話說,企業把Agent放進核心流程之前,要問的不再是“它聰明不聰明”,而是三件事:它做錯了,能不能查到是哪一步?它的結論,能不能追回原始依據?它的數據,出不出你的內網?
怎麼落地
如果你的業務裡已經有“AI先給出一份能被逐條核對的結果”這種環節,可以看看我們自己的做法。舍予AI智審把科技項目申報材料變成一張可核對的證據表:幾十到幾百頁幾秒讀完,每個抽出的值都帶頁碼和原文,並做雙引擎交叉;四值結果不默認通過;數據不出內網。它解決的是上面第三個問題——不是讓AI替你做決定,而是讓它交出一份你隨時能複核、能追責的底稿。
帶走一句判斷
份額兩個月能翻倍再腰斬,價格一年能砍一半,能力半年換一代。在這個節奏下,企業最該守住兩樣東西:架構上不被任何一家鎖死,流程上每一步都留得下證據。前者保你不掉隊,後者保你不翻車。