Anthropic 釐清:Claude Code 品質下滑源自三項產品層變更,而非模型問題

快訊消息,4月23日—Anthropic 的工程團隊確認,過去一個月使用者所報告的 Claude Code 品質退化,源自三項彼此獨立的產品層變更,而非 API 或底層模型問題。這三個問題分別在 4 月 7 日、4 月 10 日和 4 月 20 日修復,目前的最終版本為 v2.1.116。

第一項變更發生在 3 月 4 日。團隊將 Claude Code 的預設推理工作量等級從「high」降低到「medium」,以解決在高推理強度下 Opus 4.6 偶發出現極端延遲尖峰的情況。由於廣泛的使用者投訴效能下降,團隊在 4 月 7 日將該變更回退。目前,Opus 4.7 的預設為「xhigh」,其他模型的預設為「high」。

第二個問題是 3 月 26 日引入的程式錯誤。系統原本設計為在對話不活躍超過一小時後清除舊的推理紀錄,以降低會話復原成本。然而,實作中的缺陷導致該清除動作在後續每一次回合都會重複執行,而不是只執行一次,因而使模型逐步失去先前的推理脈絡。這表現為越來越健忘、重複操作,以及異常的工具呼叫。該錯誤也使每次請求都發生快取未命中,加速了使用者配額的消耗。兩個彼此無關的內部實驗掩蓋了重現條件,使除錯過程延長到超過一週。修復於 4 月 10 日完成後,團隊使用 Opus 4.7 檢查問題程式碼,並發現 Opus 4.7 能夠識別該錯誤,而 Opus 4.6 則不能。

第三項變更於 4 月 16 日與 Opus 4.7 一同推出。團隊在系統提示詞中加入指令,以降低冗餘輸出。數週的內部測試顯示沒有回歸,但在上線後與其他提示詞的互動卻使程式碼品質下降。延長評估後發現,Opus 4.6 與 4.7 的效能均下降 3%,因此在 4 月 20 日回滾。

這三項變更分別在不同時間影響了不同使用者群組,而它們的綜合效果導致普遍且不一致的品質下滑,使診斷更加困難。Anthropic 表示,現在將需要更多內部員工使用與使用者相同的公開建置版本、針對每次系統提示詞修改都執行完整的模型評估測試套件,並實施分階段推出期。作為補償,Anthropic 已重置所有訂閱使用者的使用配額。

免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見聲明

相關文章

NTT 宣布 AI x OWN 事業計畫,規劃於 2033 年前將日本發電能力提升至 1 GW 的三倍

4 月 27 日,NTT 總裁 篠田 昭太 宣布「AI x OWN」計畫,該公司努力重新設計網際網路基礎設施以支援即時 AI 使用。NTT 計畫將其國內發電能力從目前約 300 MW 提升至 2033 財政年度前後約 1 GW,作為這家電信巨頭

GateNews14分鐘前

AI 平台 Certifyde 於 5 月 1 日完成 200 萬美元種子輪融資,由 Ripple 執行長 Brad Garlinghouse 背書

根據 TechfundingNews,AI 應用平台 Certifyde 於 5 月 1 日完成一輪 200 萬美元的種子輪融資。投資方包括 K5 Global、Flamingo Capital,以及天使投資人,包括 Honey 的聯合創辦人 George Ruan、Ripple 執行長 Brad Garlinghouse,以及 Nutra 的聯合創辦人 Roland

GateNews56分鐘前

Pentagon 科技長:Anthropic 仍黑名單、Mythos 例外處理

美國國防部科技長(Pentagon technology chief)5 月 1 日對國會表示,「Anthropic 仍在黑名單上,但 Mythos Preview 是另一個議題」,正式承認國防部對 Anthropic 主品牌與其新模型 Mythos 採取區別對待。此一表態與 4 月 19 日 Axios 揭露 NSA(國家安全局)已實際使用 Mythos 形成呼應,並正式確立「Mythos 例外管道」的政策走向—同時也意味國防部曾在法庭上主張使用 Anthropic 工具會威脅國安,與當前實質做法形成法律論述上的內部矛盾。 Anthropic vs Pentagon

鏈新聞abmedia1小時前

137 Ventures 在新資金中完成 $700M ,管理資產(AUM)達到 150 億美元

根據 ChainCatcher,早期投資 SpaceX 的 137 Ventures 近期完成了兩檔新基金的募資,總額超過 7 億美元,將其管理資產提高至超過 150 億美元。這筆新資本將用於投資 AI 代理、機器人以及太空推進

GateNews1小時前

Reddit 第 16% 飆升,因 Q2 展望強勁;蘋果面臨 Mac 缺貨,因 AI 需求超過供應

Reddit 的股價在週五美股開盤前上漲 16%,原因是該公司發布了高於預期的未來一季營收展望。日活躍訪客成長 17% 至 1.268 億,且全球每位用戶平均營收跳升 44%,由 AI 驅動

GateNews1小時前

美國國防部與包含 OpenAI、Google 和 Microsoft 在內的 7 家 AI 公司達成協議

根據美國國防部的說法,該機構今日(5 月 1 日)與七家領先的人工智慧公司簽署協議:SpaceX、OpenAI、Google、Nvidia、Reflection、Microsoft 以及 Amazon Web Services(AWS)。這些協議旨在加速軍事轉型並建立

GateNews2小時前
留言
0/400
暫無留言