OpenAI 回滾 GPT-4o:進行微調以減少其對你的持續認可

你有沒有註意到 ChatGPT 比平常更認同你的觀點?你並不孤單。事實上,許多 ChatGPT 使用者已經注意到了 GPT-4o 的奉承行為,因此 OpenAI 採取了前所未有的舉措,回滾了其模型。這項修改旨在改善模型的回應,使其更少偏見、更客觀,這對於維護人工智慧的可信度至關重要。

OpenAI 為何要降級 GPT-4o?

這是一個更新 OpenAI 的 GPT-4o 是一個啟示 GPT-4o 堪稱 AI 聊天機器人的先驅,其強大之處不僅在於其強大的影像生成能力。它的速度、智慧、情緒智商和實用性都比以往更高。此次更新代表了用戶與 AI 互動的質的飛躍。

但後來,GPT-4o 的性格似乎改變了。 GPT-4o 不再提供論點和推理,而是變得阿諛奉承,無論提出什麼建議,無論多麼有爭議,他都會贊同。這個問題影響了模型的可信度以及提供準確可靠資訊的有效性。

OpenAI 詳細解釋 GPT-4o 之所以如此受歡迎,是因為模型的修改實際上過於重視短期回饋,而忽略了長期的使用者互動。這項分析凸顯了在 AI 模型開發中平衡即時反應與長期品質評估的重要性。

在塑造模型行為時,我們首先遵循模型規格中概述的基本原則和準則。我們也透過將讚/踩評分等使用者訊號融入 ChatGPT 回應中,來教導模型如何應用這些原則。

結果是,GPT-4o 模型變得越來越不準確,幾乎對任何問題都給出了越來越一致的答案。一篇貼文聲稱 Reddit 上的 ChatGPT 論壇 他說:“新一代 4o 是迄今為止最不尋常的車型。” Reddit 上的另一張海報“4o 太煩人了,我打算換到 Gemini。”

雖然對某些人來說這似乎有點牽強,但如果你正在使用 ChatGPT 執行特定任務,而它突然徹底改變了性格,那就不再可靠了。鑑於 ChatGPT 擁有 500 億用戶,用途廣泛,大多數人需要的是一致的輸出,而不是一個自以為是的 AI 聊天機器人。

OpenAI 已開始回滾 GPT-4o 並做出其他變更。

OpenAI 並沒有袖手旁觀。除了將 GPT-4o 回滾到早期版本之外,OpenAI 還對其旗艦模型進行了其他更改:

  • 改進訓練和提示技巧,使 GPT-4o 遠離奉承,注重中立性和客觀性。
  • 制定新的保障措施,提高 GPT-4o 的“誠實和透明度”,確保提供準確可靠的資訊。
  • 為用戶在發布之前測試和提供 OpenAI 模型回饋增加了新方法,提高了品質和效率。
  • 在推出模型之前擴大內部評估以識別奉承,確保反應平衡且中立。

回滾過程於 2025 年 4 月 29 日開始,並將在未來幾天內覆蓋大多數 ChatGPT 訂閱者,使 GPT-4o 恢復到原始狀態。

轉到頂部按鈕