抽象的:
- 人工智慧新創公司 SuperFocus 的共同創辦人 Steve Hsu 表示,DeepSeek 是一家令人印象深刻的公司。
- 他的團隊正在測試 DeepSeek 模型如何與 SuperFocus 配合使用,並計劃切換到它。
- Hsu 發現 DeepSeek 模型更便宜、更快、更私密。
本文基於與AI新創公司SuperFocus聯合創始人、密西根州立大學理論物理、計算數學和科學與工程學教授Steve Hsu的對話。為簡潔明了起見,以下內容已編輯。
在 SuperFocus,我們為企業打造超級智慧。典型的用例包括客戶服務、訂單處理、配送、文件分析和行程安排。在建構我們的 AI 系統時,我們通常使用的組件之一是 大型語言模型,例如 GPT-4.

從與其他人工智慧創辦人和工程師的交談中,似乎每個人都在嘗試模型。 深度搜尋它是最好的開源模型之一(如果不是最好的話),而且它比閉源模型便宜得多,如果明年沒有出現向開源模型的重大轉變,我會感到非常驚訝。
我們目前正在對模型的工作原理進行大量測試。 DeepSeek-V3 使用我們的系統,但我們已經非常有信心它足以完成我們需要它做的事情,如果客戶能從中受益,我們就可以進行切換。
除了客戶工作外,我們公司內部還有一個專門的研發部門,每個月都要向 OpenAI 支付一大筆費用。為了節省開支,我們計劃將大部分工作轉移到像 DeepSeek 這樣的開源模型上。
快速連結
我們應該轉向 DeepSeek 的三個主要原因
1.成本
DeepSeek 模型的運作成本大約是 OpenAI 同類模型的 30 倍。這意味著客服業可以顯著節省成本。在美國,客服人員的總成本約為每小時 25 美元,而在菲律賓,則低至每小時 5-10 美元。而我們的模型使用 OpenAI 作為大型語言模型供應商,使我們的成本降至菲律賓人工成本的十分之一。
使用 DeepSeek-V3,我們的成本可以再降低 30 倍。
2.速度
我們發現開源模型也更快。這對我們來說很重要,因為我們的許多工作都涉及語音交互,而人類不喜歡在他們停止說話和模型做出回應之間出現長時間的延遲。這聽起來不自然,也缺乏對話性。
當您使用新技術進行創新時,尤其是在軟體方面,由於更好的最佳化和演算法的使用,您可以輕鬆實現 10 倍或 100 倍的速度。
DeepSeek 團隊實施了許多非常巧妙的優化和創新來修改實際的模型架構,這意味著他們可以使用更少的內存,並且需要更少的計算能力來生成 token 或訓練模型;因此,模型在接收到輸入後可以更快地生成 token。
3. 隱私
一些客戶擔心他們的資料會流經 OpenAI 或專有模型。例如,如果我們有一個私募股權基金客戶,AI 可能會分析他們不想讓公司以外的任何人看到的高度敏感文件。
由於 DeepSeek 是開源的,任何人都可以在自己的硬體上運行該模型,也可以在從 AWS 或任何其他雲端提供者租用的伺服器上運行。模型本身沒有與 DeepSeek 通訊的通道。因此,我們能夠在客戶端資料所在的雲端實例中建立整個 AI 軟體平台,而無需透過 Google AI 或 OpenAI 的 API 發送資料。
如果它是閉源的,就像中國公司開發的其他一些自然語言處理模型(LLM)一樣,情況就不會如此。在這種情況下,你必須透過他們的API與模型進行通信,並且它將在中國公司控制的硬體上運行,就像OpenAI的情況一樣。
我可以想像客戶會說:「我們不想用那些共產主義的中國模型。即使價格要貴10倍甚至30倍,我也寧願用OpenAI或Anthropic的。」 如果有人這麼說,我們不會有什麼問題。但由於我們公司的目標是建構服務於特定目的的窄頻AI模型,所以通常不會出現政治問題。
我認為 DeepSeek 是一家令人印象深刻且非常開放的公司。
我一直在關注幾家中國公司開發大型語言模型(LLM)的工作,我們的團隊也已經測試開源中文模型好幾個月了。我認為DeepSeek是一家令人印象深刻的公司,他們發表了一些非常令人印象深刻的研究論文;你可以看到他們努力清晰地闡述他們的工作和成果,並鼓勵其他人複製或驗證他們的成果。
該公司的創辦人非常理想主義,他曾在訪談中談到自己的理念:開放才能讓這個領域進步更快。我認為這是真的。他們比美國任何其他大型實驗室都更開放,包括 OpenAI,關於他們所做的事情——這太荒謬了。
人工智慧的未來之路
突然之間,許多美國人開始意識到他們從未了解過的中國技術。但我們美國人的自信心如此之高,以至於人們否認中國在人工智慧領域取得進步的現實,假裝我們仍然領先,而中國尚未趕上。網路上有些人,包括知名科技公司的創辦人,甚至重複中國竊取我們資料的指控,例如聲稱DeepSeek的模式源自OpenAI,以及5.5萬美元的訓練成本是虛假的。我不相信這些指控是真的。
這場人工智慧競賽 決定性的競爭無論是經濟上還是技術上。我相信美國和中國之間將會有一場激烈的競爭,而且隨時都有可能出現許多先進模式是中國模式。
這將是一場偉大的競爭,隨著價格下降,消費者也將從中受益。人們將在日常生活中以更低的價格獲得更多的推理和應用智慧。隨著競爭推動事物發展,以及致力於解決這個問題的人才數量的增加,我相信我們將更快地實現通用人工智慧 (AGI)。
這也將使科學家受益。例如,加州理工學院的教授將能夠下載像 R1 這樣的推理模型,並對其進行微調,以幫助他們解決物理或數學研究問題。 OpenAI 的模型先前無法做到這一點。真正優秀的開源模型的出現將推動創新浪潮。









