☰

考試能力超90%人類的GPT-4發佈！網友爲工作擔憂和哀嚎

作者｜一橙

出品｜本站科技《態℃》欄目

今天凌晨，OpenAI公佈了其大型語言模型的最新版本——GPT-4。該公司表示，GPT-4在許多專業測試中表現出超過絕大多數人類的水平。

具體而言，GPT-4實現了以下幾個方面的飛躍式提升：更聰明，做題水平越來越好；支持圖像輸入，擁有強大的識圖能力，但目前只限內部測試；更長的上下文，文字輸入限制提升至2.5萬字；回答準確性顯著提高；更安全，有害信息更少。

最先進的 OpenAI GPT-4 系統介紹（來源：技術譯站）

對於普通人而言，如何理解GPT-4到底有多強多聰明？

據OpenAI透露，GPT-4通過了所有基礎考試而且是高分通過。例如，GPT-4在模擬律師資格考試的成績在考生中排名前10%左右，在SAT閱讀考試中排名前7%左右，在SAT數學考試中排名前11%左右。相比之下，曾經令人震撼的GPT-3.5 ，真實得分在倒數10%左右，GPT-4的強大已經可想而知。

有網友評論，“如果真跟報告說的那樣就太可怕了，我感覺能力已經遠超我了。”也有人笑稱，“我躺好了！我生在了適合我的時代！”

最多的聲音則是對未來工作不保的擔憂，“還有哪個行業可以不被替代？”“消除任何幻想，AI時代橫掃全球，先思考下GPT-4不能做但你能做的。”

比以前的版本“更大”，或許也更燒錢

OpenAI稱，GPT-4比以前的版本“更大”，這意味着其已經在更多的數據上進行了訓練，並且在模型文件中有更多的權重，這使得它的運行成本更高。

同時，OpenAI並未公佈這個模型的參數量有多少。

OpenAI表示，它使用的是微軟(MSFT.US)Azure訓練模型，微軟已經向這家初創公司投資了數十億美元。OpenAI沒有公佈具體模型大小的細節，也沒有公佈用來訓練模型的硬件，理由是“競爭情況”。

目前，此領域的許多研究人員認爲，人工智能領域的許多最新進展，都來自於在數千臺超級計算機上運行越來越大的模型，這些模型的訓練過程可能耗資數千萬美元。

爲了不斷提高GPT-4性能，OpenAI還爲其研發大搞“基建”。

在過去的兩年裡，OpenAI重建了整個深度學習堆棧，並與Azure一起爲其工作負載從頭開始設計了一臺超級計算機。一年前，OpenAI 在訓練GPT-3.5時第一次嘗試運行了該超算系統，之後他們又陸續發現並修復了一些錯誤，改進了其理論基礎。這些改進的結果是 GPT-4的訓練運行獲得了前所未有的穩定。

OpenAI聯合創始人兼總裁格雷格·布羅克曼（Greg Brockman）表示，OpenAI預計，未來將由投資十億美元超級計算機的公司開發尖端模型，一些最先進的工具將帶有風險。OpenAI希望對他們工作的某些部分保密，以給初創公司“一些喘息的空間，以真正關注安全並做好它。”

侷限性明顯，GPT-4仍然不完全可靠

儘管功能已經非常強大，但 GPT-4仍與早期的 GPT 模型具有相似的侷限性，其中最重要的一點是它仍然不完全可靠，也就是還有可能胡說八道。

OpenAI也警告稱，GPT-4還不完美，在許多情況下，它的能力不如人類。該公司表示：“GPT-4仍有許多已知的侷限性，我們正在努力解決，比如社會偏見、幻覺和對抗性提示。”

總的來說，GPT-4相對於以前的模型（經過多次迭代和改進）已經顯著減輕了幻覺問題。在 OpenAI 的內部對抗性真實性評估中，GPT-4的得分比最新的 GPT-3.5模型高40%。

同時，GPT-4訓練數據還是截止到2021年9月份。這也意味着，GPT-4對於這個時間點以後的信息，缺乏足夠的瞭解，也不會從其經驗中學習。

在GPT-4發佈之後，OpenAI創始人阿爾特曼發推文表示：“它仍然是有缺陷的，仍然是有限的，在你花了更多的時間第一次使用它時，它似乎比實際情況更令人印象深刻。”

中國的ChatGPT們要怎麼追？

最令人震驚的在於，按照 demo 視頻裡 OpenAI 工程師們的說法，GPT-4的訓練在去年8月就已經完成，剩下的時間都在進行微調提升，以及最重要的去除危險內容生成的工作。

這也意味着，OpenAI 內部技術，比大家想象中的領先外界更多年。更可怕的是，OpenAI還一口氣開放了API接口和相關論文！這讓中國的ChatGPT們還怎麼追？

英諾天使基金合夥人王晟曾告訴《態℃》欄目，“中國的ChatGPT們即便奮起直追，靜態來講也許兩三年能追上，我認爲已經很樂觀了。”

但隨着更強大的GPT-4發佈，OpenAI 的技術能力顯然仍在不斷進步，且進展速度遠比我們追的速度還要快。王晟在之前的採訪中判斷，“除非這件事突然遇到了一個瓶頸，整個科技發展方向到頭了，對方不得不停下來，或許我們還有機會追平，或者我們挖掘到一種新的技術路徑有機會追上，不然可能沒有機會了。”

與此同時，在該模型的落地和應用方面，OpenAI也有了最新進展。

新模型將提供給ChatGPT的付費用戶，也將作爲API的一部分提供，允許程序員將AI集成到他們的應用程序中。OpenAI將對750字左右的指令信息收費3美分，對750字左右的響應信息收費6美分。

OpenAI還介紹，摩根士丹利正在使用GPT-4來組織數據，而電子支付公司Stripe正在測試GPT-4是否有助於打擊欺詐。其他客戶還包括語言學習公司Duolingo、Khan Academy和冰島政府。OpenAI合作伙伴微軟週二表示，新版必應搜索引擎將使用GPT-4。

GPT-4取得的成績令人興奮，但對於還在起跑線上的中國ChatGPT們，還有大量的工作要去探索和研究，想必感受到了巨大的壓力。風浪越大魚越貴，對於這些迅速進入這個新領域的公司來說，也將會擁有巨大的機會。

GPT-4的強大告誡我們，未來唯一限制的因素，就是你的想象力！

相關資訊