考試能力超90%人類的GPT-4發佈!網友爲工作擔憂和哀嚎

作者|一橙

出品|本站科技《態℃》欄目

今天凌晨,OpenAI公佈了其大型語言模型的最新版本——GPT-4。該公司表示,GPT-4在許多專業測試中表現出超過絕大多數人類的水平。

具體而言,GPT-4實現了以下幾個方面的飛躍式提升:更聰明,做題水平越來越好;支持圖像輸入,擁有強大的識圖能力,但目前只限內部測試;更長的上下文,文字輸入限制提升至2.5萬字;回答準確性顯著提高;更安全,有害信息更少。

最先進的 OpenAI GPT-4 系統介紹(來源:技術譯站)

對於普通人而言,如何理解GPT-4到底有多強多聰明?

據OpenAI透露,GPT-4通過了所有基礎考試而且是高分通過。例如,GPT-4在模擬律師資格考試的成績在考生中排名前10%左右,在SAT閱讀考試中排名前7%左右,在SAT數學考試中排名前11%左右。相比之下,曾經令人震撼的GPT-3.5 ,真實得分在倒數10%左右,GPT-4的強大已經可想而知。

有網友評論,“如果真跟報告說的那樣就太可怕了,我感覺能力已經遠超我了。”也有人笑稱,“我躺好了!我生在了適合我的時代!”

最多的聲音則是對未來工作不保的擔憂,“還有哪個行業可以不被替代?”“消除任何幻想,AI時代橫掃全球,先思考下GPT-4不能做但你能做的。”

比以前的版本“更大”,或許也更燒錢

OpenAI稱,GPT-4比以前的版本“更大”,這意味着其已經在更多的數據上進行了訓練,並且在模型文件中有更多的權重,這使得它的運行成本更高。

同時,OpenAI並未公佈這個模型的參數量有多少。

OpenAI表示,它使用的是微軟(MSFT.US)Azure訓練模型,微軟已經向這家初創公司投資了數十億美元。OpenAI沒有公佈具體模型大小的細節,也沒有公佈用來訓練模型的硬件,理由是“競爭情況”。

目前,此領域的許多研究人員認爲,人工智能領域的許多最新進展,都來自於在數千臺超級計算機上運行越來越大的模型,這些模型的訓練過程可能耗資數千萬美元。

爲了不斷提高GPT-4性能,OpenAI還爲其研發大搞“基建”。

在過去的兩年裡,OpenAI重建了整個深度學習堆棧,並與Azure一起爲其工作負載從頭開始設計了一臺超級計算機。一年前,OpenAI 在訓練GPT-3.5時第一次嘗試運行了該超算系統,之後他們又陸續發現並修復了一些錯誤,改進了其理論基礎。這些改進的結果是 GPT-4的訓練運行獲得了前所未有的穩定。

OpenAI聯合創始人兼總裁格雷格·布羅克曼(Greg Brockman)表示,OpenAI預計,未來將由投資十億美元超級計算機的公司開發尖端模型,一些最先進的工具將帶有風險。OpenAI希望對他們工作的某些部分保密,以給初創公司“一些喘息的空間,以真正關注安全並做好它。”

侷限性明顯,GPT-4仍然不完全可靠

儘管功能已經非常強大,但 GPT-4仍與早期的 GPT 模型具有相似的侷限性,其中最重要的一點是它仍然不完全可靠,也就是還有可能胡說八道。

OpenAI也警告稱,GPT-4還不完美,在許多情況下,它的能力不如人類。該公司表示:“GPT-4仍有許多已知的侷限性,我們正在努力解決,比如社會偏見、幻覺和對抗性提示。”

總的來說,GPT-4相對於以前的模型(經過多次迭代和改進)已經顯著減輕了幻覺問題。在 OpenAI 的內部對抗性真實性評估中,GPT-4的得分比最新的 GPT-3.5模型高40%。

同時,GPT-4訓練數據還是截止到2021年9月份。這也意味着,GPT-4對於這個時間點以後的信息,缺乏足夠的瞭解,也不會從其經驗中學習。

在GPT-4發佈之後,OpenAI創始人阿爾特曼發推文表示:“它仍然是有缺陷的,仍然是有限的,在你花了更多的時間第一次使用它時,它似乎比實際情況更令人印象深刻。”

中國的ChatGPT們要怎麼追?

最令人震驚的在於,按照 demo 視頻裡 OpenAI 工程師們的說法,GPT-4的訓練在去年8月就已經完成,剩下的時間都在進行微調提升,以及最重要的去除危險內容生成的工作。

這也意味着,OpenAI 內部技術,比大家想象中的領先外界更多年。更可怕的是,OpenAI還一口氣開放了API接口和相關論文!這讓中國的ChatGPT們還怎麼追?

英諾天使基金合夥人王晟曾告訴《態℃》欄目,“中國的ChatGPT們即便奮起直追,靜態來講也許兩三年能追上,我認爲已經很樂觀了。”

但隨着更強大的GPT-4發佈,OpenAI 的技術能力顯然仍在不斷進步,且進展速度遠比我們追的速度還要快。王晟在之前的採訪中判斷,“除非這件事突然遇到了一個瓶頸,整個科技發展方向到頭了,對方不得不停下來,或許我們還有機會追平,或者我們挖掘到一種新的技術路徑有機會追上,不然可能沒有機會了。”

與此同時,在該模型的落地和應用方面,OpenAI也有了最新進展。

新模型將提供給ChatGPT的付費用戶,也將作爲API的一部分提供,允許程序員將AI集成到他們的應用程序中。OpenAI將對750字左右的指令信息收費3美分,對750字左右的響應信息收費6美分。

OpenAI還介紹,摩根士丹利正在使用GPT-4來組織數據,而電子支付公司Stripe正在測試GPT-4是否有助於打擊欺詐。其他客戶還包括語言學習公司Duolingo、Khan Academy和冰島政府。OpenAI合作伙伴微軟週二表示,新版必應搜索引擎將使用GPT-4。

GPT-4取得的成績令人興奮,但對於還在起跑線上的中國ChatGPT們,還有大量的工作要去探索和研究,想必感受到了巨大的壓力。風浪越大魚越貴,對於這些迅速進入這個新領域的公司來說,也將會擁有巨大的機會。

GPT-4的強大告誡我們,未來唯一限制的因素,就是你的想象力!