OpenAI爆紅聊天機器人ChatGPT已推出最新版本GPT-4.實現飛躍式提升更精確、準確性提高、更詳細描述圖像、擅長標準化考試等。GPT-4進行多次專業測試,考試能力超90%的人類,網友們已開始為工作擔憂和哀嚎。不過這些也都是電腦數據的結果,好在其沒有自我意識。像前幾年比較火的小愛同學和Siri等聊天機器人一下子被顛覆了,科技會越來越進步,大家躺平需謹慎。
3月15日消息:今天凌晨,OpenAI 公布了其大型語言模型的最新版本 ——GPT-4.該公司表示,GPT-4 在許多專業測試中表現出超過絕大多數人類的水平。
具體而言,GPT-4 實現了以下幾個方面的飛躍式提升:更聰明,做題水平越來越好;支持圖像輸入,擁有強大的識圖能力,但目前只限內部測試;更長的上下文,文字輸入限制提升至 2.5 萬字;回答準確性顯著提高;更安全,有害信息更少。
對于普通人而言,如何理解 GPT-4 到底有多強多聰明?
據 OpenAI 透露,GPT-4 通過了所有基礎考試而且是高分通過。例如,GPT-4 在模擬律師資格考試的成績在考生中排名前 10% 左右,在 SAT 閱讀考試中排名前 7% 左右,在 SAT 數學考試中排名前 11% 左右。相比之下,曾經令人震撼的 GPT-3.5 ,真實得分在倒數 10% 左右,GPT-4 的強大已經可想而知。
有網友評論,“如果真跟報告說的那樣就太可怕了,我感覺能力已經遠超我了。”也有人笑稱,“我躺好了!我生在了適合我的時代!”
最多的聲音則是對未來工作不保的擔憂,“還有哪個行業可以不被替代?”“消除任何幻想,AI 時代橫掃全球,先思考下 GPT-4 不能做但你能做的。”
比以前的版本“更大”,或許也更燒錢
OpenAI 稱,GPT-4 比以前的版本“更大”,這意味著其已經在更多的數據上進行了訓練,并且在模型文件中有更多的權重,這使得它的運行成本更高。
同時,OpenAI 并未公布這個模型的參數量有多少。
OpenAI 表示,它使用的是微軟 (MSFT.US) Azure 訓練模型,微軟已經向這家初創公司投資了數十億美元。OpenAI 沒有公布具體模型大小的細節,也沒有公布用來訓練模型的硬件,理由是“競爭情況”。
目前,此領域的許多研究人員認為,人工智能領域的許多最新進展,都來自于在數千臺超級計算機上運行越來越大的模型,這些模型的訓練過程可能耗資數千萬美元。
為了不斷提高 GPT-4 性能,OpenAI 還為其研發大搞“基建”。
在過去的兩年里,OpenAI 重建了整個深度學習堆棧,并與 Azure 一起為其工作負載從頭開始設計了一臺超級計算機。一年前,OpenAI 在訓練 GPT-3.5 時第一次嘗試運行了該超算系統,之后他們又陸續發現并修復了一些錯誤,改進了其理論基礎。這些改進的結果是 GPT-4 的訓練運行獲得了前所未有的穩定。
OpenAI 聯合創始人兼總裁格雷格?布羅克曼(Greg Brockman)表示,OpenAI 預計,未來將由投資十億美元超級計算機的公司開發尖端模型,一些最先進的工具將帶有風險。OpenAI 希望對他們工作的某些部分保密,以給初創公司“一些喘息的空間,以真正關注安全并做好它。”
局限性明顯,GPT-4 仍然不完全可靠
盡管功能已經非常強大,但 GPT-4 仍與早期的 GPT 模型具有相似的局限性,其中最重要的一點是它仍然不完全可靠,也就是還有可能胡說八道。
OpenAI 也警告稱,GPT-4 還不完美,在許多情況下,它的能力不如人類。該公司表示:“GPT-4 仍有許多已知的局限性,我們正在努力解決,比如社會偏見、幻覺和對抗性提示。”
總的來說,GPT-4 相對于以前的模型(經過多次迭代和改進)已經顯著減輕了幻覺問題。在 OpenAI 的內部對抗性真實性評估中,GPT-4 的得分比最新的 GPT-3.5 模型高 40%。
同時,GPT-4 訓練數據還是截止到 2021 年 9 月份。這也意味著,GPT-4 對于這個時間點以后的信息,缺乏足夠的了解,也不會從其經驗中學習。
在 GPT-4 發布之后,OpenAI 創始人阿爾特曼發推文表示:“它仍然是有缺陷的,仍然是有限的,在你花了更多的時間第一次使用它時,它似乎比實際情況更令人印象深刻。”
中國的 ChatGPT 們要怎么追?
最令人震驚的在于,按照 demo 視頻里 OpenAI 工程師們的說法,GPT-4 的訓練在去年 8 月就已經完成,剩下的時間都在進行微調提升,以及最重要的去除危險內容生成的工作。
這也意味著,OpenAI 內部技術,比大家想象中的領先外界更多年。更可怕的是,OpenAI 還一口氣開放了 API 接口和相關論文!這讓中國的 ChatGPT 們還怎么追?
英諾天使基金合伙人王晟曾告訴《態℃》欄目,“中國的 ChatGPT 們即便奮起直追,靜態來講也許兩三年能追上,我認為已經很樂觀了。”
但隨著更強大的 GPT-4 發布,OpenAI 的技術能力顯然仍在不斷進步,且進展速度遠比我們追的速度還要快。王晟在之前的采訪中判斷,“除非這件事突然遇到了一個瓶頸,整個科技發展方向到頭了,對方不得不停下來,或許我們還有機會追平,或者我們挖掘到一種新的技術路徑有機會追上,不然可能沒有機會了。”
與此同時,在該模型的落地和應用方面,OpenAI 也有了最新進展。
新模型將提供給 ChatGPT 的付費用戶,也將作為 API 的一部分提供,允許程序員將 AI 集成到他們的應用程序中。OpenAI 將對 750 字左右的指令信息收費 3 美分,對 750 字左右的響應信息收費 6 美分。
OpenAI 還介紹,摩根士丹利正在使用 GPT-4 來組織數據,而電子支付公司 Stripe 正在測試 GPT-4 是否有助于打擊欺詐。其他客戶還包括語言學習公司 Duolingo、Khan Academy 和冰島政府。OpenAI 合作伙伴微軟周二表示,新版必應搜索引擎將使用 GPT-4.
GPT-4 取得的成績令人興奮,但對于還在起跑線上的中國 ChatGPT 們,還有大量的工作要去探索和研究,想必感受到了巨大的壓力。風浪越大魚越貴,對于這些迅速進入這個新領域的公司來說,也將會擁有巨大的機會。
GPT-4 的強大告誡我們,未來唯一限制的因素,就是你的想象力!
網友評論:
我是壞人:以前那些所謂的人工智能語音助手,說真的,我真的覺得太蠢了,只能對一些訓練過的很基礎、模板化的指令做出回應。在用過ChatGPT3.5后我發現它對指令的理解能力和內容生成能力真的太恐怖了,我第一次對人工智能的自主意識產生了懷疑。它會正確識別我的引導語言,條件限制,場景描述來寫詩寫文章。這真的不是自主意識嗎?有人說它還是按照一些給定的參數進行文字組合而已,只不過訓練模型夠多,所以能識別很多要求。但我們人類自己寫出來的東西其實很多時候也不過是根據已有的條件進行篩詞,然后重新組合而已啊。現在又出了GPT4.它能做到什么程度真的很難想象。以上均為個人拙見,歡迎各位交流指正。
全不行:引用:中國的 ChatGPT 們即便奮起直追,靜態來講也許兩三年能追上,我認為已經很樂觀了。”以前都是和外國技術差了幾十年的 現在才幾年就能追上
newshine:chatgpt就像大腦。我覺得組裝出一個會洗菜 切菜 炒菜 做家務的機器人指日可待。甚至還能陪主人聊天,輔導學生作業。
真_滑雞制造者:今天問了一個問題,結果給了推薦了幾個假的GitHub項目,還編了假的地址讓我去clone,看來還是讓它寫片段代碼簡單一些
smile嘎嘎:gpt只能用以往的經驗進行概率推測,之后發生的事情結果對它來說是未知的,學不了也接受不了,你現在能對2025年的事情進行了解和學習嗎?
飄向天國的羽毛:我用這個五分鐘做完了下周社媒平臺的發布計劃,包括話題,內容,圖片demo、文案等等,然后拉到Excel 表格寫了個甘特圖發給了同事,同事說我真牛逼
wx21th:反正人工智能這事兒玩脫了,咱們人類可就混到頭啦,挺搞笑的。試想一下,人家鋼筋鐵骨的,泰森都打不過,更別提我們這些弱雞了。
來源:IT時代網
IT時代網(關注微信公眾號ITtime2000,定時推送,互動有福利驚喜)所有原創文章版權所有,未經授權,轉載必究。
創客100創投基金成立于2015年,直通硅谷,專注于TMT領域早期項目投資。LP均來自政府、互聯網IT、傳媒知名企業和個人。創客100創投基金對IT、通信、互聯網、IP等有著自己獨特眼光和豐富的資源。決策快、投資快是創客100基金最顯著的特點。
小何
小何
小何
小何