色婷婷AⅤ一区二区三区|亚洲精品第一国产综合亚AV|久久精品官方网视频|日本28视频香蕉

<cite id="11661"></cite>

"); //-->

博客專欄

EEPW首頁 > 博客 > 走向CV的通用人工智能：從GPT和大型語言模型中汲取的經(jīng)驗教訓 (上)

走向CV的通用人工智能：從GPT和大型語言模型中汲取的經(jīng)驗教訓 (上)

發(fā)布人：CV研究院時間：2023-06-23 來源：工程師

加入技術交流群
- 掃碼加入
  和技術大咖面對面交流
  海量資料庫查詢

發(fā)布文章

01

總述

最近，由大型語言模型（LLM）提供支持的聊天系統(tǒng)出現(xiàn)了，并迅速成為在自然語言處理（NLP）中實現(xiàn)AGI的一個有前途的方向，但在計算機視覺（CV）中實現(xiàn)AGI的道路仍不清楚。人們可能會將這種困境歸因于視覺信號比語言信號更復雜，但我們有興趣找到具體的原因，并從GPT和LLM中吸取經(jīng)驗來解決這個問題。

在今天分享中，從AGI的概念定義開始，簡要回顧了NLP如何通過聊天系統(tǒng)解決廣泛的任務。該分析啟發(fā)我們，統(tǒng)一是CV的下一個重要目標。但是，盡管在這個方向上做出了各種努力，CV仍然遠遠不是一個像GPT這樣自然集成所有任務的系統(tǒng)。我們指出，CV的本質弱點在于缺乏從環(huán)境中學習的范式，而NLP已經(jīng)完成了文本世界中的任務。然后，我們想象一個管道，將CV算法放在世界范圍的可交互環(huán)境中，對其進行預訓練，以預測其動作的未來幀，然后用指令對其進行微調，以完成各種任務。我們希望通過大量的研究和工程努力來推動這一想法并擴大其規(guī)模，為此我們分享了我們對未來研究方向的看法。

02

背景

世界正在見證一場邁向通用人工智能（AGI）的史詩之旅，我們按照慣例將AGI定義為一種可以復制人類或其他動物所能完成的任何智力任務的計算機算法。具體來說，在自然語言處理（NLP）中，計算機算法已經(jīng)發(fā)展到可以通過與人類聊天解決廣泛任務的程度。一些研究人員認為，這些系統(tǒng)可以被視為AGI的早期火花。這些系統(tǒng)大多建立在大型語言模型（LLM）之上，并通過指令調優(yōu)進行了增強。它們配備了外部知識庫和專門設計的模塊，可以完成解決數(shù)學問題、生成可視化內容等復雜任務，體現(xiàn)了其理解用戶意圖和執(zhí)行初步思想鏈的強大能力。盡管在某些方面存在已知的弱點（例如，講述科學事實和被點名的人之間的關系），但這些開創(chuàng)性的研究已經(jīng)顯示出一種明顯的趨勢，即將NLP中的大多數(shù)任務統(tǒng)一為一個系統(tǒng)，這反映了對AGI的追求。

與NLP中統(tǒng)一的快速進展相比，計算機視覺社區(qū)還遠遠不是統(tǒng)一所有任務的目標。常規(guī)的CV任務，如視覺識別、跟蹤、生成等，大多使用不同的網(wǎng)絡架構/或專門設計的通道進行處理。研究人員期待著像GPT這樣的系統(tǒng)，它可以通過統(tǒng)一的提示機制處理廣泛的CV任務，但在實現(xiàn)單個任務的良好實踐和在廣泛的任務中推廣之間存在權衡。例如，為了報告目標檢測和語義分割中的高識別精度，最好的策略是在用于圖像分類的強大主干上設計特定的頭部模塊，并且這種設計通常不會轉移到其他問題。

因此，出現(xiàn)了兩個問題：（1）為什么CV的統(tǒng)一如此困難？（2）為了實現(xiàn)這一目標，可以從GPT和LLM中學到什么？

為了回答這些問題，重新審視GPT，并將其理解為在文本世界中建立一個環(huán)境，并允許算法從交互中學習。CV研究缺乏這樣的環(huán)境。因此，算法無法模擬世界，因此它們對世界進行采樣，并學會在所謂的代理任務中獲得良好的性能。在經(jīng)歷了史詩般的十年深度學習之后，代理任務不再有意義地表明CV算法的能力；越來越明顯的是，繼續(xù)追求對它們的高精度可以使我們遠離AGI。

03

通用人工智能

人工智能是一場用機器或一套數(shù)學算法復制人類智能的持久戰(zhàn)?，F(xiàn)代人工智能于1956年在Dartmouth研討會上正式提出，社區(qū)為此開發(fā)了大量方法。實現(xiàn)人工智能至少有兩種不同的途徑：（i）符號人工智能，它試圖將世界形成一個符號系統(tǒng)，并使用邏輯算法對其進行推理；（ii）統(tǒng)計人工智能，它試圖建立一個數(shù)學函數(shù)來表述輸入和輸出之間的關系，但該函數(shù)可能是近似的，甚至是無法解釋的。在過去的十年里，第二條道路占據(jù)了主導地位，特別是深度學習理論，這是連接主義方法思想的一部分。

簡而言之，AGI就是學習一個廣義函數(shù)a=π（s）。盡管形式很簡單，但老式的人工智能算法很難使用相同的方法、算法甚至模型來處理所有這些問題。在過去的十年里，深度學習提供了一種有效而統(tǒng)一的方法：人們可以訓練深度神經(jīng)網(wǎng)絡來近似函數(shù)a=π（s），而不知道它們之間的實際關系。強大的神經(jīng)網(wǎng)絡架構（如transformer）的出現(xiàn)甚至使研究人員能夠為不同的數(shù)據(jù)模式訓練一個模型。

實現(xiàn)AGI存在巨大困難，包括但不限于以下問題。

*博客內容為網(wǎng)友個人發(fā)布，僅代表博主個人觀點，如有侵權請聯(lián)系工作人員刪除。

<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=114&cb=INSERT_RANDOM_NUMBER_HERE&n=a7a83b30' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=115&cb=INSERT_RANDOM_NUMBER_HERE&n=a3d98779' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=116&cb=INSERT_RANDOM_NUMBER_HERE&n=abca108c' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=117&cb=INSERT_RANDOM_NUMBER_HERE&n=a1775170' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=118&cb=INSERT_RANDOM_NUMBER_HERE&n=a449048b' border='0' alt='' /></a>

關鍵詞： AI

相關推薦

加大調整力度，教育部支持高校布局集成電路、AI 等專業(yè)

智能計算教育 AI 集成電路 | 2024-07-25

國際奧委會：最大限度發(fā)揮 AI 工具影響力，體育人才選拔方式有望得到革新

智能計算 AI 奧運會體育 | 2024-07-26

電子元件培訓教材

資源下載 NBA 電子元件識別電阻識別電容識別 AI MI SMT DIP 靜電防護 | 2008-09-20

蘋果承認：AI模型使用谷歌定制芯片訓練

智能計算蘋果 AI 谷歌定制芯片 | 2024-07-30

WTC-AI太陽能熱水器電路圖

設計方案 WTC-AI 太陽能熱水器電路圖 | 2012-07-24

EEPW2018年3月刊(工業(yè)物聯(lián)網(wǎng))

資源下載工業(yè)物聯(lián)網(wǎng) AI | 2018-03-12

iPhone 16將不會預裝AI功能？計劃通過iOS 18.1發(fā)布

iPhone AI iOS | 2024-07-30

摩根士丹利：僅 GB200 AI 服務器業(yè)務，就為英偉達創(chuàng)造 2100 億美元年收入

智能計算 GB200 AI 英偉達 GPU | 2024-07-26

深圳加快打造 AI 先鋒城市，今年將建成 4000PFLOPS 算力智算中心

智能計算 AI 智能計算深圳 | 2024-07-30

WTC-AI型太陽能熱水器電路圖

設計方案電子電路圖，WTC-AI 太陽能熱水器電路熱水器 | 2012-07-30

如何快速搭建手寫體識別演示系統(tǒng)

視頻 digikey AI 手寫體識別 | 2022-07-29

萬家樂JSYZ5-AI燃氣熱水器電路圖

設計方案電路圖熱水器燃氣 JSYZ5-AI 萬家樂 | 2013-01-17

EEPW2018年6月刊(5G)

資源下載 5G AI | 2018-06-11

AI驅動的嵌入式聲音和振動識別

視頻 ADI AI 嵌入式 OtoSense | 2018-10-23

瑞薩電子AI單元解決方案成功提高GE醫(yī)療（日本）日野工廠的生產(chǎn)力

winni945 | 2018-09-12

CSR8670CSR8675智能語音Alexa藍牙方案開發(fā)

資源下載 AI 智能語音 | 2017-12-14

蘋果表示其AI模型是在谷歌的定制芯片上訓練的

智能計算 AI | 2024-07-30

釋說芯語16：硬科技：構建企業(yè)未來之路（附PPT）

jackwang | 2018-10-22

Nvidia的CEO談AI的未來：“我們將需要三臺電腦... 一臺來創(chuàng)建AI... 一臺來模擬AI... 一臺來運行AI”

智能計算 AI | 2024-07-31

繼上次海聯(lián)達Ai-ap100拆機之電源改造

zhuwei0710 | 2013-04-03

海聯(lián)達（Aigale）Ai-HD1 無線全高清套件拆解

zhuwei0710 | 2013-04-28

2021春晚黑科技，火爆全網(wǎng)的\"打工牛\"是什么來頭？

視頻 AI 機器人 | 2021-02-26

攻擊成功率從 3% 到接近 100%，利用空格鍵可繞過 Meta AI 模型安全系統(tǒng)

智能計算 Meta AI | 2024-07-31

大嘴業(yè)話-AI目前市場分析

視頻人工智能，AI，ChatGPT，互聯(lián)網(wǎng)技術 | 2023-04-25

AI+機器視覺成趨勢，圖文詳解N大應用場景

智能計算安森美 AI 機器視覺 | 2024-07-31

人工智能是如何幫助阻止造假者的？

謝丫丫 | 2018-08-14

iCAN-4017 AI功能模塊

資源下載周立功單片機功能模塊 iCAN-4017 AI | 2007-03-30

“破局AI開發(fā)，釋放邊緣算力開發(fā)者訪談”，干貨滿滿！

視頻 intel AI OpenVINO | 2021-06-10

焦點

推薦視頻

更多>>

技術專區(qū)

關閉