近年來,圖像識別水平的快速提升推動人工智能熱潮形成,圖像識別技術的突破不僅提高了計算機對人臉、文字、指紋及生物特征、醫學圖片等識別的準確率,而且進一步推動了安全監控、智能交通、無人機、智能制造等廣泛領域的發展。但也遇到進一步發展,如可解釋、可分析綜合、可設計仿真等等挑戰。
對此,在中國工程院信息與電子工程前沿學術期刊上,中國工程院院士、浙江大學教授潘云鶴提出了“視覺知識”概念,他認為實現視覺知識表達、推理、學習和應用技術將是人工智能 2.0 取得突破的重要關鍵之處。近日,潘云鶴在接受《中國科學報》專訪時,詳細闡述了“視覺知識”發展面臨的5個基本問題。
“認知心理學早已指出,心象是人類知識記憶的重要部分,被用來進行形象思維。視覺知識就是計算機對心象的模擬。因此,基于視覺的人工智能是人工智能發展繞不開的課題,且具有重要意義。”潘云鶴指出。
潘云鶴認為,視覺知識表達是第一大問題。與當今人工智能所用的知識表達方式不同,視覺知識概念具有典型與范疇結構、層次結構與動作結構等要素。視覺概念能構成視覺命題,包括場景結構與動態結構;視覺命題能構成視覺敘事,例如無聲電影就是視覺敘事的顯示形式。
視覺知識不同于言語知識的特征是能表達對象的大小、色彩、紋理、空間形狀及關系;能表達對象的動作、速度及時間關系;能進行對象的時空變換、操作與推理等。事實上,人類記憶中儲存的視覺知識遠多于言語知識。
視覺識別是第二個問題。
“從人工智能早期開始,模式識別便是其中一個最重要的研究領域,其中圖象和視頻識別是發展最快的方向。”潘云鶴表示,近來,深度學習所提供的方法:用大量標識的圖像訓練出深度神經網絡模型用于圖象識別,顯著提高了正確率,已獲廣泛應用。
但與深度神經網絡模型方法不盡相同,人類在工作記憶中進行視覺識別時,不僅分析視網膜即時感知后傳入短期記憶中的數據,而且激活了長期記憶中過去學到的并記住的相關心象,即視覺知識。因此,人類在完成視覺識別任務時往往只需少量數據,而且可解釋,也可推理。
潘云鶴說,在視覺識別中,不但使用數據,而且協同使用視覺知識,形成數據驅動和視覺知識指導的協同計算范式是視覺識別的重要的研究方向。
第三、四個問題分別是視覺形象思維模擬、視覺知識的學習。
潘云鶴指出,視覺形象思維模擬在計算機輔助設計和仿真、計算機動畫、游戲、兒童教育和數字媒體創意等領域應用十分廣泛,計算機圖形學已儲備很多基礎技術,但有待與人工智能打通。一旦實現,有望打開新一代設計、仿真、教育、創意等軟件的發展新空間。
“視覺知識學習則要將目標從三維形狀的重建任務提升到視覺知識概念和命題的重建。”潘云鶴指出,這就需要對現有計算機視覺技術做進一步研究:不僅要重建3D 形狀,而且要重構 3D 形狀的概念結構與層次結構。在此基礎上,有望發展出視覺知識的自動學習手段,“當前的場景圖研究是向視覺知識自動學習前進的一個合適的中間方法,當今特別需要人工智能、計算機圖形學和計算機視覺3 個領域的研究者們聯手研究。”
多重知識表達是第五大問題。
潘云鶴認為,人腦中的知識往往是通過多重表達來描述. 因此,人工智能2.0的知識應有多種表達方式,包括知識的言語表達、知識的深度神經網絡表達、知識的形象表達等,多重知識表達將形成跨媒體智能和大數據智能新的技術理論和模型。
“視覺知識和多重知識表達的研究是發展新的視覺智能的關鍵,也是促進人工智能 2.0取得重要突破的關鍵理論與技術。”潘云鶴表示,視覺知識的獨特優點是具有形象的綜合生成能力、時空演化能力和形象顯示能力,人工智能與計算機視覺、計算機輔助設計、計算機圖形學技術聯合,將為人工智能在創造、預測和人機融合等方面的新發展提供重要的新基礎新動力。
“視覺知識是一塊寒濕而肥沃的人工智能的‘北大荒’,也是一塊充滿希望、值得多學科合作勇探的‘無人區’。”潘云鶴呼吁道。
端側人工智能芯片正登上屬于它的時代舞臺。在近日于江蘇無錫舉行的2026集成電路(無錫)創新發展大會上,由中國科學院工業人工智能研究所(以下簡稱工業人工智能所)牽頭建設的江蘇省集成電路產業聯盟端側AI芯......
端側人工智能芯片正登上屬于它的時代舞臺。在近日于江蘇無錫舉行的2026集成電路(無錫)創新發展大會上,由中國科學院工業人工智能研究所(以下簡稱工業人工智能所)牽頭建設的江蘇省集成電路產業聯盟端側AI芯......
9月4日,工業和信息化部辦公廳印發《人工智能中小企業創業支持計劃(2026-2028年)》(以下簡稱《支持計劃》)。《支持計劃》提出,通過三年,在行業應用、數據服務、智能算力等重點領域,培育形成一大批......
日前,第二屆人工智能賦能化學安全與安保國際研修班在浙江杭州開班。工業和信息化部副部長謝遠生在開班式上說,中方愿同國際社會一道,打造更多禁化武履約領域人工智能公共產品,拓展人工智能技術領域合作,助力發展......
9月2日,“通用人工智能與醫學應用聯合實驗室”揭牌儀式在香港理工大學舉行。該實驗室由杭州德適生物科技股份有限公司(以下簡稱“德適科技”)與香港理工大學共同成立,雙方將圍繞通用人工智能(AI)在醫療領域......
視覺中國供圖人工智能驅動科研范式變革,正在成為全球科技創新布局的重要方向。我國國民經濟和社會發展第十五個五年規劃綱要提出,全面實施“人工智能+”行動,以人工智能引領科研范式變革。今年7月,美國白宮科技......
第23屆中國—東盟博覽會(以下簡稱“東博會”)、中國—東盟商務與投資峰會(以下簡稱“峰會”)將于近期在廣西南寧舉行。中國貿促會副會長林紅紅9月1日在國新辦發布會上介紹,本屆峰會無論是場地設施還是主題、......
機器人樂隊靈動演奏,AI智能體高效處置民生工單,數字模型為海洋育種研發裝上“智慧大腦”……一幕幕正在上演的鮮活場景,生動展現了山東省青島市市南區推進“人工智能+”行動的創新實踐。今年以來,該區錨定全國......
日前,圣彼得堡國立大學研究團隊將語調模型集成至神經網絡,使人工智能合成語音的聽感更自然、更貼近真人。這一進展有望優化語音助手、人形機器人等設備所使用的文本轉語音系統。現有語音合成模型往往傾向于生成最常......
在經典的機器學習理論中,世界往往是靜止的。算法在封閉、靜態的“數據溫室”里得到精心培育,研究者通常假設未來的環境一成不變。然而,現實世界卻充滿了風吹雨打。如何讓人工智能(AI)模型走出理想溫室,在開放......