朝聞通: 全球領先的新聞稿發佈, 傳播和監測服務提供者
搜尋
亮點搶先看!當虹科技AI多模态能力體系,首次亮相WAIC2026

亮點搶先看!當虹科技AI多模态能力體系,首次亮相WAIC2026

2026-07-18 09:16

  /朝聞通/7月17日,2026世界人工智能大會(WAIC)暨人工智能全球治理高級别會議在上海盛大開幕。

  作為我國人工智能領域最高規格的國際盛會,本屆大會以“智能夥伴,共創未來”為主題,彙聚全球頂尖專家、科研機構和AI企業,集中展示人工智能領域最新技術成果與産業實踐,成為全球AI創新的風向标。

  本屆大會,當虹科技以“AI多模态+空間視頻+行業”為主題亮相世博展覽館,首次系統展示覆蓋理解、連接、交互、控制四大能力的專業級AI多模态能力體系。

  從AI“看懂”複雜視頻,到AI多模态數據實時連接;從重塑人與視頻交互體驗,到機器人自主巡檢與遠程接管,當虹科技全面展示了公司從“以視頻為核心”邁向“AI多模态+空間視頻+行業”全新發展階段的最新成果。

  智能理解:讓AI“看懂”複雜内容

  AI走向物理世界的起點,是“看懂”複雜内容。

  走進當虹科技“智能理解”展區,一塊大屏幕正實時播放足球比賽畫面。隻要輕觸按鍵,球員位置、跑動軌迹、攻防區域就被自動标注,進球瞬間随即生成慢動作回放。不少觀衆駐足觀看,并拿起手機記錄這一過程。

  這是當虹科技Sports AI體育賽事智能理解與包裝系統。基于BlackEye多模态空間大模型,系統能夠對比賽中的球員、動作、軌迹、事件及場上空間關系進行深度理解,并自動生成球員标簽、雷達圖、慢動作等AI輕量化包裝。

  真正的“看懂”,不僅是識别畫面裡的球和人,還要理解和預測環境變化。頂級足球賽事是最複雜的視頻場景之一,22名球員高速跑動、激烈對抗,十餘路機位實時切換,每一秒都包含海量信息。“賽事是非常複雜的視頻樣本,看懂一場球賽,需要AI具備處理更複雜視頻場景的能力。”現場工作人員介紹。

  目前,當虹科技的Sports AI系統已在2026美加墨世界杯、巴黎奧運會等國際頂級賽事轉播中落地驗證。

  (觀衆正在了解Sports AI 體育賽事智能理解與輕量化包裝)

  超級連接:AI多模态超級壓縮實時連接

  當AI能夠理解世界後,下一步,就是讓海量多模态數據高效流動。

  如今,感知終端已經從傳統攝像頭,擴展到無人機、無人車、機器人等多類智能裝備,視頻、音頻、雷達點雲等數據量快速增長,對傳輸帶寬、時延和傳輸成本提出了更高要求。

  在當虹科技“超級連接”展區,兩塊屏幕實時播放着看似“一模一樣”現場監控畫面。然而,一段原始視頻碼率高達3120kbps,另一段經過AI多模态感知壓縮後僅398kbps,碼率降低約10倍,而肉眼幾乎看不出任何畫質差異,這也讓現場不少觀衆駐足,反複比對尋找區别。

  “我們希望在盡可能保留關鍵目标、不影響AI分析前提下,大幅降低多模态數據的傳輸壓力。”現場工作人員介紹。依托AI多模态感知壓縮與回傳技術,當虹科技的視頻壓縮可實現10倍以上壓縮效率,最高節省90%以上帶寬和存儲成本;在衛星互聯網等帶寬受限場景下,壓縮比甚至可達10至100倍。

  目前,這項能力已覆蓋視頻、圖片、音頻、雷達點雲、文本、信令等多模态數據,為無人機巡檢、遠洋通信、機器人遙操等場景提供穩定、高效的數據連接能力。

  (現場觀衆對AI多模态超級壓縮興趣濃厚)

  語義交互:AI Agent重塑人與視頻交互新方式

  當數據能夠實時連接之後,人與AI之間,也需要一種更自然的交互方式。

  在當虹的視頻AI Agent體驗區,不少觀衆排隊體驗。“我想看哪吒、敖丙共渡天劫那一段。”話音剛落,大屏便快速定位到對應畫面,烏雲翻湧、雷霆落下,經典片段瞬間播放,引來現場陣陣驚歎。

  與傳統搜索不同,體驗者無需輸入關鍵詞,也不用反複拖動進度條,隻要用自然語言描述想看的内容,哪怕隻記得一句台詞、一個人物,或是一個經典場景,視頻AI Agent都能快速理解用戶意圖,精準定位到對應片段,并支持持續追問、邊看邊聊。

  “視頻比文本複雜得多,它包含人物、場景、動作、音樂、字幕等多模态信息,真正理解這些内容及其關系,才是視頻AI交互最大的挑戰。”現場工作人員介紹。

  依托BlackEye多模态空間大模型,當虹視頻AI Agent融合了多維内容理解與多輪語義交互能力,将傳統“搜索視頻”升級為“與視頻對話”,讓視頻從被動播放的内容載體,演變為一個可理解、可檢索、可持續交互的智能入口。目前,這一能力已經被搬進智能座艙,為車主帶來更自然、更高效的視頻娛樂體驗。

  (現場觀衆體驗車載智能座艙AI Agent)

  AI多模态融合:打造機器人“自主巡檢+遠程接管”新體系

  如果說理解、連接和交互是基礎,那麼最終,它還需要真正“走進”現實,完成感知與執行的閉環。

  本屆WAIC,當虹科技BlackEye Vision機器人巡邏巡檢平台首次亮相。現場,工作人員拿起手機,遠程控制一隻正在280多公裡外的四足機器人。

  随着指令發出,正在甯波具身智能産業基地自主巡檢的機器人,立即調整方向、靠近目标區域。現場大屏上的第一視角畫面,幾乎同步變化。

  事實上,來自華翔啟源的這隻機器人,此前一直在自主巡檢機器人整機産線、零部件工廠和測試中心,隻有遇到複雜情況時,工作人員才會遠程接管。“平時機器人自主巡檢,必要的時候,我們遠程接管。”當虹科技首席技術官、機器人業務線負責人吳奕剛介紹。

  這隻四足機器人所搭載的BlackEye Vision機器人巡邏巡檢平台,融合了視頻、音頻、雷達點雲、圖像等多模态感知能力,讓機器人具備自主巡檢、環境感知和異常識别能力。

  同時,依托AI多模态壓縮與自研幀級編碼技術,即使在複雜網絡環境下,也能實現端到端低至80毫秒的超低時延傳輸,保障第一視角畫面與控制信令實時回傳,讓遠端人員第一時間掌握現場、快速介入現場。

  吳奕剛介紹,在複雜、高風險的真實場景中,機器自主執行、人類遠程兜底,可能是一種務實的産業形态。遠程接管也不隻是自主能力不足時的“補丁”。遠程接管産生的數據,還可以反過來推動機器人自主能力進化,每次人工判斷和處置,都可能沉澱為機器人理解複雜場景、優化策略的數據。

  (工作人員介紹機器人遠程遙操與巡邏巡檢平台)

消息來源: 朝聞通新聞稿發布平臺
相關關鍵詞: