多模態(tài)感知,完成數(shù)據(jù)對齊及環(huán)境動態(tài)捕捉,實(shí)現(xiàn)長期空間記憶
嵌入物理規(guī)則約束,完成結(jié)構(gòu)化三維語義地圖建模,突破環(huán)境感知局限,滿足精準(zhǔn)化、策略化作業(yè)要求
從單一編程到意圖驅(qū)動,完成復(fù)雜任務(wù)分層推理與規(guī)劃,實(shí)現(xiàn)任務(wù)執(zhí)行泛化能力
打通物理與數(shù)字世界的“次元壁”,將數(shù)字規(guī)則映射到物理行為,實(shí)現(xiàn)人機(jī)交互及多機(jī)協(xié)作
自研創(chuàng)新“端側(cè)+云端”低算力混合模型架構(gòu)
空間感知
空間認(rèn)知
推理決策
作業(yè)交互
ROBOMIND機(jī)器人物理AI大腦是為機(jī)器人提供以全局空間智能為核心的感知、認(rèn)知、交互、決策能力,幫助機(jī)器人理解空間、融入空間、空間交互、執(zhí)行空間任務(wù)。ROBOMIND通過創(chuàng)新自研低算力 “端側(cè)大腦 + 云端大腦” 混合模型架構(gòu),協(xié)同雙端模型優(yōu)勢,實(shí)現(xiàn)低成本、快響應(yīng)、高泛化等一系列特性,在5-10tops算力需求下,即可完成各品類機(jī)器人跨場景作業(yè)需求,靈活支持從家庭到商用場景的全覆蓋應(yīng)用。
采用消費(fèi)級多目傳感器,視覺、語言多模態(tài)輸入,基于底層算法創(chuàng)新,剝離端側(cè)非關(guān)鍵能力,端側(cè)模型最低僅需5-10TOPS算力,為機(jī)器人提供三維感知、場景認(rèn)知、空間推理、任務(wù)理解等核心模型能力。
采用大語言模型與多模態(tài)模型混合運(yùn)行策略,泛化能力遠(yuǎn)超端側(cè)VLA模型,為機(jī)器人提供分層推理、任務(wù)解構(gòu)、作業(yè)推理、空間記憶等模型能力。