ICRA 2020 | 行人軌跡預(yù)測(cè)競(jìng)賽冠軍方案總結(jié)
在實(shí)際操作過(guò)程中,由于數(shù)據(jù)集中缺乏場(chǎng)景信息,我們對(duì)模型做了適當(dāng)?shù)恼{(diào)整。在世界模型中(對(duì)應(yīng)上圖的Interaction Net),我們僅使用了現(xiàn)有數(shù)據(jù)集,以及模型能夠提供的位置信息和跟蹤信息LSTM隱狀態(tài)信息。最終得到的模型結(jié)構(gòu)設(shè)計(jì)如下圖3所示:
圖3 競(jìng)賽使用的基于世界模型的預(yù)測(cè)算法
整個(gè)模型基于Seq2Seq結(jié)構(gòu),主要包含歷史軌跡編碼模塊(Encoder)、世界模型(Interaction Module)和解碼預(yù)測(cè)模塊(Decoder)三個(gè)部分。其中,編碼器的功能在于對(duì)行人歷史軌跡進(jìn)行編碼,主要提取行人在動(dòng)態(tài)環(huán)境中的運(yùn)動(dòng)模式;解碼器則是利用編碼器得到的行人運(yùn)動(dòng)模式特征,來(lái)預(yù)測(cè)他們未來(lái)的運(yùn)動(dòng)軌跡分布。
需要強(qiáng)調(diào)一下,在整個(gè)編碼與解碼的過(guò)程中,都需要對(duì)世界模型進(jìn)行實(shí)時(shí)更新(Update)與查詢(Query)兩種操作。更新操作主要根據(jù)時(shí)序的推進(jìn),將行人的運(yùn)動(dòng)信息實(shí)時(shí)編入世界模型中;查詢操作則是根據(jù)全局的世界地圖以及行人的自身位置,來(lái)獲取行人當(dāng)前鄰域內(nèi)的環(huán)境特征。
圖4 編碼階段
在圖4中,展示了我們模型在歷史軌跡編碼階段的計(jì)算流程。編碼階段共有9個(gè)時(shí)刻,對(duì)應(yīng)9個(gè)歷史觀測(cè)時(shí)間點(diǎn),每個(gè)時(shí)刻都執(zhí)行相同的操作。以 t 時(shí)刻為例。
首先,將 t 時(shí)刻的所有行人坐標(biāo)數(shù)據(jù),包含:
位置集合
速度集合
所有行人跟蹤信息(上時(shí)刻編碼得到的LSTM隱狀態(tài))
將以上信息輸入到世界模型中更新地圖信息,即Update操作。整個(gè)Update操作經(jīng)過(guò)MLP、MaxPooling以及GRU等模塊獲得一個(gè)全局的時(shí)空地圖特征R;然后,每個(gè)LSTM(對(duì)應(yīng)一個(gè)行人),使用其當(dāng)前觀測(cè)時(shí)刻的坐標(biāo)信息:
然后與R進(jìn)行Attention操作,得到個(gè)人領(lǐng)域內(nèi)的時(shí)空特征,最后與他的坐標(biāo)信息、上時(shí)刻隱狀態(tài)信息一并輸入到LSTM并更新LSTM內(nèi)置狀態(tài)。
解碼預(yù)測(cè)階段的流程與歷史軌跡編碼階段基本一致,但存在兩個(gè)細(xì)微的不同點(diǎn):
區(qū)別1:編碼階段每個(gè)行人對(duì)應(yīng)的LSTM隱狀態(tài)的初始化為0;而解碼階段,LSTM由編碼階段的LSTM隱狀態(tài)和噪聲共同初始化。
區(qū)別2:編碼階段行人對(duì)應(yīng)的LSTM和世界模型使用的是行人歷史觀測(cè)坐標(biāo);而解碼階段使用的是上時(shí)刻預(yù)測(cè)的行人坐標(biāo)。
圖5 解碼預(yù)測(cè)階段
四、數(shù)據(jù)預(yù)處理與后處理
為了對(duì)數(shù)據(jù)有更好的理解,便于使用更適合的模型,我們對(duì)訓(xùn)練數(shù)據(jù)做了一些預(yù)處理操作。首先,數(shù)據(jù)集給出了各個(gè)行人的行為標(biāo)簽,這些標(biāo)簽是根據(jù)規(guī)則得到的,由于我們采用了交互預(yù)測(cè)的方法,希望模型能自動(dòng)學(xué)習(xí)行人與周圍主體之間的位置關(guān)系、速度關(guān)系等,所以我們就不直接使用標(biāo)注中的“類型”信息;然后這次比賽的數(shù)據(jù)采集自馬路、校園等不同場(chǎng)景中行人的運(yùn)動(dòng)軌跡,場(chǎng)景之間的差異性非常大,訓(xùn)練集和測(cè)試集數(shù)據(jù)分布不太一致。
于是,我們做了數(shù)據(jù)的可視化工作,將所有軌跡數(shù)據(jù)的起點(diǎn)放置于坐標(biāo)軸的原點(diǎn)處,根據(jù)歷史觀測(cè)軌跡(前9個(gè)時(shí)刻)終點(diǎn)的位置朝向,將所有軌跡分為4類:沿左上方運(yùn)動(dòng)(top-left moving)、沿右上方運(yùn)動(dòng)(top-right moving)、沿左下方運(yùn)動(dòng)(bottom-left moving)和沿右下方運(yùn)動(dòng)(bottom-right moving)。分布的結(jié)果如圖6所示,可以發(fā)現(xiàn),訓(xùn)練集和測(cè)試集的數(shù)據(jù)分布存在一定的差距。
圖6 訓(xùn)練集與測(cè)試集歷史觀測(cè)軌跡中行人運(yùn)動(dòng)方向分布

發(fā)表評(píng)論
請(qǐng)輸入評(píng)論內(nèi)容...
請(qǐng)輸入評(píng)論/評(píng)論長(zhǎng)度6~500個(gè)字
圖片新聞
-
馬云重返一線督戰(zhàn),阿里重啟創(chuàng)始人模式
-
機(jī)器人奧運(yùn)會(huì)戰(zhàn)報(bào):宇樹機(jī)器人摘下首金,天工Ultra搶走首位“百米飛人”
-
存儲(chǔ)圈掐架!江波龍起訴佰維,索賠121萬(wàn)
-
長(zhǎng)安汽車母公司突然更名:從“中國(guó)長(zhǎng)安”到“辰致科技”
-
豆包前負(fù)責(zé)人喬木出軌BP后續(xù):均被辭退
-
字節(jié)AI Lab負(fù)責(zé)人李航卸任后返聘,Seed進(jìn)入調(diào)整期
-
員工持股爆雷?廣汽埃安緊急回應(yīng)
-
中國(guó)“智造”背后的「關(guān)鍵力量」
最新活動(dòng)更多
-
10月23日火熱報(bào)名中>> 2025是德科技創(chuàng)新技術(shù)峰會(huì)
-
10月23日立即報(bào)名>> Works With 開發(fā)者大會(huì)深圳站
-
10月24日立即參評(píng)>> 【評(píng)選】維科杯·OFweek 2025(第十屆)物聯(lián)網(wǎng)行業(yè)年度評(píng)選
-
即日-11.25立即下載>>> 費(fèi)斯托白皮書《柔性:汽車生產(chǎn)未來(lái)的關(guān)鍵》
-
11月27日立即報(bào)名>> 【工程師系列】汽車電子技術(shù)在線大會(huì)
-
12月18日立即報(bào)名>> 【線下會(huì)議】OFweek 2025(第十屆)物聯(lián)網(wǎng)產(chǎn)業(yè)大會(huì)
推薦專題
-
10 大模型的盡頭是開源
- 1 特斯拉工人被故障機(jī)器人打成重傷,索賠3.6億
- 2 【行業(yè)深度研究】退居幕后四年后,張一鳴終于把算法公司變成AI公司?
- 3 AI 時(shí)代,阿里云想當(dāng)“安卓” ,那誰(shuí)是“蘋果”?
- 4 硬剛英偉達(dá)!華為發(fā)布全球最強(qiáng)算力超節(jié)點(diǎn)和集群
- 5 機(jī)器人9月大事件|3家國(guó)產(chǎn)機(jī)器人沖刺IPO,行業(yè)交付與融資再創(chuàng)新高!
- 6 谷歌“香蕉”爆火啟示:國(guó)產(chǎn)垂類AI的危機(jī)還是轉(zhuǎn)機(jī)?
- 7 00后華裔女生靠?jī)刹緼I電影狂賺7.8億人民幣,AI正式進(jìn)軍好萊塢
- 8 美光:AI Capex瘋投不止,終于要拉起存儲(chǔ)超級(jí)周期了?
- 9 華為已殺入!AI領(lǐng)域最熱黃金賽道,大廠的數(shù)字人美女讓我一夜沒睡著覺
- 10 隱退4年后,張一鳴久違現(xiàn)身!互聯(lián)網(wǎng)大佬正集體殺回