AmodalSynthDrive: 自動運転のための合成アモーダル知覚データセット

AmodalSynthDrive: 自動運転のための合成アモーダル知覚データセット

この記事は、Heart of Autonomous Driving の公開アカウントから許可を得て転載したものです。転載については出典元にお問い合わせください。

  • 論文リンク: https://arxiv.org/pdf/2309.06547.pdf
  • データセットリンク: http://amodalsynthdrive.cs.uni-freiburg.de

まとめ

この論文では、自動運転のための合成アモーダル知覚データセットである AmodalSynthDrive を紹介します。部分的に遮蔽されていても物体の全体を問題なく推定できる人間とは異なり、現代のコンピューター ビジョン アルゴリズムでは、この点が依然として非常に困難です。自動運転にこのタイプのモダリティフリー知覚を活用することは、適切なデータセットが不足しているため、ほとんど未開拓のままです。これらのデータセットの生成は、主に、高額な注釈コストと、遮蔽された領域に正確に注釈を付ける際の注釈者の主観によって引き起こされる干渉を軽減する必要性によって影響を受けます。これらの制限に対処するために、本論文では、合成マルチタスク非モーダル知覚データセットである AmodalSynthDrive を紹介します。このデータセットには、さまざまな交通、天候、照明条件下での 100 万を超えるオブジェクト注釈を含む、150 の運転シーケンスのマルチビュー カメラ画像、3D 境界ボックス、LIDAR データ、オドメトリが含まれています。 AmodalSynthDrive は、空間理解を強化するためのアモーダル深度推定の導入など、さまざまなアモーダルシーン理解タスクをサポートします。課題を明らかにするために、各タスクのいくつかのベースラインを評価し、パブリック ベンチマーク サーバーをセットアップします。

主な貢献

この論文の貢献は次のように要約されます。

1) 本論文では、複数のデータソースを持つ市街地運転シナリオ向けの包括的な合成アモーダル知覚データセットである AmodalSynthDrive データセットを提案します。

2) アモーダル知覚タスクのベンチマーク、すなわちアモーダルセマンティックセグメンテーション、アモーダルインスタンスセグメンテーション、アモーダルパノプティックセグメンテーションを提案する。

3) 新しい非モーダル深度推定タスクは、空間理解の向上を促進することを目的としています。私たちは、いくつかのベースラインを通じてこの新しいタスクの実現可能性を実証します。

紙の図表








要約する

知覚は自動運転車にとって非常に重要なタスクですが、現在のアプローチでは、複雑な交通シナリオを解釈するために必要な非モーダル理解がまだ欠けています。この目的のために、本論文では、自動運転のためのマルチモーダル合成知覚データセットである AmodalSynthDrive を提案します。合成画像と LiDAR ポイント クラウドを使用して、基本的なアモーダル知覚タスクのグラウンド トゥルース注釈付きデータを含む包括的なデータセットを提供するとともに、アモーダル深度推定と呼ばれる空間理解を強化するための新しいタスクも導入します。この論文では、60,000 を超える個別の画像セットが提供されており、それぞれがアモーダルインスタンスセグメンテーション、アモーダルセマンティックセグメンテーション、アモーダルパノプティックセグメンテーション、オプティカルフロー、2D および 3D 境界ボックス、アモーダル深度、鳥瞰図に関連付けられています。 AmodalSynthDrive を通じて、私たちはある種のベースラインを提供しており、この研究が動的な都市環境におけるアモーダルシーン理解の新たな研究への道を開くと信じています。

オリジナルリンク: https://mp.weixin.qq.com/s/7cXqFbMoljcs6dQOLU3SAQ

<<:  人工知能技術は建設業界をどのように変えるのでしょうか?

>>:  これは魔法ですか? ICCV 2023 の優秀な学生論文など、すべての情報を一度に追跡しましょう。 Githubには1.6Kのスターがあります

ブログ    

推薦する

Vision Pro が 50 億ドルで売却され、ザッカーバーグは大喜び! Metaは500億ドルを燃やし、VR復活の希望がここにある

海外メディアの報道によると、2月2日の正式発売前に、AppleのVision Proはすでに20万台...

AIツール:音楽から生成される画像の未来を探り、

音楽と画像は、感情を呼び起こし、物語を伝えることができる強力な媒体であることは周知の事実です。しかし...

自動運転車はどれくらい遠いのでしょうか?

現在、5Gや人工知能産業が活況を呈しており、さまざまな大手企業が利益を最大化するために「応用シナリオ...

自動運転自転車が発売されました。これを見た後ではもう運転したくありません!ホットカミング

Google Bikeが先行販売を開始しました。まだ自転車に乗りたいかなんて聞くまでもありません。車...

EUのドローン関連法は国内メーカーにとって恩恵か、それとも災いか?

ユーザーがドローンを操作する方法を規制する法律が来週の木曜日(1月7日)に施行される。この法律はノル...

Kingsoft ビデオクラウド AI + エッジコンピューティング デュアルアクセラレーションが 5G HD 時代をリード

5G時代の到来により、さまざまな業界のトラフィックが爆発的な増加を遂げており、特にビデオ業界はインタ...

...

専門家の意見: AIアプリケーションでは、ビッグデータよりもワイドデータが価値がある

今日の急速に変化するデジタル世界では、データの使用は進化し続けており、企業は構造化データと非構造化デ...

資本の饗宴は続く:2021年上半期の生体認証分野における資金調達のレビュー

近年、5Gが話題になっていますが、AIはまだ時代遅れになっていません。特に、インターネットが普及し、...

2020年に人工知能を変える8つのトレンド

人工知能は長い間、架空の物語、SF、さらには映画にも登場してきました。人々の目には、これは技術的な魔...

米連邦取引委員会は、ChatGPTによるデータ漏洩と回答の捏造を含むOpenAIに対する徹底的な調査を開始した。

ワシントンポスト紙によると、7月13日、米国連邦取引委員会(FTC)はサンフランシスコに拠点を置くO...

2021年6月の人工知能分野における重要な進展の概要

人工知能は、人間の理論、方法、技術、アプリケーション システムをシミュレート、拡張、拡大するために使...

世界では毎年24の言語が消滅している。AIは絶滅危惧言語の新たな救世主となった

昨年、国連は2019年を「国際先住民族言語年」と宣言し、今、このお祭りがますます近づいてきています。...

企業の4分の1以上が従業員による生成AIの使用を禁止している

シスコの 2024 年データ プライバシー ベンチマーク調査によると、プライバシーとデータ セキュリ...

縮小版のOpenAIの新しいテキスト生成画像モデルGLIDEは、DALL-Eに匹敵する35億のパラメータを持つ。

[[441688]]モデルのパラメータサイズはそれほど大きくする必要はありません。今年初めにOpe...