| 講演抄録/キーワード |
| 講演名 |
2026-03-17 10:00
Towards 3D Scene Graph Reconstruction from a Single Image via Graph-based Reasoning ○Phueaksri Itthisak・Yasutomo Kawanishi(RIKEN, GRP) IMQ2025-70 IE2025-147 MVE2025-77 |
| 抄録 |
(和) |
3Dシーングラフ生成は,物体とそれらの間の関係をグラフ構造として表現することで,3次元シーンの包括的理解を目指す技術であり,ロボティクスや視覚的質問応答(VQA)などの多様な下流タスクに用いられる.
従来手法は,高精度な3次元空間情報の推定のために多視点観測を前提としているが,実環境では観測領域が制限される場合や即時的な推論が求められる場面も多く,特に,単一画像を入力とするVQAシステムでは,この制約が顕著である.
本稿では,これらの課題に対処するため,単一画像から3Dシーングラフを生成する枠組みを提案する.
提案手法は主に深度推定と関係推定の2つの要素から構成される.
まず,深度推定により物体の3次元空間情報を推定する.
次にグラフベース推論により物体特徴と空間情報を統合することで,物体間の関係を推定し,最終的なシーングラフを構築する.
評価実験では,3DSGG indoor datasetのアノテーションを拡張し,単一視点での評価が可能な設定を構築して実験した.
結果,提案手法はベースライン手法を上回る性能を示し,単一画像からの3Dシーングラフ生成する提案手法の有効性を示した. |
| (英) |
3D Scene Graph Generation aims to achieve a comprehensive understanding of 3D scenes by representing objects and their relationships as a graph.
%
This representation supports various downstream tasks, including robotics and visual question answering.
%
Conventional 3D scene graph generation approaches rely on multi-view observations to estimate accurate 3D spatial information and construct reliable scene graphs.
%
However, multi-view acquisition is not always feasible.
%
In many practical scenarios, only a limited observable region is available, or early-stage reasoning is required.
%
This setting commonly arises in visual question answering systems that operate on a single image.
%
To address this limitation, we propose a framework to generate 3D scene graphs from a single image.
%
The proposed framework consists of two main components.
%
First, 3D spatial estimation predicts object 3D spatial information from a single image.
%
Second, graph-based reasoning estimates 3D spatial information with object features to infer relationships between objects and construct the final 3D scene graph.
%
We evaluate our method on the 3DSGG indoor dataset.
%
For this purpose, we extend the original annotations to support single-view 3D scene graph reconstruction.
%
Experimental results demonstrate that the proposed method outperforms baseline approaches, validating a monocular 3D scene graph generation. |
| キーワード |
(和) |
3Dシーングラフ生成 / 単一画像理解 / グラフベース推論 / / / / / |
| (英) |
3D Scene Graph Generation / Single-Image Understanding / Graph-based Reasoning / / / / / |
| 文献情報 |
信学技報, vol. 125, no. 411, MVE2025-77, pp. 291-295, 2026年3月. |
| 資料番号 |
MVE2025-77 |
| 発行日 |
2026-03-09 (IMQ, IE, MVE) |
| ISSN |
Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
IMQ2025-70 IE2025-147 MVE2025-77 |
| 研究会情報 |
| 研究会 |
CQ MVE IMQ IE |
| 開催期間 |
2026-03-16 - 2026-03-18 |
| 開催地(和) |
沖縄産業支援センター |
| 開催地(英) |
Okinawa-Sangyoushien-Center |
| テーマ(和) |
五感に訴えるオンラインメディアとその評価,および一般 |
| テーマ(英) |
|
| 講演論文情報の詳細 |
| 申込み研究会 |
MVE |
| 会議コード |
2026-03-CQ-MVE-IMQ-IE |
| 本文の言語 |
英語 |
| タイトル(和) |
|
| サブタイトル(和) |
|
| タイトル(英) |
Towards 3D Scene Graph Reconstruction from a Single Image via Graph-based Reasoning |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
3Dシーングラフ生成 / 3D Scene Graph Generation |
| キーワード(2)(和/英) |
単一画像理解 / Single-Image Understanding |
| キーワード(3)(和/英) |
グラフベース推論 / Graph-based Reasoning |
| キーワード(4)(和/英) |
/ |
| キーワード(5)(和/英) |
/ |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
Phueaksri Itthisak / Phueaksri Itthisak / |
| 第1著者 所属(和/英) |
RIKEN, GRP (略称: RIKEN, GRP)
RIKEN, GRP (略称: RIKEN, GRP) |
| 第2著者 氏名(和/英/ヨミ) |
Yasutomo Kawanishi / Yasutomo Kawanishi / |
| 第2著者 所属(和/英) |
RIKEN, GRP (略称: RIKEN, GRP)
RIKEN, GRP (略称: RIKEN, GRP) |
| 第3著者 氏名(和/英/ヨミ) |
/ / |
| 第3著者 所属(和/英) |
(略称: )
(略称: ) |
| 第4著者 氏名(和/英/ヨミ) |
/ / |
| 第4著者 所属(和/英) |
(略称: )
(略称: ) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2026-03-17 10:00:00 |
| 発表時間 |
20分 |
| 申込先研究会 |
MVE |
| 資料番号 |
IMQ2025-70, IE2025-147, MVE2025-77 |
| 巻番号(vol) |
vol.125 |
| 号番号(no) |
no.408(IMQ), no.410(IE), no.411(MVE) |
| ページ範囲 |
pp.291-295 |
| ページ数 |
5 |
| 発行日 |
2026-03-09 (IMQ, IE, MVE) |
|