nas3r

カメラ姿勢や事前の3Dデータなしで、画像から3Dシーンを自己教師ありで再構成する手法の研究用コードです。CVPR 2026論文に付随します。

Xで共有ライセンス: MIT

概要

NAS3RはCVPR 2026の論文に対応する研究用コードで、通常の画像から3Dシーンを再構成します。正解ラベルや事前学習済みの事前知識を使わず、3D形状とカメラパラメータを同時に学習する自己教師ありのフィードフォワード型フレームワークです。導入手順、Hugging Faceのチェックポイント、データセットや実行方法の説明がPythonとPyTorchで提供されています。

主な特長

  • 3D形状とカメラパラメータを同時に学習
  • 正解ラベルも事前学習の事前知識も不要
  • 2視点と多視点のチェックポイントを公開
  • 一部のモデルはカメラ内部パラメータを入力可能
  • VGGT系とMASt3R風の構成を用意

こんな人・用途に

カメラ姿勢なしの3D再構成や新規視点合成を研究し、論文の再現や発展を目指す人向けです。CUDA対応のPyTorch環境が前提です。

アップストリーム
ranrhuang/NAS3R
GitHubのフォーク
Guo-astro/nas3r
アップストリームのスター数
121
カテゴリ
金融・データ・リサーチ
言語
Python
ライセンス
MIT
フォーク日
2026-05-03
同期状態
同期済み最終同期 2026-09-29