Wang, X., Wang, T., Chen,Y., Pang, J., & Lin, D. (2024). PointLLM: Empowering Large Language Models to Understand Point Clouds. European Conference on Computer Vision (ECCV). 6
点群から3D幾何特 徴を抽出 Xu, R., Wang, X., Wang, T., Chen,Y., Pang, J., & Lin, D. (2024). PointLLM: Empowering Large Language Models to Understand Point Clouds. European Conference on Computer Vision (ECCV). 7
事前学習済みモデル (Point-BERT)を使用 Xu, R., Wang, X., Wang, T., Chen,Y., Pang, J., & Lin, D. (2024). PointLLM: Empowering Large Language Models to Understand Point Clouds. European Conference on Computer Vision (ECCV). 8
Text Token Max-Pooling <p_end> K近傍点取得 (学習可能なコードブック を用いたベクトル量子化) 3D Token 幾何特徴量を算出 幾何特徴空間へ投影 Local geometry (Linear) aggregation <p_start> 点のサンプリング (Farthest Point Sampling) 幾何特徴(連続空間)を 語彙(離散空間)へ変換 3D Tokenへ変換 …