
Kitchens4,222 ideas

Bathrooms2,442 ideas

Kids Rooms1,868 ideas

Bedrooms1,657 ideas

Powder Rooms1,638 ideas

Family Rooms1,414 ideas

Dining Rooms1,403 ideas

Laundry1,361 ideas

Basements1,338 ideas

Entries1,286 ideas

Home Bars1,168 ideas

Hallways1,131 ideas

Home Offices1,098 ideas

Living Rooms1,038 ideas

Nurseries923 ideas

Closets & Storage922 ideas

Sunrooms851 ideas

Decks792 ideas
Discover
Fresh ideas from your catalog
More from the web
![[2403.09631] 3D-VLA: A 3D Vision-Language-Action Generative World Model](https://ar5iv.labs.arxiv.org/html/2403.09631/assets/x2.png)


![[2403.09631] 3D-VLA: A 3D Vision-Language-Action Generative World Model](https://ar5iv.labs.arxiv.org/html/2403.09631/assets/x5.png)







![[论文评述] TriVLA: A Triple-System-Based Unified Vision-Language-Action ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/trivla-a-triple-system-based-unified-vision-language-action-model-for-general-robot-control-1.png)







![[논문 리뷰] SmolVLA: A Vision-Language-Action Model for Affordable and ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/smolvla-a-vision-language-action-model-for-affordable-and-efficient-robotics-0.png)


![[논문 리뷰] Eva-VLA: Evaluating Vision-Language-Action Models' Robustness ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/eva-vla-evaluating-vision-language-action-models-robustness-under-real-world-physical-variations-0.png)




![[论文评述] G$^3$VLA: Geometric inductive bias for Vision-Language-Action Models](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/g3vla-geometric-inductive-bias-for-vision-language-action-models-0.png)






![[论文评述] BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/bridgevla-input-output-alignment-for-efficient-3d-manipulation-learning-with-vision-language-models-1.png)









![[论文评述] GST-VLA: Structured Gaussian Spatial Tokens for 3D Depth-Aware ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/gst-vla-structured-gaussian-spatial-tokens-for-3d-depth-aware-vision-language-action-models-0.png)
![[논문 리뷰] GeneralVLA: Generalizable Vision-Language-Action Models with ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/generalvla-generalizable-vision-language-action-models-with-knowledge-guided-trajectory-planning-0.png)

![[論文レビュー] RoboMamba: Efficient Vision-Language-Action Model for Robotic ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/robomamba-efficient-vision-language-action-model-for-robotic-reasoning-and-manipulation-1.png)
![[논문 리뷰] Pure Vision Language Action (VLA) Models: A Comprehensive Survey](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/pure-vision-language-action-vla-models-a-comprehensive-survey-0.png)




![[PDF] Vision-Language-Action (VLA) Models: Concepts, Progress ...](https://figures.semanticscholar.org/b2f4aa849f1e06436d4cd4b76c43413076128ba8/24-Figure16-1.png)


![[논문 리뷰] GeoPredict: Leveraging Predictive Kinematics and 3D Gaussian ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/geopredict-leveraging-predictive-kinematics-and-3d-gaussian-geometry-for-precise-vla-manipulation-2.png)
![[Literature Review] VLA-RFT: Vision-Language-Action Reinforcement Fine ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/vla-rft-vision-language-action-reinforcement-fine-tuning-with-verified-rewards-in-world-simulators-0.png)


![[논문 리뷰] XR-1: Towards Versatile Vision-Language-Action Models via ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/xr-1-towards-versatile-vision-language-action-models-via-learning-unified-vision-motion-representations-0.png)








![[논문 리뷰] QDepth-VLA: Quantized Depth Prediction as Auxiliary Supervision ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/qdepth-vla-quantized-depth-prediction-as-auxiliary-supervision-for-vision-language-action-models-2.png)





![[Literature Review] AugVLA-3D: Depth-Driven Feature Augmentation for ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/augvla-3d-depth-driven-feature-augmentation-for-vision-language-action-models-1.png)
![[논문 리뷰] SPATIAL FORCING: IMPLICIT SPATIAL REPRESENTATION ALIGNMENT FOR ...](https://velog.velcdn.com/images/jack_7711/post/4eb3d4e4-586b-4e7f-b80f-30578525321a/image.png)





![[논문 리뷰] RoboNurse-VLA: Robotic Scrub Nurse System based on Vision ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/robonurse-vla-robotic-scrub-nurse-system-based-on-vision-language-action-model-0.png)

















![[논문 리뷰] Hierarchical Vision Language Action Model Using Success and ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/hierarchical-vision-language-action-model-using-success-and-failure-demonstrations-2.png)
![[论文评述] ROSA: Harnessing Robot States for Vision-Language and Action ...](https://moonlight-paper-snapshot.s3.ap-northeast-2.amazonaws.com/arxiv/rosa-harnessing-robot-states-for-vision-language-and-action-alignment-1.png)





![[具身智能] 机器人操作VLA模型论文整理 - 知乎](https://pic1.zhimg.com/v2-8364247750bda27952e889f77ce43be4_r.jpg)





