Read original ↗
paperarXivTrust 82 · PrimaryPublished 26d agoLive · 25d ago

VGOcc: Learning Visual-Geometric Gaussians for Vision-Centric 3D Driving Occupancy Prediction

Vision-only occupancy prediction requires recovering a semantic 3D occupancy field from calibrated surround-view images, where each view provides observations with ambiguous depth along camera rays. Existing methods have progressed from dense structured representations to sparse Gaussian primitives, improving the efficiency of 3D scene representation. However, Gaussian learning still relies primarily on image domain features, which provide limited explicit geometric information for volumetric reasoning. Our key observation is that effective Gaussian occupancy modeling requires not only sparse

Lineage graph

Paper → model → repo connections mined from source citations (Tier-1 exact match).

Why these links exist

Every edge carries a method, confidence, and the source snippet that justified it — so bad links are debuggable.

  • FuzzySimilar title/name (fuzzy) · 59%VioletVision-3B

    Fuzzy title match (0.73): “VGOcc: Learning Visual-Geometric Gaussians for Vision-Centri” ≈ “VioletVision-3B”

  • FuzzySimilar title/name (fuzzy) · 84%pytorch/vision

    Fuzzy title match (0.92): “VGOcc: Learning Visual-Geometric Gaussians for Vision-Centri” ≈ “pytorch/vision”

  • FuzzyOverlapping authors or contributors · 62%Zeyi-Lin/HivisionIDPhotos

    Shared author/contributor keys: lin

  • FuzzyOverlapping authors or contributors · 62%mudler/LocalAI

    Shared author/contributor keys: guo

  • FuzzyOverlapping authors or contributors · 62%bytedance/deer-flow

    Shared author/contributor keys: wang

  • FuzzyOverlapping authors or contributors · 62%hiyouga/LlamaFactory

    Shared author/contributor keys: lin

  • LinkedLinked via arxiv author · 85%Junhong Lin

    VGOcc: Learning Visual-Geometric Gaussians for Vision-Centric 3D Driving Occupancy Prediction

  • LinkedLinked via arxiv author · 85%Xianda Guo

    VGOcc: Learning Visual-Geometric Gaussians for Vision-Centric 3D Driving Occupancy Prediction

Has model

Implements (incoming)

authored (incoming)

Related across the graph

Topics