Rare find

2D-Positional-Encoding-Vision-Transformer. PyTorch implementation of 2D Positional Encodings for Vision Transformers (ViT). Positional Encodings/Embeddings: Sinusoidal (Absolute), Learnable, Relative and Rotation (Rope).

github.com/s-chh/2D-Positional-Encoding-Vision-Transformer

Vaya's read on this project

Problem, audience, market, and the verdict — sign in to see it.

Updates

No recent activity.