SAVRN
Search Contact SAVRN

Independent publisher

AI Forever

ai-forever

NLP, CV, multimodal, python3, pytorch, machine learning, deep learning

Models in Library1
Datasets in Library0
Models on Hugging Face116
Followers748

Models

Model · Video classification

kandinsky-videomae-large-camera-motion

AI Forever

VideoMAE model(large) variant that has been finetuned for multi-label video classification (a video can belong to multiple classes simultaneously) for camera motion classification on internal dataset. The model predicts 18 different camera motion 'arcleft', 'arcright', 'dollyin', 'dollyout', 'panleft', 'panright', 'pedestaldown', 'pedestalup', 'rollleft', 'rollright', 'static', 'tiltdown', 'tiltup', 'truckleft', 'truckright', 'undefined', 'zoomin', 'zoomout' and and 3 shot type classes: 'pov', 'shake', 'track'. Model was trained to associate entire video with camera labels, not frame-level motions(!): [input video] -> label/labels (because multilabel) for all video. So, if this camera…

Open weights 304M parameters transformers