Video-Text-to-Text
Transformers
PyTorch
English
pixelrefer_qwen2
text-generation
multimodal large language model
large video-language model
Instructions to use Alibaba-DAMO-Academy/PixelRefer-2B with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use Alibaba-DAMO-Academy/PixelRefer-2B with Transformers:
# Load model directly from transformers import AutoModelForCausalLM model = AutoModelForCausalLM.from_pretrained("Alibaba-DAMO-Academy/PixelRefer-2B", device_map="auto") - Notebooks
- Google Colab
- Kaggle
- Xet hash:
- e9f35cf906a95f6129f134506f73778b11114401e67ee2b49abbf178301eb275
- Size of remote file:
- 4.39 GB
- SHA256:
- 4e506fc4d8bedb9d163b60454efd1036629c3ec9e6df8d5b7edac5218b342b1b
·
Xet efficiently stores Large Files inside Git, intelligently splitting files into unique chunks and accelerating uploads and downloads. More info.