Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Ryukijano
's Collections
World-models
AI-For-Quantum Computing
AI-4-Sciences
Learning
VLM_spaces
STEM
Vision_transformer_robotics
VILA
Midi-composer
Diffusion models
Neural Rendering
Deep Reinforcement Learning
Own Work
Deep learning
LLMs
Computer vision
Audio
Multi modal foundational models
Text_to_video diffusion
Vision_language_models
Text-3D
2D->3D
Audio->3D
Segmentation
Vision_language_models
updated
Jun 5, 2025
Upvote
-
Sort: Collection
Running
81
Experimental Moondream WebGPU
🌕
81
Generate captions for your images instantly
meta-llama/Llama-3.2-90B-Vision-Instruct
Image-Text-to-Text
•
89B
•
Updated
Mar 4, 2025
•
39k
•
359
Hcompany/Holo1-3B
Image-Text-to-Text
•
4B
•
Updated
Jun 10, 2025
•
456
•
83
Upvote
-
Sort: Collection
Share collection
View history
Collection guide
Browse collections