-
facebook/dinov3-vit7b16-pretrain-lvd1689m
Image Feature Extraction • 7B • Updated • 13.9k • 241 -
facebook/dinov3-vits16-pretrain-lvd1689m
Image Feature Extraction • 21.6M • Updated • 351k • 143 -
facebook/dinov3-convnext-small-pretrain-lvd1689m
Image Feature Extraction • 49.5M • Updated • 22.4k • 31 -
facebook/dinov3-vitb16-pretrain-lvd1689m
Image Feature Extraction • 85.7M • Updated • 769k • 201
Collections
Discover the best community collections!
Collections trending this week
-
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 87 -
Scaling Latent Reasoning via Looped Language Models
Paper • 2510.25741 • Published • 234 -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
Paper • 2502.05171 • Published • 160 -
Pretraining Language Models to Ponder in Continuous Space
Paper • 2505.20674 • Published • 3
-
mindlab-research/Macaron-V1-Preview-749B
Text Generation • 754B • Updated • 343 • 82 -
mindlab-research/Macaron-V1-Preview-744B-Merged
Text Generation • 754B • Updated • 60 • 5 -
mindlab-research/Macaron-V1-Coding-Venti
Text Generation • 753B • Updated • 278 • 19 -
mindlab-research/Macaron-V1-Venti
Text Generation • 753B • Updated • 459 • 47
-
meta-llama/Llama-3.2-1B
Text Generation • 1B • Updated • 1.67M • 2.52k -
meta-llama/Llama-3.2-1B-Instruct
Text Generation • 1B • Updated • 10M • • 1.55k -
meta-llama/Llama-3.2-3B-Instruct
Text Generation • 3B • Updated • 1.49M • • 2.38k -
meta-llama/Llama-3.2-3B
Text Generation • 3B • Updated • 540k • 882
-
Qwen/Qwen3.5-397B-A17B
Image-Text-to-Text • 403B • Updated • 414k • • 1.54k -
Qwen/Qwen3.5-397B-A17B-FP8
Image-Text-to-Text • 403B • Updated • 797k • 181 -
Qwen/Qwen3.5-122B-A10B
Image-Text-to-Text • 125B • Updated • 1.81M • • 601 -
Qwen/Qwen3.5-122B-A10B-FP8
Image-Text-to-Text • 125B • Updated • 1.17M • 112
-
facebook/dinov3-vit7b16-pretrain-lvd1689m
Image Feature Extraction • 7B • Updated • 13.9k • 241 -
facebook/dinov3-vits16-pretrain-lvd1689m
Image Feature Extraction • 21.6M • Updated • 351k • 143 -
facebook/dinov3-convnext-small-pretrain-lvd1689m
Image Feature Extraction • 49.5M • Updated • 22.4k • 31 -
facebook/dinov3-vitb16-pretrain-lvd1689m
Image Feature Extraction • 85.7M • Updated • 769k • 201
-
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 87 -
Scaling Latent Reasoning via Looped Language Models
Paper • 2510.25741 • Published • 234 -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
Paper • 2502.05171 • Published • 160 -
Pretraining Language Models to Ponder in Continuous Space
Paper • 2505.20674 • Published • 3
-
mindlab-research/Macaron-V1-Preview-749B
Text Generation • 754B • Updated • 343 • 82 -
mindlab-research/Macaron-V1-Preview-744B-Merged
Text Generation • 754B • Updated • 60 • 5 -
mindlab-research/Macaron-V1-Coding-Venti
Text Generation • 753B • Updated • 278 • 19 -
mindlab-research/Macaron-V1-Venti
Text Generation • 753B • Updated • 459 • 47
-
Qwen/Qwen3.5-397B-A17B
Image-Text-to-Text • 403B • Updated • 414k • • 1.54k -
Qwen/Qwen3.5-397B-A17B-FP8
Image-Text-to-Text • 403B • Updated • 797k • 181 -
Qwen/Qwen3.5-122B-A10B
Image-Text-to-Text • 125B • Updated • 1.81M • • 601 -
Qwen/Qwen3.5-122B-A10B-FP8
Image-Text-to-Text • 125B • Updated • 1.17M • 112
-
meta-llama/Llama-3.2-1B
Text Generation • 1B • Updated • 1.67M • 2.52k -
meta-llama/Llama-3.2-1B-Instruct
Text Generation • 1B • Updated • 10M • • 1.55k -
meta-llama/Llama-3.2-3B-Instruct
Text Generation • 3B • Updated • 1.49M • • 2.38k -
meta-llama/Llama-3.2-3B
Text Generation • 3B • Updated • 540k • 882