-
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 86 -
Scaling Latent Reasoning via Looped Language Models
Paper • 2510.25741 • Published • 236 -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
Paper • 2502.05171 • Published • 162 -
Pretraining Language Models to Ponder in Continuous Space
Paper • 2505.20674 • Published • 3
Collections
Discover the best community collections!
Collections trending this week
-
FINAL-Bench/POCKET-35B-GGUF
Text Generation • 35B • Updated • 730k • 75 -
FINAL-Bench/POCKET-KR-GGUF
Text Generation • 23B • Updated • 964 • 38 -
FINAL-Bench/POCKET-KR-MLX
Text Generation • 15B • Updated • 481 • 35 -
FINAL-Bench/POCKET-EN-GGUF
Text Generation • 23B • Updated • 1.04k • 44
-
facebook/dinov3-vit7b16-pretrain-lvd1689m
Image Feature Extraction • 7B • Updated • 11.1k • 273 -
facebook/dinov3-vits16-pretrain-lvd1689m
Image Feature Extraction • 21.6M • Updated • 428k • 267 -
facebook/dinov3-convnext-small-pretrain-lvd1689m
Image Feature Extraction • 49.5M • Updated • 27.7k • 42 -
facebook/dinov3-vitb16-pretrain-lvd1689m
Image Feature Extraction • 85.7M • Updated • 584k • 350
-
DavidAU/L3.1-Dark-Reasoning-LewdPlay-evo-Hermes-R1-Uncensored-8B
Text Generation • 8B • Updated • 467 • • 82 -
DavidAU/L3.1-Dark-Reasoning-Unholy-Hermes-R1-Uncensored-8B
Text Generation • 8B • Updated • 160 • • 22 -
DavidAU/L3.1-MOE-6X8B-Dark-Reasoning-Dantes-Peak-HORROR-R1-Uncensored-36B-GGUF
Text Generation • 36B • Updated • 4.77k • 28 -
DavidAU/L3.1-Dark-Reasoning-Dark-Planet-Hermes-R1-Uncensored-Horror-Imatrix-MAX-8B-GGUF
Text Generation • 8B • Updated • 965 • 9
-
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Text-to-Speech • 2B • Updated • 2.41M • 2.01k -
Qwen/Qwen3-TTS-12Hz-0.6B-Base
Text-to-Speech • 0.9B • Updated • 672k • 301 -
Qwen/Qwen3-TTS-12Hz-1.7B-VoiceDesign
Text-to-Speech • 2B • Updated • 328k • 426 -
Qwen/Qwen3-TTS-12Hz-1.7B-Base
2B • Updated • 3.92M • 537
-
meta-llama/Llama-3.2-1B
Text Generation • 1B • Updated • 788k • • 2.63k -
meta-llama/Llama-3.2-1B-Instruct
Text Generation • 1B • Updated • 7.32M • • 1.74k -
meta-llama/Llama-3.2-3B-Instruct
Text Generation • 3B • Updated • 1.94M • • 2.67k -
meta-llama/Llama-3.2-3B
Text Generation • 3B • Updated • 358k • • 975
-
deepseek-ai/DeepSeek-V4-Flash-Base
292B • Updated • 405k • 326 -
deepseek-ai/DeepSeek-V4-Flash
Text Generation • 291B • Updated • 1.27M • • 2.26k -
deepseek-ai/DeepSeek-V4-Pro-Base
1.6T • Updated • 32.4k • 343 -
deepseek-ai/DeepSeek-V4-Pro
Text Generation • 1.6T • Updated • 462k • • 5.6k
-
Continuous Latent Diffusion Language Model
Paper • 2605.06548 • Published • 86 -
Scaling Latent Reasoning via Looped Language Models
Paper • 2510.25741 • Published • 236 -
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
Paper • 2502.05171 • Published • 162 -
Pretraining Language Models to Ponder in Continuous Space
Paper • 2505.20674 • Published • 3
-
DavidAU/L3.1-Dark-Reasoning-LewdPlay-evo-Hermes-R1-Uncensored-8B
Text Generation • 8B • Updated • 467 • • 82 -
DavidAU/L3.1-Dark-Reasoning-Unholy-Hermes-R1-Uncensored-8B
Text Generation • 8B • Updated • 160 • • 22 -
DavidAU/L3.1-MOE-6X8B-Dark-Reasoning-Dantes-Peak-HORROR-R1-Uncensored-36B-GGUF
Text Generation • 36B • Updated • 4.77k • 28 -
DavidAU/L3.1-Dark-Reasoning-Dark-Planet-Hermes-R1-Uncensored-Horror-Imatrix-MAX-8B-GGUF
Text Generation • 8B • Updated • 965 • 9
-
FINAL-Bench/POCKET-35B-GGUF
Text Generation • 35B • Updated • 730k • 75 -
FINAL-Bench/POCKET-KR-GGUF
Text Generation • 23B • Updated • 964 • 38 -
FINAL-Bench/POCKET-KR-MLX
Text Generation • 15B • Updated • 481 • 35 -
FINAL-Bench/POCKET-EN-GGUF
Text Generation • 23B • Updated • 1.04k • 44
-
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Text-to-Speech • 2B • Updated • 2.41M • 2.01k -
Qwen/Qwen3-TTS-12Hz-0.6B-Base
Text-to-Speech • 0.9B • Updated • 672k • 301 -
Qwen/Qwen3-TTS-12Hz-1.7B-VoiceDesign
Text-to-Speech • 2B • Updated • 328k • 426 -
Qwen/Qwen3-TTS-12Hz-1.7B-Base
2B • Updated • 3.92M • 537
-
facebook/dinov3-vit7b16-pretrain-lvd1689m
Image Feature Extraction • 7B • Updated • 11.1k • 273 -
facebook/dinov3-vits16-pretrain-lvd1689m
Image Feature Extraction • 21.6M • Updated • 428k • 267 -
facebook/dinov3-convnext-small-pretrain-lvd1689m
Image Feature Extraction • 49.5M • Updated • 27.7k • 42 -
facebook/dinov3-vitb16-pretrain-lvd1689m
Image Feature Extraction • 85.7M • Updated • 584k • 350
-
meta-llama/Llama-3.2-1B
Text Generation • 1B • Updated • 788k • • 2.63k -
meta-llama/Llama-3.2-1B-Instruct
Text Generation • 1B • Updated • 7.32M • • 1.74k -
meta-llama/Llama-3.2-3B-Instruct
Text Generation • 3B • Updated • 1.94M • • 2.67k -
meta-llama/Llama-3.2-3B
Text Generation • 3B • Updated • 358k • • 975
-
deepseek-ai/DeepSeek-V4-Flash-Base
292B • Updated • 405k • 326 -
deepseek-ai/DeepSeek-V4-Flash
Text Generation • 291B • Updated • 1.27M • • 2.26k -
deepseek-ai/DeepSeek-V4-Pro-Base
1.6T • Updated • 32.4k • 343 -
deepseek-ai/DeepSeek-V4-Pro
Text Generation • 1.6T • Updated • 462k • • 5.6k