Mixed-precision quantizations of Latitude Games's 12B models, using NVFP4+4/6 for MLP layers and FP8_DYNAMIC for self-attention.
Jesse Mitchell
DataSnake
AI & ML interests
None yet
Organizations
None yet
models 18
DataSnake/Muse-12B-NVFP4-FP8
Text Generation • 8B • Updated • 17
DataSnake/Wayfarer-12B-NVFP4-FP8
Text Generation • 8B • Updated • 48
DataSnake/Mistral-Nemo-Instruct-2407-NVFP4-FP8
Text Generation • 8B • Updated • 93
DataSnake/Mistral-Nemo-Instruct-2407-NVFP4-FP8-RTN
8B • Updated • 8
DataSnake/Mistral-Nemo-Instruct-2407-Down-4over6
Text Generation • 9B • Updated • 11
DataSnake/Wayfarer-12B-NVFP4-4over6
Text Generation • 7B • Updated • 9 • 1
DataSnake/Mistral-Nemo-Instruct-2407-NVFP4-4over6
Text Generation • 7B • Updated • 11
DataSnake/Wayfarer-2-12B-NVFP4-FP8
Text Generation • 8B • Updated • 23
DataSnake/Wayfarer-2-12B-NVFP4-4over6
Text Generation • 7B • Updated • 12 • 2
DataSnake/Muse-12B-NVFP4-4over6
Text Generation • 7B • Updated • 25 • 1
datasets 0
None public yet