Mixed-precision quantizations of Latitude Games's 12B models, using NVFP4+4/6 for MLP layers and FP8_DYNAMIC for self-attention.
Jesse Mitchell
DataSnake
AI & ML interests
None yet
Organizations
None yet
models 18
DataSnake/Muse-12B-NVFP4-FP8
Text Generation • 8B • Updated • 13
DataSnake/Wayfarer-12B-NVFP4-FP8
Text Generation • 8B • Updated • 61
DataSnake/Mistral-Nemo-Instruct-2407-NVFP4-FP8
Text Generation • 8B • Updated • 410
DataSnake/Mistral-Nemo-Instruct-2407-NVFP4-FP8-RTN
8B • Updated • 11
DataSnake/Mistral-Nemo-Instruct-2407-Down-4over6
Text Generation • 9B • Updated • 7
DataSnake/Wayfarer-12B-NVFP4-4over6
Text Generation • 7B • Updated • 9 • 1
DataSnake/Mistral-Nemo-Instruct-2407-NVFP4-4over6
Text Generation • 7B • Updated • 14
DataSnake/Wayfarer-2-12B-NVFP4-FP8
Text Generation • 8B • Updated • 18
DataSnake/Wayfarer-2-12B-NVFP4-4over6
Text Generation • 7B • Updated • 7 • 2
DataSnake/Muse-12B-NVFP4-4over6
Text Generation • 7B • Updated • 21 • 1
datasets 0
None public yet