v4: tied-table 12B — one bound vocab file, verify at the rungs that load, accepted_count, activations
50a5cd8 verified | *.7z filter=lfs diff=lfs merge=lfs -text | |
| *.arrow filter=lfs diff=lfs merge=lfs -text | |
| *.bin filter=lfs diff=lfs merge=lfs -text | |
| *.bz2 filter=lfs diff=lfs merge=lfs -text | |
| *.ckpt filter=lfs diff=lfs merge=lfs -text | |
| *.ftz filter=lfs diff=lfs merge=lfs -text | |
| *.gz filter=lfs diff=lfs merge=lfs -text | |
| *.h5 filter=lfs diff=lfs merge=lfs -text | |
| *.joblib filter=lfs diff=lfs merge=lfs -text | |
| *.lfs.* filter=lfs diff=lfs merge=lfs -text | |
| *.mlmodel filter=lfs diff=lfs merge=lfs -text | |
| *.model filter=lfs diff=lfs merge=lfs -text | |
| *.msgpack filter=lfs diff=lfs merge=lfs -text | |
| *.npy filter=lfs diff=lfs merge=lfs -text | |
| *.npz filter=lfs diff=lfs merge=lfs -text | |
| *.onnx filter=lfs diff=lfs merge=lfs -text | |
| *.ot filter=lfs diff=lfs merge=lfs -text | |
| *.parquet filter=lfs diff=lfs merge=lfs -text | |
| *.pb filter=lfs diff=lfs merge=lfs -text | |
| *.pickle filter=lfs diff=lfs merge=lfs -text | |
| *.pkl filter=lfs diff=lfs merge=lfs -text | |
| *.pt filter=lfs diff=lfs merge=lfs -text | |
| *.pth filter=lfs diff=lfs merge=lfs -text | |
| *.rar filter=lfs diff=lfs merge=lfs -text | |
| *.safetensors filter=lfs diff=lfs merge=lfs -text | |
| saved_model/**/* filter=lfs diff=lfs merge=lfs -text | |
| *.tar.* filter=lfs diff=lfs merge=lfs -text | |
| *.tar filter=lfs diff=lfs merge=lfs -text | |
| *.tflite filter=lfs diff=lfs merge=lfs -text | |
| *.tgz filter=lfs diff=lfs merge=lfs -text | |
| *.wasm filter=lfs diff=lfs merge=lfs -text | |
| *.xz filter=lfs diff=lfs merge=lfs -text | |
| *.zip filter=lfs diff=lfs merge=lfs -text | |
| *.zst filter=lfs diff=lfs merge=lfs -text | |
| *tfevents* filter=lfs diff=lfs merge=lfs -text | |
| gpu-pipelined/gemma4_12b_qat_decode_int4linsym_msdpa_g8/gemma4_12b_qat_decode_int4linsym_msdpa_g8.aimodel/main.mlirb filter=lfs diff=lfs merge=lfs -text | |
| gpu-pipelined/gemma4_12b_qat_decode_int4linsym_msdpa_g8/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| dense2in/gemma4_12b_qat_decode_int4linsym/gemma4_12b_qat_decode_int4linsym.aimodel/main.mlirb filter=lfs diff=lfs merge=lfs -text | |
| dense2in/gemma4_12b_qat_decode_int4linsym/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| dense2in-pf64/gemma4_12b_qat_decode_int4linsym_pf64/gemma4_12b_qat_decode_int4linsym_pf64.aimodel/main.mlirb filter=lfs diff=lfs merge=lfs -text | |
| dense2in-pf64/gemma4_12b_qat_decode_int4linsym_pf64/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| dense2in-int8/gemma4_12b_qat_decode_int8lin_pf64/gemma4_12b_qat_decode_int8lin_pf64.aimodel/main.mlirb filter=lfs diff=lfs merge=lfs -text | |
| dense2in-int8/gemma4_12b_qat_decode_int8lin_pf64/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| tiered/gemma4_12b_qat_decode_int4linsym_e4_msdpa_g8_wkv_stable_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k/gemma4_12b_qat_decode_int4linsym_e4_msdpa_g8_wkv_stable_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k.aimodel/main.mlirb filter=lfs diff=lfs merge=lfs -text | |
| tiered/gemma4_12b_qat_decode_int4linsym_e4_msdpa_g8_wkv_stable_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| tiered-v3/gemma4_12b_qat_decode_int4linsym_hf16_msdpa_g8_wkv_stable_pf64_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k/gemma4_12b_qat_decode_int4linsym_hf16_msdpa_g8_wkv_stable_pf64_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k.aimodel/main.mlirb filter=lfs diff=lfs merge=lfs -text | |
| tiered-v3/gemma4_12b_qat_decode_int4linsym_hf16_msdpa_g8_wkv_stable_pf64_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| v4/gpu-pipelined/gemma4_12b_qat_decode_int4linsym_hsc_msdpa_g8_wkv_stable_pf64_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k/gemma4_12b_qat_decode_int4linsym_hsc_msdpa_g8_wkv_stable_pf64_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k.aimodel/main.mlirb filter=lfs diff=lfs merge=lfs -text | |
| v4/gpu-pipelined/gemma4_12b_qat_decode_int4linsym_hsc_msdpa_g8_wkv_stable_pf64_tiered_c4k_c8k_c16k_c32k_c64k_c128k_c256k/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text | |
| v4/ios-frontend/gemma4_12b_tied_vocab/head.f16 filter=lfs diff=lfs merge=lfs -text | |