nm-testing/tinyllama-one-shot-dynamic-test
Text Generation
• 1B • Updated • 20
nm-testing/tinyllama-one-shot-static-quant-test-compressed
Text Generation
• 1B • Updated • 51
nm-testing/asym-w8w8-int8-static-per-tensor-tiny-llama
1B • Updated • 1.02k
nm-testing/OLMoE-1B-7B-0924-Instruct-FP8
7B • Updated • 35
nm-testing/DeepSeek-Coder-V2-Lite-Instruct-W8A8
16B • Updated • 25
nm-testing/tinyllama-w8a8-compressed
1B • Updated • 1.92k
nm-testing/tinyllama-w4a16-compressed
1B • Updated • 2.51k
nm-testing/tinyllama-fp8-dynamic-compressed
1B • Updated • 1.35k
nm-testing/Meta-Llama-3-8B-Instruct-fp8-compressed
8B • Updated • 6
nm-testing/tinyllama-one-shot-w4a16-group-compressed
Text Generation
• 1B • Updated • 17
nm-testing/deepseekv2-lite-awq
16B • Updated • 33
• 1
nm-testing/Meta-Llama-3-8B-Instruct-fp8-hf_compat
8B • Updated • 18
nm-testing/Meta-Llama-3-70B-Instruct-FBGEMM-nonuniform
Text Generation
• 71B • Updated • 747
• 1
nm-testing/Meta-Llama-3-8B-Instruct-FBGEMM-nonuniform
Text Generation
• 8B • Updated • 16
nm-testing/llama-3-8b-instruct-fbgemm-test-model
Text Generation
• 8B • Updated • 17