nm-testing/tinyllama-one-shot-dynamic-test
Text Generation
• 1B • Updated • 20
nm-testing/tinyllama-one-shot-static-quant-test-compressed
Text Generation
• 1B • Updated • 57
nm-testing/asym-w8w8-int8-static-per-tensor-tiny-llama
1B • Updated • 1.17k
nm-testing/OLMoE-1B-7B-0924-Instruct-FP8
7B • Updated • 42
nm-testing/DeepSeek-Coder-V2-Lite-Instruct-W8A8
16B • Updated • 26
nm-testing/tinyllama-w8a8-compressed
1B • Updated • 2.07k
nm-testing/tinyllama-w4a16-compressed
1B • Updated • 2.48k
nm-testing/tinyllama-fp8-dynamic-compressed
1B • Updated • 1.4k
nm-testing/Meta-Llama-3-8B-Instruct-fp8-compressed
8B • Updated • 5
nm-testing/tinyllama-one-shot-w4a16-group-compressed
Text Generation
• 1B • Updated • 15
nm-testing/deepseekv2-lite-awq
16B • Updated • 50
• 1
nm-testing/Meta-Llama-3-8B-Instruct-fp8-hf_compat
8B • Updated • 17
nm-testing/Meta-Llama-3-70B-Instruct-FBGEMM-nonuniform
Text Generation
• 71B • Updated • 750
• 1
nm-testing/Meta-Llama-3-8B-Instruct-FBGEMM-nonuniform
Text Generation
• 8B • Updated • 14
nm-testing/llama-3-8b-instruct-fbgemm-test-model
Text Generation
• 8B • Updated • 18