nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test Text Generation • 8B • Updated about 3 hours ago • 18.3k
nm-testing/Meta-Llama-3-8B-Instruct-nonuniform-test Text Generation • 8B • Updated about 3 hours ago • 26.1k
nm-testing/Speculator-Qwen3-8B-Eagle3-converted-071-quantized-w4a16 1B • Updated Sep 29, 2025 • 7.01k
nm-testing/TinyLlama-1.1B-Chat-v1.0-W4A16-G128-Asym-Updated-ActOrder 1B • Updated Apr 10, 2025 • 14.8k
nm-testing/TinyLlama-1.1B-Chat-v1.0-W8A8-Dynamic-Per-Token-compressed 1B • Updated Jan 14, 2025 • 878
nm-testing/TinyLlama-1.1B-Chat-v1.0-W8A8-Dynamic-Per-Token-uncompressed 1B • Updated about 3 hours ago • 258
nm-testing/llama2.c-stories15M-ultrachat-mixed-uncompressed 24.4M • Updated about 3 hours ago • 2.49k
nm-testing/llama2.c-stories42M-gsm8k-quantized-only-uncompressed 58.1M • Updated about 3 hours ago • 2.82k
nm-testing/tinyllama-oneshot-w4a16-channel-v2 Text Generation • 1B • Updated about 3 hours ago • 21.6k • 1
nm-testing/tinyllama-oneshot-w4a16-group128-v2 Text Generation • 1B • Updated about 3 hours ago • 16.6k
nm-testing/tinyllama-oneshot-w8-channel-a8-tensor Text Generation • 1B • Updated about 3 hours ago • 865
nm-testing/tinyllama-oneshot-w8a16-per-channel Text Generation • 1B • Updated about 3 hours ago • 828
nm-testing/tinyllama-oneshot-w8a8-channel-dynamic-token-v2 Text Generation • 1B • Updated about 3 hours ago • 13.9k
nm-testing/tinyllama-oneshot-w8a8-dynamic-token-v2 Text Generation • 1B • Updated about 3 hours ago • 11.2k
nm-testing/tinyllama-oneshot-w8w8-test-static-shape-change Text Generation • 1B • Updated about 3 hours ago • 44.4k