nm-testing/Meta-Llama-3-8B-Instruct-W8A8-FP8-Channelwise-compressed-tensors Text Generation • 8B • Updated 26 days ago • 40 • 2
nm-testing/Meta-Llama-3-8B-Instruct-W8A8-Dyn-Per-Token-2048-Samples Text Generation • 8B • Updated 26 days ago • 206
nm-testing/Meta-Llama-3-8B-Instruct-W8A8-Dyn-Per-Token Text Generation • 8B • Updated 26 days ago • 192
nm-testing/Meta-Llama-3-8B-Instruct-W8-Channel-A8-Dynamic-Per-Token-Test Text Generation • 8B • Updated 26 days ago • 215
nm-testing/Meta-Llama-3-8B-Instruct-W8-Channel-A8-Dynamic-Asym-Per-Token-Test 8B • Updated 26 days ago • 831 • 1
nm-testing/Meta-Llama-3-8B-Instruct-W4A16-compressed-tensors-test Text Generation • 8B • Updated 26 days ago • 241
nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test Text Generation • 8B • Updated 26 days ago • 195
nm-testing/Meta-Llama-3-8B-Instruct-W4-Group128-A16-Test Text Generation • 8B • Updated 26 days ago • 188
nm-testing/Meta-Llama-3-8B-Instruct-Non-Uniform-compressed-tensors Text Generation • 8B • Updated 26 days ago • 180
nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test-bos Text Generation • 8B • Updated 26 days ago • 35
nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test Text Generation • 8B • Updated 26 days ago • 3.72k
nm-testing/DeepSeek-R1-Distill-Qwen-14B2of4-W8A8-FP8-Dynamic-Per-Token 15B • Updated 26 days ago • 33