-
inference-optimization/Llama-3.1-8B-Instruct-NVFP4
5B • Updated • 22 • 1 -
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-BlockSize16
5B • Updated • 10 • 1 -
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ
5B • Updated • 22 -
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-SmoothQuant
5B • Updated • 22
Inference Optimization
community
AI & ML interests
None defined yet.
Recent Activity
View all activity
-
inference-optimization/Llama-3.1-8B-Instruct-NVFP4
5B • Updated • 22 • 1 -
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-BlockSize16
5B • Updated • 10 • 1 -
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ
5B • Updated • 22 -
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-SmoothQuant
5B • Updated • 22
Tiny models used for testing
models 238
inference-optimization/qwen3-test-model-123
Updated
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab-qwen235b-instruct-bs16-v2-ckpt3
2B • Updated
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab-qwen235b-instruct-bs16-v2-ckpt2
2B • Updated
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab-qwen235b-instruct-bs16-v2-ckpt1
2B • Updated
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab-qwen235b-instruct-bs16-v2-ckpt0
2B • Updated
inference-optimization/Inkling-0.6B-A0.6B
Image-Text-to-Text • 0.6B • Updated • 955 • 1
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab-qwen235b-instruct-bs16-ckpt7
2B • Updated • 15
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab-qwen235b-instruct-bs16-ckpt6
2B • Updated • 14
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab.muon-qwen235b-instruct-bs16-ckpt5
2B • Updated • 4
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab.muon-qwen235b-instruct-bs16-ckpt4
2B • Updated • 4
datasets 28
inference-optimization/qwen3-test-model
Updated
inference-optimization/dflash-qwen3-8b-qwen235b-instruct-bs16-prepared-data
Preview • Updated • 50
inference-optimization/every-eval-ever-demo
Viewer • Updated • 1 • 17
inference-optimization/DeepSeek-V4-Flash-responses
Viewer • Updated • 508k • 54
inference-optimization/Qwen3.5-4B-responses
Viewer • Updated • 7.47k • 37
inference-optimization/Qwen3.5-0.8B-responses
Viewer • Updated • 7.47k • 136
inference-optimization/Qwen3.5-9B-responses
Viewer • Updated • 7.67k • 67
inference-optimization/Qwen3-8B-Regenerated-Collection
Preview • Updated • 207
inference-optimization/Qwen3-30B-A3B-responses
Preview • Updated • 85
inference-optimization/gpt-oss-120b-responses
Preview • Updated • 84