Inference Providers
Active filters: amd
amd/Qwen3.8-27B-Quark-Qronos-INT4-W4A16
Image-Text-to-Text
• 6B • Updated • 1.53k
• 2
kingjones777/LFM2-24B-A2B-ROCmFPX-GGUF
Text Generation
• 24B • Updated • 261
• 1
kingjones777/Gemma-4-31B-it-ROCmFP4-GGUF
Image-Text-to-Text
• 31B • Updated • 321
• 1
jcbtc/Qwen3.8-27B-IU4-Kairic-Edge
Text Generation
• 27B • Updated • 2.92k
• 44
jcbtc/Ling-3.0-Flash-CIRU-IU4
Text Generation
• 127B • Updated • 816
• 6
dahara1/llama3-8b-amd-npu
Tech-Meld/gpus-everywhere
Text-to-Image
• Updated • 15
• • 1
dahara1/llama3.1-8b-Instruct-amd-npu
dahara1/ALMA-Ja-V3-amd-npu
dahara1/llama-translate-amd-npu
Translation
• Updated • 5
dahara1/llama-translate-gguf
8B • Updated • 241
• 16
amd/Llama-2-7b-hf-awq-g128-int4-asym-bf16-onnx-ryzen-strix
Text Generation
• Updated • 121
amd/Llama2-7b-chat-awq-g128-int4-asym-bf16-onnx-ryzen-strix
Text Generation
• Updated • 24
amd/Llama-3-8B-awq-g128-int4-asym-bf16-onnx-ryzen-strix
Text Generation
• Updated • 53
• 2
amd/Llama-3.1-8B-awq-g128-int4-asym-bf16-onnx-ryzen-strix
Text Generation
• Updated • 44
• 2
amd/Phi-3.5-mini-instruct-awq-g128-int4-asym-bf16-onnx-ryzen-strix
Text Generation
• Updated • 16
• 3
amd/Phi-3-mini-4k-instruct-awq-g128-int4-asym-bf16-onnx-ryzen-strix
Text Generation
• Updated • 15
• 2
uday610/Llama2-7b-chat-awq-g128-int4-asym-fp32-onnx-ryzen-strix-hybrid
Text Generation
• Updated amd/Phi-3.5-mini-instruct-awq-g128-int4-asym-fp16-onnx-dml
Text Generation
• Updated amd/Phi-3-mini-4k-instruct-awq-g128-int4-asym-fp16-onnx-hybrid
Text Generation
• Updated • 17
amd/Phi-3.5-mini-instruct-awq-g128-int4-asym-fp16-onnx-hybrid
Text Generation
• Updated • 17
amd/Llama-2-7b-chat-hf-awq-g128-int4-asym-fp16-onnx-dml
Text Generation
• Updated amd/Llama-2-7b-hf-awq-g128-int4-asym-fp16-onnx-hybrid
Text Generation
• Updated • 11
amd/Llama-2-7b-chat-hf-awq-g128-int4-asym-fp16-onnx-hybrid
Text Generation
• Updated • 15
amd/Llama-3-8B-awq-g128-int4-asym-fp16-onnx-hybrid
Text Generation
• Updated • 9
sbeierle/fame-pytorch-kit
Updated
skshreyas714/AAPL_Team_ACB
Text Generation
• 4B • Updated • 11
magicunicorn/whisper-large-v3-amd-npu-int8
Updated • 9
• 4
magicunicorn/whisper-large-v2-amd-npu-int8
Updated • 3
• 5
magicunicorn/whisper-medium-amd-npu-int8