Inference Providers
Active filters: mps
enacimie/madlad400-3b-mt-Q4_K_M-GGUF
Translation
• 3B • Updated • 52
SreeniHF1/madlad400-3b-mt-Q2_K-GGUF
Translation
• 3B • Updated • 7
cyberunit/madlad400-10b-mt-Q4_K_M-GGUF
Translation
• 11B • Updated • 8
• 1
AnHoang200901/madlad400-3b-mt-Q4_K_M-GGUF
Translation
• 3B • Updated • 31
AnHoang200901/madlad400-3b-mt-Q8_0-GGUF
Translation
• 3B • Updated • 24
Fill-Mask
• Updated • 52.5k
• • 82
irmma/madlad400-3b-mt-Q5_K_M-GGUF
Translation
• 3B • Updated • 23
ThaiAn/madlad400-3b-mt-Q4_K_M-GGUF
Translation
• 3B • Updated • 25
5ivatej/tinyllama-1.1b-early-exit
Text Generation
• Updated illian64/madlad400-10b-mt-ct2-bfloat16
Translation
• Updated • 11
• 1
illian64/madlad400-7b-mt-ct2-bfloat16
Translation
• Updated • 5
• 1
JeffersonNunn/metal-flash-attention-bridge
Updated
JeffersonNunn/deepseek-ocr-metal
Dogacel/DeepSeek-OCR-Metal-MPS
Image-Text-to-Text
• 3B • Updated • 32
• 13
ucrelnlp/PyMUSAS-Neural-Multilingual-Small-BEM
0.1B • Updated • 39
ucrelnlp/PyMUSAS-Neural-Multilingual-Base-BEM
0.3B • Updated • 37
• 1
onnx-community/mmBERT-small-ONNX
Fill-Mask
• Updated • 12
• 3
Text Generation
• Updated psychologyphd/CodeLlama-7b-Text-to-SQL-mps-finetuned
Text Generation
• 7B • Updated hexbr/madlad400-3b-mt-Q4_K_M-GGUF
Translation
• 3B • Updated • 12
cstr/madlad400-3b-ct2-int8
Translation
• Updated • 165
• 1
0.3B • Updated • 128
0.1B • Updated • 92
Text Classification
• 0.3B • Updated • 38.3k
• 4
aydin99/FLUX.2-klein-4B-int8
Text-to-Image
• 4B • Updated • 720
• 12
onnx-community/mmBERT-base-ONNX
Fill-Mask
• Updated • 12
• 1
Dogacel/Universal-DeepSeek-OCR-2
Image-Text-to-Text
• 3B • Updated • 919
• 12
psychologyphd/CodeLlama-7b-Text-to-SQL-MPS-FineTuned-V4
Text Generation
• 7B • Updated • 7
ctrltokyo/ColBERT-Zero-6L-CodeSearch
Sentence Similarity
• 68.8M • Updated • 55
Text Generation
• Updated