Free AI Hosting
Host AI models for free. GPU access, API hosting, and cloud deployment.
Àwọn àgbèwọlé
Lo Free.ai infrastructure. Zero setup, zero maintenance. All models are pre-loaded and ready to use via API or web UI.
Tí a bá lè lòDocker tí a fi pamọ́
Rọ́ọ̀nù àwọn àwọn ìṣàmúlò-ètò AI-source wà nípa àwọn ìṣàmúlò-ètò rẹ̀. Àwọn àwòrán Docker ní àwọn ìṣàmúlò-ètò GPU, tí a fi pọ̀ jú fún ìṣàmúlò-ètò.
Àwọn Ìṣàmúlò-ètòÀwọn Àwọn Ààyè-iṣẹ́
Àwọn sáà GPU tí a fi hàn, tí a fi pamọ́ sínú àwọn ààyè-iṣẹ́ àwọn aládàbòójútó rẹ̀. Àwọn ààyè-iṣẹ́ ìdáràn nípa àwọn SLA àwọn aládábòójútó rẹ̀.
Àwọn Ìṣàmúlò-ètòÀwọn Ìṣàmúlò-ètò
Àwọn ìṣàmúlò-ètò wà ní gbogbo wọn jẹ́ àìṣàmúlò-ètò tí a ṣí (Apache 2.0 / MIT). O lè rọ́ọ̀nù wọn lórí àwọn ìṣàmúlò-ètò GPU rẹ̀:
# Pull and run a model with Docker
docker pull ghcr.io/free-ai/inference:latest
docker run --gpus all -p 8000:8000 ghcr.io/free-ai/inference:latest \
--model qwen2.5-72b --quantization awq
Àwọn Ìṣàmúlò-ètò Kékeré
- NVIDIA GPU pẹlú 24GB+ VRAM (RTX 4090, A5000, A100)
- CUDA 12.0+ ati Docker pẹlú NVIDIA Container Toolkit
- 16GB+ RAM eto, 100GB+ iranti fun móòdù kan
- Fun àwọn ìṣàmúlò-ètò àwọn àwọn ìṣàmúlò-ètò 72B: 80GB VRAM (A100) tàbí ìṣàfihàn GPU-àwọn-
Kini idi ti Òjútó Ààyè Rẹ́?
- Àwọn Àkọ́lé — Your data never leaves your servers
- Kò ní àwọn ìdájú àwọn ìṣàmúlò-ètò — Unlimited inference on your hardware
- Àwọn Ìṣàmúlò-ètò — Meet data residency requirements
- Àwọn ìṣàmúlò-ètò — Fine-tune models on your data
- Ìwé àwọn àwọn ìṣàmúlò-ètò — Fixed hardware costs, no per-token fees
- Àwọn àgbègbè — Runs fully offline