Free AI Hosting
Host AI models for free. GPU access, API hosting, and cloud deployment.
Mākoņdatošana
Lietot Free.ai infrastruktūru. Nulles iestatīšana, nulles uzturēšana. Visi modeļi ir iepriekš ielādēti un gatavi lietošanai caur API vai tīmekļa UI.
Pieejams tagadDocker pašizturēšanās
Palaist mūsu atvērtā avota AI modeļus uz jūsu pašu aparatūras. Docker attēlus ar GPU atbalstu, optimizēts inferences.
PašapkalpošanāsPārvaldītais privātais
Specializētie GPU serveri, kurus pārvalda mēs, izvietoti jūsu vēlamajā mākoņu reģionā. Pilna datu izolācija un pielāgota SLA.
UzņēmumsPašnodarbinātība
Visi mūsu modeļi ir atvērti (Apache 2.0) / MIT. Jūs varat tos palaist savā GPU infrastruktūrā:
# Pull and run a model with Docker
docker pull ghcr.io/free-ai/inference:latest
docker run --gpus all -p 8000:8000 ghcr.io/free-ai/inference:latest \
--model qwen2.5-72b --quantization awq
Minimālās prasības
- NVIDIA GPU ar 24GB+ VRAM (RTX 4090, A5000, A100)
- CUDA 12. 0+ un Docker ar NVIDIA konteinera instrumentu komplektu
- 16GB+ sistēmas RAM, 100GB+ uzglabāšana katram modelim
- 72B parametru modeļiem: 80GB VRAM (A100) vai vairāku GPU iestatīšana
Kāpēc ir vajadzīga pašcieņa?
- Datu privātums — Your data never leaves your servers
- Nav ierobežojumu attiecībā uz likmēm — Unlimited inference on your hardware
- Atbilstība — Meet data residency requirements
- Pielāgošana — Fine-tune models on your data
- Izmaksu kontrole — Fixed hardware costs, no per-token fees
- Gaiss — Runs fully offline