Free AI Hosting
Host AI models for free. GPU access, API hosting, and cloud deployment.
Nube alojada
Utilice la infraestructura Free.ai. Configuración cero, mantenimiento cero. Todos los modelos están precargados y listos para usar a través de API o interfaz de usuario web.
Disponible ahoraDocker auto-acogida
Ejecute nuestros modelos de código abierto de IA en su propio hardware. Imágenes Docker con soporte GPU, optimizadas para inferencia.
AutoservicioAdministrado privado
Servidores GPU dedicados gestionados por nosotros, desplegados en su región de nube preferida. Aislamiento completo de datos y SLA personalizado.
EmpresaDespliegue auto-acogida
Todos nuestros modelos son de código abierto (Apache 2.0 / MIT). Puede ejecutarlos en su propia infraestructura GPU:
# Pull and run a model with Docker
docker pull ghcr.io/free-ai/inference:latest
docker run --gpus all -p 8000:8000 ghcr.io/free-ai/inference:latest \
--model qwen2.5-72b --quantization awq
Requisitos mínimos
- GPU NVIDIA con 24GB+ VRAM (RTX 4090, A5000, A100)
- CUDA 12.0+ y Docker con el kit de herramientas de contenedores NVIDIA
- RAM de 16 GB+ sistema, almacenamiento de 100 GB+ por modelo
- Para modelos de parámetros 72B: 80GB VRAM (A100) o configuración multi-GPU
¿Por qué el auto-acogedor?
- Privacidad de los datos — Your data never leaves your servers
- Sin límites de tipos — Unlimited inference on your hardware
- Cumplimiento — Meet data residency requirements
- Personalización — Fine-tune models on your data
- Control de costos — Fixed hardware costs, no per-token fees
- Aerotransportado — Runs fully offline