Free AI Hosting
Host AI models for free. GPU access, API hosting, and cloud deployment.
Хмара звисає
Використовувати інфраструктуру Free.ai. Налаштовування нульового обслуговування. Всі моделі попередньо завантажено і готові до використання за допомогою API або інтерфейсу мережі.
Доступний заразDocker самоохайний
Запустіть наші моделі комп' ютерного гравця з відкритим кодом на вашому власному обладнанні. Програма Docker зображення з підтримкою GPU, оптимізованою для визначення.
SelviceКерований приватний
Створені сервери GPU, якими керує ми, було відкрито у вашому бажаному області хмар. Повна ізоляція даних і нетипова SLA.
ПромисловаСамозвеличення
Всі наші моделі відкриті на основі даних з відкритого коду (Apache 2.0 / MIT). Ви можете запустити їх за допомогою власної інфраструктури GPU:
# Pull and run a model with Docker
docker pull ghcr.io/free-ai/inference:latest
docker run --gpus all -p 8000:8000 ghcr.io/free-ai/inference:latest \
--model qwen2.5-72b --quantization awq
Мінімальні вимоги
- NVIDIA GPU з 24ГB+ VRAM (RTX 4090, A5000, A100)
- CUDA 12. 0+ і Docker з контейнером NVIDIA
- 16GB+ системна пам'ять, 100GB+ зберігання на модель
- Для моделей параметрів 72B: 80GB VRAM (A100) або багато-GPU
Чому він такий самоохайний?
- Особистість даних — Your data never leaves your servers
- Без обмежень швидкості — Unlimited inference on your hardware
- Конляція — Meet data residency requirements
- Налаштування — Fine-tune models on your data
- Керування вартістю — Fixed hardware costs, no per-token fees
- Повітряно- повітряний стрибун — Runs fully offline