Free AI Hosting
Host AI models for free. GPU access, API hosting, and cloud deployment.
У аблачыне
Выкарыстоўвайце інфраструктуру Free.ai. Няма неабходнасці ўсталёўваць і падтрымліваць праграму. Усе мадэлі загружаныя і гатовыя да выкарыстання праз API або інтэрфейс вэб- прыкладання.
Даступны заразName=Стварыць файл
Запускайце нашыя адкрытыя мадэлі чалавечага інтэлекту на вашым уласным апаратным забеспячэнні. Docker-адбіткі з падтрымкай GPU, аптымалізаваныя для вываду.
СамаабслугоўваннеПрыватная
Выдаленыя серверы GPU, якія кіруюцца намі, разьмешчаныя ў вашым аддаленым рэгіёне. Поўная ізаляцыя дадзеных і асабістыя SLA.
ПраграмаСамастойнае разгортванне
Усе нашыя мадэлі адкрытыя (Apache 2.0 / MIT). Вы можаце запусціць іх на вашай уласнай інфраструктуры GPU:
# Pull and run a model with Docker
docker pull ghcr.io/free-ai/inference:latest
docker run --gpus all -p 8000:8000 ghcr.io/free-ai/inference:latest \
--model qwen2.5-72b --quantization awq
Мінімальны патрабаванне
- Графічны працэсар NVIDIA з 24 ГБ+ VRAM (RTX 4090, A5000, A100)
- CUDA 12.0+ і Docker з NVIDIA Container Toolkit
- 16 ГБ + сістэмная памяць, 100 ГБ + памяць на мадэль
- Для мадэляў з параметрамі 72B: 80 ГБ VRAM (A100) або налада multi-GPU
Чаму патрэбны аўдыё- і відэа-рэжым?
- Прыватнасць дадзеных — Your data never leaves your servers
- Без абмежавання хуткасці — Unlimited inference on your hardware
- Суадносіны — Meet data residency requirements
- Настаўленні — Fine-tune models on your data
- Кантроль кошту — Fixed hardware costs, no per-token fees
- Паветраная прага — Runs fully offline