Free AI Hosting
Host AI models for free. GPU access, API hosting, and cloud deployment.
Được lưu trữ trên đám mây
Dùng cơ sở hạ tầng Free.ai. Không cài đặt, không bảo trì. Tất cả các mô hình được tải sẵn và sẵn sàng sử dụng qua API hoặc giao diện người dùng web.
Có sẵn bây giờDocker tự lưu
Chạy mô hình AI mã nguồn mở của chúng tôi trên phần cứng của bạn. Bức ảnh Docker với hỗ trợ GPU, tối ưu hóa cho suy luận.
Dịch vụ tự phục vụTự do quản lý
Máy chủ GPU chuyên dụng do chúng tôi quản lý, được triển khai ở vùng đám mây của bạn, tách dữ liệu hoàn toàn và SLA tùy chỉnh.
EnterpriseTự lưu
Tất cả các mô hình của chúng tôi là mã nguồn mở (Apache 2.0 / MIT). Bạn có thể chạy chúng trên cơ sở hạ tầng GPU của riêng mình:
# Pull and run a model with Docker
docker pull ghcr.io/free-ai/inference:latest
docker run --gpus all -p 8000:8000 ghcr.io/free-ai/inference:latest \
--model qwen2.5-72b --quantization awq
Yêu cầu tối thiểu
- NVIDIA GPU với 24GB+ VRAM (RTX 4090, A5000, A100)
- CUDA 12.0+ và Docker với bộ công cụ chứa NVIDIA
- RAM hệ thống 16GB+ mỗi mẫu
- Đối với các mẫu tham số 72B: 80GB VRAM (A100) hoặc cài đặt đa GPU
Tại sao lại là Self-Host?
- Bảo mật dữ liệu — Your data never leaves your servers
- Không giới hạn tốc độ — Unlimited inference on your hardware
- Chấp nhận — Meet data residency requirements
- Tự chọn — Fine-tune models on your data
- Kiểm soát chi phí — Fixed hardware costs, no per-token fees
- Không khí — Runs fully offline