LiteBridge, Google'ın LiteRT-LM modellerini OpenAI uyumlu bir API üzerinden sunan, yüksek performanslı ve "hafif" bir köprü (gateway) uygulamasıdır.
Ollama'ya benzer bir amaç güder fakat çok daha düşük kaynak tüketimi ve LiteRT'nin kenar cihazlar için optimize edilmiş gücünü kullanır.
- OpenAI Uyumlu:
/v1/chat/completionsendpoint'i sayesinde Cursor, Zed, Aider gibi araçlarla anında entegrasyon. - Düşük RAM Tüketimi: LiteRT altyapısı sayesinde sadece ihtiyacı olan belleği kullanır.
- Streaming (SSE) Desteği: Tokens-by-token akış hızı.
- Otomatik Kurulum: Sunucu başladığında eksik modelleri otomatik indirir.
- Hızlı Swagger Dökümantasyonu: Deneysel arayüz ile API testi.
- Gereksinimler: Python 3.10+
- Kütüphaneleri Yükle:
pip install -r requirements.txt
- Konfigürasyon:
.env.exampledosyasını.envolarak kopyalayın ve model ID'nizi belirleyin.
Sunucuyu başlatmak için:
python main.pySunucu varsayılan olarak http://localhost:8080 adresinde çalışacaktır.
GET /v1/models
POST /v1/chat/completions
messages: Mesaj listesi (Sistem, Kullanıcı, Asistan).stream:trueise yanıtlar parça parça gelir.model:gemma-4-E2B-itvb.
{
"model": "gemma-4-E2B-it",
"messages": [
{"role": "system", "content": "Sen yardımcı bir asistansın."},
{"role": "user", "content": "Python'da liste nasıl sıralanır?"}
],
"stream": false
}LiteBridge stateless çalışır. Sohbetin devam etmesi için tüm geçmiş mesajları her istekte göndermelisiniz:
{
"messages": [
{"role": "user", "content": "Merhaba, ismim Ali."},
{"role": "assistant", "content": "Merhaba Ali! Sana nasıl yardımcı olabilirim?"},
{"role": "user", "content": "Benim ismim neydi?"}
]
}curl http://localhost:8080/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"model": "gemma-4-E2B-it",
"messages": [{"role": "user", "content": "Naber?"}],
"stream": true
}'Sunucu çalışırken şu adreslerden etkileşimli dokümantasyona erişebilirsiniz:
- Swagger UI: http://localhost:8080/docs
- ReDoc: http://localhost:8080/redoc
Detaylı kurulum adımları için IDE_SETUP.md dosyasına göz atın.