LiteLLM: Traffic Mirroring та Batch Completions і трафік до двох провайдерів0 (0)
21 Серпня 2026
Готуємось до запуску self-hosted LLM, і на етапі тестування загальна ідея така, що будемо слати запити від клієнтів одночасно і до “дефолтної production моделі” типу GPT-5.6 – і до моделі на нашому власному сервері. А після отримання відповідей – будемо виконувати порівняння з Phoenix чи Opik, і потроху тюнити наші “власні” модельки. Всі запити у… Read More: LiteLLM: Traffic Mirroring та Batch Completions і трафік до двох… »
![]()