Курс
Інференс і залізо
Викликати модель можна одним рядком. А запускати її швидко, дешево, у масштабі — то вже окрема майстерність. Це інженерна екскурсія в інференс: що GPU вміє такого, чого не може CPU; за що ти насправді платиш NVIDIA; чому генерувати токени повільно; і якими практичними важелями зробити все швидким та доступним: сервінг-рушіями на кшталт vLLM та Ollama, квантуванням і підбором розміру моделі під задачу. Сім коротких уроків, кожен екран намальовано, без хайпу й без таблиць характеристик GPU, які треба зубрити.
7 уроківСередній45 хв
Уроки курсу
Пройди весь курс
Вивчи як слід — із відстеженням і персоналізацією
Проходь увесь курс як структурований маршрут — послідовні уроки, прогрес, стріки й персональний шлях, усе в застосунку.