RU

[Перевод] Масштабирование LLM: от одного чипа до ЦОДа. Глава 5. Инференс

Предыдущая глава Ну а теперь рассмотрим, как нам применить обученный трансформер. И применение уже обученной модели сильно отличается от тренировки,…

llmaimlgpugpu вычисленияанализ и проектирование системmlops
Habr
RU

[Перевод] Масштабирование LLM: от одного чипа до ЦОДа. Глава 4. Тренировка трансформера

Наконец-то мы добрались непосредственно до того, как тренировать трансформер, не просто тренировать, а делать это эффективно и масштабируемо. Как мы…

llmaimlgpugpu вычисленияанализ и проектирование систем
Habr
RU

[Перевод] Масштабирование LLM: от одного чипа до ЦОДа. Глава 3. Траснформеры

Это продолжение цикла статей о масштабировании тренировки и инференса LLM. Предыдущая статья А теперь перейдем к чему-то более практическому, а имен…

aimlgpugpu вычислениятрансформерыанализ и проектирование систем
Habr
RU

[Перевод] Масштабирование LLM: от одного чипа до ЦОДа. Глава 2. Шардинг

Это продолжение цикла статей о масштабировании тренировки и инференса LLM. Предыдущая глава находится по этой ссылке . Итак, с основами разобрались,…

aimlgpugpu вычисленияанализ и проектирование систем