Files
llm/core/training/README.md
T

489 B

Core Training

Общие пайплайны подготовки данных и дообучения.

Основной подход для доменных моделей: adapter-based fine-tuning, например LoRA/QLoRA.

Полное дообучение базовых моделей не используем как первый вариант из-за стоимости, сложности хранения и риска ухудшения общего качества.