Files
llm/core/training/README.md
T

8 lines
489 B
Markdown

# Core Training
Общие пайплайны подготовки данных и дообучения.
Основной подход для доменных моделей: adapter-based fine-tuning, например LoRA/QLoRA.
Полное дообучение базовых моделей не используем как первый вариант из-за стоимости, сложности хранения и риска ухудшения общего качества.