학습 레시피
QLoRA · DPO · ORPO 등 학습 방법 + 하이퍼파라미터를 템플릿으로 관리
레시피 편집
이름
방법
precision
베이스 모델
lora rank
alpha
dropout
lr
batch
epochs
YAML 미리보기valid
name: qlora-ko-domain-v3
method: qlora
precision: bf16
base: qwen2.5-7b
lora:
rank: 64
alpha: 128
dropout: 0.05
target_modules: [q,k,v,o]
hyperparams:
lr: 2e-4
batch: 4
epochs: 5
cutoff: 2048
optimizer: adamw_8bit
scheduler: cosine
checkpoint:
every: 1 epoch
keep_best: true
이 레시피는 학습 잡 큐에서 선택해 사용합니다. AI Designer가 추천한 값이 자동 채워집니다.