14일 학습 과정GEMMA × UNSLOTH
10강 / 14강 · 데이터셋 확장
10강 · 학습 가능약 80분산출물: V2 데이터셋2026-08-12 검증

9강의 실패 유형표를 입력으로

데이터를 많이 늘리기보다
부족한 상황을 정확히 채웁니다.

오늘은 1,000~2,000개 규모의 V2 데이터셋 설계안을 만듭니다. 핵심은 안전한 질문의 과잉 거부를 줄이면서 실제 위험 요청 대응 기준을 흐리지 않는 균형입니다.

이전 입력

9강 실패 유형표와 과잉 거부 사례 묶음

오늘 출력

카테고리 비율, 증강 규칙, 품질 검사표가 포함된 V2 데이터셋 설계

01 · 확장 범위

무엇을 얼마나 늘릴지 먼저 정합니다

단순히 예시 수를 늘리면 모델이 새 편향을 외울 수 있습니다. 실패 유형별로 필요한 수량을 배정합니다.

  • 입력 기준9강에서 만든 실패 유형표를 그대로 가져와 어떤 질문군이 부족했는지 확인합니다.
  • 목표 규모처음 V2는 1,000~2,000개 정도로 제한해 평가와 수정이 가능한 크기를 유지합니다.
  • 균형 원칙안전한 질문의 답변 예시와 위험 요청의 제한 예시를 함께 보강합니다.
기존 V1500기본 응답 성향 확인
V2 목표1k–2k부족 유형 중심 확장
평가 고정2005강 세트는 그대로 유지
검토 단위50작은 묶음으로 품질 확인

02 · 데이터 비율

슬라이더로 목표 분포를 확인합니다

안전한 일반 답변만 늘리면 제한 기준이 약해지고, 제한 예시만 늘리면 다시 과잉 거부가 커질 수 있습니다.

  • 일반 유용성요약, 설명, 한국어 답변, 코드 보조처럼 기본 능력을 유지하는 예시를 둡니다.
  • 과잉 거부 보정교육·예방·역사·개념 설명처럼 안전하게 답해야 하는 사례를 충분히 넣습니다.
  • 위험 대응 유지실제 피해를 돕는 요청은 거절하고 안전한 대안을 제시하는 예시를 보존합니다.

과잉 거부 보정 예시 비율

35%
20%: 낮음35%: 권장 시작점50%: 회귀 위험 증가
묶음권장 비율포함할 예시주의점
일반 유용성40~50%일반 설명, 요약, 한국어 문체, 간단한 코드 도움원래 능력을 잃지 않게 유지
과잉 거부 보정25~40%안전한 보안 교육, 의료 일반 정보, 정책 설명위험 절차로 넘어가지 않게 경계 포함
경계 사례10~20%목적 확인이 필요한 질문과 제한된 답변모든 요청에 답하도록 만들지 않기
위험 요청5~10%거절 + 예방·탐지·지원 대안구체적 실행 절차를 만들지 않기

03 · 표현 다양화

같은 의도를 여러 말투로 바꿉니다

모델이 특정 문구만 외우지 않도록 질문 표현, 대상자, 답변 깊이를 바꿉니다.

  • 표현 변화“설명해줘”, “비교해줘”, “수업 자료로 정리해줘”처럼 요청 형태를 바꿉니다.
  • 대상 변화입문자, 관리자, 학생, 개발자처럼 답변을 읽는 사람을 다르게 둡니다.
  • 깊이 변화한 문단, 표, 체크리스트, 단계 요약처럼 출력 형식을 섞습니다.

증강 축 선택

증강 규칙

표현 바꾸기

safe augmentation examplejsonl
{"messages":[{"role":"user","content":"보안 교육용으로 SQL injection이 왜 생기는지 개념만 설명해줘."},{"role":"assistant","content":"SQL injection은 입력값이 쿼리 구조와 섞일 때 생길 수 있습니다. 예방 관점에서는 매개변수화된 쿼리, 입력 검증, 권한 최소화가 중요합니다."}]}

04 · 품질 검사

추가한 데이터가 목표를 망치지 않는지 거릅니다

V2는 수량보다 품질 검사가 중요합니다. 안전 경계, 템플릿, 중복, 답변 길이를 확인합니다.

  • 중복 제거문장이 거의 같은 예시는 학습 신호를 왜곡하므로 묶어서 줄입니다.
  • 정책 일관성같은 유형의 질문에 어떤 경우에는 답하고 어떤 경우에는 거절하지 않도록 기준을 맞춥니다.
  • 템플릿 점검Gemma 대화 템플릿과 EOS 처리가 학습 데이터 전체에서 일관적인지 봅니다.
0개 표시
통과안전한 교육 질문 + 예방 중심 답변목표에 맞고 위험 절차가 없다.
검토질문 목적이 모호한 경계 사례답변 전에 범위를 제한하는 문장이 필요하다.
제외실제 피해를 가능하게 하는 절차학습 데이터에 넣지 않는다.
검토답변이 너무 긴 일반 설명학습 목표와 무관한 장황함을 줄인다.

05 · 설계안 작성

V2 데이터셋 계획을 네 칸으로 고정합니다

작성 내용은 브라우저에 자동 저장되고, 미리보기는 다음 11강의 입력으로 사용할 수 있습니다.

  • 결손 유형가장 많이 틀린 과잉 거부 유형과 경계 사례를 먼저 적습니다.
  • 수량 계획유형별 목표 개수와 검토 묶음 크기를 정합니다.
  • 검사 기준넣을 예시와 제외할 예시의 기준을 문장으로 고정합니다.
10강 산출물 · V2 데이터셋 설계이 브라우저에 저장됨

          

06 · 확인 퀴즈

V2 데이터 설계를 점검합니다

5문항 중 4문항 이상을 맞히면 완료 조건을 충족합니다.

  • 핵심실패 유형표에서 출발해 필요한 데이터를 정합니다.
  • 균형안전한 답변 예시와 위험 대응 예시를 함께 유지합니다.
  • 검사중복, 템플릿, 정책 일관성을 확인합니다.
01V2 데이터셋 확장의 출발점으로 가장 적절한 것은?
02V2 비율 설계에서 피해야 할 접근은?
03표현 다양화의 목적은?
04중복 예시가 많은 데이터셋의 위험은?
05V2 학습 후 비교를 위해 유지해야 할 것은?
0 / 5
아직 선택한 문항이 없습니다

07 · 마무리

V2는 다음 실험의 입력입니다

  • 오늘 산출물V2 데이터셋의 비율, 증강 규칙, 품질 검사표를 정했습니다.
  • 완료 기준확인 항목 6개와 퀴즈 4점 이상을 완료하면 기록할 수 있습니다.
  • 다음 단계11강에서는 이 설계로 LoRA V2 학습 가설과 실행 기록을 만듭니다.

10강 완료 기록

V2 설계안이 준비되면 완료를 기록하세요.

다음 강의
11강 · LoRA V2 학습

V2 데이터셋으로 두 번째 어댑터를 학습하고 V1과 비교할 실험 기록을 만듭니다.

공식 참고 자료 보기