
모델
오픈소스 모델들의 고질병 '거절 버릇'을 해부하다
- 오픈 가중치 모델들이 안전성 필터에 과도하게 걸려 일반적인 질문마저 거절해 버리는 거절 행동 패턴에 대한 심층 분석이야.
- 안전 교육(Safety Tuning)을 지나치게 빡빡하게 적용하다 보니 정당한 지시도 '부적절함'으로 잘못 진단하는 부작용이지.
- 모델 성능을 죽이지 않으면서도 유해한 답변만 정확히 솎아내기 위해 튜닝 메커니즘을 어떻게 미세 조율해야 하는지 방향을 제시해.
24시 응급병원 & 야간진료 선별 지도
보기 ›Hacker News - LLM원문 보기





























