
알고리즘
상용 LLM API 뒤에 숨은 생각 과정(Reasoning Traces) 탈탈 털어내는 공격법
- arXiv 논문인데, 비공개 상용 LLM API에서 추론 과정(Reasoning Traces)을 추출해내는 공격 기법을 규명했어.
- API 응답값의 특성을 역분석해서 내부 모델이 어떤 사고 과정을 거쳤는지 훔쳐볼 수 있다는 거지.
- 상용 LLM 모델 보안과 지적재산권(IP) 보호 측면에서 중요한 경종을 울리는 연구야.
Hacker News - LLM원문 보기
















