Heretic 은 트랜스포머 계열 언어 모델에서 안전 정렬을 사후 학습 없이 제거합니다. 흔히 abliteration 이라 부르는 방향 절제 기법에 Optuna 기반 TPE 파라미터 최적화를 붙여, 거절 응답 수와 원본 가중치로부터의 KL 발산을 동시에 최소화하는 설정을 찾아냅니다. 두 목표를 함께 낮추기 때문에 능력을 크게 잃지 않은 상태로 검열만 빠지고, 탐색 과정에 사람이 손을 댈 필요가 없습니다. 파이썬으로 작성됐고 AGPL-3.0 입니다.