p-e-w/heretic
언어 모델 검열 제거 도구
Transformer 기반 언어 모델에서 안전 정렬을 자동으로 제거한다. directional ablation과 TPE 기반 파라미터 최적화를 결합해 후학습 없이 동작한다.
- 별
- 32,300
- 7일 동안 늘어난 별
- +600
- 기여자
- 35
- 포크
- 3,600
- 최근 30일 가운데 트렌딩에 오른 날
- 7일
- 표시
- 관찰 — 기여자 1명당 별 923. 공개 지표로 붙이는 자동 표시로, 500을 넘으면 관찰, 2,000을 넘으면 과열 의심이다(품질 판단과는 별개).