audnai/penclaw-GLM-5.3-abliterated — 거부 동작을 가중치 편집으로 제거한 Warlock
Audn이 공개한 Warlock은 추가 학습 없이 모델의 거부 동작을 가중치 수준에서 제거한 GLM 계열 언어 모델입니다. Audn Refusal Benchmark에서 비거부율 92.5%, 실제 사용 가능한 응답 생성률 82.5%를 기록했으며, Transformers·vLLM·sglang에서 실행할 수 있습니다.
Audn이 공개한 Warlock은 추가 학습 없이 모델의 거부 동작을 가중치 수준에서 제거한 GLM 계열 언어 모델입니다. Audn Refusal Benchmark에서 비거부율 92.5%, 실제 사용 가능한 응답 생성률 82.5%를 기록했으며, Transformers·vLLM·sglang에서 실행할 수 있습니다.
openjev는 Qwen3.5를 premise와 hypothesis의 관계를 entailment·contradiction·neutral로 판별하는 단일 cross-encoder로 구성한 프로젝트입니다. 4B NLI 체크포인트와 동결된 35B-A3B MoE 백본의 작업별 MLP 헤드를 제공하며, 답변 재순위화·채점·콘텐츠 보호와 게임 제어까지 동일한 추론 primitive로 처리합니다.