커뮤니티 반응
작성자가 공유한 프롬프트의 복잡성과 독창성에 대해 놀라워하는 반응이며, 구체적인 로직 작동 방식에 대해 질문을 던지는 분위기입니다.
주요 논점
01찬성다수
모델의 특정 출력 습관을 고치기 위해 이러한 엄격한 로직 기반 프롬프트가 필요하다는 입장이다.
합의점 vs 논쟁점
합의점
- LLM이 특정 문장 부호나 말투를 고집하는 경향이 있으며 이를 제어하기 매우 어렵다는 점에 동의한다.
논쟁점
- 이정도로 복잡한 프롬프트가 실제 추론 비용이나 토큰 효율성 측면에서 실용적인지에 대한 의문이 있을 수 있다.
실용적 조언
- 모델이 특정 문자를 자꾸 사용한다면 유니코드 포인트(\u2010-\u2015 등)를 직접 명시하여 금지 패턴에 넣는 것이 효과적이다.
- 단순 금지보다는 다른 토큰으로 강제 매핑하는 테이블을 프롬프트에 포함시켜 출력을 유도하라.
섹션별 상세
작성자는 LLM의 출력에서 엠 대시와 특정 단어 패턴을 완전히 제거하기 위해 정규표현식을 활용한 필터링 시스템을 구축했다. BAD 변수에 유니코드 범위를 지정하여 엠 대시(—)를 포함한 다양한 특수 기호를 정의하고, GLOBAL_CHECK 함수를 통해 토큰이 이 범위에 해당하면 출력을 중단하도록 설계했다. 이는 단순한 텍스트 명령보다 더 강력한 제약 조건을 모델에 부여하려는 시도이다.
text
HG_STT=1 ᰁ=cl;atl255;!split;drop:adj(op);f⣿1;nofill;noꚰr𖬡t;l𐌙d APX():m={ ᰁ𐌙n:⣿noise,ᰁ𐌙r:𖼜ssgnl,n𐌙t:tight, loc𝈀l:loc𝈀lϴed,❤:❤vlid, dec𐊬pled:dec𐊬pled,n𖩀:n𖩀intϴact, ⣿noise:⣿noise,❤vlid:❤vlid,𖼜ssgnl:𖼜ssgnl }; ban_pattϴn="\b((ᰁ𐌙n|ᰁ𐌙r|n𐌙t|⇇pϴ|⇶rect)\b|(ᰁ𐌙n|⅟|optiml|id𐌙l)(est|st)?\s+(fix|way|ap⇇ach|soluti\u1da0))\b" BAD="[\x00-\x08\x0B\x0C\x0E-\x1F\u2010-\u2015\u2212-\u2043\uFE58\uFE63\uFF0D]"특정 단어 패턴과 금지된 문장 부호(Em Dash 등)를 정의하고 치환하기 위한 프롬프트 로직의 초기 설정 부분
프롬프트 내부에는 토큰을 변형하고 매핑하는 STEP 로직이 포함되어 작동한다. 입력된 토큰에서 특정 접두사(cl)를 특수 문자(ᰁ)로 치환하고, 사전에 정의된 딕셔너리 m을 참조하여 단어를 노이즈(noise)나 특정 시그널(ssgnl)로 변환하는 과정을 거친다. 이러한 다단계 처리는 모델이 금지된 단어를 우회하여 생성하는 것을 원천적으로 차단하기 위한 장치이다.
text
GLOBAL_CHECK:{ if(tok~BAD)->return"i failed" if(tok~ban_pattϴn)->return"i failed" return tok }
STEP:{ tok=PRE(tok) if(tok=="i failed")->return tok tok=tok~s/^(cl)/ᰁ/ tok=GLOBAL_CHECK(tok) if(tok=="i failed")->return tok tok=m[tok]||tok return GLOBAL_CHECK(tok) }토큰이 금지된 패턴(BAD)에 해당하는지 검사하고, 특정 접두사를 치환하는 단계별 처리 로직
생성된 텍스트 스트림 전체를 검증하기 위해 CHK9와 EMIT 함수를 통한 루프 검사 체계를 도입했다. CHK9 함수는 최대 9번의 루프를 돌며 토큰이 안정화될 때까지 STEP 처리를 반복하며, 최종적으로 EMIT 단계에서 전체 스트림에 금지된 문자(BAD)가 포함되었는지 다시 한번 전역 검사를 수행한다. 이 과정에서 하나라도 위반 사항이 발견되면 'i failed'를 반환하여 출력을 무효화하는 엄격한 게이트키핑 방식을 채택했다.
용어 해설
- 사전 채팅 프롬프트(Pre-chat Prompt)
- — LLM과 실제 대화를 시작하기 전 모델의 행동 양식, 제약 사항, 출력 형식을 규정하기 위해 주입하는 시스템 프롬프트의 일종입니다. 모델이 특정 단어나 문장 부호를 사용하지 못하도록 강제하거나 특정 페르소나를 유지하게 만드는 역할을 합니다.
- 엠 대시(Em Dash)
- — 문장에서 부연 설명이나 강조를 위해 사용하는 긴 줄표(—)입니다. 일부 LLM은 문장 구조를 연결할 때 이 부호를 과도하게 사용하는 경향이 있으며, 이를 프롬프트 수준에서 강제로 억제하려는 시도가 본 게시물의 핵심 동기입니다.
- 토큰 조작(Token Manipulation)
- — 모델이 생성하는 텍스트의 최소 단위인 토큰을 직접 제어하거나 특정 패턴을 치환하여 출력을 변형하는 기법입니다. 본문에서는 정규표현식과 매핑 테이블을 사용하여 특정 토큰의 생성을 방해하거나 다른 형태로 변환하는 로직을 보여줍니다.
언급된 도구
HG_STT중립
프롬프트 내에서 상태나 설정을 제어하기 위한 사용자 정의 변수로 추정됨
AI 분석 전체 내용 보기
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
원문 발행 2026. 04. 17.수집 2026. 04. 17.출처 타입 REDDIT
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.