주간 리포트에 롤백 케이스가 성공만큼 길게 적혀서 처음엔 좀 놀랐습니다. 다음 분기에 같은 실수를 한 번도 안 했어요.
답변 엔진은 우리가 가르치는 게 아니라 따라가는 것
정답은 아직 없습니다. 그래서 우리 랩은 일주일에 프로토콜 하나만 돌립니다. 한 변수만 바꾸고, 같은 페이지에서 모델별로 측정값을 다시 잽니다. 잘 된 결과보다 롤백한 결과를 길게 적는 게 우리 작업장의 형식입니다.
답변 엔진의 인용 동작은 모델 픽스 한 번에 흔들립니다. 우리 랩은 그 흔들림을 주간 프로토콜로 재현하고, 측정값을 단위까지 그대로 공개합니다.
## 047 / Speakable 마크업 롤백 - Perplexity 인용 -3pp · ChatGPT(11/14 픽스) +6pp - 같은 페이지 4곳 중 2곳 검증 통과, 2곳 리그레션 - 다음 회차: 헤딩 레벨 H3→H2 한 변수만 재시도
정답은 아직 없습니다. 그래서 우리 랩은 일주일에 프로토콜 하나만 돌립니다. 한 변수만 바꾸고, 같은 페이지에서 모델별로 측정값을 다시 잽니다. 잘 된 결과보다 롤백한 결과를 길게 적는 게 우리 작업장의 형식입니다.
AEO 베이스라인, Speakable 스키마 검증, 모델별 인용성 측정 — 세 트랙이 매주 한 프로토콜씩 돌아가고 결과는 토요일 아침 패치 노트에 같은 형식으로 적힙니다.
RUNS · 누적 프로토콜
47 회차
랩이 열린 뒤 매주 한 회차씩 돌린 주간 프로토콜의 누계. 한 회차는 한 변수만 바꾸는 규칙입니다.
ROLLBACK · 실패 케이스
47 %
주간 리포트에서 의도와 다르게 끝난 회차의 비율. 그 절반 가까이가 다음 회차의 변수 후보 풀이 됩니다.
TARGETS · 적용 페이지
138 개
AEO/Speakable/FAQ 마크업을 한 회차라도 박아본 페이지의 누계. 같은 페이지는 재시도마다 새 회차로 셉니다.
SHIP · 리포트 공개
토 주간
주간 패치 노트의 외부 공개 요일. 측정값은 단위까지, 실패 케이스는 성공보다 길게 적습니다.
변수는 하나, 측정은 모델 전수, 결과는 패치 노트로 다음 주 토요일 공개.
이번 회차에 바꿀 한 가지 — 스키마 한 줄, 헤딩 레벨, 답변형 문장 위치 — 를 패치 노트 머리에 적습니다. 두 가지를 동시에 바꾸면 그 회차는 무효.
같은 프롬프트로 ChatGPT·Perplexity·Claude·Gemini 응답을 한 번에 잡습니다. 인용 위치·문장 단위까지 적고, 모델 픽스 일자가 가까우면 재측정을 큐에 넣습니다.
성공·실패·롤백을 같은 분량으로 적어 외부에 공개합니다. 재현 안 되는 인용은 별표 표시. 다음 회차의 변수 후보를 마지막 줄에 남깁니다.
주간 리포트에 롤백 케이스가 성공만큼 길게 적혀서 처음엔 좀 놀랐습니다. 다음 분기에 같은 실수를 한 번도 안 했어요.
Speakable 한 줄을 바꾸고 다음 모델 픽스 때까지 기다리는 인내심이 우리 팀에 없었습니다. 47회차치 패치 노트를 한 번 읽고 나서야 그 인내심이 왜 필요한지 알았습니다.