스키마 누락 진단
답변 엔진이 의뢰 사이트의 어느 페이지를 어떤 위치에 인용하는지 두 주 연속으로 잡습니다. 마크업이 박혔지만 인용이 안 되는 자리와, 마크업 자체가 누락된 자리를 분리합니다.
베이스라인 측정 더 보기스키마 한 줄을 안 박아서 답변에서 빠지는 페이지는 의외로 많습니다. 우리 랩은 그 한 줄을 마크업 한 줄로 다시 박고, 모델 픽스 너머까지 인용이 살아남는지 회차로 검증합니다.
11회차 누적 · 같은 페이지 4곳 검증 통과 2곳
답변 엔진이 의뢰 사이트의 어느 페이지를 어떤 위치에 인용하는지 두 주 연속으로 잡습니다. 마크업이 박혔지만 인용이 안 되는 자리와, 마크업 자체가 누락된 자리를 분리합니다.
베이스라인 측정 더 보기cssSelector 한 줄, 헤딩 레벨 한 단계, 답변 첫 문장 위치 중 하나만 바꿔 회차를 돌립니다. 모델 4종 응답을 같은 프롬프트로 잡고, 단위까지 패치 노트에 적습니다.
프로토콜 인덱스모델 버전 픽스 일자가 캘린더에 잡히면 그 다음 주에 같은 회차를 자동 재측정합니다. 한 번의 측정값으로 인용이 안 정해진다는 게 이 트랙의 핵심 규칙입니다.
LLM 인용 모델별 더 보기월요일 변수 정의 → 수요일 측정 → 토요일 외부 공개.
이번 회차에 바꿀 마크업 한 줄을 패치 노트 머리에 적습니다. 의뢰 사이트의 URL 중 4곳 이상 묶음에 같은 변경을 적용합니다.
ChatGPT·Perplexity·Claude·Gemini 응답을 같은 프롬프트로 잡습니다. 인용 위치는 문장 단위로, 단위는 pp 로 적습니다.
토요일 아침 오픈 노트에 같이 올립니다. 묶음 4곳 중 검증 통과 수, 리그레션 수, 다음 회차 변수 후보를 한 줄씩.
"046 회차에서 cssSelector 를 좁힌 후 인용이 사라졌는데, 다음 모델 픽스에 +9pp 가 나왔습니다. 같은 한 줄이 두 회차 사이에 정반대로 움직이는 걸 처음 봤어요. 다음부터는 한 번의 결과로 결론 내지 않게 됐습니다."
한 번의 측정으로 결론 내지 않습니다. 모델 픽스 너머까지 회차를 잇고 의뢰 사이트의 인용을 패치 노트로 외부 공개합니다.