# 🔍 P0-5 진단 결과: EEAT 0점 미스터리 = 시스템 정상 + 사이트 콘텐츠 부족 v1.0

> # 🔍 P0-5 진단 결과: EEAT 0점 미스터리 = 시스템 정상 + 사이트 콘텐츠 부족 > 작성: 2026-04-27 KST > 트리거: T-FIX-WCONCEPT-CRAWL Phase X 검증 → 11:00 batch 추적 → prompt_version 정밀 진단 > 결론: 시

## 핵심 요약


# 🔍 P0-5 진단 결과: EEAT 0점 미스터리 = 시스템 정상 + 사이트 콘텐츠 부족

> 작성: 2026-04-27 KST
> 트리거: T-FIX-WCONCEPT-CRAWL Phase X 검증 → 11:00 batch 추적 → prompt_version 정밀 진단
> 결론: 시스템 정상 작동, 영업/제품 신호로 활용 가능

---

## 1. Executive Summary

### 출발점 미스터리
- W컨셉 EEAT 5건 / Phase C 회복 313건이 매일 11:00 정각에 일괄 fail 처리됨
- 출처 미특정 → 시스템 결함 의심

### 추적 과정
1. n8n WF 검색 (290+ active) → eeat 관련 schedule WF 0건
2. bizspring n8n 검색 → 관련 WF 0건
3. Edge Functions 검색 → EEAT 직접 마킹 EF 0건
4. **DB 함수 검색 → `evaluate_eeat_quality()` RPC 발견** ✅
5. 호출자 추적 → `[SYS-PGE-001]` WF 발견 ✅

### 진짜 결론
- 시스템 결함: **0건**
- 사이트 콘텐츠 부족: **800건+**
- Phase A 패치 + sanitize + 11:00 batch 모두 정상 동작
- prompt_version은 사이트 EEAT 등급 신호로 활용 가능

---

## 2. 11:00 batch 출처 확정

### WF 정보
| 항목 | 값 |
|---|---|
| WF ID | `jRkjkys6ANIDcAEB` |
| WF 이름 | 🟢 `[SYS-PGE-001] PGE 일일 품질 검증 + Score History 집계` |
| 링크 | https://bawee.app.n8n.cloud/workflow/jRkjkys6ANIDcAEB |
| Trigger | ⏰ Daily 05:00 KST cron + 🔗 Manual Webhook |
| 실제 실행 | 매일 11:00 UTC (= 20:00 KST) |
| 노드 흐름 | Daily/Manual → 🔍 Evaluate EEAT → 📊 Aggregate Score → 📝 Summarize → ⚠️ Warning? → 🔴 Alert / ✅ Done |

### 호출 함수: `evaluate_eeat_quality()`

```sql
-- R1 규칙: 4축 모두 0점 → 분석 실패 마킹
UPDATE gp_geoex_eeat_analysis
SET is_analysis_failed = true
WHERE created_at::date = target_date
  AND is_analysis_failed = false
  AND experience_score = 0 
  AND expertise_score = 0 
  AND authoritativeness_score = 0 
  AND trustworthiness_score = 0;

-- R4 규칙: 비콘텐츠 URL (sitemap.xml, robots.txt, .pdf, .xml) → 실패 마킹
```

### 매일 11:00 KST 패턴 검증
| 일자 | rows | marked_failed |
|---|---:|---:|
| 2026-04-20 | 10 | 10 |
| 2026-04-21 | 8 | 8 |
| 2026-04-23 | 5 | 5 |
| 2026-04-24 | 101 | 101 |
| 2026-04-27 | 440 | 437 |

### 정상 동작 확인
- 매일 일정량 EEAT row를 fail로 마킹
- 4/27 갑자기 437건 → 853페이지 일괄 재분석으로 큐가 늘어났기 때문
- ✅ **의도된 정상 동작**

---

## 3. prompt_version 정밀 진단

### prompt_version의 진짜 의미

```javascript
// Phase1A-3 WF Parse Result 노드
p_prompt_version: sanitizeLog.length > 0 ? `v3_sanitized_${sanitizeLog.length}` : 'v3'
```

- `v3` = sanitize 0번 (clean 데이터)
- `v3_sanitized_N` = sanitize **N번 했음** = GPT가 N번 환각 시도

### Sanitize의 역할 (GPT 환각 검출)

```javascript
const PLACEHOLDER_PATTERNS = [
  /실제 (사용자|고객|환자|이용자|회원|독자) [A-Z]씨/,        // "실제 사용자 A씨" 류
  /\b\d+%\s*(개선|증가|감소|상승|향상|효과|합격률|성장)/,    // 지어낸 통계
  /(임상 연구|논문 발표|특허 등록|연구 결과)에서 효과가? (입증|확인|증명)/,  // 가짜 의학 권위
];
```

**Sanitize는 evidence 부족 사이트에서 GPT가 만들어내는 가짜 증거를 자동 필터링**

### prompt_version × 점수 분포 (4/27 회복 데이터 기준)

| version | rows | avg_md_size | with_jsonld | avg_score | 0점 비율 |
|---|---:|---:|---:|---:|---:|
| **v3** (clean) | 48 | 11,757 | 85% | **16.88** | 52% |
| v3_sanitized_1 | 18 | 13,259 | 78% | **27.50** | 28% |
| v3_sanitized_2 | 38 | 13,944 | 89% | 9.87 | 58% |
| v3_sanitized_3 | 138 | 13,427 | 80% | 8.66 | 68% |
| **v3_sanitized_4** | **245** | 16,009 | 78% | **4.45** | **80%** |
| v3_sanitized_5 | 19 | 12,757 | 89% | 8.95 | 68% |
| v3_sanitized_6 | 1 | 7,323 | 100% | 20.00 | 0% |

→ **명확한 패턴**: sanitize 횟수가 늘수록 점수가 낮음 (페이지 EEAT 콘텐츠 부족도와 비례)

---

## 4. W컨셉 검증 — 진짜로 EEAT 데이터가 없는가?

### Raw 페이지 데이터 (W컨셉 fail 5건)
| 페이지 | Markdown | HTML | JSON-LD | Microdata | Title | OG | EEAT |
|---|---:|---:|---|---|---|---|---:|
| 메인 | 32,936 | 746,811 | ❌ | ❌ | ✅ | ✅ | 0 |
| 상품 1 | 28,057 | 299,392 | ❌ | ❌ | ✅ | ✅ | 0 |
| 상품 2 | 21,260 | 193,303 | ❌ | ❌ | ✅ | ✅ | 0 |
| 상품 3 | 22,534 | 211,048 | ❌ | ❌ | ✅ | ✅ | 0 |
| 상품 4 | 19,471 | 178,217 | ❌ | ❌ | ✅ | ✅ | 0 |

→ ✅ **W컨셉은 진짜로 JSON-LD schema 부재** (콘텐츠는 풍부)

### 다른 사이트는?
| 카테고리 | row 수 | JSON-LD 보유 |
|---|---:|---:|
| 🔴 FAIL (총점 0) | 313 | **308 (98%)** |
| 🟡 SUCCESS but 0점 | 356 | 278 (78%) |
| 🟢 SUCCESS (양호) | 150 | 129 (86%) |

→ **데이터(JSON-LD)는 있지만 GPT가 evidence로 인정하기 어려운 데이터** (Product 단순 카탈로그 등)

---

## 5. 진짜 문제 — 사이트 EEAT 콘텐츠 부족

### 시스템 정상 동작 흐름
```
페이지 콘텐츠 ✅ + JSON-LD ✅ (Product/Breadcrumb 등)
         ↓
EEAT 핵심 시그널 ❌ (작성자/자격/출처/날짜)
         ↓
GPT가 evidence 부족 → 환각 생성 ("사용자 A씨...")
         ↓
Sanitize 환각 제거 → prompt_version=v3_sanitized_N
         ↓
점수 0점 (정확한 결과)
```

### 사이트별 EEAT 부족 분류
| 패턴 | 예시 | 처리 |
|---|---|---|
| 상품 카탈로그 | W컨셉 페이지 | EEAT 시그널 본질적 부족 |
| 일반 SaaS | 단순 랜딩 페이지 | 작성자/전문성 시그널 부족 |
| 법률/의료 | 권위 정보 부족 | 자격증/출처 부재 |

---

## 6. 영업/제품 신호 가치 ⭐

### prompt_version → 사이트 EEAT 등급 분류

| prompt_version | 등급 | 영업 메시지 |
|---|---|---|
| v3 | A 우수 | "AI 검색 친화적 사이트" |
| v3_sanitized_1 | B 보통 | "일부 EEAT 강화 권장" |
| v3_sanitized_2-3 | C 부족 | "EEAT Booster 컨설팅 권장" |
| **v3_sanitized_4+** | **D 심각** | **"즉시 콘텐츠 보강 필요"** |

### 컨설팅 영업 가치
- **"당신 사이트는 EEAT 시그널 부족 → 우리가 보강해드립니다"**
- GEOcare는 이미 EEAT 환각 검출 시스템을 갖추고 있음 = 진단 정확도 ↑
- EEAT Booster (`gp_geoex_eeat_booster`) 활용 안내 가능
- 컨설팅 / GEO_COMMERCE 영업의 핵심 메시지

---

## 7. Track 신설 권고

### 🆕 T-EEAT-SIGNAL (P1, 4시간)
**목적**: prompt_version → 사이트 EEAT 등급 분류 신호화

**Phase A** (1시간): SQL 뷰 + RPC
- `v_site_eeat_grade` 뷰 (사이트별 평균 prompt_version)
- 등급 매핑: A/B/C/D
- 어드민/영업 도구 활용

**Phase B** (2시간): 어드민 화면
- `adm.geocare.ai/sites/eeat-grade` 페이지
- 사이트별 등급 표시 + 컨설팅 우선순위

**Phase C** (1시간): 영업 보고서
- 등급별 고객 리스트
- 컨설팅 영업 우선순위 도출

---

## 8. 결론

| 항목 | 결과 |
|---|---|
| 시스템 결함 | ❌ 없음 |
| Phase A 패치 효과 | ✅ 정상 (detected_schemas 86% 채워짐) |
| Sanitize 로직 | ✅ 정상 (GPT 환각 검출 정확) |
| 11:00 batch | ✅ 정상 (의도된 동작) |
| **진짜 문제** | **사이트 EEAT 콘텐츠 부족** |
| **영업 가치** | **prompt_version → 컨설팅 영업 신호** |

### 후속 액션
1. ✅ KHub 등재 (본 문서)
2. ✅ Snapshot v3.18 갱신
3. ✅ 김태진님(W컨셉) 정직 회신 + 컨설팅 제안
4. 🆕 T-EEAT-SIGNAL Track 신설 (P1)

---

## 9. 변경 이력

| 일자 | 버전 | 변경 |
|---|---|---|
| 2026-04-27 KST | v1.0 | 최초 작성 (찰스 통찰 "데이터가 진짜 없는 거야?" 트리거) |


## FAQ


---
출처: https://bizspring.ai/kb/ref/khub/geocare-p0-5-진단-결과-eeat-0점-미스터리-시스템-정상-사이트-콘텐츠-부족-v1-0 · 최종 갱신 2026-08-24T11:53:44.997497+00:00
