← 매칭 검색/도움말/점수 산출 방식

매칭 점수는 이렇게 계산됩니다

검색 결과 카드에 보이는 0.73 / 1.0 같은 점수가 어떻게 산출되는지 그림 한 장으로 설명합니다.

한눈에 보는 산출 흐름

STEP 1
🔍 검색어 입력
해결하려는 과제를 자연어 문장으로
↓
STEP 2
✨ 의미 벡터로 변환
Voyage-4 임베딩 · 1024차원
두 축에서 동시 측정 ↓
📝 본문 의미 유사도
검색어 ↔ 특허·과제 본문
0 ~ 1.0
🕸 그래프 위치 유사도
기관 협력 네트워크 근접도
0 ~ 1.0
↓ 가중 합산
STEP 4
⚙ 종합 의미 점수
본문 × 0.7 + 그래프 × 0.3
↓
✨ 가산점 — 상황에 따라 추가 부여
  • 🎯 매칭 입장 수요자 = 공공·산학 우대 +0.08~0.10 · 공급자 = 기업 우대 +0.05
  • 🏛 R&D 활동 사업보고서에 R&D를 많이 박제할수록 +0.02~0.10
  • 🌐 같은 협력 그룹 검색어가 속한 협력 군집과 일치하면 +0.05
  • 📅 최신성 보정 10년 이상 오래된 특허·과제는 점진 감점
↓
🏆 최종 매칭 점수
0 ~ 1.0
( 종합 의미 + 가산점 ) × 최신성 배수
≥ 0.8 매우 높음≥ 0.6 높음≥ 0.4 보통≥ 0.2 낮음그 외 매우 낮음

검색어가 의미 벡터로 바뀌고 → 본문·그래프 두 축에서 유사도를 측정한 뒤 → 가산점·최신성 보정을 거쳐 최종 점수 0~1.0이 나옵니다.

점수 산출 6 단계

  1. 1
    검색어 → 의미 벡터로 변환

    입력한 자연어 문장을 Voyage-4 임베딩 모델이 1024차원 의미 벡터로 바꿉니다. 단순 키워드 매칭이 아니라 문장 전체의 의미를 수치화합니다.

  2. 2
    본문 의미 유사도 측정

    검색어 벡터와 모든 특허·과제 본문 벡터의 코사인 유사도를 계산해 0~1로 환산합니다. 1에 가까울수록 본문 내용이 유사합니다.

  3. 3
    그래프 위치 유사도 측정

    특허·과제·기관 협력 네트워크(2026-05 구축 시점 기준 2,149 특허 × 1,212 과제 × 938 기관, 최신 규모는 '현황 요약' 참조) 위에서의 위치 임베딩(FastRP 128차원)으로 추가 유사도를 계산. 같은 협력 군집 안에 있을수록 점수가 높아집니다.

  4. 4
    가중 평균 → 종합 의미 점수

    본문 점수 × 0.7 + 그래프 점수 × 0.3 으로 합쳐서 종합 의미 점수를 계산합니다. 본문 의미가 더 중요하다고 판단해 7:3 가중.

  5. 5
    가산점 적용 (상황별 보정)

    아래 항목이 해당될 때 종합 점수에 추가로 더해집니다.

    • 매칭 입장 가산 — "수요자 입장" 선택 시 공공기술·산학 특허 우대 (+0.08~0.10), "공급자 입장" 선택 시 기업 특허 우대 (+0.05)
    • R&D 활동 가산 — 출원자가 사업보고서에 R&D 관련 내용을 많이 기재할수록 +0.02~0.10 (공급자 입장으로 검색할 때 적용)
    • 같은 협력 군집 — 검색어가 속한 협력 군집(community)과 일치하면 +0.05
    • 최근 활발한 활동 — M&A · 자회사 인수 · 시설투자 등 DART 공시 신호가 강한 기업 +0.15까지
  6. 6
    최신성 보정 → 최종 점수

    5년이 지난 특허·과제는 단계별로 감점합니다. 현재 최신성 감점 기준: 6~10년 ×0.7, 11~15년 ×0.4, 16년 이상 ×0.1 / 5년 이내는 100% 반영. 마지막으로 (종합 + 가산점) × 최신성 배수 가 카드 우측 상단의 최종 점수가 됩니다.

점수 수준 등급

최종 점수에 따라 5단계 등급이 자동으로 부여됩니다.

매우 높음0.8 ~ 1.0거의 확실한 매칭 — 즉시 검토 우선순위
높음0.6 ~ 0.8유의미한 매칭 — 검토 담당자 확인 권장
보통0.4 ~ 0.6참고용 — 추가 검색어로 범위를 좁히시기 바랍니다
낮음0.2 ~ 0.4관련성 약함 — 일반적으로 제외
매우 낮음0.0 ~ 0.2거의 무관 — 상위 10건 안에 있다면 검색어 재검토

예시: 점수 0.73의 산출 과정

본문 의미 유사도
0.65 / 1.0
그래프 위치 유사도
0.42 / 1.0
종합 = 0.65 × 0.7 + 0.42 × 0.3 = 0.58
매칭 입장 가산 (수요자 + 공공기술)+0.10
같은 협력 군집+0.05
가산점 합계 = +0.15
최신성 배수 1.00 (3년 전 — 우대 구간)
최종 점수 = (0.58 + 0.15) × 1.00 = 0.73 / 1.0→ 높음

신뢰성 정책

  • 매칭 대상 특허·R&D 과제 데이터는 정부 공식 출처(KIPRIS·NTIS·DART) 기반(등록 수요는 이용자 입력)
  • 임베딩 모델: Voyage-4 (1024차원, 외부 API)
  • 소멸·거절·취하·포기 특허는 매칭 풀에서 자동 차단, 오래된 특허·과제는 최신성 감점으로 후순위 처리
  • 운영기관 자체 사업·전문기관 발주 과제는 자동 감점·후순위 처리(자기참조 가지치기, 기본 −0.20점)
  • 같은 R&D 사업(사업명·수행기관)의 연도별 중복 과제는 1건만 노출(나머지 연도 수 표시, 특허는 미적용)