← 서비스로 돌아가기

ARGUS 혁신성장품목 자동판별 서비스
사용자 매뉴얼

v1.0 체험용 서비스
운영주체 안내 — 본 서비스는 AI+OpenData 챌린지 참가작으로 개발한 체험용 서비스이며, 기술보증기금·중소벤처기업부의 공식 서비스가 아닙니다. 판별 결과는 참고용이며 공식 심사 결과를 대체하지 않습니다.

1. 서비스 개요

ARGUS는 기업의 기술명·제품명·용도 및 특성을 입력받아, 혁신성장 공동기준(6차 개정)의 240개 품목 중 해당 가능성이 높은 후보를 추천하는 서비스입니다. 240개를 일일이 대조하는 대신 상위 후보 몇 개로 좁혀, 검토 시간을 줄이는 것이 목적입니다.

3개 엔진 교차검증

서로 다른 방식의 엔진 3개가 독립적으로 240개 품목을 채점하고, 그 결과를 교차검증합니다.

엔진방식역할
E1TF-IDF + 선형 분류기어휘·표기 패턴 기반 분류
E2KLUE-RoBERTa 신경망문맥 의미 기반 분류
E3KURE-v1 의미검색공식 품목정의서와의 의미 대조
결과①과 결과②는 왜 나뉘어 있나요?
결과①은 기술보증기금이 제공한 데이터로 학습한 결과(E1+E2)이고, 결과②는 공개된 공식 품목정의서를 의미검색으로 대조한 결과(E3)입니다. 두 경로는 학습에 쓰는 정보가 서로 겹치지 않기 때문에, 둘이 같은 답을 내면 신뢰도가 높다고 볼 수 있습니다. 이것이 일치도의 근거입니다.

2. 개인정보 처리 방침

기업 식별정보를 수집·저장·활용하지 않습니다.
대국민 사용자체험평가 기간에는 기업명·대표자명·사업자등록번호 입력란이 비활성화되어 있습니다. 입력받는 값은 업종·제품·기술 관련 항목뿐이며, 결과는 세션 내에서만 확인됩니다.

3. 개별 판별 이용 방법

  1. 상단 정보입력실시간입력(개별) 탭을 선택합니다.
  2. 제품명·기술명·용도 및 특성 중 최소 하나를 입력합니다. 세 가지를 모두, 구체적으로 적을수록 정확도가 올라갑니다.
  3. 업종코드·기술분류코드를 알고 있다면 함께 입력하면 정확도가 더 올라갑니다. 몰라도 판별은 가능합니다.
  4. 판별 시작을 누르면 보통 1초 안에 결과가 나옵니다.
처음 이용하시면 예시 채우기 버튼으로 샘플 값을 넣고 결과를 먼저 확인해 보세요.

4. 대량 판별 이용 방법

  1. 챌린지 평가입력(대량건) 탭을 선택합니다.
  2. 양식 다운로드로 엑셀 양식을 받습니다. 예시 행이 들어 있어 그대로 올려볼 수 있습니다.
  3. 양식의 7개 컬럼(업종코드·업종코드명·제품명·용도및특성·기술명·기술분류코드·기술분류코드명)을 채웁니다.
  4. 파일을 선택하거나 끌어다 놓으면 판별이 시작되고 진행률이 표시됩니다.
처리 건수 제한 — 체험평가 기간에는 한 번에 최대 300행까지 처리합니다. 초과분은 자동 제외되며, 필수값이 모두 빈 행도 제외됩니다. 전체 규모 일괄판별은 정식 운영 시 야간 배치로 처리합니다.

5. 결과 읽는 법

결과 화면은 세 개의 탭으로 구성됩니다.

내용
결과①기보 제공 데이터로 학습한 지도학습 앙상블의 상위 3개 품목
결과②공식 품목정의서 의미검색의 상위 3개 품목
결과 비교두 결과의 일치도, 교차 비교, 최종 추천

기여 키워드

각 품목 카드에는 기여 키워드가 함께 표시됩니다. 이는 사후에 지어낸 설명이 아니라, 모델이 그 품목 점수를 올릴 때 실제로 사용한 입력 어휘입니다. 품목정의서 일치는 입력 문구와 공식 품목 설명이 겹친 단어입니다.

최종 추천이 만들어지는 방식

① 결과①이 상위 20개 후보를 정합니다.
② 결과②가 그 20개 안에서 순서만 바꿉니다.
③ 후보 밖 품목은 새로 진입할 수 없습니다. 매 요청 이 규칙을 검증합니다.

후보를 넓게 잡되(Top-20) 최종 순서는 의미검색으로 바로잡는 구조라, 정답이 후보에 포함될 확률과 1순위 정확도를 함께 높일 수 있습니다.

6. 일치도와 검토 기준

일치도는 두 독립 경로가 얼마나 같은 판단을 했는지를 나타내며, 다음과 같이 계산합니다.

일치도 = 0.6 × (1순위 일치 여부) + 0.4 × (상위 3개 겹침 비율)
일치도상태의미
75% 이상자동승인 가능두 경로가 1순위에 동의하고 후보도 대부분 겹칩니다.
75% 미만검토대기판단이 갈립니다. 담당자 확인을 권장합니다.

7. 분류 성능

아래는 학습에 전혀 사용하지 않은 별도 데이터 2,479건으로 단 한 번 측정한 결과입니다.

수치를 읽으실 때 — 240개 중 하나를 고르는 문제이므로 무작위로 찍으면 0.42%입니다. 과제 요구사항에 기재된 기준선은 Top-1 18.87%, Top-5 39.73%였습니다.
실무에서 더 중요한 값은 Top-10입니다. 검토 대상을 240개에서 10개로 줄여 주기 때문입니다.
측정의 정직성에 대하여 — 운영 모델은 제공된 전체 데이터로 재학습했으나, 그 모델에는 독립 검증셋이 남지 않습니다. 따라서 더 높은 수치를 주장하지 않고 위 외부검증 값을 그대로 보고합니다.

8. 지원 환경

별도 설치 없이 웹 브라우저로 이용합니다. 아래 환경에서 동작을 확인했습니다.

구분지원
PC · MacChrome, Edge, Safari, Firefox 최신 버전
모바일iPhone(Safari·Chrome), Android(Chrome·삼성 인터넷)
폴더블갤럭시 폴드·플립 — 접은 상태(약 280px)와 편 상태 모두 지원
태블릿iPad, Android 태블릿 — 세로·가로 모두 지원
화면 모드기기의 라이트·다크 모드를 자동으로 따릅니다
접근성키보드 이동, 화면낭독기 레이블, 고대비·모션 축소 설정 반영

9. 자주 묻는 질문

결과가 예상과 다릅니다.

용도 및 특성을 더 구체적으로 적어 주세요. "무엇에 쓰이는지 · 어떤 점이 다른지"가 들어가면 정확도가 크게 올라갑니다. 업종코드·기술분류코드를 함께 넣는 것도 도움이 됩니다.

1순위만 믿어도 되나요?

권장하지 않습니다. 이 서비스는 후보를 좁혀 주는 도구이며 최종 판단을 대체하지 않습니다. 일치도가 75% 미만이면 특히 담당자 확인이 필요합니다.

품목 기준이 7차로 개정되면 어떻게 되나요?

결과② 경로는 품목정의 문서만 교체하면 모델 재학습 없이 반영됩니다.

입력한 내용은 저장되나요?

판별 목적으로만 사용하며 기업 식별정보는 수집하지 않습니다. 결과는 세션 내에서만 확인됩니다.