신뢰 리포트
소크라텍스는 매일 스스로를 시험하고, 그 성적을 좋은 날도 나쁜 날도 그대로 공개합니다. “믿어 달라”는 말 대신, 오늘 상태를 직접 보여드립니다.
지어낸 답
0건
없는 판례·조문을 지어냈는지. 1건이라도 나오면 그날 자동 배포를 멈춥니다.
신뢰 점수 · 2026-09-08 오전 회차
88.2 / 100
다른 AI가 우리 답을 교차 채점한 결과. 85점 이상이면 정상.이 회차 점수입니다 · 최근 30회차 중 정상 20회
오늘 자가 점검
과거에 고친 문제 하나가 다시 걸려, 원인을 확인할 때까지 자동 배포를 멈췄습니다. 서비스는 정상 운영 중입니다.
2026-09-08 오전 기준
91.7
답변 품질
결론·근거·계산이 맞는지
88.9
최신성
개정 세율·예규 반영
83.3
회귀 방어
고친 오답이 안 틀리는지
왜 믿을 수 있나요
매일 스스로를 시험합니다
틀리기 쉬운 함정 문제로 매일 자가 채점하고, 그 성적을 이 페이지에 그대로 올립니다.
지어내면 스스로 멈춥니다
없는 판례·조문을 지어내면 검증된 데이터베이스로 걸러내고, 한 건이라도 나오면 그날 자동 배포를 멈춥니다.
근거를 원문과 대조합니다
답이 인용한 조문·판례를 실제 원문과 맞춰 함께 보여줘, 그대로 믿지 않고 눌러 확인할 수 있습니다.
최신 개정을 반영합니다
일반 AI가 옛 기준으로 답할 때, 개정된 세율·예규를 반영하고 근거가 어느 시점 기준인지 함께 표시합니다.
질문도, 답도, 첨부 문서도 — 내 컴퓨터 안에만 저장됩니다.
고객 정보 유출 걱정 없이 물어보세요.
아래 네 가지 장치로 그렇게 만들었습니다.
대화·첨부 문서는 내 컴퓨터에만
질문·답변·첨부 문서는 브라우저에만 저장되고, 저희 서버 데이터베이스에는 남지 않습니다. 직접 버튼을 눌러 보내시는 오답 신고·문제 제보, 일반 피드백(첨부하신 스크린샷 포함), 캘린더 일정은 예외로 서버에 저장됩니다.
이름·번호는 전달 전 자동 마스킹
이름·주민번호·전화번호·계좌번호는 자동 마스킹을 거친 뒤에 답변 AI로 전달됩니다. 이름·회사명을 찾아 가리는 마스킹 단계에도 별도 AI가 쓰입니다.
AI 전달은 답변 생성 순간뿐
질문은 답변을 만드는 동안에만 AI 모델에 전달되고, 그 자리에서 쓰고 버려집니다.
보내기는 직접 누를 때만
오답 신고·문제 제보, 피드백, 캘린더 일정 — 이 세 가지를 직접 누르시지 않으면 어떤 대화도 저희 쪽에 전달되지 않습니다.
뭐가 실제로 되고, 뭐가 아직인가요
“AI가 다 해준다”고 뭉뚱그리지 않습니다. 지금 실사용 검증까지 마친 것과, 코드는 있지만 아직 안전하게 켜지 않은 것을 구분해 보여드립니다.
- ·예규·판례·법령 원문 통합 검색
- ·세액 계산 자동 검증 (누진세율·법인세 산출세액을 다시 계산해 답과 대조)
- ·답변 신뢰도 자동 점검 (결론·계산이 서로 맞는지, 최신 법령을 반영했는지)
- ·소명서·이유서·불복 서식 초안 자동 작성
- ·세무조사 대응 논리·반박 근거 구성
- ·신고서 자동 검토
- ·사건 단위로 대화·계산·문서를 한곳에 모아 관리
- ·법정기한 캘린더 (캘린더 앱 연동 포함)
- ·법령 개정 알림 (앱 안에서 확인)
- ·질문 난이도에 맞춰 처리 방식을 자동으로 나누는 기능
- ·복잡한 질문을 여러 쟁점으로 쪼개 순서대로 푸는 기능
- ·검색 결과가 부족하면 스스로 다시 찾아보는 기능
- ·이메일·문자로 알림 받기 (지금은 앱 안에서만 확인 가능)
나쁜 날도 지우지 않아요
최근 30번의 자가 채점입니다. 정상 20번 · 그 외 10번 — 안 좋은 날도 그대로 남겨둡니다.
숫자로 전체 보기
품질·최신성·회귀·할루는 자가 채점 세부 점수예요. 여기서 멈추는 것은새 버전 배포이고, 서비스는 그동안에도 정상 운영됩니다.
| 검증일 | 점수 | 품질 | 최신성 | 회귀 | 할루 | 상태 |
|---|---|---|---|---|---|---|
| 2026-09-08 | 88.2 | 91.7 | 88.9 | 83.3 | 0 | 배포 보류 |
| 2026-09-07 | 99.0 | 97.7 | 100.0 | 100.0 | 0 | 정상 |
| 2026-09-06 | 100.0 | 100.0 | 100.0 | 100.0 | 0 | 정상 |
| 2026-09-05 | 100.0 | 100.0 | 100.0 | 100.0 | 0 | 정상 |
| 2026-09-04 | 100.0 | 100.0 | 100.0 | 100.0 | 0 | 정상 |
| 2026-09-03 | 98.5 | 96.6 | 100.0 | 100.0 | 0 | 정상 |
| 2026-09-02 | 100.0 | 100.0 | 100.0 | 100.0 | 0 | 정상 |
| 2026-09-01 | 99.4 | 98.6 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-31 | 98.5 | 96.6 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-30 | 100.0 | 100.0 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-29 | 97.0 | 95.8 | 94.4 | 100.0 | 0 | 정상 |
| 2026-08-28 | 97.9 | 97.5 | 95.0 | 100.0 | 0 | 정상 |
| 2026-08-27 | 87.3 | 89.8 | 88.9 | 83.3 | 0 | 배포 보류 |
| 2026-08-26 | 100.0 | 100.0 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-25 | 91.6 | 93.2 | 95.5 | 87.5 | 0 | 배포 보류 |
| 2026-08-24 | 98.8 | 97.2 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-23 | 97.6 | 97.2 | 94.4 | 100.0 | 0 | 정상 |
| 2026-08-22 | 99.4 | 98.8 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-21 | 88.2 | 91.7 | 88.9 | 83.3 | 0 | 배포 보류 |
| 2026-08-20 | 99.0 | 97.7 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-19 | 97.6 | 97.2 | 94.4 | 100.0 | 0 | 정상 |
| 2026-08-18 | 85.8 | 88.9 | 83.3 | 83.3 | 0 | 배포 보류 |
| 2026-08-17 | 98.0 | 95.5 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-16 | 96.9 | 93.1 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-15 | 86.5 | 90.3 | 83.3 | 83.3 | 0 | 배포 보류 |
| 2026-08-14 | 98.8 | 97.2 | 100.0 | 100.0 | 0 | 정상 |
| 2026-08-13 | 86.9 | 88.9 | 88.9 | 83.3 | 0 | 배포 보류 |
| 2026-08-12 | 85.6 | 85.9 | 83.3 | 86.7 | 0 | 배포 보류 |
| 2026-08-11 | 94.0 | 95.1 | 92.9 | 93.3 | 0 | 배포 보류 |
| 2026-08-10 | 93.2 | 92.2 | 92.5 | 95.0 | 0 | 배포 보류 |
어떻게 채점하고, 어떻게 지키나요
매일, 세무 실무 문항 은행 185문항(2026-09-05 기준)(이 중 함정 117개 — 개정 전 세율·폐지된 특례처럼 틀리기 쉬운 질문)에서 뽑은 문제와과거 오답 회귀 문항 83건(2026-09-05 기준)을 순환하며 매 회차 일부를 실서비스와 같은 경로로 풀게 하고, 별도의 AI 채점자가 결론·근거·최신성을 교차 채점합니다.
점수가 낮거나(70점 미만), 할루시네이션이 검출되거나, 회귀 점검(과거 오답 재발) 중 하나라도 걸리면 그날은 코드를 자동으로 바꾸지 않습니다 — 사람이 원인을 확인하고 고친 뒤에야 다시 엽니다. 멈추는 것은 자동 배포이고, 서비스 자체는 그동안에도 정상 운영합니다. 기준을 느슨하게 잡으면 이 장치가 무의미해지므로, 재발이 한 건만 나와도 점수와 무관하게 멈춥니다.
검증된 현행 수치 고정
자주 바뀌는 세율·공제 한도·기한을 미리 검증한 현행 값으로 고정해, 옛 값이나 폐지된 특례로 답하지 않게 막습니다.
결론 ↔ 본문 대조
본문에서 계산을 끝낸 뒤 결론의 숫자·기간이 어긋나면 자동으로 바로잡습니다(자릿수 실수·기간 착오 등).
가짜 인용 차단
없는 판례 번호·조문을 지어내면 검증된 데이터베이스와 대조해 걸러내고 ‘확인 필요’로 정직하게 표시합니다.
‘이게 맞아?’ 재검증
앞 답을 다시 물으면 처음부터 새로 답하지 않고, 그 답을 근거로 검증 관점에서 다시 봅니다.
이 지표는 당사 내부의 자동화된 자체 평가이며 제3자 인증이 아닙니다. AI 답변은 참고자료로, 최종 판단은 세무 전문가의 검토를 거치시기 바랍니다. 모든 수치는 검증 파이프라인이 기록한 원본을 자동 변환한 것으로 사람이 고쳐 쓰지 않습니다.데이터 기준: 2026-09-08 자가 점검(2026-09-08 05:05 갱신).