AI 모델 · 모델 발표 · UNREAL LAB 자체 기사
판례 2억3천만 건을 찾는 GPT-6 Astra…Astra for Law의 정답률은 54%였다
OpenAI의 Astra for Law은 GPT-6 Astra에 미국 법률 검색 인덱스와 업무 지침을 붙인 법률 연구용 구성이다. 웹 검색만 쓴 Astra보다 개선됐지만, 200개 평가 질문에서 전체 정확성 검사를 통과한 비율은 54%였다.
답변보다 먼저, ‘근거’를 찾는 AI
법률 조사에서 중요한 것은 그럴듯한 요약이 아니다. 어떤 법원이 어떤 사실관계에서 무엇을 판단했는지, 그 판단을 뒷받침하는 정확한 문단이 어디에 있는지가 먼저다. Astra for Law은 GPT-6 Astra에 2억3천만 개가 넘는 URL을 대상으로 한 미국 법률 검색 인덱스를 연결했다. 공개 판례를 제공하는 비영리단체 Free Law Project의 CourtListener 자료도 이 흐름에 들어간다. 모델은 넓은 웹을 다시 검색하는 대신, 법률 자료 안에서 답의 뼈대를 찾도록 설계됐다.
54%는 좋아진 숫자이자 남은 절반의 숫자
OpenAI가 공개한 비교는 분명한 개선을 보여준다. 미국 법률 연구 질문 200개에서, 웹 검색만 쓰는 GPT-6 Astra의 전체 정확성 통과율은 38.7%였고 Astra for Law은 54.0%였다. 차이는 15.3%포인트, 상대적으로는 40% 개선이다. 하지만 이 숫자는 ‘54%만 맞았다’는 뜻으로도 읽어야 한다. 평가 조건과 채점 기준을 떠나, 법률가가 결과와 인용을 직접 확인해야 할 이유가 점수 안에 이미 들어 있다.
강점은 더 많은 말을 하는 데 있지 않다
OpenAI는 판례 중심 질문에서 Astra for Law이 웹 검색 기반 Astra보다 참고 판례를 24% 더 찾았고, 감사 대상 문단에서는 같은 추론 설정일 때 관련 문단을 최대 54% 더 가져왔다고 밝혔다. 이 수치의 핵심은 답변의 문장이 화려해졌다는 데 있지 않다. 법률가가 ‘왜 이 결론을 믿어야 하나’를 확인할 재료가 늘어난다는 데 있다. 다만 어떤 판례가 실제로 구속력이 있는지, 현재 사건에 얼마나 맞는지는 검색 결과만으로 결정되지 않는다.
미국 로펌의 초기 도구, 한국 법률 답변기는 아니다
Astra for Law은 처음부터 미국의 일부 적격 로펌과 그 감독 아래 일하는 법률가에게 Trusted Access로 제공된다. ChatGPT와 Codex에서 먼저 쓰이고 API는 추후 제공될 예정이다. OpenAI는 Relativity와 Clio 같은 전문 도구를 연결하는 26개 생태계 플러그인도 함께 내세웠다. 이 범위가 중요하다. 검색 자료와 업무 규칙, 기밀성 의무가 나라와 조직마다 다르기 때문에, 미국 법률 검색 구성의 성과를 한국 법률 자문 능력으로 바로 옮길 수는 없다.
