AI는 문서 Q&A에서 변호사 기준을 상회하고(Harvey 94.8% 대 70.1%), 계약서 수정에서는 완패합니다(65.0% 대 79.7%). Vals Legal AI Report의 데이터입니다. 이 격차가 바로 법률 업무에서 AI에 위임할 수 있는 선을 결정하며, 벤더 데모가 무엇을 보여주든 그 선은 변하지 않습니다.
부작용에는 이제 명확한 가격표가 붙어 있습니다. Couvrette v. Wisnovsky 사건에서 두 변호사는 $110,204.38의 제재금과 편견을 동반한 기각 처분을 받았습니다. Withers v. City of Aberdeen 사건은 지방법원과 변호사협회로부터 2년 자격정지 처분으로 끝났습니다.
전용 도구라고 안전하지도 않습니다. Stanford RegLab은 Lexis+ AI와 Westlaw AI-Assisted Research에서 17%~33%의 환각 발생률을 측정했습니다.
이 글은 위험 등급별로 구성했습니다. 벤치마크가 위임을 허용하는 작업, 판례법이 금지하는 작업, Rule 11을 버텨낼 검증 워크플로, 그리고 특권 유지 여부를 결정하는 네 가지 벤더 조항을 다룹니다.
법률 AI에서 벤치마크가 위임을 허용하는 작업
두 개의 독립 벤치마크가 기준선을 명확히 그어줍니다. 그 선은 벤더 마케팅이 제시하는 곳과 다릅니다. AI는 추출·요약 작업에서 변호사 기준을 큰 격차로 앞서고, 판단이 필요한 초안 작성과 구조화된 공개 문서 검색에서는 뒤처집니다.
AI가 변호사 기준을 뛰어넘는 영역
Vals Legal AI Report는 개별 작업에서 법률 AI 제품을 변호사 대조군과 비교했습니다. 문서 Q&A에서 Harvey는 변호사 기준 70.1% 대비 94.8%를 기록했습니다. 문서 요약에서 CoCounsel은 변호사 50.3% 대비 77.2%를 달성했습니다. 증언록 분석에서 Harvey는 53.7% 대비 77.8%를 기록했습니다(Vals AI). 이는 어소시에이트 시간을 잡아먹는 작업에서 20포인트 이상의 격차입니다.
법률 조사 분야도 움직였습니다. 이후 Vals 벤치마크에서 210개 질문을 블라인드 채점한 결과, 변호사 기준 71% 대비 Counsel Stack 81%, Alexi 80%, ChatGPT 80%, Midpage 79%를 기록했습니다(LawSites). 범용 ChatGPT가 전용 법률 조사 제품과 동점을 기록했다는 사실은, 벤더가 연간 좌석 요금으로 수만 달러를 제안할 때 다시 한번 생각하게 만듭니다.
변호사가 여전히 우위를 점하는 영역
계약서 수정이 가장 명확한 패배 사례입니다. 변호사는 Harvey의 65.0% 대비 79.7%를 기록했고, EDGAR 조사에서도 Oliver의 55.2% 대비 70.1%로 앞섰습니다(Vals AI). 스택의 어떤 도구가 계약서 마크업을 주요 용도로 내세운다면, 그 홍보는 측정된 성능보다 앞서 있습니다. 인간 검토를 위한 조항 플래그 표시에만 활용하십시오. 발송하는 수정본에는 반드시 변호사의 손길이 필요합니다.
감독 파트너처럼 벤치마크 읽기
모든 점수를 특정 작업 하나에 대한 위임 결정으로 취급하십시오. 브랜드 수준의 판단은 데이터를 이겨내지 못합니다. Harvey는 문서 Q&A에서 이기고 계약서 수정에서 집니다. 같은 제품, 정반대의 결과입니다.
구매 전에 벤치마크가 무엇을 측정했는지 확인하십시오. 제공된 문서에서 답변을 추출하는 작업에서 94.8%를 기록한 도구는, 스스로 권위를 찾을 때 인용문을 만들어내는지 여부에 대해서는 아무것도 말해주지 않습니다. 이 두 가지는 서로 다른 실패 유형이며 결과도 다릅니다. 제재 수치는 오직 두 번째 유형에만 적용됩니다. 디렉토리의 124개 법률 서비스 목록 중 후보를 추릴 때는, 필요한 작업을 기준으로 정렬하십시오.
변호사 기준 이하의 점수를 받은 것은 모두 책상을 떠나기 전에 한 줄씩 검토해야 합니다.
환각 위험이 AI를 실격시키는 영역
법률 전용 도구를 구매하면 허위 생성이 절반 정도 줄어듭니다. 제로가 되지는 않으며, '절반 감소'와 '제로' 사이의 격차가 바로 제재가 발생하는 지점입니다.
17~33%: 전용 법률 조사 도구도 여전히 틀리는 비율
Stanford RegLab과 HAI는 대부분의 로펌이 이미 사용 중인 두 제품에 대해 사전 등록 테스트를 실시했습니다. Lexis+ AI는 약 17%, Westlaw AI-Assisted Research는 약 33%의 환각률을 보였으며, GPT-4는 43%였습니다. 정확도도 마찬가지였습니다. Lexis+ AI는 65%, Westlaw AIAR은 42%. 주력 조사 제품의 세 답변 중 하나에 허위 정보나 근거 오류가 포함된다면, 단순 발췌 확인으로는 흡수할 수 없는 수준입니다.
해당 연구 프리프린트는 2024년 5월에 발표되었으며, 이후 도구들이 업데이트되었습니다. 그럼에도 이것은 두 제품에 대한 유일한 사전 등록 독립 벤치마크이며, 어떤 벤더도 수치가 변했다고 주장할 수 있는 복제 연구를 발표하지 않았습니다.
'법률 등급'과 'RAG 기반'이 안전성 주장이 아닌 이유
검색 증강 생성(RAG)은 모델을 실제 코퍼스에 기반시킵니다. 그러나 모델이 실제 판례를 인용하면서 그 판례가 실제로는 판시하지 않은 내용을 판시했다고 설명하거나, 그럴듯한 핀 인용을 잘못된 판결문에 붙이는 것을 막지 못합니다. Stanford 팀은 마케팅 자료를 직접 살펴본 결과, '100% 환각 없는 법적 인용문' 주장이 과장되었음을 발견했습니다. '법률 등급'은 학습 코퍼스에 대한 주장으로 취급하십시오. Rule 11 노출은 별개의 문제입니다.
건물 밖으로 미검증 상태로 내보내서는 안 되는 세 가지 결과물
인용문, 따옴표, 판시 사항. 모든 판례 인용은 직접 찾아서 읽어야 합니다. 모든 인용 구절은 원문과 한 글자씩 대조해야 합니다. 법원이 판시한 내용의 모든 묘사는 판결문과 대조해야 합니다. 이것이 인용 확인 도구를 통과하는 실패 유형이기 때문입니다. 판례는 존재하고, 보고서 번호도 맞고, 명제만 허구입니다.
나머지는 생산성 문제입니다. 이 세 가지는 제출 문제이며, 그 차이가 어떤 벤더를 선택했느냐보다 더 중요합니다.
동일한 규칙이 조사 후 작업에도 적용됩니다. 준비서면이나 증언록을 요약 도구로 처리하는 경우, 요약은 직접 읽기 위한 출발점이며 그 읽기를 대체하지 않습니다. 요약에서 제출 서류로 옮기는 모든 내용은 위의 세 가지 확인을 다시 거쳐야 합니다.
2026년 제재 기록: 실수의 현재 비용
구독료보다 먼저 하방 비용을 산출하십시오. 단 하나의 불량 서류 제출로 법률팀은 $110,204.38과 의뢰인의 사건을 잃었고(Greenberg Rothstein), 두 명의 타지 변호사는 연방 지방법원 출석 자격을 2년간 박탈당했습니다(JD Journal). 두 사건 모두 금액이 명시된 확정 명령입니다.
1년 만에 약 200건에서 1,668건으로
연방 법원도 인용하는 Damien Charlotin의 AI 환각 사례 데이터베이스는 2026년 7월 2일 기준 1,668건을 추적했습니다. 미국 내 1,163건, 영국 59건, 그리고 653건은 자기 대리인이 아닌 개업 변호사가 당사자였습니다. 2025년 중반에는 약 200건이었습니다. 이 곡선이 회의적인 파트너에게 보여줄 수치입니다.
수치를 발표할 경우 2차 추적 자료가 아닌 실시간 데이터베이스를 인용하십시오. 카운트는 매일 업데이트되며 추적 자료들은 서로 수백 건씩 차이를 보이기도 합니다.
653이라는 수치가 전체 합계보다 중요합니다. 추적된 사건의 약 5건 중 2건이 변호사 자격증과 전문직 배상 보험을 가진 사람에게서 발생했다는 뜻입니다. ChatGPT 출력물을 소장에 복사하는 일반인과는 전혀 다른 위험 프로파일입니다.
Couvrette v. Wisnovsky: $110,204.38 기준점
Couvrette v. Wisnovsky, No. 1:21-cv-00157-CL (D. Or.) 사건에서 법원은 두 변호사에게 합산 $110,204.38을 부과하고 소를 기각했습니다. 샌디에이고 pro hac vice 대리인 Stephen Brigandi가 $95,998.72를 부담했습니다. 제재금 $15,500과 피고 변호사 비용 $80,498.72입니다. 포틀랜드 현지 대리인 Tim Murphy는 검증하지 않고 서명한 서류에 대해 $14,205.66을 부과받았습니다. 세 건의 준비서면에서 5개월에 걸쳐 15건의 허위 판례 인용과 8건의 조작된 따옴표가 사용되었습니다.
타지 주임 대리인의 제출 대리인으로 활동한 경험이 있다면 현지 대리인 수치를 두 번 읽으십시오. 다른 사람의 조사에 14,000달러가 문서화된 가격표가 붙은 것입니다.
Whiting, Withers, 제9항소법원: 벌금에서 자격정지로
2026년 1분기에만 최소 $145,000의 AI 관련 법원 제재가 발생했습니다. 제6항소법원의 Whiting v. City of Athens 사건에서 두 변호사에게 각각 $15,000의 징벌적 제재금, 그리고 상대방 수임료와 이중 소송 비용이 부과되었습니다. 수십 건의 부정확하거나 존재하지 않는 인용 때문이었습니다(ComplexDiscovery). 이후 금전적 제재는 상한선이 아니게 되었습니다.
Withers v. City of Aberdeen (N.D. Miss., 2026년 6월 8일) 사건에서 Sharion Aycock 판사는 양측 변호사의 서류에서 허위 판례를 발견했습니다. 판사는 예정된 재판을 취소하고, 양측 주임 타지 변호사 두 명을 지방법원에서 2년간 출석 정지시키고 pro hac vice 허가를 취소하며, 모든 담당 변호사에게 $1,000~$3,500의 벌금을 부과하고 주 변호사협회에 통보했습니다. 2026년 2월에는 제9항소법원이 오렌지카운티 이민 전문 변호사 Mike Sethi와 William Rounds에게 6개월 출석 정지 및 각 $2,500 벌금을 부과했습니다. AI가 생성한 오류를 오타로 넘긴 것이 주된 이유였습니다(Metropolitan News-Enterprise).
이 제재 기록을 어떤 벤더의 ROI 슬라이드와 비교해보십시오. 디렉토리의 문서화된 AI 도입 사례 연구는 절약된 시간을 수치화하지만, 2년 자격정지를 순이익으로 계산한 것은 없습니다.
변호사는 실수가 아니라 은폐로 처벌받습니다
제재 기록을 꼼꼼히 읽으면 최적화해야 할 방향을 바꾸는 패턴이 드러납니다. 환각 데이터베이스를 금전적·직업적 제재로 필터링하면, 변호사들이 단순히 AI 도구로 실수를 했다는 이유로 처벌받는 경우는 드뭅니다. 처벌받는 것은 적발된 후 인정하기를 거부하거나, 더 강하게 밀어붙이거나, 다른 사람에게 책임을 돌리기 때문입니다(Damien Charlotin FAQ).
발상을 전환해야 합니다. 모든 허위 인용을 잡아낼 수는 없습니다. 그럴 것이라 가정하는 워크플로를 구축하는 것을 멈추고, 그러지 못하는 날을 위한 워크플로를 구축하기 시작하십시오.
Charlotin의 직접 필터링이 보여주는 것
무거운 처벌은 발견 이후의 행동에 집중되어 있습니다. 판사들은 '이 도구를 통해 처리했는데 확인하지 못했습니다. 수정 준비서면을 제출하고 상대방 비용을 부담하겠습니다'라고 말하는 변호사에게 상당한 관용을 보입니다. 인용문이 실재한다고 주장하거나 어소시에이트를 지목하는 변호사에게는 거의 관용이 없습니다.
Noland 사건과 상대방의 허위 인용을 신고할 의무
Noland 사건은 의무를 외부로 확장했습니다. 법원은 상대방 대리인에게 지급할 제재금 명령을 내리지 않으면서, 응답자들이 법원에 허위 사실을 알리지 않았고 원인 제시 명령이 내려질 때서야 이를 알게 된 것 같다고 지적했습니다(LawSites). 검증 의무는 제출하는 준비서면뿐만 아니라 수령하는 준비서면에도 적용됩니다. 상대방의 인용문을 확인하고 발견한 것을 법원에 고지하십시오.
'오타'가 두 변호사에게 6개월을 안긴 이유
2026년 2월 제9항소법원은 오렌지카운티 이민 전문 변호사 Mike Sethi와 William Rounds를 법원 출석에서 6개월 정지하고 각 $2,500의 벌금을 부과했습니다. 6개월은 불량 인용문이 표면화된 후에 일어난 일에서 비롯되었습니다. 그들은 부정확한 내용이 생성형 AI에서 비롯됐다는 사실을 공개하지 않고 오타로 묘사했으며, 법원은 그 명령을 소속 법조인 전체에 대한 경고로 작성했습니다(Metropolitan News-Enterprise).
계약서 검토와 증거개시: AI의 가장 강력한 사례
증거개시는 증거가 시사적인 수준을 넘어 결정적인 수준이 되는 지점입니다. 이 글의 다른 모든 작업에는 검증 비용에 대한 단서가 붙어 있습니다. 이 작업에는 기계가 여러분의 로펌이 이미 사용하고 청구하는 방식을 이긴 연구가 있습니다.
문서 검토: 능동 학습 64% 대비 88% 재현율
Redgrave는 45,004개 문서 코퍼스에서 GenAI를 능동 학습과 비교했으며, 기존 기술 지원 검토 방식의 재현율 64%, 누락률 3% 대비 GenAI는 재현율 88%, 누락률 1%를 달성했습니다(Redgrave). 재현율은 찾아낸 것이고, 누락률은 폐기 파일에서 놓친 것입니다. 이 규모의 코퍼스에서 누락률을 3%에서 1%로 줄이면 약 900건의 반응형 문서를 추가로 확보하는 것입니다.
이를 방어 가능성 논거로 활용하십시오. 상대방이 검토 프로토콜에 이의를 제기할 경우, '45,004개 문서 공개 벤치마크에서 더 높은 재현율을 기록한 방법을 사용했습니다'는 건당 요금표보다 훨씬 나은 답변입니다. 비용 절감은 덤으로 따라옵니다.
1차 계약서 분류 대 최종 계약서 수정
계약서 작업을 두 부분으로 나누면 벤치마크 판정은 양쪽 모두 명확합니다. 1차 분류는 추출입니다. 배상 한도를 추출하고, 모든 자동 갱신을 찾고, 200개 벤더 NDA 중 어느 것이 플레이북에서 벗어났는지 표시하는 것입니다. 이는 문서 Q&A와 같은 형태이며, Harvey가 변호사 기준 70.1% 대비 94.8%를 기록한 영역입니다(Vals AI). 위임하십시오.
최종 계약서 수정은 나머지 절반이며, 동일한 벤치마크에서 Harvey 65.0% 대비 변호사가 79.7%를 기록합니다. 계약서 수정은 법적 결과를 동반하는 협상 입장입니다. 인간이 담당해야 합니다.
실제 이커머스 및 의료 계약서 처리
고용량, 저분산 계약서 포트폴리오가 최적의 영역입니다. 수백 개의 유사한 공급업체 조건을 가진 이커머스 사업자나 지불인 계약 및 BAA를 처리하는 의료 그룹은 초안 작성보다 조항 추출과 편차 표시에서 대부분의 가치를 얻습니다. 디렉토리에는 217개의 AI 문서·PDF 도구와 550개의 에이전틱 AI 도구가 있으며, 이 작업에서는 생성 쪽보다 추출 쪽 목록이 더 중요합니다.
전환점에서 기준을 설정하십시오. 문서를 읽고 내용을 보고하는 것은 샘플 검토와 함께 대량으로 실행할 수 있습니다. 다른 사람이 서명할 문서를 작성하는 것은, 발송 전에 담당 변호사의 이름이 붙어야 합니다.
Rule 11 심사를 견디는 검증 워크플로
아래 프로토콜은 습관이 되면 준비서면 한 건당 약 10분이 소요됩니다. 이것은 벤더의 모범 사례 페이지가 아니라 변호사가 제재받은 사례에서 역순으로 구성되었으므로, 모든 단계가 판례 기록의 실패 유형에 대응합니다.
도구의 링크가 아닌 1차 출처에서 모든 인용문 직접 확인
Westlaw, Lexis, CourtListener 또는 법원의 자체 문서함을 열고 판결문을 직접 검색하십시오. AI가 제공한 링크를 클릭하지 말고, 도구가 그럴듯해 보이는 보고서 권호와 페이지 번호를 표시했다고 인용을 수용하지 마십시오. 허위 인용에는 허위 메타데이터가 함께 옵니다. Couvrette v. Wisnovsky 사건에서 허위 자료는 누군가 근거 판례를 직접 확인하기 전까지 5개월에 걸친 세 건의 준비서면에서 살아남았습니다(Greenberg Rothstein).
상대방 대리인의 인용문도 마찬가지입니다. 법원은 이미 상대방의 허위 사실을 신고하지 않은 변호사에게 불이익을 주었으며, 원인 제시 명령이 내려질 때서야 이를 알게 된 것 같다고 지적했습니다(LawSites).
따옴표 확인 후 판시 사항 확인
실제 판례에도 조작된 따옴표가 실릴 수 있습니다. Couvrette 사건에는 15개의 존재하지 않는 판례와 함께 8개의 조작된 따옴표가 포함되었으며(Greenberg Rothstein), 제6항소법원이 Whiting v. City of Athens 사건에서 변호사당 $15,000 벌금을 부과한 것은 누락된 인용뿐 아니라 잘못 표현된 인용도 포함되었습니다(ComplexDiscovery). 판결문에서 따옴표를 텍스트 검색하십시오. 그런 다음 준비서면이 주장하는 내용을 그 판례가 실제로 판시했는지 확인할 수 있도록 주변 문단을 충분히 읽으십시오.
프롬프트, 모델, 인간 검토자 기록
제출 건당 한 줄 기록을 유지하십시오. 날짜, 도구 및 모델 버전, 프롬프트, AI가 생성한 인용문, 각 인용문을 검증한 사람과 시간. 텍사스 윤리 의견 705는 생성형 AI 결과물의 역량과 감독 의무를 변호사에게 명확히 지웁니다(Texas Center for Legal Ethics). 동시대 기록은 그 의무를 주장에서 원인 제시 심리의 증거로 전환시킵니다.
서류 제출 후 허위 사실 발견 시 공개 스크립트
누가 묻기 전에 24시간 이내에 서면으로 조치하십시오. 네 가지를 명시한 수정 통보를 제출하십시오. 잘못된 구체적인 인용문, 명칭이 있는 AI 도구에서 비롯됐다는 사실, 검증 없이 제출했다는 사실, 철회 또는 수정 내용. 본인을 책임자로 명시하십시오. 어소시에이트, 계약 연구원 또는 소프트웨어를 탓하지 마십시오.
이 스크립트는 제재 데이터가 그것을 가리키기 때문에 존재합니다. 제9항소법원은 두 변호사를 6개월 정지하고 각 $2,500의 벌금을 부과했습니다. 주된 이유는 AI 오류를 출처를 공개하지 않고 오타로 재구성했기 때문입니다(Metropolitan News-Enterprise). 일찍 인정하는 것이 가장 저렴한 서류 제출입니다.
특권과 기밀: 결정을 내리는 네 가지 벤더 조항
브랜드는 특권을 보호하지 않습니다. 계약 조항이 보호합니다. 2026년 전자증거개시 판결은 학습, 보존, 제3자 접근에 관한 벤더 계약 내용을 기준으로 삼기 시작했으므로(National Law Review), 기능 목록을 읽기 전에 이 네 가지 조항을 읽으십시오. 디렉토리의 모든 법률 AI 벤더는 서면으로 답변할 수 있으며, 답변하지 않으려는 벤더는 이미 무언가를 말하고 있는 것입니다.
비학습 약정과 '학습하지 않는다'가 충분하지 않은 이유
범위를 명확히 하십시오. '귀하의 데이터로 학습하지 않습니다'는 종종 기반 모델만 적용되며, 남용 모니터링 로그, 인간 검토 큐, 검색 레이어의 파인튜닝은 포함하지 않습니다. 모델 가중치만이 아니라 모든 하류 사용을 명시하는 조항을 요구하십시오.
삭제 권리 및 보존 기간
요청 즉시 삭제, 일 단위로 명시된 최대 보존 기간, 그리고 백업과 파생 임베딩까지 포함하는 삭제를 원하십시오. 30일 신뢰·안전 보존은 일반적이며 대개 괜찮습니다. 무기한 보존은 다른 사람의 서버에 앉아 있는 증거개시 대상입니다.
제로 데이터 보존과 적용 범위
ZDR은 가장 강력한 조항이지만 동시에 가장 많이 남용되는 조항이기도 합니다. 일반적으로 API 호출에 적용되며, 채팅 인터페이스, 문서 작업공간, 또는 벤더의 자체 프롬프트 로깅은 포함하지 않습니다. 어떤 제품 표면이 적용 대상인지 서면으로 확인하십시오. 팀이 ZDR 범위 밖의 웹 UI에 증언록을 붙여넣는다면, 비용을 지불한 조항은 아무 효과도 없는 것입니다.
하위 처리자, 관할권, 아무도 읽지 않는 증거개시 노출
하위 처리자 목록이 바로 의뢰인의 기밀이 건물을 떠나는 곳입니다. 어떤 모델 제공업체, 호스팅 지역, 지원 벤더가 프롬프트에 접근하는지, 그리고 목록이 통보 없이 변경 가능한지 확인하십시오. 캘리포니아 주 변호사협회는 의무를 명확히 당신에게 부과합니다. 정보를 입력하기 전에 도구가 의뢰인 정보를 어떻게 처리하는지 이해해야 하며, 동의가 검토하지 않은 벤더 계약을 치유하지 않습니다(State Bar of California). 영업 이메일이 아닌 주문 양식에서 답변을 받으십시오.
기능 목록이 아닌 위험 등급별로 스택 선택
단 하나의 데모를 보기 전에 고려 중인 모든 작업을 세 가지 버킷으로 분류하십시오. 벤더가 아니라 버킷이 무엇을 구매하고 검증 예산을 얼마나 책정할지를 결정합니다.
1등급: 위임 및 샘플 확인
문서 Q&A, 요약, 증언록 분석, 1차 특권·반응성 검토. 이 영역의 벤치마크 격차는 충분히 넓어서, 유능한 도구와 10% 샘플 확인이 혼자 일하는 어소시에이트를 능가합니다. 정확도 주장이 아닌 계약 조항(비학습, 삭제 권리, 제로 데이터 보존, 제3자 하위 처리자 없음)을 기준으로 구매하십시오. 이 등급에서 정확도 문제는 해결되었고 특권 문제는 그렇지 않습니다.
2등급: AI가 초안 작성, 인간이 모든 인용 책임
법률 조사, 메모 초안 작성, 인용문이 포함된 모든 것. 전용 조사 도구가 여기서 가격 가치를 발휘하며, 그럼에도 서류 제출 전에 모든 근거를 직접 확인하고 읽어야 합니다. 검증 프로토콜이 실제로 구매하는 제품입니다.
3등급: 어떤 정확도에서도 하지 말 것
협상된 플레이북에 대한 계약서 수정, 새로운 쟁점 분석, 처음부터 끝까지 읽은 담당 인간 없이 제출하는 모든 것. 변호사는 여전히 계약서 수정에서 도구를 이기므로, AI가 더 나쁘게 하도록 비용을 지불하는 것은 이상한 거래입니다.
긴급성을 설정하는 숫자가 하나 있습니다. 환각 추적기의 사례 추가는 2026년 5월 22일~6월 9일 사이 하루 약 8건으로, 4월의 하루 5~6건에서 증가했습니다(haqq.ai). 곡선은 여전히 가팔라지고 있으며, 이는 여러분이 기준으로 삼는 제재 기록이 이미 구식이 되었음을 의미합니다.
디렉토리가 보여주는 법률 AI 시장
전용 세그먼트는 소음이 시사하는 것보다 훨씬 얇습니다. 디렉토리의 13,174개 AI 앱 중 법률 서비스 목록은 124개에 불과합니다. 1% 미만입니다. 여러분의 실무에 홍보되는 대부분의 도구는 법률 랜딩 페이지를 가진 범용 제품이며, 위의 네 가지 벤더 조항이 실패하는 경향이 있는 정확히 그 집단입니다.
자주 묻는 질문
변호사가 2026년에 AI를 안전하게 사용할 수 있습니까?
증거가 뒷받침하는 작업에서, 문서화할 수 있는 검증 단계와 함께라면 가능합니다. 독립 벤치마킹에 따르면 AI는 문서 Q&A에서 변호사 기준을 앞서고(Harvey 94.8% 대 70.1%), 계약서 수정에서는 뒤처집니다(65.0% 대 79.7%). 따라서 안전한 사용은 도구별이 아닌 작업별로 결정됩니다(Vals Legal AI Report). 제재 기록도 이를 뒷받침합니다. Damien Charlotin의 데이터베이스를 금전적·직업적 처벌로 필터링하면, 변호사들이 AI 도구로 실수를 했다는 이유로 처벌받는 경우는 드물며, 적발된 후 인정하기를 거부하거나 더 강하게 밀어붙이거나 다른 사람에게 책임을 돌리기 때문에 처벌받습니다(Charlotin FAQ). 법원에 제출되는 모든 것을 인용 확인하고, 무언가 빠져나가는 날을 위한 공개 프로토콜을 준비해두십시오.
변호사가 실제로 AI 사용으로 제재를 받았습니까? 비용은 얼마였습니까?
그렇습니다. 수치는 빠르게 올랐습니다. 알려진 가장 큰 미국 제재는 Couvrette v. Wisnovsky (D. Or.) 사건의 $110,204.38로, pro hac vice 대리인 Stephen Brigandi에게 $95,998.72, 현지 대리인 Tim Murphy에게 $14,205.66이 부과되었습니다. 세 건의 준비서면에 걸쳐 15개의 허위 인용과 8개의 조작된 따옴표가 있었습니다(Greenberg Rothstein). 제6항소법원은 Whiting v. City of Athens 사건에서 두 변호사에게 각 $15,000을 부과했으며, 이는 2026년 1분기에만 최소 $145,000에 달하는 AI 관련 제재의 일부입니다(ComplexDiscovery). 금전이 상한선이 아닙니다. Withers v. City of Aberdeen (N.D. Miss., 2026년 6월 8일)에서 Sharion Aycock 판사는 재판을 취소하고, 두 주임 타지 변호사를 지방법원에서 2년간 정지하며 주 변호사협회에 회부했습니다(JD Journal).
Lexis+ AI, Westlaw 같은 전용 법률 조사 도구도 여전히 환각을 일으킵니까?
그렇습니다. Stanford RegLab과 HAI의 사전 등록 연구에 따르면 Lexis+ AI는 약 17%, Westlaw AI-Assisted Research는 약 33%의 환각률을 보였으며 GPT-4는 43%였고, 정확도는 각각 65%와 42%였습니다(Stanford RegLab). 같은 연구자들은 벤더의 '100% 환각 없는 법적 인용문' 주장이 과장되었음을 발견했습니다. 검색 기반 구성이 오류율을 낮추지만 제거하지는 않으므로, 모든 인용은 서류에 포함되기 전에 직접 확인하고 읽어야 합니다.
의뢰인 문서를 AI 도구에 넣으면 특권이 소멸됩니까?
벤더 계약서에 무엇이 명시되어 있느냐에 달려 있습니다. 도구의 자체 마케팅은 관련이 없습니다. 결정하는 조항은 벤더의 데이터 학습 여부, 삭제 권리 보유 여부, 제로 데이터 보존 배포 여부입니다. 2026년의 일련의 판결은 AI 처리와 전자증거개시의 특권을 충돌 궤도에 올려놓았으며, 법원은 '법률 등급' 라벨이 아닌 데이터 처리 방식을 살펴보고 있습니다(National Law Review, 2026년 5월 12일). 단 하나의 특권 문서를 업로드하기 전에 DPA를 읽으십시오.
이미 제출한 준비서면에서 허위 인용을 발견하면 어떻게 해야 합니까?
즉시 법원에 직접 고지하고, 인용이 AI 도구에서 비롯됐음을 명확히 밝히십시오. Charlotin의 제재 데이터 분석에 따르면, 심각한 처벌은 인정하기를 거부하거나, 더 강하게 밀어붙이거나, 적발 후 직원과 벤더를 탓한 변호사에게 집중되어 있습니다(Charlotin FAQ). 제9항소법원은 2026년 2월 오렌지카운티 이민 전문 변호사 두 명을 6개월 정지하고 각 $2,500의 벌금을 부과했습니다. 주된 이유는 AI 생성 부정확성을 출처를 공개하지 않고 오타로 묘사했기 때문입니다(Metropolitan News-Enterprise). 또한 법원은 상대방의 허위 인용을 신고하지 않은 변호사에게도 불이익을 주기 시작했으므로, 의무는 양방향으로 적용됩니다(LawSites).
AI가 변호사보다 실제로 더 잘하는 법률 작업은 무엇입니까?
문서 Q&A, 요약, 증언록 분석이 큰 격차로 앞섭니다. Vals AI는 문서 Q&A에서 Harvey를 변호사 기준 70.1% 대비 94.8%, 요약에서 CoCounsel을 50.3% 대비 77.2%, 증언록 분석에서 Harvey를 53.7% 대비 77.8%로 측정했습니다(VLAIR). 법률 조사도 이미 역전되었으며, 210개 질문 블라인드 채점에서 Counsel Stack 81%, Alexi 80%가 변호사 기준 71%를 앞섰습니다(LawSites). GenAI 검토는 능동 학습이 64%와 3%를 기록한 45,004개 문서 코퍼스에서 재현율 88%, 누락률 1%를 달성했습니다(Redgrave). 계약서 수정과 EDGAR 조사는 변호사에게 남겨두십시오. 전자에서 79.7% 대 65.0%로, 후자에서 70.1% 대 55.2%로 변호사가 앞섭니다(VLAIR).