

AI 기업의 책 구매·파기, 왜 불공정 논란일까?
여러분은 헌책방에서 오래된 책을 우연히 발견했을 때 어떤 기분이 드시나요? 저는 책장을 넘길 때마다 지은이의 시간과 고민이 고스란히 묻어 있다는 생각에 마음이 무거워지곤 합니다. 그런데 최근 AI 기업들이 그 책들을 대량으로 사들인 뒤, 디지털로 스캔하고는 원본을 파기하는 일이 잇따르면서 창작자와 출판계가 강하게 반발하고 있습니다. 도대체 왜 AI 기업은 책을 사고 버리는 것일까요?
단순한 소유권 문제를 넘어 저작권과 창작 생태계의 공정성까지 이어지는 이 논란을 실제 사례 중심으로 살펴보고, 우리가 반드시 알아야 할 포인트를 정리해 드립니다.
AI 기업, 왜 책을 데이터로 탐낼까?
AI 언어모델이 사람처럼 자연스러운 글을 쓰려면 방대한 양질의 텍스트가 필요합니다. 인터넷 게시글이나 댓글보다 문장 구조가 정제되고 문맥 흐름이 자연스러운 책은 학습 데이터로 최상급입니다. 실제로 오픈AI, 메타, 구글 등 글로벌 빅테크는 수년간 전자책과 스캔본을 대규모로 수집해 왔습니다. 그중에서도 ‘Books3’라는 데이터셋에는 무려 19만 권 이상의 도서가 포함됐는데, 상당수가 저작권자의 허락 없이 수집된 것으로 알려져 큰 논란이 됐습니다.
책은 문학성, 전문성, 서사 구조를 동시에 담고 있어 AI 학습 효율이 높습니다. 하지만 ‘학습 효율이 높다’는 이유만으로 저작권자의 권리를 무시할 수는 없습니다. 바로 이 지점에서 AI 기업의 책 구매·파기 행태가 불공정 논란의 중심에 서게 된 것입니다.
책 구매 후 파기, 어디서부터 불공정일까?
소유권과 저작권은 다르다
책을 샀다는 것은 종이책 한 부의 소유권을 얻었을 뿐, 그 안에 담긴 저작물의 복제·가공·전송 권리까지 산 것이 아닙니다. AI 기업이 책을 스캔해 학습 데이터로 쓰는 것은 복제와 2차적 저작물 작성에 해당할 수 있기 때문에, 별도의 이용 허락이 없으면 저작권법 위반 소지가 큽니다. ‘샀으니 마음대로 해도 된다’는 생각은 일반인이 가장 흔히 빠지는 실수이자, AI 기업도 반드시 피해야 할 함정입니다.
원본 파기가 주는 불신
일부 AI 기업과 데이터 가공 업체는 저작권 추적을 어렵게 하거나 ‘공정 이용’ 주장을 뒷받침하기 위해 원본 증거를 없애려 한다는 의심을 받고 있습니다. 실제로 AI 학습용 데이터 구축 과정에서 책을 대량 구매하고 스캔한 뒤 원본을 폐기하는 방식이 언론 보도로 알려지면서, 출판계는 “증거 인멸이 아니냐”며 강하게 비판했습니다. 투명하게 출처를 공개하고 이용 계약을 맺는 것이 법적 리스크를 줄이는 길이지만, 원본 파기는 오히려 기업 신뢰를 떨어뜨립니다.
창작 생태계의 지속 가능성
AI가 책 내용을 학습해 비슷한 문체나 줄거리를 생성하면, 독자는 새 책을 살 이유를 잃을 수 있습니다. 저자와 출판사가 정당한 보상을 받지 못하면 좋은 원고가 나오기 어렵고, 결과적으로 AI가 학습할 양질의 데이터도 함께 고갈됩니다. 이런 점에서 AI 기업의 책 구매·파기는 단순한 법적 문제를 넘어 창작 생태계 전체의 공정성 문제로 번지고 있습니다.
실제 사례로 보는 분쟁의 현주소
미국에서는 작가 길드(Authors Guild)가 오픈AI와 메타 등을 상대로 ‘저작물 무단 학습’ 소송을 제기했고, 조지 R.R. 마틴, 사라 실버맨 등 유명 작가들도 동참했습니다. 이들은 AI 기업이 책을 허락 없이 학습 데이터에 포함해 상업적으로 이용했다고 주장합니다. 현재 미국 법원에서는 AI 학습에 대한 공정 이용 항변이 어디까지 인정될지가 핵심 쟁점으로 다뤄지고 있습니다.
유럽연합은 AI법을 통해 학습 데이터 출처 공개 의무를 강화했고, 일본은 일부 비영리 목적의 학습을 허용하되 저작권자의 이익을 부당하게 침해하면 제한하는 절충안을 택했습니다. 국내에서도 출판계와 작가 단체가 AI 학습 데이터 공개와 사전 허락 제도 도입을 요구하고 있습니다. 이처럼 세계 각국이 각기 다른 속도로 제도를 정비하는 중입니다.
독자가 꼭 알아야 할 인사이트와 실수 방지 포인트
출판 계약 시 AI 학습 이용 여부를 명확히 적어 두세요. ‘2차적 저작물 작성권’과 ‘기계 학습 이용권’을 분리해 계약하는 것이 안전합니다. 나중에 AI 기업이 내 책을 무단으로 학습에 썼다면, 저작권 등록 증명서와 계약서가 중요한 증거가 됩니다.
도서 구매 계약서에 학습용 복제·가공 권리를 포함하지 않으면 절대 안 됩니다. 원본 파기는 데이터 출처 증명을 어렵게 만들어 오히려 법적 리스크를 키웁니다. 데이터 수집·가공 이력을 투명하게 남기는 것이 장기적으로 유리합니다.
일반 독자라면, AI가 생성한 문장이 특정 책의 문체와 지나치게 유사하다면 원본 저작권 침해 여부를 의심해 볼 필요가 있습니다. 단순히 “AI가 만든 글이니까 괜찮겠지”라고 넘기기보다, 원작자에게 정당한 보상이 돌아가는지 관심을 갖는 것이 건강한 창작 생태계를 지키는 첫걸음입니다.
책 구매·파기 논란, 우리가 놓치지 말아야 할 것
AI 기술의 발전 속도는 빠르지만, 그 기반이 되는 책과 창작자의 권리는 더디게 보호받고 있습니다. ‘책을 샀다’는 사실과 ‘학습에 쓸 권리’는 엄연히 다르며, 투명한 출처 공개와 공정한 보상이 빠지면 창작 생태계는 무너질 수 있습니다. 지금까지 살펴본 사례처럼 이미 세계 곳곳에서 저작권 분쟁이 현실화되고 있고, 국내에서도 제도 정비를 요구하는 목소리가 커지고 있습니다.
저는 개인적으로 AI 기술의 발전과 책의 가치가 반드시 대립할 필요는 없다고 생각합니다. 오히려 저작권자와 AI 기업이 상생할 수 있는 라이선스 모델이 하루빨리 자리 잡기를 바랍니다. 책을 사랑하는 한 사람으로서, 책이 AI의 먹잇감이 아니라 서로를 살리는 지식 생태계의 동반자가 되었으면 합니다.
여러분은 AI가 책을 학습하는 것에 대해 어떻게 생각하시나요? “학습은 허용해야 한다” 또는 “사전 허락이 필수다” 어느 쪽에 더 공감하시나요? 댓글로 여러분의 의견을 남겨 주시면 큰 도움이 됩니다.
섀도 AI 기업 리스크, 무심코 쓴 챗GPT 한 번에 회사 기밀 털리는 이유
📌 섀도 AI 기업 리스크,무심코 쓴 챗GPT 한 번에 회사 기밀 털리는 이유“퇴근 전 10분, ChatGPT한테 계약서 초안 좀 다듬어달라고 했을 뿐인데….”평범한 직장인의 하루는 이렇게 시작됐습니다.
jandje.com
“바람의나라 개발자도 뛰어든 1인 개발, 그게 왜 매력적인 선택이 되었을까?”
“바람의나라 개발자도 뛰어든 1인 개발, 그게 왜 매력적인 선택이 되었을까?”직장인이라면 누구나 한 번쯤 상상해 보지 않으셨나요? ‘내 이름을 건 작은 서비스 하나쯤 만들면 어떨까’, 혹
jandje.com
본격 시행되는 AI 기본법, 우리의 일상은 어떻게 바뀔까?
111[요약]1. 대한민국은 2026년 1월 22일부터 **세계 최초로 본격적인 AI 기본법을 시행**하며, 일상 전반에 ‘AI 표시’와 ‘고영향 AI 관리’가 강화됩니다. 2. 국민이 가장 먼저 체감하는 변화는 **AI
jandje.com
로봇 스타트업 몸값 상승 신호 포착하는 현장 지표
“작년에 10억이던 회사가 150억?”반년 새 몸값 15배 급등…로봇·AI 스타트업 후끈혹시 이런 경험 있으신가요? 몇 달 전 지인이 “로봇 스타트업에 소액 투자했다”고 말했을 때, 속으로 ‘또 뜨
jandje.com
인공지능 도입한 미국 대기업들이 후회하는 이유
인공지능 도입한 미국 대기업들이 후회하는 이유요즘 뉴스를 보면, “AI를 도입해 혁신한다”는 이야기가 하루가 멀다 하고 등장합니다. 미국의 대형 IT 기업, 금융사, 유통 기업들은 앞다퉈 인
jandje.com


'이슈 및 시사동향' 카테고리의 다른 글
| 은행권 집단대출 금리 경쟁과 내 대출 조건 비교 (0) | 2026.08.22 |
|---|---|
| 청년 고용 한파에 대한 AI의 영향과 청년들이 준비해야 할 전략 (1) | 2026.08.21 |
| 디즈니파크 첨단 AI 로봇 체험 비하인드 스토리와 관람 꿀팁 (0) | 2026.08.20 |
| AI 상처 분석 3D 프린팅 맞춤 패치 원리 (0) | 2026.08.18 |
| AI와 로봇 시대를 대비하는 50대 노후 설계법 (0) | 2026.08.16 |