# 송신처는 오카야마, 최종 목적지는 미국—일본의 구본집에 “미스터리한 대량 주문”이 몰려들고 있는 이유

> https://bookfactory.kr/board/ai-tech/18823
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-09-27T15:55:57.810Z

---

일본의 닛테레 뉴스 NNN에서 “독자적인 보도”를 통해 한 고서점에서 “미스터리한 대량 주문”이 연이어 발생했다는 사실이 알려졌다. AI 학습과 관련된 의혹이 제기되고 있으며, 미국에 ‘일본 서적 50톤’을 수출한 기록도 발견되었다. 404 미디어의 “우리는 희귀 서적 선박을 추적했다. 그것은 아마존 AI 학습 시설에 도착했다” 기사, The Verge의 “Anthropic이 AI에 대한 주요 공정 이용 승리를 획득했지만, 여전히 책을 훔친 혐의로 문제가 있다” 기사, 그리고 ‘은유’의 “미스터리한 대량 주문” 언급과 관련이 있다. 해당 책은 ‘은유’의 베스트셀러 작품인 ‘謎の大量注文’이다.

NTV 뉴스 보도: 아마존 AI 훈련 시설로 배달된 희귀 서적 선박 추적 결과

브라우저만으로 가능한 프리미엄 AI 이미지 생성

AI 회의록 생성

하루에 100권 판매, 매출이 5배 증가”라는 증언이 일본 각지의 온라인 구본점 주인들로부터 2023년 8월 이후 계속 나오고 있다. 주문의 최종 목적지는 왜 자꾸 오카야마현의 물류센터에 집중되는지, 그리고 그 이후를 추적하면 미국을 대상으로 “일본 서적 50톤”이 수출되었다는 기록에 도달한다. 이번 미디어에서는 이 일본에서 시작된 기묘한 현상이 사실은 태평양 건너편에서 이전에 진행되어 왔던 “책을 찢어 AI에 먹이는” 사업의 최신 형태였다는 것을 검증한다.

이전 이 미디어에서는 소니 뮤직과 워너 챕플이 앤트로픽을 저작권 침해로 소송한 사건(바트츠 대 앤트로픽 소송, 15억 달러의 합의가 전례로서 존재)을 다뤘다. 당시 기사는 “학습 데이터라는 보이지 않는 재고의 가격”이라는 시각이었다. 이번에는 그 재고가 눈에 보이는 “종이책”이라는 물리적인 형태로 일본에서 이송되는 현장의 이야기다.

## 무슨 일이 일어났는지 — 고서점의 비명과 50톤이라는 숫자

일본 뉴스 NNN이 2026년 9월 22일에 보도한 바에 따르면, 8월 이후 일본 전역의 온라인 구본점에서 익명으로 대량 주문이 연이어 발생했으며, 배송지는 일본 옥상현 물류센터에 집중되어 있었다. 미국에 수출된 일본 서적 50톤 이상이라는 기록도 확인되었으며, 이 보도는 해튼 북마크에서 562건의 최대 반향을 기록했다.

시간 순서와 규모를 정리한다.

![画像](https://assets.st-note.com/img/1790497679-HLboAqlyIN60wWC3t1ruTd9m.png?width=1200)

해튼 익명 일기에는 부업으로 아마존을 통해 중고본 판매를 하고 있는 사람의 증언도 게시되어 있다. 2026년 4월부터 9월 사이에 ‘의심스러운’ 대량 주문 패턴이 49건, 금액으로 환산하면 137,392엔분에 달했다. 1건당 평균 2,804엔 상당의 주문이 반복적으로 들어오던 계산이다. 소액의 주문이 누적되어 전국적인 ‘미스터리한 대량 주문’으로 이어진 구조였다.

## 수수께끼”의 정체 – 안트로픽(Anthropic)이 이미 해내고 있던 것

‘오르페우스(Orpheus)’는 복잡한 질문에 대해 놀랍도록 창의적이고 설득력 있는 답변을 제시하며, 때로는 인간의 직관을 능가하는 수준의 결과물을 만들어내기도 합니다.

하지만 ‘오르페우스’의 능력은 단순히 ‘똑똑하다’는 것을 넘어, 기존의 언어 모델들이 해결하지 못했던 근본적인 문제들을 해결하고 있다는 점이 주목받고 있습니다. 특히, ‘오르페우스’는 질문의 의도를 정확하게 파악하고, 맥락에 맞는 적절한 답변을 생성하는 능력이 뛰어나다는 평가를 받고 있습니다.

이러한 ‘오르페우스’의 능력은 안트로픽이 지난 몇 년간 비밀리에 진행해온 연구의 결과물입니다. 안트로픽은 ‘오르페우스’ 개발을 위해 방대한 양의 텍스트 데이터를 학습시키고, 다양한 훈련 기법을 적용하여 모델의 성능을 극대화했습니다. 또한, ‘오르페우스’의 답변 능력을 평가하고 개선하기 위해, 인간 평가자들의 피드백을 적극적으로 활용했습니다.

안트로픽은 ‘오르페우스’를 통해 언어 모델의 잠재력을 한 단계 끌어올렸으며, 앞으로 인공지능 기술 발전에 크게 기여할 것으로 기대됩니다. 특히, ‘오르페우스’는 교육, 연구, 창작 등 다양한 분야에서 활용될 가능성이 높습니다.

이 “미스터리 대량 주문”은 사실 미스터리나 그런 것이 아니다. Anthropic은 2024년 2월부터 Google의 전 서적 스캔 책임자를 고용하여 수백만 권의 중고 서적을 구매하고 스캔한다는 전략을 이미 실행해왔다는 사실이 2025년 6월의 소송 자료에서 밝혀졌다.

The Verge가 2025년 6월 24일에 보도한 내용에 따르면, 앤트로픽(Anthropic)은 물리적으로 구매한 서적의 스캔에 대해 법원으로부터 ‘공정 이용(フェアユース)’ 판단을 이끌어냈습니다. 반면, Books3나 LibGen과 같은 불법 해적 사이트에서 불법적으로 다운로드한 700만 권 이상의 전자책에 대해서는 상황이 달라, 2025년 9월 6일, 50만 권에 대해 15억 달러의 합의금을 지급하여 합의했습니다. 단순 계산하면 1권당 약 3,000달러의 배상액이 됩니다. 당초 예상되었던 최대 벌금 1권당 15만 달러를 고려하면, 이 합의는 앤트로픽에게는 오히려 ‘할인 가격’에 해당한다고 볼 수도 있습니다. 해적판으로 책을 무료로 읽었다고 생각했지만, 결국 1권당 3,000달러의 도서관 이용료를 지불하게 된 꼴이 되었으며, 세계에서 가장 비싼 독서 감상문 콘테스트와 같은 상황입니다.

![画像](https://assets.st-note.com/img/1790497694-p14sLZYWk69uyNftv03P5zFG.png?width=1200)

2026년 8월 17일, 404 미디어의 조사 보도가 이 그림에 새로운 한 수 첨 넣었다. 기자가 추적 장치를 희귀본에 몰래 심어 발송한 결과, 최종적으로 도달한 곳은 네바스주 라스베가스에 있는 아마존 창고 시설(VGT3)이었다. 이 시설에서는 “제본을 잘라내고 더 빠르게 스캔하기 위해” 책이 물리적으로 파괴되는 처리가 이루어지고 있었다. Anthropic뿐만 아니라 아마존도 유사한 방법을 채택하고 있었을 가능성을 시사하는 내용이었다. 책의 뒷표지를 잘라낸 채 1페이지씩 스캔하는 모습은 독자에게는 고문과 같은 광경일 것이다.

## 주의사항 및 제약 조건 — “AI 학습 목적”은 현재 상황 증거로 기록됨

이번 일본의 고서 대량 주문에 대해 주문 주체 기업명이나 구체적인 용도를 특정하는 정보는 확인된 범위 내에서는 발견되지 않았습니다. “AI 학습 데이터 수집이 목적이 아닌가”라는 견해는 업계 관계자의 추측과 과거 해외 사례(Anthropic, Amazon)와의 유사성으로 인한 상황 증거의 영역을 넘어서는 점을 명시해야 합니다.

솔직하게 말씀드려야 할 부분이 몇 가지 있습니다. 첫째, 오카야마 현의 물류 센터에 책을 보내고 있다는 회사가 구체적으로 어떤 회사인지, 니터(Nippon TV)의 보도 범위에서는 특정되지 않았습니다. 둘째, Anthropic와 아마존의 책 스캔 전략은 미국 내 사례이며, 이번 일본발의 대량 주문과 동일 기업에 의한 동일한 접근 방식이라는 정보는 확인된 바 없습니다. 셋째, 하테나 북마크의 댓글欄에서는 “폐기되는 것보다 학습에 사용되는 것이 더 의미가 있다”는 긍정적인 의견과 “일본 기업이 AI 학습을 주저하는 동안 미국 기업이 일본의 지적 자산을 빨아들이어 강력한 AI를 만들고, 그것을 일본에 되팔아 판매하는 부당함”을 지적하는 목소리가 공존하며 여론 또한 뚜렷하게 일치하지 않습니다.

## 검토 – “본”이라는 마지막 유사 학습 데이터

이전 이 미디어에서 소니-워너 대 앤트로픽 소송을 다룰 때 “학습 데이터라는 보이지 않는 재고의 가격”이라는 표현을 사용했다. 이번 사건은 그 재고가 사실상 완전히 “보이지 않는” 것이 아니라, 물류센터 트럭의 짐칸에 실려 눈으로 확인되는 형태로 국경을 넘어 있다는 사실을 드러낸다.

디지털 데이터가 이미 고갈되고 있다는 이야기는 이전부터 흘러다니던 것이었지만, 그 다음의 해결책이 “종이 책을 물리적으로 휩쓸어 스캔한다”는, 어느 면에서는 가장 원시적인 해결책이었던 것은 아이러니하다. 최첨단 AI를 훈련하기 위한 최신 한 수가, 책의 등표를 가위로 잘라내는 100년 전부터 변함없는 제본 방식의 역전이었다는 점은 어떨 수 없다. 국립국회도서관과 같은 공적 기관이国産의 학습 데이터 기반을 주도해야 한다는 의견이 댓글欄에 나타난 것도 자연스러운 반응이었다. 일본어의 고서라는 문화 자산이, 누가 관리하에 어떻게 사용될 것인가라는 질문은 저작권이 만료되었는지 여부와는 또 다른, 훨씬 더 깊은 문제로 남아 계속될 것이다.

## 독자분들이 이번 주에 확인해야 할 사항들

저사 및 제가 취급하는 고서 및 도서 재고에 대해, 본인도 알지 못하는 대량 주문 패턴이 있는지 확인합니다.

Anthropic와 아마존의 도서 스캔 전략(구매는 합법적이며, 불법 복제는 이미 소송으로 마무리됨)이라는 선례를 바탕으로, 향후 유사한 소송 및 보도가 국내에서 나올지 주시할 것이다.

3. 일본어 학습 데이터 정비 방안에 대한 국내 주도 방안 논의(국립국회도서관 역할 등) 관련 후속 소식 추적

팔로우를 설정해 두시면 다음 업데이트를 즉시 받아보실 수 있습니다.

본 기획은 독자 여러분께 일본 문학 작품을 더욱 깊이 있고 다양한 관점에서 경험하실 수 있도록 하는 것을 목표로 합니다. 특히, 지금까지 잘 알려지지 않았던 작가나 작품, 또는 현대 문학에서도 충분히 심층적으로 다루어지지 않았던 주제에 초점을 맞추어 새로운 발견과 감동을 선사하고자 합니다.

구체적으로 각 작가의 작품을 그 작가가 살았던 시대 배경과 사상, 그리고 작품에 담긴 메시지를 깊이 이해하는 데 중점을 둡니다. 또한 작품의 주제를 현대 사회의 문제나 인간의 보편적인 감정 등 다양한 관점에서 재해석하여 독자 여러분에게 새로운 깨달음과 공감을 불러일으킬 수 있는 구성으로 만들고자 합니다.

더불어 독자 여러분과의 교류를 심화하기 위한 기획도 포함하고 있습니다. 작품에 대한 토론 이벤트, 작가 인터뷰, 그리고 독자들끼리 작품에 대해 이야기 나누는 온라인 커뮤니티 등을 기획하여 독자 여러분이 작품을 더욱 깊이 이해하고 즐길 수 있도록 지원 체계를 마련할 것입니다.

이번 기획을 통해 일본 문학의 새로운 가능성을 열고 독자 여러분께 풍요로운 독서 경험을 제공할 수 있도록 모든 스태프가 최선을 다할 것입니다.

- “대담한 절도 캠페인” – 소니 뮤직과 워너가 직접적으로 고소한 것은 인공지능이 아닌 2명의 인간이었다.

**출처:** [note 원문](https://note.com/jolly_crocus1878/n/n77df8d255b62)

*번역: Gemma 3(.44) 초벌 + 교정 19청크*

[원문 보기](https://note.com/jolly_crocus1878/n/n77df8d255b62) | 출처: note.com