アマゾンのニュースがあちらでもこちらでも。
AIによるコンテンツの収集と学習
生成AIの知財保護基本原則案を策定/生成AI学習データの公開や権利者への開示など要求、海外企業にも適用・罰則見送り…政府が知財保護案(読売新聞)

政府は生成AI事業者向けに知的財産権保護の基本原則案を策定する。AIの学習データ収集方法の公開や、特定の創作物が含まれるかの開示を求めるが、法的拘束力はない。海外企業にも適用し、技術革新と権利保護の両立を目指す。基本原則では、学習データの概要公開、権利者への開示、AI利用者への開示を通じて透明性を確保する。罰則は見送られ、企業には説明責任が求められる。
生成AIの学習データ開示要求、政府が基本原則案を提示/生成AIの学習データ、事業者に開示要求 政府が知財保護で原則案 – 日本経済新聞(日本経済新聞)
内閣府は18日、生成AI事業者に対し知的財産権の保護と透明性確保を求める基本原則案を示した。AIの学習方法やデータの種類を公表し、権利者からの照会に応じることが求められる。基本原則は法的強制力はないが、2025年に成立したAI法の趣旨を反映している。対象は国内外の生成AI開発事業者で、実施状況の公表が期待される。事業者からは業務負担の懸念も示されている。
生成AIの学習データ透明性ルール案、罰則なし/AIの学習データ、開示せずとも罰則なし 政府が事業者向けルール案:朝日新聞(朝日新聞)

内閣府の有識者会議は、生成AI事業者に対する学習データの透明性確保を求める「プリンシプル・コード」の案を了承した。事業者は原則に従うかどうかを選べ、従う場合はデータの種類を公表するが、法律ではないため罰則はない。海外ではEUやカリフォルニア州が法的義務を課している。日本政府は技術開発への影響を考慮し、罰則のないソフトローを採用した。
ニュースを読む限りにおいては遠くの話のように感じてしまうのは私だけでしょうか。自分たちも関わっている話のように全然思えない。。
イギリスとアイルランドの古本屋、AI企業による大量注文を疑う/Secondhand booksellers in UK and Ireland suspect AI firms behind ‘strange’ bulk orders(the Guardian)
イギリスとアイルランドの古本屋が、謎の買い手からの大量注文を受けており、AI企業がデータ収集のために書籍を取得しているのではないかと疑っている。注文はアメリカ、カナダ、ヨーロッパなどからもあり、テーマに沿ったものではなく、様々なジャンルの本が含まれている。特に、AI企業が書籍の内容をスキャンするために購入しているとの憶測が広がっている。Anthropic社が数千万ドルをかけて書籍を取得していることが報じられ、古本屋はこの異常な注文の増加に困惑している。
この話題も3週連続になりますね。専門的な古書にフォーカスしているのもあれば今回は雑多なジャンルとのことで。共通するのは「中古本」ということで。コストダウンなのかな、しっかりしてるんだなそういうとこ、と思っていましたが絶版本なのですね多分ね。
ここからamazonのトレーニング用書籍購入と断裁とスキャン。内容はほぼ同じですが、数でている、という情報ということで。
アマゾンが希少本をAIトレーニング用に購入・破壊/We Tracked a Shipment of Rare Books. It Ended at an Amazon AI Training Facility(404 Media)

404 Mediaの調査によると、アマゾンは大量の書籍を購入し、AIトレーニングデータのためにスキャンし、その過程で書籍を破壊していることが明らかになった。希少本に追跡装置を取り付け、最終的にネバダ州ラスベガスのアマゾン倉庫に到着する様子を追跡した。そこで働く従業員は、印刷された書籍を受け取り、バインディングを切り落として迅速にスキャンする作業を行っており、印刷物はその過程で破壊される。
アマゾンが希少本を大量購入し破壊してAIを訓練/Report: Amazon Is Buying Rare Books in Bulk and Destroying Them to Train AI — A Hidden AirTag Proved It(Entrepreneur)

希少本の書店が、AI企業が希少本を購入し、モデルの訓練に使った後に破壊しているのではないかと疑い、AirTagを使って追跡したところ、アマゾンのラスベガスの倉庫VGT3に辿り着いた。そこで作業員は本の背表紙を切り落とし、ページをスキャンして元の本を破壊している。アマゾンはAI訓練に使用していることを確認していないが、同社は競争力のあるAIモデルを構築しており、独自の訓練データが必要とされている。希少本には歴史的価値があるものも多いが、AI企業はその価値を重視していないとされる。
アマゾンがAI訓練のために希少本をスキャン・破棄/Amazon is Scanning and Destroying Rare Books to Train AI – Publishers Lunch(Publishers Lunch)
2026年8月17日、404 Mediaの調査によると、アマゾンの倉庫に希少本の出荷があり、AI訓練のためにスキャンされていることが明らかになった。匿名の書店主と協力し、1,000冊の本のうち1冊にApple AirTagを仕込んだところ、ラスベガスのアマゾン倉庫LAS8に到着した。従業員は「私たちの仕事は本をスキャンすることだけ」と語っているという。
Amazonが希少本をAIトレーニング用に大量購入か/米Amazonが希少な紙の本をAIトレーニングのために大量購入中? 海外メディアの追跡調査で発覚【やじうまWatch】(INTERNET Watch)

AI企業による紙の本の大量スキャンと廃棄が問題視される中、約千冊の希少本がAmazonの極秘施設に運ばれたことが海外メディア「404 Media」の調査で明らかになった。書店員の協力で輸送を追跡した結果、ラスベガスの倉庫でスキャン後に廃棄されることが確認された。Amazonは本の購入目的についてはコメントしたが、具体的な内容には回答しなかった。
アマゾンが希少本を廃棄しAIを訓練している疑惑/Hidden Airtag reveals Amazon is trashing rare books to train AI(Ars Technica)

アマゾンがAIモデルの訓練のために希少本を大量に購入し、スキャン後に廃棄しているとの報告が出た。404 Mediaの調査によると、希少本に隠されたエアタグがアマゾンのAI訓練施設に追跡され、そこで本が破壊されている様子が確認された。アマゾンはこの件について具体的なコメントを避けているが、AIモデルの競争力を維持するために独自の訓練データが必要とされている。書籍愛好家たちは、この行為に対して倫理的な懸念を示している。
アマゾン、希少本をAIモデルの訓練のために破壊/Amazon, which started off selling books, is destroying rare texts to train AI | TechCrunch(TechCrunch)

アマゾンが希少本を大量に購入し、その背表紙を切り落としてスキャンし、AIの訓練に利用していると404 Mediaが報じています。アマゾンは、商業チャネルを通じて本を購入し、顧客が利用する製品やサービスを改善するためだと述べています。特に絶版やインターネット上で見つけにくい希少本は、貴重な訓練データの新たな供給源となります。LLMがAI生成テキストを訓練に使用すると「モデル崩壊」のリスクがあるため、2022年以前に出版されたテキストは特に価値があります。
アンソロピックの訴訟の件は、やはり各紙が話題にしましたけれども、今回に関してはトレーサビリティで明るみに出た事実ということで、スクープというか、そのようなインパクトがあったのでしょうね。ただ、話としては新しいものではなく、「やっぱりね」といったところなんだろうなあ。そうなのかな?
で、反応は?という話ですが。
まとめてもらいました。
ネット上では、「AI学習のために本そのものを破壊する」という行為への反発が強い一方、少し違った見方も出ています。RedditやHacker Newsでは、古書店や図書館でも流通しない本の廃棄は珍しくなく、「rare books」という表現から想像するほど貴重な本なのか、という疑問も。一方で、未デジタル化の本をせっかくスキャンするのであれば、AmazonだけのAI学習資産として囲い込むのではなく、文化的なアーカイブとして残せないのか、という指摘はなかなか重いものがあります。
個人のコメントですけどね。とのことです。
出版に関わるAIサービス・提携ビジネス
AI企業が編集者を高待遇で募集する理由/なぜAI企業がこぞって編集者を募集しはじめたのか|最所あさみ(note(ノート))

Anthropicが著名雑誌の編集者を高給で雇おうとしており、年収は265,000〜295,000ドルに達する。これは一般的な編集者の年収を大きく上回る。AI企業が質の高い書き手を高待遇で採用する流れが生まれており、NotionもThe New Yorkerのライターを採用した。AIによるコンテンツ生成が進む中、編集者の役割が重要視され、アテンションエコノミーからアタッチメント(愛情)を生み出す方向にシフトしている。
購入して有料部分も読みました。高額収入というところはパンチがありますけれども、本当に伝えたいメッセージは、しっかりと人が書くというのをAI事業者本人たちが認識しているというのがポイントかなと思います。コテンパンにスキャンされてボロボロになっているニュースが続いたところで、ちょっと救いになるような話でもあると思いたいです。まわりくどいな。
AI白書2026の発売とデジタル・サブスク開始/企業のAI・DX推進を支える『AI白書2026』発売、年間を通じて最新動向を届けるデジタル・サブスクも同日開始(プレスリリース・ニュースリリース配信シェアNo.1|PR TIMES)

株式会社角川アスキー総合研究所は、AIの技術や市場、法制度、企業活用をまとめた書籍『AI白書2026』を2026年8月20日に発売します。同日より、最新情報を提供する「AI白書 デジタル・サブスク」も開始。デジタル・サブスクでは、追加レポートやオンラインセミナーなどを通じて、AIの最新動向を年間を通じて提供し、企業の意思決定を支援します。
すいません、もうお腹がいっぱいです。。
AI生成の電子書籍が市場を圧迫、アンスロピックが作家と和解/アンソロピックは15億ドルで作家たちと和解したが、AI生成の電子書籍は急速に市場を圧迫し続けている | Business Insider Japan(Business Insider Japan)

アンスロピックが中古本をスキャンし、大規模言語モデルのトレーニングに使用したことが米国著作権法において問題視されている。ニューヨーク州立大学の研究によると、アマゾンで販売される電子書籍の約20%がAI生成のテキストを含み、これが市場を圧迫している。AI生成コンテンツの増加により、人間の著者は競争に直面し、収益が減少している。アンスロピックは作家グループとの和解金15億ドルを承認された。
ああ、上のまとめが支離滅裂だと思ったらペイ壁か。どうつながるんだろう。大学時代に真面目な人の授業ノートを借りて試験対策して、さらに友人にもコピーを売って、みたいなねで結局真面目な人のパフォーマンスが一番悪くなっちゃうってさ。勉強とは、って話は置いといてね。
学術出版社がAI利用のためのガイドラインとスクリーニングツールを開発/Academic Publishers Develop Guidelines, Screening Tools for AI Use – Publishers Lunch(Publishers Lunch)
学術出版界はAIによる問題に直面しており、著者向けのガイドラインやスクリーニングツールの開発が進められている。学術誌への投稿が急増しており、多くの論文にはAIの兆候が見られると、医療ジャーナル編集者のItamar AshkenaziがCOPEのプレゼンテーションで述べた。これらの取り組みは、商業出版にも影響を与える可能性がある。
AI slopだけではなくアカデミックでも「ぽい」やつが急増しているとのこと。想像できますね。
AIと著作権・その他
AI時代の読書と非読社会の考察/非読社会で問い直したい「読む筋トレ」 AI時代に広がる格差とは?:朝日新聞(朝日新聞)

長文を読む機会が減少する中、ノンフィクションライターの稲田豊史氏は「非読社会」と呼ぶ現象を提起。AIの普及がこの状況を加速させるのか、新たな可能性をもたらすのかを探る。大学生の書籍費の減少や地方書店の減少が影響し、読書が一部の特権層のものになる危険性を指摘。また、短文や動画の増加が長文読解能力の衰退を招く中、読書文化の保存についても考察している。
何を隠そう私『本を読めなくなった人たち』を発売後すぐ新書で買って、買ったのを忘れて電子書籍でダブって、途中までしか読めていなくって結局今オーディオブックで聞いているですよ。そんな私も非読社会の構成員という悲しい現実。



コメント