Projekt Panama
Projekt Panama ist eine Unternehmung der amerikanischen KI-Firma Anthropic zur Datenerfassung, Online-Piraterie und destruktiven Bucheinlesung, dessen Ziel es ist, einen Datensatz alter und seltener Bücher zu entwickeln und dabei eine Vereinbarung zur Übertragung des Urheberrechts zu umgehen. Es wird in Gerichtsdokumenten einer 2024er Urheberrechts-Sammelklage beschrieben. In einem internen Planungsdokument wird es als Versuch, alle Bücher der Welt destruktiv zu scannen beschrieben.[1][2][3][4]
Vorgehensweise
Das Projekt dient der Erstellung einer digitalen Bibliothek zur Erweiterung des Sprachmodells Claude und bedient sich dabei zwei Methoden.
Digitale Piraterie
Anthropic erlangte zunächst Millionen von bereits zuvor digitalisierten Schriften als Raubkopie. Laut Gerichtsunterlagen wurden zu diesem Zweck Webseiten wie Books3, Library Genesis und Pirate Library Mirror verwendet und auf diese Weise vermutlich um die 7 Millionen Bücher „gestohlen“. Im Jahr 2025 gab es eine Vereinbarung zwischen Anthropic und Libgen und Pirate Library Mirrors 1,5 Mrd. USD wegen des Downloads von 482.460 Büchern zu zahlen und die entsprechenden Kopien zu vernichten. Autoren der Bücher bekamen üblicherweise 3000 USD pro Buch als Entschädigung ausgezahlt.[3]
Destruktive Buchscans
Anthropic erwarb außerdem Millionen von gebrauchten und seltenen Büchern von Online-Händlern wie Better World Books, World of Books und Zoom Books und las diese elektronisch ein, indem die Buchrücken abgeschnitten und die losen Seiten gescannt wurden.[1][5][2][6] Dieser Vorgang wurde mithilfe hydraulischer Schneidemaschinen und Hochgeschwindigkeitsbuchscannern umgesetzt und die Einzelseiten anschließend dem Recycling zugeführt (also vernichtet).[6][7] Der so entstandene Datensatz wird privat gehalten und nur für die Weiterentwicklung der Sprachmodelle genutzt.[2]
Gemäß dem Planungsdokument von Projekt Panama wollte Anthropic nicht, dass dieser Vorgang öffentlich bekannt wird.[1][2][6] In der Vereinbarung von 2025 bestimmte der Richter William Alsup, dass das destruktive Scannen von legal erworbenen Büchern als Fair Use zu betrachten sei; anders als die vorangegangene Methode, Raubkopien zu benutzen.[1][5]
Liste der größeren Beschaffungen
- 5.000 Bücher – Kenny's Bookshop, Galway, Ireland
- >10.000 Bücher – Better World Books, USA
- >10.000 Bücher – World of Books, UK
- Unbekannte Menge – Library Genesis
- Unbekannte Menge – De Vries & De Vries, Haarlem, Netherlands[8]
- Unbekannte Menge – Llibreria Fènix, Barcelona, Spain
Einzelnachweise
- ↑ a b c d Aaron Schaffer, Will Oremus, Nitasha Tiku: Inside an AI start-up's plan to scan and dispose of millions of books ( des vom 25. Februar 2026 im Internet Archive) In: The Washington Post, 27. Januar 2026. Abgerufen am 2. Februar 2026 (englisch).
- ↑ a b c d C da Costa: "We Don’t Want It to Be Known": Inside Anthropic’s Secret Plan to Destroy & Scan World Literature. In: Gadget Review. 31. Juli 2026 (englisch).
- ↑ a b Ryan Merket: Everything we know about how Anthropic's Project Panama scanned millions of books. In: runtimewire. 27. Juli 2026 (englisch).
- ↑ A ‘bananas’ order for 5,000 obscure titles from a bookshop in Galway fuels suspicion. In: The Irish Times. Abgerufen am 10. August 2026 (englisch).
- ↑ a b Benj Edwards: Anthropic destroyed millions of print books to build its AI models. In: Ars Technica. 25. Juni 2025, archiviert vom am 26. Juni 2025; abgerufen am 26. Juni 2025 (englisch).
- ↑ a b c Tiffany Chartier: The Vanishing Page: AI Firms Scan Then Destroy Rare Book Editions. In: Dallas Express. 27. Juli 2026 (englisch).
- ↑ Kathryn James: Why is Anthropic destroying books? In: The Guardian, 5. August 2026. Abgerufen am 10. August 2026 (englisch).
- ↑ Tatiana Sataua: This Dutch bookseller thought a request for 3,000 copies was 'spam or phishing.' Instead, AI companies are scanning and destroying books to train AI. In: Fortune. Abgerufen am 10. August 2026 (englisch).
Content Disclaimer
Informasi ini disarikan dari Wikipedia dan disajikan kembali untuk tujuan edukasi. Konten tersedia di bawah lisensi CC BY-SA 3.0. Kami tidak bertanggung jawab atas ketidakakuratan data yang bersumber dari kontribusi publik tersebut.
- The information displayed on this website is sourced in part or in whole from Wikipedia and has been adapted for the purpose of restating it. We strive to provide accurate and relevant information, however:
- There is no guarantee of absolute accuracy. Wikipedia is an open, collaborative project that can be edited by anyone, so information is subject to change.
- It is not intended to constitute professional advice. The content displayed is for informational and educational purposes only. For important decisions (e.g., medical, legal, or financial), please consult a professional.
- Content copyright. Wikipedia is licensed under the Creative Commons Attribution-ShareAlike License (CC BY-SA). This means that content may be reused with appropriate attribution and shared under a similar license.
- Responsible use. Any risk arising from the use of information from this website is entirely the responsibility of the user.