Усі моделі штучного інтелекту потребують навчання. Наприклад, як генератор зображень може відтворювати стиль Ghibli, якщо його розробники не використовували для навчання сотні зображень із фільмів студії? Цілком можливо, що ви вже користувалися ШІ-моделями, не замислюючись про те, на яких даних їх навчали. Більшість таких систем використовують наявний контент, поєднуючи величезні масиви інформації для створення нових […]
Запис Anthropic могла знищити мільйони книг заради навчання штучного інтелекту спершу з'явиться на iTechua - Новини про смартфони, гаджети і різні девайси.
Усі моделі штучного інтелекту потребують навчання. Наприклад, як генератор зображень може відтворювати стиль Ghibli, якщо його розробники не використовували для навчання сотні зображень із фільмів студії? Цілком можливо, що ви вже користувалися ШІ-моделями, не замислюючись про те, на яких даних їх навчали. Більшість таких систем використовують наявний контент, поєднуючи величезні масиви інформації для створення нових результатів. Однак підхід Anthropic, розробника LLM Claude, виявився незвичайним.
Компанія придбала мільйони книг, серед яких були рідкісні та важкодоступні видання, щоб використати їх у процесі так званого “деструктивного сканування”. Внутрішні документи Anthropic свідчать, що книги не просто подрібнювали після використання, як раніше повідомляли деякі ЗМІ. Їх розрізали безпосередньо під час підготовки до сканування. Представник Anthropic у коментарі Fortune заявляв, що компанія не купує “рідкісні чи антикварні книги” спеціально для подальшого сканування та знищення. Водночас внутрішні документи описують ситуацію дещо інакше.
Реклама
Згідно зі службовою запискою від квітня 2024 року, Project Panama був створений для “деструктивного сканування всіх книг у світі”, а не лише рідкісних або дорогих видань. У документі йдеться буквально про книги в глобальному масштабі. Назва “Project Panama” також була обрана не випадково. Віце-президент Anthropic Том Терві зазначав, що кодове ім’я мало приховати справжню діяльність проєкту від людей за межами компанії. Після таких подробиць використання Claude дійсно сприймається дещо по-іншому.
Ефективність ціною збереженняСам термін “деструктивне сканування” не придумали журналісти, які розслідували Project Panama. Його використовував Том Терві. Звичайне сканування книги передбачає простий процес: покласти сторінку на сканер, зробити копію, перегорнути сторінку та повторити процедуру. Для великих обсягів це надзвичайно повільно. Anthropic знайшла значно швидший спосіб. Саме після публікації 404 Media про Project Panama з’явилися два ключові висновки.
По-перше, видання повідомило, що Anthropic масово скуповувала старі книги, зокрема ті, які могли містити цінний для навчання ШІ контент. Такий підхід потенційно дозволяє отримати тексти, які не настільки широко представлені в сучасних цифрових базах даних. По-друге, компанія використовувала деструктивне сканування, оскільки воно є “швидшим і дешевшим” за традиційний процес. Книгу розрізають уздовж корінця, розділяють сторінки, після чого їх можна швидко пропустити через сканер.
Водночас на ринку існують пристрої, здатні сканувати книги без фізичного пошкодження. Серед них – роботизовані сканери Robo Scan від SMA Australia та ScanRobot від Treventus. Подібне обладнання могло б дозволити оцифровувати придбані Anthropic книги без їх знищення. Саме це викликає найбільше запитань у критиків компанії, особливо якщо йдеться про рідкісні або важкодоступні видання. Навряд чи хтось схвально сприйняв би використання Blu-ray-програвача для збереження ретроігор, якби він одночасно знищував диски. З книгами ситуація виглядає приблизно так само.
Ми насправді не знаємо масштабів цього проєктуЗгідно з внутрішніми документами Anthropic, до жовтня 2024 року Project Panama вже дозволив відсканувати, а фактично й знищити, мільйони книг. Ситуація виглядає ще цікавішою на тлі повідомлень книгарень про збільшення кількості “загадкових оптових замовлень”. Йдеться, зокрема, про незвичайні видання, які зазвичай навряд чи користуються великим попитом. Одна з поширених версій полягає в тому, що за такими закупівлями можуть стояти компанії, які займаються розробкою ШІ. Якщо це так, Anthropic може бути далеко не єдиною компанією, яка використовує подібний підхід.
Реклама
Через брак відкритої інформації неможливо точно встановити, скільки книг уже було знищено заради навчання моделей штучного інтелекту. Тим більше невідомо, чи серед них могли бути примірники, що залишалися останніми доступними копіями певних видань. Масштаби подібного сканування залишаються невідомими. Водночас далеко не всі компанії, що працюють над ШІ, обов’язково використовують такий метод. Принаймні хочеться в це вірити.
Ілон Маск свого часу написав у X, що попросив команду SpaceXAI зберігати рідкісні книги в бібліотеці та сканувати їх без знищення. На перший погляд, це демонструє зовсім інший підхід. Водночас заяви Маска не завжди беззастережно відповідають його подальшим діям, тому остаточно оцінювати ситуацію лише за одним дописом було б передчасно. Якщо ж SpaceXAI справді дотримуватиметься такого принципу, це стане помітною відмінністю від підходу, який приписують Project Panama.
Реклама
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Anthropic випередила OpenAI за виручкою завдяки корпоративному ШІ | 0 | 9.47 | 18-08-2026 |
| 2 | FT: Anthropic закрывает доступ к своим ИИ-моделям для китайских компаний | 0 | 7 | 03-07-2026 |
| 3 | OpenAI запустила спеціальну версію ChatGPT для підлітків | 0 | 10.41 | 18-08-2026 |
| 4 | Дослідники змусили Microsoft Copilot розкрити власну вразливість | 0 | 7.96 | 18-08-2026 |
| 5 | Anthropic pledges to watermark AI content in EU | 0 | 13.43 | 11-08-2026 |
| 6 | Anthropic to reassess Claude Fable 5 AI development restrictions after backlash | 0 | 11.9 | 11-06-2026 |
| 7 | Weitere KI-Attacke: Modell schleust Schwachstelle ein und manipuliert Menschen | 0 | 17.36 | 05-08-2026 |
| 8 | Anthropic усилила борьбу с обходом ограничений на использование ИИ в Китае - FT | 0 | 5 | 03-07-2026 |
| 9 | AI-pocalypse: Anthropic sparks fears after developing a bot that's 'too dangerous to release to the public' | -3 | 6 | 09-04-2026 |
| 10 | OpenAI приостановила часть обучения новых моделей ИИ из-за киберрисков | 0 | 10.4 | 18-08-2026 |