Проект Internet Archive спасает книги от уничтожения ИИ-стартапами. Недавно стало известно, что некоторые AI First компании вроде Amazon массово скупают печатные издания, в том числе редкие, чтобы отсканировать и выкинуть книгу
Уничтожение оригинала после сканирования позволяет утверждать, что одновременно у компании была только одна копия, что подпадает под доктрину добросовестного использования. Если бы компания сохранила и бумажную, и цифровую копии, это было бы уже нарушением авторских прав. В этот процесс попадают даже совершенно новые книги и, наоборот, редкие издания 🔫
ИИ-компании занимаются таким, так как большая часть текста в интернете уже либо была использована, либо написана ИИ, что непригодно для обучения нейросетей
Internet Archive решили исправить ситуацию и теперь вручную сканируют книги, которые могут исчезнуть, чтобы выложить в открытый доступ 😌
tg / max

Комментарии (14)
А дальше что делают с книгами не понятно.
Возможно тоже уничтожают.
И чем они отличаются?
Вероятно под благой целью прикрыт бизнес по продаже результата сканирования тем же ИИ-стартапам.
Ps скоро 40000 ?
А табличкин - 100% примет.
Любая библиотека сможет вбить в программе цитату по памяти и с ошибками и программа покажет точную полку и страницу именно этого издания и бумажный оригинал
А тут, получается все наоборот: хотят уничтожать бумажные оригиналы. Чтобы что? Только ради денег и закрепления за собой? Чукчи продажные
Наследие и предание планета обязана хранить, хоть в контейнерах под землей, хоть в блокчейн с контролем каждый буквы: когда кем и с какой целью была изменена
Чтобы не запутаться: сделаю графовую систему поиска и готовые harness для скачивания. Дальше агенты сами введут в курс дела: как и за счет чего достичь желаемого результата
Для продуктов типа BuildY от Макса будет сайт для пользователей на русском, а для запчастей для конструктора сайт для гиков на английском
В идеале сайт должен отдавать четкие ответы и инструкции для гугл, чатгпт и алисе