historical-figures
Эволюция стандартов архивного каталогирования и практики метаданных
Table of Contents
Эволюция стандартов архивного каталогирования и практики метаданных
История стандартов архивной каталогизации и практики метаданных — это история непрерывной адаптации. От рукописных карточных каталогов до связанных с ними экосистем данных резко изменились методы, которые архивисты используют для описания, организации и обмена историческими записями. Эта эволюция отражает не только технологический прогресс, но и углубление понимания того, как контекст, происхождение и потребности пользователей формируют сохранение коллективной памяти. По мере роста размеров и сложности архивных коллекций стандарты, регулирующие их описание, должны сбалансировать точность с доступностью, гарантируя, что записи остаются доступными и значимыми для разных поколений. Переход от изолированных, институциональных подходов к глобально совместимым структурам был обусловлен сотрудничеством между профессиональными организациями, технологическими новаторами и сообществами пользователей, каждый из которых способствует более богатому, более связанному архивному ландшафту.
Ранние архивные практики: основа описания
Эпоха ручных систем
В начале 20-го века архивисты действовали в основном в аналоговом мире. Принципы архивного описания — провенанс, оригинальный порядок и контекст — были уже хорошо установлены, благодаря пионерам, таким как голландское руководство 1898 года (Muller, Feith и Fruin) и руководство по управлению архивами сэра Хилари Дженкинсона Руководство по управлению архивами (1922). Каталогирование было трудоемким процессом, выполняемым вручную. Поисковые пособия часто набирались или составлялись вручную, списки хранились в связующих или карточных шкафах. Каждая запись или серия получала минимальный набор описательных элементов: создатель, даты, физическая степень и краткая примечание к объему. Этот подход хорошо работал для небольших, однородных коллекций, но не мог масштабироваться по мере роста и диверсификации архивов. Например, Национальный архив США, созданный в 1934 году, столкнулся с немедленным отставанием миллиардов страниц федеральных записей, подчеркивая неадекватность ручных методов для крупномасштабных государственных архивов.
Роль Прованса и Оригинального Порядка
Провенанс — принцип, согласно которому записи должны вестись в соответствии с организационной структурой их создателя, — стал основой архивной практики. Оригинальный порядок требовал, чтобы последовательность созданных записей сохранялась. Эти концепции, хотя и вневременные, применялись непоследовательно в разных учреждениях. Без общего стандарта исследователь, переходящий из одного хранилища в другое, мог столкнуться с дико отличающимися описательными практиками. Необходимость гармонизации становилась все более очевидной, особенно когда правительства и университеты начали инвестировать в крупномасштабные архивные программы после Второй мировой войны. Первые формальные усилия по кодификации этих принципов исходили из голландского руководства, а затем из британских и американских архивных традиций, но потребовалось десятилетия, чтобы они слились в единую международную структуру.
Разработка стандартизированных рамок
Толчок к международному консенсусу
К середине 20-го века профессия архивиста признала, что для обеспечения последовательного доступа и обмена информацией необходимы согласованные правила. Международный совет по архивам (ICA) , основанный в 1948 году, возглавил усилия по созданию общего языка для архивного описания. Правила для архивного описания (RAD) появились в 1980-х годах, обеспечивая подробный код для описания записей на нескольких уровнях (фонды, серии, файл, пункт. RAD был влиятельным, но в первую очередь ориентирован на канадский контекст. , впервые опубликованный в 1994 году, предложил более глобально применимую структуру. ISAD(G) определил набор из 26 описательных элементов, организованных в семь областей (таких как идентичность, контекст, содержание и условия доступа) и представил многоуровневую описательную модель, которая остается центральной сегодня. Стандарт был позже дополнен Международный стандартный архивный реестр для корпоративных органов, лиц и семей (ISAAR(CPF))
Национальные стандарты и их влияние
Другие страны разработали свои собственные стандарты, часто выровненные с ISAD (G). Соединенные Штаты использовали Англо-американские правила каталогизации (AACR2) для библиографических материалов, но создали отдельные правила для архивов: Руководство ] Описывая архивы: Стандарт контента (DACS) (2004). Великобритания приняла Руководство по архивному описанию (MAD)]ISAD (G] Правила Национального совета по архивам (NCA) . Эти усилия установили словарь и структуру, которые можно было бы использовать, даже если реализации различны. Акцент на многоуровневом описании гарантировал, что пользователи могли бы сверлить из широкого обзора коллекции в наиболее детальный элемент, все при сохранении контекстуальных отношений. Например, запись на уровне фонды может описывать полный корпус записей из университетского отдела,
Рост стандартов цифровых метаданных
Закодированное архивное описание (EAD)
Переход к цифровым средствам поиска начался всерьез в 1990-х годах. Стандарт Encoded Archival Description (EAD), разработанный Библиотекой Конгресса и Обществом американских архивистов, произвел революцию в доступе к архивам путем кодирования средств поиска в XML. EAD позволил архивистам разметить иерархические описания (используя теги для элементов, таких как , , ) в машиночитаемом формате. Это позволило поддерживать поиск, отображение и обмен средствами поиска в Интернете. Стандарт продолжает поддерживаться и широко использоваться , хотя его сложность привела к упрощенным производным, таким как EAC-CPF (Закодированный архивный контекст — Корпоративные органы, Лица, Семьи) для официальных записей. EAD быстро стал фактическим стандартом для обмена архивными описаниями в Интернете, с реализациями в крупных учреждениях, таких как Библиотека Конгресса, Британская библиотека и университетские архивы по всему миру
Дублинское ядро и совместимость
Одновременно, Инициатива по сбору метаданных в Дублинском ядре (DCMI) предоставила минималистскую схему метаданных всего из 15 элементов (например, название, создатель, дата, предмет, описание). Первоначально разработанная для веб-ресурсов, Dublin Core была быстро принята архивами и музеями для описания цифровых объектов из-за своей простоты и гибкости междоменного пространства. Хотя она не так богата, как EAD или ISAD(G), Dublin Core стала основой многих проектов цифровой библиотеки, таких как Open Archives Initiative Protocol for Metadata Harvesting (OAI-PMH). Это позволило хранилищам подвергать метаданные агрегаторам, таким как Digital Public Library of America (DPLA) и Europeana. Его легкий характер сделал его идеальным для быстрого развертывания, но также требовал тщательного отображения из более подробных архивных стандартов. На практике многие архивы поддерживают гибридный подход: полная помощь поиска EAD для внутреннего использования, с записью Dublin Core, экспортируемой для внешнего агрегирования.
Специализированные стандарты: VRA Core, MODS и METS
По мере расширения цифровых коллекций появились специальные стандарты для конкретных типов носителей. VRA Core (Ассоциация визуальных ресурсов) предложила схему метаданных для визуальных культурных работ, с элементами для описания самой работы, ее изображений и провансовой истории. MODS (Схема описания объектов Метадата) (Metadata Object Description Schema) предоставила более богатую альтернативу Dublin Core для библиографических объектов, часто используемых библиотеками, интегрирующими архивные материалы. METS (Metadata Encoding and Transmission Standard) (Metadata Encoding and Transmission Standard) позволила упаковывать описательные, административные и структурные метаданные для сложных цифровых объектов (например, оцифрованные книги с перелистывающими страницами). Эти стандарты сосуществовали с, а иногда и дополнялись, архивными стандартами, такими как EAD, создавая многоуровневую среду мета
Влияние цифровых репозиториев и агрегаторов
Распространение цифровых репозиториев в 2000-х годах еще больше сформировало практики метаданных. Платформы, такие как ContentDM, DSpace и Fedora, предоставляли поддержку из коробки для Dublin Core и METS, позволяя небольшим учреждениям публиковать цифровые коллекции без глубокого опыта в области метаданных. Digital Public Library of America (DPLA), запущенные в 2013 году, собирали метаданные от сотен партнеров и нормализовали их в общий профиль на основе Dublin Core и Europeana Data Model (EDM). Это заставило архивы улучшить качество и согласованность своих метаданных, чтобы обеспечить возможность обнаружения их коллекций в национальном или глобальном контексте. Модель хаба DPLA поощряла развитие государственных или региональных сервисных
Современные практики и совместимость
Связанные данные и семантическая сеть
В начале 21-го века произошел сдвиг парадигмы в сторону связанных данных и семантических веб принципов. архивисты начали выражать метаданные, используя Resource Description Framework (RDF), рассматривая каждую сущность (люди, места, организации, записи) как URI (единый идентификатор ресурса), связанный отношениями. Этот подход, отстаиваемый инициативами, такими как Linked Data for Archives (LD4A) и International Council on Archives’ Records in Contexts (RiC)], позволяет архивам связывать свои описания с другими источниками данных — такими как Wikidata, VIAF (Virtual International Authority File) или GeoNames — создание сети контекстных знаний. Например, создатель фонда может быть связан с его авторитетной записью, которая, в свою очередь
Записи в контекстах (RiC)
Возможно, самым амбициозным современным стандартом является Записи в контекстах (RiC) , концептуальная модель и онтология, разработанная экспертной группой ICA по архивному описанию (EGAD). RiC заменяет многоуровневую иерархию на основе элементов серии ICA на модель на основе графов, где любая сущность (Record, Agent, Function и т. Д.) может быть связана с любой другой. Он объединяет описательную, контекстную и реляционную информацию в единую структуру. Стандарт публикуется как концептуальная модель (RiC-CM) и онтология OWL (RiC-O). В то время как принятие все еще растет, RiC представляет собой передний край архивного описания , обещая действительно совместимые, открытые и расширяемые метаданные. Например, под RiC запись может быть непосредственно связана с функцией, которая его создала, агентом, который использовал ее, и событием, которое привело к его созданию, все без необходимости жесткого иерархического контейнера.
Инструменты и платформы для современных метаданных
Современные архивные системы, такие как ArchivesSpace, AtoM (Доступ к памяти) и CollectiveAccess, поддерживают эти стандарты изначально. ArchivesSpace, например, использует EAD, DACS и MODS в качестве своих основных описательных схем, в то время как AtoM карты ISAD (G), RAD и Dublin Core. Многие из этих систем также позволяют экспортировать RDF / XML и ссылаться на внешние органы. Кроме того, International Image Interoperability Framework (IIIF) трансформировал доступ к цифровым изображениям, обеспечивая API, который позволяет отображать архивные материалы, аннотировать и сравнивать их в репозиториях, не требуя дублирования метаданных. IIIF работает совместно с METS и MODS для предоставления богатых, совместимых с METS и MODS. Сообщество IIIF продолжает расти, с основными архивами, такими как Национальный архив Великобритании и Национальная библиотека Франции, принимая структуру для своих цифровых с
Будущие направления
Искусственный интеллект и автоматизированное генерирование метаданных
Взрыв цифровых записей сделал ручное описание непрактичным в масштабе. Искусственный интеллект (ИИ) и машинное обучение (ML) начинают устранять этот пробел. Обработка естественного языка (NLP) может автоматически извлекать даты, имена и предметы из текстовых документов, генерируя предварительные метаданные. Распознавание изображений может идентифицировать визуальный контент, в то время как алгоритмы классификации могут назначать коды архивных серий. Эти инструменты еще не полностью надежны - особенно для сложных, рукописных или высоко контекстуальных записей - но они быстро улучшаются. Такие инициативы, как ] Архивный трубопровод машинного обучения в Национальном архиве США и ] другие экспериментальные проекты показывают перспективы для сокращения отставания и повышения обнаруживаемости. В будущем ИИ может не только генерировать метаданные, но и обнаруживать связи между записями через коллекции, всплывающие связи, которые могут пропустить каталогизаторы человека.
Пользовательский дизайн и доступность
Будущие стандарты, вероятно, будут более явно расставлять приоритеты пользовательского опыта. Текущие средства поиска, даже когда они закодированы в EAD или опубликованы через связанные данные, все еще могут быть непрозрачными для неспециалистов. Предпринимаются усилия по созданию упрощенных, граненых интерфейсов просмотра, которые поверхностно описывают архивы способами, подобными каталогам библиотек или поисковым системам. Например, проект Социальные сети и архивный контекст (SNAC) создает удобный для пользователя график исторических фигур, соединяя их с записями, разбросанными по сотням репозиториев. Это перемещает архивное описание из пассивного инструмента хранения в активный исследовательский путь. Кроме того, рост архивных описаний из файла управления , как файл совместного управления, предлагает низкобарьерный способ для архивов обогащать свои метаданные, связываясь с глобально поддерживаемой базой знаний.
Балансировка деталей с доступностью
Настойчивой проблемой является напряженность между исчерпывающим описанием (которое позволяет проводить точные исследования, но требует значительных усилий) и минимальным описанием (которое дешевле, но может упустить жизненно важный контекст). Будущие стандарты должны поддерживать легкие профили, которые могут быть обогащены с течением времени, возможно, посредством краудсорсинга или автоматического обогащения. Опция DACS Single Level Description уже позволяет архивам описывать только уровень фондов, оставляя более низкие уровни для более позднего времени. Аналогичным образом, графическая модель RiC позволяет постепенно добавлять отношения. Как архивные профессионалы обсуждают эти компромиссы, цель остается постоянной: обеспечить, чтобы исторические записи не просто хранились, но активно понимались и использовались. Использование минимальное расширяемые профили метаданных, как это отстаивается W3C's Data on the Web Best Practices , может помочь архивам эффективно распределять ресурсы, все еще позволяя богатое открытие.
Этические соображения в метаданных
Современные архивные стандарты также борются с этическими измерениями. Например, сообщества коренных народов потребовали культурно чувствительные метаданные, которые уважают традиционные знания и контроль. Инициатива Традиционные знания (TK) этикетки и Местные контексты обеспечивают основу для добавления происхождения и ограничений, которые выходят за рамки стандартных условий доступа. Связанные данные и открытые метаданные также могут непреднамеренно подвергать конфиденциальной информации; будущие стандарты должны будут включать автоматизированное редактирование, уровни доступа и детальные элементы управления разрешениями. Принципы CARE для управления данными коренных народов Все больше влияют на дизайн архивных метаданных, выдвигая стандарты за пределы технической совместимости к социальной ответственности. Эти принципы требуют, чтобы метаданные о коллекциях коренных народов были созданы совместно с входом сообщества и чтобы доступ управлялся в соответствии с культурными протоколами.
Заключение
Путь от рукописных каталогов к графам связанных данных отражает неизменную приверженность архивной профессии к тому, чтобы сделать записи доступными во времени и технологиях. Каждый новый стандарт - будь то ISAD (G), EAD, Dublin Core или RiC - решал проблемы своей эпохи: последовательность, машиночитаемость, совместимость и контекст. Заглядывая вперед, слияние ИИ, принципов семантической сети и ориентированного на пользователя дизайна обещает еще больше трансформировать то, как мы описываем и открываем исторические материалы. Основные архивные ценности происхождения, оригинального порядка и контекста остаются постоянными, даже когда инструменты для их реализации развиваются. Охватывая как инновации, так и этическую строгость, архивисты будут продолжать соединять людей с доказательствами прошлого, гарантируя, что память сохраняется не в изоляции, а в рамках живой, взаимосвязанной сети знаний. Сотрудничество между архивным сообществом и смежными областями - библиотеками, музеями, информатикой и исследованиями коренных народов - будет формировать следующее поколение стандартов, делая архивное описание более справедливым, эффективным и обширным.