Бесплатная библиотека
Читайте книгу на сайте или телефоне
READ-E-BOOK » Прочая компьютерная литература » Исторические информационные системы: теория и практика [litres]
Исторические информационные системы: теория и практика [litres] - Читать Любимую Русскую Полную Книгу 👉 Read-E-Book.com

Исторические информационные системы: теория и практика [litres]

Электронная книга - «Исторические информационные системы: теория и практика [litres]». Краткое содержание книги:

Исторические, или историко-ориентированные, информационные системы – значимый элемент информационной среды гуманитарных наук. Его выделение связано с развитием исторической информатики и историко-ориентированного подхода, формированием информационной среды, практикой создания исторических ресурсов.
Книга содержит результаты исследования теоретических и прикладных проблем создания и внедрения историко-ориентированных информационных систем. Это первое комплексное исследование по данной тематике. Одни проблемы в книге рассматриваются впервые, другие – хотя и находили ранее отражение в литературе, но не изучались специально.
Издание адресовано историкам, специалистам в области цифровой истории и цифровых гуманитарных наук, а также разработчикам цифровых ресурсов, содержащих исторический контент или ориентированных на использование в исторических исследованиях и образовании.
В формате PDF A4 сохранен издательский макет.
1 ... 19 20 21 22 23 24 25 26 27 ... 83
Перейти на страницу:

• обеспечение поиска информации, повышение эффективности навигации по данным;

• создание единой коллекции документов или взаимосвязанных коллекций на основе стандартизированных структур и описания;

• решение определенных научно-исследовательских задач при изучении источника;

• создание единого пространства исторических источников, развитие гуманитарной составляющей Semantic Web.

Применение XML-разметки возможно по отношению к метаописанию объектов, что широко используется в современных системах репрезентации исторических источников разных типов.

XML-разметка предоставляет широкие возможности для работы с машиночитаемыми текстовыми источниками. Уровни разметки зависят от назначения и цели ее использования и могут быть следующими:

1) разметка метаданных источников;

2) разметка структуры текстовых источников для создания сложных электронных публикаций;

3) разметка отдельных наборов ключевых слов и иных смысловых и формальных структурных элементов в тексте – маркировка географических объектов, персоналий, дат, событий и т. д.;

4) глубокая разметка и выделение смысловых единиц для решения определенных научно-исследовательских задач и расширения возможностей использования источников.

Развитие информационных технологий позволяет использовать при реализации проектов все уровни разметки одновременно.

В историко-ориентированных информационных системах XML-раз метка используется для обозначения метаданных, к которым в том числе относятся: сведения, позволяющие идентифицировать источник или коллекцию (данные об авторе, происхождении, историческом периоде, типе источника и т. д.); структурные метаданные, отображающие взаимосвязи и отношения элементов информационной системы; метаданные административного характера, отображающие сведения об основных процессах (например, об архивировании и хранении данных в системе и т. д.). XML позволяет оперировать размеченными данными, структурировать и извлекать необходимую информацию посредством запросов. При этом текстовые источники, представленные в системе, могут не являться машиночитаемыми и быть опубликованными в форматах изображений, т. е. в таких случаях обработке на основе XML подвергаются только метаданные. Разметка метаданных позволяет структурировать информацию для ее эффективной обработки, поиска, хранения и передачи.

Наборы метаданных источников в историко-ориентированных информационных системах могут быть краткими или расширенными. Детализированная разметка метаданных предоставляет, соответственно, более широкие возможности для последующего поиска необходимых пользователю ресурсов. Использование XML-разметки при структурировании метаданных не всегда означает ее применение в самих текстах опубликованных источников. Так, в проекте The Early Americas Digital Archive[24], посвященном публикации документов по ранней американской истории (1492–1820-е годы), в качестве метаданных источников размечены авторство, предметно-тематическая рубрика, принадлежность к временному периоду, географическая принадлежность, жанр, тип текстового источника и форма. При этом тексты источников также опубликованы в машиночитаемом формате на сайте проекта (и реализован контекстный поиск), но сами тексты не размечены дополнительно с помощью XML.

Широкие возможности для использования имеют информационные системы с XML-разметкой текстов публикуемых источников.

В настоящее время многие текстовые источники, в особенности рукописные, представляются преимущественно в форматах изображений. Это связано и с необходимостью репрезентации внешнего вида источника, и с затратностью распознавания и транскрибирования текста. Представление текстовых источников исключительно в форматах изображений несет массу ограничений: поскольку они не идентифицируются как текст, то, соответственно, не могут быть обработаны на содержательном уровне компьютеризированными методами. В связи с этим возникает необходимость разнопланового представления данных – в качестве текста (в совокупности его содержательных особенностей, слоев и смысловых уровней) и изображения источника. Современные информационные системы позволяют представить документы в многоформатном отображении; для решения этой задачи используется XML.

Разметка особенностей текстовых источников на основе XML позволяет в более полной мере передать аутентичный характер источника. Многие источники имеют слабоструктурированный характер, поэтому их публикация в традиционных для цифрового мира форматах (как, например, HTML) несет существенные ограничения. Использование XML-разметки для публикации текстовых источников имеет значительные преимущества перед традиционными типами электронной публикации ввиду возможностей репрезентации комплексного характера источников. Использование языка XML в историко-ориентированных информационных системах позволяет повысить качество представления цифровых версий документов. Разметка структуры документов (заголовков, абзацев, строк и других элементов текста), особенностей синтаксиса и морфологии позволяет максимально полно представить многослойность источника без потери информативности.

вернуться

24

Th e Early Americas Digital Archive [Электронный ресурс]. URL: http://eada.lib. umd.edu (дата обращения: 27.03.2020).

1 ... 19 20 21 22 23 24 25 26 27 ... 83
Перейти на страницу:
0
Сюжет
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
  • 7
  • 8
  • 9
  • 10
0
Атмосфера
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
  • 7
  • 8
  • 9
  • 10
0
Главный герой
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
  • 7
  • 8
  • 9
  • 10
0
Общее впечатление
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
  • 7
  • 8
  • 9
  • 10
Итоговая оценка: 0.0 из 10 (голосов: 0 / История оценок)