Теория и практика общественно-научной информации. Выпуск 22 - стр. 12
Любой производственный или научный процесс порождает огромные объемы данных, и работать с ними по мере увеличения объемов становится все сложнее. Количество данных когда-нибудь превысит способность человека их обрабатывать, поэтому необходимы новые инструментальные средства и алгоритмы для анализа. Вместе с тем предъявляются серьезные требования к обеспечению прозрачного доступа и долговременной сохранности информации. В результате вопросы «что хранить?», «как хранить?» и «как найти?» остаются самыми существенными: без ответа на них все остальные теряют актуальность (10).
Взаимодействие человека с информацией, существующей в машиночитаемом виде (данными), осуществляется при помощи специализированных программных комплексов – информационных систем (ИС), предназначенных для:
• организации хранения информации (организация хранилищ, поддержка систем хранения данных);
• управления информацией (добавление, модернизация, изменение данных);
• управления доступом к информации (контроль исполнения правил регламентации доступа к данным), идентификация данных;
• поиска информации;
• извлечения информации и предоставления ее пользователю (приложению) в необходимом ему виде;
• визуализации (представления) информации в соответствии с требованиями пользователя (4; 7).
Исходя из тенденций развития систем коммуникаций и практики организации локальных хранилищ данных современная ИС должна удовлетворять некоторым общим требованиям, а именно:
• она должна быть распределенной – РИС13;
• РИС должна обеспечивать контролируемый доступ к различным информационным ресурсам для пользователей и администраторов различных уровней;
• РИС должна обеспечивать сквозной поиск, в том числе полнотекстовый, по различным критериям;
• РИС должна предоставлять информацию в требуемом пользователем виде;
• внутренние технологии РИС должны быть скрыты от пользователей;
• внешние интерфейсы должны быть стандартизованы (6).
При попытках разработки РИС, удовлетворяющих перечисленным требованиям, возникают проблемы, связанные с различными аспектами их функционирования. Эти проблемы можно сгруппировать в следующие классы (2; 6):
• модели и стандарты представления информации и метаинформации.
К сожалению, следование рекомендациям международного сообщества о стандартизации схем данных не является характерной чертой подавляющего большинства разрабатываемых и функционирующих информационных систем14;
• автоматическая классификация информации.
Разработчики ИС не используют модели классификации хранимой информации, затрудняя тем самым включение механизмов, в том числе внешних, для ее автоматической классификации;