Аналитика: методология, технология и организация информационно-аналитической работы
Шрифт:
— поиск методов адаптации существующих моделей и установление направлений исследований;
— восстановление сведений об источниках информации, привлекавшихся для получения данных при решении аналогичных задач, формирование гипотезы о направлениях информационно-поисковых мероприятий;
— анализ парка инструментальных средств проведения исследований и их доступности на текущий момент времени;
— анализ потребностей в развитии парка инструментальных средств и оценка финансовых затрат на его пополнение и возможностей повторного использования вновь приобретенных средств, определение стратегии финансирования (приобретение, лизинг, аренда);
— оценка трудоемкости отдельных
— оценка стоимости информационной продукции, приобретаемой у сторонних субъектов ИАР в интересах решения данной задачи;
— установление факта достижимости поставленной цели ИАР/решения задачи;
— подготовка заключения о сроках и стоимости мероприятий по пополнению информационных ресурсов, парка инструментальных средств, методологического обеспечения в интересах решения задачи;
— передача документа, содержащего заключение заказчику.
Основными методами, используемыми на этом этапе, являются методы классификации, мозговых атак, структурирования массивов данных, анализа деревьев целей и задач.
Ресурсами, привлекаемыми для решения задачи, являются существующие архивы, массивы данных на электронных и иных носителях, принадлежащих субъекту ИАР, а также ресурсы библиотек, ГСТК Интернет и иные.
Продукцией, получаемой по завершении этапа, являются следующие блоки информационных продуктов/документов:
— для субъекта ИАР: оценка трудозатрат, стоимости и направлений исследований, направления пополнения информационных ресурсов и инструментального парка, направления расходования средств и оценка прибыли;
— для потребителя информационной продукции: заключение о возможности решения поставленной перед субъектом ИАО задачи, краткое описание содержания предстоящих работ, смета и технико-экономическое обоснование.
4. Поиск, отбор и экспресс-анализ данных
Задачи поиска, отбора и экспресс-анализа данных являются базисными для любой отрасли ИАР, требуют творчества от сотрудников и имеют, подчас, весьма нетривиальные решения. Причин тут масса — перечислим лишь основные:
— данные могут иметь разнообразные формы представления;
— данные могут быть как обеспечены, так и не обеспечены моделями их интерпретации;
— данные могут быть распределены в массе различных по своей физической природе, временной и пространственной локализации источников;
— источники данных могут быть в различной степени доступны или наблюдаемы.
Вам доводилось видеть по телевизору церемонии открытия олимпийских игр? Допустим, да. Тогда вам приходилось видеть, как по сигналу церемониймейстера на трибунах из отдельных щитов, управляемых сидящими на трибунах людьми, складываются государственные флаги, олимпийская символика и прочие замысловатые узоры. А теперь представьте себе, что вы сидите на этой трибуне, и все, что вы можете наблюдать — это разноцветные щиты с номерами в ногах у себя и своих ближайших соседей, а вам по системе оповещения сообщают с каким номером щит вам предстоит поднять на счет «три». Так вот, задачи поиска и установления информативности источников сходны с задачей определения того, какой флаг через мгновение увидит телезритель, и того, в какой части трибуны вероятность правильного распознавания была бы выше.
Характер и состав множества источников информации определяется возможностями системы сбора информации, которой располагает конкретный субъект ИАР. Чем мощнее комплект инструментальных средств сбора, чем обширнее сеть добывания информации, тем полнее источниковая база ИАР. Для одних задач существует возможность привлечения инструментальных средств контроля, обеспечивающих сбор максимально достоверной информации о состоянии объектов исследований и среды их функционирования, возможность ранжирования источников по достоверности, точности и оперативности. Для других такая возможность отсутствует, а прогностический потенциал данных, получаемых методом непосредственного измерения параметров, не удовлетворяет требованиям, предъявляемых к результатам исследований. Таким образом, мы приходим к выводу о том, что состав источников, действительно, в сильной степени зависит от специфики задач исследования и парка инструментальных средств субъекта ИАР.
Современная аналитика располагает чрезвычайно обширной источниковой базой. В арсенале средств сбора информации присутствуют самые изощренные системы: начиная от спутниковых систем мониторинга атмосферы и земной поверхности, радио и оптико-электронной разведки и заканчивая самим, вооруженным пятью каналами ввода информации, аналитиком.
5 Работа с источниками текстовой информации
Оставим рассмотрение «экзотических» случаев: использования спутников- и самолетов-шпионов, добывания экспериментального образца методом подкупа вахтера и иные, столь же далекие от повседневной работы «чистого» аналитика. Хотя случаи работы с несимвольной информацией встречаются достаточно часто — например, могут проводиться работы по определению химического состава или конструктивных особенностей продукции непосредственно с ее образцами, а не с описаниями таковых.
Сосредоточим свое внимание на классе источников символьных данных, а еще точнее — текстовых данных. Класс текстовых данных обладает максимальным прогностическим потенциалом при минимальном интервале наблюдений — в одном кратком предложении может быть выражена информация, достаточная для описания поведения объекта или процесса на сколь угодно отдаленную перспективу. В то же время, точность этого вида данных крайне низка, они подвержены многим видам искажений. Особенно низка их устойчивость к целенаправленной модификации. Но, сколь бы плохи или хороши они ни были, такие данные часто бывают единственным, что доступно аналитику.
Чаще всего, в повседневной деятельности нам приходится сталкиваться с классом источников информации, имеющих в своей основе языковые (знаковые или символьные) средства коммуникации: книги, периодические издания различной специализации, телевидение, радио, телефон, персональные коммуникации, ресурсы глобальных, региональных и локальных телекоммуникационных сетей. Данный класс коммуникаций, если исключить персональные ощущения и специальные технологии, является основным каналом пополнения личного (персонально пережитого) и социального (полученного в результате коммуникаций) опыта и знаний. Количество только языковой информации (исключая видеоряд), которое поступает по каналам этого класса источников, в принципе, позволяет сложной системе типа «человек» адаптивно реагировать на изменение ситуации, вырабатывать цели, стратегии, синтезировать новую информацию и добывать новые знания. Более того, этой информации достаточно для управления и другими людьми, не говоря уж о технических системах, созданных человеком.