ОЦЕНКА АДЕКВАТНОСТИ МЕТОДОВ ИНТЕГРИРОВАНИЯ СХЕМ ДАННЫХ > Полезные советы
Тысяча полезных мелочей    

ОЦЕНКА АДЕКВАТНОСТИ МЕТОДОВ ИНТЕГРИРОВАНИЯ СХЕМ ДАННЫХ

ОЦЕНКА АДЕКВАТНОСТИ МЕТОДОВ ИНТЕГРИРОВАНИЯ СХЕМ ДАННЫХ

Комар Ф.В. Статья в формате PDF 58 KB

В настоящее время ведется активная работа по разработке методов интегрирования схем данных [1, 2]. Предлагаются новые подходы и методы автоматизированного интегрирования [3]. Как следствие встает проблема оценки адекватности методов интегрирования схем данных [4]. Важную роль в оценке результатов применения методов интегрирования схем данных играет эталонное отображение элементов, построенное экспертами.

Рис. 1. Сравнение эталонного и автоматически построенного отображения элементов схем данных

На базе такого эталонного отображения можно различными методами вычислять количественные оценки качества отображения построенного автоматизированным методом.

На рисунке 1 представлены возможные варианты отождествлений. Множество А - это множество истинных, определенных экспертом, соответствий между элементами схем данных. По своей сути множество A - это ошибочно не распознанные соответствия. Множество B - это множество истинных соответствий, которые были включены в автоматически построенное отображение элементов схем данных. По своей сути множество B - это та часть соответствий, которая была верно распознана методом. Множество C - это множество соответствий, которые были включены в автоматически построенное отображение, но на самом деле не являющихся истинными. По своей сути множество C - это множество ошибочно распознанных соответствий. Множество D - это множество ложных соответствий. По своей сути множество D является множеством верно отброшенных методом соответствий. Очевидно, что чем точнее совпадают множества соответствий эталонного отображения и автоматически построенного отображения, тем выше адекватность автоматически построенного отображения.

Наиболее простыми оценками адекватности построенного отображения могут служить следующие численные хаpaктеристики [0]:

    (1)

Данная оценка отображает долю найденных истинных соответствий по отношению к общему числу соответствий вошедших в автоматически построенное отображение.

       (2)

Данная оценка отображает долю автоматически найденных истинных соответствий по отношению к общему числу истинных соответствий.

В случае, когда автоматически построенное отображение дает идеальный результат, имеем . Однако рассмотренные отдельно друг от друга ни оценка P, ни оценка  не дают возможности сделать выводы о качестве рассматриваемого отображения. Действительно, оценка P может быть увеличена путем включения в отображения малого числа соответствий с предельно высоким уровнем достоверности. При этом оценка  будет заведомо занижена. Включая в отображение как можно большее количество соответствий, будет увеличена оценка . При этом оценка P будет заведомо снижена.

Представленные ниже оценки лишены указанных выше недостатков:

   (3)

Комбинированная оценка, которая с помощью параметра  позволяет изменять вклад оценок P и  в конечный результат. При   , оценка  не учитывает. При   , оценка P не учитывает. При  оценки P и  учитываются равноценно и можно получить следующую комбинированную оценку [5]:

 (4)

В работе [0] была представлена, а в работе [0] использована следующая оценка:

   (5) 

С учетом вышесказанного предлагается следующий метод оценки адекватности метода интегрирования схем данных:

Сравнительный анализ методов должен проводиться на заранее подготовленных тестовых задачах. Тестовые задачи должны быть стандартизированы и общепризнанны.

Эталонное отображение в каждой тестовой задаче должно быть построено с учетом мнения нескольких экспертов. Возможно усреднение отображений построенных каждым экспертом для получения единого эталонного отображения. Или же возможно сравнение результатов автоматизированного отождествления с эталонным отображением каждого эксперта и усреднение полученных величин качества.

Для численного анализа результатов предлагается использовать количественные оценки качества  и .

СПИСОК ЛИТЕРАТУРЫ:

  1. Брюхов Д.О. Интероперабельные информационные системы: архитектуры и технологии. / Задорожный В.И., Калиниченко Л.А., Курошев М.Ю., Шумилов С.С. // СУБД, № 4, 1995
  2. Калиниченко Л. А. Методы и средства интеграции неоднородных баз данных. - М.: Наука, 1983. - 423 c.
  3. Do Hong-Hai, Rahm Erhard. COMA - A System for Flexible Combination of Schema Matching Approach. // VLDB, 2002.
  4. Do Hong-Hai, Melnik Sergey, Rahm, Erhard. Comparison of Schema Matching Evaluations // Proc. GI-Workshop "Web and Databases", Erfurt, Oct. 2002.
  5. Melnik Sergey, Garcia-Molina Hector, Rahm Erhard. Similarity Flooding: A Versatile Graph Matching Algorithm (Extended Technical Report) 2001.


СУБЪЕКТЫ КОРРУПЦИОННЫХ ПРАВОНАРУШЕНИЙ

СУБЪЕКТЫ КОРРУПЦИОННЫХ ПРАВОНАРУШЕНИЙ Статья в формате PDF 250 KB...

18 03 2026 3:58:54

ПЕТРОЛОГИЯ И ГЕОХИМИЯ СУБВУЛКАНИЧЕСКИХ ОБРАЗОВАНИЙ УНИКАЛЬНОГО КУМИРСКОГО Sc-U-TR МЕСТОРОЖДЕНИЯ ГОРНОГО АЛТАЯ

ПЕТРОЛОГИЯ И ГЕОХИМИЯ СУБВУЛКАНИЧЕСКИХ ОБРАЗОВАНИЙ УНИКАЛЬНОГО КУМИРСКОГО Sc-U-TR МЕСТОРОЖДЕНИЯ ГОРНОГО АЛТАЯ Для уникального Кумирского скандий-уран-редкоземельного месторождения впервые описаны субвулканические образования, сформировавшиеся в антидромной последовательности от гранитов до долеритов. Более ранние гранит-порфиры и аляскит-порфиры слагают Кумирский шток, в контакте с которым образовались сложнее по составу метасоматиты от фельдшпатоидов до пропилитов. Гранитоиды формировались в процессе частичного плавления мантийного субстрата(кварцевые эклогиты) и относятся к А-типу (анорогенных гранитоидов), а дайки долеритов обнаруживают в своём образовании мантийно-коровое взаимодействие: смешение мантийной базальтовой магмы и корового материала. ...

17 03 2026 17:19:29

Фонды углерода каштановых почв Западного Забайкалья

Фонды углерода каштановых почв Западного Забайкалья Выявлены количественные и качественные особенности формирования запасов углерода в степных экосистемах. ...

16 03 2026 8:43:40

Воронежская область: реформирование адвокатуры

Воронежская область: реформирование адвокатуры Статья в формате PDF 118 KB...

12 03 2026 8:24:35

ВОДНЫЕ РЕСУРСЫ ИРКУТСКОЙ ОБЛАСТИ

ВОДНЫЕ РЕСУРСЫ ИРКУТСКОЙ ОБЛАСТИ Статья в формате PDF 277 KB...

11 03 2026 4:46:40

АДАКИТОВЫЕ ГРАНИТОИДЫ СУМСУНУРСКОГО БАТОЛИТА ВОСТОЧНОГО САЯНА: ПЕТРОЛОГИЯ И ГЕОХИМИЯ

АДАКИТОВЫЕ ГРАНИТОИДЫ СУМСУНУРСКОГО БАТОЛИТА ВОСТОЧНОГО САЯНА: ПЕТРОЛОГИЯ И ГЕОХИМИЯ Описан состав Сумсунурского батолита рифейского возраста, сложенного кварцевыми диоритами, тоналитами, трондьемитами, а также дайками лейкогранитов и аплитов, отнесённых по сумме признаков к адакитовым гранитоидам. Среди тоналитов и трондьемитов по минеральному и химическому составам выделяются по две разновидности. В трондьемитах и аплитах проявлены два типа тетрадного эффекта фpaкционирования РЗЭ. Установлено, что в процессе генерации адакитовых гранитоидов участвовали разнородные источники плавления субстрата: мантийный и коровый. Становление породных типов происходило при участии флюидов мантийной природы и корового обводнения. Выдвинуто предположение, что формирование комплексного и крупного по запасам золотого Зун-Холбинского месторождения описываемого района принимали различные источники (мантийные и коровые). Взаимодействие последних генерировало золотое оруденение. Высказано предположение о прострaнcтвенной и парагенетической связи оруденения с раннепалеозойским холбинским и более древним рифейским сумсунурским комплексами. ...

07 03 2026 11:40:30

АНАЛИЗ СТРУКТУР КРИСТАЛЛОВ ЗАМОРОЖЕННОЙ БИОЛОГИЧЕСКОЙ ЖИДКОСТИ В 3D-ФОРМАТЕ

АНАЛИЗ СТРУКТУР КРИСТАЛЛОВ ЗАМОРОЖЕННОЙ БИОЛОГИЧЕСКОЙ ЖИДКОСТИ В 3D-ФОРМАТЕ В работе рассмотрен вопрос исследования биологической жидкости в формате 3D. ...

04 03 2026 4:10:29

ЗАРУБЕЖНЫЙ ОПЫТ СТРУКТУРНЫХ ПРЕОБРАЗОВАНИЙ

ЗАРУБЕЖНЫЙ ОПЫТ СТРУКТУРНЫХ ПРЕОБРАЗОВАНИЙ Статья в формате PDF 121 KB...

03 03 2026 7:38:15

МИКРОЭКОЛОГИЯ ЧЕЛОВЕКА (ЧАСТЬ I)

МИКРОЭКОЛОГИЯ ЧЕЛОВЕКА (ЧАСТЬ I) С экологических позиций излагается представление о человеке как метасистеме, состоящей из макроскопического (тело) и микроскопического (микробиота) компонентов. Последний определяется как биоценоз микроорганизмов — бактерий, простейших, микроскопических грибов и вирусов, встречающийся у здоровых людей. Приводятся некоторые количественные хаpaктеристики микробиоты человека: общее число микроорганизмов, суммарная биомасса, процентное содержание облигатной, факультативной и транзиторной составляющих, время, за которое происходит смена генерации микроорганизмов. Рассматриваются главные системоообразующие факторы, обеспечивающие целостность микробиоты: структурный, метаболический, генетический и информационный. Анализируются взаимоотношения микробиоты и макроорганизма в нормальных физиологических условиях и при патологии. Обсуждаются механизмы развития дисбиозов и патогенетически обоснованные подходы к их коррекции. ...

27 02 2026 6:17:49

ЖИЖИН КОНСТАНТИН СЕРГЕЕВИЧ

ЖИЖИН КОНСТАНТИН СЕРГЕЕВИЧ Статья в формате PDF 114 KB...

24 02 2026 19:27:56

СТРУКТУРА ВИРУСНОЙ ПАТОЛОГИИ ЛОР-ОРГАНОВ

СТРУКТУРА ВИРУСНОЙ ПАТОЛОГИИ ЛОР-ОРГАНОВ Статья в формате PDF 277 KB...

23 02 2026 19:48:49

НЕКОТОРЫЕ СВЕДЕНИЯ О ПРОДУКТАХ ИЗ БОБОВ СОИ

НЕКОТОРЫЕ СВЕДЕНИЯ О ПРОДУКТАХ ИЗ БОБОВ СОИ Статья в формате PDF 130 KB...

18 02 2026 16:57:19

ПРИМЕНЕНИЕ КОЛЛАГЕНА В МЕДИЦИНСКИХ ЦЕЛЯХ

ПРИМЕНЕНИЕ КОЛЛАГЕНА В МЕДИЦИНСКИХ ЦЕЛЯХ Статья в формате PDF 254 KB...

16 02 2026 6:46:24

ИССЛЕДОВАНИЕ ВРОЖДЕННЫХ ПОРОКОВ РАЗВИТИЯ И НАСЛЕДСТВЕННЫХ ЗАБОЛЕВАНИЙ В ЗАПАДНОЙ ЗОНЕ АЗЕРБАЙДЖАНА

ИССЛЕДОВАНИЕ ВРОЖДЕННЫХ ПОРОКОВ РАЗВИТИЯ И НАСЛЕДСТВЕННЫХ ЗАБОЛЕВАНИЙ В ЗАПАДНОЙ ЗОНЕ АЗЕРБАЙДЖАНА Проведены медико-генетические исследования среди населения трех крупных районов Западной зоны Азербайджана с целью дальнейшего составления регистра фенотипически наиболее легко диагностируемых врожденных пороков развития и наследственных заболеваний, подлежащих обязательной регистрации. Установлена высокая частота распространения нарушений ЦНС, врожденных патологий зрения и слуха. Вычислены фенотипические частоты выявленных патологий. У детей с диагнозом гемолитическая болезнь выявлен полный и частичный дефицит фермента глюкозо-6-фосфатдегидрогеназы. С использованием молекулярного метода полимеразно-цепной реакции идентифицированы типы мутаций β-талассемии в обследованных районах. ...

13 02 2026 23:35:15

Еще:
Поддержать себя -1 :: Поддержать себя -2 :: Поддержать себя -3 :: Поддержать себя -4 :: Поддержать себя -5 :: Поддержать себя -6 :: Поддержать себя -7 :: Поддержать себя -8 :: Поддержать себя -9 :: Поддержать себя -10 :: Поддержать себя -11 :: Поддержать себя -12 :: Поддержать себя -13 :: Поддержать себя -14 :: Поддержать себя -15 :: Поддержать себя -16 :: Поддержать себя -17 :: Поддержать себя -18 :: Поддержать себя -19 :: Поддержать себя -20 :: Поддержать себя -21 :: Поддержать себя -22 :: Поддержать себя -23 :: Поддержать себя -24 :: Поддержать себя -25 :: Поддержать себя -26 :: Поддержать себя -27 :: Поддержать себя -28 :: Поддержать себя -29 :: Поддержать себя -30 :: Поддержать себя -31 :: Поддержать себя -32 :: Поддержать себя -33 :: Поддержать себя -34 :: Поддержать себя -35 :: Поддержать себя -36 :: Поддержать себя -37 :: Поддержать себя -38 ::