Skip to main content
LibreTexts - Ukrayinska

5.3: Процес опису ресурсів

  • Page ID
    53839
  • \( \newcommand{\vecs}[1]{\overset { \scriptstyle \rightharpoonup} {\mathbf{#1}} } \) \( \newcommand{\vecd}[1]{\overset{-\!-\!\rightharpoonup}{\vphantom{a}\smash {#1}}} \)\(\newcommand{\id}{\mathrm{id}}\) \( \newcommand{\Span}{\mathrm{span}}\) \( \newcommand{\kernel}{\mathrm{null}\,}\) \( \newcommand{\range}{\mathrm{range}\,}\) \( \newcommand{\RealPart}{\mathrm{Re}}\) \( \newcommand{\ImaginaryPart}{\mathrm{Im}}\) \( \newcommand{\Argument}{\mathrm{Arg}}\) \( \newcommand{\norm}[1]{\| #1 \|}\) \( \newcommand{\inner}[2]{\langle #1, #2 \rangle}\) \( \newcommand{\Span}{\mathrm{span}}\) \(\newcommand{\id}{\mathrm{id}}\) \( \newcommand{\Span}{\mathrm{span}}\) \( \newcommand{\kernel}{\mathrm{null}\,}\) \( \newcommand{\range}{\mathrm{range}\,}\) \( \newcommand{\RealPart}{\mathrm{Re}}\) \( \newcommand{\ImaginaryPart}{\mathrm{Im}}\) \( \newcommand{\Argument}{\mathrm{Arg}}\) \( \newcommand{\norm}[1]{\| #1 \|}\) \( \newcommand{\inner}[2]{\langle #1, #2 \rangle}\) \( \newcommand{\Span}{\mathrm{span}}\)

    Ми віддаємо перевагу загальному поняттю опису ресурсів перед більш спеціалізованими бібліографічними описами та метаданими, оскільки це полегшує перегляд проблем, що стосуються доменів, де ці терміни домінують. Крім того, це дозволяє нам запропонувати більш стандартний процес, який ми можемо широко застосувати до використання описів ресурсів при організації систем. Спільний словник дозволяє обмінюватися уроками та найкращими практиками.

    Процес опису ресурсів включає сім взаємозалежних і ітераційних кроків. Почнемо з загального резюме процесу, щоб задати основу для детального покрокового обговорення.

    1. Визначення ресурсів для опису є першим кроком; ця тема детально розглядається в розділі «Ідентифікація ресурсів». Домен ресурсу та область видимості обмежують описані властивості та можливі цілі, яким можуть служити описи. Ресурсний фокус визначає, які є основними інформаційними ресурсами, а які розглядаються як відповідні описи ресурсів. Два важливих рішення на даному етапі — деталізація опису чи описуємо ми окремі ресурси чи їх колекції? і рівень абстракції ми описуємо екземпляри ресурсів, їх частини або типи ресурсів?

    2. Як правило, метою опису ресурсу є підтримка заходів, загальних для всіх організаційних систем: відбір, організація, взаємодія та підтримка ресурсів, як ми бачили в Діяльність в організаційних системах. Конкретний домен ресурсу та контекст, в якому створюються та використовуються описи, накладає більш конкретні вимоги та обмеження на цілі, яким може служити опис ресурсу.

    3. Після того, як цілі опису з точки зору діяльності та взаємодій будуть визначені, можна визначити конкретні властивості ресурсів, які необхідні для їх забезпечення. Мета опису - не бути вичерпним; завжди є більше можливих властивостей, ніж можна обґрунтовано описати. Натомість завдання полягає у використанні властивостей, які є найбільш надійними та надійними для підтримки бажаних взаємодій.

    4. Цей крок включає в себе кілька логічних і семантичних рішень про те, як будуть описуватися властивості ресурсу. Які терміни або імена елементів слід використовувати для ідентифікації властивостей ресурсу, які ми вибрали для опису? Чи існують правила або обмеження щодо типів даних або значень, які можуть припускати описи властивостей? При роботі з числовими описами їх типи даних та рівні вимірювання обмежують види обробки, до якої вони можуть подати. Номінальні, порядкові, інтервальні та коефіцієнтні дані обмежені певними перетвореннями на основі того, що вони представляють. Хороший словниковий запас опису буде легко призначити при створенні описів ресурсів і легко зрозуміти при їх використанні.

    5. Логічні та смислові рішення про словниковий запас опису уточнюються рішеннями щодо позначення, синтаксису та структури описів. Взяті разом ці рішення в сукупності визначають, що ми називаємо формою або кодуванням описів ресурсів. Реалізація описів передбачає прийняття рішень про те, як і де вони зберігаються, а також технології, що використовуються для їх створення, редагування, зберігання та отримання.

    6. Описи ресурсів створюються окремими особами, неформальними або формальними групами людей або автоматизованими або обчислювальними засобами. Деякі типи описів можуть створюватися лише людьми, деякі типи описів можуть створюватися лише автоматизованими або алгоритмічними методами, а деякі можуть бути створені будь-яким способом.

    7. Описи ресурсів повинні бути оцінені відповідно до їх цільових цілей. Результати цієї оцінки допоможуть визначити, які або попередні кроки потрібно переробити.

    Наступні сім підрозділів детально обговорюють кожен з цих кроків. Короткий довідковий посібник - Малюнок: Процес опису ресурсів.

    Процес опису ресурсів

    Ця діаграма узагальнює процес опису ресурсів, перераховуючи сім кроків та деякі пов'язані з ними пункти прийняття рішень.

    Процес опису ресурсів складається з семи етапів: визначення сфери застосування та спрямованості, визначення призначення, визначення властивостей ресурсу, проектування словникового запасу опису, проектування форми опису та реалізації, створення описів та оцінка описи.

    Наскільки чітким і систематичним повинен бути кожен крок, залежить від домену і обсягу ресурсу, і особливо від передбачуваних користувачів організаційної системи. Якщо ми уважно подивимось, ми можемо побачити, що більшість цих кроків відбуваються навіть у дуже неформальному контексті, наприклад, діти, які грають з блоками Lego, з яких ми розпочали цю главу. Мета побудови речей з блоками змушує хлопчиків визначити, які властивості найбільш корисні для аналізу. Вони розробляють описи блоків, які фіксують конкретні значення відповідних властивостей. Нарешті, вони оцінюють свої описи, використовуючи їх, коли вони грають разом; відразу стає очевидним, що опис не служить своїй меті, коли один хлопчик передає блок іншому, який не був тим, про який він думав, що він просив.

    На відміну від цього, сценарій фотографування передбачає набагато більш чіткий і систематичний процес опису ресурсу. Властивості ресурсу, словниковий запас опису та форма опису, яка автоматично використовується цифровою камерою, були обрані галузевою асоціацією та опубліковані як технічна специфікація, реалізована виробниками камер та мобільних телефонів у всьому світі.

    Описи ресурсів, які використовуються бібліотеками, архівами та музеями, зазвичай створюються ще більш чітко та систематично. Як і описи цифрової фотографії, властивості, словниковий запас та форма описів, що використовуються їх організаційними системами, регулюються стандартами. Однак немає еквівалента цифровій камері, яка може створювати ці описи автоматично. Натомість висококваліфіковані професіонали створюють їх прискіпливо.

    Безліч ресурсів і пов'язаних з ними описів в бізнес-і наукових організаційних системах створюються автоматизованими або обчислювальними процесами, тому процес опису окремих ресурсів зовсім не такий в бібліотеках та інших установах пам'яті. Однак процес проектування моделей даних або схем для класу ресурсів, які будуть генеруватися, однаково систематичний і зазвичай виконується висококваліфікованими аналітиками даних та моделювальниками даних.

    Визначення сфери та фокусу

    Які ресурси ми хочемо описати? Як ми бачили в Resources in Organizing Systems, визначити, що буде розглядатися як окремий ресурс, не завжди легко, особливо для ресурсів зі складовими частинами та для інформаційних ресурсів, де найважливішою властивістю є їх зміст, яке безпосередньо не сприймається. Визначення речі, яку ви хочете описати так само точно, як практичне, - це перший крок до створення корисного опису.

    У «Resource Focus» ми ввели контраст між первинними ресурсами та ресурсами опису, який ми назвали ресурсним фокусом. Визначення ресурсної спрямованості йде рука об руку з визначенням того, які ресурси ми маємо намір описати; ці часто довільні рішення потім мають величезну різницю в характері та масштабах опису ресурсів. Метадані однієї людини — це дані іншої людини.

    • Для бібліотекаря ціна книги може бути лише ще одним атрибутом, який є частиною запису книги.

    • Для бухгалтера в книгарні ціна цієї книги - як вартість покупки книги, так і ціна, за якою вона потім продається клієнтам - є важливою інформацією для перебування в бізнесі.

    • У контексті медичних записів, страховий постачальник пацієнта не викликає особливого занепокоєння для лікаря, але для особи, відповідальної за виставлення рахунків, вона є центральною. Для медсестри поточні життєві показники пацієнта можуть мати найбільше значення, тоді як для лікаря може бути найважливішим зрозуміти, як ці дані в сукупності служать для вказівки на довгостроковий прогноз здоров'я пацієнта.

    • Вчений, що вивчає порівняльну анатомію, зберігає зразки тварин і записує докладні фізичні описи про них, але вчений, що вивчає екологію або міграцію, відкидає зразки і зосереджується на описі контексту, в якому був зразок. розташований.

    Опис екземплярів або опис колекцій

    Найпростіше думати про опис ресурсу як пов'язане з іншим окремим ресурсом. Як ми обговорювали в розділі Ресурси в організації систем, важко визначити, що розглядати як окремий ресурс, коли ресурси самі по собі є об'єктами або системами, що складаються з інших частин або ресурсів. Наприклад, ми іноді описуємо футбольну команду як єдиний ресурс, а в інший час зосереджуємося на кожному окремому гравці. Однак після прийняття рішення про деталізацію ресурсу залишається питання, чи потрібен кожному ресурсу окремий опис.

    Бібліотеки та музеї спеціалізуються на кураторстві описів ресурсів про екземпляри у своїх колекціях. Описи ресурсів також застосовуються до класів або колекцій ресурсів, оскільки колекція також є ресурсом («Поняття «Колекція»). Архівам і спеціальним колекціям карт, як правило, присвоюються описи ресурсів, але кожен документ або карта, що містяться в колекції, не обов'язково мають свій власний бібліографічний опис. Аналогічно, бізнес-та наукові набори даних незмінно описуються на рівні збирання, оскільки вони часто аналізуються в повному обсязі.

    Крім того, деталізація опису для колекції ресурсів має тенденцію відрізнятися для різних користувачів або цілей. Інвестор, який володіє багатьма різними акціями, орієнтується на свої індивідуальні ціни, тоді як інші інвестори вкладають свої гроші в індексні фонди, які об'єднують всі окремі ціни в єдине значення.

    Багато веб-сторінок, особливо каталоги товарів електронної комерції та новинні сайти, динамічно збираються та персоналізуються з великої кількості інформаційних ресурсів та послуг, які окремо ідентифікуються та описуються в системах управління контентом та доставки контенту. Однак дуже складна колекція ресурсів, яка об'єднується на одній сторінці, розглядається як єдиний ресурс, коли ця сторінка з'являється у списку результатів пошукової системи. Більш того, всім окремо згенерованим сторінкам можна дати єдиний опис, коли користувач створює закладку, щоб було легко повернутися на головну сторінку сайту.

    Абстракція в описі ресурсу

    Ми також можемо пов'язувати описи ресурсів з цілим типом або доменом ресурсів. (Див. «Збереження типів ресурсів» та «Домен ресурсів».) Колекція описів ресурсів набагато корисніша, коли кожен ресурс описується з використанням загальних елементів опису або термінів, які застосовуються до кожного ресурсу. Схема (або модель, або стандарт метаданих) визначає набір описів, які застосовуються до всього типу ресурсів. Іноді ця схема, модель або стандарт виводяться з колекції існуючих ресурсів або накладаються на неї для забезпечення більш послідовних визначень, але частіше вона використовується як специфікація, коли ресурси створюються або генеруються в першу чергу. (Див. Що про «Створення» ресурсів? в «Вступі».)

    Наприклад, реляційна база даних легко концептуалізується як колекція записів, організованих як одна або кілька таблиць, причому кожен запис у власному рядку має ряд полів або атрибутів, які містять певний встановлений тип вмісту. Кожен запис або рядок у таблиці бази даних є описом ресурсу співробітника, продукту, будь-чого і окремі значення атрибутів, організовані за стовпцями та рядками таблиці, є окремими частинами опису для певного екземпляра ресурсу, як-от employee 24 або продукт 8012С. [1]

    Інформаційні ресурси, які ми зазвичай називаємо документами, за своєю природою менш однорідні за змістом і структурою, ніж ті, якими можна керувати в базах даних. Схеми документів, зазвичай представлені в SGML або XML, зазвичай дозволяють використовувати суміш даних, подібних і текстових описових елементів.

    [2]

    Область застосування, масштаб та опис ресурсу

    Якби нам було лише одне, що потрібно описати, ми могли б використати одне слово, щоб описати це: «це. «Нам не потрібно було б відрізняти його від чогось іншого. Другий ресурс має на увазі хоча б ще один термін в мові опису: «не це. Однак у міру зростання колекції описи повинні ставати складнішими, щоб розрізняти не тільки між ресурсами, а й між ними.

    Кожен елемент або термін в мові опису створює вимір або вісь, уздовж якої можна розрізняти ресурси, або він визначає набір питань щодо ресурсів. Відмінності та питання, які часто виникають, потрібно легко вирішити, такі як:

    • Як називається ресурс?

    • Хто його створив?

    • Який тип вмісту чи матерії він містить?

    Тому, коли колекція зростає, мова опису ресурсів повинна ставати більш суворим, а описи, створені, коли колекція була невеликою, часто потребують перегляду, оскільки вони вже не адекватні за призначенням. [3]

    Таку спільну еволюцію описової сфери та складності опису легко побачити в надзвичайно складних бібліографічних описах, створених професійними каталогізаторами. Загальновикористовувані англо-американські правила каталогізації (AACR2) стандарти каталогізації виділяють 11 різних категорій ресурсів і вказують кілька сотень описових елементів. AACR2 нещодавно був замінений стандартами опису ресурсів та доступу (RDA), які роблять чіткі відмінності щодо вмісту, типу носія та носія (технології). [4]

    Оскільки завдання опису бібліотечного ресурсу було стандартизовано на національному та міжнародному рівнях, каталогізаційна робота розподіляється серед багатьох описів, результати яких поділяються. Принцип стандартизації був основою централізованого бібліографічного опису протягом століття.

    Централізоване опис ресурсів кваліфікованими фахівцями працює для бібліотек, але навіть в перші дні веб багато вчених бібліотек та футурологи веб-авторингу визнали, що такий підхід не буде масштабуватися для опису веб-ресурсів. У 1995 році елемент метаданих Dublin Core (DC), який містить лише 15 елементів, був запропонований як значно простіший словник опису, який могли використовувати люди, не навчені як професійні каталогізатори. З тих пір ініціатива Dublin Core була дуже впливовою, надихаючи численні інші спільноти на створення мінімалістичних словників описів, часто шляхом спрощення словників, розроблених професіоналами для використання непрофесіоналами. [5]

    Звичайно, простіша лексика опису робить менше відмінностей, ніж складний; замінюючи «автор», «художник», «композитор» та багато інших описів особи або нелюдського ресурсу, відповідального за інтелектуальний зміст ресурсу, просто « creator» (як це робить Dublin Core) призводить до значної втрати точності при створенні опису і може спричинити непорозуміння при повторному використанні описів. [6]

    Негативного впливу зростаючого масштабу та масштабу на опис ресурсів іноді можна уникнути, якщо під час її створення передбачається кінцевий обсяг та масштаб організаційної системи. Для бізнесу з клієнтами у шести штатах США було б нерозумно створити адресне поле у своїй базі даних клієнтів, яке обробляло б лише ці шість штатів; більш розширюваний дизайн дозволив би для будь-якого штату чи провінції та включав код країни. Загалом, однак, так само, як є проблеми з адаптацією простого словникового запасу як збільшення обсягу та масштабу, розробка та застосування описів ресурсів, які працюватимуть для великої та постійно зростаючої колекції, може здатися занадто великою роботою, коли колекція під рукою невелика.

    Проблеми, що виникають у великих словниках описів, трансформуються, коли описи ресурсів створюються та призначаються комп'ютерними алгоритмами. Великий набір даних може містити багато тисяч описів для кожного ресурсу, але очевидно, що комп'ютер не має когнітивних труднощів з їх створенням або використанням. Однак комп'ютерні моделі з такою кількістю функцій можуть бути важко для людей, щоб зрозуміти і довіряти.

    Визначення цілей

    Опис ресурсу служить багатьом цілям, і поєднання цілей і результуючих видів описів в будь-якій конкретній системі організації залежить від обсягу та масштабу організованих ресурсів. Ми можемо визначити та класифікувати найпоширеніші цілі, використовуючи чотири заходи, які відбуваються в кожній організаційній системі: вибір, організація, взаємодія з ресурсами та підтримка їх (див. Діяльність в організаційних системах). Опис ресурсу також має більш відкриту мету у сенсі та науці (див. «Опис ресурсів для смислення та науки»); ми спостерігаємо та описуємо світ, щоб зрозуміти наш досвід та передбачити майбутні спостереження.

    Опис ресурсу для підтримки вибору

    Визначення вибору як процесу, за допомогою якого ресурси ідентифікуються, оцінюються, а потім додаються до колекції в організаційній системі підкреслює описи ресурсів, створені кимось іншим, ніж особа, яка їх використовує. Можна виділити кілька різних способів, за допомогою яких опис ресурсу підтримує вибір:

    Діскавері

    Які доступні ресурси можуть бути додані до колекції? Нові ресурси часто занесені в каталоги, реєстри або каталоги. Деякі типи ресурсів вибираються і купуються автоматично за допомогою підписок або контрактів.

    Можливість та сумісність

    Чи буде ресурс відповідати функціональним вимогам чи вимогам сумісності? Техномісткі ресурси часто мають численні спеціалізовані типи описів, які визначають їх функції, продуктивність, надійність та інші «-іліти», які визначають, чи відповідають вони іншим ресурсам в організаційній системі. [7] Деякі служби мають якості рівнів обслуговування, умови та інтерфейси, задокументовані в описі ресурсів, які впливають на їх сумісність та сумісність. Деякі ресурси мають обмеження ліцензування або використання, які можуть перешкоджати ефективному використанню ресурсів за цільовими цілями. Рішення про «вибір людей» стають все більш керованими даними, і спортивні команди, бізнес-роботодавці та сайти знайомств тепер покладаються на прогнозну статистику, щоб знайти найкращу людину.

    Аутентифікація

    Чи є ресурс таким, яким він претендує? («Автентичність») Описи ресурсів, які можуть підтримувати автентифікацію, включають технологічні, такі як мітки часу, водяні знаки, шифрування, контрольні суми та цифрові підписи. Історія власності або зберігання ресурсу, яка називається його походження («Провенанс»), часто встановлюється через асоціацію з продажами або податковими записами. Імпортні та експортні сертифікати, пов'язані з ресурсом, можуть знадобитися для дотримання законів, спрямованих на запобігання крадіжці старожитностей або передачі технологій чи інформації з наслідками національної безпеки або зовнішньої політики.

    Оцінка

    У чому цінність даного ресурсу? Яка його вартість? За якою швидкістю вона знецінюється? Чи має він термін придатності? Чи є у нього якісь пов'язані рейтинги, рейтинги чи показники якості? Більше того, яка якість цих рейтингів, рейтингів та заходів?

    Ми також розглядаємо перспективу людини, яка створює опис ресурсу, і його основне призначення, яке часто полягає в тому, щоб заохотити вибір ресурсу кимось іншим. Маркетинг продуктів - це розробка імен та описів, щоб зробити ресурс відмінним та привабливим порівняно з альтернативами. Довгі роки чорнослив пропагувався як харчова добавка, яку людям (особливо старим) потрібно «підтримувати регулярність». Але після того, як Каліфорнійська дошка з чорносливу (найбільший у світі постачальник) перебрендувала їх як «сушені сливи» і почала продавати їх як закусочну їжу (і одночасно перейменуючи себе в Каліфорнійську дошку сушеної сливи) продажі значно зросли. [8]

    Багато країн вимагають, щоб імпортовані товари були марковані їх країною або походженням. Споживачі часто використовують цю властивість в описі ресурсів як показник високої якості, як це може бути зі швейцарським годинником, французькою або італійською модою або канадським беконом. Крім того, споживачі можуть захотіти купувати товари вітчизняного або місцевого походження через економічний патріотизм або дотримуватися правил закупівель. Не дивно, що коли споживачі розглядають походження в позитивному світлі, ця інформація помітна і легко читається. На відміну від цього, коли споживачі розглядають походження менш позитивно, можливо, як попередження про неякісні товари, постачальник, швидше за все, зробить інформацію про походження настільки непомітною, наскільки це можливо юридично, або навіть може спотворювати товар як вітчизняний. [9]

    Це оману також є повсюдним у онлайн-знайомствах, хоча кількість омани повинна бути збалансована з цілями відносин та шансами на виявлення обману. [10]

    Опис ресурсу для підтримки організації

    Ми визначили організацію як визначення принципів опису та організації ресурсів для створення можливостей, на яких базується взаємодія. Це визначення розглядає створення описів ресурсів та їх використання для організації ресурсів для взаємодій як окремі та послідовні заходи. Це найпростіше побачити, коли люди призначають ключові слова та класифікації документам, або коли датчики створюють дані, а ці описи ресурсів згодом використовуються для пошуку документів або аналізу даних. Клерк універмагу може сортувати сорочки сукні на дисплеї, використовуючи етикетки, які описують їх бренди, розміри та інші властивості. Правила, що регулюють збір, інтеграцію та аналіз особистої інформації, також є описами ресурсів, що впливають на організацію інформаційних ресурсів.

    Однак навіть якщо опис ресурсу та організація ресурсів логічно роздільні, часом вони переплітаються між собою. Коли ви оформляєте свій власний одяг, ви не використовуєте чіткі описи ресурсів, а натомість покладаєтеся на неявні про легко сприймаються властивості, такі як колір, форма та матеріал композиції. Коли алгоритми, а не люди аналізують тексти для виявлення описових функцій для таких додатків, як пошук інформації, класифікація спаму та аналіз настроїв, описи ресурсів та організація ресурсів спільно розвиваються, часто постійно, коли алгоритм адаптується та вчиться з кожним новим ресурсом, він описує. Цей тісний зв'язок між описом ресурсу та організацією ресурсів також використовується в організації систем, які використовують записи про використання з журналів сеансів, перегляду або завантаження діяльності як ресурси взаємодії, прив'язуючи їх до платежів за використання ресурсів або аналізуючи їх для впливу на вибір та організація ресурсів у майбутніх персоналізованих взаємодіях. (Див. «Поняття «Ресурс взаємодії»)

    Опис ресурсу для підтримки взаємодії

    Більшість обговорень цілей опису ресурсів та метаданих підкреслюють взаємодію, засновану на описах ресурсів, які були навмисно та явно призначені. Функціональні вимоги до бібліографічних записів (FRBR), визначені вченими бібліотеки, визначає чотири взаємодії пошуку, ідентифікації, вибору та отримання ресурсів, але вони в цілому застосовуються до систем організації, а не тільки в бібліотеках. [11]

    Знаходження

    Які доступні ресурси, які «відповідають заявленим користувачем критеріям пошуку» і таким чином можуть задовольнити інформаційну потребу? До того, як з'явилися онлайн-каталоги та електронні бібліотеки, ми знаходили ресурси, посилаючись на каталоги описів друкованих ресурсів, що містять назву, автора та предметні терміни як точки доступу до колекції; описи предметів були найважливішими помічниками пошуку, коли користувач не мав конкретний ресурс на увазі. Сучасні користувачі визнають, що комп'ютеризована індексація робить можливим пошук не тільки по всьому ресурсу опису, але часто по всьому вмісту первинного ресурсу. Компанії шукають каталоги для опису можливостей компанії для пошуку потенційних партнерів, а також шукають описи інтерфейсів додатків (API), які дозволяють їм обмінюватися інформацією в автоматичному режимі.

    Ідентифікація

    Інша мета опису ресурсу - дати можливість користувачеві підтвердити особистість конкретного ресурсу або виділити кілька, які мають деякі перекриваються описи. У бібліографічному контексті це може означати пошук ресурсу, який ідентифікується його цитуванням. Комп'ютерні описи ресурсів, що обробляються, як штрих-коди, [12]

    Вибір

    Вибір у цьому контексті означає активність користувача з використання описів ресурсів для підтримки вибору ресурсу з колекції, а не інституційна діяльність з вибору ресурсів для збору в першу чергу. Пошукові системи зазвичай використовують короткий «текстовий фрагмент» з термінами запиту, виділеними як описи ресурсів для підтримки вибору. Люди часто вибирають ресурси з найменшими обмеженнями на використання, як описано в ліцензії Creative Commons. [13] Бізнес може вибрати постачальника або дистриб'ютора, який використовує той самий стандарт або галузеву еталонну модель для опису своєї продукції або бізнес-процесів, оскільки майже напевно зменшить витрати на ведення бізнесу з цим діловим партнером. [14]

    Отримання

    Фізичні ресурси часто вимагають значних зусиль для отримання після їх вибору. Ловля автобуса або літака передбачає узгодження вашого поточного місця розташування та часу з часом та місцем розташування ресурсу. З інформаційними ресурсами у фізичній формі отримання вибраного ресурсу зазвичай означало прогулянку стеками бібліотеки. За допомогою цифрових інформаційних ресурсів пошукова система повертає список ідентифікаторів ресурсів, до яких можна отримати лише ще одним клацанням миші, тому для переходу від вибору серед результатів запиту до отримання відповідного первинного ресурсу потрібно мало зусиль. [15]

    Елейн Свеноніус запропонувала додати до [16] п'яту задачу під назвою Навігація

    Навігація або досліджувати

    Якщо користувачі не можуть вказати свої інформаційні потреби таким чином, який вимагає функціональність пошуку, вони повинні мати можливість використовувати реляційні та структурні описи серед ресурсів для переходу від будь-якого ресурсу до інших, які можуть бути кращими. Свеноній підкреслює узагальнення, агрегацію та дериваційні зв'язки. [17] Але в принципі будь-які відносини або майно можуть служити навігаційним «шосе» між ресурсами.

    Те, що деякі автори називають «структурними метаданими», може використовуватися для підтримки пов'язаних завдань переміщення в межах багатоскладових цифрових ресурсів, таких як електронні книги, де кожна сторінка може мати пов'язану інформацію про попередню, наступну та інші пов'язані сторінки. Документи, описані за допомогою [18]

    Опис ресурсу для підтримки обслуговування

    Багато типів описів ресурсів, які підтримують вибір («Опис ресурсу для підтримки вибору») також корисні з часом для підтримки підтримки конкретного ресурсу та колекції, до якої вони належать. Зокрема, технічну інформацію про формати ресурсів та технології (програмне забезпечення, комп'ютери чи інші), необхідні для використання ресурсів, а також інформацію, необхідну для забезпечення цілісності ресурсів, часто називають «метаданими збереження» в контексті технічного обслуговування. [19]

    Описи ресурсів, які більше пов'язані з діяльністю з технічного обслуговування, включають інформацію про версію та ефективність, або інформацію про термін корисного використання. Графіки технічного обслуговування обладнання, як правило, пов'язані з кількістю пройдених миль (вказується одометром автомобіля), кількістю годин, що експлуатуються (зберігаються багатьма двигунами), кількістю надрукованих сторінок або іншої легко записаної інформації про використання ресурсів або взаємодії. Завдяки розумним ресурсам, здатним збирати, аналізувати та передавати більше даних про продуктивність у режимі реального часу, тепер можливе більш складне прогнозування та планування робіт з технічного обслуговування. Також легше визначити ресурси, які використовуються не так багато, як очікувалося, що може означати, що вони більше не потрібні і, таким чином, можуть бути безпечно архівовані або викинуті.

    Опис ресурсу для смислення та науки

    До цього часу в «Визначенні цілей» ми обговорювали, як описи ресурсів використовуються для виконання чітко визначених завдань в рамках існуючої організаційної системи. Однак існує більш широка і менш чітко визначена мета опису ресурсу, яка є старішою і більш фундаментальною: використання описів ресурсів як сировини для осмислення світу.

    Протягом тисяч років, ще до винаходу писемності, люди систематично збирали речі, інформацію про ці речі та спостереження всіх видів, щоб зрозуміти, як працює їхній світ. Палеолітичні люди зробили наскальні малюнки, що зображують результати полювання та міграції тварин; стародавні єгиптяни фіксували щорічні повені річки Ніл у різьбленні по каменю; а вавилонські, єгипетські, китайські та мезоамериканські астрономи організували місячні, сонячні та планетарні спостереження як календарі, починаючи близько п'яти тисяч років тому.

    Ці різноманітні зусилля щодо накладання сенсу досвіду шляхом запису, аналізу, організації та реорганізації спостережень можна колективно описати як смислення. (Див. бічну панель, Створення сенсу та організація.)

    Деякі аспекти смислення жорстко пов'язані еволюцією, яка надала нашому мозку потужні механізми, які автоматично спрощують та організовують дані сприйняття, які ми отримуємо від світу (див. Бічну панель Принципи Гештальта). Але це автоматичне смислення домінує і посилюється навмисним сенсом.

    Навмисне смислення відбувається, коли систематичні статистичні, експериментальні та наукові методи свідомо дотримуються для отримання та організації знань із колекцій зразків, спостережень або вимірювань. Тут дуже важливо визнати, що вміст цих колекцій представляє вибір, що збирати, тому що більшість речей і більшість явищ мають безліч описів або властивостей, які можна було б записати про них.

    Після того, як речі або дані були зібрані, статистичні методи підсумовують значення властивостей у колекції або наборі даних та зв'язки між ними. Отримання сенсу однієї колекції або набору даних шляхом визначення властивостей, які контрастують та класифікують екземпляри, є початком до більш важливої мети розуміння більшого набору або сукупності, з якої початкова колекція є лише зразком. Немає кращого прикладу тому, ніж таблиця Менделєєва, розроблена в 1869 році Менделєєвим, який організував відомі елементи на основі їх загальних хімічних властивостей, а потім успішно прогнозував деякі властивості ще невідкритих.

    Обчислювальні моделі, розроблені на основі початкового набору даних, можуть прогнозувати майбутні спостереження. Моделі класифікації присвоюють новий екземпляр категорії (наприклад, спам чи не спам-повідомлення, Медісон або Гамільтон як автор, зовнішня або внутрішня сцена); регресійні моделі прогнозують певне значення деякого вимірювання (враховуючи опис нового фільму, скільки грошей він заробить?) ; порядкові регресійні моделі прогнозують значення для неметричних заходів (наскільки вам сподобається фільм?). Експериментальні методи тестування гіпотез допомагають розробляти та вдосконалювати моделі будь-якого типу шляхом систематичного зміни умов, за яких проводяться спостереження, щоб виявити, як змінюються результати в різних ситуаціях.

    Фундаментальним завданням у сенсі та моделюванні є пошук балансу між конкуруючими цілями розуміння певної колекції або набору даних та можливістю застосувати це розуміння до нових екземплярів. Моделі можуть відрізнятися кількістю описів ресурсів, які вони використовують як параметри, і легко і спокусливо переоснастити модель, використовуючи більше параметрів, які фіксують випадкові зміни в спостереженнях. Перевстановлення дає помилкову точність у відтворенні оригінальних спостережень, але робить моделі менш узагальнюваними.

    Найвищим рівнем сенсотворчості є створення наукових моделей або теорій, які пропонують інтерпретаційні та причинно-наслідкові механізми спостережень. І так само, як автоматичне смислення створює прості пояснення, вчені, як правило, віддають перевагу простішим теоріям, евристичним, відомим як бритва Оккама, або закону парсимонії. Незважаючи на те, що складні теорії іноді можуть бути більш точними, простіші теорії дають більш перевірені прогнози, що полегшує перевірку або уточнення теорії. Відомий принцип Оккама, виражений вісім століть тому, полягає в тому, щоб віддавати перевагу моделям, які роблять найменшу кількість припущень, часто вимірюваних з точки зору кількості параметрів або змінних, необхідних для прогнозування. [21] [22] [23]

    Визначення властивостей

    Після того, як цілі опису були встановлені, нам потрібно визначити конкретні властивості ресурсів, які можуть задовольнити ці цілі. Існує чотири причини, за якими це завдання складніше, ніж здається спочатку.

    • По-перше, будь-якому конкретному ресурсу може знадобитися багато описів ресурсів, всі з яких стосуються різних властивостей, залежно від підтримуваних взаємодій та контексту, в якому вони відбуваються. Вибір людей для баскетбольної команди зосереджується на їх фізичних властивостях, таких як висота, сила, стрибаюча здатність та координація. Вибір для команди дебатів буде більше стосуватися їх словесних та інтелектуальних властивостей.

    • По-друге, різні типи ресурсів повинні включати різні властивості в свої описи. Для ресурсів у музеї вони можуть включати матеріали та розміри творів мистецтва; для файлів та служб, керованих адміністратором мережі, вони включають дозволи на контроль доступу; для електронних книг або DVD-дисків вони включали б управління цифровими правами ( DRM) код, який виражає те, що ви можете, а що не можна робити з ресурсом.

    • По-третє, як ми коротко торкнулися в розділі «Область видимості, масштаб і опис ресурсу», які властивості беруть участь в описі ресурсів, залежить від того, хто робить опис. Мало сенсу очікувати дрібнозернистих відмінностей і тлумачень про властивості від людей, яким не вистачає навчання дисципліні організації. Ми повернемося до цього компромісу в «Створення описів ресурсів» і знову в «Описі музейних та художніх ресурсів».

    • По-четверте, те, що може здатися однаковою властивістю на концептуальному рівні, може сильно відрізнятися на рівні реалізації. Багато ресурсів мають опис ресурсу, який є сурогатом або резюме первинного ресурсу. Для фотографій, картин та інших ресурсів, зовнішній вигляд яких є їх сутністю, відповідним підсумковим описом може стати менша, зменшена роздільна здатність фото оригіналу. Цей сурогат простий у створенні і легко для користувачів, щоб зв'язатися з первинним ресурсом. З іншого боку, перегонка тексту до короткого резюме або реферату - це навичка для себе. Ресурси, засновані на часі, забезпечують більші виклики для резюме. Чи повинен короткий зміст фільму бути текстовим змістом сюжету, значним кліпом з фільму, резюме відео або чимось іншим взагалі?

      Цей розрив у реалізації часто дуже великий для властивостей про людей, оскільки людей не так легко виміряти, як більшість видів ресурсів. Компанії повинні кількісно оцінити інтерес людини до своєї продукції, щоб передбачити, яку ціну вони готові заплатити, але «відсотки» не можуть бути виміряні безпосередньо. Натомість прогнози покладаються на заходи проксі-сервера для «інтересу», наприклад, як довго клієнт дивився на веб-сторінку продукту і чи дивився вони також на веб-сторінку конкурента.

    Двома важливими вимірами для розуміння та контрастності властивостей ресурсів, що використовуються в описах та принципах організації, є: сутність власності - чи властивості іскрово чи зовнішньо пов'язані з ресурсом, і; стійкість властивостей - чи є властивості статичні або динамічні. Взяті разом ці два виміри дають чотири категорії властивостей, як показано на малюнку: Сутність власності x Стійкість: Чотири категорії властивостей. Ці чотири категорії забезпечують корисну основу для роздумів про властивості ресурсів, навіть якщо часом класифікація властивостей є дискусійною. [24]

    Сутність власності х наполегливість:
    Чотири категорії властивостей

    Матриця «Властивості сутності» (Intrinsic vs Extrinsic) та «Властивість стійкості» (динамічна проти статичної). Визначення та приклади з тексту узагальнені тут.

    Відмінності стійкості властивостей та сутності властивостей об'єднуються, щоб виділити чотири категорії властивостей: внутрішні статичні, зовнішні статичні, внутрішні динамічні та зовнішні динамічні властивості.

    Внутрішні статичні властивості

    Внутрішні або неявні властивості притаманні ресурсу і часто можуть бути безпосередньо сприйняті або досвідчені. Статичні властивості не змінюють своїх значень з плином часу. Вид тварини, матеріал складу дерев'яного стільця, діаметр колеса - все це статичні властивості, які з часом не змінюють своїх значень. Статичні властивості, такі як колір або форма, часто використовуються для опису та організації фізичних ресурсів.

    Внутрішні фізичні властивості зазвичай є лише частиною опису ресурсів. У багатьох випадках фізичні властивості описують лише поверхневий шар ресурсу, мало розкриваючи про те, що щось таке або його первісне цільове призначення, що це означає, або коли і навіщо воно було створено. Автором пісні та контекстом її створення є інші приклади власних і статичних властивостей ресурсу, які безпосередньо не сприймаються.

    Внутрішні описи часто витягуються або обчислюються обчислювальними процесами. Наприклад, комп'ютерна програма може обчислити частоту та розподіл слів у певному документі. Аналогічно візуальні підписи або звукові відбитки пальців є внутрішніми описами («Опис нетекстових ресурсів»).

    Деякі відносини між ресурсами є внутрішніми і статичними, як відносини батько-дитина або відносини між двома дітьми з тими ж батьками. Частково цілі або композиційні відносини для ресурсів з частинами також є внутрішніми статичними властивостями, які часто використовуються в описах ресурсів. Однак краще уникати трактування ресурсних відносин як властивостей, а замість цього висловлювати їх як відносини. Опис відносин і структур обговорює частково цілі та інші семантичні відносини дуже докладно.

    Зовнішні статичні властивості

    Зовнішні або явні властивості присвоюються ресурсу, а не притаманні йому. Ім'я або ідентифікатор ресурсу часто є довільним, але після присвоєння зазвичай не змінюється. Упорядкування ресурсів за алфавітним або числовим порядком їх описових ідентифікаторів є загальним організаційним принципом. Класифікаційні номери та тематичні заголовки, присвоєні бібліографічним ресурсам, є зовнішніми статичними властивостями, як і серійні номери, нанесені на виготовлену продукцію або прикріплені до них.

    Для інформаційних ресурсів, які мають цифрову форму, властивості їх друкованих або відтворених версій можуть бути невластивими. Деякі текстові формати повністю відокремлюють контент від презентації, і в результаті таблиці стилів можуть кардинально змінити зовнішній вигляд друкованого документа або веб-сторінки, не змінюючи при цьому основний ресурс жодним чином. Наприклад, якби до цього абзацу був застосований інший стиль, щоб виділити його жирним шрифтом або відлитим 24-точковим шрифтом, його вміст залишатиметься таким же.

    Внутрішні динамічні властивості

    Внутрішні динамічні властивості змінюються з плином часу. Наприклад, особистісні характеристики розвитку, такі як зріст і вага людини, майстерність або інтелектуальні здібності. Оскільки ці властивості не є статичними, вони зазвичай використовуються лише для організації ресурсів, членство яких у колекції має обмежену тривалість. Спортивні програми або ліги, які відокремлюють учасників за віком або роками досвіду, використовують внутрішні динамічні властивості для опису та організації ресурсів.

    Зовнішні динамічні властивості

    Зовнішні динамічні властивості багато в чому довільні і можуть змінюватися, оскільки вони засновані на використанні, поведінці або контексті. Поточний власник або місцезнаходження ресурсу, його частота доступу, спільна частота доступу з іншими ресурсами, його нинішня популярність або культурна значимість, або його конкурентна перевага перед альтернативними ресурсами є типовими зовнішніми та динамічними властивостями, які використовуються в описах ресурсів. Тематична книга, описана як бестселер один рік, може бути знайдена у смітнику зі знижками через кілька років. Середній бал студента - це зовнішня динамічна властивість.

    Зовнішні динамічні властивості є корисними функціями для вчених даних, які роблять прогнозування або класифікаційні моделі. Ваше поточне місце розташування, річ, яку ви тільки що купили, і місце, яке ви її купили, можна розглядати як прояви недоглянутих уподобань і цінностей. Відбитки пальців, знайдені на дверній ручці на місці злочину, є зовнішньою динамічною властивістю, пов'язаною з дверима, і розумні детективи аналізують їх разом з іншими ресурсами взаємодії, які вони виявили з метою ідентифікації людини, для якої відбитки пальців є внутрішніми статичними властивостями.

    Багато взаємозв'язків між ресурсами мають зовнішні та динамічні властивості, як у найкращого друга.

    Контекстні властивості - це ті, що пов'язані з ситуацією або контекстом, в якому описується ресурс. Dey визначає контекст як «будь-яку інформацію, яка характеризує ситуацію, пов'язану з взаємодією між користувачами, програмами та навколишнім середовищем. » [25] Це відкрите визначення передбачає велику кількість контекстних властивостей, які можуть бути використані в описі; чіткішими визначеннями контексту можуть бути «місцезнаходження+активність» або «хто, коли, де, чому. » Оскільки контекст змінюється, контекстні дескриптори можуть бути доречними при призначенні, але можуть мати обмежену стійкість та ефективність («Ресурси протягом часу»); опис документа як «отримання недавньої покупки» не буде корисним дуже довго.

    Цитати одного інформаційного ресурсу іншим є зовнішніми статичними описами, коли вони знаходяться в друкованому вигляді, але коли вони публікуються в цифрових бібліотеках, зазвичай буває так, що «cited by» - це динамічний опис ресурсу. Аналогічно, будь-яке конкретне посилання з однієї веб-сторінки на іншу є зовнішнім статичним описом, але оскільки багато веб-сторінок самі по собі дуже динамічні, ми також можемо розглядати посилання як динамічні. Цитати та веб-посилання розглядаються більш детально в описі відносин і структур.

    Ресурси часто описуються з культурними властивостями, які випливають із звичайної мови чи культури, часто за аналогією, оскільки вони можуть бути дуже запам'ятовуються та запам'ятовуються. [27]

    Іноді культурний опис переживає свою виразність, втрачаючи свою силу викликати що-небудь, крім спантеличення про те, що це може означати. [28]

    Для хлопчиків Lego, поточних з останніми фільмами «Зоряних воєн», «легка шабля» була лише очевидним описом для довгої неонової трубки з ручкою. Однак хтось, незнайомий з франшизою «Зоряних воєн», може не зрозуміти «світлу шаблю» і опише шматок іншим способом.

    Розробка словника опису

    Після того, як ми визначили властивості для використання в описах ресурсів, нам потрібно спроектувати словниковий запас опису: набір слів або значень, які представляють властивості. «Naming Resources» обговорювали проблеми неймінгу та запропоновані принципи для хороших імен, а оскільки імена є дуже важливим описом ресурсу, значна частина того, що ми там говорили, стосується взагалі оформлення словника опису.

    Однак, оскільки словниковий запас опису в цілому - це набагато більше, ніж просто назва ресурсу, нам потрібно запропонувати додаткові принципи або рекомендації для цього кроку. Крім того, деякі нові питання дизайну виникають, коли ми розглядаємо всі описи ресурсу як набір, окремі описи якого створюються багатьма людьми протягом деякого періоду часу.

    Принципи хорошого опису

    В Інтелектуальному фонді організації інформації Свеноній пропонує набір принципів або «директив для дизайну» мови опису. [29] Її принципи, оформлені у вузькому контексті бібліографічних описів, зазвичай застосовуються до широкого спектру типів ресурсів, які ми розглядаємо в цій книзі.

    Зручність користувача

    Вибирайте терміни опису з урахуванням користувача; це, швидше за все, терміни будуть загальним для цільової аудиторії.

    Представництво

    Використовуйте описи, які відображають те, як ресурси описують себе; припускайте, що самоописи точні.

    Достатність і необхідність

    Описи повинні мати достатню кількість інформації для їх цілей і не містити інформацію, яка не є необхідною для певної мети; це може означати виключення деяких аспектів самоопису, які є незначними.

    Стандартизація

    Стандартизуйте описи настільки, наскільки це практично, але також використовуйте згладжування, щоб дозволити загальновживані терміни.

    Інтеграція

    Віддайте перевагу однаковим властивостям і термінам для всіх типів ресурсів.

    Будь-який набір загальних принципів проектування стикається з двома проблемами.

    • Перший полягає в тому, що реалізація будь-якого принципу вимагає багатьох додаткових і конкретних контекстно-залежних варіантів, для яких загальний принцип пропонує мало вказівок. Наприклад, як застосовується принцип стандартизації, якщо кілька стандартів вже існують в якомусь ресурсному домені? Який із конкуруючих стандартів повинен бути прийнятий, і чому?

    • Другий виклик полягає в тому, що загальні принципи іноді можуть призвести до суперечливих порад. Рекомендація щодо зручності користувача щодо вибору термінів опису в загальному користуванні не вдається, якщо спільнота користувачів включає як звичайних людей, так і науковців, які використовують різні терміни для одних і тих же ресурсів; чиє «загальне використання» має переважати?

    Хто використовує описи?

    Орієнтуйтеся на описи користувача. Це основна ідея, яку ми не можемо переоцінити, оскільки вона неявна на кожному кроці процесу опису ресурсу. Всі принципи проектування в попередньому розділі поділяють думку про те, що оформлення словника опису має орієнтуватися на користувача описів. Чи організовуються ресурси особистими, для особистих і переважно приватних цілей? У цьому випадку властивості та терміни опису можуть бути дуже особистими або своєрідними і все одно дотримуватися принципів дизайну.

    Аналогічно, коли користувачі ресурсів діляться відповідними знаннями або перебувають у контексті, де вони можуть спілкуватися та вести переговори, якщо це необхідно, для ідентифікації ресурсів, їх описи ресурсів можуть дозволити собі бути менш точними та суворими, ніж їм може знадобитися в іншому випадку. Це допомагає пояснити цікаві описи в історії Lego, з якої ми почали цю главу. Хлопці, які грали з блоками, розмовляли один з одним з Легосом перед ними. Якби вони не змогли побачити блоки, про які говорили інші, або якби їм довелося описувати свої іграшки тому, хто ніколи раніше не грав з Легосом, їх описи були б зовсім іншими.

    Однак найчастіше описи ресурсів не можуть припускати такого ступеня спільного контексту і повинні бути розроблені для категорій користувачів, а не окремих користувачів: користувачів бібліотеки, які шукають книги, службовці бізнесу або клієнти, які використовують каталоги деталей і товарів, вчені аналізують набори даних з експериментів або моделювання. У кожній з цих ситуацій описи ресурсів потрібно буде розуміти людям, які їх не створили, тому оформлення словникового запасу опису повинно бути більш обдуманим і систематичним, щоб переконатися, що його терміни були однозначними і достатніми для забезпечення надійного безконтекстного тлумачення. Одна людина рідко має широту знань домену та досвіду з користувачами, необхідними для розробки словникового запасу опису, який може задовольнити різноманітних користувачів з різноманітними цілями. Натомість багато людей, які працюють разом, зазвичай розробляють необхідний словниковий запас опису. Ми називаємо результати інституційними словниками, щоб протиставити їх індивідуальним або культурним. (Цей контраст ми обговоримо більш повно в Категоризації: Опис класів і типів ресурсів)

    Кожен знає щось про дерева, але деякі люди знають більше, ніж інші, і їх особливий досвід і перспектива впливають на те, як вони описують дерева. Які властивості та описи використовували б студенти університету? За дослідженнями ботаніків? Ландшафтними дизайнерами? Працівниками технічного обслуговування парку? До корінних жителів, які живуть в тропічних дощових лісах?

    Деякі описи ресурсів призначені для використання машинами, що, здавалося б, знижує важливість принципів проектування, що враховують переваги користувача або загальне використання. Однак, навіть якщо ресурси описуються та організовані алгоритмами, коли людям потрібно пояснити класифікації та прогнози, які виробляють алгоритми, описи ресурсів, які зрозумілі та легко передаються, краще статистично оптимальних. Крім того, принципи стандартизації та інтеграції стають більш важливими для міжмашинного зв'язку, щоб забезпечити ефективну обробку, повторне використання даних та програмного забезпечення, а також підвищити сумісність між організаційними системами. [30]

    Контрольовані словники та правила вмісту

    Як ми визначили в розділі «Використовувати керовані словники», керований словник - це фіксований або закритий набір термінів опису в деякій області з точними визначеннями, які використовуються замість словника, який люди інакше використовували б. Наприклад, замість популярних термінів опису захворювань або симптомів медичні дослідники та навчальні лікарні можуть використовувати контрольований словниковий запас Національної бібліотеки медицини (MESH). [31]

    Ми можемо виділити прогресію контролю словникового запасу: глосарій - це набір дозволених термінів; тезаурус - це набір термінів, розташованих в ієрархії та анотованих для позначення термінів, які є кращими, ширшими або вужчими за інші терміни; онтологія виражає концептуальні зв'язки між терміни формальною мовою на основі логіки, щоб вони могли оброблятися комп'ютерами. Ми скажемо більше про онтології в описі відносин і структур.

    Правила вмісту схожі на керовані словники, оскільки вони також обмежують можливі значення, які можна використовувати в описах. Замість того, щоб вказувати фіксований набір значень, правила вмісту зазвичай обмежують описи, вимагаючи від них певного типу даних (ціле число, логічне значення, дата тощо). Можливі значення обмежуються логічними виразами (наприклад, значення має бути від 0 до 99) або регулярними виразами (наприклад, має бути рядком довжиною 5, який повинен починатися з числа). Такі правила вмісту використовуються для забезпечення дійсних описів, коли користувачі вводять їх у веб-формах або інших програмах.

    Контроль словникового запасу як зменшення розмірності

    У більшості випадків керована лексика є підмножиною природного або неконтрольованого словникового запасу, але іноді це новий набір придуманих термінів. Це може здатися дивним, поки ми не вважаємо, що метою контрольованого словника є зменшення кількості описових термінів, призначених ресурсу. Зазначена таким чином проблема зменшення розмірності, перетворення високовимірного простору в нижчевимірний. Зменшення кількості компонентів у багатовимірному описі може бути здійснено за допомогою багатьох різних статистичних методів, які йдуть за іменами, такими як «вилучення ознак», «аналіз основних компонентів», «ортогональне розкладання», «прихований семантичний аналіз, » «багатовимірне масштабування» та «факторний аналіз. » [32]

    Ці методи можуть здатися нав'язливими, і вони обчислювально-складні, але всі вони мають однакову просту концепцію в своїй основі, що особливості або властивості, які описують певний ресурс, часто сильно корелюють. Наприклад, документ, який містить слово «автомобіль», швидше за все містить слова «водій» і «трафік», ніж документ, який цього не робить. Подібні кореляції існують серед візуальних особливостей, що використовуються для опису зображень, і акустичних особливостей, що описують музику. Методи зменшення розмірності аналізують кореляції між описами ресурсів, щоб перетворити великий набір описів у набагато менший набір некорельованих. Таким чином, це реалізує принцип достатності та необхідності, про який ми згадували в «Принципах хорошого опису», оскільки він усуває розміри опису або властивості, які не сприяють особливому розрізненню ресурсів.

    Ось спрощений приклад, який ілюструє ідею. Припустимо, у нас є колекція ресурсів, і кожен ресурс, описаний як «великий», також описується як «червоний», а кожен «маленький» ресурс також «зелений». Це ідеальне співвідношення між кольором і розміром означає, що будь-який з цих властивостей є достатнім, щоб відрізнити «великі червоні» речі від «маленьких зелених», і нам не потрібні розумні алгоритми, щоб зрозуміти це. Але якщо ми маємо тисячі властивостей і кореляції лише часткові, нам потрібні складні статистичні підходи, щоб вибрати оптимальний набір властивостей опису і термінів, а в деяких техніках розміри, які залишаються, називаються «латентними» або «синтетичними». оскільки вони статистично оптимальні, але не відображаються безпосередньо з властивостями ресурсів.

    Проектування форми опису

    На цьому етапі в процесі опису ресурсу ми прийняли численні важливі рішення про те, які ресурси описувати, цілі, для яких ми описуємо, їх, а також властивості та терміни, які ми будемо використовувати в описах. Наскільки це можливо, ми описали кроки на концептуальному рівні і відклали обговорення міркувань реалізації щодо позначення, синтаксису та розгортання описів ресурсів окремо або в пакетах. Відокремлення дизайну від проблем впровадження - це ідеалізація процесу опису ресурсу, але легше вивчити та подумати про опис ресурсів та організацію систем, якщо ми це зробимо. Ці питання реалізації ми обговорюємо в «Формах описів ресурсів».

    Іноді нам доводиться стикатися з застарілими технологіями, існуючими або потенційними діловими відносинами, правилами, відповідністю стандартам, вимогами до продуктивності або іншими факторами, які впливають на те, як описи ресурсів повинні бути реалізовані, збережені та керовані. Ми візьмемо цю більш прагматичну перспективу в Дорожній карті Організаційної системи, Дорожній карті організаційної системи, але до цього часу ми будемо продовжувати зосереджуватися на питаннях проектування та відкладати обговорення варіантів впровадження.

    Створення описів ресурсів

    Описи ресурсів можуть створюватися професіоналами, авторами або творцями ресурсів, користувачами, або обчислювальними або автоматизованими засобами.

    З традиційної точки зору бібліотечної та інформаційної науки з акцентом на бібліографічний опис, ці способи створення передбачають різний рівень складності та вишуканості опису; Тейлор і Джудрі припускають, що професіонали створюють багаті описи, непідготовлені користувачі в кращому випадку створюють структуровані, а автоматизовані процеси створюють прості.

    Ця класифікація більше відображає дисциплінарний та історичний упередження, ніж реальність. «Прості» описи ресурсів - це «не більше, ніж дані, витягнуті з самого ресурсу... підхід пошукової системи до організації Інтернету за допомогою автоматизованих методів індексації. » [33]

    Було б справедливо описати реалізацію інвертованого індексу логічної моделі пошуку інформації як просту, але явно неправильно вважати, що Google та інші пошукові системи роблять для опису та отримання веб-ресурсів як просто. [34]

    Краще поняття рівнів опису ресурсів засноване на кількості інтерпретації, накладеної описом, підході, який фокусується на самих описах, а не на їх методах створення. Цей підхід ми обговоримо в «Описі музейних та художніх ресурсів» в контексті опису музейних та мистецьких ресурсів.

    Професійно створені описи ресурсів, створені автором або користувачем описи, а також обчислювальні або автоматизовані описи мають сильні сторони та обмеження, які накладають компроміси. Природне рішення полягає в тому, щоб спробувати поєднати бажані аспекти з кожного в гібридних підходах. Наприклад, словниковий запас для нового домену ресурсу може виникнути внаслідок позначення кінцевими користувачами, але потім бути вдосконаленим професіоналами, класифікатори можуть створювати описи за допомогою програмних засобів, які пропонують можливі терміни, або програмне забезпечення, яке створює описи, може бути покращено, навчаючи його з людиною- згенеровані описи, форма контрольованого навчання (див. «Категорії, створені за допомогою кластеризації»).

    Часто існуючі описи ресурсів можуть або повинні бути перетворені або вдосконалені для задоволення поточних потреб організаційної системи, а іноді ці процеси можуть бути автоматизовані. Ми відкладемо подальше обговорення цих ситуацій до Взаємодії з ресурсами. У наступному обговоренні ми зосереджуємося на створенні нових описів ресурсів, де їх ще немає.

    Опис ресурсу професіоналами

    Перш ніж Інтернет дозволив майже будь-кому створювати, публікувати та описувати власні ресурси та описувати ті, що створені та опубліковані іншими, опис ресурсів, як правило, робився професіоналами в інституційних контекстах. Професійні індексатори та каталогізатори описували бібліографічні та музейні ресурси після навчання вивченню концепцій, контрольованих описових словників та відповідних стандартів. В області інформаційних систем професійні аналітики даних і процесів, технічні письменники та інші створювали аналогічні суворі описи після проходження аналогічного навчання. Ми назвали ці типи описів ресурсів інституційними, щоб підкреслити контраст між тими, що створені відповідно до стандартів, та тими, що створені неофіційно спеціальними способами, особливо непідготовленими чи недисциплінованими особами. [35]

    Опис ресурсу авторами або творцями

    Автор або творець ресурсу можна вважати, що розуміє причини і цілі, для яких ресурс може бути використаний. І, імовірно, більшість авторів хочуть, щоб їх прочитали, тому вони будуть описувати свої ресурси способами, які сподобаються і будуть корисні їх передбачуваним користувачам. Однак ці описи навряд чи використовуватимуть контрольовані словники та стандарти, які використовуватимуть професійні каталогізатори.

    Опис ресурсу Користувачами

    Сьогоднішня павутина містить приголомшливу кількість ресурсів, більшість з яких є первинними інформаційними ресурсами, опублікованими як веб-контент, але багато інших є ресурсами, які виступають за «в світі» фізичні ресурси. Більшість цих ресурсів описуються їх користувачами, а не професіоналами або їх авторами. Ці «за великим рахунком» користувачі найчастіше створюють описи для власної вигоди, коли вони призначають теги або рейтинги веб-ресурсам, і вони навряд чи будуть використовувати стандартні або контрольовані дескриптори, коли вони це роблять. [36] Результуюча мінливість може бути проблемою, якщо створення опису вимагає судження з боку мітки. Більшість людей можуть погодитися на тривалість певного музичного файлу, але вони можуть різко відрізнятися, коли справа доходить до визначення того, до якого музичного жанру належить цей файл. На щастя, більшість веб-користувачів неявно визнають, що потенційне значення в цих додатках «Web 2.0» або «користувальницький контент» буде більшим, якщо вони уникають егоцентричних описів. Крім того, статистика великих розмірів вибірки неминуче призводить до деякої згоди в описах найпопулярніших додатків, оскільки в частотному розподілі переважають ідіосинкратичні описи більш умовними. [37]

    Ми не припускаємо, що професійні описи завжди мають високу якість та корисність, а соціально вироблені завжди низької якості та корисності. [38] Швидше за все, важливо розуміти обмеження та кваліфікацію описів, що виробляються кожним способом. Теґування знижує бар'єр для введення опису, роблячи організацію більш доступною та створюючи описи, що відображають різноманітні точки зору. Однак, коли багато тегів пов'язані з ресурсом, це збільшує відкликання, одночасно зменшуючи точність. (Див. «Опис ресурсу користувачами»)

    Опис автоматизованого та обчислювального ресурсу

    Файл EXIF зображення, створений цифровою камерою, записує властивості, пов'язані з камерою та її налаштуваннями, а також деякі властивості контексту фотозйомки. (Див. Рис. Контрастні описи для твору мистецтва для прикладу.) Створення цього дуже докладного опису вручну було б майже неможливо. Недоліком, однак, є те, що автоматизований опис не відображає значення фотографії; автоматизований опис зображення фіксує час і місце, але не те, що це картина медового місяця відпустки. Різниця між автоматизованим і людським описом називається семантичним розривом («Семантичний розрив»).

    Будь-який ресурс, який достатньо розумний для збору даних про свій стан або оточення, створює описи ресурсів автоматично (див. «Активні або оперативні ресурси»). Ресурси з обчислювальними можливостями можуть обробляти необроблені дані датчиків для виявлення важливих подій та створення більш інтерпретованих описів.

    Деякі обчислювальні підходи створюють описи ресурсів, схожі за призначенням до тих, що створені людськими описами. Системи видобутку тексту та узагальнення коментарів клієнтів про продукти можуть скоротити тисячі коментарів до списку найважливіших функцій. [39] Люди, які купують книги на Amazon.com, отримують уявлення про зміст книги та відмінність від статистично неймовірних фраз, які вона визначила, порівнюючи всі книги, для яких вона має повний текст. [40]

    Обчислювальні описи можуть використовувати будь-яку спостережувану або приховану змінну (див. Бічну панель, Створення прихованих функцій та рекомендації Netflix), за винятком тих, які заборонені законом, такі як раса, релігія, національне походження та сімейний стан, щоб запобігти дискримінації. Однак на практиці цю заборону легко обійти, оскільки ці властивості зазвичай можна передбачити за допомогою інших. Наприклад, расу часто можна достовірно передбачити, використовуючи адресу проживання та прізвище. [41]

    Звичайно, всі інформаційно-пошукові системи порівнюють опис потреб користувача з описами ресурсів, які можуть їм задовольнити. «Опис нетекстових ресурсів» та у взаємодії з ресурсами.

    Оцінка описів ресурсів

    Оцінка неявна у багатьох заходах організації систем, яку ми описали в розділі Діяльність в організаційних системах, і є явною, коли ми підтримуємо колекцію ресурсів з часом. У цьому розділі ми зупинимося на більш вузькій задачі оцінки описів ресурсів.

    Оцінка означає визначення якості за деякими критеріями або розмірами. Запропоновано безліч різних наборів критеріїв, для репозиторіїв цифрових ресурсів найбільш часто використовуваними є точність, повнота та послідовність. [42] Іншими типовими критеріями є своєчасність, сумісність та зручність використання. Легко уявити ці критерії в конфлікті; зусилля, спрямовані на досягнення точності та повноти, можуть поставити під загрозу своєчасність; забезпечення узгодженості може виключити зміни та персоналізації, які б підвищили зручність використання.

    Які характеристики або критерії ви б використовували для визначення якості автомобіля? З їжі? З одягу? З місця для проживання? Які з цих критеріїв є специфічними для домену, а які застосовуються в цілому до багатьох типів ресурсів?

    Якість результату багатоступінчастого процесу, запропонованого в цьому розділі, є складом якості, створеної або розтраченої на кожному кроці. Обсяг, який є занадто гранульованим або абстрактним, надмірно амбітними або розпливчастими цілями, словниковий запас опису, який важко використовувати, або даючи людям недостатньо часу для створення хороших описів, все це може спричинити проблеми з якістю, але жодне з цих рішень не видно в кінці процес, де користувачі взаємодіють з описами ресурсів.

    Оцінка створення описів ресурсів

    Коли професіонали створюють описи ресурсів централізовано, що вже давно є стандартною практикою для багатьох ресурсів у бібліотеках, є природний акцент на якості в точці створення, щоб гарантувати, що відповідні контрольовані словники та стандарти були використані. Однак необхідність опису ресурсів узагальнюється до доменів ресурсів поза традиційною бібліографічною, і в цих контекстах виникають інші міркування щодо якості.

    Описи ресурсів у фірмах приватного сектору мають важливе значення для ведення бізнесу та ефективної взаємодії з постачальниками, партнерами та клієнтами. Порівняно з державним сектором, набагато більший акцент робиться на економіці та стратегії опису ресурсів. [43] Яке значення опису ресурсу? Хто буде нести витрати на їх виробництво? Які з конкуруючих галузевих стандартів будуть дотримуватися? Деякі з цих рішень не є вільним вибором, оскільки вони є обмеженнями, наведеними як умовою ведення бізнесу з домінуючим економічним партнером, який іноді є державним суб'єктом.

    Наприклад, така фірма, як Wal-Mart з величезною ринковою потужністю, може диктувати умови та стандарти своїм постачальникам, оскільки довгострокові переваги контракту Wal-Mart зазвичай роблять початкове розміщення вартим. Так само уряди часто вимагають від своїх постачальників дотримання відкритих стандартів, щоб уникнути блокування запатентованих технологій. [44]

    Як у державному, так і в приватному секторах спостерігається більш широке використання обчислювальних методів для створення описів ресурсів, оскільки кількість ресурсів, що підлягають опису, просто занадто велика, щоб забезпечити професійний опис. Велика робота з інтелектуального аналізу текстових даних, класифікації веб-сторінок, семантичного збагачення та інших подібних напрямків досліджень вже ведеться і значно знижує витрати на виготовлення корисних описів ресурсів. Деякі музеї використовують підходи, які автоматично створюють орієнтовані на користувача описи ресурсів та нові користувальницькі інтерфейси для пошуку та перегляду, перетворюючи професійні описи у своїх внутрішніх системах управління колекціями. [45] Амбітний проект Google з оцифрування мільйонів книг піддався критиці за якість алгоритмічно витягнутих описів ресурсів, але ми можемо очікувати, що комп'ютерні вчені будуть добре використовувати корпус книг Google як дослідницький тестовий стенд для удосконалювати прийоми. [46]

    Web 2.0 додатки, які отримують свою цінність від агрегації та інтерпретації створеного користувачем контенту, можуть розглядатися як добровільно передаючи свої повноваження описувати та організовувати ресурси своїм користувачам, які потім позначають або оцінюють їх так, як вони вважають за потрібне. У цьому контексті важливою проблемою стає узгодженість опису ресурсу або його відсутність, і багато сайтів використовують технології або стимули, щоб направляти користувачів на створення кращих описів.

    Оцінка використання описів ресурсів

    Незалежно від або на додаток до будь-яких критеріїв якості, що застосовуються до створення та вибору описів ресурсів, в певний момент описи ресурсів відповідають їх передбачуваним користувачам. Найважливішим критерієм якості на цьому етапі є те, чи відповідають описи ресурсів їх цільовим цілям корисним способом. Багато в чому відповідь - невтішний «ні».

    Наприклад, в одній з найбільш ранніх ревізій оригінальних описів ресурсу продовжують мучити користувачів Інтернету. (Див. «Соціальна та веб-курація».)

    Дизайн словникового опису обмежує те, що можна сказати про ресурс, тому важливо визнати, що він неявно визначає те, що також не можна сказати, з ненавмисними негативними наслідками для користувачів. Схема опису ресурсу, реалізована в системі управління пацієнтом лікаря, визначає певні типи записуваної інформації про відвідування пацієнта дату візиту, будь-які тести, які були замовлені, поставлений діагноз, направлення до фахівця. Схема, і пов'язаний з нею робочий процес, накладають обмеження, які впливають на види інформації медичні працівники можуть записувати і обсяг простору, який вони можуть використовувати для цих описів. Більше того, така схема може також усунути життєво важливий неструктурований простір, який можуть надати паперові записи, де лікарі повідомляють про своє обґрунтування діагнозу чи рішення без необхідності вписувати його в якусь конкретну коробку.

    Однак, коли описи ресурсів - це дані, що використовуються для підготовки моделей для прогнозування або класифікації, основна увага оцінки не приділяється описам, які часто вважають точними спостереженнями про світ. Натомість оцінка фокусується на моделі, а «вибір моделі» - це завдання вибору, яка з декількох конкуруючих моделей найкраще відповідає вихідним даними, а також добре узагальнює нові дані. У будь-якому випадку будь-які проблеми з якістю або упередження вибору з вихідними даними підірвуть значення будь-якої обраної моделі.

    Важливість ітераційної оцінки

    Неминучі конфлікти між цілями якості означають, що між критеріями якості будуть компроміси. Крім того, збільшення масштабів в організаційній системі та постійне вдосконалення обчислювальних методів опису ресурсів означають, що характер компромісу буде змінюватися з часом. В результаті однієї оцінки описів ресурсів в один момент часу буде недостатньо.

    Це робить записи про використання, історію навігації та дані транзакцій надзвичайно важливими видами описів ресурсів, оскільки вони дозволяють зосередити зусилля на покращенні якості там, де вони найбільше потрібні. Крім того, для організації систем з багатьма типами ресурсів та спільнот користувачів ця інформація може дозволити адаптувати характер та масштаби опису ресурсів, щоб знайти правильний баланс між «багатим та всеосяжним» та «простим та ефективним» підходами. Кожна комбінація типу ресурсу та спільноти користувачів може мати різне рішення.

    Ідея про те, що якість є властивістю наскрізного процесу, втілюється в «русі якості» та статистичному контролі процесів для промислових процесів, але вона однаково добре застосовується до опису ресурсів. Основна ідея полягає в тому, що якість не може бути перевірена шляхом перевірки кінцевої продукції. Натомість якість досягається за допомогою контролю процесу - вимірювання та усунення мінливості кожного процесу, необхідного для створення продуктів. [47] Явні відгуки користувачів або неявний зворотний зв'язок із записами їхніх потреб у взаємодії з ресурсами є важливими, оскільки ми повторюємо процес проектування та переглядаємо прийняті там рішення.


    1. Оскільки схема реляційної бази даних служить моделлю для створення описів ресурсів, вона призначена для обмеження описів простими і повністю регулярними наборами пар атрибут-значення. Схема бази даних визначає загальну структуру таблиць і особливо їх стовпців, які будуть містити значення атрибутів, що описують кожен ресурс. Таблиця працівника може мати стовпці для атрибутів ідентифікатора працівника, дати найму, відділу та заробітної плати. Атрибут дати буде обмежений значенням, яке є датою, тоді як зарплата працівника буде обмежена відповідно до діапазонів заробітної плати, встановлених відділом кадрів. Це перетворює ім'я атрибута та обмеження на значення атрибутів в описи ресурсів, які застосовуються до всього класу ресурсів, описаних таблицею.

      Часто необхідно пов'язати деякі описи з окремими ресурсами, специфічними для цього екземпляра, та іншими типами описів, які відображають абстрактний клас, до якого належить екземпляр. Коли типовий автомобіль зійде з конвеєра, він має лише один опис рівня екземпляра, який відрізняє його від аналогів: ідентифікаційний номер автомобіля (VIN). Конкретні автомобілі мають індивідуалізовані кольори інтер'єру та екстер'єру та встановлені варіанти, і всі вони мають дату та місце виготовлення. Інші елементи опису мають значення, які поділяються з багатьма іншими автомобілями тієї ж моделі та року, як-от запропонована ціна та додаткові пакети опцій, або конфігурації, які можуть бути застосовані до нього до того, як вона буде доставлена замовнику. Крім того, будь-яка описова інформація, яка застосовується до декількох автомобілів одного і того ж модельного року, може бути частиною опису ресурсу на цьому рівні, на який посилається, а не дублюється в описах екземплярів.


    2. Веб-сервіси, як правило, реалізуються за допомогою (Erl 2005b), особливо гл. 3, Введення в технології веб-служб.


    3. Створення описів, які можуть йти в ногу зі зростанням колекції, було проблемою для бібліотекарів протягом багатьох років, оскільки бібліотеки перейшли від опису просто «того, що натрапилося на стіл каталогізатора» до каталогізації ресурсів для національної та навіть міжнародної аудиторії (Свеноній 2000 р., с. 31).


    4. AACR2 включає правила для книг, брошур та друкованих аркушів; картографічних матеріалів; рукописів та колекцій рукописів; музики; звукозаписів; кінофільмів та відеозаписів; графічних матеріалів; електронних ресурсів; 3-D артефактів; мікроформ; та постійних ресурсів . Короткий (Горман 2004). Словники опису ресурсів та доступу (RDA) є наступниками AACR2 і роблять ще більш точні відмінності між типами ресурсів. Перегляньте списки вмісту RDA, медіа та носіїв.


    5. Ми також можемо розглядати Dublin Core як частину інтелектуальних основ для «краудсорсингу» або «курації спільноти» описів ресурсів непрофесіоналами («Соціальна та веб-курація»). Дивіться Дублінську ініціативу основних метаданих (DCMI) за адресою http://dublincore.org/.


    6. Семантична «тупість» мінімалістичної лексики ілюструється прикладами використання елемента «творець» в офіційному посібнику користувача Dublin Core (Hillmann 2005), який показує «Шекспір, Вільям» та «Хаббл» Телескоп» як творці.


    7. Процесор Intel Core 2 Duo має докладні технічні характеристики (http://www.intel.com/products/processor/core2duo/specifications.htm) та сім категорій технічної документації: примітки до додатків, технічні характеристики, посібники з проектування, посібники, оновлення, компоненти підтримки та білий документи (http://www.intel.com/design/core2duo/documentation.htm).


    8. Оголошення про нерухомість горезвісні своїми творчими описами; будинок «зручний для транспортування», швидше за все, знаходиться поруч з галасливою магістраллю, а будинок в «відокремленому місці» - у віддаленій і пустельній частині міста.


    9. У перші дня. коли споживачі США взагалі не знали, що Sony - японська компанія, а якість японської продукції розглядалася в негативному світлі, Sony зробила б етикетку «Зроблено в Японії» настільки непомітною, наскільки це могло б піти з рук. (Джон 1999)

      Влітку 2015 року організація з захисту прав споживачів Truth in Advertising повідомила про виявлення на веб-сайті Walmart понад 100 описів товарів, неточно представляючи продукцію як вироблену в Сполучених Штатах. (Див. https://www.truthinadvertising.org/walmart-made-in-usa/)


    10. Результати дослідження чотирьох служб знайомств в Інтернеті (Toma et al 2008) показали, що 81% людей брехали принаймні про одну характеристику. Чоловіки частіше брехали про зріст, тоді як жінки брехали більше про вагу, і чим далі їхні фактичні висоти та ваги були від середнього, тим більше вони брехали. Пізніше дослідження (Hall et al 2010) підтвердило знахідку для жінок та ваги, але також виявило, що чоловіки з високою ймовірністю спотворюють свої особисті активи.


    11. Ми стикалися з FRBR кілька разів у попередніх розділах, особливо в «Ідентичність та бібліографічні ресурси», де ми запитали: «Що це за річ, яку ми називаємо «Макбет»? » і який описує FRBR чотирирівневу абстракцію ієрархії твору, зображеного на малюнку: Ієрархія абстракції FRBR

      Фреймворк FRBR - це найновіша формалізація цілей опису ресурсів, яка почалася в бібліотеках дев'ятнадцятого століття. Ця довга історія означає, що не дивно, що те, як ми думаємо про опис ресурсів, все ще показує деяку упередженість до взаємодії з фізичними бібліографічними ресурсами та описами, необхідними для їх отримання.

      Є три члени сім'ї «FRBR. » Одним з членів є «Групи 1 сутностей» - Робота, Вираз, Прояв та Предмет - які використовуються для визначення класів інтелектуальних продуктів та їх стосунків один з одним. Суб'єкти «Групи 2» несуть відповідальність за створення або піклування суб'єктів першої групи — фізичних, сімейних та корпоративних органів. Модель та вимоги Групи 2 були розроблені далі як Функціональні вимоги до даних про повноваження (FRAD), щоб каталоги могли відповідати на питання про відносини між юридичними особами або співробітниками; див. http://www.ifla.org/publications/fun...authority-data і http://archive.ifla.org/VII/d4/wg-franar.htm#Authority. «Суб'єкти групи 3» - це описи суб'єктів для Групи 1 та Групи 2; див. Функціональні вимоги до даних суб'єктів влади (FRSAD) за адресою http://www.ifla.org/node/1297.

      Для бібліографічних ресурсів ці взаємодії та моделі описів ресурсів, необхідні для їх підтримки, були формалізовані як Функціональні вимоги до бібліографічних записів (FRBR). Ми зіткнулися з «Бібліографічними ресурсами, інформаційними компонентами та «Розумними речами» як ресурси»), де ми запитали: «Що це за річ, яку ми називаємо «Макбет»? » і описав роботу.


    12. У дуже напруженому та небезпечному середовищі льотної палуби авіаносця моряки носять жилети та сорочки, які мають кольорове маркування для своїх робочих місць. Наприклад, червоні сорочки обробляють боєприпаси, фіолетові сорочки обробляють паливо, зелені сорочки запускають катапульти і гачки, які запускають і приземляють літаки, а жовті сорочки керують польотами. Колір робить це швидше і займає менше уваги для людей, щоб побачити, чи потрібні люди там, де вони повинні бути

      Офіційна кольорова діаграма флоту для персоналу авіаносців доступна за адресою www.navy.mil/navydata/кораблі/перевізники/rainbow.asp

      Подібний принцип використовується в деяких видах спорту; воротарі носять різні кольорові трикотажні вироби, щоб полегшити виконання правил, конкретні положення, і футбольні захисники носити відмінні практики трикотажні вироби, щоб нагадати оборонним гравцям не вирішувати їх і, можливо, травмувати їх.

      Варто відзначити, що дальтонізм зачіпає приблизно 7% населення.


    13. Некомерційна організація Creative Commons визначає шість видів ліцензій на авторські права, які відрізняються тим, наскільки вони дозволяють комерційне використання або модифікації оригінального ресурсу (див. http://creativecommons.org/licenses/). Додаток для обміну фотографіями Flickr є хорошим прикладом сайту, де пошук багаторазових ресурсів може використовувати ліцензії Creative Commons для фільтрації результатів (http://www.flickr.com/creativecommons/).


    14. Використання тих же стандартів для опису продуктів або визначення виконання бізнес-процесів може полегшити впровадження та експлуатацію інформаційно-ємних бізнес-моделей, оскільки інформація може потім перетікати між службами або фірмами без втручання людини. У свою чергу, це дозволяє бізнесу стати більш попитом або подіями, а не орієнтованими на прогнози, роблячи його більш «адаптивним», «гнучким» або «на вимогу» підприємством. Див. (Глушко та МакГрат 2005), особливо гл. 5, Як розвиваються моделі та закономірності.


    15. Для нових ресурсів трудомістка вартість традиційного бібліографічного опису менш виправдана, коли можна перейти за посиланням з опису ресурсу на описуваний ним цифровий ресурс і швидко вирішити його актуальність. Тобто веб-пошукові системи демонструють, що алгоритмічний аналіз змісту інформаційних ресурсів може зробити їх самоописом в значній мірі, зменшуючи потребу в бібліографічному описі.


    16. Див. Довідкову модель бібліотеки FRBR-бібліотеки


    17. (Свеноній 2000, стор. 18-19).


    18. Кен Холман Остаточний XSLT і XPath (Holman 2001) - це книга, щоб розпочати роботу з XPath, і ніхто не навчив більше людей про XPath, ніж Холман. Перші п'ять годин цілодобового відеокурсу з практичної трансформації за допомогою XSLT та XPath доступні безкоштовно за адресою www.udemy.com/practical-transformation-using-xslt-and-xpath.


    19. (ПРЕМІС 2011). Стандарт стратегій реалізації метаданих збереження (PREMIS) для збереження метаданих підтримується Бібліотекою Конгресу США за адресою http://www.loc.gov/standards/premis/. Гарне місце для початку є 2011 Преміс даних Словник (http://www.loc.gov/standards/premis/v2/premis-2-1.pdf).


    20. (Локер-1893) і (Дзвін 1970)

      Спільна історія збору даних Браге та аналізу та теоретизації Кеплера розповідається в цікавій манері в (Фергюсон 2002). Не менш захоплюючим аналізом, який інтерпретує концептуальні зрушення Кеплера з моделлю аналогічних міркувань, є (Gentner et al., 1997).


    21. Концепція створення сенсу виникла з досліджень бізнес-школи в галузі управління та організаційної теорії (Weick 1995), але широко використовується етнографами в багатьох контекстах, включаючи кімнати швидкої допомоги, класи зі студентами меншин, інспекції безпеки авіакомпаній та злочинності. розслідування. Див. (Weick 2005) і (Розділ 2016)


    22. Razor Occam має давню традицію в науковій філософії, але деякі люди стверджували, що вона переоцінена як евристика для вибору серед альтернативних пояснень або теорій, особливо тому, що це залежить від того, як ви визначаєте простоту.


    23. Один із способів зробити простоту більш корисною як посібник для вибору між математичними моделями - це явно покарати ті, які є більш складними, додаючи помилку до прогнозів, методику, яку комп'ютерні вчені дали неінтуїтивну назву регуляризації. Цей штраф вимагає, щоб складні моделі були значно кращими в поясненні даних, ніж простіші, оскільки вони повинні подолати додані помилки.


    24. Наприклад, склад стільця представлений тут як статична властивість, але насправді дерев'яний стілець може з часом зіпсуватися в результаті впливу сонячних променів, тепла або біологічних агентів, які його атакують. Навичка може вважатися внутрішньою та динамічною, але вона також може сильно залежати від контексту, роблячи її зовнішньою. Тематична категорія, присвоєна книзі, є зовнішньою та статичною, але якщо система класифікації переглядається, книга може бути перекласифікована. Нарешті, хоча розташування ресурсу може бути зовнішнім і динамічним, історія розташування ресурсу в певний момент часу є фактом, внутрішньою і статичною властивістю.


    25. (Dey 2001) додатково визначає «середовище» контексту як місця, люди та речі, і для кожного з «сутностей» існує чотири категорії контекстної інформації: місцезнаходження, ідентичність, статус (або діяльність) та час. Таким чином, ця структура дає 12 вимірів для опису контексту середовища.


    26. Захоплююча історія про дизайн Netflix та використання десятків тисяч піджанрів фільмів у своїй системі рекомендацій є (Madrigal 2014).


    27. Розглянемо, скільки подій названо, додавши суфікс «-gate», щоб означати, що відбувається щось скандальне чи неетичне, що прикривається. Цей культурний опис не відразу має сенсу для тих, хто не знає про злом в штаб-квартирі штаб-квартири Демократичного національного комітету в готелі Уотергейт і подальше прикриття, яке призвело до відставки президента США в 1974 році. Річард Ніксон. Список подій «-gate» ведеться за адресою http://en.Wikipedia.org/wiki/List_of_scandals_with_%22-gate%22_suffix.


    28. (http://en.Wikipedia.org/wiki/Holbein_carpet).


    29. (Свеноній 2000, гл. 5).


    30. (Ласкі 2005).


    31. http://www.ncbi.nlm.nih.gov/mesh/.


    32. Ми не можемо цитувати всю математичну статистику в одній короткій кінцевій нотатці, але якщо ви схильні дізнаватися більше, (Mardia, Kent, and Bibby 1980) і (Lee and Verleysen 2007) є найдобрішими та найніжнішими ресурсами. Якщо ми дуже щедро подивимось на «зменшення розмірності», ми можемо навіть вважати крок індексації усунення «стоп-слів» формою зменшення розмірності. Стоп-слова з'являються з такою високою частотою, що не мають розбірливої сили, тому відкидаються від запитів і не входять до опису індексованих документів.


    33. (Тейлор і Джоудрі 2009), стор. 91.


    34. Див. Гл. 4 з (Buttcher, Clarke та Cormack 2010) для опису простої моделі пошуку булевої інформації та в главах 14 та 15 для описів масштабу Google. Популярне обговорення алгоритму Google див. (Levy 2010).


    35. Багато інституційних організаційних систем підпорядковуються єдиному централізованому або державному органу, який може нав'язувати принципи опису та організації ресурсів. Прикладами організації систем, де ресурси описуються за стандартними централізованими принципами, є:

      Бібліотеки, які використовують національні бібліографічні стандарти для задоволення вимог, встановлених галузевими асоціаціями або іншими органами з акредитації, такими як Асоціація коледжів та дослідницьких бібліотек (ACRL). (http://ala.org/acrl)

      Компанії, які дотримуються галузевих стандартів щодо інформаційних або технологічних моделей, класифікації продукції або ідентифікації, мають право на державний бізнес (Shah and Kesan 2006).

      Законодавчі документи, які відповідають національним або європейським стандартам спільноти щодо структури, найменування та опису (Biasiotti 2008).

      Інтернет-корпорація з присвоєння імен та номерів (ICANN) та її політики щодо роботи системи доменних імен (DNS) дозволяють розміщувати кожен веб-сайт за його логічною назвою (наприклад, «berkeley.edu», а не за допомогою www.icann.org/)

      В інших сферах кілька організацій або установ мають повноваження нав'язувати принципи опису ресурсів. Іноді цей орган походить від добровільної співпраці декількох автономних партій, які встановлюють та відповідають стандартам, оскільки вони отримують вигоду від можливості ділитися ресурсами чи інформацією про ресурси. Прикладами організації систем, де ресурси описуються з використанням стандартизованих децентралізованих принципів, є:

      Фірми, які встановлюють загальнокорпоративні стандарти для своїх інформаційних ресурсів, як правило, включаючи організацію та управління вихідним вмістом, моделі типів документів та посібник зі стилів, який застосовується до друкованих та веб-документів.

      Фірми, які беруть участь у галузевих консорціумах OASIS (http://www.oasis-open.org/) або W3C (http://www.w3.org/) для встановлення специфікацій або технічних рекомендацій для своїх інформаційних систем або веб-служб).


    36. Багато організаційних систем описують та організовують свої фізичні чи інформаційні ресурси спеціальними способами, оскільки особа чи установа, що визначають розташування, є повністю автономними. Це область організації систем, охоплених Девідом Вайнбергером у «Все є різне» (Weinberger 2007).


    37. (Sen et al. 2006) проаналізувати ефекти чотирьох алгоритмів вибору тегів, що використовуються на сайтах, які дозволяють теги користувачів на еволюцію словникового запасу (в літературі частіше називають «конвергенцією тегів»), утиліти тегів, прийняття тегів та задоволеності користувачів.


    38. Але в часто цитованому есе (Doctorow, 2001) провокаційно під назвою Metacrap: Поклавши факел сім солом'яних чоловіків мета-утопії, Корі Доктороу стверджує, що багато створених людиною метаданих низької якості, тому що» люди брешуть, люди ліниві, люди дурні, місія нездійсненна пізнайте себе, схеми не нейтральні, метрики впливають на результати, (і) є не один спосіб щось описати. »


    39. (Ху і Луй 2004).


    40. www.amazon.com/gp/пошук-всередині/sipshelp.html/.


    41. Назва говорить про все: Прогнозна аналітика: сила передбачати, хто натисне, купить, брехати чи помре. (Зігель 2013). Байєсівське прізвище та метод геокодування для прогнозування раси описується (Elliott et al. 2008).


    42. (Парк 2009).


    43. Однак ці проблеми стрімко набувають все більшого значення в державному секторі. Зокрема, багато державних університетів США борються зі скороченнями державного та федерального фінансування, які впливають на бібліотечні послуги та практику.


    44. У більш загальному плані економісти використовують поняття «спосіб обміну» в ділові відносини для включення процедур і норм, які регулюють рутинну поведінку між діловими партнерами. Режим «виходу» - це режим, при якому покупець робить мало довгострокових зобов'язань перед постачальником, а проблеми з постачальником змушують покупця знайти нового. На відміну від цього, в режимі «голосу» набагато більше прихильності та спілкування між сторонами, що зазвичай призводить до вдосконалення процесів та конструкцій. Див. (Помічник і МакДаффі 2003).


    45. (Шміц і чорний 2008).


    46. (Nunberg 2009) назвав якість метаданих Google «катастрофою для вчених», але (Sag 2012) стверджує, що в іншому випадку нехтують «сирітськими роботами» в корпусі Google є «грист для млина даних. »


    47. Сучасний «рух якості» виріс із зусиль США по відновленню Японії після Другої світової війни, а її «Біблія» була Юраном 1951 року з контролю якості Посібник (Juran 1951).