Search (39 results, page 1 of 2)

Kasprzik, A.: Automatisierte und semiautomatisierte Klassifizierung : eine Analyse aktueller Projekte (2014) 0.06

0.055782747 = product of:
  0.22313099 = sum of:
    0.020231893 = weight(_text_:und in 2470) [ClassicSimilarity], result of:
      0.020231893 = score(doc=2470,freq=16.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.41556883 = fieldWeight in 2470, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=2470)
    0.07613816 = weight(_text_:methodik in 2470) [ClassicSimilarity], result of:
      0.07613816 = score(doc=2470,freq=2.0), product of:
        0.15883602 = queryWeight, product of:
          7.230979 = idf(docFreq=86, maxDocs=44218)
          0.021966046 = queryNorm
        0.47935072 = fieldWeight in 2470, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          7.230979 = idf(docFreq=86, maxDocs=44218)
          0.046875 = fieldNorm(doc=2470)
    0.011167361 = weight(_text_:des in 2470) [ClassicSimilarity], result of:
      0.011167361 = score(doc=2470,freq=2.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.18358089 = fieldWeight in 2470, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.046875 = fieldNorm(doc=2470)
    0.019223517 = weight(_text_:der in 2470) [ClassicSimilarity], result of:
      0.019223517 = score(doc=2470,freq=14.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.3917808 = fieldWeight in 2470, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.046875 = fieldNorm(doc=2470)
    0.07613816 = weight(_text_:methodik in 2470) [ClassicSimilarity], result of:
      0.07613816 = score(doc=2470,freq=2.0), product of:
        0.15883602 = queryWeight, product of:
          7.230979 = idf(docFreq=86, maxDocs=44218)
          0.021966046 = queryNorm
        0.47935072 = fieldWeight in 2470, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          7.230979 = idf(docFreq=86, maxDocs=44218)
          0.046875 = fieldNorm(doc=2470)
    0.020231893 = weight(_text_:und in 2470) [ClassicSimilarity], result of:
      0.020231893 = score(doc=2470,freq=16.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.41556883 = fieldWeight in 2470, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=2470)
  0.25 = coord(6/24)

Abstract: Das sprunghafte Anwachsen der Menge digital verfügbarer Dokumente gepaart mit dem Zeit- und Personalmangel an wissenschaftlichen Bibliotheken legt den Einsatz von halb- oder vollautomatischen Verfahren für die verbale und klassifikatorische Inhaltserschließung nahe. Nach einer kurzen allgemeinen Einführung in die gängige Methodik beleuchtet dieser Artikel eine Reihe von Projekten zur automatisierten Klassifizierung aus dem Zeitraum 2007-2012 und aus dem deutschsprachigen Raum. Ein Großteil der vorgestellten Projekte verwendet Methoden des Maschinellen Lernens aus der Künstlichen Intelligenz, arbeitet meist mit angepassten Versionen einer kommerziellen Software und bezieht sich in der Regel auf die Dewey Decimal Classification (DDC). Als Datengrundlage dienen Metadatensätze, Abstracs, Inhaltsverzeichnisse und Volltexte in diversen Datenformaten. Die abschließende Analyse enthält eine Anordnung der Projekte nach einer Reihe von verschiedenen Kriterien und eine Zusammenfassung der aktuellen Lage und der größten Herausfordungen für automatisierte Klassifizierungsverfahren.

Franke-Maier, M.: Anforderungen an die Qualität der Inhaltserschließung im Spannungsfeld von intellektuell und automatisch erzeugten Metadaten (2018) 0.04

0.039747916 = product of:
  0.13627857 = sum of:
    0.014454362 = weight(_text_:und in 5344) [ClassicSimilarity], result of:
      0.014454362 = score(doc=5344,freq=6.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.2968967 = fieldWeight in 5344, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5344)
    0.018425206 = weight(_text_:des in 5344) [ClassicSimilarity], result of:
      0.018425206 = score(doc=5344,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.302893 = fieldWeight in 5344, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5344)
    0.04404146 = weight(_text_:fragen in 5344) [ClassicSimilarity], result of:
      0.04404146 = score(doc=5344,freq=2.0), product of:
        0.11184209 = queryWeight, product of:
          5.0915895 = idf(docFreq=738, maxDocs=44218)
          0.021966046 = queryNorm
        0.39378253 = fieldWeight in 5344, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.0915895 = idf(docFreq=738, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5344)
    0.023975939 = weight(_text_:der in 5344) [ClassicSimilarity], result of:
      0.023975939 = score(doc=5344,freq=16.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.4886365 = fieldWeight in 5344, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5344)
    0.010510888 = product of:
      0.021021776 = sum of:
        0.021021776 = weight(_text_:29 in 5344) [ClassicSimilarity], result of:
          0.021021776 = score(doc=5344,freq=2.0), product of:
            0.07726968 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.021966046 = queryNorm
            0.27205724 = fieldWeight in 5344, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0546875 = fieldNorm(doc=5344)
      0.5 = coord(1/2)
    0.014454362 = weight(_text_:und in 5344) [ClassicSimilarity], result of:
      0.014454362 = score(doc=5344,freq=6.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.2968967 = fieldWeight in 5344, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5344)
    0.010416336 = product of:
      0.020832673 = sum of:
        0.020832673 = weight(_text_:22 in 5344) [ClassicSimilarity], result of:
          0.020832673 = score(doc=5344,freq=2.0), product of:
            0.07692135 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.021966046 = queryNorm
            0.2708308 = fieldWeight in 5344, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0546875 = fieldNorm(doc=5344)
      0.5 = coord(1/2)
  0.29166666 = coord(7/24)

Abstract: Spätestens seit dem Deutschen Bibliothekartag 2018 hat sich die Diskussion zu den automatischen Verfahren der Inhaltserschließung der Deutschen Nationalbibliothek von einer politisch geführten Diskussion in eine Qualitätsdiskussion verwandelt. Der folgende Beitrag beschäftigt sich mit Fragen der Qualität von Inhaltserschließung in digitalen Zeiten, wo heterogene Erzeugnisse unterschiedlicher Verfahren aufeinandertreffen und versucht, wichtige Anforderungen an Qualität zu definieren. Dieser Tagungsbeitrag fasst die vom Autor als Impulse vorgetragenen Ideen beim Workshop der FAG "Erschließung und Informationsvermittlung" des GBV am 29. August 2018 in Kiel zusammen. Der Workshop fand im Rahmen der 22. Verbundkonferenz des GBV statt.

Kasprzik, A.: Voraussetzungen und Anwendungspotentiale einer präzisen Sacherschließung aus Sicht der Wissenschaft (2018) 0.04

0.0354701 = product of:
  0.1418804 = sum of:
    0.020441556 = weight(_text_:und in 5195) [ClassicSimilarity], result of:
      0.020441556 = score(doc=5195,freq=12.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.41987535 = fieldWeight in 5195, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5195)
    0.018425206 = weight(_text_:des in 5195) [ClassicSimilarity], result of:
      0.018425206 = score(doc=5195,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.302893 = fieldWeight in 5195, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5195)
    0.04404146 = weight(_text_:fragen in 5195) [ClassicSimilarity], result of:
      0.04404146 = score(doc=5195,freq=2.0), product of:
        0.11184209 = queryWeight, product of:
          5.0915895 = idf(docFreq=738, maxDocs=44218)
          0.021966046 = queryNorm
        0.39378253 = fieldWeight in 5195, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.0915895 = idf(docFreq=738, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5195)
    0.02811428 = weight(_text_:der in 5195) [ClassicSimilarity], result of:
      0.02811428 = score(doc=5195,freq=22.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.57297707 = fieldWeight in 5195, product of:
          4.690416 = tf(freq=22.0), with freq of:
            22.0 = termFreq=22.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5195)
    0.020441556 = weight(_text_:und in 5195) [ClassicSimilarity], result of:
      0.020441556 = score(doc=5195,freq=12.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.41987535 = fieldWeight in 5195, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5195)
    0.010416336 = product of:
      0.020832673 = sum of:
        0.020832673 = weight(_text_:22 in 5195) [ClassicSimilarity], result of:
          0.020832673 = score(doc=5195,freq=2.0), product of:
            0.07692135 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.021966046 = queryNorm
            0.2708308 = fieldWeight in 5195, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0546875 = fieldNorm(doc=5195)
      0.5 = coord(1/2)
  0.25 = coord(6/24)

Abstract: Große Aufmerksamkeit richtet sich im Moment auf das Potential von automatisierten Methoden in der Sacherschließung und deren Interaktionsmöglichkeiten mit intellektuellen Methoden. In diesem Kontext befasst sich der vorliegende Beitrag mit den folgenden Fragen: Was sind die Anforderungen an bibliothekarische Metadaten aus Sicht der Wissenschaft? Was wird gebraucht, um den Informationsbedarf der Fachcommunities zu bedienen? Und was bedeutet das entsprechend für die Automatisierung der Metadatenerstellung und -pflege? Dieser Beitrag fasst die von der Autorin eingenommene Position in einem Impulsvortrag und der Podiumsdiskussion beim Workshop der FAG "Erschließung und Informationsvermittlung" des GBV zusammen. Der Workshop fand im Rahmen der 22. Verbundkonferenz des GBV statt.

Carevic, Z.: Semi-automatische Verschlagwortung zur Integration externer semantischer Inhalte innerhalb einer medizinischen Kooperationsplattform (2012) 0.02
```
0.022223193 = product of:
  0.106671326 = sum of:
    0.011680889 = weight(_text_:und in 897) [ClassicSimilarity], result of:
      0.011680889 = score(doc=897,freq=12.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.23992877 = fieldWeight in 897, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=897)
    0.014889815 = weight(_text_:des in 897) [ClassicSimilarity], result of:
      0.014889815 = score(doc=897,freq=8.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.24477452 = fieldWeight in 897, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.03125 = fieldNorm(doc=897)
    0.023730025 = weight(_text_:der in 897) [ClassicSimilarity], result of:
      0.023730025 = score(doc=897,freq=48.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.4836247 = fieldWeight in 897, product of:
          6.928203 = tf(freq=48.0), with freq of:
            48.0 = termFreq=48.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.03125 = fieldNorm(doc=897)
    0.04468971 = weight(_text_:allgemeines in 897) [ClassicSimilarity], result of:
      0.04468971 = score(doc=897,freq=4.0), product of:
        0.12532558 = queryWeight, product of:
          5.705423 = idf(docFreq=399, maxDocs=44218)
          0.021966046 = queryNorm
        0.35658893 = fieldWeight in 897, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          5.705423 = idf(docFreq=399, maxDocs=44218)
          0.03125 = fieldNorm(doc=897)
    0.011680889 = weight(_text_:und in 897) [ClassicSimilarity], result of:
      0.011680889 = score(doc=897,freq=12.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.23992877 = fieldWeight in 897, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=897)
  0.20833333 = coord(5/24)
```
Abstract

Die vorliegende Arbeit beschäftigt sich mit der Integration von externen semantischen Inhalten auf Basis eines medizinischen Begriffssystems. Die zugrundeliegende Annahme ist, dass die Verwendung einer einheitlichen Terminologie auf Seiten des Anfragesystems und der Wissensbasis zu qualitativ hochwertigen Ergebnissen führt. Um dies zu erreichen muss auf Seiten des Anfragesystems eine Abbildung natürlicher Sprache auf die verwendete Terminologie gewährleistet werden. Dies geschieht auf Basis einer (semi-)automatischen Verschlagwortung textbasierter Inhalte. Im Wesentlichen lassen sich folgende Fragestellungen festhalten: Automatische Verschlagwortung textbasierter Inhalte Kann eine automatische Verschlagwortung textbasierter Inhalte auf Basis eines Begriffssystems optimiert werden? Der zentrale Aspekt der vorliegenden Arbeit ist die (semi-)automatische Verschlagwortung textbasierter Inhalte auf Basis eines medizinischen Begriffssystems. Zu diesem Zweck wird der aktuelle Stand der Forschung betrachtet. Es werden eine Reihe von Tokenizern verglichen um zu erfahren welche Algorithmen sich zur Ermittlung von Wortgrenzen eignen. Speziell wird betrachtet, wie die Ermittlung von Wortgrenzen in einer domänenspezifischen Umgebung eingesetzt werden kann. Auf Basis von identifizierten Token in einem Text werden die Auswirkungen des Stemming und POS-Tagging auf die Gesamtmenge der zu analysierenden Inhalte beobachtet. Abschließend wird evaluiert wie ein kontrolliertes Vokabular die Präzision bei der Verschlagwortung erhöhen kann. Dies geschieht unter der Annahme dass domänenspezifische Inhalte auch innerhalb eines domänenspezifischen Begriffssystems definiert sind. Zu diesem Zweck wird ein allgemeines Prozessmodell entwickelt anhand dessen eine Verschlagwortung vorgenommen wird.
Integration externer Inhalte Inwieweit kann die Nutzung einer einheitlichen Terminologie zwischen Anfragesystem und Wissensbasis den Prozess der Informationsbeschaffung unterstützen? Zu diesem Zweck wird in einer ersten Phase ermittelt welche Wissensbasen aus der medizinischen Domäne in der Linked Data Cloud zur Verfügung stehen. Aufbauend auf den Ergebnissen werden Informationen aus verschiedenen dezentralen Wissensbasen exemplarisch integriert. Der Fokus der Betrachtung liegt dabei auf der verwendeten Terminologie sowie der Nutzung von Semantic Web Technologien. Neben Informationen aus der Linked Data Cloud erfolgt eine Suche nach medizinischer Literatur in PubMed. Wie auch in der Linked Data Cloud erfolgt die Integration unter Verwendung einer einheitlichen Terminologie. Eine weitere Fragestellung ist, wie Informationen aus insgesamt 21. Mio Aufsatzzitaten in PubMed sinnvoll integriert werden können. Dabei wird ermittelt welche Mechanismen eingesetzt werden können um die Präzision der Ergebnisse zu optimieren. Eignung medizinischer Begriffssystem Welche medizinischen Begriffssysteme existieren und wie eignen sich diese als zugrungeliegendes Vokabular für die automatische Verschlagwortung und Integration semantischer Inhalte? Der Fokus liegt dabei speziell auf einer Bewertung der Reichhaltigkeit von Begriffssystemen, wobei insbesondere der Detaillierungsgrad von Interesse ist. Handelt es sich um ein spezifisches oder allgemeines Begriffssystem und eignet sich dieses auch dafür bestimmte Teilaspekte der Medizin, wie bspw. die Chirurige oder die Anästhesie, in einer ausreichenden Tiefe zu beschreiben?

Content

Masterarbeit, ausgearbeitet von Zeljko Carevic zur Erlangung des akademischen Grades Master of Science vorgelegt an der Fachhochschule Köln Campus Gummersbach im Studiengang Medieninformatik. Vgl.. unter: http://opus.bibl.fh-koeln.de/volltexte/2012/376/pdf/Carevic.pdf.

Kempf, A.O.: Neue Verfahrenswege der Wissensorganisation : eine Evaluation automatischer Indexierung in der sozialwissenschaftlichen Fachinformation (2017) 0.02

0.02004669 = product of:
  0.096224114 = sum of:
    0.016690461 = weight(_text_:und in 3497) [ClassicSimilarity], result of:
      0.016690461 = score(doc=3497,freq=8.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.34282678 = fieldWeight in 3497, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3497)
    0.018425206 = weight(_text_:des in 3497) [ClassicSimilarity], result of:
      0.018425206 = score(doc=3497,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.302893 = fieldWeight in 3497, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3497)
    0.033907097 = weight(_text_:der in 3497) [ClassicSimilarity], result of:
      0.033907097 = score(doc=3497,freq=32.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.69103634 = fieldWeight in 3497, product of:
          5.656854 = tf(freq=32.0), with freq of:
            32.0 = termFreq=32.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3497)
    0.010510888 = product of:
      0.021021776 = sum of:
        0.021021776 = weight(_text_:29 in 3497) [ClassicSimilarity], result of:
          0.021021776 = score(doc=3497,freq=2.0), product of:
            0.07726968 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.021966046 = queryNorm
            0.27205724 = fieldWeight in 3497, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0546875 = fieldNorm(doc=3497)
      0.5 = coord(1/2)
    0.016690461 = weight(_text_:und in 3497) [ClassicSimilarity], result of:
      0.016690461 = score(doc=3497,freq=8.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.34282678 = fieldWeight in 3497, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3497)
  0.20833333 = coord(5/24)

Series: Fortschritte in der Wissensorganisation; Bd.13
Source: Theorie, Semantik und Organisation von Wissen: Proceedings der 13. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) und dem 13. Internationalen Symposium der Informationswissenschaft der Higher Education Association for Information Science (HI) Potsdam (19.-20.03.2013): 'Theory, Information and Organization of Knowledge' / Proceedings der 14. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) und Natural Language & Information Systems (NLDB) Passau (16.06.2015): 'Lexical Resources for Knowledge Organization' / Proceedings des Workshops der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) auf der SEMANTICS Leipzig (1.09.2014): 'Knowledge Organization and Semantic Web' / Proceedings des Workshops der Polnischen und Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) Cottbus (29.-30.09.2011): 'Economics of Knowledge Production and Organization'. Hrsg. von W. Babik, H.P. Ohly u. K. Weber

Schulz, K.U.; Brunner, L.: Vollautomatische thematische Verschlagwortung großer Textkollektionen mittels semantischer Netze (2017) 0.02

0.01959046 = product of:
  0.09403421 = sum of:
    0.016690461 = weight(_text_:und in 3493) [ClassicSimilarity], result of:
      0.016690461 = score(doc=3493,freq=8.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.34282678 = fieldWeight in 3493, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3493)
    0.018425206 = weight(_text_:des in 3493) [ClassicSimilarity], result of:
      0.018425206 = score(doc=3493,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.302893 = fieldWeight in 3493, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3493)
    0.031717185 = weight(_text_:der in 3493) [ClassicSimilarity], result of:
      0.031717185 = score(doc=3493,freq=28.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.6464053 = fieldWeight in 3493, product of:
          5.2915025 = tf(freq=28.0), with freq of:
            28.0 = termFreq=28.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3493)
    0.010510888 = product of:
      0.021021776 = sum of:
        0.021021776 = weight(_text_:29 in 3493) [ClassicSimilarity], result of:
          0.021021776 = score(doc=3493,freq=2.0), product of:
            0.07726968 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.021966046 = queryNorm
            0.27205724 = fieldWeight in 3493, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0546875 = fieldNorm(doc=3493)
      0.5 = coord(1/2)
    0.016690461 = weight(_text_:und in 3493) [ClassicSimilarity], result of:
      0.016690461 = score(doc=3493,freq=8.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.34282678 = fieldWeight in 3493, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3493)
  0.20833333 = coord(5/24)

Series: Fortschritte in der Wissensorganisation; Bd.13
Source: Theorie, Semantik und Organisation von Wissen: Proceedings der 13. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) und dem 13. Internationalen Symposium der Informationswissenschaft der Higher Education Association for Information Science (HI) Potsdam (19.-20.03.2013): 'Theory, Information and Organization of Knowledge' / Proceedings der 14. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) und Natural Language & Information Systems (NLDB) Passau (16.06.2015): 'Lexical Resources for Knowledge Organization' / Proceedings des Workshops der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) auf der SEMANTICS Leipzig (1.09.2014): 'Knowledge Organization and Semantic Web' / Proceedings des Workshops der Polnischen und Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) Cottbus (29.-30.09.2011): 'Economics of Knowledge Production and Organization'. Hrsg. von W. Babik, H.P. Ohly u. K. Weber

Böhm, A.; Seifert, C.; Schlötterer, J.; Granitzer, M.: Identifying tweets from the economic domain (2017) 0.02

0.01959046 = product of:
  0.09403421 = sum of:
    0.016690461 = weight(_text_:und in 3495) [ClassicSimilarity], result of:
      0.016690461 = score(doc=3495,freq=8.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.34282678 = fieldWeight in 3495, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3495)
    0.018425206 = weight(_text_:des in 3495) [ClassicSimilarity], result of:
      0.018425206 = score(doc=3495,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.302893 = fieldWeight in 3495, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3495)
    0.031717185 = weight(_text_:der in 3495) [ClassicSimilarity], result of:
      0.031717185 = score(doc=3495,freq=28.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.6464053 = fieldWeight in 3495, product of:
          5.2915025 = tf(freq=28.0), with freq of:
            28.0 = termFreq=28.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3495)
    0.010510888 = product of:
      0.021021776 = sum of:
        0.021021776 = weight(_text_:29 in 3495) [ClassicSimilarity], result of:
          0.021021776 = score(doc=3495,freq=2.0), product of:
            0.07726968 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.021966046 = queryNorm
            0.27205724 = fieldWeight in 3495, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0546875 = fieldNorm(doc=3495)
      0.5 = coord(1/2)
    0.016690461 = weight(_text_:und in 3495) [ClassicSimilarity], result of:
      0.016690461 = score(doc=3495,freq=8.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.34282678 = fieldWeight in 3495, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3495)
  0.20833333 = coord(5/24)

Series: Fortschritte in der Wissensorganisation; Bd.13
Source: Theorie, Semantik und Organisation von Wissen: Proceedings der 13. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) und dem 13. Internationalen Symposium der Informationswissenschaft der Higher Education Association for Information Science (HI) Potsdam (19.-20.03.2013): 'Theory, Information and Organization of Knowledge' / Proceedings der 14. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) und Natural Language & Information Systems (NLDB) Passau (16.06.2015): 'Lexical Resources for Knowledge Organization' / Proceedings des Workshops der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) auf der SEMANTICS Leipzig (1.09.2014): 'Knowledge Organization and Semantic Web' / Proceedings des Workshops der Polnischen und Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation (ISKO) Cottbus (29.-30.09.2011): 'Economics of Knowledge Production and Organization'. Hrsg. von W. Babik, H.P. Ohly u. K. Weber

Glaesener, L.: Automatisches Indexieren einer informationswissenschaftlichen Datenbank mit Mehrwortgruppen (2012) 0.02

0.018504636 = product of:
  0.08882225 = sum of:
    0.021326289 = weight(_text_:und in 401) [ClassicSimilarity], result of:
      0.021326289 = score(doc=401,freq=10.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.438048 = fieldWeight in 401, product of:
          3.1622777 = tf(freq=10.0), with freq of:
            10.0 = termFreq=10.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=401)
    0.014889815 = weight(_text_:des in 401) [ClassicSimilarity], result of:
      0.014889815 = score(doc=401,freq=2.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.24477452 = fieldWeight in 401, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0625 = fieldNorm(doc=401)
    0.019375484 = weight(_text_:der in 401) [ClassicSimilarity], result of:
      0.019375484 = score(doc=401,freq=8.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.3948779 = fieldWeight in 401, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0625 = fieldNorm(doc=401)
    0.021326289 = weight(_text_:und in 401) [ClassicSimilarity], result of:
      0.021326289 = score(doc=401,freq=10.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.438048 = fieldWeight in 401, product of:
          3.1622777 = tf(freq=10.0), with freq of:
            10.0 = termFreq=10.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=401)
    0.011904384 = product of:
      0.023808768 = sum of:
        0.023808768 = weight(_text_:22 in 401) [ClassicSimilarity], result of:
          0.023808768 = score(doc=401,freq=2.0), product of:
            0.07692135 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.021966046 = queryNorm
            0.30952093 = fieldWeight in 401, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0625 = fieldNorm(doc=401)
      0.5 = coord(1/2)
  0.20833333 = coord(5/24)

Abstract: Ein Bericht über die Ergebnisse und die Prozessanalyse einer automatischen Indexierung mit Mehrwortgruppen. Diese Bachelorarbeit beschreibt, inwieweit der Inhalt informationswissenschaftlicher Fachtexte durch informationswissenschaftliches Fachvokabular erschlossen werden kann und sollte und dass in diesen wissenschaftlichen Texten ein Großteil der fachlichen Inhalte in Mehrwortgruppen vorkommt. Die Ergebnisse wurden durch eine automatische Indexierung mit Mehrwortgruppen mithilfe des Programme Lingo an einer informationswissenschaftlichen Datenbank ermittelt.
Content: Bachelorarbeit im Studiengang Bibliothekswesen der Fakultät für Informations- und Kommunikationswissenschaften an der Fachhochschule Köln.
Date: 11. 9.2012 19:43:22
Imprint: Köln : Fachhochschule / Fakultät für Informations- und Kommunikationswissenschaften

Groß, T.: Automatische Indexierung von Dokumenten in einer wissenschaftlichen Bibliothek : Implementierung und Evaluierung am Beispiel der Deutschen Zentralbibliothek für Wirtschaftswissenschaften (2011) 0.02

0.01732446 = product of:
  0.08315741 = sum of:
    0.018849954 = weight(_text_:und in 1083) [ClassicSimilarity], result of:
      0.018849954 = score(doc=1083,freq=20.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.3871834 = fieldWeight in 1083, product of:
          4.472136 = tf(freq=20.0), with freq of:
            20.0 = termFreq=20.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1083)
    0.016118698 = weight(_text_:des in 1083) [ClassicSimilarity], result of:
      0.016118698 = score(doc=1083,freq=6.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.2649762 = fieldWeight in 1083, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1083)
    0.021831032 = weight(_text_:der in 1083) [ClassicSimilarity], result of:
      0.021831032 = score(doc=1083,freq=26.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.4449227 = fieldWeight in 1083, product of:
          5.0990195 = tf(freq=26.0), with freq of:
            26.0 = termFreq=26.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1083)
    0.0075077773 = product of:
      0.015015555 = sum of:
        0.015015555 = weight(_text_:29 in 1083) [ClassicSimilarity], result of:
          0.015015555 = score(doc=1083,freq=2.0), product of:
            0.07726968 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.021966046 = queryNorm
            0.19432661 = fieldWeight in 1083, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0390625 = fieldNorm(doc=1083)
      0.5 = coord(1/2)
    0.018849954 = weight(_text_:und in 1083) [ClassicSimilarity], result of:
      0.018849954 = score(doc=1083,freq=20.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.3871834 = fieldWeight in 1083, product of:
          4.472136 = tf(freq=20.0), with freq of:
            20.0 = termFreq=20.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1083)
  0.20833333 = coord(5/24)

Abstract: Die Bewertung der Indexierungsqualität bzw. -güte ist ein grundlegendes Problem von intellektuellen und automatischen Indexierungsverfahren. Letztere werden aber gerade im digitalen Zeitalter als einzige Möglichkeit angesehen, den zunehmenden Schwierigkeiten bibliothekarischer Informationsstrukturierung gerecht zu werden. Diese Studie befasst sich mit der Funktionsweise, Implementierung und Evaluierung der Sacherschließungssoftware MindServer Categorizer der Firma Recommind an der Deutschen Zentralbibliothek für Wirtschaftswissenschaften. Grundlage der maschinellen Sacherschließung und anschließenden quantitativen und qualitativen Auswertung bilden rund 39.000 wirtschaftswissenschaftliche Dokumente aus den Datenbanken Econis und EconStor. Unter Zuhilfenahme des rund 6.000 Schlagwörter umfassenden Standard-Thesaurus Wirtschaft wird der ursprünglich rein statistische Indexierungsansatz des MindServer Categorizer zu einem begriffsorientierten Verfahren weiterentwickelt und zur Inhaltserschließung digitaler Informationsressourcen eingesetzt. Der zentrale Fokus dieser Studie liegt vor allem auf der Evaluierung der maschinell beschlagworteten Titel, in Anlehnung an die hierzu von Stock und Lancaster vorgeschlagenen Kriterien: Indexierungskonsistenz, -tiefe, -breite, -spezifität, -effektivität. Weiterhin wird die Belegungsbilanz des STW evaluiert und es erfolgt zusätzlich eine qualitative, stichprobenartige Bewertung der Ergebnisse seitens der zuständigen Fachreferenten und -referentinnen.
Date: 19. 6.2015 18:00:29

Beckmann, R.; Hinrichs, I.; Janßen, M.; Milmeister, G.; Schäuble, P.: ¬Der Digitale Assistent DA-3 : Eine Plattform für die Inhaltserschließung (2019) 0.02

0.017269762 = product of:
  0.08289486 = sum of:
    0.006274925 = product of:
      0.018824775 = sum of:
        0.018824775 = weight(_text_:p in 5408) [ClassicSimilarity], result of:
          0.018824775 = score(doc=5408,freq=2.0), product of:
            0.078979194 = queryWeight, product of:
              3.5955126 = idf(docFreq=3298, maxDocs=44218)
              0.021966046 = queryNorm
            0.23835106 = fieldWeight in 5408, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5955126 = idf(docFreq=3298, maxDocs=44218)
              0.046875 = fieldNorm(doc=5408)
      0.33333334 = coord(1/3)
    0.018925203 = weight(_text_:und in 5408) [ClassicSimilarity], result of:
      0.018925203 = score(doc=5408,freq=14.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.38872904 = fieldWeight in 5408, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=5408)
    0.015793033 = weight(_text_:des in 5408) [ClassicSimilarity], result of:
      0.015793033 = score(doc=5408,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.25962257 = fieldWeight in 5408, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.046875 = fieldNorm(doc=5408)
    0.022976499 = weight(_text_:der in 5408) [ClassicSimilarity], result of:
      0.022976499 = score(doc=5408,freq=20.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.46826762 = fieldWeight in 5408, product of:
          4.472136 = tf(freq=20.0), with freq of:
            20.0 = termFreq=20.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.046875 = fieldNorm(doc=5408)
    0.018925203 = weight(_text_:und in 5408) [ClassicSimilarity], result of:
      0.018925203 = score(doc=5408,freq=14.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.38872904 = fieldWeight in 5408, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=5408)
  0.20833333 = coord(5/24)

Abstract: Der "Digitale Assistent" DA-3 ist ein webbasiertes Tool zur maschinellen Unterstützung der intellektuellen verbalen und klassifikatorischen Inhaltserschließung. Im Frühjahr 2016 wurde einer breiteren Fachöffentlichkeit die zunächst für den Einsatz im IBS|BW-Konsortium konzipierte Vorgängerversion DA-2 vorgestellt. Die Community nahm die Entwicklung vor dem Hintergrund der strategischen Diskussionen um zukunftsfähige Verfahren der Inhaltserschließung mit großem Interesse auf. Inzwischen wird das Tool in einem auf drei Jahre angelegten Kooperationsprojekt zwischen der Firma Eurospider Information Technology, dem IBS|BW-Konsortium, der Staatsbibliothek zu Berlin und den beiden Verbundzentralen VZG und BSZ zu einem zentralen und leistungsstarken Service weiterentwickelt. Die ersten Anwenderbibliotheken in SWB und GBV setzen den DA-3 während dieser Projektphase bereits erfolgreich ein, am Ende ist die Überführung in den Routinebetrieb vorgesehen. Der Beitrag beschreibt den derzeitigen Stand und Nutzen des Projekts im Kontext der aktuellen Rahmenbedingungen, stellt ausführlich die Funktionalitäten des DA-3 vor, gibt einen kleinen Einblick hinter die Kulissen der Projektpartner und einen Ausblick auf kommende Entwicklungsschritte.

Junger, U.; Schwens, U.: ¬Die inhaltliche Erschließung des schriftlichen kulturellen Erbes auf dem Weg in die Zukunft : Automatische Vergabe von Schlagwörtern in der Deutschen Nationalbibliothek (2017) 0.02

0.017152896 = product of:
  0.08233391 = sum of:
    0.022303566 = weight(_text_:und in 3780) [ClassicSimilarity], result of:
      0.022303566 = score(doc=3780,freq=28.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.45812157 = fieldWeight in 3780, product of:
          5.2915025 = tf(freq=28.0), with freq of:
            28.0 = termFreq=28.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3780)
    0.013160862 = weight(_text_:des in 3780) [ClassicSimilarity], result of:
      0.013160862 = score(doc=3780,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.21635216 = fieldWeight in 3780, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3780)
    0.01712567 = weight(_text_:der in 3780) [ClassicSimilarity], result of:
      0.01712567 = score(doc=3780,freq=16.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.34902605 = fieldWeight in 3780, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3780)
    0.022303566 = weight(_text_:und in 3780) [ClassicSimilarity], result of:
      0.022303566 = score(doc=3780,freq=28.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.45812157 = fieldWeight in 3780, product of:
          5.2915025 = tf(freq=28.0), with freq of:
            28.0 = termFreq=28.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3780)
    0.00744024 = product of:
      0.01488048 = sum of:
        0.01488048 = weight(_text_:22 in 3780) [ClassicSimilarity], result of:
          0.01488048 = score(doc=3780,freq=2.0), product of:
            0.07692135 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.021966046 = queryNorm
            0.19345059 = fieldWeight in 3780, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0390625 = fieldNorm(doc=3780)
      0.5 = coord(1/2)
  0.20833333 = coord(5/24)

Abstract: Wir leben im 21. Jahrhundert, und vieles, was vor hundert und noch vor fünfzig Jahren als Science Fiction abgetan worden wäre, ist mittlerweile Realität. Raumsonden fliegen zum Mars, machen dort Experimente und liefern Daten zur Erde zurück. Roboter werden für Routineaufgaben eingesetzt, zum Beispiel in der Industrie oder in der Medizin. Digitalisierung, künstliche Intelligenz und automatisierte Verfahren sind kaum mehr aus unserem Alltag wegzudenken. Grundlage vieler Prozesse sind lernende Algorithmen. Die fortschreitende digitale Transformation ist global und umfasst alle Lebens- und Arbeitsbereiche: Wirtschaft, Gesellschaft und Politik. Sie eröffnet neue Möglichkeiten, von denen auch Bibliotheken profitieren. Der starke Anstieg digitaler Publikationen, die einen wichtigen und prozentual immer größer werdenden Teil des Kulturerbes darstellen, sollte für Bibliotheken Anlass sein, diese Möglichkeiten aktiv aufzugreifen und einzusetzen. Die Auswertbarkeit digitaler Inhalte, beispielsweise durch Text- and Data-Mining (TDM), und die Entwicklung technischer Verfahren, mittels derer Inhalte miteinander vernetzt und semantisch in Beziehung gesetzt werden können, bieten Raum, auch bibliothekarische Erschließungsverfahren neu zu denken. Daher beschäftigt sich die Deutsche Nationalbibliothek (DNB) seit einigen Jahren mit der Frage, wie sich die Prozesse bei der Erschließung von Medienwerken verbessern und maschinell unterstützen lassen. Sie steht dabei im regelmäßigen kollegialen Austausch mit anderen Bibliotheken, die sich ebenfalls aktiv mit dieser Fragestellung befassen, sowie mit europäischen Nationalbibliotheken, die ihrerseits Interesse an dem Thema und den Erfahrungen der DNB haben. Als Nationalbibliothek mit umfangreichen Beständen an digitalen Publikationen hat die DNB auch Expertise bei der digitalen Langzeitarchivierung aufgebaut und ist im Netzwerk ihrer Partner als kompetente Gesprächspartnerin geschätzt.
Date: 19. 8.2017 9:24:22

Malits, A.; Schäuble, P.: ¬Der Digitale Assistent : halbautomatisches Verfahren der Sacherschließung in der Zentralbibliothek Zürich (2014) 0.02

0.016728481 = product of:
  0.08029671 = sum of:
    0.007320746 = product of:
      0.021962237 = sum of:
        0.021962237 = weight(_text_:p in 2562) [ClassicSimilarity], result of:
          0.021962237 = score(doc=2562,freq=2.0), product of:
            0.078979194 = queryWeight, product of:
              3.5955126 = idf(docFreq=3298, maxDocs=44218)
              0.021966046 = queryNorm
            0.27807623 = fieldWeight in 2562, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5955126 = idf(docFreq=3298, maxDocs=44218)
              0.0546875 = fieldNorm(doc=2562)
      0.33333334 = coord(1/3)
    0.011801938 = weight(_text_:und in 2562) [ClassicSimilarity], result of:
      0.011801938 = score(doc=2562,freq=4.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.24241515 = fieldWeight in 2562, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=2562)
    0.022566179 = weight(_text_:des in 2562) [ClassicSimilarity], result of:
      0.022566179 = score(doc=2562,freq=6.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.3709667 = fieldWeight in 2562, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0546875 = fieldNorm(doc=2562)
    0.026805915 = weight(_text_:der in 2562) [ClassicSimilarity], result of:
      0.026805915 = score(doc=2562,freq=20.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.5463122 = fieldWeight in 2562, product of:
          4.472136 = tf(freq=20.0), with freq of:
            20.0 = termFreq=20.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0546875 = fieldNorm(doc=2562)
    0.011801938 = weight(_text_:und in 2562) [ClassicSimilarity], result of:
      0.011801938 = score(doc=2562,freq=4.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.24241515 = fieldWeight in 2562, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=2562)
  0.20833333 = coord(5/24)

Abstract: Seit Juni 2013 ist der Digitale Assistent in den Workflow der Erschließungsprozesse der Zentralbibliothek Zürich integriert. Das System des Digitalen Assistenten kombiniert automatisch unterstützte Prozesse und intellektuelle Sacherschließung: Es werden Schlagwortvorschläge generiert, die danach intellektuell von den Fachreferenten überprüft werden. Im vorliegenden Beitrag wird die Entwicklung des Digitalen Assistenten im Kontext der Praxis der Sacherschließung im Allgemeinen und in der Zentralbibliothek Zürich im Speziellen skizziert. Im Anschluss werden die unterschiedlichen Prozesse der Datenverarbeitung des Systems näher erläutert, sodann wird auf Basis von Statistiken ein erstes Resümee gezogen. Ausführungen zu technischen Spezifikationen runden den Bericht ab.

Busch, D.: Domänenspezifische hybride automatische Indexierung von bibliographischen Metadaten (2019) 0.01

0.014495911 = product of:
  0.069580376 = sum of:
    0.0143061085 = weight(_text_:und in 5628) [ClassicSimilarity], result of:
      0.0143061085 = score(doc=5628,freq=8.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.29385152 = fieldWeight in 5628, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=5628)
    0.015793033 = weight(_text_:des in 5628) [ClassicSimilarity], result of:
      0.015793033 = score(doc=5628,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.25962257 = fieldWeight in 5628, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.046875 = fieldNorm(doc=5628)
    0.016246837 = weight(_text_:der in 5628) [ClassicSimilarity], result of:
      0.016246837 = score(doc=5628,freq=10.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.3311152 = fieldWeight in 5628, product of:
          3.1622777 = tf(freq=10.0), with freq of:
            10.0 = termFreq=10.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.046875 = fieldNorm(doc=5628)
    0.0143061085 = weight(_text_:und in 5628) [ClassicSimilarity], result of:
      0.0143061085 = score(doc=5628,freq=8.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.29385152 = fieldWeight in 5628, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=5628)
    0.008928288 = product of:
      0.017856576 = sum of:
        0.017856576 = weight(_text_:22 in 5628) [ClassicSimilarity], result of:
          0.017856576 = score(doc=5628,freq=2.0), product of:
            0.07692135 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.021966046 = queryNorm
            0.23214069 = fieldWeight in 5628, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.046875 = fieldNorm(doc=5628)
      0.5 = coord(1/2)
  0.20833333 = coord(5/24)

Abstract: Im Fraunhofer-Informationszentrum Raum und Bau (IRB) wird Fachliteratur im Bereich Planen und Bauen bibliographisch erschlossen. Die daraus resultierenden Dokumente (Metadaten-Einträge) werden u.a. bei der Produktion der bibliographischen Datenbanken des IRB verwendet. In Abb. 1 ist ein Dokument dargestellt, das einen Zeitschriftenartikel beschreibt. Die Dokumente werden mit Deskriptoren von einer Nomenklatur (Schlagwortliste IRB) indexiert. Ein Deskriptor ist "eine Benennung., die für sich allein verwendbar, eindeutig zur Inhaltskennzeichnung geeignet und im betreffenden Dokumentationssystem zugelassen ist". Momentan wird die Indexierung intellektuell von menschlichen Experten durchgeführt. Die intellektuelle Indexierung ist zeitaufwendig und teuer. Eine Lösung des Problems besteht in der automatischen Indexierung, bei der die Zuordnung von Deskriptoren durch ein Computerprogramm erfolgt. Solche Computerprogramme werden im Folgenden auch als Klassifikatoren bezeichnet. In diesem Beitrag geht es um ein System zur automatischen Indexierung von deutschsprachigen Dokumenten im Bereich Bauwesen mit Deskriptoren aus der Schlagwortliste IRB.
Source: B.I.T.online. 22(2019) H.6, S.465-469

Schöneberg, U.; Gödert, W.: Erschließung mathematischer Publikationen mittels linguistischer Verfahren (2012) 0.01

0.014192592 = product of:
  0.06812444 = sum of:
    0.006274925 = product of:
      0.018824775 = sum of:
        0.018824775 = weight(_text_:p in 1055) [ClassicSimilarity], result of:
          0.018824775 = score(doc=1055,freq=2.0), product of:
            0.078979194 = queryWeight, product of:
              3.5955126 = idf(docFreq=3298, maxDocs=44218)
              0.021966046 = queryNorm
            0.23835106 = fieldWeight in 1055, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5955126 = idf(docFreq=3298, maxDocs=44218)
              0.046875 = fieldNorm(doc=1055)
      0.33333334 = coord(1/3)
    0.017521333 = weight(_text_:und in 1055) [ClassicSimilarity], result of:
      0.017521333 = score(doc=1055,freq=12.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.35989314 = fieldWeight in 1055, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=1055)
    0.017797519 = weight(_text_:der in 1055) [ClassicSimilarity], result of:
      0.017797519 = score(doc=1055,freq=12.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.36271852 = fieldWeight in 1055, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.046875 = fieldNorm(doc=1055)
    0.009009332 = product of:
      0.018018665 = sum of:
        0.018018665 = weight(_text_:29 in 1055) [ClassicSimilarity], result of:
          0.018018665 = score(doc=1055,freq=2.0), product of:
            0.07726968 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.021966046 = queryNorm
            0.23319192 = fieldWeight in 1055, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.046875 = fieldNorm(doc=1055)
      0.5 = coord(1/2)
    0.017521333 = weight(_text_:und in 1055) [ClassicSimilarity], result of:
      0.017521333 = score(doc=1055,freq=12.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.35989314 = fieldWeight in 1055, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=1055)
  0.20833333 = coord(5/24)

Abstract: Die Zahl der mathematik-relevanten Publikationn steigt von Jahr zu Jahr an. Referatedienste wie da Zentralblatt MATH und Mathematical Reviews erfassen die bibliographischen Daten, erschließen die Arbeiten inhaltlich und machen sie - heute über Datenbanken, früher in gedruckter Form - für den Nutzer suchbar. Keywords sind ein wesentlicher Bestandteil der inhaltlichen Erschließung der Publikationen. Keywords sind meist keine einzelnen Wörter, sondern Mehrwortphrasen. Das legt die Anwendung linguistischer Methoden und Verfahren nahe. Die an der FH Köln entwickelte Software 'Lingo' wurde für die speziellen Anforderungen mathematischer Texte angepasst und sowohl zum Aufbau eines kontrollierten Vokabulars als auch zur Extraction von Keywords aus mathematischen Publikationen genutzt. Es ist geplant, über eine Verknüpfung von kontrolliertem Vokabular und der Mathematical Subject Classification Methoden für die automatische Klassifikation für den Referatedienst Zentralblatt MATH zu entwickeln und zu erproben.
Date: 12. 9.2013 12:29:05
Footnote: Vortrag anlässlich der DMV-Tagung in Saarbrücken, 17.-20.09.2012.
Type: p

Groß, T.: Automatische Indexierung von wirtschaftswissenschaftlichen Dokumenten : Implementierung und Evaluierung am Beispiel der Deutschen Zentralbibliothek für Wirtschaftswissenschaften (2010) 0.01
```
0.013887095 = product of:
  0.08332257 = sum of:
    0.021492256 = weight(_text_:und in 2078) [ClassicSimilarity], result of:
      0.021492256 = score(doc=2078,freq=26.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.441457 = fieldWeight in 2078, product of:
          5.0990195 = tf(freq=26.0), with freq of:
            26.0 = termFreq=26.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2078)
    0.016118698 = weight(_text_:des in 2078) [ClassicSimilarity], result of:
      0.016118698 = score(doc=2078,freq=6.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.2649762 = fieldWeight in 2078, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2078)
    0.024219355 = weight(_text_:der in 2078) [ClassicSimilarity], result of:
      0.024219355 = score(doc=2078,freq=32.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.4935974 = fieldWeight in 2078, product of:
          5.656854 = tf(freq=32.0), with freq of:
            32.0 = termFreq=32.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2078)
    0.021492256 = weight(_text_:und in 2078) [ClassicSimilarity], result of:
      0.021492256 = score(doc=2078,freq=26.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.441457 = fieldWeight in 2078, product of:
          5.0990195 = tf(freq=26.0), with freq of:
            26.0 = termFreq=26.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2078)
  0.16666667 = coord(4/24)
```
Abstract

Die Bewertung der Indexierungsqualität bzw. -güte ist ein grundlegendes Problem von manuellen und automatischen Indexierungsverfahren. Letztere werden aber gerade im digitalen Zeitalter als einzige Möglichkeit angesehen, den zunehmenden Schwierigkeiten bibliothekarischer Informationsstrukturierung gerecht zu werden. Diese Arbeit befasst sich mit der Funktionsweise, Implementierung und Evaluierung der Sacherschließungssoftware MindServer Categorizer, der Firma Recommind, an der Deutschen Zentralbibliothek für Wirtschaftswissenschaften (ZBW). Grundlage der maschinellen Sacherschließung und anschließenden quantitativen und qualitativen Auswertung bilden rund 39.000 wirtschaftswissenschaftliche Dokumente aus den Datenbanken Econis und EconStor. Unter Zuhilfenahme des rund 6.000 Deskriptoren umfassenden Standard-Thesaurus Wirtschaft (STW) wird der ursprünglich rein statistische Indexierungsansatz des MindServer Categorizer zu einem begriffsorientierten Verfahren weiterentwickelt und zur Inhaltserschließung digitaler Informationsressourcen eingesetzt. Der zentrale Fokus dieser Arbeit liegt vor allem auf der Evaluierung der maschinell beschlagworteten Titel, in Anlehnung und entsprechender Anpassung der von Stock (2008) und Lancaster (2003) hierzu vorgeschlagenen Kriterien: Indexierungskonsistenz, -tiefe, -breite, -spezifität, -effektivität. Zusätzlich wird die Belegungsbilanz des STW evaluiert und es erfolgt ferner eine stichprobenartige, qualitative Bewertung der Ergebnisse seitens der zuständigen Fachreferenten und -referentinnen.

Content

Vgl. unter: http://edoc.hu-berlin.de/series/berliner-handreichungen/2010-284/PDF/284.pdf. Auch als: Automatische Indexierung von Dokumenten in einer wissenschaftlichen Bibliothek: Implementierung und Evaluierung am Beispiel der Deutschen Zentralbibliothek für Wirtschaftswissenschaften. Diplomica Verlag, 2011.

Imprint

Berlin : Institut für Bibliotheks- und Informationswissenschaft der Humboldt-Universität zu Berlin

Wiesenmüller, H.: Maschinelle Indexierung am Beispiel der DNB : Analyse und Entwicklungmöglichkeiten (2018) 0.01

0.013043827 = product of:
  0.07826296 = sum of:
    0.020441556 = weight(_text_:und in 5209) [ClassicSimilarity], result of:
      0.020441556 = score(doc=5209,freq=12.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.41987535 = fieldWeight in 5209, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5209)
    0.018425206 = weight(_text_:des in 5209) [ClassicSimilarity], result of:
      0.018425206 = score(doc=5209,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.302893 = fieldWeight in 5209, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5209)
    0.018954644 = weight(_text_:der in 5209) [ClassicSimilarity], result of:
      0.018954644 = score(doc=5209,freq=10.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.38630107 = fieldWeight in 5209, product of:
          3.1622777 = tf(freq=10.0), with freq of:
            10.0 = termFreq=10.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5209)
    0.020441556 = weight(_text_:und in 5209) [ClassicSimilarity], result of:
      0.020441556 = score(doc=5209,freq=12.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.41987535 = fieldWeight in 5209, product of:
          3.4641016 = tf(freq=12.0), with freq of:
            12.0 = termFreq=12.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5209)
  0.16666667 = coord(4/24)

Abstract: Der Beitrag untersucht die Ergebnisse des bei der Deutschen Nationalbibliothek (DNB) eingesetzten Verfahrens zur automatischen Vergabe von Schlagwörtern. Seit 2017 kommt dieses auch bei Printausgaben der Reihen B und H der Deutschen Nationalbibliografie zum Einsatz. Die zentralen Problembereiche werden dargestellt und an Beispielen illustriert - beispielsweise dass nicht alle im Inhaltsverzeichnis vorkommenden Wörter tatsächlich thematische Aspekte ausdrücken und dass die Software sehr häufig Körperschaften und andere "Named entities" nicht erkennt. Die maschinell generierten Ergebnisse sind derzeit sehr unbefriedigend. Es werden Überlegungen für mögliche Verbesserungen und sinnvolle Strategien angestellt.
Content: Vortrag anlässlich des 107. Deutschen Bibliothekartages 2018 in Berlin, Themenkreis "Fokus Erschließen & Bewahren". https://www.o-bib.de/article/view/5396. https://doi.org/10.5282/o-bib/2018H4S141-153.

Pollmeier, M.: Verlagsschlagwörter als Grundlage für den Einsatz eines maschinellen Verfahrens zur verbalen Erschließung der Kinder- und Jugendliteratur durch die Deutsche Nationalbibliothek : eine Datenanalyse (2019) 0.01

0.012994625 = product of:
  0.07796775 = sum of:
    0.023843516 = weight(_text_:und in 1081) [ClassicSimilarity], result of:
      0.023843516 = score(doc=1081,freq=32.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.48975256 = fieldWeight in 1081, product of:
          5.656854 = tf(freq=32.0), with freq of:
            32.0 = termFreq=32.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1081)
    0.009306135 = weight(_text_:des in 1081) [ClassicSimilarity], result of:
      0.009306135 = score(doc=1081,freq=2.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.15298408 = fieldWeight in 1081, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1081)
    0.020974576 = weight(_text_:der in 1081) [ClassicSimilarity], result of:
      0.020974576 = score(doc=1081,freq=24.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.42746788 = fieldWeight in 1081, product of:
          4.8989797 = tf(freq=24.0), with freq of:
            24.0 = termFreq=24.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1081)
    0.023843516 = weight(_text_:und in 1081) [ClassicSimilarity], result of:
      0.023843516 = score(doc=1081,freq=32.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.48975256 = fieldWeight in 1081, product of:
          5.656854 = tf(freq=32.0), with freq of:
            32.0 = termFreq=32.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1081)
  0.16666667 = coord(4/24)

Abstract: Die Inhaltserschließung durch Schlagwörter wird aktuell in vielen Öffentlichen Bibliotheken Deutschlands zurückgefahren. Aufgrund von Personalmangel und den vielfältigen anderen bibliothekarischen Dienstleistungen, die für die Benutzer zu leisten sind, kommt sie oft zu kurz. Die Deutsche Nationalbibliothek unterstützte diese Bibliotheken bisher als wichtigster Datenlieferant, jedoch stellte sie 2017 die intellektuelle Inhaltserschließung der Kinder- und Jugendliteratur und der Belletristik ein. Um diese problematische Situation zu verbessern, wird aktuell in der Deutschen Nationalbibliothek ein Verfahren erprobt, das aus Schlagwörtern von Verlagen maschinell bibliothekarische Schlagwörter aus der Gemeinsamen Normdatei generiert. Auf die Titel der Kinder- und Jugendliteratur aus den Jahren 2018 und 2019 wurde es bereits angewendet. In dieser Arbeit geht es um eine erste Analyse dieser Erschließungsergebnisse, um Aussagen über die Nützlichkeit der Verlagsschlagwörter und des automatischen Verfahrens zu treffen. Im theoretischen Teil werden einerseits die Inhaltserschließung im bibliothekarischen Bereich und deren aktuelle Entwicklungen hinsichtlich der Automatisierung beschrieben. Andererseits wird näher auf die Erschließungspraxis in der Deutschen Nationalbibliothek hinsichtlich der Automatisierung und der Kinder- und Jugendliteratur eingegangen. Im Analyseteil werden sowohl die Verlagsschlagwörter als auch die bibliothekarischen Schlagwörter nach festgelegten Kriterien untersucht und schließlich miteinander verglichen.
Footnote: Bachelorarbeit an der Hochschule für Technik, Wirtschaft und Kultur Leipzig Fakultät Informatik und Medien Studiengang Bibliotheks- und Informationswissenschaft.
Imprint: Leipzig : Hochschule für Technik, Wirtschaft und Kultur / Fakultät Informatik und Medien

Groß, T.; Faden, M.: Automatische Indexierung elektronischer Dokumente an der Deutschen Zentralbibliothek für Wirtschaftswissenschaften : Bericht über die Jahrestagung der Internationalen Buchwissenschaftlichen Gesellschaft (2010) 0.01
```
0.011834453 = product of:
  0.071006715 = sum of:
    0.017193804 = weight(_text_:und in 4051) [ClassicSimilarity], result of:
      0.017193804 = score(doc=4051,freq=26.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.3531656 = fieldWeight in 4051, product of:
          5.0990195 = tf(freq=26.0), with freq of:
            26.0 = termFreq=26.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=4051)
    0.016647318 = weight(_text_:des in 4051) [ClassicSimilarity], result of:
      0.016647318 = score(doc=4051,freq=10.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.27366623 = fieldWeight in 4051, product of:
          3.1622777 = tf(freq=10.0), with freq of:
            10.0 = termFreq=10.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.03125 = fieldNorm(doc=4051)
    0.019971792 = weight(_text_:der in 4051) [ClassicSimilarity], result of:
      0.019971792 = score(doc=4051,freq=34.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.40703082 = fieldWeight in 4051, product of:
          5.8309517 = tf(freq=34.0), with freq of:
            34.0 = termFreq=34.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.03125 = fieldNorm(doc=4051)
    0.017193804 = weight(_text_:und in 4051) [ClassicSimilarity], result of:
      0.017193804 = score(doc=4051,freq=26.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.3531656 = fieldWeight in 4051, product of:
          5.0990195 = tf(freq=26.0), with freq of:
            26.0 = termFreq=26.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=4051)
  0.16666667 = coord(4/24)
```
Abstract

Die zunehmende Verfügbarmachung digitaler Informationen in den letzten Jahren sowie die Aussicht auf ein weiteres Ansteigen der sogenannten Datenflut kumulieren in einem grundlegenden, sich weiter verstärkenden Informationsstrukturierungsproblem. Die stetige Zunahme von digitalen Informationsressourcen im World Wide Web sichert zwar jederzeit und ortsungebunden den Zugriff auf verschiedene Informationen; offen bleibt der strukturierte Zugang, insbesondere zu wissenschaftlichen Ressourcen. Angesichts der steigenden Anzahl elektronischer Inhalte und vor dem Hintergrund stagnierender bzw. knapper werdender personeller Ressourcen in der Sacherschließun schafft keine Bibliothek bzw. kein Bibliotheksverbund es mehr, weder aktuell noch zukünftig, alle digitalen Daten zu erfassen, zu strukturieren und zueinander in Beziehung zu setzen. In der Informationsgesellschaft des 21. Jahrhunderts wird es aber zunehmend wichtiger, die in der Flut verschwundenen wissenschaftlichen Informationen zeitnah, angemessen und vollständig zu strukturieren und somit als Basis für eine Wissensgenerierung wieder nutzbar zu machen. Eine normierte Inhaltserschließung digitaler Informationsressourcen ist deshalb für die Deutsche Zentralbibliothek für Wirtschaftswissenschaften (ZBW) als wichtige Informationsinfrastruktureinrichtung in diesem Bereich ein entscheidender und auch erfolgskritischer Aspekt im Wettbewerb mit anderen Informationsdienstleistern. Weil die traditionelle intellektuelle Sacherschließung aber nicht beliebig skalierbar ist - mit dem Anstieg der Zahl an Online-Dokumenten steigt proportional auch der personelle Ressourcenbedarf an Fachreferenten, wenn ein gewisser Qualitätsstandard gehalten werden soll - bedarf es zukünftig anderer Sacherschließungsverfahren. Automatisierte Verschlagwortungsmethoden werden dabei als einzige Möglichkeit angesehen, die bibliothekarische Sacherschließung auch im digitalen Zeitalter zukunftsfest auszugestalten. Zudem können maschinelle Ansätze dazu beitragen, die Heterogenitäten (Indexierungsinkonsistenzen) zwischen den einzelnen Sacherschließer zu nivellieren, und somit zu einer homogeneren Erschließung des Bibliotheksbestandes beitragen.
Mit der Anfang 2010 begonnen Implementierung und Ergebnisevaluierung des automatischen Indexierungsverfahrens "Decisiv Categorization" der Firma Recommind soll das hier skizzierte Informationsstrukturierungsproblem in zwei Schritten gelöst werden. Kurz- bis mittelfristig soll die intellektuelle Indexierung durch ein semiautomatisches Verfahren6 unterstützt werden. Mittel- bis langfristig soll das maschinelle Verfahren, aufbauend auf einem entsprechenden Training, in die Lage versetzt werden, sowohl im Hause vorliegende Dokumente vollautomatisch zu indexieren als auch ZBW-fremde digitale Informationsressourcen zu verschlagworten bzw. zu klassifizieren, um sie in einem gemeinsamen Suchraum auffindbar machen zu können. Im Anschluss an diese Einleitung werden die ersten Ansätze maschineller Sacherschließung an der ZBW (2001-2004) und deren Ergebnisse und Problemlagen aufgezeigt. Danach werden die Rahmenbedingungen (Projektauftrag und -ziel) für eine Wiederaufnahme des Vorhabens im Jahre 2009 aufgezeigt, gefolgt von einer Darstellung der Funktionsweise der Recommind-Technologie und deren Einsatz im Rahmen der Sacherschließung von Online-Dokumenten mit einem Thesaurus. Schwerpunkt dieser Abhandlung bilden im Anschluss daran die Evaluierungsmöglichkeiten automatischer Indexierungsansätze sowie die aktuellen Ergebnisse und zentralen Erkenntnisse des Einsatzes im Kontext der ZBW. Das Fazit beschreibt die entsprechenden Schlussfolgerungen aus den erzielten Ergebnissen sowie den Ausblick auf das weitere Vorgehen.

Kempf, A.O.: Automatische Indexierung in der sozialwissenschaftlichen Fachinformation : eine Evaluationsstudie zur maschinellen Erschließung für die Datenbank SOLIS (2012) 0.01

0.011802531 = product of:
  0.07081518 = sum of:
    0.018925203 = weight(_text_:und in 903) [ClassicSimilarity], result of:
      0.018925203 = score(doc=903,freq=14.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.38872904 = fieldWeight in 903, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=903)
    0.011167361 = weight(_text_:des in 903) [ClassicSimilarity], result of:
      0.011167361 = score(doc=903,freq=2.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.18358089 = fieldWeight in 903, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.046875 = fieldNorm(doc=903)
    0.021797419 = weight(_text_:der in 903) [ClassicSimilarity], result of:
      0.021797419 = score(doc=903,freq=18.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.44423765 = fieldWeight in 903, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.046875 = fieldNorm(doc=903)
    0.018925203 = weight(_text_:und in 903) [ClassicSimilarity], result of:
      0.018925203 = score(doc=903,freq=14.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.38872904 = fieldWeight in 903, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=903)
  0.16666667 = coord(4/24)

Abstract: Automatische Indexierungsverfahren werden mit Zunahme der digitalen Verfügbarkeit von Metadaten und Volltexten mehr und mehr als eine mögliche Antwort auf das Management unstrukturierter Daten diskutiert. In der sozialwissenschaftlichen Fachinformation existiert in diesem Zusammenhang seit einiger Zeit der Vorschlag eines sogenannten Schalenmodells (vgl. Krause, 1996) mit unterschiedlichen Qualitätsstufen bei der inhaltlichen Erschließung. Vor diesem Hintergrund beschreibt die Arbeit zunächst Methoden und Verfahren der inhaltlichen und automatischen Indexierung, bevor vier Testläufe eines automatischen Indexierungssystems (MindServer) zur automatischen Erschließung von Datensätzen der bibliographischen Literaturdatenbank SOLIS mit Deskriptoren des Thesaurus Sozialwissenschaften sowie der Klassifikation Sozialwissenschaften beschrieben und analysiert werden. Es erfolgt eine ausführliche Fehleranalyse mit Beispielen sowie eine abschließende Diskussion, inwieweit die automatische Erschließung in dieser Form für die Randbereiche der Datenbank SOLIS für die Zukunft einen gangbaren Weg darstellt.
Imprint: Berlin : Humboldt-Universität zu Berlin, Philosophische Fakultät I, Institut für Bibliotheks- und Informationswissenschaft
Series: Berliner Handreichungen zur Bibliotheks- und Informationswissenschaft; 329

Bredack, J.: Automatische Extraktion fachterminologischer Mehrwortbegriffe : ein Verfahrensvergleich (2016) 0.01

0.0111817755 = product of:
  0.06709065 = sum of:
    0.017882636 = weight(_text_:und in 3194) [ClassicSimilarity], result of:
      0.017882636 = score(doc=3194,freq=18.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.3673144 = fieldWeight in 3194, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3194)
    0.013160862 = weight(_text_:des in 3194) [ClassicSimilarity], result of:
      0.013160862 = score(doc=3194,freq=4.0), product of:
        0.06083074 = queryWeight, product of:
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.021966046 = queryNorm
        0.21635216 = fieldWeight in 3194, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.7693076 = idf(docFreq=7536, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3194)
    0.018164515 = weight(_text_:der in 3194) [ClassicSimilarity], result of:
      0.018164515 = score(doc=3194,freq=18.0), product of:
        0.049067024 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.021966046 = queryNorm
        0.37019804 = fieldWeight in 3194, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3194)
    0.017882636 = weight(_text_:und in 3194) [ClassicSimilarity], result of:
      0.017882636 = score(doc=3194,freq=18.0), product of:
        0.04868482 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.021966046 = queryNorm
        0.3673144 = fieldWeight in 3194, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3194)
  0.16666667 = coord(4/24)

Abstract: In dieser Untersuchung wurden zwei Systeme eingesetzt, um MWT aus einer Dokumentkollektion mit fachsprachlichem Bezug (Volltexte des ACL Anthology Reference Corpus) automatisch zu extrahieren. Das thematische Spektrum umfasste alle Bereiche der natürlichen Sprachverarbeitung, im Speziellen die CL als interdisziplinäre Wissenschaft. Ziel war es MWT zu extrahieren, die als potentielle Indexterme im IR Verwendung finden können. Diese sollten auf Konzepte, Methoden, Verfahren und Algorithmen in der CL und angrenzenden Teilgebieten, wie Linguistik und Informatik hinweisen bzw. benennen.
Als Extraktionssysteme wurden der TreeTagger und die Indexierungssoftware Lingo verwendet. Der TreeTagger basiert auf einem statistischen Tagging- und Chunking- Algorithmus, mit dessen Hilfe NPs automatisch identifiziert und extrahiert werden. Er kann für verschiedene Anwendungsszenarien der natürlichen Sprachverarbeitung eingesetzt werden, in erster Linie als POS-Tagger für unterschiedliche Sprachen. Das Indexierungssystem Lingo arbeitet im Gegensatz zum TreeTagger mit elektronischen Wörterbüchern und einem musterbasierten Abgleich. Lingo ist ein auf automatische Indexierung ausgerichtetes System, was eine Vielzahl von Modulen mitliefert, die individuell auf eine bestimmte Aufgabenstellung angepasst und aufeinander abgestimmt werden können. Die unterschiedlichen Verarbeitungsweisen haben sich in den Ergebnismengen beider Systeme deutlich gezeigt. Die gering ausfallenden Übereinstimmungen der Ergebnismengen verdeutlichen die abweichende Funktionsweise und konnte mit einer qualitativen Analyse beispielhaft beschrieben werden. In der vorliegenden Arbeit kann abschließend nicht geklärt werden, welches der beiden Systeme bevorzugt für die Generierung von Indextermen eingesetzt werden sollte.
Content: Schriftliche Hausarbeit (Masterarbeit) zur Erlangung des Grades eines Master of Arts An der Universität Trier Fachbereich II Studiengang Computerlinguistik.

Search (39 results, page 1 of 2)

Authors

Types

Themes

Classifications