Search (52 results, page 2 of 3)

Klein, H.: Web Content Mining (2004) 0.02
```
0.021741066 = product of:
  0.086964265 = sum of:
    0.015770938 = weight(_text_:und in 3154) [ClassicSimilarity], result of:
      0.015770938 = score(doc=3154,freq=18.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 3154, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=3154)
    0.015770938 = weight(_text_:und in 3154) [ClassicSimilarity], result of:
      0.015770938 = score(doc=3154,freq=18.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 3154, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=3154)
    0.02388051 = weight(_text_:der in 3154) [ClassicSimilarity], result of:
      0.02388051 = score(doc=3154,freq=40.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.44148692 = fieldWeight in 3154, product of:
          6.3245554 = tf(freq=40.0), with freq of:
            40.0 = termFreq=40.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.03125 = fieldNorm(doc=3154)
    0.015770938 = weight(_text_:und in 3154) [ClassicSimilarity], result of:
      0.015770938 = score(doc=3154,freq=18.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 3154, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=3154)
    0.015770938 = weight(_text_:und in 3154) [ClassicSimilarity], result of:
      0.015770938 = score(doc=3154,freq=18.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 3154, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=3154)
  0.25 = coord(5/20)
```
Abstract

Web Mining - ein Schlagwort, das mit der Verbreitung des Internets immer öfter zu lesen und zu hören ist. Die gegenwärtige Forschung beschäftigt sich aber eher mit dem Nutzungsverhalten der Internetnutzer, und ein Blick in Tagungsprogramme einschlägiger Konferenzen (z.B. GOR - German Online Research) zeigt, dass die Analyse der Inhalte kaum Thema ist. Auf der GOR wurden 1999 zwei Vorträge zu diesem Thema gehalten, auf der Folgekonferenz 2001 kein einziger. Web Mining ist der Oberbegriff für zwei Typen von Web Mining: Web Usage Mining und Web Content Mining. Unter Web Usage Mining versteht man das Analysieren von Daten, wie sie bei der Nutzung des WWW anfallen und von den Servern protokolliert wenden. Man kann ermitteln, welche Seiten wie oft aufgerufen wurden, wie lange auf den Seiten verweilt wurde und vieles andere mehr. Beim Web Content Mining wird der Inhalt der Webseiten untersucht, der nicht nur Text, sondern auf Bilder, Video- und Audioinhalte enthalten kann. Die Software für die Analyse von Webseiten ist in den Grundzügen vorhanden, doch müssen die meisten Webseiten für die entsprechende Analysesoftware erst aufbereitet werden. Zuerst müssen die relevanten Websites ermittelt werden, die die gesuchten Inhalte enthalten. Das geschieht meist mit Suchmaschinen, von denen es mittlerweile Hunderte gibt. Allerdings kann man nicht davon ausgehen, dass die Suchmaschinen alle existierende Webseiten erfassen. Das ist unmöglich, denn durch das schnelle Wachstum des Internets kommen täglich Tausende von Webseiten hinzu, und bereits bestehende ändern sich der werden gelöscht. Oft weiß man auch nicht, wie die Suchmaschinen arbeiten, denn das gehört zu den Geschäftsgeheimnissen der Betreiber. Man muss also davon ausgehen, dass die Suchmaschinen nicht alle relevanten Websites finden (können). Der nächste Schritt ist das Herunterladen der Websites, dafür gibt es Software, die unter den Bezeichnungen OfflineReader oder Webspider zu finden ist. Das Ziel dieser Programme ist, die Website in einer Form herunterzuladen, die es erlaubt, die Website offline zu betrachten. Die Struktur der Website wird in der Regel beibehalten. Wer die Inhalte einer Website analysieren will, muss also alle Dateien mit seiner Analysesoftware verarbeiten können. Software für Inhaltsanalyse geht davon aus, dass nur Textinformationen in einer einzigen Datei verarbeitet werden. QDA Software (qualitative data analysis) verarbeitet dagegen auch Audiound Videoinhalte sowie internetspezifische Kommunikation wie z.B. Chats.

Series

Fortschritte in der Wissensorganisation; Bd.7

Source

Wissensorganisation und Edutainment: Wissen im Spannungsfeld von Gesellschaft, Gestaltung und Industrie. Proceedings der 7. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation, Berlin, 21.-23.3.2001. Hrsg.: C. Lehner, H.P. Ohly u. G. Rahmstorf

Wiegmann, S.: Hättest du die Titanic überlebt? : Eine kurze Einführung in das Data Mining mit freier Software (2023) 0.02

0.021703288 = product of:
  0.08681315 = sum of:
    0.018399429 = weight(_text_:und in 876) [ClassicSimilarity], result of:
      0.018399429 = score(doc=876,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.34282678 = fieldWeight in 876, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=876)
    0.018399429 = weight(_text_:und in 876) [ClassicSimilarity], result of:
      0.018399429 = score(doc=876,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.34282678 = fieldWeight in 876, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=876)
    0.013215441 = weight(_text_:der in 876) [ClassicSimilarity], result of:
      0.013215441 = score(doc=876,freq=4.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.24431825 = fieldWeight in 876, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0546875 = fieldNorm(doc=876)
    0.018399429 = weight(_text_:und in 876) [ClassicSimilarity], result of:
      0.018399429 = score(doc=876,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.34282678 = fieldWeight in 876, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=876)
    0.018399429 = weight(_text_:und in 876) [ClassicSimilarity], result of:
      0.018399429 = score(doc=876,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.34282678 = fieldWeight in 876, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=876)
  0.25 = coord(5/20)

Abstract: Am 10. April 1912 ging Elisabeth Walton Allen an Bord der "Titanic", um ihr Hab und Gut nach England zu holen. Eines Nachts wurde sie von ihrer aufgelösten Tante geweckt, deren Kajüte unter Wasser stand. Wie steht es um Elisabeths Chancen und hätte man selbst das Unglück damals überlebt? Das Titanic-Orakel ist eine algorithmusbasierte App, die entsprechende Prognosen aufstellt und im Rahmen des Kurses "Data Science" am Department Information der HAW Hamburg entstanden ist. Dieser Beitrag zeigt Schritt für Schritt, wie die App unter Verwendung freier Software entwickelt wurde. Code und Daten werden zur Nachnutzung bereitgestellt.

Brückner, T.; Dambeck, H.: Sortierautomaten : Grundlagen der Textklassifizierung (2003) 0.02

0.020880632 = product of:
  0.08352253 = sum of:
    0.018210711 = weight(_text_:und in 2398) [ClassicSimilarity], result of:
      0.018210711 = score(doc=2398,freq=6.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.33931053 = fieldWeight in 2398, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=2398)
    0.018210711 = weight(_text_:und in 2398) [ClassicSimilarity], result of:
      0.018210711 = score(doc=2398,freq=6.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.33931053 = fieldWeight in 2398, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=2398)
    0.010679688 = weight(_text_:der in 2398) [ClassicSimilarity], result of:
      0.010679688 = score(doc=2398,freq=2.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.19743896 = fieldWeight in 2398, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0625 = fieldNorm(doc=2398)
    0.018210711 = weight(_text_:und in 2398) [ClassicSimilarity], result of:
      0.018210711 = score(doc=2398,freq=6.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.33931053 = fieldWeight in 2398, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=2398)
    0.018210711 = weight(_text_:und in 2398) [ClassicSimilarity], result of:
      0.018210711 = score(doc=2398,freq=6.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.33931053 = fieldWeight in 2398, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=2398)
  0.25 = coord(5/20)

Abstract: Rechnung, Kündigung oder Adressänderung? Eingehende Briefe und E-Mails werden immer häufiger von Software statt aufwändig von Menschenhand sortiert. Die Textklassifizierer arbeiten erstaunlich genau. Sie fahnden auch nach ähnlichen Texten und sorgen so für einen schnellen Überblick. Ihre Werkzeuge sind Linguistik, Statistik und Logik

Bauckhage, C.: Moderne Textanalyse : neues Wissen für intelligente Lösungen (2016) 0.02

0.020208826 = product of:
  0.080835305 = sum of:
    0.014868983 = weight(_text_:und in 2568) [ClassicSimilarity], result of:
      0.014868983 = score(doc=2568,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 2568, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=2568)
    0.014868983 = weight(_text_:und in 2568) [ClassicSimilarity], result of:
      0.014868983 = score(doc=2568,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 2568, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=2568)
    0.021359377 = weight(_text_:der in 2568) [ClassicSimilarity], result of:
      0.021359377 = score(doc=2568,freq=8.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.3948779 = fieldWeight in 2568, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0625 = fieldNorm(doc=2568)
    0.014868983 = weight(_text_:und in 2568) [ClassicSimilarity], result of:
      0.014868983 = score(doc=2568,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 2568, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=2568)
    0.014868983 = weight(_text_:und in 2568) [ClassicSimilarity], result of:
      0.014868983 = score(doc=2568,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 2568, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=2568)
  0.25 = coord(5/20)

Abstract: Im Zuge der immer größeren Verfügbarkeit von Daten (Big Data) und rasanter Fortschritte im Daten-basierten maschinellen Lernen haben wir in den letzten Jahren Durchbrüche in der künstlichen Intelligenz erlebt. Dieser Vortrag beleuchtet diese Entwicklungen insbesondere im Hinblick auf die automatische Analyse von Textdaten. Anhand einfacher Beispiele illustrieren wir, wie moderne Textanalyse abläuft und zeigen wiederum anhand von Beispielen, welche praktischen Anwendungsmöglichkeiten sich heutzutage in Branchen wie dem Verlagswesen, der Finanzindustrie oder dem Consulting ergeben.
Content: Folien der Präsentation anlässlich des GENIOS Datenbankfrühstücks 2016, 19. Oktober 2016.

Sperlich, T.: ¬Die Zukunft hat schon begonnen : Visualisierungssoftware in der praktischen Anwendung (2000) 0.02

0.019493423 = product of:
  0.07797369 = sum of:
    0.014868983 = weight(_text_:und in 5059) [ClassicSimilarity], result of:
      0.014868983 = score(doc=5059,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 5059, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=5059)
    0.014868983 = weight(_text_:und in 5059) [ClassicSimilarity], result of:
      0.014868983 = score(doc=5059,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 5059, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=5059)
    0.018497765 = weight(_text_:der in 5059) [ClassicSimilarity], result of:
      0.018497765 = score(doc=5059,freq=6.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.34197432 = fieldWeight in 5059, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0625 = fieldNorm(doc=5059)
    0.014868983 = weight(_text_:und in 5059) [ClassicSimilarity], result of:
      0.014868983 = score(doc=5059,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 5059, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=5059)
    0.014868983 = weight(_text_:und in 5059) [ClassicSimilarity], result of:
      0.014868983 = score(doc=5059,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 5059, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=5059)
  0.25 = coord(5/20)

Content: 1. Unsichtbares sichtbar machen - 2. Mit 3D-Darsteltungen besser verkaufen - 3. Mixed Realities - 4. Informationstechnik hilft heilen - 5. Informationen finden - Komplexes verstehen - 6. Informationslandschaften - Karten - 7. Arbeiten und Wohnen in der Info-Zukunft - 8. Neues Lernen in der Info-Welt - 9. Computerspiele alsTechnologie-Avantgarde - 10. Multimediale Kunst
Source: Weltwissen - Wissenswelt: Das globale Netz von Text und Bild. Hrsg.: Christa Maar, u.a

Baumgartner, R.: Methoden und Werkzeuge zur Webdatenextraktion (2006) 0.02

0.019472124 = product of:
  0.09736062 = sum of:
    0.024340155 = weight(_text_:und in 5808) [ClassicSimilarity], result of:
      0.024340155 = score(doc=5808,freq=14.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.4535172 = fieldWeight in 5808, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5808)
    0.024340155 = weight(_text_:und in 5808) [ClassicSimilarity], result of:
      0.024340155 = score(doc=5808,freq=14.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.4535172 = fieldWeight in 5808, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5808)
    0.024340155 = weight(_text_:und in 5808) [ClassicSimilarity], result of:
      0.024340155 = score(doc=5808,freq=14.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.4535172 = fieldWeight in 5808, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5808)
    0.024340155 = weight(_text_:und in 5808) [ClassicSimilarity], result of:
      0.024340155 = score(doc=5808,freq=14.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.4535172 = fieldWeight in 5808, product of:
          3.7416575 = tf(freq=14.0), with freq of:
            14.0 = termFreq=14.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=5808)
  0.2 = coord(4/20)

Abstract: Das World Wide Web kann als die größte uns bekannte "Datenbank" angesehen werden. Leider ist das heutige Web großteils auf die Präsentation für menschliche Benutzerinnen ausgelegt und besteht aus sehr heterogenen Datenbeständen. Überdies fehlen im Web die Möglichkeiten Informationen strukturiert und aus verschiedenen Quellen aggregiert abzufragen. Das heutige Web ist daher für die automatische maschinelle Verarbeitung nicht geeignet. Um Webdaten dennoch effektiv zu nutzen, wurden Sprachen, Methoden und Werkzeuge zur Extraktion und Aggregation dieser Daten entwickelt. Dieser Artikel gibt einen Überblick und eine Kategorisierung von verschiedenen Ansätzen zur Datenextraktion aus dem Web. Einige Beispielszenarien im B2B Datenaustausch, im Business Intelligence Bereich und insbesondere die Generierung von Daten für Semantic Web Ontologien illustrieren die effektive Nutzung dieser Technologien.

Heyer, G.; Läuter, M.; Quasthoff, U.; Wolff, C.: Texttechnologische Anwendungen am Beispiel Text Mining (2000) 0.02

0.01923927 = product of:
  0.07695708 = sum of:
    0.015770938 = weight(_text_:und in 5565) [ClassicSimilarity], result of:
      0.015770938 = score(doc=5565,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 5565, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=5565)
    0.015770938 = weight(_text_:und in 5565) [ClassicSimilarity], result of:
      0.015770938 = score(doc=5565,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 5565, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=5565)
    0.013873324 = weight(_text_:der in 5565) [ClassicSimilarity], result of:
      0.013873324 = score(doc=5565,freq=6.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.25648075 = fieldWeight in 5565, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.046875 = fieldNorm(doc=5565)
    0.015770938 = weight(_text_:und in 5565) [ClassicSimilarity], result of:
      0.015770938 = score(doc=5565,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 5565, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=5565)
    0.015770938 = weight(_text_:und in 5565) [ClassicSimilarity], result of:
      0.015770938 = score(doc=5565,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 5565, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=5565)
  0.25 = coord(5/20)

Abstract: Die zunehmende Menge von Informationen und deren weltweite Verfügbarkeit auf der Basis moderner Internet Technologie machen es erforderlich, Informationen nach inhaltlichen Kriterien zu strukturieren und zu bewerten sowie nach inhaltlichen Kriterien weiter zu verarbeiten. Vom Standpunkt des Benutzers aus sind dabei folgende Fälle zu unterscheiden: Handelt es sich bei den gesuchten Informationen um strukturierle Daten (z.B. in einer SQL-Datenbank) oder unstrukturierte Daten (z.B. grosse Texte)? Ist bekannt, welche Daten benötigt werden und wie sie zu finden sind? Oder ist vor dein Zugriff auf die Daten noch nicht bekannt welche Ergebnisse erwartet werden?
Source: Sprachtechnologie für eine dynamische Wirtschaft im Medienzeitalter - Language technologies for dynamic business in the age of the media - L'ingénierie linguistique au service de la dynamisation économique à l'ère du multimédia: Tagungsakten der XXVI. Jahrestagung der Internationalen Vereinigung Sprache und Wirtschaft e.V., 23.-25.11.2000, Fachhochschule Köln. Hrsg.: K.-D. Schmitz

Nohr, H.: Big Data im Lichte der EU-Datenschutz-Grundverordnung (2017) 0.02

0.018644823 = product of:
  0.07457929 = sum of:
    0.014868983 = weight(_text_:und in 4076) [ClassicSimilarity], result of:
      0.014868983 = score(doc=4076,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 4076, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=4076)
    0.014868983 = weight(_text_:und in 4076) [ClassicSimilarity], result of:
      0.014868983 = score(doc=4076,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 4076, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=4076)
    0.015103361 = weight(_text_:der in 4076) [ClassicSimilarity], result of:
      0.015103361 = score(doc=4076,freq=4.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.27922085 = fieldWeight in 4076, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0625 = fieldNorm(doc=4076)
    0.014868983 = weight(_text_:und in 4076) [ClassicSimilarity], result of:
      0.014868983 = score(doc=4076,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 4076, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=4076)
    0.014868983 = weight(_text_:und in 4076) [ClassicSimilarity], result of:
      0.014868983 = score(doc=4076,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.27704588 = fieldWeight in 4076, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=4076)
  0.25 = coord(5/20)

Abstract: Der vorliegende Beitrag beschäftigt sich mit den Rahmenbedingungen für analytische Anwendungen wie Big Data, die durch das neue europäische Datenschutzrecht entstehen, insbesondere durch die EU-Datenschutz-Grundverordnung. Er stellt wesentliche Neuerungen vor und untersucht die spezifischen datenschutzrechtlichen Regelungen im Hinblick auf den Einsatz von Big Data sowie Voraussetzungen, die durch die Verordnung abverlangt werden.
Source: JurPC: Internet-Zeitschrift für Rechtsinformatik und Informationsrecht, [http://www.jurpc.de/jurpc/show?id=20170111]

Witschel, H.F.: Text, Wörter, Morpheme : Möglichkeiten einer automatischen Terminologie-Extraktion (2004) 0.02

0.018148553 = product of:
  0.07259421 = sum of:
    0.013142449 = weight(_text_:und in 126) [ClassicSimilarity], result of:
      0.013142449 = score(doc=126,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 126, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=126)
    0.013142449 = weight(_text_:und in 126) [ClassicSimilarity], result of:
      0.013142449 = score(doc=126,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 126, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=126)
    0.020024417 = weight(_text_:der in 126) [ClassicSimilarity], result of:
      0.020024417 = score(doc=126,freq=18.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.37019804 = fieldWeight in 126, product of:
          4.2426405 = tf(freq=18.0), with freq of:
            18.0 = termFreq=18.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0390625 = fieldNorm(doc=126)
    0.013142449 = weight(_text_:und in 126) [ClassicSimilarity], result of:
      0.013142449 = score(doc=126,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 126, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=126)
    0.013142449 = weight(_text_:und in 126) [ClassicSimilarity], result of:
      0.013142449 = score(doc=126,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 126, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=126)
  0.25 = coord(5/20)

Abstract: Die vorliegende Arbeit beschäftigt sich mit einem Teilgebiet des TextMining, versucht also Information (in diesem Fall Fachterminologie) aus natürlichsprachlichem Text zu extrahieren. Die der Arbeit zugrundeliegende These besagt, daß in vielen Gebieten des Text Mining die Kombination verschiedener Methoden sinnvoll sein kann, um dem Facettenreichtum natürlicher Sprache gerecht zu werden. Die bei der Terminologie-Extraktion angewandten Methoden sind statistischer und linguistischer (bzw. musterbasierter) Natur. Um sie herzuleiten, wurden einige Eigenschaften von Fachtermini herausgearbeitet, die für deren Extraktion relevant sind. So läßt sich z.B. die Tatsache, daß viele Fachbegriffe Nominalphrasen einer bestimmten Form sind, direkt für eine Suche nach gewissen POS-Mustern ausnützen, die Verteilung von Termen in Fachtexten führte zu einem statistischen Ansatz - der Differenzanalyse. Zusammen mit einigen weiteren wurden diese Ansätze in ein Verfahren integriert, welches in der Lage ist, aus dem Feedback eines Anwenders zu lernen und in mehreren Schritten die Suche nach Terminologie zu verfeinern. Dabei wurden mehrere Parameter des Verfahrens veränderlich belassen, d.h. der Anwender kann sie beliebig anpassen. Bei der Untersuchung der Ergebnisse anhand von zwei Fachtexten aus unterschiedlichen Domänen wurde deutlich, daß sich zwar die verschiedenen Verfahren gut ergänzen, daß aber die optimalen Werte der veränderbaren Parameter, ja selbst die Auswahl der angewendeten Verfahren text- und domänenabhängig sind.
Imprint: Leipzig : Universität / Fakultät für Mathematik und Informatik Institut für Informatik

Hölzig, C.: Google spürt Grippewellen auf : Die neue Anwendung ist bisher auf die USA beschränkt (2008) 0.02

0.017960742 = product of:
  0.059869137 = sum of:
    0.0091053555 = weight(_text_:und in 2403) [ClassicSimilarity], result of:
      0.0091053555 = score(doc=2403,freq=6.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.16965526 = fieldWeight in 2403, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=2403)
    0.0091053555 = weight(_text_:und in 2403) [ClassicSimilarity], result of:
      0.0091053555 = score(doc=2403,freq=6.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.16965526 = fieldWeight in 2403, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=2403)
    0.01688607 = weight(_text_:der in 2403) [ClassicSimilarity], result of:
      0.01688607 = score(doc=2403,freq=20.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.3121784 = fieldWeight in 2403, product of:
          4.472136 = tf(freq=20.0), with freq of:
            20.0 = termFreq=20.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.03125 = fieldNorm(doc=2403)
    0.0091053555 = weight(_text_:und in 2403) [ClassicSimilarity], result of:
      0.0091053555 = score(doc=2403,freq=6.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.16965526 = fieldWeight in 2403, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=2403)
    0.0091053555 = weight(_text_:und in 2403) [ClassicSimilarity], result of:
      0.0091053555 = score(doc=2403,freq=6.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.16965526 = fieldWeight in 2403, product of:
          2.4494898 = tf(freq=6.0), with freq of:
            6.0 = termFreq=6.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.03125 = fieldNorm(doc=2403)
    0.006561648 = product of:
      0.013123296 = sum of:
        0.013123296 = weight(_text_:22 in 2403) [ClassicSimilarity], result of:
          0.013123296 = score(doc=2403,freq=2.0), product of:
            0.08479747 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.024215192 = queryNorm
            0.15476047 = fieldWeight in 2403, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.03125 = fieldNorm(doc=2403)
      0.5 = coord(1/2)
  0.3 = coord(6/20)

Content: "Vor Google gibt es kein Entrinnen. Nun macht sich die größte Internetsuchmaschine daran, auch gefährliche Grippewellen in den USA vorauszusagen - und das schneller als die US-Gesundheitsbehörde. In den Regionen, in denen die Influenza grassiert, häufen sich erfahrungsgemäß auch die Online-Anfragen im Internet speziell zu diesem Thema. "Wir haben einen engen Zusammenhang feststellen können zwischen Personen, die nach themenbezogenen Informationen suchen, und Personen, die tatsächlich an der Grippe erkrankt sind", schreibt Google. Ein Webtool namens "Google Flu Trends" errechnet aus den Anfragen die Ausbreitung von Grippeviren. Auch wenn nicht jeder Nutzer erkrankt sei, spiegele die Zahl der Anfragen doch ziemlich genau die Entwicklung einer Grippewelle wider. Das belege ein Vergleich mit den Daten der US-Seuchenkontrollbehörde CDC, die in den meisten Fällen nahezu identisch seien. Die Internet-Suchmaschine könne anders als die Gesundheitsbehörde täglich auf aktuelle Daten zurückgreifen. Dadurch sei Google in der Lage, die Grippesaison ein bis zwei Wochen früher vorherzusagen. Und Zeit bedeutet Leben, wie Lyn Finelli sagt, Leiter der Abteilung Influenza der USSeuchenkontrollbehörde: "Je früher wir gewarnt werden, desto früher können wir handeln. Dies kann die Anzahl der Erkrankten erheblich minimieren." "Google Flu Trends" ist das erste Projekt, das Datenbanken einer Suchmaschine nutzt, um einen auftretenden Grippevirus zu lokalisieren - zurzeit nur in den USA, aber weltweite Prognosen wären ein folgerichtiger nächster Schritt. Philip M. Polgreen von der Universität von Iowa verspricht sich noch viel mehr: "Theoretisch können wir diese Flut an Informationen dazu nutzen, auch den Verlauf anderer Krankheiten besser zu studieren." Um das Grippe-Ausbreitungsmodell zu erstellen, hat Google mehrere hundert Milliarden Suchanfragen aus den vergangenen Jahren analysiert. Datenschützer haben den Internetgiganten bereits mehrfach als "datenschutzfeindlich" eingestuft. Die Anwender wüssten weder, was mit den gesammelten Daten passiere, noch wie lange gespeicherte Informationen verfügbar seien. Google versichert jedoch, dass "Flu Trends" die Privatsphäre wahre. Das Tool könne niemals dazu genutzt werden, einzelne Nutzer zu identifizieren, da wir bei der Erstellung der Statistiken lediglich anonyme Datenmaterialien nutzen. Die Muster, die wir in den Daten analysieren, ergeben erst in einem größeren Kontext Sinn." An einer echten Virus-Grippe - nicht zu verwechseln mit einer Erkältung - erkranken weltweit mehrere Millionen Menschen, mehr als 500 000 sterben daran."
Date: 3. 5.1997 8:44:22

Data Mining im praktischen Einsatz : Verfahren und Anwendungsfälle für Marketing, Vertrieb, Controlling und Kundenunterstützung (2000) 0.02

0.01784278 = product of:
  0.0892139 = sum of:
    0.022303475 = weight(_text_:und in 3425) [ClassicSimilarity], result of:
      0.022303475 = score(doc=3425,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.41556883 = fieldWeight in 3425, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.09375 = fieldNorm(doc=3425)
    0.022303475 = weight(_text_:und in 3425) [ClassicSimilarity], result of:
      0.022303475 = score(doc=3425,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.41556883 = fieldWeight in 3425, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.09375 = fieldNorm(doc=3425)
    0.022303475 = weight(_text_:und in 3425) [ClassicSimilarity], result of:
      0.022303475 = score(doc=3425,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.41556883 = fieldWeight in 3425, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.09375 = fieldNorm(doc=3425)
    0.022303475 = weight(_text_:und in 3425) [ClassicSimilarity], result of:
      0.022303475 = score(doc=3425,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.41556883 = fieldWeight in 3425, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.09375 = fieldNorm(doc=3425)
  0.2 = coord(4/20)

Seidenfaden, U.: Schürfen in Datenbergen : Data-Mining soll möglichst viel Information zu Tage fördern (2001) 0.02
```
0.017056746 = product of:
  0.068226986 = sum of:
    0.01301036 = weight(_text_:und in 6923) [ClassicSimilarity], result of:
      0.01301036 = score(doc=6923,freq=16.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24241515 = fieldWeight in 6923, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.02734375 = fieldNorm(doc=6923)
    0.01301036 = weight(_text_:und in 6923) [ClassicSimilarity], result of:
      0.01301036 = score(doc=6923,freq=16.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24241515 = fieldWeight in 6923, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.02734375 = fieldNorm(doc=6923)
    0.016185544 = weight(_text_:der in 6923) [ClassicSimilarity], result of:
      0.016185544 = score(doc=6923,freq=24.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.29922754 = fieldWeight in 6923, product of:
          4.8989797 = tf(freq=24.0), with freq of:
            24.0 = termFreq=24.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.02734375 = fieldNorm(doc=6923)
    0.01301036 = weight(_text_:und in 6923) [ClassicSimilarity], result of:
      0.01301036 = score(doc=6923,freq=16.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24241515 = fieldWeight in 6923, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.02734375 = fieldNorm(doc=6923)
    0.01301036 = weight(_text_:und in 6923) [ClassicSimilarity], result of:
      0.01301036 = score(doc=6923,freq=16.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24241515 = fieldWeight in 6923, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.02734375 = fieldNorm(doc=6923)
  0.25 = coord(5/20)
```
Content

"Fast alles wird heute per Computer erfasst. Kaum einer überblickt noch die enormen Datenmengen, die sich in Unternehmen, Universitäten und Verwaltung ansammeln. Allein in den öffentlich zugänglichen Datenbanken der Genforscher fallen pro Woche rund 4,5 Gigabyte an neuer Information an. "Vom potentiellen Wissen in den Datenbanken wird bislang aber oft nur ein Teil genutzt", meint Stefan Wrobel vom Lehrstuhl für Wissensentdeckung und Maschinelles Lernen der Otto-von-Guericke-Universität in Magdeburg. Sein Doktorand Mark-Andre Krogel hat soeben mit einem neuen Verfahren zur Datenbankrecherche in San Francisco einen inoffiziellen Weltmeister-Titel in der Disziplin "Data-Mining" gewonnen. Dieser Daten-Bergbau arbeitet im Unterschied zur einfachen Datenbankabfrage, die sich einfacher statistischer Methoden bedient, zusätzlich mit künstlicher Intelligenz und Visualisierungsverfahren, um Querverbindungen zu finden. "Das erleichtert die Suche nach verborgenen Zusammenhängen im Datenmaterial ganz erheblich", so Wrobel. Die Wirtschaft setzt Data-Mining bereits ein, um das Kundenverhalten zu untersuchen und vorherzusagen. "Stellen sie sich ein Unternehmen mit einer breiten Produktpalette und einem großen Kundenstamm vor", erklärt Wrobel. "Es kann seinen Erfolg maximieren, wenn es Marketing-Post zielgerichtet an seine Kunden verschickt. Wer etwa gerade einen PC gekauft hat, ist womöglich auch an einem Drucker oder Scanner interessiert." In einigen Jahren könnte ein Analysemodul den Manager eines Unternehmens selbständig informieren, wenn ihm etwas Ungewöhnliches aufgefallen ist. Das muss nicht immer positiv für den Kunden sein. Data-Mining ließe sich auch verwenden, um die Lebensdauer von Geschäftsbeziehungen zu prognostizieren. Für Kunden mit geringen Kaufinteressen würden Reklamationen dann längere Bearbeitungszeiten nach sich ziehen. Im konkreten Projekt von Mark-Andre Krogel ging es um die Vorhersage von Protein-Funktionen. Proteine sind Eiweißmoleküle, die fast alle Stoffwechselvorgänge im menschlichen Körper steuern. Sie sind daher die primären Ziele von Wirkstoffen zur Behandlung von Erkrankungen. Das erklärt das große Interesse der Pharmaindustrie. Experimentelle Untersuchungen, die Aufschluss über die Aufgaben der über 100 000 Eiweißmoleküle im menschlichen Körper geben können, sind mit einem hohen Zeitaufwand verbunden. Die Forscher möchten deshalb die Zeit verkürzen, indem sie das vorhandene Datenmaterial mit Hilfe von Data-Mining auswerten. Aus der im Humangenomprojekt bereits entschlüsselten Abfolge der Erbgut-Bausteine lässt sich per Datenbankanalyse die Aneinanderreihung bestimmter Aminosäuren zu einem Protein vorhersagen. Andere Datenbanken wiederum enthalten Informationen, welche Struktur ein Protein mit einer bestimmten vorgegebenen Funktion haben könnte. Aus bereits bekannten Strukturelementen versuchen die Genforscher dann, auf die mögliche Funktion eines bislang noch unbekannten Eiweißmoleküls zu schließen.- Fakten Verschmelzen - Bei diesem theoretischen Ansatz kommt es darauf an, die in Datenbanken enthaltenen Informationen so zu verknüpfen, dass die Ergebnisse mit hoher Wahrscheinlichkeit mit der Realität übereinstimmen. "Im Rahmen des Wettbewerbs erhielten wir Tabellen als Vorgabe, in denen Gene und Chromosomen nach bestimmten Gesichtspunkten klassifiziert waren", erläutert Krogel. Von einigen Genen war bekannt, welche Proteine sie produzieren und welche Aufgabe diese Eiweißmoleküle besitzen. Diese Beispiele dienten dem von Krogel entwickelten Programm dann als Hilfe, für andere Gene vorherzusagen, welche Funktionen die von ihnen erzeugten Proteine haben. "Die Genauigkeit der Vorhersage lag bei den gestellten Aufgaben bei über 90 Prozent", stellt Krogel fest. Allerdings könne man in der Praxis nicht davon ausgehen, dass alle Informationen aus verschiedenen Datenbanken in einem einheitlichen Format vorliegen. Es gebe verschiedene Abfragesprachen der Datenbanken, und die Bezeichnungen von Eiweißmolekülen mit gleicher Aufgabe seien oftmals uneinheitlich. Die Magdeburger Informatiker arbeiten deshalb in der DFG-Forschergruppe "Informationsfusion" an Methoden, um die verschiedenen Datenquellen besser zu erschließen."

Keim, D.A.: Datenvisualisierung und Data Mining (2004) 0.02

0.016873779 = product of:
  0.067495115 = sum of:
    0.013142449 = weight(_text_:und in 2931) [ClassicSimilarity], result of:
      0.013142449 = score(doc=2931,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 2931, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2931)
    0.013142449 = weight(_text_:und in 2931) [ClassicSimilarity], result of:
      0.013142449 = score(doc=2931,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 2931, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2931)
    0.014925319 = weight(_text_:der in 2931) [ClassicSimilarity], result of:
      0.014925319 = score(doc=2931,freq=10.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.27592933 = fieldWeight in 2931, product of:
          3.1622777 = tf(freq=10.0), with freq of:
            10.0 = termFreq=10.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2931)
    0.013142449 = weight(_text_:und in 2931) [ClassicSimilarity], result of:
      0.013142449 = score(doc=2931,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 2931, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2931)
    0.013142449 = weight(_text_:und in 2931) [ClassicSimilarity], result of:
      0.013142449 = score(doc=2931,freq=8.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 2931, product of:
          2.828427 = tf(freq=8.0), with freq of:
            8.0 = termFreq=8.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=2931)
  0.25 = coord(5/20)

Abstract: Die rasante technologische Entwicklung der letzten zwei Jahrzehnte ermöglicht heute die persistente Speicherung riesiger Datenmengen durch den Computer. Forscher an der Universität Berkeley haben berechnet, dass jedes Jahr ca. 1 Exabyte (= 1 Million Terabyte) Daten generiert werden - ein großer Teil davon in digitaler Form. Das bedeutet aber, dass in den nächsten drei Jahren mehr Daten generiert werden als in der gesamten menschlichen Entwicklung zuvor. Die Daten werden oft automatisch mit Hilfe von Sensoren und Überwachungssystemen aufgezeichnet. So werden beispielsweise alltägliche Vorgänge des menschlichen Lebens, wie das Bezahlen mit Kreditkarte oder die Benutzung des Telefons, durch Computer aufgezeichnet. Dabei werden gewöhnlich alle verfügbaren Parameter abgespeichert, wodurch hochdimensionale Datensätze entstehen. Die Daten werden gesammelt, da sie wertvolle Informationen enthalten, die einen Wettbewerbsvorteil bieten können. Das Finden der wertvollen Informationen in den großen Datenmengen ist aber keine leichte Aufgabe. Heutige Datenbankmanagementsysteme können nur kleine Teilmengen dieser riesigen Datenmengen darstellen. Werden die Daten zum Beispiel in textueller Form ausgegeben, können höchstens ein paar hundert Zeilen auf dem Bildschirm dargestellt werden. Bei Millionen von Datensätzen ist dies aber nur ein Tropfen auf den heißen Stein.
Source: Grundlagen der praktischen Information und Dokumentation. 5., völlig neu gefaßte Ausgabe. 2 Bde. Hrsg. von R. Kuhlen, Th. Seeger u. D. Strauch. Begründet von Klaus Laisiepen, Ernst Lutterbeck, Karl-Heinrich Meyer-Uhlenried. Bd.1: Handbuch zur Einführung in die Informationswissenschaft und -praxis

Borgelt, C.; Kruse, R.: Unsicheres Wissen nutzen (2002) 0.02

0.016479852 = product of:
  0.06591941 = sum of:
    0.013142449 = weight(_text_:und in 1104) [ClassicSimilarity], result of:
      0.013142449 = score(doc=1104,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 1104, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.078125 = fieldNorm(doc=1104)
    0.013142449 = weight(_text_:und in 1104) [ClassicSimilarity], result of:
      0.013142449 = score(doc=1104,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 1104, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.078125 = fieldNorm(doc=1104)
    0.013349611 = weight(_text_:der in 1104) [ClassicSimilarity], result of:
      0.013349611 = score(doc=1104,freq=2.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.2467987 = fieldWeight in 1104, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.078125 = fieldNorm(doc=1104)
    0.013142449 = weight(_text_:und in 1104) [ClassicSimilarity], result of:
      0.013142449 = score(doc=1104,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 1104, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.078125 = fieldNorm(doc=1104)
    0.013142449 = weight(_text_:und in 1104) [ClassicSimilarity], result of:
      0.013142449 = score(doc=1104,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24487628 = fieldWeight in 1104, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.078125 = fieldNorm(doc=1104)
  0.25 = coord(5/20)

Abstract: Probabilistische Schlussfolgerungsnetze sind ein probates Mittel, unsicheres Wissen sauber und mathematisch fundiert zu verarbeiten. In neuerer Zeit wurden Verfahren entwickelt, um sie automatisch aus Beispieldaten zu erlernen
Source: Spektrum der Wissenschaft. 2002, H.11, S.82-84

Decker, B.: Data Mining in Öffentlichen Bibliotheken (2000) 0.01

0.014719543 = product of:
  0.073597714 = sum of:
    0.018399429 = weight(_text_:und in 4782) [ClassicSimilarity], result of:
      0.018399429 = score(doc=4782,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.34282678 = fieldWeight in 4782, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.109375 = fieldNorm(doc=4782)
    0.018399429 = weight(_text_:und in 4782) [ClassicSimilarity], result of:
      0.018399429 = score(doc=4782,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.34282678 = fieldWeight in 4782, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.109375 = fieldNorm(doc=4782)
    0.018399429 = weight(_text_:und in 4782) [ClassicSimilarity], result of:
      0.018399429 = score(doc=4782,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.34282678 = fieldWeight in 4782, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.109375 = fieldNorm(doc=4782)
    0.018399429 = weight(_text_:und in 4782) [ClassicSimilarity], result of:
      0.018399429 = score(doc=4782,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.34282678 = fieldWeight in 4782, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.109375 = fieldNorm(doc=4782)
  0.2 = coord(4/20)

Imprint: Köln : Fachhochschule, Fachbereich Bibliotheks- und Informationswesen

Tiefschürfen in Datenbanken (2002) 0.01

0.014289798 = product of:
  0.057159193 = sum of:
    0.0105139585 = weight(_text_:und in 996) [ClassicSimilarity], result of:
      0.0105139585 = score(doc=996,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.19590102 = fieldWeight in 996, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=996)
    0.0105139585 = weight(_text_:und in 996) [ClassicSimilarity], result of:
      0.0105139585 = score(doc=996,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.19590102 = fieldWeight in 996, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=996)
    0.015103361 = weight(_text_:der in 996) [ClassicSimilarity], result of:
      0.015103361 = score(doc=996,freq=4.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.27922085 = fieldWeight in 996, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.0625 = fieldNorm(doc=996)
    0.0105139585 = weight(_text_:und in 996) [ClassicSimilarity], result of:
      0.0105139585 = score(doc=996,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.19590102 = fieldWeight in 996, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=996)
    0.0105139585 = weight(_text_:und in 996) [ClassicSimilarity], result of:
      0.0105139585 = score(doc=996,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.19590102 = fieldWeight in 996, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0625 = fieldNorm(doc=996)
  0.25 = coord(5/20)

Abstract: Ein Einkauf im Supermarkt, ein Telefongespräch, ein Klick im Internet: Die Spuren solcher Allerweltsaktionen häufen sich zu Datengebirgen ungeheuren Ausmaßes. Darin noch das Wesentlich - was immer das sein mag - zu finden, ist die Aufgabe des noch jungen Wissenschaftszweiges Data Mining, der mit offiziellem Namen "Wissensentdeckung in Datenbanken" heißt
Content: Enthält die Beiträge: Kruse, R., C. Borgelt: Suche im Datendschungel - Borgelt, C. u. R. Kruse: Unsicheres Wissen nutzen - Wrobel, S.: Lern- und Entdeckungsverfahren - Keim, D.A.: Data Mining mit bloßem Auge
Source: Spektrum der Wissenschaft. 2002, H.11, S.80-91

Witten, I.H.; Frank, E.: Data Mining : Praktische Werkzeuge und Techniken für das maschinelle Lernen (2000) 0.01

0.012616751 = product of:
  0.06308375 = sum of:
    0.015770938 = weight(_text_:und in 6833) [ClassicSimilarity], result of:
      0.015770938 = score(doc=6833,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 6833, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.09375 = fieldNorm(doc=6833)
    0.015770938 = weight(_text_:und in 6833) [ClassicSimilarity], result of:
      0.015770938 = score(doc=6833,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 6833, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.09375 = fieldNorm(doc=6833)
    0.015770938 = weight(_text_:und in 6833) [ClassicSimilarity], result of:
      0.015770938 = score(doc=6833,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 6833, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.09375 = fieldNorm(doc=6833)
    0.015770938 = weight(_text_:und in 6833) [ClassicSimilarity], result of:
      0.015770938 = score(doc=6833,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.29385152 = fieldWeight in 6833, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.09375 = fieldNorm(doc=6833)
  0.2 = coord(4/20)

Ohly, H.P.: Bibliometric mining : added value from document analysis and retrieval (2008) 0.01

0.012363065 = product of:
  0.04945226 = sum of:
    0.007885469 = weight(_text_:und in 2386) [ClassicSimilarity], result of:
      0.007885469 = score(doc=2386,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.14692576 = fieldWeight in 2386, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=2386)
    0.007885469 = weight(_text_:und in 2386) [ClassicSimilarity], result of:
      0.007885469 = score(doc=2386,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.14692576 = fieldWeight in 2386, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=2386)
    0.017910382 = weight(_text_:der in 2386) [ClassicSimilarity], result of:
      0.017910382 = score(doc=2386,freq=10.0), product of:
        0.054091092 = queryWeight, product of:
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.024215192 = queryNorm
        0.3311152 = fieldWeight in 2386, product of:
          3.1622777 = tf(freq=10.0), with freq of:
            10.0 = termFreq=10.0
          2.2337668 = idf(docFreq=12875, maxDocs=44218)
          0.046875 = fieldNorm(doc=2386)
    0.007885469 = weight(_text_:und in 2386) [ClassicSimilarity], result of:
      0.007885469 = score(doc=2386,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.14692576 = fieldWeight in 2386, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=2386)
    0.007885469 = weight(_text_:und in 2386) [ClassicSimilarity], result of:
      0.007885469 = score(doc=2386,freq=2.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.14692576 = fieldWeight in 2386, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.046875 = fieldNorm(doc=2386)
  0.25 = coord(5/20)

Series: Fortschritte in der Wissensorganisation; Bd.10
Source: Kompatibilität, Medien und Ethik in der Wissensorganisation - Compatibility, Media and Ethics in Knowledge Organization: Proceedings der 10. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation Wien, 3.-5. Juli 2006 - Proceedings of the 10th Conference of the German Section of the International Society of Knowledge Organization Vienna, 3-5 July 2006. Ed.: H.P. Ohly, S. Netscher u. K. Mitgutsch

Huvila, I.: Mining qualitative data on human information behaviour from the Web (2010) 0.01

0.010408289 = product of:
  0.05204144 = sum of:
    0.01301036 = weight(_text_:und in 4676) [ClassicSimilarity], result of:
      0.01301036 = score(doc=4676,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24241515 = fieldWeight in 4676, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=4676)
    0.01301036 = weight(_text_:und in 4676) [ClassicSimilarity], result of:
      0.01301036 = score(doc=4676,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24241515 = fieldWeight in 4676, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=4676)
    0.01301036 = weight(_text_:und in 4676) [ClassicSimilarity], result of:
      0.01301036 = score(doc=4676,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24241515 = fieldWeight in 4676, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=4676)
    0.01301036 = weight(_text_:und in 4676) [ClassicSimilarity], result of:
      0.01301036 = score(doc=4676,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.24241515 = fieldWeight in 4676, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0546875 = fieldNorm(doc=4676)
  0.2 = coord(4/20)

Source: Information und Wissen: global, sozial und frei? Proceedings des 12. Internationalen Symposiums für Informationswissenschaft (ISI 2011) ; Hildesheim, 9. - 11. März 2011. Hrsg.: J. Griesbaum, T. Mandl u. C. Womser-Hacker

Survey of text mining : clustering, classification, and retrieval (2004) 0.01

0.007434491 = product of:
  0.037172455 = sum of:
    0.009293114 = weight(_text_:und in 804) [ClassicSimilarity], result of:
      0.009293114 = score(doc=804,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.17315367 = fieldWeight in 804, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=804)
    0.009293114 = weight(_text_:und in 804) [ClassicSimilarity], result of:
      0.009293114 = score(doc=804,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.17315367 = fieldWeight in 804, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=804)
    0.009293114 = weight(_text_:und in 804) [ClassicSimilarity], result of:
      0.009293114 = score(doc=804,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.17315367 = fieldWeight in 804, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=804)
    0.009293114 = weight(_text_:und in 804) [ClassicSimilarity], result of:
      0.009293114 = score(doc=804,freq=4.0), product of:
        0.05366975 = queryWeight, product of:
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.024215192 = queryNorm
        0.17315367 = fieldWeight in 804, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          2.216367 = idf(docFreq=13101, maxDocs=44218)
          0.0390625 = fieldNorm(doc=804)
  0.2 = coord(4/20)

Classification: ST 270 Informatik / Monographien / Software und -entwicklung / Datenbanken, Datenbanksysteme, Data base management, Informationssysteme
RVK: ST 270 Informatik / Monographien / Software und -entwicklung / Datenbanken, Datenbanksysteme, Data base management, Informationssysteme

Search (52 results, page 2 of 3)

Authors

Years

Languages

Types

Themes

Subjects

Classifications