Search (162 results, page 1 of 9)

Wiegmann, S.: Hättest du die Titanic überlebt? : Eine kurze Einführung in das Data Mining mit freier Software (2023) 0.01

0.0113775935 = product of:
  0.11377593 = sum of:
    0.09253615 = weight(_text_:wasser in 876) [ClassicSimilarity], result of:
      0.09253615 = score(doc=876,freq=2.0), product of:
        0.14643952 = queryWeight, product of:
          8.1705265 = idf(docFreq=33, maxDocs=44218)
          0.017922899 = queryNorm
        0.6319069 = fieldWeight in 876, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          8.1705265 = idf(docFreq=33, maxDocs=44218)
          0.0546875 = fieldNorm(doc=876)
    0.008576217 = product of:
      0.017152434 = sum of:
        0.017152434 = weight(_text_:29 in 876) [ClassicSimilarity], result of:
          0.017152434 = score(doc=876,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.27205724 = fieldWeight in 876, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0546875 = fieldNorm(doc=876)
      0.5 = coord(1/2)
    0.012663566 = product of:
      0.018995348 = sum of:
        0.001842915 = weight(_text_:a in 876) [ClassicSimilarity], result of:
          0.001842915 = score(doc=876,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.089176424 = fieldWeight in 876, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.0546875 = fieldNorm(doc=876)
        0.017152434 = weight(_text_:29 in 876) [ClassicSimilarity], result of:
          0.017152434 = score(doc=876,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.27205724 = fieldWeight in 876, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0546875 = fieldNorm(doc=876)
      0.6666667 = coord(2/3)
  0.1 = coord(3/30)

Abstract: Am 10. April 1912 ging Elisabeth Walton Allen an Bord der "Titanic", um ihr Hab und Gut nach England zu holen. Eines Nachts wurde sie von ihrer aufgelösten Tante geweckt, deren Kajüte unter Wasser stand. Wie steht es um Elisabeths Chancen und hätte man selbst das Unglück damals überlebt? Das Titanic-Orakel ist eine algorithmusbasierte App, die entsprechende Prognosen aufstellt und im Rahmen des Kurses "Data Science" am Department Information der HAW Hamburg entstanden ist. Dieser Beitrag zeigt Schritt für Schritt, wie die App unter Verwendung freier Software entwickelt wurde. Code und Daten werden zur Nachnutzung bereitgestellt.
Date: 28. 1.2022 11:05:29
Type: a

Seidenfaden, U.: Schürfen in Datenbergen : Data-Mining soll möglichst viel Information zu Tage fördern (2001) 0.01
```
0.007828966 = product of:
  0.05871724 = sum of:
    0.027599389 = product of:
      0.055198777 = sum of:
        0.055198777 = weight(_text_:bergbau in 6923) [ClassicSimilarity], result of:
          0.055198777 = score(doc=6923,freq=2.0), product of:
            0.15994929 = queryWeight, product of:
              8.924298 = idf(docFreq=15, maxDocs=44218)
              0.017922899 = queryNorm
            0.34510174 = fieldWeight in 6923, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              8.924298 = idf(docFreq=15, maxDocs=44218)
              0.02734375 = fieldNorm(doc=6923)
      0.5 = coord(1/2)
    0.023379536 = weight(_text_:post in 6923) [ClassicSimilarity], result of:
      0.023379536 = score(doc=6923,freq=2.0), product of:
        0.10409636 = queryWeight, product of:
          5.808009 = idf(docFreq=360, maxDocs=44218)
          0.017922899 = queryNorm
        0.22459514 = fieldWeight in 6923, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.808009 = idf(docFreq=360, maxDocs=44218)
          0.02734375 = fieldNorm(doc=6923)
    0.007431159 = weight(_text_:u in 6923) [ClassicSimilarity], result of:
      0.007431159 = score(doc=6923,freq=2.0), product of:
        0.058687534 = queryWeight, product of:
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.017922899 = queryNorm
        0.12662244 = fieldWeight in 6923, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.02734375 = fieldNorm(doc=6923)
    3.071525E-4 = product of:
      9.214575E-4 = sum of:
        9.214575E-4 = weight(_text_:a in 6923) [ClassicSimilarity], result of:
          9.214575E-4 = score(doc=6923,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.044588212 = fieldWeight in 6923, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.02734375 = fieldNorm(doc=6923)
      0.33333334 = coord(1/3)
  0.13333334 = coord(4/30)
```
Content

"Fast alles wird heute per Computer erfasst. Kaum einer überblickt noch die enormen Datenmengen, die sich in Unternehmen, Universitäten und Verwaltung ansammeln. Allein in den öffentlich zugänglichen Datenbanken der Genforscher fallen pro Woche rund 4,5 Gigabyte an neuer Information an. "Vom potentiellen Wissen in den Datenbanken wird bislang aber oft nur ein Teil genutzt", meint Stefan Wrobel vom Lehrstuhl für Wissensentdeckung und Maschinelles Lernen der Otto-von-Guericke-Universität in Magdeburg. Sein Doktorand Mark-Andre Krogel hat soeben mit einem neuen Verfahren zur Datenbankrecherche in San Francisco einen inoffiziellen Weltmeister-Titel in der Disziplin "Data-Mining" gewonnen. Dieser Daten-Bergbau arbeitet im Unterschied zur einfachen Datenbankabfrage, die sich einfacher statistischer Methoden bedient, zusätzlich mit künstlicher Intelligenz und Visualisierungsverfahren, um Querverbindungen zu finden. "Das erleichtert die Suche nach verborgenen Zusammenhängen im Datenmaterial ganz erheblich", so Wrobel. Die Wirtschaft setzt Data-Mining bereits ein, um das Kundenverhalten zu untersuchen und vorherzusagen. "Stellen sie sich ein Unternehmen mit einer breiten Produktpalette und einem großen Kundenstamm vor", erklärt Wrobel. "Es kann seinen Erfolg maximieren, wenn es Marketing-Post zielgerichtet an seine Kunden verschickt. Wer etwa gerade einen PC gekauft hat, ist womöglich auch an einem Drucker oder Scanner interessiert." In einigen Jahren könnte ein Analysemodul den Manager eines Unternehmens selbständig informieren, wenn ihm etwas Ungewöhnliches aufgefallen ist. Das muss nicht immer positiv für den Kunden sein. Data-Mining ließe sich auch verwenden, um die Lebensdauer von Geschäftsbeziehungen zu prognostizieren. Für Kunden mit geringen Kaufinteressen würden Reklamationen dann längere Bearbeitungszeiten nach sich ziehen. Im konkreten Projekt von Mark-Andre Krogel ging es um die Vorhersage von Protein-Funktionen. Proteine sind Eiweißmoleküle, die fast alle Stoffwechselvorgänge im menschlichen Körper steuern. Sie sind daher die primären Ziele von Wirkstoffen zur Behandlung von Erkrankungen. Das erklärt das große Interesse der Pharmaindustrie. Experimentelle Untersuchungen, die Aufschluss über die Aufgaben der über 100 000 Eiweißmoleküle im menschlichen Körper geben können, sind mit einem hohen Zeitaufwand verbunden. Die Forscher möchten deshalb die Zeit verkürzen, indem sie das vorhandene Datenmaterial mit Hilfe von Data-Mining auswerten. Aus der im Humangenomprojekt bereits entschlüsselten Abfolge der Erbgut-Bausteine lässt sich per Datenbankanalyse die Aneinanderreihung bestimmter Aminosäuren zu einem Protein vorhersagen. Andere Datenbanken wiederum enthalten Informationen, welche Struktur ein Protein mit einer bestimmten vorgegebenen Funktion haben könnte. Aus bereits bekannten Strukturelementen versuchen die Genforscher dann, auf die mögliche Funktion eines bislang noch unbekannten Eiweißmoleküls zu schließen.- Fakten Verschmelzen - Bei diesem theoretischen Ansatz kommt es darauf an, die in Datenbanken enthaltenen Informationen so zu verknüpfen, dass die Ergebnisse mit hoher Wahrscheinlichkeit mit der Realität übereinstimmen. "Im Rahmen des Wettbewerbs erhielten wir Tabellen als Vorgabe, in denen Gene und Chromosomen nach bestimmten Gesichtspunkten klassifiziert waren", erläutert Krogel. Von einigen Genen war bekannt, welche Proteine sie produzieren und welche Aufgabe diese Eiweißmoleküle besitzen. Diese Beispiele dienten dem von Krogel entwickelten Programm dann als Hilfe, für andere Gene vorherzusagen, welche Funktionen die von ihnen erzeugten Proteine haben. "Die Genauigkeit der Vorhersage lag bei den gestellten Aufgaben bei über 90 Prozent", stellt Krogel fest. Allerdings könne man in der Praxis nicht davon ausgehen, dass alle Informationen aus verschiedenen Datenbanken in einem einheitlichen Format vorliegen. Es gebe verschiedene Abfragesprachen der Datenbanken, und die Bezeichnungen von Eiweißmolekülen mit gleicher Aufgabe seien oftmals uneinheitlich. Die Magdeburger Informatiker arbeiten deshalb in der DFG-Forschergruppe "Informationsfusion" an Methoden, um die verschiedenen Datenquellen besser zu erschließen."

Type

a

Hölzig, C.: Google spürt Grippewellen auf : Die neue Anwendung ist bisher auf die USA beschränkt (2008) 0.01

0.0068550617 = product of:
  0.05141296 = sum of:
    0.027439507 = weight(_text_:einzelne in 2403) [ClassicSimilarity], result of:
      0.027439507 = score(doc=2403,freq=2.0), product of:
        0.10548963 = queryWeight, product of:
          5.885746 = idf(docFreq=333, maxDocs=44218)
          0.017922899 = queryNorm
        0.26011568 = fieldWeight in 2403, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.885746 = idf(docFreq=333, maxDocs=44218)
          0.03125 = fieldNorm(doc=2403)
    0.013148096 = weight(_text_:neue in 2403) [ClassicSimilarity], result of:
      0.013148096 = score(doc=2403,freq=2.0), product of:
        0.07302189 = queryWeight, product of:
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.017922899 = queryNorm
        0.18005691 = fieldWeight in 2403, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.03125 = fieldNorm(doc=2403)
    0.0036478117 = product of:
      0.0072956234 = sum of:
        0.0072956234 = weight(_text_:online in 2403) [ClassicSimilarity], result of:
          0.0072956234 = score(doc=2403,freq=2.0), product of:
            0.05439423 = queryWeight, product of:
              3.0349014 = idf(docFreq=5778, maxDocs=44218)
              0.017922899 = queryNorm
            0.13412495 = fieldWeight in 2403, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.0349014 = idf(docFreq=5778, maxDocs=44218)
              0.03125 = fieldNorm(doc=2403)
      0.5 = coord(1/2)
    0.007177544 = product of:
      0.010766315 = sum of:
        0.0010530943 = weight(_text_:a in 2403) [ClassicSimilarity], result of:
          0.0010530943 = score(doc=2403,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.050957955 = fieldWeight in 2403, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.03125 = fieldNorm(doc=2403)
        0.009713221 = weight(_text_:22 in 2403) [ClassicSimilarity], result of:
          0.009713221 = score(doc=2403,freq=2.0), product of:
            0.06276294 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.017922899 = queryNorm
            0.15476047 = fieldWeight in 2403, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.03125 = fieldNorm(doc=2403)
      0.6666667 = coord(2/3)
  0.13333334 = coord(4/30)

Content: "Vor Google gibt es kein Entrinnen. Nun macht sich die größte Internetsuchmaschine daran, auch gefährliche Grippewellen in den USA vorauszusagen - und das schneller als die US-Gesundheitsbehörde. In den Regionen, in denen die Influenza grassiert, häufen sich erfahrungsgemäß auch die Online-Anfragen im Internet speziell zu diesem Thema. "Wir haben einen engen Zusammenhang feststellen können zwischen Personen, die nach themenbezogenen Informationen suchen, und Personen, die tatsächlich an der Grippe erkrankt sind", schreibt Google. Ein Webtool namens "Google Flu Trends" errechnet aus den Anfragen die Ausbreitung von Grippeviren. Auch wenn nicht jeder Nutzer erkrankt sei, spiegele die Zahl der Anfragen doch ziemlich genau die Entwicklung einer Grippewelle wider. Das belege ein Vergleich mit den Daten der US-Seuchenkontrollbehörde CDC, die in den meisten Fällen nahezu identisch seien. Die Internet-Suchmaschine könne anders als die Gesundheitsbehörde täglich auf aktuelle Daten zurückgreifen. Dadurch sei Google in der Lage, die Grippesaison ein bis zwei Wochen früher vorherzusagen. Und Zeit bedeutet Leben, wie Lyn Finelli sagt, Leiter der Abteilung Influenza der USSeuchenkontrollbehörde: "Je früher wir gewarnt werden, desto früher können wir handeln. Dies kann die Anzahl der Erkrankten erheblich minimieren." "Google Flu Trends" ist das erste Projekt, das Datenbanken einer Suchmaschine nutzt, um einen auftretenden Grippevirus zu lokalisieren - zurzeit nur in den USA, aber weltweite Prognosen wären ein folgerichtiger nächster Schritt. Philip M. Polgreen von der Universität von Iowa verspricht sich noch viel mehr: "Theoretisch können wir diese Flut an Informationen dazu nutzen, auch den Verlauf anderer Krankheiten besser zu studieren." Um das Grippe-Ausbreitungsmodell zu erstellen, hat Google mehrere hundert Milliarden Suchanfragen aus den vergangenen Jahren analysiert. Datenschützer haben den Internetgiganten bereits mehrfach als "datenschutzfeindlich" eingestuft. Die Anwender wüssten weder, was mit den gesammelten Daten passiere, noch wie lange gespeicherte Informationen verfügbar seien. Google versichert jedoch, dass "Flu Trends" die Privatsphäre wahre. Das Tool könne niemals dazu genutzt werden, einzelne Nutzer zu identifizieren, da wir bei der Erstellung der Statistiken lediglich anonyme Datenmaterialien nutzen. Die Muster, die wir in den Daten analysieren, ergeben erst in einem größeren Kontext Sinn." An einer echten Virus-Grippe - nicht zu verwechseln mit einer Erkältung - erkranken weltweit mehrere Millionen Menschen, mehr als 500 000 sterben daran."
Date: 3. 5.1997 8:44:22
Type: a

Medien-Informationsmanagement : Archivarische, dokumentarische, betriebswirtschaftliche, rechtliche und Berufsbild-Aspekte ; [Frühjahrstagung der Fachgruppe 7 im Jahr 2000 in Weimar und Folgetagung 2001 in Köln] (2003) 0.00
```
0.004951138 = product of:
  0.04951138 = sum of:
    0.009861072 = weight(_text_:neue in 1833) [ClassicSimilarity], result of:
      0.009861072 = score(doc=1833,freq=2.0), product of:
        0.07302189 = queryWeight, product of:
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.017922899 = queryNorm
        0.13504268 = fieldWeight in 1833, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.0234375 = fieldNorm(doc=1833)
    0.037222005 = weight(_text_:medien in 1833) [ClassicSimilarity], result of:
      0.037222005 = score(doc=1833,freq=16.0), product of:
        0.084356464 = queryWeight, product of:
          4.7066307 = idf(docFreq=1085, maxDocs=44218)
          0.017922899 = queryNorm
        0.44124663 = fieldWeight in 1833, product of:
          4.0 = tf(freq=16.0), with freq of:
            16.0 = termFreq=16.0
          4.7066307 = idf(docFreq=1085, maxDocs=44218)
          0.0234375 = fieldNorm(doc=1833)
    0.0024283053 = product of:
      0.007284916 = sum of:
        0.007284916 = weight(_text_:22 in 1833) [ClassicSimilarity], result of:
          0.007284916 = score(doc=1833,freq=2.0), product of:
            0.06276294 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.017922899 = queryNorm
            0.116070345 = fieldWeight in 1833, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0234375 = fieldNorm(doc=1833)
      0.33333334 = coord(1/3)
  0.1 = coord(3/30)
```
Abstract

Als in den siebziger Jahren des vergangenen Jahrhunderts immer häufiger die Bezeichnung Informationsmanager für Leute propagiert wurde, die bis dahin als Dokumentare firmierten, wurde dies in den etablierten Kreisen der Archivare und Bibliothekare gelegentlich belächelt und als Zeichen einer Identitätskrise oder jedenfalls einer Verunsicherung des damit überschriebenen Berufsbilds gewertet. Für den Berufsstand der Medienarchivare/Mediendokumentare, die sich seit 1960 in der Fachgruppe 7 des Vereins, später Verbands deutscher Archivare (VdA) organisieren, gehörte diese Verortung im Zeichen neuer inhaltlicher Herausforderungen (Informationsflut) und Technologien (EDV) allerdings schon früh zu den Selbstverständlichkeiten des Berufsalltags. "Halt, ohne uns geht es nicht!" lautete die Überschrift eines Artikels im Verbandsorgan "Info 7", der sich mit der Einrichtung von immer mächtigeren Leitungsnetzen und immer schnelleren Datenautobahnen beschäftigte. Information, Informationsgesellschaft: diese Begriffe wurden damals fast nur im technischen Sinne verstanden. Die informatisierte, nicht die informierte Gesellschaft stand im Vordergrund - was wiederum Kritiker auf den Plan rief, von Joseph Weizenbaum in den USA bis hin zu den Informations-Ökologen in Bremen. Bei den nationalen, manchmal auch nur regionalen Projekten und Modellversuchen mit Datenautobahnen - auch beim frühen Btx - war nie so recht deutlich geworden, welche Inhalte in welcher Gestalt durch diese Netze und Straßen gejagt werden sollten und wer diese Inhalte eigentlich selektieren, portionieren, positionieren, kurz: managen sollte. Spätestens mit dem World Wide Web sind diese Projekte denn auch obsolet geworden, jedenfalls was die Hardware und Software anging. Geblieben ist das Thema Inhalte (neudeutsch: Content). Und - immer drängender im nicht nur technischen Verständnis - das Thema Informationsmanagement. MedienInformationsManagement war die Frühjahrstagung der Fachgruppe 7 im Jahr 2000 in Weimar überschrieben, und auch die Folgetagung 2001 in Köln, die der multimedialen Produktion einen dokumentarischen Pragmatismus gegenüber stellte, handelte vom Geschäftsfeld Content und von Content-Management-Systemen. Die in diesem 6. Band der Reihe Beiträge zur Mediendokumentation versammelten Vorträge und Diskussionsbeiträge auf diesen beiden Tagungen beleuchten das Titel-Thema aus den verschiedensten Blickwinkeln: archivarischen, dokumentarischen, kaufmännischen, berufsständischen und juristischen. Deutlich wird dabei, daß die Berufsbezeichnung Medienarchivarln/Mediendokumentarln ziemlich genau für all das steht, was heute mit sog. alten wie neuen Medien im organisatorischen, d.h. ordnenden und vermittelnden Sinne geschieht. Im besonderen Maße trifft dies auf das Internet und die aus ihm geborenen Intranets zu. Beide bedürfen genauso der ordnenden Hand, die sich an den alten Medien, an Buch, Zeitung, Tonträger, Film etc. geschult hat, denn sie leben zu großen Teilen davon. Daß das Internet gleichwohl ein Medium sui generis ist und die alten Informationsberufe vor ganz neue Herausforderungen stellt - auch das durchzieht die Beiträge von Weimar und Köln.
Vorliegender Band umgreift den gegenwärtigen Stand der Diskussion um das Handling von Informationen in und mit Hilfe von neuen und alten Medien und liefert außerdem dem Verein Fortbildung für Medienarchivare/ Mediendokumentare (VFM), der seit dem 5. Band die Reihe herausgibt, eine weitere Handreichung für die zusammen mit dem Deutschen Institut, für publizistische Bildungsarbeit in Hagen veranstalteten Seminare. Im Anhang sind außer den vollständigen Programmen der beiden Frühjahrstagungen die Namen und institutionellen Anbindungen der Referenten nachzulesen. Allen Autoren des Bandes sei für ihre Bereitschaft, an dieser Publikation mitzuwirken, gedankt, insbesondere denen, die sich auch noch der Mühe unterziehen mußten, das Transkript ihres in freier Rede gehaltenen Vortrags in eine lesbare Fassung zu bringen. Manche Eigentümlichkeiten des Stils sind dieser freien Rede geschuldet - oder vielleicht auch gedankt, denn sie geben damit umso lebendiger die Atmosphäre jener Frühlingstage in Weimar und Köln wieder.

Classification

AP 11500 Allgemeines / Medien- und Kommunikationswissenschaften, Kommunikationsdesign / Bibliographien und Sammelschriften / Tagungs- und Kongreßberichte (CSN)

Date

11. 5.2008 19:49:22

RSWK

Medien / Informationsmanagement / Aufsatzsammlung

RVK

AP 11500 Allgemeines / Medien- und Kommunikationswissenschaften, Kommunikationsdesign / Bibliographien und Sammelschriften / Tagungs- und Kongreßberichte (CSN)

Subject

Medien / Informationsmanagement / Aufsatzsammlung

Tiefschürfen in Datenbanken (2002) 0.00

0.0041259546 = product of:
  0.041259546 = sum of:
    0.0098013915 = product of:
      0.019602783 = sum of:
        0.019602783 = weight(_text_:29 in 996) [ClassicSimilarity], result of:
          0.019602783 = score(doc=996,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.31092256 = fieldWeight in 996, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0625 = fieldNorm(doc=996)
      0.5 = coord(1/2)
    0.016985506 = weight(_text_:u in 996) [ClassicSimilarity], result of:
      0.016985506 = score(doc=996,freq=2.0), product of:
        0.058687534 = queryWeight, product of:
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.017922899 = queryNorm
        0.28942272 = fieldWeight in 996, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.0625 = fieldNorm(doc=996)
    0.014472648 = product of:
      0.02170897 = sum of:
        0.0021061886 = weight(_text_:a in 996) [ClassicSimilarity], result of:
          0.0021061886 = score(doc=996,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.10191591 = fieldWeight in 996, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.0625 = fieldNorm(doc=996)
        0.019602783 = weight(_text_:29 in 996) [ClassicSimilarity], result of:
          0.019602783 = score(doc=996,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.31092256 = fieldWeight in 996, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0625 = fieldNorm(doc=996)
      0.6666667 = coord(2/3)
  0.1 = coord(3/30)

Content: Enthält die Beiträge: Kruse, R., C. Borgelt: Suche im Datendschungel - Borgelt, C. u. R. Kruse: Unsicheres Wissen nutzen - Wrobel, S.: Lern- und Entdeckungsverfahren - Keim, D.A.: Data Mining mit bloßem Auge
Date: 31.12.1996 19:29:41
Type: a

Klein, H.: Web Content Mining (2004) 0.00
```
0.0040405705 = product of:
  0.030304275 = sum of:
    0.017812679 = product of:
      0.035625357 = sum of:
        0.035625357 = weight(_text_:industrie in 3154) [ClassicSimilarity], result of:
          0.035625357 = score(doc=3154,freq=2.0), product of:
            0.12019911 = queryWeight, product of:
              6.7064548 = idf(docFreq=146, maxDocs=44218)
              0.017922899 = queryNorm
            0.2963862 = fieldWeight in 3154, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              6.7064548 = idf(docFreq=146, maxDocs=44218)
              0.03125 = fieldNorm(doc=3154)
      0.5 = coord(1/2)
    0.0036478117 = product of:
      0.0072956234 = sum of:
        0.0072956234 = weight(_text_:online in 3154) [ClassicSimilarity], result of:
          0.0072956234 = score(doc=3154,freq=2.0), product of:
            0.05439423 = queryWeight, product of:
              3.0349014 = idf(docFreq=5778, maxDocs=44218)
              0.017922899 = queryNorm
            0.13412495 = fieldWeight in 3154, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.0349014 = idf(docFreq=5778, maxDocs=44218)
              0.03125 = fieldNorm(doc=3154)
      0.5 = coord(1/2)
    0.008492753 = weight(_text_:u in 3154) [ClassicSimilarity], result of:
      0.008492753 = score(doc=3154,freq=2.0), product of:
        0.058687534 = queryWeight, product of:
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.017922899 = queryNorm
        0.14471136 = fieldWeight in 3154, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.03125 = fieldNorm(doc=3154)
    3.5103143E-4 = product of:
      0.0010530943 = sum of:
        0.0010530943 = weight(_text_:a in 3154) [ClassicSimilarity], result of:
          0.0010530943 = score(doc=3154,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.050957955 = fieldWeight in 3154, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.03125 = fieldNorm(doc=3154)
      0.33333334 = coord(1/3)
  0.13333334 = coord(4/30)
```
Abstract

Web Mining - ein Schlagwort, das mit der Verbreitung des Internets immer öfter zu lesen und zu hören ist. Die gegenwärtige Forschung beschäftigt sich aber eher mit dem Nutzungsverhalten der Internetnutzer, und ein Blick in Tagungsprogramme einschlägiger Konferenzen (z.B. GOR - German Online Research) zeigt, dass die Analyse der Inhalte kaum Thema ist. Auf der GOR wurden 1999 zwei Vorträge zu diesem Thema gehalten, auf der Folgekonferenz 2001 kein einziger. Web Mining ist der Oberbegriff für zwei Typen von Web Mining: Web Usage Mining und Web Content Mining. Unter Web Usage Mining versteht man das Analysieren von Daten, wie sie bei der Nutzung des WWW anfallen und von den Servern protokolliert wenden. Man kann ermitteln, welche Seiten wie oft aufgerufen wurden, wie lange auf den Seiten verweilt wurde und vieles andere mehr. Beim Web Content Mining wird der Inhalt der Webseiten untersucht, der nicht nur Text, sondern auf Bilder, Video- und Audioinhalte enthalten kann. Die Software für die Analyse von Webseiten ist in den Grundzügen vorhanden, doch müssen die meisten Webseiten für die entsprechende Analysesoftware erst aufbereitet werden. Zuerst müssen die relevanten Websites ermittelt werden, die die gesuchten Inhalte enthalten. Das geschieht meist mit Suchmaschinen, von denen es mittlerweile Hunderte gibt. Allerdings kann man nicht davon ausgehen, dass die Suchmaschinen alle existierende Webseiten erfassen. Das ist unmöglich, denn durch das schnelle Wachstum des Internets kommen täglich Tausende von Webseiten hinzu, und bereits bestehende ändern sich der werden gelöscht. Oft weiß man auch nicht, wie die Suchmaschinen arbeiten, denn das gehört zu den Geschäftsgeheimnissen der Betreiber. Man muss also davon ausgehen, dass die Suchmaschinen nicht alle relevanten Websites finden (können). Der nächste Schritt ist das Herunterladen der Websites, dafür gibt es Software, die unter den Bezeichnungen OfflineReader oder Webspider zu finden ist. Das Ziel dieser Programme ist, die Website in einer Form herunterzuladen, die es erlaubt, die Website offline zu betrachten. Die Struktur der Website wird in der Regel beibehalten. Wer die Inhalte einer Website analysieren will, muss also alle Dateien mit seiner Analysesoftware verarbeiten können. Software für Inhaltsanalyse geht davon aus, dass nur Textinformationen in einer einzigen Datei verarbeitet werden. QDA Software (qualitative data analysis) verarbeitet dagegen auch Audiound Videoinhalte sowie internetspezifische Kommunikation wie z.B. Chats.

Source

Wissensorganisation und Edutainment: Wissen im Spannungsfeld von Gesellschaft, Gestaltung und Industrie. Proceedings der 7. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation, Berlin, 21.-23.3.2001. Hrsg.: C. Lehner, H.P. Ohly u. G. Rahmstorf

Type

a

Ohly, H.P.: Bibliometric mining : added value from document analysis and retrieval (2008) 0.00

0.003958561 = product of:
  0.03958561 = sum of:
    0.026319932 = weight(_text_:medien in 2386) [ClassicSimilarity], result of:
      0.026319932 = score(doc=2386,freq=2.0), product of:
        0.084356464 = queryWeight, product of:
          4.7066307 = idf(docFreq=1085, maxDocs=44218)
          0.017922899 = queryNorm
        0.31200847 = fieldWeight in 2386, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          4.7066307 = idf(docFreq=1085, maxDocs=44218)
          0.046875 = fieldNorm(doc=2386)
    0.012739129 = weight(_text_:u in 2386) [ClassicSimilarity], result of:
      0.012739129 = score(doc=2386,freq=2.0), product of:
        0.058687534 = queryWeight, product of:
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.017922899 = queryNorm
        0.21706703 = fieldWeight in 2386, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.046875 = fieldNorm(doc=2386)
    5.265472E-4 = product of:
      0.0015796415 = sum of:
        0.0015796415 = weight(_text_:a in 2386) [ClassicSimilarity], result of:
          0.0015796415 = score(doc=2386,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.07643694 = fieldWeight in 2386, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.046875 = fieldNorm(doc=2386)
      0.33333334 = coord(1/3)
  0.1 = coord(3/30)

Source: Kompatibilität, Medien und Ethik in der Wissensorganisation - Compatibility, Media and Ethics in Knowledge Organization: Proceedings der 10. Tagung der Deutschen Sektion der Internationalen Gesellschaft für Wissensorganisation Wien, 3.-5. Juli 2006 - Proceedings of the 10th Conference of the German Section of the International Society of Knowledge Organization Vienna, 3-5 July 2006. Ed.: H.P. Ohly, S. Netscher u. K. Mitgutsch
Type: a

Amir, A.; Feldman, R.; Kashi, R.: ¬A new and versatile method for association generation (1997) 0.00

0.0035993138 = product of:
  0.053989705 = sum of:
    0.0098013915 = product of:
      0.019602783 = sum of:
        0.019602783 = weight(_text_:29 in 1270) [ClassicSimilarity], result of:
          0.019602783 = score(doc=1270,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.31092256 = fieldWeight in 1270, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0625 = fieldNorm(doc=1270)
      0.5 = coord(1/2)
    0.044188313 = sum of:
      0.005159087 = weight(_text_:a in 1270) [ClassicSimilarity], result of:
        0.005159087 = score(doc=1270,freq=12.0), product of:
          0.020665944 = queryWeight, product of:
            1.153047 = idf(docFreq=37942, maxDocs=44218)
            0.017922899 = queryNorm
          0.24964198 = fieldWeight in 1270, product of:
            3.4641016 = tf(freq=12.0), with freq of:
              12.0 = termFreq=12.0
            1.153047 = idf(docFreq=37942, maxDocs=44218)
            0.0625 = fieldNorm(doc=1270)
      0.019602783 = weight(_text_:29 in 1270) [ClassicSimilarity], result of:
        0.019602783 = score(doc=1270,freq=2.0), product of:
          0.063047156 = queryWeight, product of:
            3.5176873 = idf(docFreq=3565, maxDocs=44218)
            0.017922899 = queryNorm
          0.31092256 = fieldWeight in 1270, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5176873 = idf(docFreq=3565, maxDocs=44218)
            0.0625 = fieldNorm(doc=1270)
      0.019426443 = weight(_text_:22 in 1270) [ClassicSimilarity], result of:
        0.019426443 = score(doc=1270,freq=2.0), product of:
          0.06276294 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.017922899 = queryNorm
          0.30952093 = fieldWeight in 1270, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.0625 = fieldNorm(doc=1270)
  0.06666667 = coord(2/30)

Abstract: Current algorithms for finding associations among the attributes describing data in a database have a number of shortcomings. Presents a novel method for association generation, that answers all desiderata. The method is different from all existing algorithms and especially suitable to textual databases with binary attributes. Uses subword trees for quick indexing into the required database statistics. Tests the algorithm on the Reuters-22173 database with satisfactory results
Date: 5. 4.1996 15:29:15
Source: Information systems. 22(1997) nos.5/6, S.333-347
Type: a

Hofstede, A.H.M. ter; Proper, H.A.; Van der Weide, T.P.: Exploiting fact verbalisation in conceptual information modelling (1997) 0.00

0.003094175 = product of:
  0.04641262 = sum of:
    0.008576217 = product of:
      0.017152434 = sum of:
        0.017152434 = weight(_text_:29 in 2908) [ClassicSimilarity], result of:
          0.017152434 = score(doc=2908,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.27205724 = fieldWeight in 2908, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0546875 = fieldNorm(doc=2908)
      0.5 = coord(1/2)
    0.037836403 = sum of:
      0.00368583 = weight(_text_:a in 2908) [ClassicSimilarity], result of:
        0.00368583 = score(doc=2908,freq=8.0), product of:
          0.020665944 = queryWeight, product of:
            1.153047 = idf(docFreq=37942, maxDocs=44218)
            0.017922899 = queryNorm
          0.17835285 = fieldWeight in 2908, product of:
            2.828427 = tf(freq=8.0), with freq of:
              8.0 = termFreq=8.0
            1.153047 = idf(docFreq=37942, maxDocs=44218)
            0.0546875 = fieldNorm(doc=2908)
      0.017152434 = weight(_text_:29 in 2908) [ClassicSimilarity], result of:
        0.017152434 = score(doc=2908,freq=2.0), product of:
          0.063047156 = queryWeight, product of:
            3.5176873 = idf(docFreq=3565, maxDocs=44218)
            0.017922899 = queryNorm
          0.27205724 = fieldWeight in 2908, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5176873 = idf(docFreq=3565, maxDocs=44218)
            0.0546875 = fieldNorm(doc=2908)
      0.016998138 = weight(_text_:22 in 2908) [ClassicSimilarity], result of:
        0.016998138 = score(doc=2908,freq=2.0), product of:
          0.06276294 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.017922899 = queryNorm
          0.2708308 = fieldWeight in 2908, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.0546875 = fieldNorm(doc=2908)
  0.06666667 = coord(2/30)

Abstract: Focuses on the information modelling side of conceptual modelling. Deals with the exploitation of fact verbalisations after finishing the actual information system. Verbalisations are used as input for the design of the so-called information model. Exploits these verbalisation in 4 directions: considers their use for a conceptual query language, the verbalisation of instances, the description of the contents of a database and for the verbalisation of queries in a computer supported query environment. Provides an example session with an envisioned tool for end user query formulations that exploits the verbalisation
Date: 5. 4.1996 15:29:15
Source: Information systems. 22(1997) nos.5/6, S.349-385
Type: a

Heyer, G.; Quasthoff, U.; Wittig, T.: Text Mining : Wissensrohstoff Text. Konzepte, Algorithmen, Ergebnisse (2006) 0.00
```
0.0030734781 = product of:
  0.030734781 = sum of:
    0.018594217 = weight(_text_:neue in 5218) [ClassicSimilarity], result of:
      0.018594217 = score(doc=5218,freq=4.0), product of:
        0.07302189 = queryWeight, product of:
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.017922899 = queryNorm
        0.25463894 = fieldWeight in 5218, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.03125 = fieldNorm(doc=5218)
    0.0036478117 = product of:
      0.0072956234 = sum of:
        0.0072956234 = weight(_text_:online in 5218) [ClassicSimilarity], result of:
          0.0072956234 = score(doc=5218,freq=2.0), product of:
            0.05439423 = queryWeight, product of:
              3.0349014 = idf(docFreq=5778, maxDocs=44218)
              0.017922899 = queryNorm
            0.13412495 = fieldWeight in 5218, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.0349014 = idf(docFreq=5778, maxDocs=44218)
              0.03125 = fieldNorm(doc=5218)
      0.5 = coord(1/2)
    0.008492753 = weight(_text_:u in 5218) [ClassicSimilarity], result of:
      0.008492753 = score(doc=5218,freq=2.0), product of:
        0.058687534 = queryWeight, product of:
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.017922899 = queryNorm
        0.14471136 = fieldWeight in 5218, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.03125 = fieldNorm(doc=5218)
  0.1 = coord(3/30)
```
Abstract

Ein großer Teil des Weltwissens befindet sich in Form digitaler Texte im Internet oder in Intranets. Heutige Suchmaschinen nutzen diesen Wissensrohstoff nur rudimentär: Sie können semantische Zusammen-hänge nur bedingt erkennen. Alle warten auf das semantische Web, in dem die Ersteller von Text selbst die Semantik einfügen. Das wird aber noch lange dauern. Es gibt jedoch eine Technologie, die es bereits heute ermöglicht semantische Zusammenhänge in Rohtexten zu analysieren und aufzubereiten. Das Forschungsgebiet "Text Mining" ermöglicht es mit Hilfe statistischer und musterbasierter Verfahren, Wissen aus Texten zu extrahieren, zu verarbeiten und zu nutzen. Hier wird die Basis für die Suchmaschinen der Zukunft gelegt. Das erste deutsche Lehrbuch zu einer bahnbrechenden Technologie: Text Mining: Wissensrohstoff Text Konzepte, Algorithmen, Ergebnisse Ein großer Teil des Weltwissens befindet sich in Form digitaler Texte im Internet oder in Intranets. Heutige Suchmaschinen nutzen diesen Wissensrohstoff nur rudimentär: Sie können semantische Zusammen-hänge nur bedingt erkennen. Alle warten auf das semantische Web, in dem die Ersteller von Text selbst die Semantik einfügen. Das wird aber noch lange dauern. Es gibt jedoch eine Technologie, die es bereits heute ermöglicht semantische Zusammenhänge in Rohtexten zu analysieren und aufzubereiten. Das For-schungsgebiet "Text Mining" ermöglicht es mit Hilfe statistischer und musterbasierter Verfahren, Wissen aus Texten zu extrahieren, zu verarbeiten und zu nutzen. Hier wird die Basis für die Suchmaschinen der Zukunft gelegt. Was fällt Ihnen bei dem Wort "Stich" ein? Die einen denken an Tennis, die anderen an Skat. Die verschiedenen Zusammenhänge können durch Text Mining automatisch ermittelt und in Form von Wortnetzen dargestellt werden. Welche Begriffe stehen am häufigsten links und rechts vom Wort "Festplatte"? Welche Wortformen und Eigennamen treten seit 2001 neu in der deutschen Sprache auf? Text Mining beantwortet diese und viele weitere Fragen. Tauchen Sie mit diesem Lehrbuch ein in eine neue, faszinierende Wissenschaftsdisziplin und entdecken Sie neue, bisher unbekannte Zusammenhänge und Sichtweisen. Sehen Sie, wie aus dem Wissensrohstoff Text Wissen wird! Dieses Lehrbuch richtet sich sowohl an Studierende als auch an Praktiker mit einem fachlichen Schwerpunkt in der Informatik, Wirtschaftsinformatik und/oder Linguistik, die sich über die Grundlagen, Verfahren und Anwendungen des Text Mining informieren möchten und Anregungen für die Implementierung eigener Anwendungen suchen. Es basiert auf Arbeiten, die während der letzten Jahre an der Abteilung Automatische Sprachverarbeitung am Institut für Informatik der Universität Leipzig unter Leitung von Prof. Dr. Heyer entstanden sind. Eine Fülle praktischer Beispiele von Text Mining-Konzepten und -Algorithmen verhelfen dem Leser zu einem umfassenden, aber auch detaillierten Verständnis der Grundlagen und Anwendungen des Text Mining. Folgende Themen werden behandelt: Wissen und Text Grundlagen der Bedeutungsanalyse Textdatenbanken Sprachstatistik Clustering Musteranalyse Hybride Verfahren Beispielanwendungen Anhänge: Statistik und linguistische Grundlagen 360 Seiten, 54 Abb., 58 Tabellen und 95 Glossarbegriffe Mit kostenlosen e-learning-Kurs "Schnelleinstieg: Sprachstatistik" Zusätzlich zum Buch gibt es in Kürze einen Online-Zertifikats-Kurs mit Mentor- und Tutorunterstützung.

Budzik, J.; Hammond, K.J.; Birnbaum, L.: Information access in context (2001) 0.00

0.0028319713 = product of:
  0.042479567 = sum of:
    0.017152434 = product of:
      0.03430487 = sum of:
        0.03430487 = weight(_text_:29 in 3835) [ClassicSimilarity], result of:
          0.03430487 = score(doc=3835,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.5441145 = fieldWeight in 3835, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.109375 = fieldNorm(doc=3835)
      0.5 = coord(1/2)
    0.025327131 = product of:
      0.037990697 = sum of:
        0.00368583 = weight(_text_:a in 3835) [ClassicSimilarity], result of:
          0.00368583 = score(doc=3835,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.17835285 = fieldWeight in 3835, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.109375 = fieldNorm(doc=3835)
        0.03430487 = weight(_text_:29 in 3835) [ClassicSimilarity], result of:
          0.03430487 = score(doc=3835,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.5441145 = fieldWeight in 3835, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.109375 = fieldNorm(doc=3835)
      0.6666667 = coord(2/3)
  0.06666667 = coord(2/30)

Date: 29. 3.2002 17:31:17
Type: a

Raan, A.F.J. van; Noyons, E.C.M.: Discovery of patterns of scientific and technological development and knowledge transfer (2002) 0.00

0.0026871965 = product of:
  0.026871964 = sum of:
    0.00612587 = product of:
      0.01225174 = sum of:
        0.01225174 = weight(_text_:29 in 3603) [ClassicSimilarity], result of:
          0.01225174 = score(doc=3603,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.19432661 = fieldWeight in 3603, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0390625 = fieldNorm(doc=3603)
      0.5 = coord(1/2)
    0.010615941 = weight(_text_:u in 3603) [ClassicSimilarity], result of:
      0.010615941 = score(doc=3603,freq=2.0), product of:
        0.058687534 = queryWeight, product of:
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.017922899 = queryNorm
        0.1808892 = fieldWeight in 3603, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.2744443 = idf(docFreq=4547, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3603)
    0.010130152 = product of:
      0.015195228 = sum of:
        0.002943488 = weight(_text_:a in 3603) [ClassicSimilarity], result of:
          0.002943488 = score(doc=3603,freq=10.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.14243183 = fieldWeight in 3603, product of:
              3.1622777 = tf(freq=10.0), with freq of:
                10.0 = termFreq=10.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.0390625 = fieldNorm(doc=3603)
        0.01225174 = weight(_text_:29 in 3603) [ClassicSimilarity], result of:
          0.01225174 = score(doc=3603,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.19432661 = fieldWeight in 3603, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.0390625 = fieldNorm(doc=3603)
      0.6666667 = coord(2/3)
  0.1 = coord(3/30)

Abstract: This paper addresses a bibliometric methodology to discover the structure of the scientific 'landscape' in order to gain detailed insight into the development of MD fields, their interaction, and the transfer of knowledge between them. This methodology is appropriate to visualize the position of MD activities in relation to interdisciplinary MD developments, and particularly in relation to socio-economic problems. Furthermore, it allows the identification of the major actors. It even provides the possibility of foresight. We describe a first approach to apply bibliometric mapping as an instrument to investigate characteristics of knowledge transfer. In this paper we discuss the creation of 'maps of science' with help of advanced bibliometric methods. This 'bibliometric cartography' can be seen as a specific type of data-mining, applied to large amounts of scientific publications. As an example we describe the mapping of the field neuroscience, one of the largest and fast growing fields in the life sciences. The number of publications covered by this database is about 80,000 per year, the period covered is 1995-1998. Current research is going an to update the mapping for the years 1999-2002. This paper addresses the main lines of the methodology and its application in the study of knowledge transfer.
Source: Gaining insight from research information (CRIS2002): Proceedings of the 6th International Conference an Current Research Information Systems, University of Kassel, August 29 - 31, 2002. Eds: W. Adamczak u. A. Nase
Type: a

Keim, D.A.: Data Mining mit bloßem Auge (2002) 0.00

0.0024274043 = product of:
  0.036411062 = sum of:
    0.014702087 = product of:
      0.029404175 = sum of:
        0.029404175 = weight(_text_:29 in 1086) [ClassicSimilarity], result of:
          0.029404175 = score(doc=1086,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.46638384 = fieldWeight in 1086, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.09375 = fieldNorm(doc=1086)
      0.5 = coord(1/2)
    0.021708973 = product of:
      0.03256346 = sum of:
        0.003159283 = weight(_text_:a in 1086) [ClassicSimilarity], result of:
          0.003159283 = score(doc=1086,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.15287387 = fieldWeight in 1086, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.09375 = fieldNorm(doc=1086)
        0.029404175 = weight(_text_:29 in 1086) [ClassicSimilarity], result of:
          0.029404175 = score(doc=1086,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.46638384 = fieldWeight in 1086, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.09375 = fieldNorm(doc=1086)
      0.6666667 = coord(2/3)
  0.06666667 = coord(2/30)

Date: 31.12.1996 19:29:41
Type: a

Kruse, R.; Borgelt, C.: Suche im Datendschungel (2002) 0.00

0.0024274043 = product of:
  0.036411062 = sum of:
    0.014702087 = product of:
      0.029404175 = sum of:
        0.029404175 = weight(_text_:29 in 1087) [ClassicSimilarity], result of:
          0.029404175 = score(doc=1087,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.46638384 = fieldWeight in 1087, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.09375 = fieldNorm(doc=1087)
      0.5 = coord(1/2)
    0.021708973 = product of:
      0.03256346 = sum of:
        0.003159283 = weight(_text_:a in 1087) [ClassicSimilarity], result of:
          0.003159283 = score(doc=1087,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.15287387 = fieldWeight in 1087, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.09375 = fieldNorm(doc=1087)
        0.029404175 = weight(_text_:29 in 1087) [ClassicSimilarity], result of:
          0.029404175 = score(doc=1087,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.46638384 = fieldWeight in 1087, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.09375 = fieldNorm(doc=1087)
      0.6666667 = coord(2/3)
  0.06666667 = coord(2/30)

Date: 31.12.1996 19:29:41
Type: a

Wrobel, S.: Lern- und Entdeckungsverfahren (2002) 0.00

0.0024274043 = product of:
  0.036411062 = sum of:
    0.014702087 = product of:
      0.029404175 = sum of:
        0.029404175 = weight(_text_:29 in 1105) [ClassicSimilarity], result of:
          0.029404175 = score(doc=1105,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.46638384 = fieldWeight in 1105, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.09375 = fieldNorm(doc=1105)
      0.5 = coord(1/2)
    0.021708973 = product of:
      0.03256346 = sum of:
        0.003159283 = weight(_text_:a in 1105) [ClassicSimilarity], result of:
          0.003159283 = score(doc=1105,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.15287387 = fieldWeight in 1105, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.09375 = fieldNorm(doc=1105)
        0.029404175 = weight(_text_:29 in 1105) [ClassicSimilarity], result of:
          0.029404175 = score(doc=1105,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.46638384 = fieldWeight in 1105, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.09375 = fieldNorm(doc=1105)
      0.6666667 = coord(2/3)
  0.06666667 = coord(2/30)

Date: 31.12.1996 19:29:41
Type: a

Lihui, C.; Lian, C.W.: Using Web structure and summarisation techniques for Web content mining (2005) 0.00
```
0.0022920335 = product of:
  0.0343805 = sum of:
    0.033399336 = weight(_text_:post in 1046) [ClassicSimilarity], result of:
      0.033399336 = score(doc=1046,freq=2.0), product of:
        0.10409636 = queryWeight, product of:
          5.808009 = idf(docFreq=360, maxDocs=44218)
          0.017922899 = queryNorm
        0.3208502 = fieldWeight in 1046, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.808009 = idf(docFreq=360, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1046)
    9.811628E-4 = product of:
      0.002943488 = sum of:
        0.002943488 = weight(_text_:a in 1046) [ClassicSimilarity], result of:
          0.002943488 = score(doc=1046,freq=10.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.14243183 = fieldWeight in 1046, product of:
              3.1622777 = tf(freq=10.0), with freq of:
                10.0 = termFreq=10.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.0390625 = fieldNorm(doc=1046)
      0.33333334 = coord(1/3)
  0.06666667 = coord(2/30)
```
Abstract

The dynamic nature and size of the Internet can result in difficulty finding relevant information. Most users typically express their information need via short queries to search engines and they often have to physically sift through the search results based on relevance ranking set by the search engines, making the process of relevance judgement time-consuming. In this paper, we describe a novel representation technique which makes use of the Web structure together with summarisation techniques to better represent knowledge in actual Web Documents. We named the proposed technique as Semantic Virtual Document (SVD). We will discuss how the proposed SVD can be used together with a suitable clustering algorithm to achieve an automatic content-based categorization of similar Web Documents. The auto-categorization facility as well as a "Tree-like" Graphical User Interface (GUI) for post-retrieval document browsing enhances the relevance judgement process for Internet users. Furthermore, we will introduce how our cluster-biased automatic query expansion technique can be used to overcome the ambiguity of short queries typically given by users. We will outline our experimental design to evaluate the effectiveness of the proposed SVD for representation and present a prototype called iSEARCH (Intelligent SEarch And Review of Cluster Hierarchy) for Web content mining. Our results confirm, quantify and extend previous research using Web structure and summarisation techniques, introducing novel techniques for knowledge representation to enhance Web content mining.

Type

a

Borgelt, C.; Kruse, R.: Unsicheres Wissen nutzen (2002) 0.00

0.0020228368 = product of:
  0.030342551 = sum of:
    0.01225174 = product of:
      0.02450348 = sum of:
        0.02450348 = weight(_text_:29 in 1104) [ClassicSimilarity], result of:
          0.02450348 = score(doc=1104,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.38865322 = fieldWeight in 1104, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.078125 = fieldNorm(doc=1104)
      0.5 = coord(1/2)
    0.01809081 = product of:
      0.027136216 = sum of:
        0.0026327355 = weight(_text_:a in 1104) [ClassicSimilarity], result of:
          0.0026327355 = score(doc=1104,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.12739488 = fieldWeight in 1104, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.078125 = fieldNorm(doc=1104)
        0.02450348 = weight(_text_:29 in 1104) [ClassicSimilarity], result of:
          0.02450348 = score(doc=1104,freq=2.0), product of:
            0.063047156 = queryWeight, product of:
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.017922899 = queryNorm
            0.38865322 = fieldWeight in 1104, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5176873 = idf(docFreq=3565, maxDocs=44218)
              0.078125 = fieldNorm(doc=1104)
      0.6666667 = coord(2/3)
  0.06666667 = coord(2/30)

Date: 31.12.1996 19:29:41
Type: a

Drees, B.: Text und data mining : Herausforderungen und Möglichkeiten für Bibliotheken (2016) 0.00
```
0.0018945249 = product of:
  0.028417872 = sum of:
    0.027891325 = weight(_text_:neue in 3952) [ClassicSimilarity], result of:
      0.027891325 = score(doc=3952,freq=4.0), product of:
        0.07302189 = queryWeight, product of:
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.017922899 = queryNorm
        0.38195843 = fieldWeight in 3952, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.046875 = fieldNorm(doc=3952)
    5.265472E-4 = product of:
      0.0015796415 = sum of:
        0.0015796415 = weight(_text_:a in 3952) [ClassicSimilarity], result of:
          0.0015796415 = score(doc=3952,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.07643694 = fieldWeight in 3952, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.046875 = fieldNorm(doc=3952)
      0.33333334 = coord(1/3)
  0.06666667 = coord(2/30)
```
Abstract

Text und Data Mining (TDM) gewinnt als wissenschaftliche Methode zunehmend an Bedeutung und stellt wissenschaftliche Bibliotheken damit vor neue Herausforderungen, bietet gleichzeitig aber auch neue Möglichkeiten. Der vorliegende Beitrag gibt einen Überblick über das Thema TDM aus bibliothekarischer Sicht. Hierzu wird der Begriff Text und Data Mining im Kontext verwandter Begriffe diskutiert sowie Ziele, Aufgaben und Methoden von TDM erläutert. Diese werden anhand beispielhafter TDM-Anwendungen in Wissenschaft und Forschung illustriert. Ferner werden technische und rechtliche Probleme und Hindernisse im TDM-Kontext dargelegt. Abschließend wird die Relevanz von TDM für Bibliotheken, sowohl in ihrer Rolle als Informationsvermittler und -anbieter als auch als Anwender von TDM-Methoden, aufgezeigt. Zudem wurde im Rahmen dieser Arbeit eine Befragung der Betreiber von Dokumentenservern an Bibliotheken in Deutschland zum aktuellen Umgang mit TDM durchgeführt, die zeigt, dass hier noch viel Ausbaupotential besteht. Die dem Artikel zugrunde liegenden Forschungsdaten sind unter dem DOI 10.11588/data/10090 publiziert.

Type

a

Nohr, H.: Big Data im Lichte der EU-Datenschutz-Grundverordnung (2017) 0.00

0.0017998838 = product of:
  0.026998255 = sum of:
    0.026296193 = weight(_text_:neue in 4076) [ClassicSimilarity], result of:
      0.026296193 = score(doc=4076,freq=2.0), product of:
        0.07302189 = queryWeight, product of:
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.017922899 = queryNorm
        0.36011383 = fieldWeight in 4076, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          4.074223 = idf(docFreq=2043, maxDocs=44218)
          0.0625 = fieldNorm(doc=4076)
    7.0206285E-4 = product of:
      0.0021061886 = sum of:
        0.0021061886 = weight(_text_:a in 4076) [ClassicSimilarity], result of:
          0.0021061886 = score(doc=4076,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.10191591 = fieldWeight in 4076, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.0625 = fieldNorm(doc=4076)
      0.33333334 = coord(1/3)
  0.06666667 = coord(2/30)

Abstract: Der vorliegende Beitrag beschäftigt sich mit den Rahmenbedingungen für analytische Anwendungen wie Big Data, die durch das neue europäische Datenschutzrecht entstehen, insbesondere durch die EU-Datenschutz-Grundverordnung. Er stellt wesentliche Neuerungen vor und untersucht die spezifischen datenschutzrechtlichen Regelungen im Hinblick auf den Einsatz von Big Data sowie Voraussetzungen, die durch die Verordnung abverlangt werden.
Type: a

Loonus, Y.: Einsatzbereiche der KI und ihre Relevanz für Information Professionals (2017) 0.00

0.0017897654 = product of:
  0.02684648 = sum of:
    0.026319932 = weight(_text_:medien in 5668) [ClassicSimilarity], result of:
      0.026319932 = score(doc=5668,freq=2.0), product of:
        0.084356464 = queryWeight, product of:
          4.7066307 = idf(docFreq=1085, maxDocs=44218)
          0.017922899 = queryNorm
        0.31200847 = fieldWeight in 5668, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          4.7066307 = idf(docFreq=1085, maxDocs=44218)
          0.046875 = fieldNorm(doc=5668)
    5.265472E-4 = product of:
      0.0015796415 = sum of:
        0.0015796415 = weight(_text_:a in 5668) [ClassicSimilarity], result of:
          0.0015796415 = score(doc=5668,freq=2.0), product of:
            0.020665944 = queryWeight, product of:
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.017922899 = queryNorm
            0.07643694 = fieldWeight in 5668, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              1.153047 = idf(docFreq=37942, maxDocs=44218)
              0.046875 = fieldNorm(doc=5668)
      0.33333334 = coord(1/3)
  0.06666667 = coord(2/30)

Abstract: Es liegt in der Natur des Menschen, Erfahrungen und Ideen in Wort und Schrift mit anderen teilen zu wollen. So produzieren wir jeden Tag gigantische Mengen an Texten, die in digitaler Form geteilt und abgelegt werden. The Radicati Group schätzt, dass 2017 täglich 269 Milliarden E-Mails versendet und empfangen werden. Hinzu kommen größtenteils unstrukturierte Daten wie Soziale Medien, Presse, Websites und firmeninterne Systeme, beispielsweise in Form von CRM-Software oder PDF-Dokumenten. Der weltweite Bestand an unstrukturierten Daten wächst so rasant, dass es kaum möglich ist, seinen Umfang zu quantifizieren. Der Versuch, eine belastbare Zahl zu recherchieren, führt unweigerlich zu diversen Artikeln, die den Anteil unstrukturierter Texte am gesamten Datenbestand auf 80% schätzen. Auch wenn nicht mehr einwandfrei nachvollziehbar ist, woher diese Zahl stammt, kann bei kritischer Reflexion unseres Tagesablaufs kaum bezweifelt werden, dass diese Daten von großer wirtschaftlicher Relevanz sind.
Type: a

Search (162 results, page 1 of 9)

Authors

Years

Languages

Types

Themes

Subjects

Classifications