Search (61 results, page 1 of 4)

Hofstede, A.H.M. ter; Proper, H.A.; Van der Weide, T.P.: Exploiting fact verbalisation in conceptual information modelling (1997) 0.08

0.081836894 = product of:
  0.16367379 = sum of:
    0.10527182 = weight(_text_:van in 2908) [ClassicSimilarity], result of:
      0.10527182 = score(doc=2908,freq=2.0), product of:
        0.24408463 = queryWeight, product of:
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.043769516 = queryNorm
        0.43129233 = fieldWeight in 2908, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.0546875 = fieldNorm(doc=2908)
    0.058401965 = sum of:
      0.01689081 = weight(_text_:der in 2908) [ClassicSimilarity], result of:
        0.01689081 = score(doc=2908,freq=2.0), product of:
          0.09777089 = queryWeight, product of:
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.043769516 = queryNorm
          0.17275909 = fieldWeight in 2908, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.0546875 = fieldNorm(doc=2908)
      0.041511156 = weight(_text_:22 in 2908) [ClassicSimilarity], result of:
        0.041511156 = score(doc=2908,freq=2.0), product of:
          0.15327339 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.043769516 = queryNorm
          0.2708308 = fieldWeight in 2908, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.0546875 = fieldNorm(doc=2908)
  0.5 = coord(2/4)

Source: Information systems. 22(1997) nos.5/6, S.349-385

Maaten, L. van den: Learning a parametric embedding by preserving local structure (2009) 0.08

0.07937479 = product of:
  0.15874958 = sum of:
    0.053477753 = weight(_text_:l in 3883) [ClassicSimilarity], result of:
      0.053477753 = score(doc=3883,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.30739886 = fieldWeight in 3883, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3883)
    0.10527182 = weight(_text_:van in 3883) [ClassicSimilarity], result of:
      0.10527182 = score(doc=3883,freq=2.0), product of:
        0.24408463 = queryWeight, product of:
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.043769516 = queryNorm
        0.43129233 = fieldWeight in 3883, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3883)
  0.5 = coord(2/4)

Maaten, L. van den: Accelerating t-SNE using Tree-Based Algorithms (2014) 0.08

0.07937479 = product of:
  0.15874958 = sum of:
    0.053477753 = weight(_text_:l in 3886) [ClassicSimilarity], result of:
      0.053477753 = score(doc=3886,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.30739886 = fieldWeight in 3886, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3886)
    0.10527182 = weight(_text_:van in 3886) [ClassicSimilarity], result of:
      0.10527182 = score(doc=3886,freq=2.0), product of:
        0.24408463 = queryWeight, product of:
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.043769516 = queryNorm
        0.43129233 = fieldWeight in 3886, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3886)
  0.5 = coord(2/4)

Maaten, L. van den; Hinton, G.: Visualizing non-metric similarities in multiple maps (2012) 0.07

0.068035536 = product of:
  0.13607107 = sum of:
    0.04583807 = weight(_text_:l in 3884) [ClassicSimilarity], result of:
      0.04583807 = score(doc=3884,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.26348472 = fieldWeight in 3884, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.046875 = fieldNorm(doc=3884)
    0.090233 = weight(_text_:van in 3884) [ClassicSimilarity], result of:
      0.090233 = score(doc=3884,freq=2.0), product of:
        0.24408463 = queryWeight, product of:
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.043769516 = queryNorm
        0.36967915 = fieldWeight in 3884, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.046875 = fieldNorm(doc=3884)
  0.5 = coord(2/4)

Maaten, L. van den; Hinton, G.: Visualizing data using t-SNE (2008) 0.06

0.05669628 = product of:
  0.11339256 = sum of:
    0.038198393 = weight(_text_:l in 3888) [ClassicSimilarity], result of:
      0.038198393 = score(doc=3888,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.2195706 = fieldWeight in 3888, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3888)
    0.075194165 = weight(_text_:van in 3888) [ClassicSimilarity], result of:
      0.075194165 = score(doc=3888,freq=2.0), product of:
        0.24408463 = queryWeight, product of:
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.043769516 = queryNorm
        0.30806595 = fieldWeight in 3888, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3888)
  0.5 = coord(2/4)

Jäger, L.: Von Big Data zu Big Brother (2018) 0.04
```
0.03549847 = product of:
  0.07099694 = sum of:
    0.030558715 = weight(_text_:l in 5234) [ClassicSimilarity], result of:
      0.030558715 = score(doc=5234,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.17565648 = fieldWeight in 5234, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.03125 = fieldNorm(doc=5234)
    0.040438227 = sum of:
      0.016717566 = weight(_text_:der in 5234) [ClassicSimilarity], result of:
        0.016717566 = score(doc=5234,freq=6.0), product of:
          0.09777089 = queryWeight, product of:
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.043769516 = queryNorm
          0.17098716 = fieldWeight in 5234, product of:
            2.4494898 = tf(freq=6.0), with freq of:
              6.0 = termFreq=6.0
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.03125 = fieldNorm(doc=5234)
      0.023720661 = weight(_text_:22 in 5234) [ClassicSimilarity], result of:
        0.023720661 = score(doc=5234,freq=2.0), product of:
          0.15327339 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.043769516 = queryNorm
          0.15476047 = fieldWeight in 5234, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.03125 = fieldNorm(doc=5234)
  0.5 = coord(2/4)
```
Abstract

1983 bewegte ein einziges Thema die gesamte Bundesrepublik: die geplante Volkszählung. Jeder Haushalt in Westdeutschland sollte Fragebögen mit 36 Fragen zur Wohnsituation, den im Haushalt lebenden Personen und über ihre Einkommensverhältnisse ausfüllen. Es regte sich massiver Widerstand, hunderte Bürgerinitiativen formierten sich im ganzen Land gegen die Befragung. Man wollte nicht "erfasst" werden, die Privatsphäre war heilig. Es bestand die (berechtigte) Sorge, dass die Antworten auf den eigentlich anonymisierten Fragebögen Rückschlüsse auf die Identität der Befragten zulassen. Das Bundesverfassungsgericht gab den Klägern gegen den Zensus Recht: Die geplante Volkszählung verstieß gegen den Datenschutz und damit auch gegen das Grundgesetz. Sie wurde gestoppt. Nur eine Generation später geben wir sorglos jedes Mal beim Einkaufen die Bonuskarte der Supermarktkette heraus, um ein paar Punkte für ein Geschenk oder Rabatte beim nächsten Einkauf zu sammeln. Und dabei wissen wir sehr wohl, dass der Supermarkt damit unser Konsumverhalten bis ins letzte Detail erfährt. Was wir nicht wissen, ist, wer noch Zugang zu diesen Daten erhält. Deren Käufer bekommen nicht nur Zugriff auf unsere Einkäufe, sondern können über sie auch unsere Gewohnheiten, persönlichen Vorlieben und Einkommen ermitteln. Genauso unbeschwert surfen wir im Internet, googeln und shoppen, mailen und chatten. Google, Facebook und Microsoft schauen bei all dem nicht nur zu, sondern speichern auf alle Zeiten alles, was wir von uns geben, was wir einkaufen, was wir suchen, und verwenden es für ihre eigenen Zwecke. Sie durchstöbern unsere E-Mails, kennen unser persönliches Zeitmanagement, verfolgen unseren momentanen Standort, wissen um unsere politischen, religiösen und sexuellen Präferenzen (wer kennt ihn nicht, den Button "an Männern interessiert" oder "an Frauen interessiert"?), unsere engsten Freunde, mit denen wir online verbunden sind, unseren Beziehungsstatus, welche Schule wir besuchen oder besucht haben und vieles mehr.

Date

22. 1.2018 11:33:49

Budzik, J.; Hammond, K.J.; Birnbaum, L.: Information access in context (2001) 0.03

0.026738876 = product of:
  0.106955506 = sum of:
    0.106955506 = weight(_text_:l in 3835) [ClassicSimilarity], result of:
      0.106955506 = score(doc=3835,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.6147977 = fieldWeight in 3835, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.109375 = fieldNorm(doc=3835)
  0.25 = coord(1/4)

Vaughan, L.; Chen, Y.: Data mining from web search queries : a comparison of Google trends and Baidu index (2015) 0.03

0.026511904 = product of:
  0.053023808 = sum of:
    0.038198393 = weight(_text_:l in 1605) [ClassicSimilarity], result of:
      0.038198393 = score(doc=1605,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.2195706 = fieldWeight in 1605, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0390625 = fieldNorm(doc=1605)
    0.014825413 = product of:
      0.029650826 = sum of:
        0.029650826 = weight(_text_:22 in 1605) [ClassicSimilarity], result of:
          0.029650826 = score(doc=1605,freq=2.0), product of:
            0.15327339 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.043769516 = queryNorm
            0.19345059 = fieldWeight in 1605, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0390625 = fieldNorm(doc=1605)
      0.5 = coord(1/2)
  0.5 = coord(2/4)

Source: Journal of the Association for Information Science and Technology. 66(2015) no.1, S.13-22

Lackes, R.; Tillmanns, C.: Data Mining für die Unternehmenspraxis : Entscheidungshilfen und Fallstudien mit führenden Softwarelösungen (2006) 0.02
```
0.019753624 = product of:
  0.079014495 = sum of:
    0.079014495 = sum of:
      0.04343351 = weight(_text_:der in 1383) [ClassicSimilarity], result of:
        0.04343351 = score(doc=1383,freq=18.0), product of:
          0.09777089 = queryWeight, product of:
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.043769516 = queryNorm
          0.44423765 = fieldWeight in 1383, product of:
            4.2426405 = tf(freq=18.0), with freq of:
              18.0 = termFreq=18.0
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.046875 = fieldNorm(doc=1383)
      0.03558099 = weight(_text_:22 in 1383) [ClassicSimilarity], result of:
        0.03558099 = score(doc=1383,freq=2.0), product of:
          0.15327339 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.043769516 = queryNorm
          0.23214069 = fieldWeight in 1383, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.046875 = fieldNorm(doc=1383)
  0.25 = coord(1/4)
```
Abstract

Das Buch richtet sich an Praktiker in Unternehmen, die sich mit der Analyse von großen Datenbeständen beschäftigen. Nach einem kurzen Theorieteil werden vier Fallstudien aus dem Customer Relationship Management eines Versandhändlers bearbeitet. Dabei wurden acht führende Softwarelösungen verwendet: der Intelligent Miner von IBM, der Enterprise Miner von SAS, Clementine von SPSS, Knowledge Studio von Angoss, der Delta Miner von Bissantz, der Business Miner von Business Object und die Data Engine von MIT. Im Rahmen der Fallstudien werden die Stärken und Schwächen der einzelnen Lösungen deutlich, und die methodisch-korrekte Vorgehensweise beim Data Mining wird aufgezeigt. Beides liefert wertvolle Entscheidungshilfen für die Auswahl von Standardsoftware zum Data Mining und für die praktische Datenanalyse.

Content

Modelle, Methoden und Werkzeuge: Ziele und Aufbau der Untersuchung.- Grundlagen.- Planung und Entscheidung mit Data-Mining-Unterstützung.- Methoden.- Funktionalität und Handling der Softwarelösungen. Fallstudien: Ausgangssituation und Datenbestand im Versandhandel.- Kundensegmentierung.- Erklärung regionaler Marketingerfolge zur Neukundengewinnung.Prognose des Customer Lifetime Values.- Selektion von Kunden für eine Direktmarketingaktion.- Welche Softwarelösung für welche Entscheidung?- Fazit und Marktentwicklungen.

Date

22. 3.2008 14:46:06

Raan, A.F.J. van; Noyons, E.C.M.: Discovery of patterns of scientific and technological development and knowledge transfer (2002) 0.02

0.018798541 = product of:
  0.075194165 = sum of:
    0.075194165 = weight(_text_:van in 3603) [ClassicSimilarity], result of:
      0.075194165 = score(doc=3603,freq=2.0), product of:
        0.24408463 = queryWeight, product of:
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.043769516 = queryNorm
        0.30806595 = fieldWeight in 3603, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          5.5765896 = idf(docFreq=454, maxDocs=44218)
          0.0390625 = fieldNorm(doc=3603)
  0.25 = coord(1/4)

Lusti, M.: Data Warehousing and Data Mining : Eine Einführung in entscheidungsunterstützende Systeme (1999) 0.02

0.018685248 = product of:
  0.07474099 = sum of:
    0.07474099 = sum of:
      0.027299672 = weight(_text_:der in 4261) [ClassicSimilarity], result of:
        0.027299672 = score(doc=4261,freq=4.0), product of:
          0.09777089 = queryWeight, product of:
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.043769516 = queryNorm
          0.27922085 = fieldWeight in 4261, product of:
            2.0 = tf(freq=4.0), with freq of:
              4.0 = termFreq=4.0
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.0625 = fieldNorm(doc=4261)
      0.047441322 = weight(_text_:22 in 4261) [ClassicSimilarity], result of:
        0.047441322 = score(doc=4261,freq=2.0), product of:
          0.15327339 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.043769516 = queryNorm
          0.30952093 = fieldWeight in 4261, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.0625 = fieldNorm(doc=4261)
  0.25 = coord(1/4)

Abstract: Im Mittelpunkt dieses anwendungsbezogenen Lehrbuchs stehen Architekturen, Methoden und Werkzeuge entscheidungsunterstützender Systeme. Beispiele und Aufgaben ermöglichen die Entwicklung von Anwendungen mit der Demonstrationssoftware der CD-ROM. Eine interaktive Foliensammlung veranschaulicht den Buchtext und verweist auf zusätzliches Lernmaterial
Date: 17. 7.2002 19:22:06

Chen, Y.-L.; Liu, Y.-H.; Ho, W.-L.: ¬A text mining approach to assist the general public in the retrieval of legal documents (2013) 0.02

0.016206207 = product of:
  0.06482483 = sum of:
    0.06482483 = weight(_text_:l in 521) [ClassicSimilarity], result of:
      0.06482483 = score(doc=521,freq=4.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.37262368 = fieldWeight in 521, product of:
          2.0 = tf(freq=4.0), with freq of:
            4.0 = termFreq=4.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.046875 = fieldNorm(doc=521)
  0.25 = coord(1/4)

Hölzig, C.: Google spürt Grippewellen auf : Die neue Anwendung ist bisher auf die USA beschränkt (2008) 0.01
```
0.0135606555 = product of:
  0.054242622 = sum of:
    0.054242622 = sum of:
      0.03052196 = weight(_text_:der in 2403) [ClassicSimilarity], result of:
        0.03052196 = score(doc=2403,freq=20.0), product of:
          0.09777089 = queryWeight, product of:
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.043769516 = queryNorm
          0.3121784 = fieldWeight in 2403, product of:
            4.472136 = tf(freq=20.0), with freq of:
              20.0 = termFreq=20.0
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.03125 = fieldNorm(doc=2403)
      0.023720661 = weight(_text_:22 in 2403) [ClassicSimilarity], result of:
        0.023720661 = score(doc=2403,freq=2.0), product of:
          0.15327339 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.043769516 = queryNorm
          0.15476047 = fieldWeight in 2403, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.03125 = fieldNorm(doc=2403)
  0.25 = coord(1/4)
```
Content

"Vor Google gibt es kein Entrinnen. Nun macht sich die größte Internetsuchmaschine daran, auch gefährliche Grippewellen in den USA vorauszusagen - und das schneller als die US-Gesundheitsbehörde. In den Regionen, in denen die Influenza grassiert, häufen sich erfahrungsgemäß auch die Online-Anfragen im Internet speziell zu diesem Thema. "Wir haben einen engen Zusammenhang feststellen können zwischen Personen, die nach themenbezogenen Informationen suchen, und Personen, die tatsächlich an der Grippe erkrankt sind", schreibt Google. Ein Webtool namens "Google Flu Trends" errechnet aus den Anfragen die Ausbreitung von Grippeviren. Auch wenn nicht jeder Nutzer erkrankt sei, spiegele die Zahl der Anfragen doch ziemlich genau die Entwicklung einer Grippewelle wider. Das belege ein Vergleich mit den Daten der US-Seuchenkontrollbehörde CDC, die in den meisten Fällen nahezu identisch seien. Die Internet-Suchmaschine könne anders als die Gesundheitsbehörde täglich auf aktuelle Daten zurückgreifen. Dadurch sei Google in der Lage, die Grippesaison ein bis zwei Wochen früher vorherzusagen. Und Zeit bedeutet Leben, wie Lyn Finelli sagt, Leiter der Abteilung Influenza der USSeuchenkontrollbehörde: "Je früher wir gewarnt werden, desto früher können wir handeln. Dies kann die Anzahl der Erkrankten erheblich minimieren." "Google Flu Trends" ist das erste Projekt, das Datenbanken einer Suchmaschine nutzt, um einen auftretenden Grippevirus zu lokalisieren - zurzeit nur in den USA, aber weltweite Prognosen wären ein folgerichtiger nächster Schritt. Philip M. Polgreen von der Universität von Iowa verspricht sich noch viel mehr: "Theoretisch können wir diese Flut an Informationen dazu nutzen, auch den Verlauf anderer Krankheiten besser zu studieren." Um das Grippe-Ausbreitungsmodell zu erstellen, hat Google mehrere hundert Milliarden Suchanfragen aus den vergangenen Jahren analysiert. Datenschützer haben den Internetgiganten bereits mehrfach als "datenschutzfeindlich" eingestuft. Die Anwender wüssten weder, was mit den gesammelten Daten passiere, noch wie lange gespeicherte Informationen verfügbar seien. Google versichert jedoch, dass "Flu Trends" die Privatsphäre wahre. Das Tool könne niemals dazu genutzt werden, einzelne Nutzer zu identifizieren, da wir bei der Erstellung der Statistiken lediglich anonyme Datenmaterialien nutzen. Die Muster, die wir in den Daten analysieren, ergeben erst in einem größeren Kontext Sinn." An einer echten Virus-Grippe - nicht zu verwechseln mit einer Erkältung - erkranken weltweit mehrere Millionen Menschen, mehr als 500 000 sterben daran."

Date

3. 5.1997 8:44:22

Methodologies for knowledge discovery and data mining : Third Pacific-Asia Conference, PAKDD'99, Beijing, China, April 26-28, 1999, Proceedings (1999) 0.01

0.013369438 = product of:
  0.053477753 = sum of:
    0.053477753 = weight(_text_:l in 3821) [ClassicSimilarity], result of:
      0.053477753 = score(doc=3821,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.30739886 = fieldWeight in 3821, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0546875 = fieldNorm(doc=3821)
  0.25 = coord(1/4)

Editor: Zhou, L.

Zhou, L.; Chaovalit, P.: Ontology-supported polarity mining (2008) 0.01

0.013369438 = product of:
  0.053477753 = sum of:
    0.053477753 = weight(_text_:l in 1343) [ClassicSimilarity], result of:
      0.053477753 = score(doc=1343,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.30739886 = fieldWeight in 1343, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0546875 = fieldNorm(doc=1343)
  0.25 = coord(1/4)

Kong, S.; Ye, F.; Feng, L.; Zhao, Z.: Towards the prediction problems of bursting hashtags on Twitter (2015) 0.01

0.013369438 = product of:
  0.053477753 = sum of:
    0.053477753 = weight(_text_:l in 2338) [ClassicSimilarity], result of:
      0.053477753 = score(doc=2338,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.30739886 = fieldWeight in 2338, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0546875 = fieldNorm(doc=2338)
  0.25 = coord(1/4)

Lischka, K.: Spurensuche im Datenwust : Data-Mining-Software fahndet nach kriminellen Mitarbeitern, guten Kunden - und bald vielleicht auch nach Terroristen (2002) 0.01
```
0.012740847 = product of:
  0.050963387 = sum of:
    0.050963387 = sum of:
      0.03317289 = weight(_text_:der in 1178) [ClassicSimilarity], result of:
        0.03317289 = score(doc=1178,freq=42.0), product of:
          0.09777089 = queryWeight, product of:
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.043769516 = queryNorm
          0.3392921 = fieldWeight in 1178, product of:
            6.4807405 = tf(freq=42.0), with freq of:
              42.0 = termFreq=42.0
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.0234375 = fieldNorm(doc=1178)
      0.017790494 = weight(_text_:22 in 1178) [ClassicSimilarity], result of:
        0.017790494 = score(doc=1178,freq=2.0), product of:
          0.15327339 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.043769516 = queryNorm
          0.116070345 = fieldWeight in 1178, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.0234375 = fieldNorm(doc=1178)
  0.25 = coord(1/4)
```
Content

"Ob man als Terrorist einen Anschlag gegen die Vereinigten Staaten plant, als Kassierer Scheine aus der Kasse unterschlägt oder für bestimmte Produkte besonders gerne Geld ausgibt - einen Unterschied macht Data-Mining-Software da nicht. Solche Programme analysieren riesige Daten- mengen und fällen statistische Urteile. Mit diesen Methoden wollen nun die For- scher des "Information Awaren in den Vereinigten Staaten Spuren von Terroristen in den Datenbanken von Behörden und privaten Unternehmen wie Kreditkartenfirmen finden. 200 Millionen Dollar umfasst der Jahresetat für die verschiedenen Forschungsprojekte. Dass solche Software in der Praxis funktioniert, zeigen die steigenden Umsätze der Anbieter so genannter Customer-Relationship-Management-Software. Im vergangenen Jahr ist das Potenzial für analytische CRM-Anwendungen laut dem Marktforschungsinstitut IDC weltweit um 22 Prozent gewachsen, bis zum Jahr 2006 soll es in Deutschland mit einem jährlichen Plus von 14,1 Prozent so weitergehen. Und das trotz schwacher Konjunktur - oder gerade deswegen. Denn ähnlich wie Data-Mining der USRegierung helfen soll, Terroristen zu finden, entscheiden CRM-Programme heute, welche Kunden für eine Firma profitabel sind. Und welche es künftig sein werden, wie Manuela Schnaubelt, Sprecherin des CRM-Anbieters SAP, beschreibt: "Die Kundenbewertung ist ein zentraler Bestandteil des analytischen CRM. Sie ermöglicht es Unternehmen, sich auf die für sie wichtigen und richtigen Kunden zu fokussieren. Darüber hinaus können Firmen mit speziellen Scoring- Verfahren ermitteln, welche Kunden langfristig in welchem Maße zum Unternehmenserfolg beitragen." Die Folgen der Bewertungen sind für die Betroffenen nicht immer positiv: Attraktive Kunden profitieren von individuellen Sonderangeboten und besonderer Zuwendung. Andere hängen vielleicht so lauge in der Warteschleife des Telefonservice, bis die profitableren Kunden abgearbeitet sind. So könnte eine praktische Umsetzung dessen aussehen, was SAP-Spreche-rin Schnaubelt abstrakt beschreibt: "In vielen Unternehmen wird Kundenbewertung mit der klassischen ABC-Analyse durchgeführt, bei der Kunden anhand von Daten wie dem Umsatz kategorisiert werden. A-Kunden als besonders wichtige Kunden werden anders betreut als C-Kunden." Noch näher am geplanten Einsatz von Data-Mining zur Terroristenjagd ist eine Anwendung, die heute viele Firmen erfolgreich nutzen: Sie spüren betrügende Mitarbeiter auf. Werner Sülzer vom großen CRM-Anbieter NCR Teradata beschreibt die Möglichkeiten so: "Heute hinterlässt praktisch jeder Täter - ob Mitarbeiter, Kunde oder Lieferant - Datenspuren bei seinen wirtschaftskriminellen Handlungen. Es muss vorrangig darum gehen, einzelne Spuren zu Handlungsmustern und Täterprofilen zu verdichten. Das gelingt mittels zentraler Datenlager und hoch entwickelter Such- und Analyseinstrumente." Von konkreten Erfolgen sprich: Entlas-sungen krimineller Mitarbeiter-nach Einsatz solcher Programme erzählen Unternehmen nicht gerne. Matthias Wilke von der "Beratungsstelle für Technologiefolgen und Qualifizierung" (BTQ) der Gewerkschaft Verdi weiß von einem Fall 'aus der Schweiz. Dort setzt die Handelskette "Pick Pay" das Programm "Lord Lose Prevention" ein. Zwei Monate nach Einfüh-rung seien Unterschlagungen im Wert von etwa 200 000 Franken ermittelt worden. Das kostete mehr als 50 verdächtige Kassiererinnen und Kassierer den Job.
Jede Kasse schickt die Daten zu Stornos, Rückgaben, Korrekturen und dergleichen an eine zentrale Datenbank. Aus den Informationen errechnet das Programm Kassiererprofile. Wessen Arbeit stark Durchschnitt abweicht, macht sich verdächtig. Die Kriterien" legen im Einzelnen die Revisionsabteilungen fest, doch generell gilt: "Bei Auffälligkeiten wie überdurchschnittlichvielenStornierungen, Off nen der Kassenschublade ohne Verkauf nach einem Storno oder Warenrücknahmen ohne Kassenbon, können die Vorgänge nachträglich einzelnen Personen zugeordnet werden", sagt Rene Schiller, Marketing-Chef des Lord-Herstellers Logware. Ein Kündigungsgrund ist eine solche Datensammlung vor Gericht nicht. Doch auf der Basis können Unternehmen gezielt Detektive einsetzen. Oder sie konfrontieren die Mitarbeiter mit dem Material; woraufhin Schuldige meist gestehen. Wilke sieht Programme wie Lord kritisch:"Jeder, der in dem Raster auffällt, kann ein potenzieller Betrüger oder Dieb sein und verdient besondere Beobachtung." Dabei könne man vom Standard abweichen, weil man unausgeschlafen und deshalb unkonzentriert sei. Hier tut sich für Wilke die Gefahr technisierter Leistungskontrolle auf. "Es ist ja nicht schwierig, mit den Programmen zu berechnen, wie lange beispielsweise das Kassieren eines Samstagseinkaufs durchschnittlich dauert." Die Betriebsräte - ihre Zustimmung ist beim Einsatz technischer Kon trolleinrichtungen nötig - verurteilen die wertende Software weniger eindeutig. Im Gegenteil: Bei Kaufhof und Edeka haben sie dem Einsatz zugestimmt. Denn: "Die wollen ja nicht, dass ganze Abteilungen wegen Inventurverlusten oder dergleichen unter Generalverdacht fallen", erklärt Gewerkschaftler Wilke: "Angesichts der Leistungen kommerzieller Data-Mining-Programme verblüfft es, dass in den Vereinigten Staaten das "Information Awareness Office" noch drei Jahre für Forschung und Erprobung der eigenen Programme veranschlagt. 2005 sollen frühe Prototypen zur Terroristensuche einesgetz werden. Doch schon jetzt regt sich Protest. Datenschützer wie Marc Botenberg vom Informationszentrum für Daten schutz sprechen vom "ehrgeizigsten öffentlichen Überwachungssystem, das je vorgeschlagen wurde". Sie warnen besonders davor, Daten aus der Internetnutzung und private Mails auszuwerten. Das Verteidigungsministerium rudert zurück. Man denke nicht daran, über die Software im Inland aktiv zu werden. "Das werden die Geheimdienste, die Spionageabwehr und die Strafverfolger tun", sagt Unterstaatssekretär Edward Aldridge. Man werde während der Entwicklung und der Tests mit konstruierten und einigen - aus Sicht der Datenschützer unbedenklichen - realen Informationen arbeiten. Zu denken gibt jedoch Aldriges Antwort auf die Frage, warum so viel Geld für die Entwicklung von Übersetzungssoftware eingeplant ist: Damit man Datenbanken in anderen Sprachen nutzen könne - sofern man auf sie rechtmäßigen Zugriff bekommt."
Peters, G.; Gaese, V.: ¬Das DocCat-System in der Textdokumentation von G+J (2003) 0.01
```
0.012314292 = product of:
  0.049257167 = sum of:
    0.049257167 = sum of:
      0.025536506 = weight(_text_:der in 1507) [ClassicSimilarity], result of:
        0.025536506 = score(doc=1507,freq=14.0), product of:
          0.09777089 = queryWeight, product of:
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.043769516 = queryNorm
          0.2611872 = fieldWeight in 1507, product of:
            3.7416575 = tf(freq=14.0), with freq of:
              14.0 = termFreq=14.0
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.03125 = fieldNorm(doc=1507)
      0.023720661 = weight(_text_:22 in 1507) [ClassicSimilarity], result of:
        0.023720661 = score(doc=1507,freq=2.0), product of:
          0.15327339 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.043769516 = queryNorm
          0.15476047 = fieldWeight in 1507, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.03125 = fieldNorm(doc=1507)
  0.25 = coord(1/4)
```
Abstract

Wir werden einmal die Grundlagen des Text-Mining-Systems bei IBM darstellen, dann werden wir das Projekt etwas umfangreicher und deutlicher darstellen, da kennen wir uns aus. Von daher haben wir zwei Teile, einmal Heidelberg, einmal Hamburg. Noch einmal zur Technologie. Text-Mining ist eine von IBM entwickelte Technologie, die in einer besonderen Ausformung und Programmierung für uns zusammengestellt wurde. Das Projekt hieß bei uns lange Zeit DocText Miner und heißt seit einiger Zeit auf Vorschlag von IBM DocCat, das soll eine Abkürzung für Document-Categoriser sein, sie ist ja auch nett und anschaulich. Wir fangen an mit Text-Mining, das bei IBM in Heidelberg entwickelt wurde. Die verstehen darunter das automatische Indexieren als eine Instanz, also einen Teil von Text-Mining. Probleme werden dabei gezeigt, und das Text-Mining ist eben eine Methode zur Strukturierung von und der Suche in großen Dokumentenmengen, die Extraktion von Informationen und, das ist der hohe Anspruch, von impliziten Zusammenhängen. Das letztere sei dahingestellt. IBM macht das quantitativ, empirisch, approximativ und schnell. das muss man wirklich sagen. Das Ziel, und das ist ganz wichtig für unser Projekt gewesen, ist nicht, den Text zu verstehen, sondern das Ergebnis dieser Verfahren ist, was sie auf Neudeutsch a bundle of words, a bag of words nennen, also eine Menge von bedeutungstragenden Begriffen aus einem Text zu extrahieren, aufgrund von Algorithmen, also im Wesentlichen aufgrund von Rechenoperationen. Es gibt eine ganze Menge von linguistischen Vorstudien, ein wenig Linguistik ist auch dabei, aber nicht die Grundlage der ganzen Geschichte. Was sie für uns gemacht haben, ist also die Annotierung von Pressetexten für unsere Pressedatenbank. Für diejenigen, die es noch nicht kennen: Gruner + Jahr führt eine Textdokumentation, die eine Datenbank führt, seit Anfang der 70er Jahre, da sind z.Z. etwa 6,5 Millionen Dokumente darin, davon etwas über 1 Million Volltexte ab 1993. Das Prinzip war lange Zeit, dass wir die Dokumente, die in der Datenbank gespeichert waren und sind, verschlagworten und dieses Prinzip haben wir auch dann, als der Volltext eingeführt wurde, in abgespeckter Form weitergeführt. Zu diesen 6,5 Millionen Dokumenten gehören dann eben auch ungefähr 10 Millionen Faksimileseiten, weil wir die Faksimiles auch noch standardmäßig aufheben.

Date

22. 4.2003 11:45:36
Medien-Informationsmanagement : Archivarische, dokumentarische, betriebswirtschaftliche, rechtliche und Berufsbild-Aspekte ; [Frühjahrstagung der Fachgruppe 7 im Jahr 2000 in Weimar und Folgetagung 2001 in Köln] (2003) 0.01
```
0.01190933 = product of:
  0.04763732 = sum of:
    0.04763732 = sum of:
      0.029846825 = weight(_text_:der in 1833) [ClassicSimilarity], result of:
        0.029846825 = score(doc=1833,freq=34.0), product of:
          0.09777089 = queryWeight, product of:
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.043769516 = queryNorm
          0.30527312 = fieldWeight in 1833, product of:
            5.8309517 = tf(freq=34.0), with freq of:
              34.0 = termFreq=34.0
            2.2337668 = idf(docFreq=12875, maxDocs=44218)
            0.0234375 = fieldNorm(doc=1833)
      0.017790494 = weight(_text_:22 in 1833) [ClassicSimilarity], result of:
        0.017790494 = score(doc=1833,freq=2.0), product of:
          0.15327339 = queryWeight, product of:
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.043769516 = queryNorm
          0.116070345 = fieldWeight in 1833, product of:
            1.4142135 = tf(freq=2.0), with freq of:
              2.0 = termFreq=2.0
            3.5018296 = idf(docFreq=3622, maxDocs=44218)
            0.0234375 = fieldNorm(doc=1833)
  0.25 = coord(1/4)
```
Abstract

Als in den siebziger Jahren des vergangenen Jahrhunderts immer häufiger die Bezeichnung Informationsmanager für Leute propagiert wurde, die bis dahin als Dokumentare firmierten, wurde dies in den etablierten Kreisen der Archivare und Bibliothekare gelegentlich belächelt und als Zeichen einer Identitätskrise oder jedenfalls einer Verunsicherung des damit überschriebenen Berufsbilds gewertet. Für den Berufsstand der Medienarchivare/Mediendokumentare, die sich seit 1960 in der Fachgruppe 7 des Vereins, später Verbands deutscher Archivare (VdA) organisieren, gehörte diese Verortung im Zeichen neuer inhaltlicher Herausforderungen (Informationsflut) und Technologien (EDV) allerdings schon früh zu den Selbstverständlichkeiten des Berufsalltags. "Halt, ohne uns geht es nicht!" lautete die Überschrift eines Artikels im Verbandsorgan "Info 7", der sich mit der Einrichtung von immer mächtigeren Leitungsnetzen und immer schnelleren Datenautobahnen beschäftigte. Information, Informationsgesellschaft: diese Begriffe wurden damals fast nur im technischen Sinne verstanden. Die informatisierte, nicht die informierte Gesellschaft stand im Vordergrund - was wiederum Kritiker auf den Plan rief, von Joseph Weizenbaum in den USA bis hin zu den Informations-Ökologen in Bremen. Bei den nationalen, manchmal auch nur regionalen Projekten und Modellversuchen mit Datenautobahnen - auch beim frühen Btx - war nie so recht deutlich geworden, welche Inhalte in welcher Gestalt durch diese Netze und Straßen gejagt werden sollten und wer diese Inhalte eigentlich selektieren, portionieren, positionieren, kurz: managen sollte. Spätestens mit dem World Wide Web sind diese Projekte denn auch obsolet geworden, jedenfalls was die Hardware und Software anging. Geblieben ist das Thema Inhalte (neudeutsch: Content). Und - immer drängender im nicht nur technischen Verständnis - das Thema Informationsmanagement. MedienInformationsManagement war die Frühjahrstagung der Fachgruppe 7 im Jahr 2000 in Weimar überschrieben, und auch die Folgetagung 2001 in Köln, die der multimedialen Produktion einen dokumentarischen Pragmatismus gegenüber stellte, handelte vom Geschäftsfeld Content und von Content-Management-Systemen. Die in diesem 6. Band der Reihe Beiträge zur Mediendokumentation versammelten Vorträge und Diskussionsbeiträge auf diesen beiden Tagungen beleuchten das Titel-Thema aus den verschiedensten Blickwinkeln: archivarischen, dokumentarischen, kaufmännischen, berufsständischen und juristischen. Deutlich wird dabei, daß die Berufsbezeichnung Medienarchivarln/Mediendokumentarln ziemlich genau für all das steht, was heute mit sog. alten wie neuen Medien im organisatorischen, d.h. ordnenden und vermittelnden Sinne geschieht. Im besonderen Maße trifft dies auf das Internet und die aus ihm geborenen Intranets zu. Beide bedürfen genauso der ordnenden Hand, die sich an den alten Medien, an Buch, Zeitung, Tonträger, Film etc. geschult hat, denn sie leben zu großen Teilen davon. Daß das Internet gleichwohl ein Medium sui generis ist und die alten Informationsberufe vor ganz neue Herausforderungen stellt - auch das durchzieht die Beiträge von Weimar und Köln.
Vorliegender Band umgreift den gegenwärtigen Stand der Diskussion um das Handling von Informationen in und mit Hilfe von neuen und alten Medien und liefert außerdem dem Verein Fortbildung für Medienarchivare/ Mediendokumentare (VFM), der seit dem 5. Band die Reihe herausgibt, eine weitere Handreichung für die zusammen mit dem Deutschen Institut, für publizistische Bildungsarbeit in Hagen veranstalteten Seminare. Im Anhang sind außer den vollständigen Programmen der beiden Frühjahrstagungen die Namen und institutionellen Anbindungen der Referenten nachzulesen. Allen Autoren des Bandes sei für ihre Bereitschaft, an dieser Publikation mitzuwirken, gedankt, insbesondere denen, die sich auch noch der Mühe unterziehen mußten, das Transkript ihres in freier Rede gehaltenen Vortrags in eine lesbare Fassung zu bringen. Manche Eigentümlichkeiten des Stils sind dieser freien Rede geschuldet - oder vielleicht auch gedankt, denn sie geben damit umso lebendiger die Atmosphäre jener Frühlingstage in Weimar und Köln wieder.

Content

Enthält u.a. die Beiträge (Dokumentarische Aspekte): Günter Perers/Volker Gaese: Das DocCat-System in der Textdokumentation von Gr+J (Weimar 2000) Thomas Gerick: Finden statt suchen. Knowledge Retrieval in Wissensbanken. Mit organisiertem Wissen zu mehr Erfolg (Weimar 2000) Winfried Gödert: Aufbereitung und Rezeption von Information (Weimar 2000) Elisabeth Damen: Klassifikation als Ordnungssystem im elektronischen Pressearchiv (Köln 2001) Clemens Schlenkrich: Aspekte neuer Regelwerksarbeit - Multimediales Datenmodell für ARD und ZDF (Köln 2001) Josef Wandeler: Comprenez-vous only Bahnhof'? - Mehrsprachigkeit in der Mediendokumentation (Köln 200 1)

Date

11. 5.2008 19:49:22

Leydesdorff, L.; Persson, O.: Mapping the geography of science : distribution patterns and networks of relations among cities and institutes (2010) 0.01

0.011459517 = product of:
  0.04583807 = sum of:
    0.04583807 = weight(_text_:l in 3704) [ClassicSimilarity], result of:
      0.04583807 = score(doc=3704,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.26348472 = fieldWeight in 3704, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.046875 = fieldNorm(doc=3704)
  0.25 = coord(1/4)

Search (61 results, page 1 of 4)

Authors

Years

Languages

Types

Themes

Subjects

Classifications