Search (31 results, page 1 of 2)

Vanderwende, L.; Suzuki, H.; Brockett, J.M.; Nenkova, A.: Beyond SumBasic : task-focused summarization with sentence simplification and lexical expansion (2007) 0.03
```
0.03181428 = product of:
  0.06362856 = sum of:
    0.04583807 = weight(_text_:l in 948) [ClassicSimilarity], result of:
      0.04583807 = score(doc=948,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.26348472 = fieldWeight in 948, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.046875 = fieldNorm(doc=948)
    0.017790494 = product of:
      0.03558099 = sum of:
        0.03558099 = weight(_text_:22 in 948) [ClassicSimilarity], result of:
          0.03558099 = score(doc=948,freq=2.0), product of:
            0.15327339 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.043769516 = queryNorm
            0.23214069 = fieldWeight in 948, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.046875 = fieldNorm(doc=948)
      0.5 = coord(1/2)
  0.5 = coord(2/4)
```
Abstract

In recent years, there has been increased interest in topic-focused multi-document summarization. In this task, automatic summaries are produced in response to a specific information request, or topic, stated by the user. The system we have designed to accomplish this task comprises four main components: a generic extractive summarization system, a topic-focusing component, sentence simplification, and lexical expansion of topic words. This paper details each of these components, together with experiments designed to quantify their individual contributions. We include an analysis of our results on two large datasets commonly used to evaluate task-focused summarization, the DUC2005 and DUC2006 datasets, using automatic metrics. Additionally, we include an analysis of our results on the DUC2006 task according to human evaluation metrics. In the human evaluation of system summaries compared to human summaries, i.e., the Pyramid method, our system ranked first out of 22 systems in terms of overall mean Pyramid score; and in the human evaluation of summary responsiveness to the topic, our system ranked third out of 35 systems.

Liu, J.; Wu, Y.; Zhou, L.: ¬A hybrid method for abstracting newspaper articles (1999) 0.02

0.015279357 = product of:
  0.06111743 = sum of:
    0.06111743 = weight(_text_:l in 4059) [ClassicSimilarity], result of:
      0.06111743 = score(doc=4059,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.35131297 = fieldWeight in 4059, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0625 = fieldNorm(doc=4059)
  0.25 = coord(1/4)

Plaza, L.; Stevenson, M.; Díaz, A.: Resolving ambiguity in biomedical text to improve summarization (2012) 0.01

0.013369438 = product of:
  0.053477753 = sum of:
    0.053477753 = weight(_text_:l in 2734) [ClassicSimilarity], result of:
      0.053477753 = score(doc=2734,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.30739886 = fieldWeight in 2734, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0546875 = fieldNorm(doc=2734)
  0.25 = coord(1/4)

Ye, S.; Chua, T.-S.; Kan, M.-Y.; Qiu, L.: Document concept lattice for text understanding and summarization (2007) 0.01

0.011459517 = product of:
  0.04583807 = sum of:
    0.04583807 = weight(_text_:l in 941) [ClassicSimilarity], result of:
      0.04583807 = score(doc=941,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.26348472 = fieldWeight in 941, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.046875 = fieldNorm(doc=941)
  0.25 = coord(1/4)

Martinez-Romo, J.; Araujo, L.; Fernandez, A.D.: SemGraph : extracting keyphrases following a novel semantic graph-based approach (2016) 0.01

0.011459517 = product of:
  0.04583807 = sum of:
    0.04583807 = weight(_text_:l in 2832) [ClassicSimilarity], result of:
      0.04583807 = score(doc=2832,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.26348472 = fieldWeight in 2832, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.046875 = fieldNorm(doc=2832)
  0.25 = coord(1/4)

Rodríguez-Vidal, J.; Carrillo-de-Albornoz, J.; Gonzalo, J.; Plaza, L.: Authority and priority signals in automatic summary generation for online reputation management (2021) 0.01

0.009549598 = product of:
  0.038198393 = sum of:
    0.038198393 = weight(_text_:l in 213) [ClassicSimilarity], result of:
      0.038198393 = score(doc=213,freq=2.0), product of:
        0.17396861 = queryWeight, product of:
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.043769516 = queryNorm
        0.2195706 = fieldWeight in 213, product of:
          1.4142135 = tf(freq=2.0), with freq of:
            2.0 = termFreq=2.0
          3.9746525 = idf(docFreq=2257, maxDocs=44218)
          0.0390625 = fieldNorm(doc=213)
  0.25 = coord(1/4)

Goh, A.; Hui, S.C.: TES: a text extraction system (1996) 0.01

0.0059301653 = product of:
  0.023720661 = sum of:
    0.023720661 = product of:
      0.047441322 = sum of:
        0.047441322 = weight(_text_:22 in 6599) [ClassicSimilarity], result of:
          0.047441322 = score(doc=6599,freq=2.0), product of:
            0.15327339 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.043769516 = queryNorm
            0.30952093 = fieldWeight in 6599, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0625 = fieldNorm(doc=6599)
      0.5 = coord(1/2)
  0.25 = coord(1/4)

Date: 26. 2.1997 10:22:43

Robin, J.; McKeown, K.: Empirically designing and evaluating a new revision-based model for summary generation (1996) 0.01

0.0059301653 = product of:
  0.023720661 = sum of:
    0.023720661 = product of:
      0.047441322 = sum of:
        0.047441322 = weight(_text_:22 in 6751) [ClassicSimilarity], result of:
          0.047441322 = score(doc=6751,freq=2.0), product of:
            0.15327339 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.043769516 = queryNorm
            0.30952093 = fieldWeight in 6751, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0625 = fieldNorm(doc=6751)
      0.5 = coord(1/2)
  0.25 = coord(1/4)

Date: 6. 3.1997 16:22:15

Jones, P.A.; Bradbeer, P.V.G.: Discovery of optimal weights in a concept selection system (1996) 0.01

0.0059301653 = product of:
  0.023720661 = sum of:
    0.023720661 = product of:
      0.047441322 = sum of:
        0.047441322 = weight(_text_:22 in 6974) [ClassicSimilarity], result of:
          0.047441322 = score(doc=6974,freq=2.0), product of:
            0.15327339 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.043769516 = queryNorm
            0.30952093 = fieldWeight in 6974, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0625 = fieldNorm(doc=6974)
      0.5 = coord(1/2)
  0.25 = coord(1/4)

Source: Information retrieval: new systems and current research. Proceedings of the 16th Research Colloquium of the British Computer Society Information Retrieval Specialist Group, Drymen, Scotland, 22-23 Mar 94. Ed.: R. Leon

Hahn, U.: ¬Die Verdichtung textuellen Wissens zu Information : vom Wandel methodischer Paradigmen beim automatischen Abstracting (2004) 0.01

0.0052242395 = product of:
  0.020896958 = sum of:
    0.020896958 = product of:
      0.041793916 = sum of:
        0.041793916 = weight(_text_:der in 4667) [ClassicSimilarity], result of:
          0.041793916 = score(doc=4667,freq=6.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.42746788 = fieldWeight in 4667, product of:
              2.4494898 = tf(freq=6.0), with freq of:
                6.0 = termFreq=6.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.078125 = fieldNorm(doc=4667)
      0.5 = coord(1/2)
  0.25 = coord(1/4)

Source: Wissen in Aktion: Der Primat der Pragmatik als Motto der Konstanzer Informationswissenschaft. Festschrift für Rainer Kuhlen. Hrsg. R. Hammwöhner, u.a

Dammeyer, A.; Jürgensen, W.; Krüwel, C.; Poliak, E.; Ruttkowski, S.; Schäfer, Th.; Sirava, M.; Hermes, T.: Videoanalyse mit DiVA (1998) 0.01
```
0.0051186886 = product of:
  0.020474754 = sum of:
    0.020474754 = product of:
      0.04094951 = sum of:
        0.04094951 = weight(_text_:der in 23) [ClassicSimilarity], result of:
          0.04094951 = score(doc=23,freq=16.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.4188313 = fieldWeight in 23, product of:
              4.0 = tf(freq=16.0), with freq of:
                16.0 = termFreq=16.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.046875 = fieldNorm(doc=23)
      0.5 = coord(1/2)
  0.25 = coord(1/4)
```
Abstract

Die Bedeutung von Videos nimmt für multimediale Systeme stetig zu. Dabei existiert eine Vielzahl von Produkten zur Betrachtung von Videos, allerdings nur wenige Ansätze, den Inhalt eines Videos zu erschließen. Das DiVA-System, welches an der Universität Bremen im Rahmen eines studentischen Projektes entwickelt wird, dient der automatischen Analyse von MPEG-I Videofilmen. Der dabei verfolgte Ansatz läßt sich in vier Phasen gliedern. Zunächst wird der Videofilm durch eine Shotanalyse in seine einzelnen Kameraeinstellungen (Shots) unterteilt. Darauf aufbauend findet eine Kamerabewegungsanalyse sowie die Erstellung von Mosaicbildern statt. Mit Methoden der künstlichen Intelligenz und der digitalen Bildverarbeitung wird das analysierte Material nach Bild- und Toninformationen ausgewertet. Das Resultat ist eine textuelle Beschreibung eines Videofilms, auf der mit Hilfe von Text-Retrieval-Systemen recherchiert werden kann

Source

Inhaltsbezogene Suche von Bildern und Videosequenzen in digitalen multimedialen Archiven: Beiträge eines Workshops der KI'98 am 16./17.9.1998 in Bremen. Hrsg.: N. Luth
Endres-Niggemeyer, B.: Bessere Information durch Zusammenfassen aus dem WWW (1999) 0.00
```
0.0048259455 = product of:
  0.019303782 = sum of:
    0.019303782 = product of:
      0.038607564 = sum of:
        0.038607564 = weight(_text_:der in 4496) [ClassicSimilarity], result of:
          0.038607564 = score(doc=4496,freq=8.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.3948779 = fieldWeight in 4496, product of:
              2.828427 = tf(freq=8.0), with freq of:
                8.0 = termFreq=8.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.0625 = fieldNorm(doc=4496)
      0.5 = coord(1/2)
  0.25 = coord(1/4)
```
Abstract

Am Beispiel der Knochenmarktransplantation, eines medizinischen Spezialgebietes, wird im folgenden dargelegt, wie man BenutzerInnen eine großen Teil des Aufwandes bei der Wissensbeschaffung abnehmen kann, indem man Suchergebnisse aus dem Netz fragebezogen zusammenfaßt. Dadurch wird in zeitkritischen Situationen, wie sie in Diagnose und Therapie alltäglich sind, die Aufnahme neuen Wissens ermöglicht. Auf einen Überblick über den Stand des Textzusammenfassens und der Ontologieentwicklung folgt eine Systemskizze, in der die Informationssuche im WWW durch ein kognitiv fundiertes Zusammenfassungssystem ergänzt wird. Dazu wird eine Fach-Ontologie vorgeschlagen, die das benötigte Wissen organisiert und repräsentiert.
Ruda, S.: Abstracting: eine Auswahlbibliographie (1992) 0.00
```
0.004721125 = product of:
  0.0188845 = sum of:
    0.0188845 = product of:
      0.037769 = sum of:
        0.037769 = weight(_text_:der in 6603) [ClassicSimilarity], result of:
          0.037769 = score(doc=6603,freq=10.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.38630107 = fieldWeight in 6603, product of:
              3.1622777 = tf(freq=10.0), with freq of:
                10.0 = termFreq=10.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.0546875 = fieldNorm(doc=6603)
      0.5 = coord(1/2)
  0.25 = coord(1/4)
```
Abstract

Die vorliegende Auswahlbibliographie ist in 9 Themenbereiche unterteilt. Der erste Abschnitt enthält Literatur, in der auf Abstracts und Abstracting-Verfahren allgemein eingegangen und ein Überblick über den Stand der Forschung gegeben wird. Im nächsten Abschnitt werden solche Aufsätze referiert, die die historische Entwicklung des Abstracting beschreiben. Im dritten Teil sind Abstracting-Richtlinien verschiedener Institutionen aufgelistet. Lexikalische, syntaktische und semantische Textkondensierungsverfahren sind das Thema der in Abschnitt 4 präsentierten Arbeiten. Textstrukturen von Abstracts werden unter Punkt 5 betrachtet, und die Arbeiten des nächsten Themenbereiches befassen sich mit dem Problem des Schreibens von Abstracts. Der siebte Abschnitt listet sog. 'maschinelle' und maschinen-unterstützte Abstracting-Methoden auf. Anschließend werden 'maschinelle' und maschinenunterstützte Abstracting-Verfahren, Abstracts im Vergleich zu ihren Primärtexten sowie Abstracts im allgemeien bewertet. Den Abschluß bilden Bibliographien
Kuhlen, R.: In Richtung Summarizing für Diskurse in K3 (2006) 0.00
```
0.004721125 = product of:
  0.0188845 = sum of:
    0.0188845 = product of:
      0.037769 = sum of:
        0.037769 = weight(_text_:der in 6067) [ClassicSimilarity], result of:
          0.037769 = score(doc=6067,freq=10.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.38630107 = fieldWeight in 6067, product of:
              3.1622777 = tf(freq=10.0), with freq of:
                10.0 = termFreq=10.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.0546875 = fieldNorm(doc=6067)
      0.5 = coord(1/2)
  0.25 = coord(1/4)
```
Abstract

Der Bedarf nach Summarizing-Leistungen, in Situationen der Fachinformation, aber auch in kommunikativen Umgebungen (Diskursen) wird aufgezeigt. Summarizing wird dazu in den Kontext des bisherigen (auch automatischen) Abstracting/Extracting gestellt. Der aktuelle Forschungsstand, vor allem mit Blick auf Multi-Document-Summarizing, wird dargestellt. Summarizing ist eine wichtige Funktion in komplex und umfänglich werdenden Diskussionen in elektronischen Foren. Dies wird am Beispiel des e-Learning-Systems K3 aufgezeigt. Rudimentäre Summarizing-Funktionen von K3 und des zugeordneten K3VIS-Systems werden dargestellt. Der Rahmen für ein elaborierteres, Template-orientiertes Summarizing unter Verwendung der vielfältigen Auszeichnungsfunktionen von K3 (Rollen, Diskurstypen, Inhaltstypen etc.) wird aufgespannt.
Endres-Niggemeyer, B.; Ziegert, C.: SummIt-BMT : (Summarize It in BMT) in Diagnose und Therapie, Abschlussbericht (2002) 0.00
```
0.004265574 = product of:
  0.017062295 = sum of:
    0.017062295 = product of:
      0.03412459 = sum of:
        0.03412459 = weight(_text_:der in 4497) [ClassicSimilarity], result of:
          0.03412459 = score(doc=4497,freq=16.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.34902605 = fieldWeight in 4497, product of:
              4.0 = tf(freq=16.0), with freq of:
                16.0 = termFreq=16.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.0390625 = fieldNorm(doc=4497)
      0.5 = coord(1/2)
  0.25 = coord(1/4)
```
Abstract

SummIt-BMT (Summarize It in Bone Marrow Transplantation) - das Zielsystem des Projektes - soll Ärzten in der Knochenmarktransplantation durch kognitiv fundiertes Zusammenfassen (Endres-Niggemeyer, 1998) aus dem WWW eine schnelle Informationsaufnahme ermöglichen. Im bmbffinanzierten Teilprojekt, über das hier zu berichten ist, liegt der Schwerpunkt auf den klinischen Fragestellungen. SummIt-BMT hat als zentrale Komponente eine KMT-Ontologie. Den Systemablauf veranschaulicht Abb. 1: Benutzer geben ihren Informationsbedarf in ein strukturiertes Szenario ein. Sie ziehen dazu Begriffe aus der Ontologie heran. Aus dem Szenario werden Fragen an Suchmaschinen abgeleitet. Die Summit-BMT-Metasuchmaschine stößt Google an und sucht in Medline, der zentralen Literaturdatenbank der Medizin. Das Suchergebnis wird aufbereitet. Dabei werden Links zu Volltexten verfolgt und die Volltexte besorgt. Die beschafften Dokumente werden mit einem Schlüsselwortretrieval auf Passagen untersucht, in denen sich Suchkonzepte aus der Frage / Ontologie häufen. Diese Passagen werden zum Zusammenfassen vorgeschlagen. In ihnen werden die Aussagen syntaktisch analysiert. Die Systemagenten untersuchen sie. Lassen Aussagen sich mit einer semantischen Relation an die Frage anbinden, tragen also zur deren Beantwortung bei, werden sie in die Zusammenfassung aufgenommen, es sei denn, andere Agenten machen Hinderungsgründe geltend, z.B. Redundanz. Das Ergebnis der Zusammenfassung wird in das Frage/Antwort-Szenario integriert. Präsentiert werden Exzerpte aus den Quelldokumenten. Mit einem Link vermitteln sie einen sofortigen Rückgriff auf die Quelle. SummIt-BMT ist zum nächsten Durchgang von Informationssuche und Zusammenfassung bereit, sobald der Benutzer dies wünscht.

Kuhlen, R.: Abstracts, abstracting : intellektuelle und maschinelle Verfahren (1990) 0.00

0.0042227027 = product of:
  0.01689081 = sum of:
    0.01689081 = product of:
      0.03378162 = sum of:
        0.03378162 = weight(_text_:der in 2333) [ClassicSimilarity], result of:
          0.03378162 = score(doc=2333,freq=2.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.34551817 = fieldWeight in 2333, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.109375 = fieldNorm(doc=2333)
      0.5 = coord(1/2)
  0.25 = coord(1/4)

Source: Grundlagen der praktischen Information und Dokumentation. 3. Aufl. Hrsg.: M. Buder u.a. Bd.1

Ruda, S.: Maschinenunterstützte Kondensierung von Fachtexten mit CONNY : Abstracting am Beispiel eines 'Nachrichten für Dokumentation'-Textkorpus (1994) 0.00
```
0.0042227027 = product of:
  0.01689081 = sum of:
    0.01689081 = product of:
      0.03378162 = sum of:
        0.03378162 = weight(_text_:der in 2376) [ClassicSimilarity], result of:
          0.03378162 = score(doc=2376,freq=8.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.34551817 = fieldWeight in 2376, product of:
              2.828427 = tf(freq=8.0), with freq of:
                8.0 = termFreq=8.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.0546875 = fieldNorm(doc=2376)
      0.5 = coord(1/2)
  0.25 = coord(1/4)
```
Abstract

Als Textkorpus sind von 50 verschiedenen Autoren verfaßte Dokumente der Zeitschrift 'Nachrichten für Dokumentation' aus einem Zwanzigjahreszeitraum (1969-1989) herangezogen worden. Die Untersuchung der Abstracts hat ergeben, daß lediglich 15 von 50 Abstracts aus ausschließlich 'normgerechten' Abstractsätzen bestehen und kein Abstract allen Anforderungen der Richtlinien genügt. Insofern signalisieren sie die Abstracting-Richtlinien als 'Wunschdenken', was die Idee des maschinenunterstützten Abstracting nach linguistischen Merkmalen bekräftigt. CONNY ist ein interaktives linhuistisches Abstracting-Modell für Fachtexte, das dem Abstractor auf der Oberflächenstruktur operierende allgemeine Abstracting-Richtlinien anbietet. Es kondendiert die als abstractrelevant bewertenden Primärtextteile auf Primärtext-, Satz- und Abstractebene hinsichtlich Lexik, Syntax und Semantik
Meyer, R.: Allein, es wär' so schön gewesen : Der Copernic Summarzier kann Internettexte leider nicht befriedigend und sinnvoll zusammenfassen (2002) 0.00
```
0.004088614 = product of:
  0.016354457 = sum of:
    0.016354457 = product of:
      0.032708913 = sum of:
        0.032708913 = weight(_text_:der in 648) [ClassicSimilarity], result of:
          0.032708913 = score(doc=648,freq=30.0), product of:
            0.09777089 = queryWeight, product of:
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.043769516 = queryNorm
            0.33454654 = fieldWeight in 648, product of:
              5.477226 = tf(freq=30.0), with freq of:
                30.0 = termFreq=30.0
              2.2337668 = idf(docFreq=12875, maxDocs=44218)
              0.02734375 = fieldNorm(doc=648)
      0.5 = coord(1/2)
  0.25 = coord(1/4)
```
Abstract

Das Netz hat die Jagd nach textlichen Inhalten erheblich erleichtert. Es ist so ein-fach, irgendeinen Beitrag über ein bestimmtes Thema zu finden, daß man eher über Fülle als über Mangel klagt. Suchmaschinen und Kataloge helfen beim Sichten, indem sie eine Vorauswahl von Links treffen. Das Programm "Copernic Summarizer" geht einen anderen Weg: Es erstellt Exzerpte beliebiger Texte und will damit die Lesezeit verkürzen. Decken wir über die lästige Zwangsregistrierung (unter Pflichtangabe einer Mailadresse) das Mäntelchen des Schweigens. Was folgt, geht rasch, nicht nur die ersten Schritte sind schnell vollzogen. Die Software läßt sich in verschiedenen Umgebungen einsetzen. Unterstützt werden Microsoft Office, einige Mailprogramme sowie der Acrobat Reader für PDF-Dateien. Besonders eignet sich das Verfahren freilich für Internetseiten. Der "Summarizer" nistet sich im Browser als Symbol ein. Und mit einem Klick faßt er einen Online Text in einem Extrafenster zusammen. Es handelt sich dabei nicht im eigentlichen Sinne um eine Zusammenfassung mit eigenen Worten, die in Kürze den Gesamtgehalt wiedergibt. Das Ergebnis ist schlichtes Kürzen, das sich noch dazu ziemlich brutal vollzieht, da grundsätzlich vollständige Sätze gestrichen werden. Die Software erfaßt den Text, versucht Schlüsselwörter zu ermitteln und entscheidet danach, welche Sätze wichtig sind und welche nicht. Das Verfahren mag den Entwicklungsaufwand verringert haben, dem Anwender hingegen bereitet es Probleme. Oftmals beziehen sich Sätze auf frühere Aussagen, etwa in Formulierungen wie "Diese Methode wird . . ." oder "Ein Jahr später . . ." In der Zusammenfassung fehlt entweder der Kontext dazu oder man kann nicht darauf vertrauen, daß der Bezug sich tatsächlich im voranstehenden Satz findet. Die Liste der Schlüsselwörter, die links eingeblendet wird, wirkt nicht immer glücklich. Teilweise finden sich unauffällige Begriffe wie "Anlaß" oder "zudem". Wenigstens lassen sich einzelne Begriffe entfernen, um das Ergebnis zu verfeinern. Hilfreich ist das mögliche Markieren der Schlüsselbegriffe im Text. Unverständlich bleibt hingegen, weshalb man nicht selbst relevante Wörter festlegen darf, die als Basis für die Zusammenfassung dienen. Das Kürzen des Textes ist in mehreren Stufen möglich, von fünf bis fünfzig Prozent. Fünf Prozent sind unbrauchbar; ein guter Kompromiß sind fünfundzwanzig. Allerdings nimmt es die Software nicht genau mit den eigenen Vorgaben. Bei kürzeren Texten ist die Zusammenfassung von angeblich einem Viertel fast genauso lang wie das Original; noch bei zwei Seiten eng bedrucktem Text (8 Kilobyte) entspricht das Exzerpt einem Drittel des Originals. Für gewöhnlich sind Webseiten geschmückt mit einem Menü, mit Werbung, mit Hinweiskästen und allerlei mehr. Sehr zuverlässig erkennt die Software, was überhaupt Fließtext ist; alles andere wird ausgefiltert. Da bedauert man es zuweilen, daß der Summarizer nicht den kompletten Text listet, damit er in einer angenehmen Umgebung schwarz auf weiß gelesen oder gedruckt wird. Wahlweise zum manuellen Auslösen der Zusammenfassung wird der "LiveSummarizer" aktiviert. Er verdichtet Text zeitgleich mit dem Aufrufen einer Seite, nimmt dafür aber ein Drittel der Bildschirmfläche ein - ein zu hoher Preis. Insgesamt fragen wir uns, wie man das Programm sinnvoll nutzen soll. Beim Verdichten von Nachrichten ist unsicher, ob Summarizer nicht wichtige Details unterschlägt. Bei langen Texten sorgen Fragen zum Kontext für Verwirrung. Sucht man nach der Antwort auf eine Detailfrage, hilft die Suchfunktion des Browsers oft schneller. Eine Zusammenfassung hätte auch dem Preis gutgetan: 100 Euro verlangt der deutsche Verleger Softline. Das scheint deutlich zu hoch gegriffen. Zumal das Zusammenfassen der einzige Zweck des Summarizers ist. Das Verwalten von Bookmarks und das Archivieren von Texten wären sinnvolle Ergänzungen gewesen.

Wu, Y.-f.B.; Li, Q.; Bot, R.S.; Chen, X.: Finding nuggets in documents : a machine learning approach (2006) 0.00

0.0037063533 = product of:
  0.014825413 = sum of:
    0.014825413 = product of:
      0.029650826 = sum of:
        0.029650826 = weight(_text_:22 in 5290) [ClassicSimilarity], result of:
          0.029650826 = score(doc=5290,freq=2.0), product of:
            0.15327339 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.043769516 = queryNorm
            0.19345059 = fieldWeight in 5290, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0390625 = fieldNorm(doc=5290)
      0.5 = coord(1/2)
  0.25 = coord(1/4)

Date: 22. 7.2006 17:25:48

Kim, H.H.; Kim, Y.H.: Generic speech summarization of transcribed lecture videos : using tags and their semantic relations (2016) 0.00

0.0037063533 = product of:
  0.014825413 = sum of:
    0.014825413 = product of:
      0.029650826 = sum of:
        0.029650826 = weight(_text_:22 in 2640) [ClassicSimilarity], result of:
          0.029650826 = score(doc=2640,freq=2.0), product of:
            0.15327339 = queryWeight, product of:
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.043769516 = queryNorm
            0.19345059 = fieldWeight in 2640, product of:
              1.4142135 = tf(freq=2.0), with freq of:
                2.0 = termFreq=2.0
              3.5018296 = idf(docFreq=3622, maxDocs=44218)
              0.0390625 = fieldNorm(doc=2640)
      0.5 = coord(1/2)
  0.25 = coord(1/4)

Date: 22. 1.2016 12:29:41

Search (31 results, page 1 of 2)

Authors

Years

Languages

Types

Themes