Forum für Wissenschaft, Industrie und Wirtschaft

Hauptsponsoren:     3M 
Datenbankrecherche:

 

Computer schürfen nach den "Goldnuggets" im Textuniversum

24.01.2006


EU fördert internationales Forschungsprojekt von Computerlinguisten der Universität Jena



In den Forschungslabors der Welt werden heute in jeder Minute eine neue chemische Formel gewonnen, alle drei Minuten ein neuer physikalischer Zusammenhang aufgedeckt und im Fünf-Minuten-Rhythmus neue medizinische Erkenntnisse gewonnen - und publiziert. Forscher der Max-Planck-Gesellschaft haben ermittelt, dass jährlich rund vier Millionen Fachbeiträge veröffentlicht werden, also 20.000 pro Arbeitstag. Selbst wenn nur ein Bruchteil davon den Bereich der Biologie betrifft, dann ist "kein Biologe mehr in der Lage, alle für sein Fachgebiet relevanten Arbeiten zu lesen", ist Prof. Dr. Udo Hahn von der Universität Jena überzeugt. Die Fülle an immer neuen Erkenntnissen, die die eigene Forschungstätigkeit betreffen, sei jedoch nur ein Problem für jeden Wissenschaftler. "Will er über den Tellerrand des eigenen Spezialgebietes schauen, dann versteht er manche Texte vielleicht nicht richtig, weil in den einzelnen Disziplinen häufig dem Leser unbekannte Spezialtermini gebraucht werden", erklärt der Computerlinguist vom Institut für Germanistische Sprachwissenschaft. Es könne sogar vorkommen, dass Biologen an denselben Proteinen forschen, ohne voneinander zu wissen, weil die Proteine in verschiedenen Labors unterschiedliche Namen haben. Doch hier wollen Prof. Hahn und sein Forscherteam Abhilfe schaffen.

... mehr zu:
»Biologe »Biologie »Computerlinguist


Sie wollen ein Computerprogramm entwickeln, das biologische Fachtexte nach bestimmten Kriterien analysiert, Wichtiges von Unwichtigem trennt und Forscher wie industrielle Entwickler - etwa aus der Biotech- oder Pharmaindustrie - mit automatisch gewonnenem, hochaktuellem Wissen versorgt. "Wir reden dabei auch vom biologischen Text-Mining", erläutert Hahn. De facto lassen die Jenaer Computerlinguisten ihre intelligenten Rechenmaschinen in den Texten nach den "Goldnuggets" schürfen und programmieren die Computer so, dass sie die gesuchten Informationen automatisch finden.

Die Computerlinguisten nutzen dafür ihr Fachwissen und sprachwissenschaftliche Methoden, um die natürliche Sprache - bei den Biologen ist dies fast ausschließlich Englisch - mit dem Computer zu bearbeiten. "Als Sprachwissenschaftler haben wir einerseits das Wissen, wie man Texte formuliert und inhaltlich strukturiert", sagt Prof. Hahn. Andererseits sei Sprache ein berechenbarer Prozess. Mit Hilfe von Methoden aus der Informatik könnten ihre Regeln und Konzepte formal und mathematisch präzise analysiert werden. Dann ist selbst das "Fachchinesisch" einer Wissenschaftsdisziplin für den Computer durchschaubar.

"Allerdings verstehen reine Computerlinguisten nur wenig von den biologischen Inhalten der analysierten Texte, dafür brauchen sie einen Vermittler", räumt Prof. Hahn ein. Deshalb gehören auch Biologen zu seinem Team, die den Sprachwissenschaftlern und Informatikern auch erklären sollen, "wie Biologen was verstehen". Unterstützung erhoffe er sich zudem von der in Jena sehr gut entwickelten Biotechnologie-Szene, sagt er. Mit der Medizin gebe es ebenfalls viele Berührungspunkte, da diese heute immer mehr in die Biologie hinein reiche.

Mediziner profitieren im Übrigen bereits von den Arbeiten der Computerlinguisten. An der Freiburger Universität, von der Prof. Hahn 2004 auf den Lehrstuhl für Germanistische Sprachwissenschaft/Computerlinguistik nach Jena wechselte, hat er schon gemeinsam mit Medizininformatikern ein System für die automatische Bearbeitung von elektronischen Patientenakten entwickelt.

Für sein neues Jenaer Forschungsprojekt "BOOTStrep" (Bootstrapping of Ontologies and Terminologies Strategic Research Project) hat die Europäische Union (EU) jetzt für vorerst drei Jahre eine Unterstützung von 3,6 Millionen Euro bewilligt. An dem anspruchsvollen Vorhaben, das am 1. April offiziell starten wird, sind Wissenschaftler aus England, Italien, Frankreich, Singapur und Deutschland beteiligt. Auch Biologen aus diesen Ländern sollen von dem mehrsprachig angelegten Programm profitieren.

Kontakt:
Prof. Dr. Udo Hahn
Institut für Germanistische Sprachwissenschaft der Universität Jena
Fürstengraben 30, 07743 Jena
Tel.: 03641 / 944320
Fax: 03641 / 944321
E-Mail: udo.hahn[at]uni-jena.de

Axel Burchardt | idw
Weitere Informationen:
http://www.uni-jena.de/

Weitere Berichte zu: Biologe Biologie Computerlinguist

Weitere Nachrichten aus der Kategorie Informationstechnologie:

nachricht Digitaler Denker: Argument-Suchmaschine hilft bei der Meinungsbildung
22.01.2019 | Universität Paderborn

nachricht Forscher entwickeln Datenleak-Frühwarnsystem
22.01.2019 | Rheinische Friedrich-Wilhelms-Universität Bonn

Alle Nachrichten aus der Kategorie: Informationstechnologie >>>

Die aktuellsten Pressemeldungen zum Suchbegriff Innovation >>>

Die letzten 5 Focus-News des innovations-reports im Überblick:

Im Focus: Zweigesichtige Stammzellen produzieren Holz und Bast

Heidelberger Forscher untersuchen einen der wichtigsten Wachstumsprozesse auf der Erde

Für einen der wichtigsten Wachstumsprozesse auf der Erde – die Holzbildung – sind sogenannte zweigesichtige Stammzellen verantwortlich: Sie bilden nicht nur...

Im Focus: Bifacial Stem Cells Produce Wood and Bast

Heidelberg researchers study one of the most important growth processes on Earth

So-called bifacial stem cells are responsible for one of the most critical growth processes on Earth – the formation of wood.

Im Focus: Energizing the immune system to eat cancer

Abramson Cancer Center study identifies method of priming macrophages to boost anti-tumor response

Immune cells called macrophages are supposed to serve and protect, but cancer has found ways to put them to sleep. Now researchers at the Abramson Cancer...

Im Focus: Klassisches Doppelspalt-Experiment in neuem Licht

Internationale Forschergruppe entwickelt neue Röntgenspektroskopie-Methode basierend auf dem klassischen Doppelspalt-Experiment, um neue Erkenntnisse über die physikalischen Eigenschaften von Festkörpern zu gewinnen.

Einem internationalen Forscherteam unter Führung von Physikern des Sonderforschungsbereichs 1238 der Universität zu Köln ist es gelungen, eine neue Variante...

Im Focus: Ten-year anniversary of the Neumayer Station III

The scientific and political community alike stress the importance of German Antarctic research

Joint Press Release from the BMBF and AWI

The Antarctic is a frigid continent south of the Antarctic Circle, where researchers are the only inhabitants. Despite the hostile conditions, here the Alfred...

Alle Focus-News des Innovations-reports >>>

Anzeige

Anzeige

VideoLinks
Industrie & Wirtschaft
Veranstaltungen

Führende Röntgen- und Nanoforscher treffen sich in Hamburg

22.01.2019 | Veranstaltungen

Smarte Sensorik für Mobilität und Produktion 4.0 am 07. Februar 2019 in Oldenburg

18.01.2019 | Veranstaltungen

16. BF21-Jahrestagung „Mobilität & Kfz-Versicherung im Fokus“

17.01.2019 | Veranstaltungen

VideoLinks
Wissenschaft & Forschung
Weitere VideoLinks im Überblick >>>
 
Aktuelle Beiträge

Zweigesichtige Stammzellen produzieren Holz und Bast

22.01.2019 | Biowissenschaften Chemie

Wie tickt die rote Königin?

22.01.2019 | Biowissenschaften Chemie

Digitaler Denker: Argument-Suchmaschine hilft bei der Meinungsbildung

22.01.2019 | Informationstechnologie

Weitere B2B-VideoLinks
IHR
JOB & KARRIERE
SERVICE
im innovations-report
in Kooperation mit academics