Forum für Wissenschaft, Industrie und Wirtschaft

Hauptsponsoren:     3M 
Datenbankrecherche:

 

Computer schürfen nach den "Goldnuggets" im Textuniversum

24.01.2006


EU fördert internationales Forschungsprojekt von Computerlinguisten der Universität Jena



In den Forschungslabors der Welt werden heute in jeder Minute eine neue chemische Formel gewonnen, alle drei Minuten ein neuer physikalischer Zusammenhang aufgedeckt und im Fünf-Minuten-Rhythmus neue medizinische Erkenntnisse gewonnen - und publiziert. Forscher der Max-Planck-Gesellschaft haben ermittelt, dass jährlich rund vier Millionen Fachbeiträge veröffentlicht werden, also 20.000 pro Arbeitstag. Selbst wenn nur ein Bruchteil davon den Bereich der Biologie betrifft, dann ist "kein Biologe mehr in der Lage, alle für sein Fachgebiet relevanten Arbeiten zu lesen", ist Prof. Dr. Udo Hahn von der Universität Jena überzeugt. Die Fülle an immer neuen Erkenntnissen, die die eigene Forschungstätigkeit betreffen, sei jedoch nur ein Problem für jeden Wissenschaftler. "Will er über den Tellerrand des eigenen Spezialgebietes schauen, dann versteht er manche Texte vielleicht nicht richtig, weil in den einzelnen Disziplinen häufig dem Leser unbekannte Spezialtermini gebraucht werden", erklärt der Computerlinguist vom Institut für Germanistische Sprachwissenschaft. Es könne sogar vorkommen, dass Biologen an denselben Proteinen forschen, ohne voneinander zu wissen, weil die Proteine in verschiedenen Labors unterschiedliche Namen haben. Doch hier wollen Prof. Hahn und sein Forscherteam Abhilfe schaffen.

... mehr zu:
»Biologe »Biologie »Computerlinguist


Sie wollen ein Computerprogramm entwickeln, das biologische Fachtexte nach bestimmten Kriterien analysiert, Wichtiges von Unwichtigem trennt und Forscher wie industrielle Entwickler - etwa aus der Biotech- oder Pharmaindustrie - mit automatisch gewonnenem, hochaktuellem Wissen versorgt. "Wir reden dabei auch vom biologischen Text-Mining", erläutert Hahn. De facto lassen die Jenaer Computerlinguisten ihre intelligenten Rechenmaschinen in den Texten nach den "Goldnuggets" schürfen und programmieren die Computer so, dass sie die gesuchten Informationen automatisch finden.

Die Computerlinguisten nutzen dafür ihr Fachwissen und sprachwissenschaftliche Methoden, um die natürliche Sprache - bei den Biologen ist dies fast ausschließlich Englisch - mit dem Computer zu bearbeiten. "Als Sprachwissenschaftler haben wir einerseits das Wissen, wie man Texte formuliert und inhaltlich strukturiert", sagt Prof. Hahn. Andererseits sei Sprache ein berechenbarer Prozess. Mit Hilfe von Methoden aus der Informatik könnten ihre Regeln und Konzepte formal und mathematisch präzise analysiert werden. Dann ist selbst das "Fachchinesisch" einer Wissenschaftsdisziplin für den Computer durchschaubar.

"Allerdings verstehen reine Computerlinguisten nur wenig von den biologischen Inhalten der analysierten Texte, dafür brauchen sie einen Vermittler", räumt Prof. Hahn ein. Deshalb gehören auch Biologen zu seinem Team, die den Sprachwissenschaftlern und Informatikern auch erklären sollen, "wie Biologen was verstehen". Unterstützung erhoffe er sich zudem von der in Jena sehr gut entwickelten Biotechnologie-Szene, sagt er. Mit der Medizin gebe es ebenfalls viele Berührungspunkte, da diese heute immer mehr in die Biologie hinein reiche.

Mediziner profitieren im Übrigen bereits von den Arbeiten der Computerlinguisten. An der Freiburger Universität, von der Prof. Hahn 2004 auf den Lehrstuhl für Germanistische Sprachwissenschaft/Computerlinguistik nach Jena wechselte, hat er schon gemeinsam mit Medizininformatikern ein System für die automatische Bearbeitung von elektronischen Patientenakten entwickelt.

Für sein neues Jenaer Forschungsprojekt "BOOTStrep" (Bootstrapping of Ontologies and Terminologies Strategic Research Project) hat die Europäische Union (EU) jetzt für vorerst drei Jahre eine Unterstützung von 3,6 Millionen Euro bewilligt. An dem anspruchsvollen Vorhaben, das am 1. April offiziell starten wird, sind Wissenschaftler aus England, Italien, Frankreich, Singapur und Deutschland beteiligt. Auch Biologen aus diesen Ländern sollen von dem mehrsprachig angelegten Programm profitieren.

Kontakt:
Prof. Dr. Udo Hahn
Institut für Germanistische Sprachwissenschaft der Universität Jena
Fürstengraben 30, 07743 Jena
Tel.: 03641 / 944320
Fax: 03641 / 944321
E-Mail: udo.hahn[at]uni-jena.de

Axel Burchardt | idw
Weitere Informationen:
http://www.uni-jena.de/

Weitere Berichte zu: Biologe Biologie Computerlinguist

Weitere Nachrichten aus der Kategorie Informationstechnologie:

nachricht Brain-Computer-Interface: Wenn der Computer uns intuitiv versteht
18.01.2017 | Technische Universität Berlin

nachricht »Lernlabor Cybersicherheit« startet in Weiden i. d. Oberpfalz
12.01.2017 | Fraunhofer-Gesellschaft

Alle Nachrichten aus der Kategorie: Informationstechnologie >>>

Die aktuellsten Pressemeldungen zum Suchbegriff Innovation >>>

Die letzten 5 Focus-News des innovations-reports im Überblick:

Im Focus: Innovatives Hochleistungsmaterial: Biofasern aus Florfliegenseide

Neuartige Biofasern aus einem Seidenprotein der Florfliege werden am Fraunhofer-Institut für Angewandte Polymerforschung IAP gemeinsam mit der Firma AMSilk GmbH entwickelt. Die Forscher arbeiten daran, das Protein in großen Mengen biotechnologisch herzustellen. Als hochgradig biegesteife Faser soll das Material künftig zum Beispiel in Leichtbaukunststoffen für die Verkehrstechnik eingesetzt werden. Im Bereich Medizintechnik sind beispielsweise biokompatible Seidenbeschichtungen von Implantaten denkbar. Ein erstes Materialmuster präsentiert das Fraunhofer IAP auf der Internationalen Grünen Woche in Berlin vom 20.1. bis 29.1.2017 in Halle 4.2 am Stand 212.

Zum Schutz des Nachwuchses vor bodennahen Fressfeinden lagern Florfliegen ihre Eier auf der Unterseite von Blättern ab – auf der Spitze von stabilen seidenen...

Im Focus: Verkehrsstau im Nichts

Konstanzer Physiker verbuchen neue Erfolge bei der Vermessung des Quanten-Vakuums

An der Universität Konstanz ist ein weiterer bedeutender Schritt hin zu einem völlig neuen experimentellen Zugang zur Quantenphysik gelungen. Das Team um Prof....

Im Focus: Traffic jam in empty space

New success for Konstanz physicists in studying the quantum vacuum

An important step towards a completely new experimental access to quantum physics has been made at University of Konstanz. The team of scientists headed by...

Im Focus: Textiler Hochwasserschutz erhöht Sicherheit

Wissenschaftler der TU Chemnitz präsentieren im Februar und März 2017 ein neues temporäres System zum Schutz gegen Hochwasser auf Baumessen in Chemnitz und Dresden

Auch die jüngsten Hochwasserereignisse zeigen, dass vielerorts das natürliche Rückhaltepotential von Uferbereichen schnell erschöpft ist und angrenzende...

Im Focus: Wie Darmbakterien krank machen

HZI-Forscher entschlüsseln Infektionsmechanismen von Yersinien und Immunantworten des Wirts

Yersinien verursachen schwere Darminfektionen. Um ihre Infektionsmechanismen besser zu verstehen, werden Studien mit dem Modellorganismus Yersinia...

Alle Focus-News des Innovations-reports >>>

Anzeige

Anzeige

IHR
JOB & KARRIERE
SERVICE
im innovations-report
in Kooperation mit academics
Veranstaltungen

Mittelstand 4.0 – Mehrwerte durch Digitalisierung: Hintergründe, Beispiele, Lösungen

20.01.2017 | Veranstaltungen

Nachhaltige Wassernutzung in der Landwirtschaft Osteuropas und Zentralasiens

19.01.2017 | Veranstaltungen

Künftige Rohstoffexperten aus aller Welt in Freiberg zur Winterschule

18.01.2017 | Veranstaltungen

 
VideoLinks
B2B-VideoLinks
Weitere VideoLinks >>>
Aktuelle Beiträge

21.500 Euro für eine grüne Zukunft – Unserer Umwelt zuliebe

20.01.2017 | Unternehmensmeldung

innovations-report im Interview mit Rolf-Dieter Lafrenz, Gründer und Geschäftsführer der Hamburger Start ups Cargonexx

20.01.2017 | Unternehmensmeldung

Niederlande: Intelligente Lösungen für Bahn und Stahlindustrie werden gefördert

20.01.2017 | Förderungen Preise