OPUS 4 | Computerlinguistik

Computerlinguistik

611 search hits

1 to 10

Sort by

“… jetzt auch im praktischen Hypertextformat” – Die Anfänge der Grammatik mit der Maus (2011)

“My Curiosity was Satisfied, but not in a Good Way”: Predicting User Ratings for Online Recipes (2014)

Liu, Can ; Guo, Chun ; Dakota, Daniel ; Rajagopalan, Sridhar ; Li, Wen ; Kübler, Sandra ; Yu, Ning

In this paper, we develop an approach to automatically predict user ratings for recipes at Epicurious.com, based on the recipes’ reviews. We investigate two distributional methods for feature selection, Information Gain and Bi-Normal Separation; we also compare distributionally selected features to linguistically motivated features and two types of frameworks: a one-layer system where we aggregate all reviews and predict the rating vs. a two-layer system where ratings of individual reviews are predicted and then aggregated. We obtain our best results by using the two-layer architecture, in combination with 5 000 features selected by Information Gain. This setup reaches an overall accuracy of 65.60%, given an upper bound of 82.57%.

“Hello ELSA, how are you?” - Legal and ethical challenges in RDM, current and future tasks of ELSA activities against the background of AI and Anonymisation (2023)

Boehm, Franziska ; Sax, Ulrich ; Vettermann, Oliver ; Kamocki, Paweł ; Stoilova, Vasilka

The proposed contribution will shed light on current and future challenges on legal and ethical questions in research data infrastructures. The authors of the proposal will present the work of NFDI’s section on Ethical, Legal and Social Aspects (hereinafter: ELSA), whose aim is to facilitate cross-disciplinary cooperation between the NFDI consortia in the relevant areas of management and re-use of research data.

Überlegungen zu einem Verfahren "Wortsegmentierung deutscher Texte" (WORTSEG) (1982)

Kolvenbach, Monika ; Brückner, Tobias

Zur Mikrostruktur im Hypertext-Wörterbuch (2001)

Haß-Zumkehr, Ulrike

In diesem Beitrag werden erste Erfahrungen mit und Überlegungen zu der Aufgabe dargelegt, ein Mikrostrukturenprogramm für ein Hypertext-Wörterbuch zu entwerfen. Zur Hypertextualisierung gedruckter Wörterbücher gibt es inzwischen erste Veröffentlichungen; meist bleibt hier die Bindung an eine gedruckte Vorlage, und sei die Hypertextualisierung noch so konsequent, bestehen. Im Unterschied zu solchen Hypertext-Wörterbüchern gehen nachfolgende Überlegungen von einem vorlagenunabhängigen Hypertext aus, dessen allgemeines Ziel es ist, Informationen zum deutschen Wortschatz zu vermitteln. Die hier vorgestellten Erfahrungen und Überlegungen sind an ein konkretes Projekt gebunden: LEKSIS - das lexikalisch-lexikologische Informationssystem des Instituts für Deutsche Sprache, Mannheim. Auf eine (weitere) Projektbeschreibung wird hier aber verzichtet; sie findet sich in Fraas/Haß-Zumkehr (1999), ferner auf der Homepage unter http://www.ids-mannheim.de/wiw. Vor dem Hintergrund dieses Projektes stehen die Bedingungen bzw. lexikografischen Konsequenzen des Mediums Hypertext im Unterschied zum Druck zur Diskussion.

Zur Entwicklung einer funktionalen Computergrammatik des Deutschen (1992)

Dik, Simon C.

Yes we can!? Annotating the senses of English modal verbs (2012)

Ruppenhofer, Josef ; Rehbein, Ines

This paper presents an annotation scheme for English modal verbs together with sense-annotated data from the news domain. We describe our annotation scheme and discuss problematic cases for modality annotation based on the inter-annotator agreement during the annotation. Furthermore, we present experiments on automatic sense tagging, showing that our annotations do provide a valuable training resource for NLP systems.

XML-strukturierte Learning Objects (2003)

Lobin, Henning ; Stührenberg, Maik

Dieser Beitrag skizziert die Möglichkeiten, die die Extensible Markup Language (XML) im Umfeld von eLearning und Web Based Training (WBT) eröffnet. Bisherige eLearning-Angebote kranken an verschiedenen Problemen, die durch die Verwendung von XML-basierten Learning Objects vermieden werden können. Ausgehend vom aktuellen Stand im Projekt MiLCA - Medienintensive Lehrmodule in der Computerlinguistik-Ausbildung - soll zudem ein Ausblick auf zukünftige technische Möglichkeiten des Computer-gestützten Lernens gegeben werden.

XML-Kodierung des Bonner Frühneuhochdeutschkorpus (2002)

Diel, Marcel ; Fisseni, Bernhard ; Lenders, Winfried ; Schmitz, Hans-Christian

XML in der Praxis: Dokument parsen, validieren und verarbeiten (2003)

Köhler, Werner ; Witt, Andreas ; Sasaki, Felix ; Milde, Jan-Torsten ; Pönninghaus, Jens