Πύλη του Ελληνικού Σώματος Κειμένων Μαθητών/τριών (ΕΣΚΕΙΜΑΘ)

Η ενιαία διαδικτυακή διεπαφή του ΕΣΚΕΙΜΑΘ, του μεγαλύτερου ελεύθερα διαθέσιμου σώματος κειμένων με επισημειωμένα λάθη για την Ελληνική ως δεύτερη ή ξένη γλώσσα, με πλούσια μεταδεδομένα μαθητών.

Χρησιμοποιήστε τις καρτέλες επάνω για να εξερευνήσετε τα σώματα: περιγραφική Επισκόπηση, Αναλυτικά Μαθητών, και τα δύο υποσώματα GLC v.1 και GLC v.2 (επισημειώσεις λαθών, αναζήτηση/συμφραστικοί πίνακες και μέρη του λόγου).

GLC v.1

≈ 450 γραπτές παραγωγές (~33.000 λέξεις) εφήβων μαθητών, επισημειωμένες με το UAM Corpus Tool. Το σχήμα λαθών του αποτέλεσε τη βάση για το GLC v.2.

Ανοίξτε την καρτέλα GLC v.1 για το πλαίσιο επισημείωσης, την περιήγηση λαθών, τον συμφραστικό πίνακα και τα μέρη του λόγου.

GLC v.2

≈ 422.000 λέξεις γραπτού και προφορικού λόγου μαθητών (36 μητρικές γλώσσες, Επίπεδα Α1–Γ2), συν συγκρίσιμο σώμα ελέγχου φυσικών ομιλητών, με πολυεπίπεδη γραμματική επισημείωση λαθών.

Ανοίξτε την καρτέλα GLC v.2 για το πλαίσιο επισημείωσης, την περιήγηση λαθών, τον συμφραστικό πίνακα και τα μέρη του λόγου.

annoteca, η πλατφόρμα επισημείωσης που συνοδεύει το GLC: εκεί επεξεργάζονται, συγκρίνονται μεταξύ επισημειωτών και επιμελούνται προς το χρυσό πρότυπο οι επισημειώσεις του σώματος. Η Πύλη δείχνει τα αποτελέσματα· στο annoteca παράγονται.

Αίτηση πρόσβασης

Για την πλήρη περιγραφή του σώματος, του σχεδιασμού και της επισημείωσής του, δείτε την καρτέλα Σχετικά με το GLC.

Το Greek Learner Corpus αναπτύχθηκε, έως το 2023, με την υποστήριξη του Ελληνικού Ιδρύματος Έρευνας και Καινοτομίας (ΕΛ.ΙΔ.Ε.Κ.) στο πλαίσιο του έργου Latent Aspects in L2 Acquisition (LAL2A)· πλέον συντηρείται και επεκτείνεται ανεξάρτητα, εκτός του χρηματοδοτούμενου έργου.

Σχετικά με το Greek Learner Corpus

Το Greek Learner Corpus (GLC) είναι το μεγαλύτερο διαδικτυακό, ελεύθερα διαθέσιμο σώμα κειμένων μαθητών της Ελληνικής ως δεύτερης/ξένης γλώσσας (Γ2). Συνενώνει δύο υποσώματα με επισημειωμένα λάθη (το GLC I και το GLC II) γραπτών και προφορικών παραγωγών μαθητών, καθένα από τα οποία συνοδεύεται από πλούσιο σύνολο μεταδεδομένων, κρίσιμων για τη διδασκαλία και την κατάκτηση της Γ2. Το GLC II συγκροτήθηκε στο πλαίσιο του ερευνητικού έργου Latent Aspects in L2 Acquisition (LAL2A) κατά την περίοδο 2019-2022, που χρηματοδοτήθηκε από το Ελληνικό Ίδρυμα Έρευνας και Καινοτομίας (ΕΛ.ΙΔ.Ε.Κ., έργο αρ. 3161), στο Αριστοτέλειο Πανεπιστήμιο Θεσσαλονίκης.

Το GLC v.1 (δεύτερη καρτέλα) είναι μια συλλογή περίπου 450 γραπτών παραγωγών (~33.000 λέξεων) εφήβων μαθητών της Ελληνικής, που συγκροτήθηκε στο Αριστοτέλειο Πανεπιστήμιο Θεσσαλονίκης υπό την εποπτεία του Αλέξανδρου Τάντου και της Δέσποινας Παπαδοπούλου (Tantos & Papadopoulou, 2014). Αντλεί από τα διαβαθμισμένα τεστ γλωσσομάθειας «Ας μιλήσουμε Ελληνικά Ι, ΙΙ, ΙΙΙ», που δόθηκαν στις Τάξεις Υποδοχής ελληνικών σχολείων μεταξύ 2010 και 2014, και επισημειώθηκε με το UAM Corpus Tool. Το σχήμα επισημείωσης λαθών του αποτέλεσε τη βάση για το GLC v.2. Το GLC v.1 είναι επίσης προσβάσιμο μέσω του ελληνικού κόμβου του CLARIN, CLARIN-EL.

Το GLC v.2 (GLC II, τρίτη καρτέλα) είναι το μεγαλύτερο και πιο πρόσφατο σώμα. Στην ανοιχτή του έκδοση που καταρτίστηκε κατά την περίοδο 2019-2022, περιλαμβάνει 1.101 γραπτά κείμενα (197.713 λέξεις) και 318 προφορικές συνεντεύξεις (~156.005 λέξεις), περίπου 422.360 λέξεις συνολικά, από ενήλικες μαθητές με 36 διαφορετικές μητρικές γλώσσες (συχνότερες: ρωσικά, αραβικά, ισπανικά, σερβικά και τουρκικά), που καλύπτουν τα Επίπεδα Α1–Γ2 του ΚΕΠΑ. Πρόκειται για συγχρονικό σώμα, που αποτυπώνει στιγμιότυπο της επίδοσης των μαθητών σε αρχάριο, μέσο και προχωρημένο επίπεδο. Οι παραγωγές προέρχονται από σειρά φορέων στην Ελλάδα και στο εξωτερικό: το Σχολείο Νέας Ελληνικής Γλώσσας του ΑΠΘ, το τμήμα ελληνομάθειας για μετανάστριες και πρόσφυγες του Λυκείου των Ελληνίδων (Αθήνα), το ιδιωτικό κέντρο γλωσσών Peek at Greek (Θεσσαλονίκη), το Σισμανόγλειο Ίδρυμα στην Κωνσταντινούπολη και τα παραρτήματα του Ελληνικού Ιδρύματος Πολιτισμού σε Βελιγράδι, Οδησσό, Φλωρεντία και Αλεξάνδρεια.

Οι γραπτές παραγωγές συλλέχθηκαν μέσω φόρμας Google οργανωμένης σε τρεις ενότητες (περιγραφή του έργου και συναίνεση, προφίλ μαθητή και προφίλ δραστηριότητας), σε τρία κειμενικά είδη (περιγραφή, αφήγηση και επιχειρηματολογία), με ανώτατο χρονικό όριο τη μία ώρα. Πέρα από τις ψηφιακές υποβολές, συγκεντρώθηκαν και ψηφιοποιήθηκαν χειρόγραφα κείμενα, με σαφές πρωτόκολλο που εξασφάλισε ενιαία κωδικοποίηση χαρακτηριστικών όπως τα δυσανάγνωστα γράμματα, οι διαγραφές, ο τεμαχισμός και οι δείκτες παραγράφων.

Εκπαιδευτικοί και φιλόλογοι με μαθητές που μαθαίνουν τα Ελληνικά ως δεύτερη/ξένη γλώσσα, οι οποίοι ενδιαφέρονται να συμβάλουν με παραγωγές των δικών τους μαθητών, μπορούν να επικοινωνήσουν μαζί μας.

Το προφορικό υποσώμα συλλέχθηκε μέσω μαγνητοσκοπημένων διαδικτυακών (Zoom) συνεντεύξεων διάρκειας 6–9 λεπτών στα ίδια θέματα· οι μισές ηχογραφήσεις έχουν ήδη απομαγνητοφωνηθεί σύμφωνα με τις συμβάσεις της Ανάλυσης Συνομιλίας, και οι υπόλοιπες θα προστίθενται σταδιακά στην Πύλη.

Το GLC v.2 συνοδεύεται επίσης από συγκρίσιμο σώμα ελέγχου γραπτών παραγωγών μονόγλωσσων φυσικών ομιλητών της Ελληνικής (~66.645 λέξεις), αντιστοιχισμένων με τους μαθητές ως προς την ηλικία, το φύλο και το μορφωτικό επίπεδο και με βάση τα ίδια θέματα. Η αντιστοίχιση αυτή επιτρέπει την άμεση σύγκριση παραγωγών μαθητών και φυσικών ομιλητών.

Το σώμα φέρει πολυεπίπεδη, αυτόνομη (stand-off) επισημείωση γραμματικών λαθών, οργανωμένη ιεραρχικά ως Πεδίο λάθους → Κατηγορία λάθους → Συστάδα λαθών. Καλύπτονται τέσσερα μορφοσυντακτικά πεδία: Συμφωνία, Απόδοση Γένους, Ρηματική Όψη και Φωνή. Η Συμφωνία, για παράδειγμα, αναλύεται σε Γένος (αρσενικό / θηλυκό / ουδέτερο), Αριθμό (ενικός / πληθυντικός) και Πτώση (ονομαστική / αιτιατική / γενική / κλητική). Η επισημείωση πραγματοποιήθηκε από έξι εκπαιδευμένους γλωσσολόγους που εργάστηκαν σε ζεύγη, με συμφωνία μεταξύ επισημειωτών περίπου 90%, και τεκμηριώνεται σε εγχειρίδιο επισημείωσης που εξασφαλίζει συνέπεια και επαναχρησιμοποίηση στις μελλοντικές επεκτάσεις του σώματος.

Η παρούσα διαδικτυακή εφαρμογή, η Πύλη του Greek Learner Corpus, αποτελεί την ενιαία διεπαφή πρόσβασης στο GLC I και στο GLC II. Προσφέρει περιγραφικά στατιστικά για κάθε σώμα, γραφήματα προφίλ λαθών σε επίπεδο σώματος και κειμένου, τις επισημειώσεις λαθών και τα μεταδεδομένα σε αναζητήσιμη πινακοποιημένη μορφή, σύνθετη αναζήτηση και λήψη με οποιονδήποτε συνδυασμό γλωσσικών και εξωγλωσσικών μεταβλητών, καθώς και πρόσθετες προβολές: πίνακες εποπτείας, αναλυτικά μαθητών, συμφραστικούς πίνακες και μέρη του λόγου.

Πέρα από τη διάχυση, τα δεδομένα του GLC και οι επισημειώσεις τους φιλοξενούνται στην πλατφόρμα annoteca, μια εξειδικευμένη πλατφόρμα επισημείωσης που είναι υπό εξέλιξη και υποστηρίζει τις συνεργατικές ροές εργασίας επισημείωσης Σωμάτων Κειμένων: επισημείωση από πολλούς επισημειωτές, μέτρηση συμφωνίας μεταξύ επισημειωτών και επιμέλεια προς χρυσό πρότυπο. Εκεί, στο άμεσο μέλλον, η επισημείωση του GLC θα μπορεί να συντηρείται, να ελέγχεται και να επεκτείνεται σε ένα αναπαραγώγιμο, πολυσυμμετοχικό περιβάλλον, ενώ το σώμα λειτουργεί ως βάση για την υποβοηθούμενη από ΤΝ επισημείωση νέων δεδομένων της Ελληνικής ως Γ2.

Το GLC v.2 ακολουθεί έναν σαφή σχεδιασμό (βλ. το σχήμα παρακάτω) που επιτρέπει στους ερευνητές να κρίνουν γρήγορα αν το σώμα ανταποκρίνεται στα ενδιαφέροντά τους.

Δομή του Σώματος

Η οργάνωση του Greek Learner Corpus II

Δεδομένα & Πρόσβαση
Μέρη του λόγου: ελεγμένα με ΤΝ & επικυρωμένα από ειδικούς Λάθη: επανεπισημείωση στο INCEpTION, επιμέλεια στο annoteca
Διαθέσιμα εδώ, στην Πύλη
  • Κάθε πίνακας του ιστοτόπου (λάθη, στατιστικά, συγκρίσεις): λήψη σε CSV / Excel από το κουμπί λήψης.
  • Τα κείμενα του GLC v.2 σε αρχείο ZIP (καρτέλα GLC v.2).
  • Αναζήτηση (συμφραστικός πίνακας), μέρη του λόγου και περιήγηση λαθών, χωρίς λογαριασμό.
Στο annoteca (απαιτείται λογαριασμός)
  • Τα πλήρη επίπεδα επισημείωσης και ολόκληρο το σχεσιακό γράφημα, σε επεξεργάσιμο, πολυσυμμετοχικό περιβάλλον.
  • Μαζικές εξαγωγές (CoNLL-U / JSON / TSV) των επιμελημένων επισημειώσεων.
  • Συνεισφορά: πρόταση διορθώσεων, επισημείωση νέων κειμένων, συμφωνία μεταξύ επισημειωτών και επιμέλεια προς το χρυσό πρότυπο.

Αίτηση πρόσβασης στο annoteca

Λεξικό δεδομένων

Ορισμοί σε απλή γλώσσα για τους δείκτες και τα βασικά πεδία δεδομένων που συναντάτε στους πίνακες και στις λήψεις.

Δείκτες (πολυπλοκότητα, ορθότητα, λεξιλόγιο)

Εμφανίζονται στον Πίνακα ελέγχου, στην εξέλιξη ανά επίπεδο (ΚΕΠΑ), στις κάρτες «Προφίλ κειμένου» και στη Σύγκριση Ομάδων. Οι τιμές υπολογίζονται ανά κείμενο· τα στοιχεία ομάδας είναι μέσοι όροι, εκτός από τον ρυθμό λαθών που υπολογίζεται αθροιστικά στα κείμενα της ομάδας. Οι περίοδοι κατατέμνονται με βάση τη στίξη τέλους πρότασης και τις αλλαγές γραμμής.

Λάθη / 1.000 λέξεις Επισημειωμένα λάθη ανά 1.000 λέξεις (εξαιρείται η στίξη). Δείκτης ορθότητας.
Λεξική ποικιλότητα (MTLD) Measure of Textual Lexical Diversity: πόσο ποικίλο είναι το λεξιλόγιο, ανεξάρτητα από το μήκος του κειμένου (σε αντίθεση με τον απλό λόγο τύπων/δειγμάτων). Υψηλότερο = πιο ποικίλο. Υπολογίζεται μετρώντας πόσο συχνά ο τρέχων λόγος τύπων/δειγμάτων πέφτει στο 0,72, με μέσο όρο προς τα εμπρός και προς τα πίσω.
Μέσο μήκος πρότασης Μέσος αριθμός λέξεων ανά πρόταση. Δείκτης ευχέρειας / πολυπλοκότητας.
Λεξική πυκνότητα Ποσοστό λέξεων περιεχομένου (ουσιαστικά, ρήματα, επίθετα, επιρρήματα) στο σύνολο των λέξεων. Εύρος 0–1· υψηλότερο = πιο πυκνό σε πληροφορία.
Υπόταξη (σύνδεσμοι / πρόταση) Υποτακτικοί σύνδεσμοι (SCONJ, π.χ. «ότι», «όταν», «επειδή») ανά πρόταση. Δείκτης συντακτικής πολυπλοκότητας.
Προτάσεις ανά περίοδο Μέσος αριθμός προτάσεων ανά περίοδο, από τις σχέσεις εξάρτησης (root + advcl + ccomp + xcomp + acl + csubj). Απαιτεί συντακτική ανάλυση· μένει κενό όπου δεν υπάρχει.
Περίοδοι χωρίς λάθη (%) Ποσοστό των περιόδων ενός κειμένου που δεν φέρουν κανένα επισημειωμένο λάθος. Μέτρο ορθότητας.
Πεδία επισημείωσης λαθών

Οι πίνακες λαθών και ο περιηγητής λαθών (GLC v.1 και v.2).

Error type Η ευρεία γραμματική κατηγορία του λάθους (π.χ. συμφωνία, πτώση, άρθρο, ορθογραφία). Το GLC v.1 χρησιμοποιεί το σχήμα του UAM CorpusTool· το GLC v.2 το μορφοσυντακτικό πλαίσιο Λιόντα-Μίγκα.
Error subtype Πιο λεπτομερής χαρακτηρισμός κάτω από τον τύπο (π.χ. πτώση: αιτιατική). Ένα λάθος του GLC v.1 μπορεί να φέρει πολλές διαδοχικές υποκατηγορίες, από το ευρύ προς το ειδικό.
Target_Form Η επιδιωκόμενη, γραμματικά ορθή μορφή του λανθασμένου τμήματος (η διόρθωση). Για το GLC v.2 είναι επισημειωμένη από άνθρωπο· για το GLC v.1 είναι στρώμα που προτάθηκε από LLM και εκκρεμεί έλεγχος.
Target_Lemma Η λημματική (λεξικογραφική) μορφή της διορθωμένης λέξης.
Offset (v.2) / Start–End (v.1) Η θέση (σε χαρακτήρες) του λάθους μέσα στο κείμενο. Το Offset του GLC v.2 είναι 1-based· τα Start/End του GLC v.1 είναι 0-based.
Relation / Relation_Type (v.2) Συνδέει τα δύο μέλη ενός λάθους συμφωνίας (π.χ. ένα ουσιαστικό και το άρθρο που δεν συμφωνεί μαζί του) και τον τύπο/κατεύθυνσή του. Αποτυπώνεται μόνο εν μέρει στο επίπεδο σχήμα της Πύλης· η πλήρης σχεσιακή πιστότητα βρίσκεται στο annoteca.
Μεταδεδομένα μαθητή/τριας

Στοιχεία υπόβαθρου ανά κείμενο, για φιλτράρισμα και για σύγκριση ομάδων.

Proficiency level (CEFR) Το επίπεδο του μαθητή/τριας κατά το Κοινό Ευρωπαϊκό Πλαίσιο (A1 έως C2).
L1 (first language) Η μητρική γλώσσα του μαθητή/τριας.
Genre / writing task Το κειμενικό είδος ή η δραστηριότητα παραγωγής (π.χ. αφήγηση, περιγραφή, επιχειρηματολογία). Στο GLC v.2 είναι τα πεδία είδους / επιλογής θέματος.
Country of origin Η χώρα προέλευσης του μαθητή/τριας, όπως καταγράφεται στα μεταδεδομένα.
Sex / Gender Το φύλο του μαθητή/τριας όπως καταγράφεται στα μεταδεδομένα (GLC v.2: Sex· GLC v.1: Gender).
Πεδία μερών του λόγου (POS)

Οι πίνακες POS (καρτέλα POS) και οι λεξικοί δείκτες. Τα POS του GLC v.1 έχουν επισημειωθεί από LLM και δεν έχουν ακόμη ελεγχθεί· στα POS του GLC v.2 εφαρμόστηκε έλεγχος δεύτερης γνώμης υψηλής βεβαιότητας (Tier A).

Form Ο επιφανειακός τύπος της λέξης ακριβώς όπως εμφανίζεται στο κείμενο. Δεν αλλάζει ποτέ, ούτε για τα λάθη (η επιδιωκόμενη μορφή βρίσκεται στο Target_Form).
UPOS Καθολική ετικέτα μέρους του λόγου (NOUN, VERB, ADJ, DET, ...). Κενό UPOS σε συγχωνευμένους τύπους όπως «στο/στην» δηλώνει πολυλεκτική μονάδα των Universal Dependencies (σε + άρθρο), όχι λάθος επισημείωσης.
XPOS Ειδική ανά γλώσσα (λεπτομερής) ετικέτα μέρους του λόγου.
Lemma Η λημματική (βασική, λεξικογραφική) μορφή της λέξης.
FEATS (features) Μορφολογικά χαρακτηριστικά (Πτώση, Γένος, Αριθμός, Χρόνος, Όψη, Φωνή, ...) σε μορφή Universal Dependencies.
Normalized (v.1) Στρώμα διορθωμένου λήμματος (αυτό που εννοούσε ο μαθητής/τρια) για κανονικοποιημένη λεξική συχνότητα. Μόνο στο GLC v.1· συμπληρώνεται όταν εφαρμοστεί ο έλεγχος των POS.
Πώς να το αναφέρετε

Αν χρησιμοποιήσετε το Greek Learner Corpus ή την Πύλη στην έρευνά σας, παρακαλούμε αναφέρετε:

  • GLC v.2 / Gateway: Tantos, A., Amvrazis, N., & Drakonaki, C. E. (2023). Greek Learner Corpus II (GLCII): Design and development of an online corpus for L2 Greek. Journal of Applied Linguistics, 36.
  • GLC v.1: Tantos, A., & Papadopoulou, D. (2014). Stand-off annotation in learner corpora: Compiling the Greek Learner Corpus (GLC). In A. Díaz-Negrillo & F. J. Díaz-Pérez (Eds.), Specialisation and variation in language corpora (pp. 15–41). Peter Lang. (Available through CLARIN-EL.)
  • Gateway (platform): Tantos, A., Amvrazis, N., Drakonaki, E., Papadopoulou, D., Develaska, C., Douka, G., Kikilintza, P., & Papafilippou, I. (2024). Empowering L2-Greek research and teaching: The role of GLCII’s design and web platform. In Proceedings of the 15th International Conference on Greek Linguistics (ICGL15) (Vol. 15.2, pp. 503–517). https://doi.org/10.18485/icgl.2024.15.2.ch301

1 Το κεφάλαιο περιγράφει παλαιότερη έκδοση αυτής της πλατφόρμας.

Σχεδιάζεται αναφορά με DOI και σήμανση έκδοσης για τις εκδόσεις των δεδομένων.

Εταίροι & Χρηματοδότηση

Το Greek Learner Corpus αναπτύχθηκε, έως το 2023, με την υποστήριξη του Ελληνικού Ιδρύματος Έρευνας και Καινοτομίας (ΕΛ.ΙΔ.Ε.Κ.) στο πλαίσιο του έργου Latent Aspects in L2 Acquisition (LAL2A)· πλέον συντηρείται και επεκτείνεται ανεξάρτητα, εκτός του χρηματοδοτούμενου έργου.

Κείμενα

Λέξεις (tokens)

Τύποι (types)

Λάθη

Λάθη / 1.000 λέξεις

Κάντε κλικ σε μια μπάρα για τους δείκτες της ομάδας.

Κείμενα

Λέξεις (tokens)

Τύποι (types)

Λάθη

Λάθη / 1.000 λέξεις

Κάντε κλικ σε μια μπάρα για τους δείκτες της ομάδας.
Σώμα:
Οι αναλύσεις είναι ανά κείμενο / επίπεδο (τα σώματα δεν φέρουν ταυτότητα μαθητή).
Το λάθος στο συγκείμενό του
Σώμα:

Πώς εξελίσσεται ο επιλεγμένος δείκτης στα Επίπεδα ΑΑ1–Γ2 (μέσοι όροι ανά κείμενο· το ποσοστό λαθών είναι κανονικοποιημένο στις λέξεις). Οι προτάσεις/περίοδο απαιτούν συντακτική ανάλυση και υπάρχουν μόνο για το GLC v.2.

Μερίδιο (%) κάθε τύπου λάθους σε κάθε επίπεδο.

Σώμα:

Έλεγχος: αμφίπλευρος Wilcoxon rank-sum (Mann-Whitney) σε τιμές ανά κείμενο· οι τιμές p διορθώνονται κατά Holm για το πλήθος των δεικτών. Δ = δεύτερη ομάδα μείον πρώτη. Μέγεθος επίδρασης = Cliff's δ. Σημαντικότητα: *** p<.001, ** p<.01, * p<.05, ns = μη σημαντικό. Απαιτεί τουλάχιστον 3 κείμενα ανά ομάδα· οι γραμμές πλήθους (κείμενα, λέξεις) δεν ελέγχονται. Προσοχή στα μεγέθη των ομάδων και στις πολλαπλές συγκρίσεις.

Προφίλ τύπων λαθών (μερίδιο εντός κάθε ομάδας)
Σώμα:

Κάθε κελί μετρά τις προτάσεις στις οποίες δύο τύποι λάθους εμφανίζονται μαζί (πιο σκούρο = συχνότερη συνεμφάνιση)· η διαγώνιος εξαιρείται. Κλικ σε κελί για να εμφανιστούν παρακάτω αυτές οι προτάσεις.

Η επιλεγμένη περίπτωση στο συγκείμενό της
Κατευθυνόμενες σχέσεις συμφωνίας (μια κεφαλή + το εξαρτώμενο που πρέπει να συμφωνεί μαζί της), σε διάγραμμα τύπου INCEpTION πάνω στην πρόταση: τα βέλη δείχνουν κεφαλή → εξαρτώμενο, οι ετικέτες δείχνουν την παρατηρημένη και τη σωστή τιμή. Επιλέξτε διάσταση και μετά περίπτωση. (Μόνο GLC v.2.)
Η προβολή περιέχει όλες τις επισημειωμένες σχέσεις του σώματος, μόνο για ανάγνωση, μία επιλεγμένη σχέση κάθε φορά. Για επεξεργασία / επιμέλεια ολόκληρου του γραφήματος (πολλοί επισημειωτές, IAA, χρυσό πρότυπο) ανοίξτε το στο annoteca (πρόσβαση κατόπιν αιτήματος, βλ. Σχετικά → Δεδομένα & Πρόσβαση).
Επισημειωμένη σχέση
Ποια λάθη να περιμένετε από τους μαθητές σας; Επιλέξτε επίπεδο ή/και μητρική γλώσσα (Γ1) και δείτε τις συχνότερες κατηγορίες λαθών με πραγματικά παραδείγματα από το σώμα κειμένων και τη διορθωμένη μορφή, όπου αυτή έχει επισημειωθεί. Ο πίνακας στο τέλος κατεβαίνει σε CSV/Excel για χρήση στην τάξη.
Για τη διδασκαλία και τον σχεδιασμό του μαθήματος
Πίνακας για εξαγωγή (όλα τα λάθη της επιλογής)
Παραδείγματα ανά κατηγορία
Τομείς Λαθών

Η ταξινομία γραμματικών λαθών του GLC v.1, όπως ορίζεται στο έργο του UAM CorpusTool. Οι κατηγορίες κρατούν τις πρωτότυπες ελληνικές ετικέτες τους και εμφωλεύονται από τα ευρύτερα πεδία λαθών έως τις λεπτότερες υποκατηγορίες· καθεμία συνοδεύεται από σύντομη περιγραφή και, όπου απαντά στα δεδομένα, από ένα πραγματικό παράδειγμα από το GLC v.1.

  • ορθ Ορθογραφία: ορθογραφικά λάθη π.χ. «ανέβεναν»
    • ο-γραμ Ορθογραφικό λάθος με γραμματική σημασία (π.χ. λανθασμένη κατάληξη) π.χ. «τραβίξη»
    • ο-ορια_λεξ Λάθος ορίων λέξης (λανθασμένος χωρισμός ή ένωση λέξεων) π.χ. «παάραπολει»
    • κεφ Εσφαλμένη χρήση κεφαλαίων π.χ. «ΜαΜΑ»
    • πεζ Εσφαλμένη χρήση πεζών π.χ. «η»
    • κωδ Γραφή με λατινικούς χαρακτήρες / εναλλαγή κώδικα π.χ. «κe»
    • ο-λεξ Λεξικό ορθογραφικό λάθος (χωρίς γραμματική σημασία) π.χ. «ανέβεναν»
    • διαλυτ Λάθος διαλυτικών π.χ. «φαϊ»
  • γραφ Γραφηματική απόδοση: λάθη αντιστοίχισης φθόγγου-γράμματος π.χ. «πολάκια»
    • γ-λεξ Λεξικό γραφηματικό λάθος π.χ. «πολάκια»
    • γ-γραμ Γραμματικό γραφηματικό λάθος π.χ. «κελαδιόσαν»
  • τον Τονισμός: λάθη τόνου π.χ. «σκιλος»
    • τ-παρ Παράλειψη τόνου π.χ. «σκιλος»
    • τ-προσ Πλεονάζων τόνος π.χ. «ποιό»
    • τ-αντι Λανθασμένη θέση τόνου π.χ. «μόρα»
  • συμφ Λάθη συμφωνίας π.χ. «πίγα»
    • σ-αρι Λάθος συμφωνίας αριθμού π.χ. «το»
      • α-αρθρο Συμφωνία αριθμού: στο άρθρο
      • α-ουσιαστικό Συμφωνία αριθμού: στο ουσιαστικό
      • α-επίθετο Συμφωνία αριθμού: στο επίθετο
        • α-ονφραση Συμφωνία αριθμού: επιθετικός προσδιορισμός (στην ονοματική φράση)
        • α-κατηγ Συμφωνία αριθμού: κατηγορούμενο
      • α-κλιτικό Συμφωνία αριθμού: στο κλιτικό
      • α-ρήμα Συμφωνία αριθμού: στο ρήμα
    • σ-γεν Λάθος συμφωνίας γένους π.χ. «τις»
      • γ-αρθρο Συμφωνία γένους: στο άρθρο
      • γ-ουσιαστικό Συμφωνία γένους: στο ουσιαστικό
      • γ-επίθετο Συμφωνία γένους: στο επίθετο
        • γ-ονφραση Συμφωνία γένους: επιθετικός προσδιορισμός (στην ονοματική φράση)
        • γ-κατηγ Συμφωνία γένους: κατηγορούμενο
      • γ-κλιτικό Συμφωνία γένους: στο κλιτικό
      • γ-ρήμα Συμφωνία γένους: στο ρήμα
    • σ-προσ Λάθος συμφωνίας προσώπου π.χ. «πίγα»
      • πρ-αρθρο Συμφωνία προσώπου: στο άρθρο
      • πρ-ουσιαστικό Συμφωνία προσώπου: στο ουσιαστικό
      • πρ-επίθετο Συμφωνία προσώπου: στο επίθετο
        • πρ-ονφραση Συμφωνία προσώπου: επιθετικός προσδιορισμός (στην ονοματική φράση)
        • πρ-κατηγ Συμφωνία προσώπου: κατηγορούμενο
      • πρ-κλιτικό Συμφωνία προσώπου: στο κλιτικό
      • πρ-ρήμα Συμφωνία προσώπου: στο ρήμα
    • σ-πτω Λάθος συμφωνίας πτώσης π.χ. «της γάτα»
      • πτ-αρθρο Συμφωνία πτώσης: στο άρθρο
      • πτ-ουσιαστικό Συμφωνία πτώσης: στο ουσιαστικό
      • πτ-επίθετο Συμφωνία πτώσης: στο επίθετο
        • πτ-ονφραση Συμφωνία πτώσης: επιθετικός προσδιορισμός (στην ονοματική φράση)
        • πτ-κατηγ Συμφωνία πτώσης: κατηγορούμενο
      • πτ-κλιτικό Συμφωνία πτώσης: στο κλιτικό
      • πτ-ρήμα Συμφωνία πτώσης: στο ρήμα
  • οψη Λάθη ρηματικής όψης π.χ. «προσπαθούσε»
    • συν Εσφαλμένη συνοπτική όψη π.χ. «σκαρφάλοσε»
    • μσυν Εσφαλμένη μη συνοπτική όψη π.χ. «προσπαθούσε»
    • τελ-συν Συντελική αντί συνοπτικής όψης π.χ. «ειχαι βρι»
    • συν-τελ Συνοπτική αντί συντελικής όψης π.χ. «πηγε»
  • χρ Λάθη χρόνου π.χ. «σκαρφαλοσε»
    • πρλθ Εσφαλμένος παρελθοντικός χρόνος π.χ. «σκαρφαλοσε»
    • μπρλθ Εσφαλμένος μη παρελθοντικός χρόνος π.χ. «φευγη»
  • λεξη_φράση Λεξικά λάθη λέξης ή φράσης π.χ. «προς το κάτω»
    • λ_φ-παρ Παράλειψη λέξης ή φράσης π.χ. «.»
    • λ_φ-προσ Πλεονάζουσα λέξη ή φράση π.χ. «και στιλε»
    • λ_φ-αντι Εσφαλμένη επιλογή λέξης ή φράσης π.χ. «προς το κάτω»
  • στιξ Λάθη στίξης π.χ. «.»
    • στ-παρ Παράλειψη σημείου στίξης π.χ. «α»
    • στ-προσ Πλεονάζον σημείο στίξης π.χ. «.»
    • στ-αντι Λανθασμένο σημείο στίξης π.χ. «,»
  • κειμ Κειμενικά λάθη / λάθη συνοχής π.χ. «και»
    • υποκ Λάθος πραγμάτωσης υποκειμένου π.χ. «η γάτα»
      • υποκ-παρ Παράλειψη υποκειμένου π.χ. «τ»
      • υποκ-προσ Πλεονάζον υποκείμενο π.χ. «η γάτα»
      • υποκ-αντικ Υποκείμενο σε θέση αντικειμένου (λανθασμένη γραμματική σχέση)
    • συνδ Λάθος συνδέσμου (συνοχή) π.χ. «και»
      • παρ Λάθος παρατακτικής σύνδεσης π.χ. «ετσι»
        • παρ-παρ Παράλειψη παρατακτικού συνδέσμου π.χ. «.»
        • παρ-προσ Πλεονάζων παρατακτικός σύνδεσμος π.χ. «και»
        • παρ-αντι Λανθασμένος παρατακτικός σύνδεσμος π.χ. «μετά»
      • υποτ Λάθος υποτακτικής σύνδεσης π.χ. «,»
        • επιρρ Λάθος συνδέσμου επιρρηματικής πρότασης π.χ. «όταν»
          • επ-παρ Παράλειψη επιρρηματικού συνδέσμου π.χ. «α»
          • επ-προσ Πλεονάζων επιρρηματικός σύνδεσμος π.χ. «όταν»
          • επ-αντι Λανθασμένος επιρρηματικός σύνδεσμος π.χ. «γιατί»
        • συμπλ Λάθος συνδέσμου συμπληρωματικής πρότασης π.χ. «,»
          • συμπλ-παρ Παράλειψη συμπληρωματικού συνδέσμου π.χ. «,»
          • συμπλ-προσ Πλεονάζων συμπληρωματικός σύνδεσμος π.χ. «που»
          • συμπλ-αντι Λανθασμένος συμπληρωματικός σύνδεσμος π.χ. «ότι»
    • αναφορά_κλιτικό Λάθος αναφοράς κλιτικού π.χ. «την γάτα»
      • αντ_κλ Λάθος αναδιπλασιασμού κλιτικού π.χ. «τους»
      • αντ_οφ Παράλειψη υποχρεωτικού κλιτικού αναφοράς π.χ. «την γάτα»
  • σορ Λάθη σειράς όρων
  • ν Λάθη τελικού -ν
  • προβλ Προβληματικές ή αταξινόμητες περιπτώσεις
  • γεν Λάθη απόδοσης γένους
  • συλλαβ Λάθη συλλαβισμού
  • αρθ Λάθη άρθρων π.χ. «ενα»
    • ορι Λάθος οριστικού άρθρου π.χ. «ο»
      • ο-παρ Παράλειψη οριστικού άρθρου π.χ. «ο»
      • ο-προσ Πλεονάζον οριστικό άρθρο π.χ. «ι»
      • ο-αντι Λανθασμένο οριστικό άρθρο π.χ. «η»
    • αορ Λάθος αόριστου άρθρου π.χ. «ενα»
      • α-παρ Παράλειψη αόριστου άρθρου π.χ. «Π»
      • α-προσ Πλεονάζον αόριστο άρθρο
      • α-αντι Λανθασμένο αόριστο άρθρο π.χ. «ενα»
  • προθ Λάθη προθέσεων π.χ. «με»
    • π-παρ Παράλειψη πρόθεσης π.χ. «τα»
    • π-προσ Πλεονάζουσα πρόθεση π.χ. «με»
    • π-αντι Λανθασμένη πρόθεση π.χ. «με»
  • φωνη Λάθη φωνής (ενεργητική/παθητική) π.χ. «τρομαστικε»
    • ενεργ Εσφαλμένη χρήση ενεργητικής φωνής π.χ. «κατεβει»
    • παθ Εσφαλμένη χρήση παθητικής φωνής π.χ. «τρομαστικε»
  • κλιτ Λάθη κλιτικών π.χ. «του»
    • κλ-παρ Παράλειψη κλιτικού π.χ. «α»
    • κλ-προσ Πλεονάζον κλιτικό π.χ. «του»
  • πτω Λάθη πτώσης π.χ. «την»
    • πτω-υποκ Λάθος πτώσης στο υποκείμενο π.χ. «σκυλο»
    • πτω-αντ Λάθος πτώσης στο αντικείμενο π.χ. «καλλος δασκαλος»
    • πτω-προθ_φραση Λάθος πτώσης σε προθετική φράση π.χ. «του»
    • πτω-προσδ_γενική Λάθος πτώσης σε γενική προσδιοριστική π.χ. «την»
    • πτω-αιτ_χρόνου Λάθος πτώσης σε αιτιατική του χρόνου π.χ. «ηστγειμη»
    • πτω-κλητική_προσφώνηση Λάθος πτώσης σε κλητική προσφώνηση π.χ. «Γιώργος»
  • συμπλήρωμα Λάθη συμπληρωμάτων π.χ. «.»
    • συμπληρ-παρ Παράλειψη συμπληρώματος π.χ. «.»
    • συμπληρ-προσ Πλεονάζον συμπλήρωμα
    • συμπληρ-αντι Λανθασμένο συμπλήρωμα
Η επιλεγμένη γραμμή στο συγκείμενό της

Context

ΣΥΜΦΩΝΙΑ

Τύπος λάθους

Περιγραφή

Παραδείγματα

gender-a

αδιευκρίνιστη απόδοση γένους

η λεκσι ικογενια από μόνο του

gen-masc

εσφαλμένη χρήση αρσενικού γένους

στον ακτή

gen-fem

εσφαλμένη χρήση θηλυκού γένους

είχα να δω τις γονείς μου

gen-neut

εσφαλμένη χρήση ουδέτερου γένους

η γεύση του καπνού είναι δυσάρεστο

case

αδιευκρίνιστη πτώση

στη σκιά του σμαραγδένιο πράσινο

case-nom

εσφαλμένη χρήση ονομαστικής

τον χειμώνας

case-gen

εσφαλμένη χρήση γενικής

η πρώτη στιγμής μιας μέρας

case-acc

εσφαλμένη χρήση αιτιατικής

εμένα περίμεναν οι καλύτερους ανθρώπους

case-voc

εσφαλμένη χρήση κλητικής

 

num-sing

εσφαλμένη χρήση ενικού αριθμού

στην άλλη μέρες

num-pl

εσφαλμένη χρήση πληθυντικού αριθμού

εσείς ξέρεις ότι θέλουμε…

pers-first

εσφαλμένη χρήση πρώτου προσώπου

υπάρχω μία φίλη μου

pers-second

εσφαλμένη χρήση δεύτερου προσώπου

ο James ξυπνάι μόνος σου

pers-third

εσφαλμένη χρήση τρίτου προσώπου

το σπίτι μου που μόλις αγόρασε είναι ωραίο

relation

αμφίσημη περίπτωση: λάθος στην απόδοση γένους ή στη συμφωνία γένους & αριθμού

η γάλα, τα μυρωδιά, τα τεραπή

 

ΦΩΝΗ

Τύπος λάθους

Περιγραφή

Παραδείγματα

active

εσφαλμένη χρήση ενεργητικής φωνής

Είναι δύσκολο να ενσωματώσουν σε μια ξένη κοινωνία

passive

εσφαλμένη χρήση παθητικής φωνής

Ετοιμαστήκαμε τις τσάντες μας από την προηγούμενη μέρα

Verb_type/dep

εσφαλμένη χρήση αποθετικού ρήματος

 

Verb_type/Unac

εσφαλμένη χρήση αναιτιατικού ρήματος

o σύζυγος της Τζοάνας διασκεδαζόταν

Verb_type Unerg

εσφαλμένη χρήση ανεργαστικού ρήματος

 

 

 

ΓΕΝΟΣ

Τύπος λάθους

Περιγραφή

Παραδείγματα

gender-g

αδιευκρίνιστη χρήση γένους

χαρούμενες πάρτες

έχει 2 υπνοδωμάτιες

syncretism

συγκρητισμός

χαρούμενες πάρτες

έχει 2 υπνοδωμάτιες

masc

εσφαλμένη απόδοση γένους (αρσενικό)

Ο δρόμος μας εκεί ήταν σαν όνειρος

fem

εσφαλμένη απόδοση γένους (θηλυκό)

της κοινόχρηστας

μεγάλη τραπέζη

neut

εσφαλμένη απόδοση γένους (ουδέτερο)

Τα γκέι δεν μπορούν όμως να έχουν…

μου αρεσιε… το κοσμ

 

ΠΤΩΣΗ

Τύπος λάθους

Περιγραφή

Παραδείγματα

ccase

αδιευκρίνιστη πτώση

 

nom

εσφαλμένη χρήση ονομαστικής

να μάθω η Ελλεινική γλόσσα

genitive

εσφαλμένη χρήση γενικής

Ήταν πολύ συγκινητικό να της δούμε έτσι ντυμένη

από θρησκευτικού σκοταδισμού

acc

εσφαλμένη χρήση αιτιατικής

Ήτανε μείον δεκαπέντε βαθμούς

voc

εσφαλμένη χρήση κλητικής

 

 

ΡΗΜΑΤΙΚΗ ΟΨΗ

Τύπος λάθους

Περιγραφή

Παραδείγματα

form

χρήση μη στοχευόμενου τύπου

κάθεμέρα μείνουσαμε στην παραλία την ολόκληρη μέρα

αν συγκρίσουμε τα πρωτοσέλιδα επιτέλους τα είχε καταφέρνει.

imperf

εσφαλμένη χρήση μη συνοπτικής όψης

πρέπει να αγοράζουμε κατι για το σπίτι

pperf

εσφαλμένη χρήση συνοπτικής όψης

ήτανε πολύ δύσκολα να ξεκινήσω να μάθω την γλώσσα.

perf

εσφαλμένη χρήση συντελικής όψης

Ο κινέζικος κινηματογράφος έχει αναπτυχθεί όλο και πιο γρήγορα από το 2013

 

Η επιλεγμένη γραμμή στο συγκείμενό της

Context