
ChatGPT ή Gemini στα ελληνικά: η γραμματική δεν κρίνει μόνη τον νικητή

Για ελληνικό διάλογο εξυπηρέτησης, η μελέτη της Alexandra Fiotaki κατέγραψε κλείσιμο από τον εκπρόσωπο στο 67% των διαλόγων του ChatGPT-4.1 και στο 57% του Gemini 2.5, με εκκρεμότητα 4% και 7% αντίστοιχα· στο ίδιο δείγμα, το Gemini δεν παρουσίασε γραμματικό σφάλμα, ενώ τουλάχιστον ένα μορφοσυντακτικό σφάλμα βρέθηκε στο 15% των διαλόγων του ChatGPT.
Άρα, για καθαρή μορφοσύνταξη στο συγκεκριμένο είδος κειμένου, το Gemini έχει το ισχυρότερο τεκμήριο. Για μια συμπαγή συνομιλία που φτάνει συχνότερα σε σαφές κλείσιμο, τα στοιχεία ευνοούν το ChatGPT. Το ποιο είναι καταλληλότερο για ελληνικά εξαρτάται από το αν προέχει η γλωσσική επιμέλεια, ο τόνος, η ολοκλήρωση της ανταλλαγής ή η ακρίβεια της πληροφορίας.
Τι μετρήθηκε στους τραπεζικούς διαλόγους
Οι διάλογοι ήταν συνθετικά σενάρια τηλεφωνικής τραπεζικής, όπως άνοιγμα λογαριασμού και επίλυση προβλημάτων εξυπηρέτησης. Οι δύο εκδόσεις έλαβαν κοινή οδηγία για τη δομή της συνομιλίας, τους ρόλους και τον βαθμό τυπικότητας. Αυτό κρατά σταθερό το πλαίσιο της σύγκρισης, αλλά το αποτέλεσμα εξακολουθεί να αφορά τη συγκεκριμένη οδηγία και το συγκεκριμένο πεδίο, όπου μετρούν ιδιαίτερα η ευγένεια και η τραπεζική ορολογία.
«Κλείσιμο από τον εκπρόσωπο» σημαίνει ότι η παραγόμενη συνομιλία τελειώνει με τελική απάντηση, επιβεβαίωση, επόμενα βήματα ή αποχαιρετισμό από τον ρόλο του υπαλλήλου. Υπάρχει και κλείσιμο από τον πελάτη, όταν εκείνος ευχαριστεί ή δηλώνει ότι θα δοκιμάσει τη λύση. Εκκρεμής χαρακτηρίζεται ο διάλογος που σταματά ενώ η τελευταία ερώτηση ή εντολή του πελάτη χρειάζεται ακόμη απάντηση. Πρόκειται για μέτρο της δομής ενός κειμένου, όχι για απόδειξη ότι μια πραγματική τραπεζική πράξη εκτελέστηκε.
Γιατί η σωστή γραμματική δεν αρκεί για φυσικό λόγο
Στους διαλόγους του ChatGPT τα σφάλματα αφορούσαν, μεταξύ άλλων, παραλείψεις άρθρων ή προθέσεων και αποκλίσεις στην πτώση. Το Gemini απέφυγε τέτοια λάθη στο εξεταζόμενο υλικό. Η καθαρότητα αυτή έχει αξία σε κείμενο που θα διαβαστεί ως επαγγελματική απάντηση, ιδίως όταν μια μικρή μορφοσυντακτική αστοχία αρκεί για να ακουστεί η φράση ξένη προς τα ελληνικά.
Το ίδιο Gemini παρήγαγε πολύ εκτενέστερους διαλόγους, με περισσότερη επανάληψη και τυποποιημένες διατυπώσεις. Παράλληλα, η ποιοτική αποτίμηση το βρήκε πιο οικείο και υποστηρικτικό στην αναγνώριση της ανησυχίας του πελάτη, ενώ το ChatGPT ήταν πιο σύντομο και προσανατολισμένο στο κλείσιμο του αιτήματος. Η «φυσικότητα» εδώ περιλαμβάνει την εναλλαγή των ομιλητών και την κατάλληλη αντίδραση στο συναίσθημα, όχι απλώς την απουσία λαθών.
Σύνταξη, σημασία και φυσικότητα κρίθηκαν χειροκίνητα από έναν αξιολογητή. Η κοινή κλίμακα βοηθά τη σύγκριση μέσα στο δείγμα, όμως οι κρίσεις για ύφος και ενσυναίσθηση έχουν μεγαλύτερο περιθώριο ερμηνείας από την καταμέτρηση ενός σαφούς μορφοσυντακτικού σφάλματος. Γι’ αυτό το προβάδισμα στον τόνο είναι χρήσιμη ένδειξη για παρόμοιους διαλόγους, όχι εγγύηση για κάθε ελληνικό είδος κειμένου.
Ανά εργασία: ποιο προβάδισμα έχει σημασία
- Τυπικός διάλογος εξυπηρέτησης: Το Gemini έχει καλύτερο καταγεγραμμένο αποτέλεσμα στη γραμματική του εξεταζόμενου δείγματος. Η μεγαλύτερη έκταση και η επανάληψη σημαίνουν ότι ένα έτοιμο μήνυμα προς πελάτη μπορεί να χρειαστεί περικοπή, ακόμη κι αν οι προτάσεις του είναι σωστές.
- Σύντομη απόκριση που κλείνει αίτημα: Το ChatGPT έχει το ισχυρότερο αποτέλεσμα ως προς το κλείσιμο από τον ρόλο του εκπροσώπου και λιγότερους διαλόγους που σταματούν με αναπάντητη εκκρεμότητα. Είναι ένδειξη καλύτερης δομής στη συγκεκριμένη προσομοίωση, όχι μετρημένης επιτυχίας σε ζωντανή εξυπηρέτηση.
- Διάλογος με ανάγκη καθησυχασμού: Η ποιοτική αξιολόγηση ευνοεί το Gemini για την υποστηρικτική του ανταπόκριση. Σε κανάλι όπου η απάντηση πρέπει να είναι σύντομη, η ίδια τάση για ανάπτυξη μπορεί να μειώσει την καταλληλότητά του χωρίς επιμέλεια.
- Ερώτηση γνώσεων στα ελληνικά: Η ορθότητα της απάντησης χρειάζεται δική της δοκιμή. Ένα ευγενικό και άψογο ελληνικό κείμενο μπορεί να δώσει λανθασμένη πληροφορία, ενώ μια λιγότερο κομψή διατύπωση μπορεί να περιέχει τη σωστή επιλογή.
Όταν το ζητούμενο είναι η σωστή πληροφορία
Το GreekMMLU περιλαμβάνει 21.805 ερωτήσεις πολλαπλής επιλογής από 45 πεδία, αντλημένες ή γραμμένες αρχικά στα ελληνικά· στο δημόσιο υποσύνολο, χωρίς παραδείγματα μέσα στην οδηγία, το Gemini 3 Flash πέτυχε μέση ακρίβεια 93,16% και το GPT-5.2 87,75%. Αυτό είναι προβάδισμα των συγκεκριμένων εκδόσεων στην επιλογή σωστής απάντησης, με ελληνικές οδηγίες και ερωτήσεις.
Τα θέματα καλύπτουν, μεταξύ άλλων, νεοελληνική γλώσσα, ελληνική ιστορία, μαθηματικά και επαγγελματικές εξετάσεις. Έτσι η δοκιμή πιάνει γνώσεις που μια μετάφραση αγγλικών ερωτήσεων μπορεί να παρακάμψει. Η βαθμολογία, πάντως, αφορά επιλογή απάντησης και όχι σύνταξη ελεύθερου κειμένου, διαχείριση μιας συνομιλίας ή ποιότητα επιχειρηματολογίας. Εξετάζει επίσης άλλες εκδόσεις από εκείνες της τραπεζικής μελέτης, οπότε τα ποσοστά τους δεν συγκροτούν ενιαία κατάταξη των δύο υπηρεσιών.
Τι προσθέτουν οι επίσημες δυνατότητες
Η κάρτα του Gemini 3.1 Pro περιγράφει είσοδο κειμένου, εικόνας, ήχου και βίντεο, καθώς και μεγάλο διαθέσιμο πλαίσιο συμφραζομένων. Αν μια ελληνική εργασία περιλαμβάνει διαφορετικά είδη υλικού, αυτές οι δυνατότητες καθορίζουν τι μπορεί να δοθεί στο μοντέλο για επεξεργασία. Δεν αποτελούν μέτρηση της γραμματικής ή της φυσικότητας των απαντήσεών του στα ελληνικά.
Η κάρτα του GPT-5.5 περιγράφει χρήση για διαδικτυακή έρευνα, ανάλυση πληροφοριών, δημιουργία εγγράφων και εργασία με εργαλεία. Πρόκειται πάλι για περιγραφή διαφορετικής έκδοσης από τις εκδόσεις των ελληνικών δοκιμών. Σε μια επιλογή βοηθού, οι επίσημες δυνατότητες δείχνουν αν υποστηρίζεται ο τύπος εργασίας· οι ανεξάρτητες ελληνικές μετρήσεις δείχνουν πώς απέδωσαν ορισμένες εκδόσεις σε συγκεκριμένα καθήκοντα.
Η επιλογή για ελληνικό κείμενο
Για τυποποιημένες απαντήσεις εξυπηρέτησης με έμφαση στη μορφοσύνταξη και στον καθησυχαστικό τόνο, το διαθέσιμο δείγμα δίνει προβάδισμα στο Gemini. Για σύντομη, προσανατολισμένη στο αίτημα ανταλλαγή, δίνει προβάδισμα στο ChatGPT ως προς το κλείσιμο. Αν ο αναγνώστης χρειάζεται απάντηση σε ερώτηση γνώσεων, το αποτέλεσμα του GreekMMLU αφορά άλλη δεξιότητα και διαφορετικές εκδόσεις.
Στην πράξη, η ίδια ελληνική οδηγία και το ίδιο επιθυμητό παραδοτέο είναι η δικαιότερη βάση επιλογής για χρήση στην Ελλάδα ή την Κύπρο. Για μήνυμα προς πελάτη μετρά η σαφής κατάληξη και ο κατάλληλος τόνος· για κείμενο προς δημοσίευση, η γραμματική και η οικονομία λόγου· για πληροφοριακή απάντηση, η ακρίβεια. Η στάθμιση αυτών των κριτηρίων εξαρτάται από το πραγματικό καθήκον, όχι από ένα συνολικό σκορ για «τα ελληνικά».
Διαβάστε επίσης:
Σχετικά άρθρα


Τα έργα ΤΠΕ μετά το RRF: η χρηματοδότηση αλλάζει, όχι οι προθεσμίες

DeepL ή Google Translate στα ελληνικά: το ύφος αλλάζει τον νικητή

LanguageTool ή Grammarly στα ελληνικά: μόνο το ένα διορθώνει το κείμενο

Ψηφιακές δεξιότητες στην Κύπρο: 100% επιχορήγηση έως το τέλος του 2026

Το δωρεάν Gemini χάνει Flash και Pro από τις 9 Οκτωβρίου
Εγγραφείτε στο newsletter μας
Λάβετε τα τελευταία νέα για Web3, AI και κρυπτονομίσματα απευθείας στα εισερχόμενά σας.