background image

Σχεδιασμός και Υλοποίηση εξειδικευμένου chatbot για διαδικτυακές πλατφόρμες

 

106

 

 

ΕΙΚΟΝΑ 22: ΠΟΙΟΤΗΤΑ ΑΠΑΝΤΗΣΗΣ ΑΝΑ ΓΛΩΣΣΑ ΓΙΑ ΤΑ ΔΥΟ ΚΟΡΥΦΑΙΑ ΥΠΟΨΗΦΙΑ 

ΜΟΝΤΕΛΑ 

 

Συγκεντρωτικά,  η  αντιπαραβολή  των  δύο  μοντέλων  δείχνει  ότι  το  καθένα  υπερέχει  σε 

διαφορετικό πεδίο. Όπως φαίνεται στην Εικόνα 23, το Qwen κρατά ένα οριακό προβάδισμα 

στη γενική γνώση, ενώ το Llama υπερέχει εκεί που μετράει για τη δική μας εφαρμογή: στην 

τήρηση των οδηγιών, στη συνέπεια της μορφής και στην ποιότητα των ελληνικών. Η υπεροχή 

αυτή  γίνεται  ακόμη  πιο  εμφανής  όταν  το  μοντέλο  παραγωγής  συνεργάζεται  με  το  μοντέλο 

ενσωματώσεων  BGE-M3.  Επειδή  η  ανάκτηση  επιστρέφει  τμήματα  συχνά  δίγλωσσα  ή  με 

ανομοιογενή  μορφή,  το  μοντέλο  παραγωγής  πρέπει  να  τα  συνθέσει  σε  μια  καθαρή, 

μονόγλωσση  και  τεκμηριωμένη  απάντηση.  Στις  δοκιμές  μας  το  Llama  3.1  8B  τηρούσε  τη 

ζητούμενη μορφή σε πολύ μεγαλύτερο ποσοστό των απαντήσεων και εμφάνιζε τη μικρότερη 

ανάμειξη γλωσσών, όπως αποτυπώνεται στην Εικόνα 24. Το Qwen, παρά τη συγκρίσιμη γενική 

του ποιότητα, χρειαζόταν αυστηρότερη καθοδήγηση για να παραμείνει εντός μορφής, κάτι που 

σε ένα αυτοματοποιημένο σύστημα μεταφράζεται σε λιγότερο προβλέψιμη συμπεριφορά.