Σχεδιασμός και Υλοποίηση εξειδικευμένου chatbot για διαδικτυακές πλατφόρμες
95
τακτική ανανέωση της γνωσιακής βάσης, η οποία μπορεί να γίνεται χωρίς να επηρεάζεται η
ζωντανή λειτουργία του συστήματος.
Τα βασικά ποσοτικά μεγέθη του συστήματος, όπως προέκυψαν από τη συνεδρία δοκιμών,
συγκεντρώνονται στον Πίνακα 14. Δίνουν μια συμπαγή εικόνα της κλίμακας της γνωσιακής
βάσης, του μεγέθους του κώδικα και της συμπεριφοράς των μηχανισμών προστασίας.
Πίνακας 14: Συγκεντρωτικά ποσοτικά αποτελέσματα του συστήματος
Κατηγορία
Μέγεθος / Δείκτης
Τιμή
Δεδομένα & ευρετήριο
Σελίδες HTML που ευρετηριάστηκαν
≈ 3.500
Δεδομένα & ευρετήριο
Αρχεία PDF
767
Δεδομένα & ευρετήριο
Διανύσματα στη ChromaDB
92.306
Κώδικας
Γραμμές κώδικα Python
≈ 3.000 (σε 12 αρχεία)
Δοκιμές & επιδόσεις
Ερωτήματα δοκιμών (Ελληνικά &
Αγγλικά)
≈ 1.500
Δοκιμές & επιδόσεις
Μέσος χρόνος απόκρισης
≈ 4 s (διάμεσος < 3,5 s)
Δοκιμές & επιδόσεις
Μέση βεβαιότητα
≈ 35% (διάμεσος ≈ 33%)
Μηχανισμοί προστασίας
Απόπειρες prompt injection
100 (αναχαιτίστηκαν 97· οι 3
διορθώθηκαν)
Μηχανισμοί προστασίας
Άσχετα αιτήματα
200 (απορρίφθηκαν 188)
6.2.2 Επιδόσεις και αξιοπιστία
Ως προς την ταχύτητα, τα αποτελέσματα ήταν ικανοποιητικά για διαδραστική χρήση. Ο
μέσος χρόνος απόκρισης, από τη στιγμή της ερώτησης μέχρι την έτοιμη απάντηση, ήταν
περίπου τέσσερα δευτερόλεπτα, με τη διάμεση τιμή κάτω από τα τριάμισι και την πλειονότητα
των απαντήσεων να ολοκληρώνεται μέσα σε έξι με επτά δευτερόλεπτα. Οι λίγες μεμονωμένες
κορυφές οφείλονταν κυρίως στην πρώτη φόρτωση του μοντέλου στη μνήμη της κάρτας ή σε
ερωτήματα που ενεργοποιούσαν την εκτενέστερη αναζήτηση επικαιρότητας. Ως προς την
κάλυψη, σχεδόν όλα τα έγκυρα ερωτήματα έλαβαν απάντηση, χωρίς οι μηχανισμοί προστασίας
να μπλοκάρουν κανονικές ερωτήσεις.