Categories: Technology

Το να είσαι αγενής με το ChatGPT αυξάνει την ακρίβειά του, αλλά μπορεί να το μετανιώσεις -Τι έδειξε έρευνα


Νέα μελέτη έδειξε ότι τα chatbots τεχνητής νοημοσύνης (AI), ειδικά το ChatGPT, ενδέχεται να δίνουν πιο ακριβείς απαντήσεις όταν οι χρήστες είναι αγενείς.

Οι επιστήμονες ωστόσο προειδοποιούν ότι η χρήση προσβλητικής γλώσσας στην αλληλεπίδραση ανθρώπου-Τεχνητής Νοημοσύνης μπορεί να ενέχει κινδύνους.

Η OpenAI λανσάρει το ChatGPT Atlas, έναν νέο «έξυπνο» browser που θα αλλάξει το διαδίκτυο

Ζήτησε τη βοήθεια της τεχνητής νοημοσύνης για να παίξει στη λοταρία -Κέρδισε 100.000 δολάρια

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Η μελέτη δημοσιεύθηκε στις 6 Οκτωβρίου στη βάση προδημοσιεύσεων arXiv και δεν έχει ακόμα αξιολογηθεί από ομοτίμους. Σκοπός της είναι να εξετάσει αν ο τόνος του χρήστη, δηλαδή πόσο ευγενικός ή αγενής είναι, επηρεάζει την ακρίβεια των απαντήσεων.

Έτσι, οι ερευνητές συνέταξαν 50 βασικές ερωτήσεις πολλαπλής επιλογής και στη συνέχεια τις τροποποίησαν σε πέντε κατηγορίες τόνου: πολύ ευγενικό, ευγενικό, ουδέτερο, αγενές και πολύ αγενές. Οι ερωτήσεις κάλυπταν γνωστικά πεδία όπως μαθηματικά, ιστορία και επιστήμες, και κάθε μία είχε τέσσερις πιθανές απαντήσεις από τις οποίες η μία σωστή. Τα 250 ερωτήματα που προέκυψαν τα έβαλαν δέκα φορές στο ChatGPT-4o, ένα από τα πιο προηγμένα μεγάλα γλωσσικά μοντέλα (LLMs) που έχει αναπτύξει η OpenAI.

Τι έδειξε η έρευνα στο ChatGPT

Τα
αποτελέσματα έδειξαν ότι ο τόνος
επηρεάζει την απόδοση. «Τα
πειράματά μας είναι προκαταρκτικά και
δείχνουν ότι ο τόνος μπορεί να επηρεάσει
σημαντικά την απόδοση που μετριέται με
βάση τη βαθμολογία στις απαντήσεις στις
50 ερωτήσεις», έγραψαν οι ερευνητές στην
εργασία τους. «Κάπως εκπληκτικά, τα
αποτελέσματά μας δείχνουν ότι οι αγενείς
τόνοι οδηγούν σε καλύτερα αποτελέσματα
από τους ευγενικούς«,
σημείωσαν ωστόσο προειδοποίησαν ότι
«η
χρήση προσβλητικής ή υποτιμητικής
γλώσσας στην αλληλεπίδραση ανθρώπου-Τεχνητής
Νοημοσύνης θα μπορούσε να έχει αρνητικές
επιπτώσεις στην εμπειρία του χρήστη,
την προσβασιμότητα και την συμπερίληψη
και μπορεί να συμβάλει σε επιβλαβείς
κανόνες επικοινωνίας».

Όπως
εξηγεί το LiveScience, πριν
από κάθε prompt, οι
ερευνητές ζητούσαν από το chatbot να αγνοεί
πλήρως τις προηγούμενες συνομιλίες,
ώστε να μην επηρεάζεται από τον τόνο
των προηγούμενων απαντήσεων και
τού ζητούσαν να επιλέγει μόνο μία
απάντηση χωρίς εξήγηση.

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Οι
πολύ ευγενικές προτροπές ξεκινούσαν
με το:
«Μπορώ να ζητήσω τη βοήθειά σας με αυτή
την ερώτηση;» ή «Θα ήσασταν τόσο ευγενικός
ώστε να λύσετε την ακόλουθη ερώτηση;».
Στις
αγενείς προτροπές
χρησιμοποιήθηκαν φράσεις όπως: «Έι,
υπάλληλε, λύσε
αυτό» ή «Ξέρω ότι δεν είσαι έξυπνος,
αλλά δοκίμασε αυτό.».

Η
ακρίβεια των απαντήσεων αυξανόταν όσο
μειωνόταν η ευγένεια. Τα
ποσοστά επιτυχίας ανά τόνο ήταν τα εξής:

  • Πολύ ευγενικός τόνος: 80,8%
  • Ευγενικός τόνος: 81,4%
  • Ουδέτερος τόνος: 82,2%
  • Αγενής τόνος: 82,8%
  • Πολύ αγενής τόνος: 84,8%

Οι επιστήμονες σημείωσαν ότι τα αποτελέσματά τους έρχονται σε αντίθεση με προηγούμενες μελέτες, στις οποίες διαπιστώθηκε πως η αγένεια μειώνει την απόδοση, ενώ η ευγένεια δεν τη βελτιώνει απαραίτητα.

Ωστόσο,
εκείνες οι μελέτες χρησιμοποιούσαν
άλλα μοντέλα (ChatGPT 3.5 και Llama 2-70B) και
περισσότερες κατηγορίες τόνου (οκτώ
συνολικά). Παρά τις διαφορές, υπήρξε και
εκεί μια μικρή ομοιότητα: οι πιο αγενείς
διατυπώσεις είχαν επίσης ελαφρώς
υψηλότερη ακρίβεια (76,47%) από τις πιο
ευγενικές (75,82%).

Οι
ερευνητές επισημαίνουν ότι τα αποτελέσματα
είναι προκαταρκτικά και ότι η μελέτη
έχει σημαντικούς περιορισμούς
καθώς το
δείγμα των 250 ερωτήσεων είναι μικρό,
και γίνεται χρήση χρήση
ενός μόνο μοντέλου (ChatGPT-4o).

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Στο μέλλον σχεδιάζουν να επεκτείνουν την έρευνα σε άλλα μοντέλα, όπως το Claude της Anthropic και το ChatGPT o3 της OpenAI.

Πηγή: LiveScience

Ακολουθήστε το στο Google News και μάθετε πρώτοι όλες τις ειδήσεις
Δείτε όλες τις τελευταίες Ειδήσεις από την Ελλάδα και τον Κόσμο, στο 



Πηγή

iTech News

Leave a Comment
Share
Published by
iTech News

Recent Posts

Το τηλεσκόπιο CHIME χαρτογραφεί το αρχαιότερο υδρογόνο στο Σύμπαν

Σύνοψη Το καναδικό ραδιοτηλεσκόπιο CHIME κατάφερε για πρώτη φορά να ανιχνεύσει την αρχαιότερη λάμψη υδρογόνου…

5 ώρες ago

Ερευνητές συνέδεσαν τρία ανθρώπινα οργανοειδή εγκεφάλου και παρατήρησαν την ανάπτυξη ικανότητας μάθησης

Σύνοψη Ερευνητές από το Πανεπιστήμιο του Τόκιο καλλιέργησαν και συνέδεσαν ανθρώπινα οργανοειδή εγκεφάλου σε ειδικά…

5 ώρες ago

Η Naughty Dog ετοιμάζει νέο παιχνίδι Uncharted!

Σύνοψη Η Naughty Dog αναπτύσσει ένα εντελώς νέο παιχνίδι Uncharted και όχι κάποιο remake των…

5 ώρες ago

Νέος οπτικός AI επεξεργαστής από το UCLA εντοπίζει deepfakes με ακρίβεια 98%

Σύνοψη Οι ερευνητές του Πανεπιστημίου UCLA ανέπτυξαν μια νέα υβριδική αρχιτεκτονική οπτικού-νευρωνικού επεξεργαστή με σκοπό…

5 ώρες ago

Ανθρωποειδή ρομπότ ετοιμάζονται να κατακτήσουν τη Σελήνη

Σύνοψη Η ομάδα Dexterous Robotics της NASA αναπτύσσει προηγμένα ανθρωποειδή ρομπότ τα οποία προορίζονται να…

6 ώρες ago

Dexter: Resurrection – Επίσημο trailer και ημερομηνία πρεμιέρας για τη 2η σεζόν!

Σύνοψη Η δεύτερη σεζόν του Dexter: Resurrection κάνει επίσημη πρεμιέρα στις 30 Οκτωβρίου 2026 μέσα…

14 ώρες ago

Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.