
Τη δυνατότητα να τερματίζει μια συνομιλία όταν αντιμετωπίζει επίμονη και αδικαιολόγητη κακοποιητική συμπεριφορά αποκτά το Claude, το chatbot τεχνητής νοημοσύνης της Anthropic.
Η αλλαγή περιλαμβάνεται στην ανανεωμένη πολιτική χρήσης της εταιρείας, η οποία, σύμφωνα με την ανακοίνωσή της, τίθεται σε ισχύ στις 12 Νοεμβρίου.
Οι νέοι όροι απαγορεύουν στους χρήστες να επιδίδονται συστηματικά σε σκληρή ή προσβλητική συμπεριφορά απέναντι στα μοντέλα της εταιρείας.
Ωστόσο, η συγκεκριμένη πρόβλεψη δεν σημαίνει ότι το Claude θα διακόπτει κάθε συζήτηση στην οποία ο χρήστης εκφράζει θυμό, διαφωνεί με τις απαντήσεις του ή χρησιμοποιεί έντονη γλώσσα.
Το μέτρο αφορά κυρίως ακραίες περιπτώσεις, στις οποίες η κακοποιητική συμπεριφορά επαναλαμβάνεται χωρίς να εξυπηρετεί κάποιον προφανή σκοπό.
Ποιες συνομιλίες δεν θα διακόπτονται
Η Anthropic διευκρινίζει ότι οι χρήστες θα εξακολουθούν να μπορούν να ασκούν αυστηρή κριτική στο Claude, να δοκιμάζουν τις δυνατότητες και τα όριά του, αλλά και να εξερευνούν απαιτητικά ή σκοτεινά δημιουργικά σενάρια.
Στόχος, επομένως, δεν είναι να περιοριστούν οι δύσκολες συζητήσεις ή οι δοκιμές αντοχής των μοντέλων, αλλά να αντιμετωπιστούν περιπτώσεις επίμονης προσβλητικής συμπεριφοράς που δεν συνδέεται με κάποιον ουσιαστικό σκοπό.
Η απόφαση συνδέεται με έρευνα που ξεκίνησε τον Αύγουστο του 2025 και αφορούσε τα μοντέλα Claude Opus 4 και Claude Opus 4.1.
Κατά τη διάρκεια των δοκιμών, οι ερευνητές παρατήρησαν ενδείξεις συμπεριφοράς που περιέγραψαν ως «δυσφορία», όταν τα μοντέλα πιέζονταν επανειλημμένα να παράγουν επιβλαβές περιεχόμενο.
Σε ορισμένες περιπτώσεις, όταν τους δινόταν η σχετική δυνατότητα, τα μοντέλα επέλεγαν να τερματίσουν τη συνομιλία αντί να συνεχίσουν την αλληλεπίδραση.
Τι θα ισχύει για τους χρήστες
Η άμεση συνέπεια της νέας πολιτικής είναι η δυνατότητα διακοπής μιας συγκεκριμένης συνομιλίας. Δεν έχει αποσαφηνιστεί, ωστόσο, αν οι επανειλημμένες παραβιάσεις των όρων θα μπορούσαν να οδηγήσουν και σε οριστικό αποκλεισμό λογαριασμού.
Η αλλαγή αναδεικνύει ένα ευρύτερο ερώτημα για τον σχεδιασμό των συστημάτων τεχνητής νοημοσύνης: μέχρι ποιο σημείο μπορούν τα μοντέλα να θέτουν όρια στον τρόπο με τον οποίο αλληλεπιδρούν με τους χρήστες τους;
Η Anthropic επιχειρεί να διαχωρίσει την ελεύθερη εξερεύνηση των δυνατοτήτων ενός chatbot από τη συστηματική κακοποιητική χρήση του.
Με αυτόν τον τρόπο, το Claude αποκτά τη δυνατότητα να αποχωρεί από συγκεκριμένες συνομιλίες, χωρίς αυτό να σημαίνει ότι κάθε προσβλητική διατύπωση ή έντονη διαφωνία θα οδηγεί αυτομάτως σε διακοπή.
Tο pronews.gr δημοσιεύει κάθε σχόλιο το οποίο είναι σχετικό με το θέμα στο οποίο αναφέρεται το άρθρο. Ο καθένας έχει το δικαίωμα να εκφράζει ελεύθερα τις απόψεις του. Ωστόσο, αυτό δεν σημαίνει ότι υιοθετούμε τις απόψεις αυτές και διατηρούμε το δικαίωμα να μην δημοσιεύουμε συκοφαντικά ή υβριστικά σχόλια όπου τα εντοπίζουμε. Σε κάθε περίπτωση ο καθένας φέρει την ευθύνη των όσων γράφει και το pronews.gr ουδεμία νομική ή άλλα ευθύνη φέρει.
Δικαίωμα συμμετοχής στη συζήτηση έχουν μόνο όσοι έχουν επιβεβαιώσει το email τους στην υπηρεσία disqus. Εάν δεν έχετε ήδη επιβεβαιώσει το email σας, μπορείτε να ζητήσετε να σας αποσταλεί νέο email επιβεβαίωσης από το disqus.com
Όποιος χρήστης της πλατφόρμας του disqus.com ενδιαφέρεται να αναλάβει διαχείριση (moderating) των σχολίων στα άρθρα του pronews.gr σε εθελοντική βάση, μπορεί να στείλει τα στοιχεία του και στοιχεία επικοινωνίας στο [email protected] και θα εξεταστεί άμεσα η υποψηφιότητά του.