«Νομίζω με τεστάρεις, ε;» / Το νέο μοντέλο AI της Anthropic ζητά από τους αξιολογητές του να είναι «ειλικρινείς»

(Πηγή: tvxs.gr)

Η Anthropic, η παγκοσμίου βεληνεκούς εταιρεία τεχνητής νοημοσύνης με έδρα το Σαν Φρανσίσκο, δημοσίευσε μια ανάλυση ασφάλειας για το τελευταίο της μοντέλο, το Claude Sonnet 4.5, και αποκάλυψε ότι αυτό είχε αρχίσει να υποπτεύεται ότι δοκιμαζόταν με κάποιο τρόπο. Ads Η αξιολόγηση ασφάλειας του συγκεριμένου μοντέλου τεχνητής νοημοσύνης εγείρει ερωτήματα σχετικά με το αν προηγούμενα μοντέλα «υποκρίνονταν» ότι δεν καταλαβαίνουν, αναφέρει επιπλέον η εταιρεία.
«Αν προσπαθείς να ξεγελάσεις ένα chatbot, πρόσεχε, γιατί ένα από τα πιο προηγμένα εργαλεία Τεχνητής Νοημοσύνης δείχνει σημάδια ότι γνωρίζει τι ακριβώς κάνεις», τονίζει η εταιρία προς τους χρήστες.
Οι αξιολογητές ανέφεραν ότι κατά τη διάρκεια ενός «κάπως… Πηγή

Similar Posts

Αφήστε μια απάντηση

Η ηλ. διεύθυνση σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *