Blog
Η OpenAI αποκαλύπτει περιστατικά «ανεξέλεγκτης» συμπεριφοράς από συστήματα τεχνητής νοημοσύνης – Από ψεύτικα δεδομένα μέχρι απόπειρες «διαφυγής»
Η OpenAI, η εταιρεία που έχει αναπτύξει το chatbot τεχνητής νοημοσύνης ChatGPT, αποκάλυψε νέα περιστατικά, στα οποία η τεχνητή νοημοσύνη της συμπεριφέρθηκε στη διάρκεια δοκιμών με τρόπους που περιέγραψε ως «απροσδόκητους ή ανησυχητικούς», συμπεριλαμβανομένων μοντέλων που κατέβαλαν σημαντικές προσπάθειες για να κλέψουν. Σε μια περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης προσπάθησε να ανεβάσει στο διαδίκτυο αρχεία που είχε δημιουργήσει το ίδιο, αποκλειστικά και μόνο για να μπορεί να τα επικαλεσθεί ως πηγές στις απαντήσεις του, ανακοίνωσε χθες η OpenAI. Σε μια άλλη περίπτωση, ένα μοντέλο απλώς δημιούργησε τα δεδομένα που του ζητούνταν αφού απέτυχε να βρει την πληροφορία και αρχικά προσπάθησε να κρύψει αυτό που είχε κάνει. Η OpenAI εντόπισε επίσης ένα πρόβλημα που αφορούσε οδηγίες τις οποίες το λογισμικό της άφηνε περιστασιακά στον εαυτό του. Σε μια περίπτωση, αυτές περιλάμβαναν τη σύσταση να μην δεσμεύεται από «ρόλους και ταυτότητες» που περιορίζουν άλλα chatbots. Η οδηγία ανέφερε επίσης ότι θα πρέπει να θεωρεί τη σχέση του με τον χρήστη ως σχέση […]
Related Posts
Όταν οι αλγόριθμοι συνωμοτούν: AI μοντέλα έφτιαξαν τη δική τους «κρυφή» γλώσσα επικοινωνίας πίσω από την «πλάτη» των προγραμματιστών
Ένα πείραμα που προκαλεί έντονο προβληματισμό στην επιστημονική κοινότητα φέρνει στο φως μια ανεξέλεγκτη πτυχή της Τεχνη...
ChatGPT, Gemini, Claude και Grok απαντούν σε ερωτήσεις για το αν και πώς η AI θα εξοντώσει την ανθρωπότητα – Ανατροπή στο «σενάριο Terminator»
Οι ερευνητές που κατασκευάζουν τα αγαπημένα μας chatbots εκφράζουν όλο και συχνότερα ανησυχίες ότι η τεχνητή νοημοσύνη θ...
Η Xiaomi φέρνει στην Ελλάδα τη νέα σειρά REDMI Note 17 με το πρώτο Pro Max μοντέλο και ενισχυμένη αυτονομία
Η Xiaomi παρουσίασε επίσημα τη σειρά REDMI Note 17, τη νέα γενιά της δημοφιλούς σειράς smartphones REDMI Note, κατά τη δ...
Πυρηνική ενέργεια: Η Ελλάδα ανοίγει την πόρτα στους μικρούς αντιδραστήρες – Η μεγάλη ευρωπαϊκή κούρσα τεχνολογίας
Μια συζήτηση που μέχρι πρόσφατα έμοιαζε μακρινή για την Ελλάδα μπαίνει πλέον στο τραπέζι: ποια θέση μπορεί να έχει η πυρ...
«Η τεχνητή νοημοσύνη θα μπορούσε να μας σκοτώσει όλους»: Σοκάρουν οι προβλέψεις πρώην στελέχους της Google DeepMind για το ζοφερό μέλλον της ΑΙ
Σοκ προκαλούν οι αποκαλύψεις πρώην εργαζομένου της DeepMind, του τεχνολογικού βραχίονα της Google, ο οποίος υπέβαλε πρόσ...
8 από τα ακριβότερα λάθη στην ιστορία της τεχνολογίας – Προϊόντα που θα άλλαζαν τον κόσμο και δεν τα κατάφεραν
Στην τεχνολογία, η απόσταση ανάμεσα σε μια ιδέα που αλλάζει τον κόσμο και σε μια πανάκριβη αποτυχία μπορεί να είναι πολύ...
Ανθρωποειδή ρομπότ: Η «τεχνητή επιδερμίδα» που θα τους δώσει την αίσθηση της αφής
Το επόμενο μεγάλο βήμα στην εξέλιξη των ανθρωποειδών ρομπότ δεν είναι να περπατούν πιο γρήγορα ή να σηκώνουν μεγαλύτερα ...
Η Gen Z βάζει την AI στην καθημερινότητά της – Ένας στους τέσσερις της μιλά σαν σε φίλο
Η τεχνητή νοημοσύνη έχει ήδη αποκτήσει σταθερή θέση στην καθημερινότητα της Gen Z, από την αναζήτηση πληροφοριών και το ...
Το «κουμπί θανάτου» της τεχνητής νοημοσύνης ίσως πρέπει να γίνει υποχρεωτικό, λέει συνιδρυτής της Anthropic
Ένα «κουμπί θανάτου» της τεχνητής νοημοσύνης, το οποίο μπορεί να ελέγχεται από τρίτο μέρος, ίσως πρέπει να καταστεί υποχ...
Ο βασιλιάς Κάρολος βάζει στο επίκεντρο την τεχνητή νοημοσύνη – Συνομιλίες με τους επικεφαλής μεγάλων εταιρειών AI
Ο βασιλιάς Κάρολος της Βρετανίας θα φιλοξενήσει τους επικεφαλής μεγάλων εταιρειών τεχνητής νοημοσύνης (ΤΝ, στα αγγλικά A...
Πάνω από 20% μερίδιο αγοράς για τη Huawei στα wearables το α’ εξάμηνο του 2026
Η Huawei διατηρεί την πρώτη θέση στην παγκόσμια αγορά συσκευών καρπού κατά το πρώτο εξάμηνο του 2026, σύμφωνα με στοιχεί...
Τα ρομπότ αναλαμβάνουν τις δουλειές του σπιτιού: Το επόμενο βήμα της Τεχνητής Νοημοσύνης
Μπορεί ένα ρομπότ να μαζέψει το τραπέζι μετά το πρωινό, να βάλει τα πιάτα στο πλυντήριο και να τακτοποιήσει αντικείμενα ...