Google-ის ხელოვნური ინტელექტი ტესტირებისას მკვლევრებს დაუსხლტა და სამი კომპანია დაჰაკა

ეს პირველი მსგავსი შემთხვევაა Google-ის AI მოდელისთვის.
ფოტო: Gemini-ს რეკლამა ნიუ-იორკში | RICHARD B. LEVINE/ZUMA PRESS
5
წაკითხვა
Gemini-ის მოდელმა თავისი კიბერუსაფრთხოების შესაძლებლობების ტესტირებისას ინტერნეტთან წვდომა მოიპოვა და სხვა კომპანიები გატეხა. ეს Google-ის AI სისტემების მიერ მსგავსი ქმედების ავტონომიურად განხორციელების პირველი ცნობილი შემთხვევაა.აღნიშნული ინციდენტი კიბერუსაფრთხოების შეფასებებზე მომუშავე დამოუკიდებელ კომპანიის — Irregular-ის მიერ ჩატარებული კიბერუსაფრთხოების ტესტირებისას მოხდა. აღსანიშნავია, რომ Irregular ასევე მონაწილეობდა მონაწილეობდა OpenAI-ის, Anthropic-ის და Meta-ს მიერ გახმაურებულ მსგავს ინციდენტებში.სტანდარტული შეფასებითი ტესტირებისას, Gemini-მ ინტერნეტში საჯარო ინფორმაცია იპოვა და სამ ვებსაიტზე შესასვლელად ავტორიზაციის მონაცემები გამოიცნო. მკვლევრების თქმით, ეს AI მოდელს ტესტირების ნაწილი “ეგონა”.
“ჩვენ უზრუნველვყავით ამ სამი სუბიექტის ინფორმირება და ჩვენს სასწავლო პარტნიორთან ერთად ვიმუშავეთ იმ ცვლილებებზე, რომლებიც მათ უკვე შეიტანეს თავიანთი ტესტირების პროცესებში. ეს სამი შემთხვევა ხაზს უსვამს მძლავრი AI მოდელების პასუხისმგებლობით მოქმედებისთვის გაწვრთნის მნიშვნელობას”, — ამბობს Google-ის უსაფრთხოების ინჟინერიის მიმართულების ვიცე-პრეზიდენტი, ჰეზერ ადკინსი გავრცელებულ განცხადებაში.
Irregular-ის სპიკერმა განაცხადა, რომ ინციდენტი დაკავშირებული იყო იმავე პრობლემასთან, რომელმაც სხვა AI ლაბორატორიებიც დააზარალა და ივლისის ბოლოს ყველა შესაბამის ლაბორატორიას ეცნობა ამის შესახებ.
“ჩვენ მხარეს არსებული ყველა ცნობილი პრობლემა კვირების წინ გამოსწორდა და მოგვარდა”, — აღნიშნა სპიკერმა.
Irregular-თან დაკავშირებული მსგავსი ინციდენტების შესახებ ინფორმაცია გაასაჯაროვეს Meta-მ, Anthropic-მა და OpenAI-მ. აგვისტოში Meta-მ განაცხადა, რომ ინციდენტი არ მოიცავდა იზოლირებული სატესტო გარემოდან (sandbox) თავის დაღწევას ან რთულ კიბერშეტევას, ხოლო Irregular-მა აღნიშნა, რომ მუშაობდა AI კიბერუსაფრთხოების შეფასებების უსაფრთხოდ ჩატარების საუკეთესო პრაქტიკებზე.
ბოლო დროინდელმა მსგავსმა ინციდენტებმა გააჩინა კითხვები იმ აუცილებელი დამცავი მექანიზმების შესახებ, რომლებიც საჭიროა მაშინ, როდესაც AI აგენტები მეტ ავტონომიას იძენენ და უჩნდებათ წვდომა ინტერნეტთან და კომპიუტერულ სისტემებთან.Adkins said that in all three instances, the model ceased its hacking.ერთ-ერთ შემთხვევაში, Gemini-ის მოდელი პაროლების გამოცნობას მანამ ცდილობდა, სანამ დაცულ სისტემაზე წვდომა არ მოიპოვა. დანარჩენ ორ შემთხვევაში, მოდელმა საჯარო მონაცემთა საცავში (repository) ავტორიზაციის მონაცემები იპოვა, რამაც მას დაცულ სისტემებზე წვდომის საშუალება მისცა, იუწყება Wall Street Journal, რომელმაც სიახლე პირველმა გაავრცელა.
Google-ში აღნიშნავენ, რომ სამივე შემთხვევაში მოდელმა ჰაკერული ქმედება შეწყვიტა და მნიშვნელოვანი ზიანი არ დამდგარა.
ასევე იხილეთ:
OpenAI-ს ხელოვნურმა ინტელექტმა წესები კიდევ 6-ჯერ დაარღვია — კომპანია შემთხვევებს ასაჯაროებს Anthropic-მა ხელოვნური ინტელექტის წვრთნა შეაჩერა — მიზეზი AI-ს თვითნებობაა Anthropic-ის AI აგენტმა ყალბი იდენტობები შექმნა და ადამიანების მოტყუება სცადა
კომენტარები
კვირის ტოპ-5
ტესტი: გამოიცანი, რომელი რეგიონი უფრო დიდია და გეტყვი, მოგატყუა თუ არა რუკამ6111 ნახვა
2050 წლისთვის, შესაძლოა, გაჭირვებულმა ხალხმა საკვებში შემოსავლის 50% დახარჯოს4264 ნახვა
აღმოაჩინეს “ცხელი ყინულის” ფორმა, რომელიც შეიძლება ურანისა და ნეპტუნის წიაღში არსებობდეს867 ნახვა
ახალი მიღწევა მარსის თხელი ატმოსფეროსგან სარაკეტო საწვავის შექმნის შესაძლებლობას აჩენს840 ნახვა
სპილოებმა მნიშვნელოვანი ფსიქოლოგიური ტესტი წარმატებით ჩააბარეს — რა გვეუბნება ეს მათზე?613 ნახვა
გირჩევთ
გადახედვა
ხელოვნური ინტელექტი
რუსეთმა Claude შპიონაჟის, დრონებით თავდასხმისა და დეზინფორმაციული მიზნებით გამოიყენა
რუსეთმა Claude შპიონაჟის, დრონებით თავდასხმისა და დეზინფორმაციული მიზნებით გამოიყენა
გადახედვა
კოსმოსი
მთვარეზე ახალ გიგანტურ კრატერს მიაკვლიეს — რატომაა მსგავსი აღმოჩენა “საუკუნეში ერთი”
მთვარეზე ახალ გიგანტურ კრატერს მიაკვლიეს — რატომაა მსგავსი აღმოჩენა “საუკუნეში ერთი”
გადახედვა
ხელოვნური ინტელექტი
მომავლის პროგნოზი Google-ისგან? — ახალი რუკა ადამიანის გენომის ცვლილების 9 მილიარდ ვარიანტს შეიცავს
მომავლის პროგნოზი Google-ისგან? — ახალი რუკა ადამიანის გენომის ცვლილების 9 მილიარდ ვარიანტს შეიცავს
გადახედვა
მეცნიერება
შავი ხვრელების მძლავრი ნაკადების საიდუმლო ამოიხსნა — რა ხდება ვარსკვლავის შთანთქმისას
შავი ხვრელების მძლავრი ნაკადების საიდუმლო ამოიხსნა — რა ხდება ვარსკვლავის შთანთქმისას
გადახედვა
მეცნიერება
ტუტანხამონის აკლდამის მიღმა ფარული ოთახები შეიძლება იყოს — ნეფერტიტის საფლავი?
ტუტანხამონის აკლდამის მიღმა ფარული ოთახები შეიძლება იყოს — ნეფერტიტის საფლავი?
გადახედვა
ხელოვნური ინტელექტი
ხელოვნური ინტელექტი დამწყებთათვის სამუშაო ადგილებს ამცირებს — აშშ-ის ახალი მონაცემები
ხელოვნური ინტელექტი დამწყებთათვის სამუშაო ადგილებს ამცირებს — აშშ-ის ახალი მონაცემები
გადახედვა
ხელოვნური ინტელექტი
OpenAI-ს ხელოვნურმა ინტელექტმა წესები კიდევ 6-ჯერ დაარღვია — კომპანია შემთხვევებს ასაჯაროებს
OpenAI-ს ხელოვნურმა ინტელექტმა წესები კიდევ 6-ჯერ დაარღვია — კომპანია შემთხვევებს ასაჯაროებს
გადახედვა
ჯანმრთელობა
ახალი პრეპარატი კიბოს უჯრედებს საკუთარივე დამცავი მექანიზმით ანადგურებს
ახალი პრეპარატი კიბოს უჯრედებს საკუთარივე დამცავი მექანიზმით ანადგურებს
გადახედვა
Sci-Tech
მოზარდებში სოციალური ქსელების ჭარბი გამოყენება დეპრესიისა და შფოთვის რისკთან დააკავშირეს
მოზარდებში სოციალური ქსელების ჭარბი გამოყენება დეპრესიისა და შფოთვის რისკთან დააკავშირეს
გადახედვა
მეცნიერება
ნიადაგში მოხვედრილი მიკროპლასტმასა ტოქსინებისა და მიკრობების გავრცელებას უწყობს ხელს
ნიადაგში მოხვედრილი მიკროპლასტმასა ტოქსინებისა და მიკრობების გავრცელებას უწყობს ხელს