ტექნოლოგია
/
27.02.2026
Anthropic ხელოვნური ინტელექტის უსაფრთხოების ძირითად ვალდებულებას უკან იხევს
ხელოვნური ინტელექტის უსაფრთხოების წინა პლანზე წამოწევით ცნობილი კომპანია Anthropic-ი უარს ამბობს თავის ძირითად ვალდებულებაზე, შეაჩეროს მძლავრი AI მოდელების განვითარება, თუ უსაფრთხოების ადეკვატური ზომები მზად არ იქნება. კომპანია ამ ნაბიჯს ხსნის იმით, რომ უაზროა იყოს ერთადერთი ფრთხილი მოთამაშე სწრაფად განვითარებად ინდუსტრიაში, სადაც ცალმხრივმა ვალდებულებებმა შეიძლება შეაფერხოს უსაფრთხოების კვლევები, თუ კონკურენტები წინ გაიჭრებიან რისკების ძლიერი შემარბილებლების გარეშე.
დღესდღეობით ხელოვნური ინტელექტის ინდუსტრიის განვითარების გათვალისწინებით, შემდეგი ამბავი ალბათ დიდ გაკვირვებას არ გამოიწვევს, თუმცა ის მაინც შემაშფოთებელია.
ახალ ბლოგ პოსტში Anthropic-მა, რომელიც, სავარაუდოდ, ერთადერთი მსხვილი AI მოთამაშე იყო, რომელიც ხაზს უსვამდა უსაფრთხოების პასუხისმგებლობებს, უარი თქვა თავის ძირითად ვალდებულებაზე, „შეაჩეროს“ უფრო მძლავრი AI მოდელების განვითარება, თუ უსაფრთხოების შესაბამისი ზომები მზად არ იქნება.
Anthropic-ის „პასუხისმგებლიანი მასშტაბირების პოლიტიკის“ (Responsible Scaling Policy - RSP) წინა ვერსიებში ორგანიზაცია აცხადებდა, რომ თუ მისი AI სისტემები მიუახლოვდებოდა გარკვეულ სახიფათო ზღვრებს – განსაკუთრებით კატასტროფული ბოროტად გამოყენების კუთხით – ის შეაჩერებდა შემდგომ მასშტაბირებას ან განთავსებას, სანამ უსაფრთხოების ადეკვატური ზომები არ იქნებოდა დანერგილი.
Anthropic-ის თავდაპირველი ვალდებულების ციტირებით, „ASL (AI Safety Levels) სისტემა არაპირდაპირ გვავალდებულებს დროებით შევაჩეროთ უფრო მძლავრი მოდელების წვრთნა, თუ ჩვენი AI-ის მასშტაბირება გადააჭარბებს აუცილებელი უსაფრთხოების პროცედურების დაცვის ჩვენს შესაძლებლობას.“
თუმცა, ეს ვალდებულება ახლა წაშლილია Anthropic-ის ახლად განახლებული RSP-დან. RSP-ის 3.0 ვერსიაში Anthropic-მა უარი თქვა განვითარების „შეჩერების“ ექსპლიციტურ მითითებებზე, უფრო რბილი ენის სასარგებლოდ, რომელიც ფოკუსირებულია „პასუხისმგებლიან განვითარებაზე“, „რისკების მართვაზე“ და „განმეორებით განთავსებაზე“.
სპეციფიკურ საფრთხის ზღვრებს გადაკვეთისას მოდელების შეჩერების ნაცვლად, კომპანია ახლა აცხადებს, რომ დანერგავს უსაფრთხოების ზომებს, გამოაქვეყნებს უსაფრთხოების შეფასებებს და გამოაქვეყნებს „საზღვრის უსაფრთხოების ჩარჩოს“ (Frontier Safety Framework) განახლებებს, რომლებიც განმარტავს, თუ როგორ ხდება რისკების მართვა.
მაშ, რატომ ხდება ეს? ნაწილობრივ, როგორც Anthropic-ი აცხადებს, იმიტომ, რომ უაზროა იყო ერთადერთი AI კომპანია, რომელიც ექსპლიციტურად არის ვალდებული უსაფრთხოების მიმართ. „თუ ერთი AI დეველოპერი შეაჩერებს განვითარებას უსაფრთხოების ზომების დასანერგად, მაშინ როცა სხვები წინ მიიწევენ AI სისტემების წვრთნასა და განთავსებაში ძლიერი შემარბილებელი ზომების გარეშე, ამან შეიძლება გამოიწვიოს ნაკლებად უსაფრთხო სამყარო – ყველაზე სუსტი დაცვის მქონე დეველოპერები დაადგენენ ტემპს, და პასუხისმგებლიანი დეველოპერები დაკარგავენ უსაფრთხოების კვლევების ჩატარებისა და საზოგადოებრივი სარგებლის წინსვლის შესაძლებლობას“, – ნათქვამია Anthropic-ის სრულ პოლიტიკურ დოკუმენტში.
„AI-ის სწრაფი განვითარების გათვალისწინებით, არ გვეგონა, რომ აზრი ჰქონდა ცალმხრივი ვალდებულებების აღებას... თუ კონკურენტები წინ მიიწევენ“, – განუცხადა Anthropic-ის მთავარმა მეცნიერმა ოფიცერმა ჯარედ კაპლანმა Time Magazine-ს.
Anthropic-ი გარდაუვლად წარმოადგენს თავის „პასუხისმგებლიანი მასშტაბირების პოლიტიკაში“ შეტანილ ცვლილებებს, როგორც უსაფრთხოებისთვის წმინდა დადებითს. მოკლედ, ის ამბობს, რომ ახალი პოლიტიკა ამატებს ვალდებულებას, შექმნას მუდმივი, საჯაროდ გასაზიარებელი საგზაო რუკები და რისკების ანგარიშები, რომლებიც მიზნად ისახავს აჩვენოს, თუ როგორ ფიქრობს Anthropic-ი უსაფრთხოების საკითხებზე და როგორ მართავს მათ, რადგან მოდელები უფრო შესაძლებლობების მქონე ხდებიან.
„ეს მესამე რევიზია აძლიერებს იმას, რაც მუშაობდა წინა RSP-ში, გვავალდებულებს მეტ გამჭვირვალობას ჩვენი გეგმებისა და რისკების გათვალისწინებით, და გამოყოფს ჩვენს რეკომენდაციებს ინდუსტრიისთვის მთლიანობაში იმისგან, რისი მიღწევაც შეგვიძლია როგორც ინდივიდუალურ კომპანიას“, – ნათქვამია ახალ პოლიტიკურ დოკუმენტში.
ეს კარგია, მაგრამ ის მაინც შორს დგას ძველი ვალდებულებისგან, არსებითად შეაჩეროს მუშაობა, თუ ბოტები კონტროლიდან გასვლას დაემუქრებოდნენ.
წყარო: www.pcgamer.com
გაზიარება