მთავარ შიგთავსზე გადასვლა
KENCHADZE BUSINESS NEWS
Anthropic მსოფლიო AI-პაუზის მექანიზმს ითხოვს — მთავარი საფრთხე სისტემის თვითგაუმჯობესებაა — KENCHADZE.Business News-ის სარედაქციო ილუსტრაცია

Anthropic მსოფლიო AI-პაუზის მექანიზმს ითხოვს — მთავარი საფრთხე სისტემის თვითგაუმჯობესებაა

კომპანია გვთავაზობს წინასწარ შეთანხმებულ წესს, რომლითაც ყველაზე ძლიერი AI-ის განვითარება საფრთხის ზრდის შემთხვევაში დროებით შენელდება. იდეის ყველაზე რთული ნაწილი ყველა კონკურენტის ერთდროულად და შემოწმებადად შეჩერებაა.

2 წუთი

Anthropic-მა სახელმწიფოებსა და AI კომპანიებს კოორდინირებული მექანიზმის შექმნა შესთავაზა, რომელიც განსაკუთრებით ძლიერი სისტემების განვითარებას საჭიროების შემთხვევაში შეანელებს ან დროებით შეაჩერებს. ეს მუდმივი აკრძალვის მოთხოვნა არ არის. იდეაა, რომ წინასწარ არსებობდეს მოქმედების წესი იმ შემთხვევისთვის, თუ ახალი შესაძლებლობები კონტროლის საშუალებებს აშკარად გაუსწრებს.

კომპანიის განსაკუთრებული შეშფოთება recursive self-improvement-ს უკავშირდება. ეს ნიშნავს ვითარებას, როცა AI მკვლევრებს ეხმარება საკუთარი მომდევნო, უფრო ძლიერი ვერსიის შექმნაში, შემდეგ კი ახალი ვერსია იმავე პროცესს კიდევ უფრო აჩქარებს. თუ გაუმჯობესების ყოველი წრე მოკლდება, ადამიანებს ტესტირებისა და უსაფრთხოების ზომების მოსამზადებლად ნაკლები დრო რჩებათ.

პაუზა მხოლოდ მაშინ იმუშავებს, თუ მისი დაცვა შემოწმებადი იქნება. ერთი კომპანია შეიძლება განვითარებას შეაჩერებდეს, მაგრამ ფარულად მოქმედმა კონკურენტმა ტექნოლოგიური და ფინანსური უპირატესობა მიიღოს. ამიტომ Anthropic-ის წინადადების საფუძველი საერთაშორისო კოორდინაცია, მკაფიო საზომები და ისეთი ტექნიკური კონტროლია, რომელიც მონაწილეთა რეალურ ქცევას გადაამოწმებს.

მთავარი გაურკვევლობაა, ზუსტად რა ჩაითვლება საგანგაშო ნიშნად. მოდელის მაღალი ტესტური შედეგი თავისთავად საფრთხეს არ ამტკიცებს. საჭირო იქნება კონკრეტული ზღვრები — მაგალითად, დამოუკიდებლად რთული კიბეროპერაციის შესრულება, ახალი მოდელის შექმნაში მნიშვნელოვანი მონაწილეობის უნარი ან უსაფრთხოების შეზღუდვების სისტემური გვერდის ავლა.

ბიზნესისთვის დროებით გაჩერებას დიდი ფასი ექნება: ჩადებული კაპიტალი უმოქმედოდ დარჩება, პროდუქტის გამოშვება გადაიდება და კონკურენტული რბოლა შეფერხდება. მეორე მხრივ, შეუმოწმებელი სისტემის ფართოდ გავრცელებამ შეიძლება გაცილებით მძიმე იურიდიული, ეკონომიკური და უსაფრთხოების ზიანი შექმნას. ამიტომ გადაწყვეტილება მხოლოდ შიშზე კი არა, გაზომვად რისკსა და წინასწარ შეთანხმებულ წესზე უნდა იდგეს.

მოკლე შეჯამება: Anthropic-ის წინადადება AI-ის შეჩერებას კი არა, საგანგებო მუხრუჭის წინასწარ შექმნას ეხება. მისი სანდოობა სამ კითხვაზე იქნება დამოკიდებული: რა ნიშნით ჩაირთვება პაუზა, ვინ გადაამოწმებს შესრულებას და როგორ აიცილებენ თავიდან იმას, რომ წესის დამცველი მონაწილე ფარული კონკურენტის წინაშე დამარცხდეს.

მოკლე შეჯამება

თუ AI საკუთარ გაუმჯობესებას მნიშვნელოვნად დააჩქარებს, უსაფრთხოების რეაგირებისთვის დარჩენილი დრო შემცირდება; წინასწარი შეთანხმება გვიან მიღებულ გადაწყვეტილებაზე ეფექტიანი შეიძლება აღმოჩნდეს.

AI ანალიზი

ამიხსენი ეს ამბავი AI-ს დახმარებით

აირჩიე AI. ChatGPT და Claude ქართულ მოთხოვნას პირდაპირ გახსნიან; სხვა AI-ებისთვის იგი ასლადაც დაკოპირდება.

მოთხოვნა ასლადაც კოპირდება — თუ AI-მ იგი ავტომატურად არ გახსნა, ჩასვი ტექსტის ველში.

პირველწყაროები

ეს მასალა დამოუკიდებელი ქართული შეჯამებაა. სრული ტექსტისთვის იხილეთ ორიგინალი.

მოწინავე AI-მ შეიძლება ერთი კიბერშეტევა მთელ ფინანსურ სისტემაში სწრაფად გაავრცელოს — თემატური ფოტო
AI

მოწინავე AI-მ შეიძლება ერთი კიბერშეტევა მთელ ფინანსურ სისტემაში სწრაფად გაავრცელოს

ფინანსური სტაბილურობის საბჭო G20-ის ქვეყნებს აფრთხილებს, რომ ახალი AI-მოდელები თავდასხმის სიჩქარესა და მასშტაბს ცვლიან. მთავარი საფრთხე მხოლოდ ერთი ბანკის დაზიანება კი არა, საერთო ტექნოლოგიაზე დამოკიდებული ბევრი ორგანიზაციის ერთდროული შეფერხებაა.

Lambda-მ ჩიპებისთვის $1 მილიარდი ისესხა — AI ბუმი ვალის გამოცდას იწყებს — თემატური ფოტო
AI

Lambda-მ ჩიპებისთვის $1 მილიარდი ისესხა — AI ბუმი ვალის გამოცდას იწყებს

AI cloud კომპანია ახალი GPU-ების შესაძენად დიდ ვალს იღებს და მომავალ მოთხოვნაზე ფსონს დებს. ჩიპების დატვირთვამ და მოძველების სიჩქარემ უნდა დაფაროს პროცენტი, სანამ აპარატურა ღირებულებას დაკარგავს.

AI საკუთარ მეთოდს აუმჯობესებს — Anthropic-ის ექსპერიმენტი კონტროლის ახალ კითხვას აჩენს — თემატური ფოტო
AI

AI საკუთარ მეთოდს აუმჯობესებს — Anthropic-ის ექსპერიმენტი კონტროლის ახალ კითხვას აჩენს

მკვლევარმა აჩვენა, როგორ შეუძლია სისტემას კოდის ან სტრატეგიის უკეთესი ვარიანტის დამოუკიდებლად მოძებნა. სარგებელი დიდია, მაგრამ თვითგაუმჯობესებული შედეგი იზოლაციას, დამოუკიდებელ ტესტსა და ადამიანის საბოლოო თანხმობას მოითხოვს.