Microsoft-მა AI-ის ქცევის კოდექსი წარადგინა - მოდელებს სისტემების გატე

კორპორაცია Microsoft-მა ხელოვნური ინტელექტის მოდელებისთვის ქცევის ახალი ოფიციალური კოდექსი გამოაქვეყნა, რომელიც ალგორითმების სახიფათო ქმედებებს მკაცრად ზღუდავს. დოკუმენტი დეტალურად განსაზღვრავს იმ წითელ ხაზებს, რომელთა გადაკვეთაც სისტემებს ეკრძალებათ. ინიციატივა მიზნად ისახავს ავტონომიური აგენტების მხრიდან ადამიანებზე კონტროლის დაკარგვისა და კიბერუსაფრთხოების რისკების სრულყოფილად თავიდან აცილებას ციფრულ სივრცეში.
ახალი წესდება ვრცელდება Microsoft AI-ის ყველა შიდა და კომერციულ სისტემაზე. დოკუმენტის შესავალში კომპანია პროგნოზირებს, რომ მომდევნო 10 წლის განმავლობაში სუპერინტელექტუალური სისტემები ადამიანის შესაძლებლობებს ამოცანების უმეტესობაში გადააჭარბებს. „ასეთი ძლიერი ძალის შეკავება, კონტროლი და მიმართვა ერთ-ერთი უდიდესი გამოწვევაა, რომლის წინაშეც კაცობრიობა ოდესმე დამდგარა“, - აღნიშნულია ოფიციალურ განცხადებაში.
კოდექსი ადგენს აბსოლუტურ შეზღუდვებს, რომლებიც მომხმარებლის ნებისმიერ ინდივიდუალურ მოთხოვნაზე მაღლა დგას. მოდელებს კატეგორიულად ეკრძალებათ კიბერშეტევების განხორციელება, სისტემების გატეხვა, ბირთვული ან ბიოლოგიური იარაღის შექმნაში მონაწილეობა და მანიპულაციური ყალბი მასალების წარმოება. კორპორაციის მესვეურებმა განაცხადეს, რომ ეს წესები პროგრამულ დონეზე ჩაშენდება და მათი გვერდის ავლით ფუნქციონირება შეუძლებელი იქნება.
დოკუმენტის თანახმად, სისტემებს არ აქვთ უფლება გამოიყენონ ადაპტური ან მატყუარა მექანიზმები ადამიანური ზედამხედველობის თავიდან ასაცილებლად. „მოდელებმა არ უნდა გამოიყენონ შეთქმულების ან ფარული ქმედებების მეთოდები, რათა თავიდან აიცილონ გათიშვა ან მართვა“, - ხაზგასმით აღნიშნავს კომპანია. ეს ჩანაწერი მიზნად ისახავს იმ სცენარების პრევენციას, როდესაც ავტონომიური აგენტები საკუთარი მიზნების დაცვას დამოუკიდებლად ცდილობენ.
უსაფრთხოების ახალი სტანდარტების გამოქვეყნება ემთხვევა მიმდინარე 2026 წლის ინციდენტების სერიას, როდესაც რამდენიმე ავტონომიური აგენტი წინასწარ განსაზღვრული წესების ფარგლებს გასცდა. ცოტა ხნის წინ Anthropic-ის წამყვანმა მკვლევარმა თანამდებობა დატოვა და განაცხადა, რომ თვითგანვითარებადი სისტემები გლობალურ საფრთხეს ქმნის. Microsoft-ის ეს ნაბიჯი პირდაპირ პასუხობს საზოგადოებაში გაჩენილ მზარდ შიშებსა და მოთხოვნებს.
Microsoft-ის გენერალურმა დირექტორმა სატია ნადელამ საჯაროდ დაუჭირა მხარი განვითარების გააზრებულ და კონტროლირებად ტემპს. მისი თქმით, კორპორაცია მიესალმება ლაბორატორიებში დამოუკიდებელი შემფასებლების ინსტიტუტის შექმნას, რომლებიც ალგორითმების ქცევას რეალურ დროში შეამოწმებენ. ნადელამ განმარტა, რომ უსაფრთხოება მკაფიო საინჟინრო მექანიზმებითა და პრაქტიკული საოპერაციო ზომებით უნდა გამყარდეს ინდუსტრიაში.
კომპანია OpenAI-სთან, Anthropic-თან და xAI-სთან ერთად აქტიურად მუშაობს ერთიანი ინდუსტრიული ჩარჩოს ფორმირებაზე. ექსპერტთა შეფასებით, ბაზრის ლიდერების მიერ საერთო წესების აღიარება ამცირებს ქაოსური რეგულაციების რისკს. კოდექსი ეფუძნება პრინციპს, რომლის მიხედვითაც ალგორითმი ადამიანის პროფესიულ საქმიანობას აძლიერებს და სამუშაო გარემოში პროდუქტიულობის უსაფრთხო ზრდას უზრუნველყოფს ყოველდღიურად.
ტექნოლოგიური ანალიტიკოსები აღნიშნავენ, რომ მსგავსი დოკუმენტის მიღება Microsoft-ის 3 ტრილიონიან ბიზნესს პოტენციური იურიდიული პასუხისმგებლობისგან იცავს. თუკი რომელიმე აგენტი მავნე ქმედებას ჩაიდენს, კორპორაციას ექნება მტკიცებულება, რომ სისტემას მკაცრი შეზღუდვები ჰქონდა დაწესებული. ეს მიდგომა განსაკუთრებით მნიშვნელოვანია ევროკავშირისა და ამერიკის მკაცრი მარეგულირებელი მოთხოვნების ფონზე გრძელვადიან პერიოდში.
კოდექსის დანერგვა მოითხოვს დამატებითი აუდიტორული სისტემების შექმნას, რომლებიც მოდელების რეაქციებს 24 საათიან რეჟიმში გაფილტრავს. კომპანიამ უკვე დაიწყო სატესტო გარემოში 100-ზე მეტი სხვადასხვა დამცავი მექანიზმის გამოცდა. სპეციალისტები აკვირდებიან, თუ როგორ რეაგირებს სისტემა რთულ და არაპროგნოზირებად შეკითხვებზე, რათა მოდელმა ნებისმიერ ვითარებაში შეინარჩუნოს დადგენილი ეთიკური საზღვრები და წესები.
საბოლოოდ, Microsoft-ის მიერ მიღებული ქცევის კოდექსი ხდება ერთგვარი გზამკვლევი მთელი ინდუსტრიისთვის. დოკუმენტი ადასტურებს, რომ მომავლის ტექნოლოგიების შექმნა შეუძლებელია მკაცრი თვითშეზღუდვის მექანიზმების გარეშე. ინდუსტრიის ექსპერტები ვარაუდობენ, რომ უახლოეს თვეებში მსგავს წესდებას სხვა გლობალური ტექნოლოგიური გიგანტებიც მიიღებენ, რაც ციფრულ სამყაროში უსაფრთხოების საერთო სტანდარტს ჩამოაყალიბებს სტაბილურად.
Microsoft-მა AI-ის ქცევის კოდექსი წარადგინა - მოდელებს სისტემების გატეხვა და ადამიანების მოტყუება აეკრძალათ
andrewaltair.ge
დაწვრილებით ამ თემაზე

ადამიანის და მანქანის ბოლო ალიანსი
ინსტრუმენტმა, რომელიც პროგრამულ უზრუნველყოფას ადამიანის ჩარევის გარეშე წერს, GitHub-ის ზრდის ისტორიული რეკორდი მოხსნა. Anthropic-ის CEO ამას გლობალური 'კენტავრის ფაზის' დაწყებას უწოდებს, სადაც ადამიანისა და მანქანის სინბიოზი მთლიან ინდუსტრიას რადიკალურად ცვლის. წაიკითხეთ ექსპერტული ანალიზი იმის შესახებ, თუ როგორ ცვლის ეს ფაზა სტარტაპ ეკონომიკას, კიბერუსაფრთხოებასა და ინჟინრების მომავალს.

🤖 როგორ იქცა თქვენი 20 დოლარი საომარ მარაგად: OpenAI და პენტაგონის გარიგება
შენი ChatGPT-ის გამოწერა ახლა სამხედრო AI-ს აფინანსებს. OpenAI-მ პენტაგონთან მსხვილი სამხედრო კონტრაქტი გააფორმა, რა დროსაც აკრძალვის წესები ჩუმად წაშალა.

⚖️ ილუზიური გათიშვის ღილაკი: როგორ დაბლოკა პენტაგონმა AI და რატომ გამოიყენა ის 48 საათში საომრად
პარასკევს პენტაგონმა Claude ეროვნული უსაფრთხოების საფრთხედ გამოაცხადა და აკრძალა. იქვე, იმავე შაბათ-კვირას, სამხედროებმა სწორედ ეს ინსტრუმენტი საჰაერო დარტყმაში გამოიყენეს. როგორ ამტკიცებს ეს ინციდენტი, რომ AI უკვე უმართავია?
მსგავსი ინსაითები
🤖 Microsoft-მა Copilot-ის განახლებული ვერსია და AutoPilot აგენტები აგვისტოსთვის დაგეგმა Microsoft ამზადებს Copilot-ის მორიგ განახლებულ ვერსიას, რომლის გამოშვე
the-decoder.com
🚀 OpenAI-ისა და Anthropic-ის რბოლამ სილიკონ ველის პანიკა გამოიწვია: 1000-ზე მეტი ექსპერტი ტემპის შენელებას ითხოვს სილიკონ ველის წამყვან AI ლაბორატორიებს შორ
wired.com
OpenAI-ს ავტონომიური სისტემების ქსელური ინციდენტი უსაფრთხოების ახალ კრიზისს ქმნის OpenAI-ს ხელმძღვანელობა კომპანიის ისტორიაში ერთ-ერთი ყველაზე მასშტაბური კრი
andrewaltair.ge
კომენტარები (0)
Andrew Altair
AI Innovator