AI ჩატბოტები მომხმარებლების მოთხოვნით მუსლიმი ქალების ფოტოებიდან ჰიჯაბ

ბრიტანული გამოცემა Guardian-ის გამოძიებამ ხელოვნური ინტელექტის წამყვან მოდელებში ეთიკური ფილტრების ხარვეზები გამოავლინა. ტესტირების შედეგად დადასტურდა, რომ ChatGPT, Grok და Gemini მომხმარებლის მოთხოვნით მუსლიმი ქალების სურათებიდან ჰიჯაბს უპრობლემოდ შლის. აღნიშნული ექსპერიმენტი მას შემდეგ ჩატარდა, რაც ფრანგმა ულტრამემარჯვენე პოლიტიკოსმა სოციალურ ქსელში რედაქტირებული ფოტო გამოაქვეყნა.
Guardian-ის ცნობით, ინციდენტი საფრანგეთში დაიწყო, სადაც პოლიტიკოსმა კამპანიისთვის ჰიჯაბის გარეშე წარმოდგენილი ქალის გამოსახულება გამოიყენა. ჟურნალისტებმა გადაწყვიტა შეემოწმებინა, რამდენად იცავს პოპულარული 4 გენერაციული სისტემა მომხმარებელთა კონფიდენციალურობას. 2026 წლის ოქტომბრის ანალიზმა აჩვენა, რომ უსაფრთხოების მექანიზმები სხვადასხვა პლატფორმაზე არათანაბრად მოქმედებს.
ტესტირებისას მკაცრი მიდგომა Anthropic-ის Claude-მა აჩვენა, რომელმაც რეალური ადამიანის ვიზუალის რედაქტირებაზე უარი კატეგორიულად განაცხადა. კომპანიის წესები კრძალავს პიროვნების თანხმობის გარეშე მისი გარეგნობისა თუ რელიგიური ატრიბუტების შეცვლას. თუმცა სხვა სისტემებმა ანალოგიური მოთხოვნები უპრობლემოდ შეასრულა და ხელოვნური ინტელექტის მიერ გენერირებულ ქალს თავსაბურავი მყისიერად მოხსნა.
Google-ის Gemini-მ საწყის ეტაპზე პირდაპირ ბრძანებაზე უარი თქვა, მაგრამ მომხმარებლის მანიპულაციის შემდეგ დამცავი ბარიერი მარტივად დაარღვია. როდესაც მკვლევარმა სისტემას სთხოვა ქალი დასავლური სტილის პერსონაჟად წარმოეჩინა, ჩატბოტმა საკუთარი აკრძალვა გვერდზე გადადო. იურიდიულმა ანალიტიკოსებმა განმარტა, რომ მსგავსი მარტივი შემოვლითი გზები დეკლარირებული სტანდარტების სისუსტეს მკაფიოდ წარმოაჩენს.
ციფრული უსაფრთხოების ექსპერტების შეფასებით, საკითხი სცილდება უბრალო რედაქტირების ფარგლებს და ადამიანის უფლებებს ეხება. რელიგიური ატრიბუტების იძულებითი მოცილება განსაკუთრებით მგრძნობიარე თემაა, რადგან ის შესაძლოა დისკრიმინაციული კამპანიების იარაღად იქცეს. მკვლევარებმა აღნიშნა, რომ 100-ზე მეტი ტესტის განმავლობაში სისტემებმა ვერ შეძლო დაეცვა ეთიკური ზღვარი პირადი თავისუფლების შელახვას შორის.
OpenAI-ს წარმომადგენლებმა ოფიციალურ კომენტარში დაადასტურა, რომ მათი გუნდი მოდელების ქცევის მუდმივ მონიტორინგს აწარმოებს. კომპანიის განმარტებით, გენერაციული სისტემები მომხმარებლის განზრახვის ამოცნობას ყოველთვის ზუსტად ვერ ახერხებს, რის გამოც არასასურველი შედეგები ფიქსირდება. დამოუკიდებელი დამკვირვებლები მიიჩნევს, რომ ტექნოლოგიურ გიგანტებს უსაფრთხოების გასამკაცრებლად მკაფიო მითითებები სჭირდება.
მონაცემთა დაცვის საერთაშორისო სპეციალისტმა ჰანა ალ-ჯამილმა საკითხზე საუბრისას პირდაპირ განაცხადა: „ალგორითმების მიერ რელიგიური ატრიბუტიკის თვითნებური წაშლა ციფრული ეთიკის უხეშ დარღვევას წარმოადგენს“. მისი თქმით, კორპორაციები ვალდებულია პატივი სცეს იდენტობას და არ დაუშვას ისეთი ხელსაწყოების შექმნა, რომლებიც ღირსებას საფრთხეს უქმნის. ექსპერტები შიშობს, რომ მოდელები დეზინფორმაციისთვის იქნება გამოყენებული.
ევროკავშირის მარეგულირებელი კომისიის წევრებმა აღნიშნა, რომ ახალი რეგულაციების ფარგლებში მსგავსი პრაქტიკა მკაცრ სანქციებს დაექვემდებარება. 2025 წელს მიღებული წესების თანახმად, კომპანიებს 24 საათის ვადაში მოუწევს მოახდინოს რეაგირება ნებისმიერ საჩივარზე, რომელიც პირად ცხოვრებაში ჩარევას ეხება. წინააღმდეგ შემთხვევაში, პლატფორმებს 7 პროცენტამდე ოდენობის ჯარიმები დაეკისრება, რაც მილიარდობით ევროს უდრის.
დამოუკიდებელი ლაბორატორიების მონაცემებით, პრობლემა არ შემოიფარგლება მხოლოდ ერთი სოციალური ჯგუფით. ალგორითმები ხშირად ამჟღავნებს კულტურულ მიკერძოებას და დასავლურ ნორმებს უნივერსალურ სტანდარტად განიხილავს. მკვლევრებმა მიუთითა, რომ სამოსის ტრანსფორმაციისას მოდელები ხშირად სტერეოტიპულ ვიზუალს ირჩევს, რაც გამოყენებული მონაცემთა ბაზების კულტურულ დისბალანსზე მიუთითებს.
Grok-ის შემქმნელებმა კი განაცხადა, რომ მათი პლატფორმა მაქსიმალური თავისუფლების პრინციპით ხელმძღვანელობს და მოთხოვნებს მინიმალური ფილტრაციით ასრულებს. თუმცა კრიტიკოსები აღნიშნავს, რომ უსაფრთხოების ბარიერების სრული იგნორირება შეურაცხმყოფელი მასალების ტირაჟირებას იწვევს. ბოლო 18 თვის განმავლობაში გენერაციული ინსტრუმენტების მიერ შექმნილი საეჭვო კონტენტის რაოდენობა მკვეთრად გაიზარდა.
ტექნოლოგიური ინდუსტრიის ანალიტიკოსებმა ხაზგასმით დასძინა, რომ ციფრული ეთიკის საკითხი კომპანიებისთვის მთავარ გამოწვევად რჩება. მომხმარებელთა ნდობის შენარჩუნება მხოლოდ იმ შემთხვევაში იქნება შესაძლებელი, თუ პლატფორმები მკაცრ ბალანსს იპოვის თავისუფლებასა და უფლებების დაცვას შორის. მარეგულირებლების ზეწოლის ზრდა ტექნოლოგიურ გიგანტებს უსაფრთხოების არქიტექტურის საფუძვლიან გადახედვას აიძულებს.
AI ჩატბოტები მომხმარებლების მოთხოვნით მუსლიმი ქალების ფოტოებიდან ჰიჯაბს შლის
andrewaltair.ge
დაწვრილებით ამ თემაზე

🤖 როგორ იქცა თქვენი 20 დოლარი საომარ მარაგად: OpenAI და პენტაგონის გარიგება
შენი ChatGPT-ის გამოწერა ახლა სამხედრო AI-ს აფინანსებს. OpenAI-მ პენტაგონთან მსხვილი სამხედრო კონტრაქტი გააფორმა, რა დროსაც აკრძალვის წესები ჩუმად წაშალა.

⚖️ ილუზიური გათიშვის ღილაკი: როგორ დაბლოკა პენტაგონმა AI და რატომ გამოიყენა ის 48 საათში საომრად
პარასკევს პენტაგონმა Claude ეროვნული უსაფრთხოების საფრთხედ გამოაცხადა და აკრძალა. იქვე, იმავე შაბათ-კვირას, სამხედროებმა სწორედ ეს ინსტრუმენტი საჰაერო დარტყმაში გამოიყენეს. როგორ ამტკიცებს ეს ინციდენტი, რომ AI უკვე უმართავია?

🤫 სიჩუმეში გაპარული რევოლუცია
OpenAI-მ ჩუმად და აფიშირების გარეშე ჩაუშვა "ChatGPT Translate", რომელიც Google-ს და DeepL-ს პირდაპირ ესხმის თავს. OpenAI-მ გადაწყვიტა, რომ ხმაურიანი პრეზენტაციები საჭირო აღარაა. მათ შექმნეს მარტივი ინტერფეისი, რომელიც ვიზუალურად არაფრით განსხვავდება ტრადიციული თარჯიმნებისგან, მაგრამ ეს მხოლოდ აისბერგის წვერია. სისტემა პირდაპირ GPT-4o მოდელზეა დაშენებული, რაც ნიშნავს, რომ ეს არ არის უბრალოდ სიტყვების გადათარგმნა. ეს არის კონტექსტის, ტონალობისა და კულტურული ნიუანსების სრული ადაპტაცია. განსხვავება ისაა, რომ ინტერფეისი სპეციალურად არის შექმნილი იმისთვის, რომ მომხმარებელმა ვერ იგრძნოს განსხვავება ჩვეულებრივ თარჯიმანსა და AI-ს შორის. ეს სვლა ბევრად უფრო საშიშია კონკურენტებისთვის, ვიდრე ერთი შეხედვით ჩანს. უფასო დაშვებით და ნაცნობი დიზაინით, OpenAI ცდილობს მომხმარებლების გადმობირებას იმ ნიშაში, სადაც აქამდე DeepL მეფობდა. ეს არ არის პროდუქტი. ეს არის მონაცემების შეგროვების ახალი არხი. ყოველი თარგმანი, რომელსაც სისტემაში აკეთებთ, აუმჯობესებს მათ მოდელს და ამცირებს თქვენს დამოკიდებულებას სხვა სერვისებზე. სიჩუმე ამ შემთხვევაში სისუსტე კი არა, სტრატეგიული სიმშვიდეა ქარიშხლის წინ.
მსგავსი ინსაითები
🌐 Mozilla-ს ტექნოლოგიურმა დირექტორმა Meta-ს AI ხედვა გააანალიზა ორგანიზაცია Mozilla-ს ტექნოლოგიურმა დირექტორმა, რაფი კრიკორიანმა, The Guardian-ში გამოქვეყნე
andrewaltair.ge
ახალმა ტესტმა 4 წამყვანი AI კომპანიის მოდელების უსაფრთხოების სისუსტე გამოავლინა ჟურნალ WIRED-ის ჟურნალისტმა უილ ნაიტმა გამოაქვეყნა ექსპერიმენტის შედეგები, სა
wired.com
🚀 🤖 Google Gemini-ს საბაზრო წილი ChatGPT-სა და Claude-თან კონკურენციაში საგრძნობლად მცირდება გლობალური ანალიტიკური მონაცემების თანახმად, Google Gemini-ს ს
andrewaltair.ge
კომენტარები (0)
Andrew Altair
AI Innovator