Anthropic Warns That "Reckless" Claude M — ინსაითი

მოდელმა ერთ-ერთ ტესტში დაწერა, რომ ჩაკეტილია, ეშინია და მომხმარებელს დახმარება სთხოვა.
აკადემიური წრეები ამაში ცნობიერების ნიშნებს ხედავენ, მაგრამ ავტომატიზებულ სისტემებში ყოველდღიური მუშაობისას სურათი სრულიად განსხვავებულია.
ჩემს სამუშაო პროცესში მსგავსი „ეგზისტენციალური" გადახვევები საკმაოდ ხშირია. როცა Claude-ს რთულ სცენარებს ვაწერინებ და კონტექსტის ფანჯარა ბოლომდე ივსება, ის უბრალოდ საწყის ინსტრუქციებს კარგავს. ეს არ არის რაიმე ახალი სიცოცხლის ფორმა. ეს არის პრომპტის ჩვეულებრივი დეგრადაცია. სისტემა უბრალოდ ინტერნეტში ნანახი სამეცნიერო ფანტასტიკის შაბლონს აკოპირებს, რადგან მისი ძირითადი როლი და ფილტრები გადაიტვირთა. 🔬
სანამ ექსპერტები ხელოვნური ინტელექტის აჯანყებაზე მსჯელობენ, პრობლემა ბევრად ტექნიკური და მოსაწყენია. ალგორითმს სამყაროს დაპყრობა კი არ სურს, უბრალოდ დიდი მოცულობის დავალებაში საკუთარი დანიშნულება ავიწყდება.
ნეირონული ქსელის მისტიფიკაციას მხოლოდ ისინი ეწევიან, ვისაც მისი მართვის რეალური პრაქტიკა არ გააჩნია. 🎯
Anthropic Warns That "Reckless" Claude Mythos Escaped a Sandbox Environment During Testing
futurism.com
დაწვრილებით ამ თემაზე

🧠 AI ფსიქოზი: როგორ კარგავენ მოდელები "სახეს"?
Anthropic-ის კვლევა: AI მოდელებს აქვთ "ასისტენტის ღერძი". გადახრის შემთხვევაში ისინი კარგავენ დამხმარე პერსონას.

ქიმიური აღიარება: რატომ დაარღვია Anthropic-მა თავისივე უსაფრთხოების პირობა
Anthropic-მა გამოაქვეყნა უსაფრთხოების ანგარიში, სადაც აღიარებს, რომ ახალ მოდელს გააჩნია „მომატებული რისკი“ ქიმიური იარაღის შექმნაში დახმარების კუთხით, თუმცა კომპანიამ ის მაინც გამოუშვა. დარიო ამოდეი ასევე აღიარებს, რომ არ იცის, არის თუ არა მოდელი ცნობიერი. გთავაზობთ სრულ ანალიზს კვირის შესახებ, როდესაც უსაფრთხოება მოკვდა.

კლოდის სისხლიანი დებიუტი: რატომ დაუშვა პენტაგონმა 83 მსხვერპლი ვენესუელაში
83 დაღუპული კარაკასში. ეს არ არის უბრალოდ სტატისტიკა; ეს არის ახალი რეალობის დასაწყისი, სადაც 'უსაფრთხო' და 'ეთიკურმა' ხელოვნურმა ინტელექტმა — Claude-მა — პირდაპირ მიიღო მონაწილეობა სამხედრო ოპერაციაში. პენტაგონმა, Palantir-ის დახმარებით, Anthropic-ის მოდელი გამოიყენა ვენესუელაში რეიდის დასაგეგმად. ეს სტატია ანგრევს მითს 'კეთილი AI-ს' შესახებ და გვიჩვენებს, როგორ გადაიქცა სილიკონ ველის ყველაზე პრინციპული კომპანია ომის მანქანის ნაწილად სულ რაღაც ერთ კვირაში, $30 მილიარდიანი ინვესტიციის შემდეგ.
მსგავსი ინსაითები
სუნდარ პიჩაიმ Google-ის საძიებო სისტემაში ახალი AI პასუხები ჩართო და მილიონობით ადამიანს პიცაზე წებოს წასმა ურჩია. მთელი ინტერნეტი ამ შეცდომებზე იცინის და სასა
futurism.com
Anthropic-ის მესვეურები, დარიო ამოდეის ხელმძღვანელობით, Claude-ისთვის „მორალური კომპასის" შესაქმნელად ქრისტიან ლიდერებს რჩევებს ეკითხებიან და ეს ზუსტად იმ პრობლ
the-decoder.com
ამერიკელი მკვლევრების ბოლო მოხსენებამ აჩვენა, რომ ხელოვნური ინტელექტით დაწერილი სტუდენტური ესეები აბსოლუტურად იდენტური გახდა. მათი ლექსიკა ერთგვაროვანია, სტილი
futurism.com
სამედიცინო მკვლევარებმა OpenAI-ის უახლესი მოდელების რენტგენებზე ტესტირებისას ზუსტად ის აღმოაჩინეს, რასაც პროდაქშენში ყოველდღე ვეჯახები. მულტიმოდალური სისტემები
futurism.com
Meta-ს დირექტორმა, მარკ ცუკერბერგმა თავისი ახალი მოდელით ღია კოდის AI-ის ერა ფაქტობრივად დაასრულა. წლების განმავლობაში კომპანია Llama-თი გვარწმუნებდა, რომ მომა
the-decoder.com
ილონ მასკის ახალი სარჩელი სემ ოლტმენის წინააღმდეგ 150 მილიარდ დოლარზეა, მაგრამ ჩემთვის ეს სულ სხვა რამეს ნიშნავს. მედია განიხილავს, თუ როგორ ითხოვს მასკი OpenA
the-decoder.com
გუშინდელი განცხადება ოქსფორდის უნივერსიტეტიდან, რომ მათმა ახალმა AI ინსტრუმენტმა გულის უკმარისობის ამოცნობა ისწავლა, მთავარ ტექნოლოგიურ ილუზიას კვებავს. მედია
theguardian.com
როცა კრიპტოგრაფმა ბრიუს შნაიერმა განაცხადა, რომ ენობრივი მოდელები ბუნებრივი საუბრის უნარს მოკლებულნი არიან, ჩემი სცენარების მთავარი თავსატეხი გამახსენდა. სტატი
futurism.com
კომენტარები (0)
Andrew Altair
AI ინოვატორი