Andrew Altair
  • ბლოგი
  • ინსაითები
  • ფორუმი
  • პრომპტები
  • ბოტები
  • სერვისები
Andrew Altair

© 2026 Andrew Altair

aiNOW · AI სააგენტო

Insights

მოკლე ანალიტიკა და კომენტარები AI სამყაროდან

English →
All#ai#tech-industry#openai#anthropic#big-tech#ai-agents#elon-musk#google#startup#gpt#claude#Anthropic#OpenAI#meta#Meta
ChatGPT can now listen and talk at the same time, making AI conversations seem more human
the-decoder.com

🤖 OpenAI-მ ChatGPT-ისთვის ახალი თაობის ხმოვანი მოდელი GPT-Live წარადგინა

ხელოვნური ინტელექტის სფეროში მოღვაწე კომპანიამ OpenAI-მ ხმოვანი მოდელების ახალი თაობა GPT-Live წარადგინა, რომელიც ორმხრივი კომუნიკაციის არქიტექტურას ეფუძნება. ეს ტექნოლოგიური განახლება საშუალებას აძლევს ChatGPT-ს ერთდროულად მოისმინოს მომხმარებლის ნათქვამი და ისაუბროს, რაც საუბარს ბევრად უფრო ბუნებრივს ხდის. აქამდე მომხმარებლებს უწევდათ ლოდინი, სანამ პროგრამა პასუხს დაასრულებდა, რაც კომუნიკაციას აფერხებდა. ახალი მოდელი წამში რამდენჯერმე იღებს გადაწყვეტილებას იმის შესახებ, გააგრძელოს საუბარი, შეჩერდეს, მოუსმინოს მომხმარებელს, თუ ჩაერიოს დიალოგში. საუბრისას GPT-Live იყენებს ბუნებრივ ხმოვან რეაქციებს, როგორიცაა „გავიგე“ ან „ჰო“. მომხმარებელს შეუძლია ნებისმიერ დროს გააწყვეტინოს მოდელს საუბარი, სთხოვოს ტემპის შენელება ან დაფიქრება, რაც აქამდე შეუძლებელი იყო. Nvidia-მ ცოტა ხნის წინ მსგავსი ღია კოდის მქონე მოდელი PersonaPlex გამოუშვა. OpenAI-ს ინფორმაციით, ახალი ხმოვანი სისტემა გლობალურად ორ ვერსიად იწყებს გავრცელებას. პირველი ვერსია GPT-Live-1 განკუთვნილია ფასიანი მომხმარებლებისთვის, ხოლო მეორე ვერსია GPT-Live-1 mini ხელმისაწვდომი იქნება უფასო ანგარიშების მფლობელთათვის. ორივე მოდელი იმუშავებს iOS და Android მობილურ სისტემებზე, ასევე ვებგვერდზე. კომპანია უახლოეს მომავალში დეველოპერებისთვის სპეციალური აპლიკაციის პროგრამირების ინტერფეისის გახსნასაც გეგმავს. კომპანიის მონაცემებით, მომხმარებელთა გამოკითხვამ აჩვენა, რომ ადამიანები 75,7% შემთხვევაში უპირატესობას GPT-Live-1 ვერსიას ანიჭებენ, ხოლო 69,2% შემთხვევაში კი GPT-Live-1 mini მოდელს ირჩევენ ძველ ხმოვან სისტემასთან შედარებით. გარდა ამისა, საუბრის დროს ეკრანზე გამოჩნდება სპეციალური ვიზუალური ბარათები, რომლებიც მომხმარებელს მიაწვდის ინფორმაციას ამინდის, აქციების ფასებისა და სპორტული შედეგების შესახებ. მოდელის არქიტექტურა ორ ნაწილად არის გაყოფილი, რაც ხმოვან მართვასა და ლოგიკურ აზროვნებას ერთმანეთისგან მიჯნავს. როდესაც მომხმარებელი რთულ კითხვას სვამს, რომელიც ინტერნეტში ძიებას ან ანალიზს მოითხოვს, GPT-Live ამ დავალებას ფონურ რეჟიმში მომუშავე GPT-5.5 მოდელს გადასცემს. სანამ ფონური მოდელი მუშაობს, ხმოვანი სისტემა აგრძელებს საუბარს, რათა თავიდან აიცილოს უხერხული პაუზები და შეინარჩუნოს დიალოგის რიტმი. მომხმარებლებს შეუძლიათ აირჩიონ აზროვნების დონე, რომელიც მოიცავს სწრაფ, საშუალო და მაღალ რეჟიმებს. ამ არქიტექტურამ გადაჭრა ძველი ხმოვანი სისტემების მთავარი სირთულე, როდესაც მოდელები მხოლოდ საკუთარი შესაძლებლობებით ცდილობდა პასუხის გაცემას და ხშირად ცდებოდა. ახალი არქიტექტურა საშუალებას აძლევს ხმოვან ინტერფეისს მუდმივად იყოს დაკავშირებული წამყვან ტექნოლოგიურ მოდელებთან, რაც ზრდის პასუხების ხარისხს. ტექნოლოგიური ტესტირების შედეგები მნიშვნელოვნად გაუმჯობესდა. სამეცნიერო აზროვნების GPQA გამოცდაზე GPT-Live-1 მოდელმა მაღალ რეჟიმში 84,2%-იანი სიზუსტე აჩვენა, მაშინ როდესაც ძველმა ხმოვანმა რეჟიმმა მხოლოდ 45,3%-ის მიღწევა შეძლო. BrowseComp საძიებო ტესტში ახალმა სისტემამ 75,2% დააფიქსირა, ხოლო ძველმა ვერსიამ კი მხოლოდ 0,7% მიიღო, რაც თითქმის სრულ მარცხს ნიშნავდა. ხმოვანი ტელეკომუნიკაციის შიდა ტესტში tau3, ახალი მოდელი ბევრად უფრო სწრაფად ასრულებს რთულ მხარდაჭერის ამოცანებს, ვიდრე წინა თაობის სისტემები. მიუხედავად წარმატებისა, ტექნოლოგია გარკვეულ შეზღუდვებს შეიცავს. გამოშვების ეტაპზე GPT-Live არ უჭერს მხარს ვიდეოსა და ეკრანის გაზიარების ფუნქციებს, თუმცა OpenAI ამ შესაძლებლობების ეტაპობრივ დანერგვას მომდევნო თვეებში გეგმავს, რათა სერვისი უფრო ფუნქციური გახდეს. კვლევები აჩვენებს, რომ ხმოვანი მოდელების მომხმარებელი უფრო ხშირად ავლენს ემოციურ დამოკიდებულებას ხელოვნური ინტელექტის მიმართ. ამ რისკების შესამცირებლად კომპანიამ სპეციალური უსაფრთხოების მექანიზმები დანერგა, რომლებიც საუბრის პროცესშივე ამოწმებს ტექსტს. თვითდაზიანების თემების ხსენებისას სისტემა ავტომატურად სთავაზობს მომხმარებელს დახმარების ხაზებს და საჭიროების შემთხვევაში წყვეტს საუბარს. ახალგაზრდა მომხმარებლებისთვის მოდელი სპეციალურად არის გაწვრთნილი ასაკის შესაბამისად საუბრისთვის. მშობლებს ეძლევათ საშუალება გააკონტროლონ ბავშვების წვდომა და მიიღონ შეტყობინებები საშიში სიტუაციების დროს. OpenAI-ს წარმომადგენელმა დაადასტურა, რომ მოდელი არ ახდენს რეალური ადამიანების ხმის იმიტირებას. კომპანიამ განაცხადა: „უსაფრთხოების ზომების სრული დეტალები მოცემულია მოდელის სპეციალურ ბარათში“.

#OpenAI#GPT-Live#GPT-Live-1
ChatGPT can now listen and talk at the same time, making AI conversations seem more human
22 ივლ 20260

All insights loaded