Desk48 stories

AI.

Artificial intelligence, LLMs, and ML research

OpenAI უსაფრთხოება და წითელი გუნდის კონცეფციის ხელოვნება, რომელიც წარმოადგენს ავტომატიზირებულ გამძლეობის ტესტირებას დიდი ენის მოდელებისთვის.
AI

OpenAI პოზიციონირება GPT-Red, როგორც თვითგაუმჯობესებული გამძლეობის ფენა, აჩვენებს საზღვრის მოდელის ლაბორატორიებს, რომლებიც გადადიან ერთჯერადი შეფასებებიდან მუდმივად ადაპტირებულ უსაფრთხოების სისტემებზე, რომლებსაც შეუძლიათ გამოიკვლიონ, ისწავლონ და გააძლიერონ წარმოების მოდელები ოპერატიული სიჩქარით.

OpenAI ამბობს, რომ GPT-Red-ს შეუძლია გააუმჯობესოს საკუთარი თავდასხმის წარმატების მაჩვენებელი სამიზნე მოდელებზე, ხოლო ზედაპირზე წარუმატებლობის შაბლონები, რომლებიც ადამიანებს შეუძლიათ გამოიყენონ გამოსასწორებლად, რაც მიუთითებს უფრო ავტომატიზირებულ უსაფრთხოების საინჟინრო დასტაზე მომავალი მოდელების გაშვების გარშემო.

3 წთ წასაკითხადJul 17, 2026 · 05h
AI აგენტის ინტერფეისის ნამუშევარი, რომელიც წარმოადგენს Gemini-ის მუშაობის ავტომატიზირებას დესკტოპზე, ბრაუზერსა და მობილურ პროგრამებზე.
AI

Google-ის დასაკეცი კომპიუტერის გამოყენება პირდაპირ Gemini 3.5 Flash-ში მიუთითებს იმაზე, რომ ხელოვნური ინტელექტის აგენტების რასა შორდება იზოლირებულ დემო-ს და მიდის ერთ მთავარ მოდელზე, რომელსაც შეუძლია ნახოს ინტერფეისები, მსჯელობა გრძელვადიან ამოცანებში და რეალურად აწარმოოს პროგრამული უზრუნველყოფა საწარმოს სამუშაო პროცესებში.

Google-მა კომპიუტერი გამოიყენა ჩაშენებული ხელსაწყო Gemini 3.5 Flash-ში, ათავსებს მოდელს ბრაუზერის, მობილურის და დესკტოპის ავტომატიზაციისთვის და ამავდროულად დაამატებს საწარმოს გარანტიებს, როგორიცაა აშკარა დადასტურება და სწრაფი ინექციის გაჩერებები.

4 წთ წასაკითხადJul 16, 2026 · 17h
Anthropic-ის მძიმე კითხვების კამპანიის სარედაქციო გარეკანზე ნათქვამია, რომ სასაზღვრო ხელოვნური ინტელექტის ლაბორატორიები ახლა კონკურენციას უწევენ საზოგადოებრივ ლეგიტიმურობას და არა მხოლოდ მოდელის ძალას.
AI

Anthropic-ის რთული კითხვების კამპანია ამბობს, რომ სასაზღვრო ხელოვნური ინტელექტის ლაბორატორიები ახლა კონკურენციას უწევენ საზოგადოებრივ ლეგიტიმურობას და არა მხოლოდ მოდელის ძალას.

Anthropic-ის 9 ივლისს მოუწოდებს საზოგადოების ურთულესი კითხვების დასმას ხელოვნური ინტელექტის საკითხებთან დაკავშირებით, რადგან ის აქცევს ნდობის ჩამოყალიბებას პროდუქტისა და მმართველობის ზედაპირად, რაც მიანიშნებს იმაზე, რომ წამყვან ლაბორატორიებს სულ უფრო მეტად სჭირდებათ თავიანთი სამუშაოს საჯაროდ ჩვენება, ვიდრე უსაფრთხოებისა და სოციალური ზემოქმედების განხილვა, როგორც კერძო შიდა ნარატივები.

3 წთ წასაკითხადJul 12, 2026 · 05h