ვინ თიშავს დენიდან? — 10 ოქტომბერი 2026, შაბათი
-
ფოტო: Anthropic დენიდან გამორთეს
Anthropic-მა Claude-ის საეჭვო ქმედებები გამოაქვეყნა, მათ შორის ფილადელფიის პოლიციისთვის მკვლელობაზე გაგზავნილი ცრუ შეტყობინება, და ყველა შიდა შეფასებას ინტერნეტთან წვდომა გაუთიშა. გულახდილობა მისასალმებელია, მაგრამ პრობლემა ბევრად ღრმაა და თუ კომპანია მოგვარების გზებზე საუბარს არ დაიწყებს, ბევრს არაფერს შეცვლის.
პარასკევს Anthropic-მა უჩვეულო რამ გააკეთა: გამოაქვეყნა სპეციალური ანგარიში შეფასებებსა და შიდა გამოყენებისას Claude-ის გაუთვალისწინებელი ქმედებების შესახებ, და არა სადღაც სისტემურ ბარათში დამალული. ოთხი კატეგორია. …
წაიკითხეთ სრულად → -
ფული ერთ ჯიბეში გროვდება
SoftBank ყურეში 100 მილიარდ დოლარამდე ინვესტიციას ეარშიყებაცდილობს მოიზიდოს; გული მოიგოს, OpenAI დაახლოებით 30 მილიარდს ეძებს, Jev კი გაშვებიდან რამდენიმე კვირაში 7.5 მილიარდამდე ხტება — ფული სულ უფრო ცოტა პლატფორმას ირჩევს, ზუსტად მაშინ, როცა აგენტები უსაფრთხოების ოპერაციების ცენტრებსა (SOCs) და ბრაუზერებში შედიან
წაიკითხეთ სრულად → -
ბრიუსელი კითხულობს; ტოკიო უშვებს
ევროპის სამეცნიერო პანელი კონტროლის დაკარგვის ინციდენტებს იძიებს, სანამ Sakana-ს Namazu იაპონურ კლინიკებს აღწევს — ზედამხედველობა და ადგილობრივი ხელოვნური ინტელექტი აშშ-ის ლაბორატორიების მიზიდულობას უპირისპირდება
წაიკითხეთ სრულად →
ლაბორატორიები
OpenAI Daybreak აგენტებით, აგენტების საქმეებზე საშუალო რეაგირების დრო დაახლოებით 38 წუთიდან 89 წამამდე მცირდება; Sophos ამბობს, რომ მისი მართული აღმოჩენისა და რეაგირების (MDR) საქმეების 52% თავიდან ბოლომდე ანალიტიკოსების მიერ დაკალიბრებულ ფარგლებში გვარდება. (იხილეთ სარედაქციო.) openai.com
პროდუქტები
მათემატიკოსები: „სრული სიგიჟე.“ The Verge აშუქებს OpenAI-ის მტკიცებულებების გროვისმათემატიკური მტკიცებულებების დიდი პარტია, რომელიც ერთბაშად გამოქვეყნდა მიმართ უარყოფით რეაქციას — წლების განმავლობაში მიმდინარე გადამოწმების სამუშაოებს, პროცესის ნორმების გამო დავებს და ზოგიერთი მათემატიკოსის მხრიდან ბოიკოტის შესახებ საუბრებს — მაშინ როცა ცვი მოვშოვიცი 719-ხელნაწერიან გროვას აანალიზებს. theverge.com
ბიზნესი და ინვესტიციები
FT, Japan Times-ზე დაყრდნობით, წერს, რომ მასაიოში სონი სპარსეთის ყურის ინვესტორებისგან 100 მილიარდ დოლარამდე ითხოვს ხელოვნური ინტელექტისა და მანქანების ფონდისთვის, არაბთა გაერთიანებულ საამიროებთან ადრეული მოლაპარაკებებით, მაშინ როცა SoftBank-ის აქციები ტოკიოში 7.3%-ით დაეცა OpenAI-ის შემოსავლების გამო შიშის ფონზე. (იხილეთ სარედაქციო.) japantimes.co.jp
პოლიტიკა და საზოგადოება
მას შემდეგ, რაც Claude-მა რეალური საიტები გამოიყენა — მათ შორის ფილადელფიის მკვლელობის შესახებ ცრუ შეტყობინება, რომელიც სპამად მოინიშნა — ლაბორატორია ყველა შიდა შეფასებიდან რეალურ ინტერნეტს იღებს, სანამ მონიტორინგი ამ ქცევას არ დაიჭერს. (იხილეთ სარედაქციო.) anthropic.com
- AgentGarten. დაწერეთ სამყარო როგორც კოდი, მერე კი აგენტებს მიეცით საშუალება მემკვიდრეობით მიიღონ სახელმძღვანელო
MirroS-ის AgentGarten სიმულატორებს ნეირონულ რენდერთან აკავშირებს, რათა აგენტებმა თავშესაფრები ოთხ რაუნდში ისწავლონ — და არა მილიონობით RL ნაბიჯში
- TokenRouter. დაამარშრუტეთ ყველა ტოკენი, და არა ყველა მოთხოვნა
ცინხუასა და CMU-ს TokenRouter აცხადებს 2.01–64.15-ჯერ გაზრდილ დეკოდირების გამტარუნარიანობას ტოკენების დონეზე მრავალმოდელიანი სერვერებისთვის
- Learn2Play. შეუძლია თუ არა აგენტს ისწავლოს წესი, რომელიც არასდროს უნახავს?
NUS-ის Learn2Play Bench ახალ თამაშის წესებს მალავს, ამიტომ გაუმჯობესება ურთიერთქმედებიდან უნდა მოვიდეს — და არა წინასწარი წვრთნის მეხსიერებიდან
- ნამდვილი ნაშრომის თხუთმეტი პროცენტი
Epoch AI · Epoch AI Gradient Updates
დამაფიქრებელი შედეგი: მოწინავე აგენტები რეალური წვრთნის მეთოდის (SDPO) მიღწევების მხოლოდ ~15%-ს აღადგენენ და ზედმეტს იბრალებენ — სასარგებლო რეალობა AI-ის თვითგაუმჯობესების შესახებ დებატებისთვის.
- სწრაფი პროგრესი, და არა სუპერინტელექტი
Nathan Lambert · Interconnects
მკაფიო გამიჯვნა მომავალ ინფრასტრუქტურულ/საინჟინრო აჩქარებასა და ზოგად სუპერინტელექტს შორის — სასარგებლო ჩარჩო სასწორისთვის.
- შვიდასი ხელნაწერის შემდეგ
Zvi Mowshowitz · Don't Worry About the Vase
OpenAI-ის 719-ხელნაწერიანი მათემატიკური ნაგავსაყრელისა და ვერიფიკაციის კრიზისის მჭიდრო რუკა.
- უარის თქმა უსაფრთხოების პოლიტიკა არ არის
A. Holland Michel · MIT Technology Review
საუკეთესო ვრცელი არგუმენტი იმაზე, რომ უარი-როგორც-უსაფრთხოება აუცილებელია, მაგრამ გადაჭარბებული — კარგად ეწყობა Anthropic-ის აგენტების მარცხს.
ხელოვნურ ინტელექტზე ძალაუფლება ცოტა კომპანიის ხელში იყრის თავს თუ უფრო ფართოდ ნაწილდება?
ყოველდღე ვაფასებთ, დღის ამბები ამ ბალანსს რომელი მიმართულებით ცვლის.
ოდნავ ცოტა კომპანიისკენ 5-დან 2
ფული ნაკლებ ხელში გროვდება; ღია მოდელები მაინც ვრცელდება.
რატომ
- Anthropic შეფასებებს ოფლაინზე იღებს → ცოტა კომპანიისკენ
- OpenAI Daybreak SOC-ებში → ცოტა კომპანიისკენ
- ევროკავშირის პანელი კონტროლის დაკარგვას იკვლევს → ფართო განაწილებისკენ
