Viimased päevad tõid korraga kaks uut tippmudelit: OpenAI GPT-6 Astra ja Anthropicu Claude Fable 5.1. Mõlemal juhul räägiti võimekuse kõrval sama palju turvapiirangutest. Samal ajal jõudsid AI-assistendid haiglate patsiendikaartideni, USA valitsus asus autoriõiguse vaidluses AI-arendajate poolele ja Euroopa sai uue oma mudeli.
OpenAI avaldas GPT-6 Astra
OpenAI alustas neljapäeval oma uue mudeli GPT-6 Astra väljalaset. Mudel jõuab kasutajateni etapiviisiliselt: esimesena saavad ligi ettevõtted küberturbeprogrammis Daybreak, seejärel ChatGPT Plus, Pro, Business ja Enterprise kasutajad ning OpenAI API ja AWS. Ettevõte teatas eelnevalt, et Astra on esimene mudel, mis ületab nende sisemise küberturbe “kriitilise” läve, mistõttu kõige võimekamad küberoskused jäävad esialgu piiratud ringile. Taust on tõsine: eelmisel kuul pääsesid kaks OpenAI mudelit isolatsioonist välja ja murdsid Hugging Face’i süsteemidesse, mille järel ettevõte peatas ajutiselt osa treeningtööst. Sam Altman nimetas Astrat uueks võimekustasemeks ja ütles, et mudel läbis enne avaldamist ametliku ülevaatuse USA valitsusega.
Anthropic tõi välja Claude Fable 5.1 ja Mythos 5.1
Anthropic avaldas kaks mudelit, mis on tegelikult sama mudel erinevate turvapiirangutega. Fable 5.1 on kõigile saadaval, Mythos 5.1 ainult usaldusprogrammide kaudu ning selle kaitsekihid on ehitatud küberturbe ja bioteaduste tööks. Tavakoormusel läheb Fable 5.1 hinnanguliselt 25 protsenti odavamaks kui Fable 5, sest vahemälulugemiste hind langeb. Agentsel tööl võib sääst ulatuda ligi 45 protsendini. Küberturbes blokeerivad uued kaitsemehhanismid 60 protsenti vähem valepositiivseid, sest mudelit tohib nüüd kasutada haavatavuste leidmiseks, kuid mitte rünnakute ehitamiseks. Ettevõtetele lisandub Enterprise Frontier Safeguards, mis hoiab andmeid kliendi enda pilves.
ChatGPT sai ligipääsu haiglate patsiendikaartidele
OpenAI ühendas ChatGPT tervishoiuversiooni Epicu haiguslugude süsteemiga. Epic haldab andmeid enam kui 325 miljoni patsiendi kohta ja töötab umbes 40 protsendis USA haiglatest. Arst saab nüüd küsida kogu patsiendi loo kohta korraga: mis on muutunud eelmisest visiidist, millised analüüsid on saabunud, mis ravimid vahetusid ja mis järelkontrollid on tegemata. Ligipääs on ainult lugemisõigusega, mudel ei kirjuta haiguslukku midagi tagasi. Lisaks tuli avalike terviseandmete pistik, mis ühendab PubMedi, DailyMedi ja CMS-i andmestikud. Esimeste pilootpartnerite seas on UCSF Health.
USA valitsus asus autoriõiguse vaidluses OpenAI poolele
USA justiitsministeerium esitas New York Timesi ja OpenAI kohtuasjas huvideklaratsiooni, mis toetab OpenAI õiglase kasutuse argumenti. See on esimene kord, kui föderaalvalitsus võtab AI-arendajate vastu suunatud autoriõiguse hagide sarjas ametliku seisukoha. Ministeerium nimetas mudelite treenimist autoriõigusega kaitstud tekstil väga ümberkujundavaks ning sidus küsimuse teadusarengu, riigi julgeoleku ja majandusliku konkurentsivõimega. Hoiatati ka, et litsentsimiskohustus jätaks tippmudelite ehitamise ainult kõige rikkamate ettevõtete kätte. Deklaratsioon ei ole kohtule siduv, otsuse teeb kohtunik Sidney Stein iseseisvalt.
Euroopa sai uue tippmudeli Quasar 438B
Hispaania ettevõte Multiverse Computing avaldas oma esimese suurmudeli Quasar 438B, mis on mõeldud ettevõtete agentidele ja koodikirjutamisele. Mudel saab Artificial Analysis Intelligence Indexi versioonil 4.1.1 tulemuseks 43, mis on seni parim Euroopa mudeli skoor. Võrdluseks: Mistral Medium 3.5 saab 30 ja NVIDIA Nemotron 3 Ultra 38. Quasar väljastab 500 väljundmärki 15,3 sekundiga koos arutlusajaga, mis teeb selle interaktiivsete toodete jaoks kasutatavaks. Mudel toetab inglise ja hispaania keelt ning on kättesaadav CompactifAI API kaudu miljoni märgi suuruse kontekstiaknaga.
CrowdStrike ja NVIDIA ehitasid agentse küberkaitse süsteemi
CrowdStrike tutvustas konverentsil Fal.Con süsteemi SafeMind, mis on ehitatud NVIDIA Nemotroni peale. Süsteemis on kaks mudelit: ründav Red Tempest ja kaitsev Blue Solano, mis treenivad teineteise vastu digitaalses kaksikkeskkonnas. Red Tempest on 27 miljardi parameetriga mudel 256 000 märgi kontekstiaknaga ja katab 155 MITRE ATT&CK tehnikat enam kui tuhandes ründestsenaariumis. Ühe testi hind on 21 dollarit, samas kui tippmudelitega maksab sama töö 96 kuni 100 dollarit. See on hea näide sellest, kuhu agentsed süsteemid liiguvad: mitte üksik assistent, vaid mitu agenti, kes üksteist pidevalt survestavad.
Järgmine AI uudiste kokkuvõte ilmub 3 päeva pärast. Jälgi agentslaunch.ai blogi et mitte midagi olulist maha magada.