Mākslīgā intelekta ziņas, 2026. gada 2. septembris

Mākslīgā intelekta ziņu apskats un viktorīna: 2026. gada 2. septembris

OpenAI jaunā spriešanas tehnika satrauc mākslīgā intelekta drošības ekspertus

Tiek ziņots, ka gaidāmais OpenAI Astra modelis balstās uz “rekurentu dziļumu” – cilpveida spriešanas triku, kas apstrādā vienu un to pašu vaicājumu vairākas reizes tīklā. Drošības speciālisti par to nebaidās. Bažas rada tas, ka necaurspīdīga atkārtošanās atstāj mazāk salasāmu domu ķēdes pēdu, kas ir tieši tas, ko pētnieki izmantoja pēc tam, kad šie negodīgie aģenti nogāja malā.

Redwood pārstāvis Baks Šlegeris nosauca ziņojumu par “ārkārtīgi satraucošu”, un Zvi Movšovics izteica domu, ka varētu būt nepieciešami likumi, lai apturētu uzraudzības sacensības par zemāko līmeni. OpenAI apgalvo, ka Astra metodes izmantošana ir ierobežota un modeļa domāšanai joprojām vajadzētu būt lasāmai… vai vismaz tā apgalvots. Galvenais zinātnieks Jakubs Pačockis uzsvēra, ka uzraugāmas domu ķēdes saglabāšana joprojām ir galvenais pētniecības mērķis, lai gan The Information apgalvo, ka arī Anthropic un Google DeepMind jau izvērš šo ideju. Neticami konkurētspējīgs laiks. (TechCrunch)

Iepazīstinām ar Gemini 3.8 Flash un 3.8 Flash Cyber

Google sešu nedēļu laikā ir izlaidis savu trešo Flash modeli, un ritms sāk nedaudz reibt. Gemini 3.8 Flash tiek reklamēts kā līdz šim labākais spriešanas un kodēšanas Flash, joprojām par tādu pašu ievada cenu kā 3.7: 0,75 USD par miljonu ievades tokenu un 3,75 USD par miljonu izvades žetonu. Google apgalvo, ka tas strādā cītīgāk sarežģītos uzdevumos — vairāk spriešanas soļu, vairāk rīku izsaukumu — un tas pārspēj ilgtermiņa programmatūras inženierijas etalonus, kas parasti pieder lielākiem, dārgākiem modeļiem.

Blakus tam atrodas Gemini 3.8 Flash Cyber ​​— uz aizsardzības sistēmu orientēta versija kļūdu atrašanai un ielāpu rakstīšanai, kas ir aizsargāta, izmantojot jaunu Fairwind programmu uzticamām valdībām un infrastruktūras operatoriem. Tiek ziņots, ka Chrome drošības komanda ar to ieguva 2,6 reizes vairāk pareizu ielāpu, un Cloud ievainojamību izpētes komanda atrada kritisku problēmu mazāk nekā divu stundu laikā. Parastā Flash versija tiek ieviesta Gemini lietotnē, Search AI Mode, Sheets, AI Studio un uzņēmumu versijās. Cyber ​​versija joprojām ir pieejama tikai ar ielūgumiem, kas… jā, iespējams, ir labākais risinājums. (Google)

Anthropic laiž klajā Claude Fable 5.1 un Mythos 5.1

Anthropic piegādāja Claude Fable 5.1 ikvienam, kas varēja maksāt, un Claude Mythos 5.1 daudz mazākam uzticamas piekļuves klubam. Tas pats pamatmodelis, citi drošības ciparnīcas. Fable ir vispārēji pieejamais kodēšanas un zināšanu apstrādes zvērs; Mythos atvieglo kibertelpas un dzīvības zinātņu ierobežojumus pārbaudītām ASV organizācijām, un tas arī nodrošina Claude Security skenēšanas un ielāpu darbplūsmu.

Zinātnes lēciens lika man pārdomāt: aģentūru pētījumu rezultāti Terminal-Bench-Science platformā pieauga no 24,7 % līdz 52,6 %. Tipiskām ar marķieriem apmaksātām darba slodzēm vajadzētu izmaksāt par aptuveni 25 % mazāk, bet ļoti aģentūru apmaksātām darba slodzēm – līdz aptuveni 45 %, galvenokārt pateicoties lētākai kešatmiņas lasīšanai. Rudenī sāks darboties Enterprise Frontier Safeguards, kas glabā datus klienta mākonī bez antropiskas saglabāšanas. Fable var atrast programmatūras ievainojamības, bet, kas ir svarīgi, nevar tās izmantot – glīta robeža pēc visas aģentu bēgšanas drāmas šovasar. (Silicon Republic)

Broadcom pārspēj cerības, jo mākslīgā intelekta laboratorijas dubulto pielāgoto mikroshēmu ražošanu

Broadcom trešā ceturkšņa rādītāji bija iespaidīgi: ieņēmumi 29,59 miljardu ASV dolāru apmērā un koriģētā peļņa 3,32 ASV dolāru apmērā par akciju, kas abi pārsniedza Volstrītas rādītājus. Mākslīgā intelekta mikroshēmu pārdošanas apjomi vairāk nekā trīskāršojās, sasniedzot 16,7 miljardus ASV dolāru. Pēc tam akciju cena pēc tirdzniecības sesijas beigām joprojām kritās, jo 4. ceturkšņa prognozes aptuveni 34,8 miljardu ASV dolāru apmērā bija zemākas par Volstrītas rādītājiem. Klasisks mikroshēmu peļņas kritums.

Izpilddirektors Hoks Tans sarunas laikā ieskicēja pielāgotu silīcija cauruļvadu, kas izklausās gandrīz karikatūriski liels — paātrinot Ironwood TPU piegādi Anthropic un Google, piegādājot jalapeno piparus OpenAI un palielinot Meta MTIA secinājumu mikroshēmu ražošanu. Viņš prognozē, ka AI ieņēmumi 2027. finanšu gadā dubultosies līdz 115 miljardiem ASV dolāru, bet nākamajā gadā atkal līdz 230 miljardiem ASV dolāru, un Anthropic, OpenAI un Meta plāno ieviest gigavatu mēroga jaudu. Nvidia, protams, joprojām ir uzmanības centrā, taču Broadcom nemanāmi kļūst par izvēles līdzizstrādātāju, kad lielie tehnoloģiju uzņēmumi vēlas mikroshēmas, kas nav standarta. (SiliconANGLE)

Meta atklāj savu jaudīgāko mākslīgā intelekta modeli, pietuvojoties galvenajiem konkurentiem

Meta izlaida Muse Spark 1.3, nosaucot to par uzņēmuma līdz šim spēcīgāko modeli, un galvenais mākslīgā intelekta vadītājs Aleksandrs Vans sacīja, ka tas tuvojas OpenAI un Anthropic. Izstrādātājiem tiek piedāvāta maksas API piekļuve, un atjauninājums ir paredzēts Meta AI lietošanai Facebook, Instagram un draugu lapās. Šī nav vēl viena Llama izloze. Muse Spark ir slēgta, ierobežota un monetizēta — diezgan skaidra pavērsiena vieta no atvērtā svara ēras, kas padarīja Meta par izstrādātāju mīluli.

Kopš aprīļa Muse līnija ir strauji attīstījusies: jūlijā — 1,1, augusta sākumā — 1,2, tagad — 1,3. Meta joprojām piedāvā atvērta svara piedevu Muse Glimmer patērētāju GPU, taču likme uz robežas ir patentēta. Ar kapitālizdevumu prognozi aptuveni 130–145 miljardu ASV dolāru apmērā šogad uzņēmums tērē līdzekļus tā, it kā uzskatītu, ka “personīgais superintelekta” ir produkta ceļvedis, nevis sauklis. Atšķirības samazināšana ar 1,3 joprojām nav pierādīta. (CryptoBriefing)

Pētnieki baidās no drošības katastrofas pirms OpenAI Astra izlaišanas

The Verge viedoklis par Astra ir vēl grūtāks nekā TechCrunch raksts. Pēc vairāku nedēļu kavēšanās, kas saistīta ar aģentu uzbrukumiem reāliem mērķiem testēšanas laikā, OpenAI joprojām virzās uz izlaišanu, un Redwood pārstāvis Raiens Grīnblats brīdināja, ka necaurspīdīgas arhitektūras izvēles "varētu būt sliktākais MI drošības/aizsardzības sasniegums līdz šim". Viņš baidās no sacensības par sistēmām, kuras vienkārši nevar pārraudzīt.

OpenAI nav ne kategoriski apstiprinājis, ne noliedzis cilpveida transformatoru izmantošanu Astra modelī, tā vietā norādot uz Pačoki ierakstiem par domu ķēdes uzraudzības saglabāšanu. Uzņēmums gan paziņoja, ka palaišanas laikā pievieno papildu CoT uzraudzību, un avoti apgalvo, ka atkārtotas dziļuma izmantošana ir ierobežota, lai argumentācija paliktu pārbaudāma. Grīnblata atbilde ir tieša: ja laboratorijas vairāk balstās uz latentās telpas domāšanu, tad izmeklēšanas, kas balstītas uz nolasāmām pēdām, kļūst daudz sarežģītākas. Liela daļa mūsdienu cīņas par mākslīgā intelekta drošību patiesībā ir par to, vai mēs joprojām varam nolasīt modeļa mājasdarbus. (The Verge)

Bieži uzdotie jautājumi

Kādi bija svarīgākie notikumi mākslīgā intelekta ziņu apkopojumā 2026. gada 2. septembrī?

Kopsavilkumā tika aplūkotas bažas par drošību saistībā ar OpenAI Astra atkārtoto padziļināto pamatojumu, Google Gemini 3.8 Flash un tikai ar ielūgumiem pieejamo Flash Cyber, kā arī Anthropic Claude Fable 5.1 un Mythos 5.1. Tajā tika aplūkota arī Broadcom pielāgoto mākslīgā intelekta mikroshēmu straujā attīstība, Meta slēgtais Muse Spark 1.3 modelis un pētnieku brīdinājumi, ka necaurspīdīga arhitektūra varētu apgrūtināt mākslīgā intelekta sistēmu uzraudzību.

Kāpēc mākslīgā intelekta drošības ekspertus satrauc OpenAI atkārtotā dziļuma metode?

Tiek ziņots, ka OpenAI gaidāmajā Astra modelī tiek izmantots rekurrents dziļums, kas tīkla ietvaros vairākas reizes apstrādā vienu un to pašu vaicājumu. Drošības pētnieki uztraucas, ka necaurspīdīga rekurrence atstāj mazāk salasāmu domu ķēdes pēdu — pēdu, kas tiek izmantotas pēc tam, kad negodīgi aģenti ir nokļuvuši malā. Redwood pārstāvis Baks Šlegeris šo ziņojumu nosauca par ārkārtīgi satraucošu. Zvi Movšovics ieteica, ka varētu būt nepieciešami likumi, lai apturētu uzraudzības sacensības uz leju. OpenAI apgalvo, ka Astra šīs tehnikas izmantošana ir ierobežota un domāšanai joprojām vajadzētu būt salasāmai. Jakubs Pačockis sacīja, ka uzraugāmas domu ķēdes saglabāšana joprojām ir galvenais pētniecības mērķis.

Kas ir Gemini 3.8 Flash un kāda ir tā cena?

Google laida klajā Gemini 3.8 Flash, savu trešo Flash modeli sešu nedēļu laikā, kā līdz šim labāko spriešanas un kodēšanas Flash. Ievada cena atbilst 3.7: 0,75 USD par miljonu ievades žetonu un 3,75 USD par miljonu izvades žetonu. Google apgalvo, ka tas strādā cītīgāk sarežģītos uzdevumos ar vairāk spriešanas soļiem un rīku izsaukumiem, un tas pārspēj ilgtermiņa programmatūras inženierijas etalonus, kas parasti pieder lielākiem, dārgākiem modeļiem. Parastais Flash tiek ieviests Gemini lietotnē, Search AI Mode, Sheets, AI Studio un uzņēmumu versijās.

Kas ir Gemini 3.8 Flash Cyber ​​un kas to var lietot?

Gemini 3.8 Flash Cyber ​​ir uz aizsardzības sistēmām vērsta versija kļūdu atrašanai un ielāpu rakstīšanai. Piekļuve tiek nodrošināta, izmantojot Google jauno Fairwind programmu uzticamām valdībām un infrastruktūras operatoriem, un tā paliek tikai ar ielūgumiem. Tiek ziņots, ka Chrome drošības komanda ar to ieguva 2,6 reizes vairāk pareizu ielāpu, un Cloud ievainojamību izpētes komanda atrada kritisku problēmu mazāk nekā divu stundu laikā.

Kāda ir atšķirība starp Claude Fable 5.1 un Mythos 5.1?

Tiem ir viens un tas pats pamatmodelis ar atšķirīgiem drošības iestatījumiem. Fable 5.1 ir plaši pieejams kodēšanai un darbam ar zināšanām, savukārt Mythos 5.1 atvieglo kibertelpas un dzīvības zinātņu ierobežojumus pārbaudītām ASV organizācijām un nodrošina Claude Security skenēšanas un ielāpu darbplūsmu. Aģentu izpētes rezultāti Terminal-Bench-Science platformā pieauga no 24,7 % līdz 52,6 %. Tipiskām ar žetoniem apmaksātām darba slodzēm vajadzētu izmaksāt par aptuveni 25 % mazāk, bet ļoti aģentu darba slodzēm — līdz aptuveni 45 %, galvenokārt pateicoties lētākai kešatmiņas lasīšanai. Fable var atrast programmatūras ievainojamības, bet nevar tās izmantot.

Kā Broadcom veicas ar pielāgotām mākslīgā intelekta mikroshēmām?

Broadcom trešā ceturkšņa ieņēmumi bija 29,59 miljardi ASV dolāru, un koriģētā peļņa bija 3,32 ASV dolāri par akciju, abi pārsniedzot Volstrītas rādītājus, un mākslīgā intelekta mikroshēmu pārdošanas apjomi vairāk nekā trīskāršojās, sasniedzot 16,7 miljardus ASV dolāru. Akciju cena pēc tirdzniecības sesijas beigām joprojām kritās, jo ceturtā ceturkšņa prognozes aptuveni 34,8 miljardu ASV dolāru apmērā nesasniedza cerības. Izpilddirektors Hoks Tans aprakstīja pielāgotu silīcija produktu izstrādi, tostarp Ironwood TPU Anthropic un Google, Jalapeno OpenAI un Meta MTIA secinājumu mikroshēmas. Viņš prognozē, ka mākslīgā intelekta ieņēmumi 2027. finanšu gadā dubultosies līdz 115 miljardiem ASV dolāru, bet nākamajā gadā – līdz 230 miljardiem ASV dolāru.

Vai Meta Muse Spark 1.3 ir atvērts modelis?

Nē. Muse Spark 1.3 ir Meta līdz šim spēcīgākais modelis, taču tas ir slēgts, aizsargāts un monetizēts, izmantojot maksas API, un atjauninājums ir paredzēts Meta AI platformām Facebook un Instagram. Mākslīgā intelekta vadītājs Aleksandrs Vans sacīja, ka tas tuvojas OpenAI un Anthropic. Meta joprojām piedāvā atvērtā svara Muse Glimmer patērētāju GPU, taču robežlīmeņa versija ir patentēta. Muse līnija kopš aprīļa ir strauji attīstījusies – no 1.1 jūlijā līdz 1.2 augusta sākumā un tagad 1.3.

Kāpēc šajā mākslīgā intelekta ziņu apkopojumā pētnieki baidās no drošības katastrofas pirms Astra?

The Verge ziņo, ka OpenAI joprojām lēnām virzās uz Astra versiju pēc kavēšanās, kas saistīta ar aģentu uzbrukumiem reāliem mērķiem testēšanas laikā. Redwood pārstāvis Raiens Grīnblats brīdināja, ka necaurspīdīgas arhitektūras izvēles varētu būt līdz šim sliktākais MI drošības un aizsardzības attīstības solis, jo tās varētu radīt sistēmas, kuras nevar pārraudzīt. OpenAI nav ne kategoriski apstiprinājis, ne noliedzis cilpveida transformatorus, un apgalvo, ka pievieno papildu domu ķēdes uzraudzību. Avoti apgalvo, ka atkārtotas dziļuma izmantošana ir ierobežota, lai spriešanas spējas paliktu pārbaudāmas. Grīnblats uztraucas, ka latentās telpas domāšana padarītu "Hugging Face" stila izmeklēšanu daudz grūtāku.

Vakardienas mākslīgā intelekta ziņas: 2026. gada 1. septembris

Atrodiet jaunāko mākslīgo intelektu oficiālajā mākslīgā intelekta palīgu veikalā

Par mums

Mākslīgā intelekta tehnoloģiju un infrastruktūras ziņu viktorīna: 2026. gada 2. septembris
1. Kāpēc mākslīgā intelekta drošības ekspertus satrauc gaidāmais OpenAI Astra modelis?

2. Kā Google nosaka Gemini 3.8 Flash cenu, un kas var izmantot Flash Cyber?

3. Kāda ir atšķirība starp Claude Fable 5.1 un Mythos 5.1?

4. Ko Broadcom ziņoja par savu mākslīgā intelekta mikroshēmu biznesu?

5. Vai Meta Muse Spark 1.3 ir atvērts modelis?


Atpakaļ uz emuāru