MI Hírek 2026. szeptember 2

AI Hírösszefoglaló és Kvíz: 2026. szeptember 2

Az OpenAI új érvelési technikája riasztja a mesterséges intelligencia biztonsági szakértőit

Az OpenAI hamarosan megjelenő Astra modellje állítólag az „ismétlődő mélységre” támaszkodik, egy ciklusszerű érvelési trükkre, amely ugyanazt a lekérdezést többször is feldolgozza a hálózaton belül. A biztonsági szakemberek nem higgadtak emiatt. Az aggodalom az, hogy az átlátszatlan ismétlődés kevesebb olvasható gondolatláncot hagy maga után, ami pontosan az a nyom, amelyet a kutatók használtak, miután ezek a gazember ügynökök félreálltak.

A Redwood munkatársa, Buck Shlegeris „rendkívül aggasztónak” nevezte a jelentést, Zvi Mowshowitz pedig felvetette, hogy törvényekre lehet szükség a monitorozási verseny leállításához. Az OpenAI szerint az Astra korlátozottan használja a technikát, és a modell gondolkodásának továbbra is olvashatónak kell lennie... vagy legalábbis ezt állítja a cég. Jakub Pachocki vezető tudós hangsúlyozta, hogy a monitorozható gondolatlánc megőrzése továbbra is alapvető kutatási cél, miközben a The Information szerint az Anthropic és a Google DeepMind is már foglalkoznak az ötlettel. Hihetetlenül versenyképes időzítés. (TechCrunch)

Bemutatkozik a Gemini 3.8 Flash és a 3.8 Flash Cyber

A Google hat hét alatt kiadta harmadik Flash modelljét, és a tempó kezd kissé felpörögni. A Gemini 3.8 Flash-t a legjobb logikai és kódolási Flashként reklámozzák, továbbra is ugyanazon a bevezető áron, mint a 3.7: 0,75 dollár millió bemeneti tokenenként és 3,75 dollár millió kimeneti tokenenként. A Google azt állítja, hogy keményebben dolgozik a nehéz feladatokon – több logikai lépés, több eszközhívás –, és túlszárnyalja a hosszú távú szoftverfejlesztési benchmarkokat, amelyek általában a nagyobb, drágább modellekhez tartoznak.

Mellette található a Gemini 3.8 Flash Cyber, egy védekezésre fókuszált változat, amely hibák keresésére és javítások írására szolgál, és egy új Fairwind Programon keresztül tesztelték megbízható kormányok és infrastruktúra-üzemeltetők számára. A Chrome biztonsági csapata állítólag 2,6-szor több helyes javítást kapott vele, és a Cloud sebezhetőségkutató csapata két óra alatt talált egy kritikus hibát. A hagyományos Flash a Gemini alkalmazásban, a Search AI Mode-ban, a Sheetsben, az AI Studio-ban és a vállalati verziókban is elérhető. A Cyber ​​továbbra is csak meghívásos alapon érhető el, ami… igen, valószínűleg a legjobb megoldás. (Google)

Az Anthropic piacra dobja a Claude Fable 5.1-et és a Mythos 5.1-et

Az Anthropic a Claude Fable 5.1-et szállította mindenkinek, aki megengedhette magának, és a Claude Mythos 5.1-et egy sokkal kisebb, megbízható hozzáférésű klub számára. Ugyanaz az alapmodell, eltérő biztonsági tárcsákkal. A Fable a széles körben elérhető kódoló és tudásalapú szörnyeteg; a Mythos lazítja a kiber- és élettudományi korlátokat az ellenőrzött amerikai szervezetek számára, és a Claude Security szkennelési és javítási munkafolyamatát is működteti.

A tudományos ugrás az, ami megdöbbentett: az ágensalapú kutatási pontszámok 24,7%-ról 52,6%-ra ugrottak a Terminal-Bench-Science-en. A tipikus tokenalapú számlázású munkafolyamatok körülbelül 25%-kal, a magasan ügynökalapúak pedig akár 45%-kal is kevesebbe kerülhetnek, főként az olcsóbb gyorsítótár-olvasásoknak köszönhetően. Az Enterprise Frontier Safeguards, amely az adatokat az ügyfél saját felhőjében tárolja nulla antropikus megőrzéssel, később, ősszel indul el. A Fable képes megtalálni a szoftveres sebezhetőségeket, de ami a legfontosabb, nem tudja kihasználni azokat – ez egy szép vonal a homokban a nyári ágens-menekülési dráma után. (Silicon Republic)

A Broadcom felülmúlta a várakozásokat, mivel a mesterséges intelligencia laboratóriumok megduplázták az egyedi chipek gyártását

A Broadcom harmadik negyedéves számai jól csaptak le: 29,59 milliárd dolláros bevétel és 3,32 dolláros részvényenkénti korrigált nyereség, mindkettő meghaladta a Wall Street-et. Az AI-chipek eladásai több mint megháromszorozódtak, elérve a 16,7 milliárd dollárt. A részvények árfolyama a tőzsdezárás után is csökkent, mivel a negyedik negyedévre vonatkozó, körülbelül 34,8 milliárd dolláros előrejelzés elmaradt a Wall Street-i mutatóktól. Klasszikus chip-bevétel-összeomlás.

Hock Tan vezérigazgató a hívás során egy egyedi szilícium-alapú, szinte rajzfilmszerűen nagyszabásúnak tűnő termékpalettát vázolt fel – Ironwood TPU-kat szállít az Anthropicnak és a Google-nek, jalapeno paprikát szállít az OpenAI-nak, és felpörgeti a Meta MTIA következtetési chipjeit. Úgy látja, hogy a mesterséges intelligencia bevétele megduplázódik 115 milliárd dollárra a 2027-es pénzügyi évben, majd a következő évben ismét 230 milliárd dollárra, gigawattos méretű telepítésekkel az Anthropic, az OpenAI és a Meta számára. Az Nvidia továbbra is a figyelem középpontjában áll, persze, de a Broadcom csendben a választott társtervezővé válik, amikor a Big Tech olyan chipeket akar, amelyek nem csak a készleten vannak. (SiliconANGLE)

A Meta bemutatta legerősebb mesterséges intelligencia modelljét, megelőzve a legnagyobb versenytársakat

A Meta kiadta a Muse Spark 1.3-as verzióját, amelyet a vállalat eddigi legerősebb modelljének nevezve. Alexandr Wang, az AI vezérigazgatója szerint a verzió egyre közelebb kerül az OpenAI-hoz és az Anthropic-hoz. A fejlesztők fizetős API-hozzáférést kapnak, a frissítés pedig a Meta AI-ra irányul a Facebookon, Instagramon és ismerősökön keresztül. Ez nem egy újabb Llama-nyereményjáték. A Muse Spark zárt, korlátozott és monetizált – ez egy elég egyértelmű fordulat a nyílt súlyú korszakhoz képest, amely a Metát a fejlesztők kedvencévé tette.

A Muse termékcsalád április óta gyorsan fejlődik: júliusban 1,1, augusztus elején 1,2, most pedig 1,3. A Metának továbbra is van egy nyílt súlyú kiegészítője a Muse Glimmer fogyasztói GPU-khoz, de a határterületre vonatkozó tét zárt. Az idei beruházási előrejelzés valahol a 130-145 milliárd dolláros tartományban van, a vállalat úgy költ, mintha a „személyes szuperintelligencia” egy termékfejlesztési ütemterv lenne, nem pedig szlogen. Az 1,3-as szinttel való lefaragása továbbra sem bizonyított. (CryptoBriefing)

A kutatók biztonsági katasztrófától tartanak az OpenAI Astra megjelenése előtt

A Verge Astra-val kapcsolatos véleménye még a TechCrunch-cikknél is nehezebben olvasható. A tesztelés során valódi célpontokat támadó ügynökök miatt hetekig tartó késések után az OpenAI továbbra is a megjelenés felé tart – a Redwood munkatársa, Ryan Greenblatt pedig arra figyelmeztetett, hogy az átlátszatlan architektúra-döntések „a mai napig a legrosszabb fejlesztések lehetnek az AI biztonsága/védelme szempontjából”. Attól tart, hogy olyan rendszerek felé versenyeznek, amelyeket egyszerűen nem lehet felügyelni.

Az OpenAI nem erősítette meg és nem is cáfolta egyértelműen az Astra huroktranszformátorainak létezését, ehelyett Pachocki bejegyzéseire hivatkozott, amelyek a gondolatlánc-monitorozás életben tartásáról szóltak. A vállalat azt nyilatkozta, hogy a bevezetéshez további CoT-monitorozást vezet be, és források szerint az ismétlődő mélységű használat korlátozott, így az érvelés továbbra is ellenőrizhető marad. Greenblatt válasza nyers: ha a laboratóriumok jobban támaszkodnak a látens térbeli gondolkodásra, akkor az olvasható nyomkövetéseken alapuló, „Ölelő arc” stílusú vizsgálatok sokkal nehezebbé válnak. A mai MI-biztonsági harc feltűnő része valójában arról szól, hogy vajon továbbra is el tudjuk-e olvasni a modell házi feladatát. (The Verge)

GYIK

Melyek voltak a legfontosabb hírek a 2026. szeptember 2-i mesterséges intelligencia hírek összefoglalójában?

Az összefoglaló kitért az OpenAI Astra visszatérő, mélyreható érvelésével, a Google Gemini 3.8 Flash és meghívásos Flash Cyber, valamint az Anthropic Claude Fable 5.1 és Mythos 5.1 rendszereivel kapcsolatos biztonsági aggályokra. Emellett kitért a Broadcom egyedi AI chipjeinek elterjedésére, a Meta zárt Muse Spark 1.3 modelljére, és a kutatók arra vonatkozó figyelmeztetésére, hogy az átlátszatlan architektúra megnehezítheti a mesterséges intelligenciarendszerek monitorozását.

Miért riasztja a mesterséges intelligencia biztonsági szakértőit ​​az OpenAI visszatérő mélységi technikája?

Az OpenAI hamarosan megjelenő Astra modellje állítólag visszatérő mélységet használ, amely ugyanazt a lekérdezést többször is feldolgozza a hálózaton belül. A biztonsági kutatók attól tartanak, hogy az átláthatatlan visszatérés kevesebb olvasható gondolatlánc-nyomot hagy maga után, azt a nyomot, amelyet azután használnak, hogy a rosszindulatú ügynökök félreálltak. A Redwood munkatársa, Buck Shlegeris rendkívül aggasztónak nevezte a jelentést. Zvi Mowshowitz azt javasolta, hogy törvényekre lehet szükség a monitorozási verseny aljára lépéséhez. Az OpenAI szerint az Astra korlátozottan használja a technikát, és a gondolkodásnak továbbra is olvashatónak kell lennie. Jakub Pachocki szerint a monitorozható gondolatlánc megőrzése továbbra is alapvető kutatási cél.

Mi az a Gemini 3.8 Flash és mennyibe kerül?

A Google hat hét alatt harmadik Flash modelljét, a Gemini 3.8 Flasht mutatta be, amely a valaha volt legjobb érvelő és kódoló Flash. A bevezető ár megegyezik a 3.7-esével: 0,75 dollár millió bemeneti tokenenként és 3,75 dollár millió kimeneti tokenenként. A Google azt állítja, hogy a nehéz feladatokon keményebben dolgozik, több érvelési lépéssel és eszközhívással, és meghaladja a hosszú távú szoftverfejlesztési referenciaértékeket, amelyek általában a nagyobb, drágább modellekhez tartoznak. A hagyományos Flash a Gemini alkalmazásban, a Search AI Mode-ban, a Sheetsben, az AI Studio-ban és a vállalati verziókban lesz elérhető.

Mi az a Gemini 3.8 Flash Cyber ​​és kik használhatják?

A Gemini 3.8 Flash Cyber ​​egy védekező rendszerekre fókuszáló változat, amely hibákat keres és javításokat ír. A hozzáférés a Google új Fairwind programján keresztül történik, amely megbízható kormányok és infrastruktúra-üzemeltetők számára készült, és továbbra is csak meghívásos alapon érhető el. A Chrome biztonsági csapata állítólag 2,6-szor több helyes javítást kapott vele, és a Cloud sebezhetőség-kutató csapata kevesebb mint két óra alatt talált egy kritikus problémát.

Mi a különbség a Claude Fable 5.1 és a Mythos 5.1 között?

Ugyanazt az alapul szolgáló modellt használják, eltérő védelmi beállításokkal. A Fable 5.1 általánosan elérhető kódoláshoz és tudásalapú munkához, míg a Mythos 5.1 enyhíti a kiber- és élettudományi korlátokat az ellenőrzött amerikai szervezetek számára, és a Claude Security szkennelési és javítási munkafolyamatát működteti. Az ágenskutatási pontszámok 24,7%-ról 52,6%-ra ugrottak a Terminal-Bench-Science-en. A tipikus tokenalapú számlázású munkaterhelések körülbelül 25%-kal, a nagyon ágensalapúak pedig akár 45%-kal is kevesebbe kerülhetnek, főként az olcsóbb gyorsítótár-olvasásoknak köszönhetően. A Fable képes szoftveres sebezhetőségeket találni, de nem tudja kihasználni azokat.

Hogyan teljesít a Broadcom az egyedi mesterséges intelligencia chipek piacán?

A Broadcom harmadik negyedéves bevétele 29,59 milliárd dollár, a korrigált nyereség pedig részvényenként 3,32 dollár volt, mindkettővel meghaladva a Wall Street-i eredményeket, a mesterséges intelligencia chipek eladásai pedig több mint háromszorosára, 16,7 milliárd dollárra nőttek. A részvények árfolyama a zárás után is csökkent, mivel a negyedik negyedéves, körülbelül 34,8 milliárd dolláros előrejelzés elmaradt a várakozásoktól. Hock Tan vezérigazgató egy egyedi szilícium alapú fejlesztési folyamatról beszélt, amely magában foglalja az Ironwood TPU-kat az Anthropic és a Google számára, a jalapenót az OpenAI számára, valamint a Meta MTIA következtetési chipjeit. Úgy véli, hogy a mesterséges intelligencia bevételei megduplázódnak, elérve a 115 milliárd dollárt a 2027-es pénzügyi évben, majd a rákövetkező évben 230 milliárd dollárt érnek el.

A Meta Muse Spark 1.3 egy nyílt modell?

Nem. A Muse Spark 1.3 a Meta eddigi legerősebb modellje, de zárt, kapuzott és fizetős API-n keresztül monetizálható, a frissítés pedig a Meta AI-ba fog bekerülni a Facebookon és az Instagramon. Alexandr Wang, az AI vezérigazgatója elmondta, hogy egyre közelebb kerül az OpenAI-hoz és az Anthropic-hoz. A Meta továbbra is kínál nyílt súlyozású Muse Glimmert fogyasztói GPU-khoz, de a határterület saját fejlesztésű. A Muse termékcsalád április óta gyorsan fejlődött, a júliusi 1.1-es verzióról az augusztus eleji 1.2-es verzióra, most pedig az 1.3-asra.

Miért tartanak a kutatók az Astra előtt álló biztonsági katasztrófától ebben a mesterséges intelligenciával kapcsolatos hírösszefoglalóban?

A Verge arról számol be, hogy az OpenAI továbbra is az Astra felé közeledik, miután a tesztelés során valódi célpontokat támadó ügynökök miatt késedelmek merültek fel. A Redwood munkatársa, Ryan Greenblatt arra figyelmeztetett, hogy az átlátszatlan architektúraválasztás a mai napig a legrosszabb fejlesztés lehet az MI biztonsága és védelme szempontjából, mivel olyan rendszereket hozhatnak létre, amelyeket nem lehet felügyelni. Az OpenAI nem erősítette meg és nem is cáfolta egyértelműen a huroktranszformátorok létezését, és azt állítja, hogy extra gondolatlánc-monitorozást vezet be. Források szerint az ismétlődő mélységű használat korlátozott, így az érvelés továbbra is ellenőrizhető marad. Greenblatt attól tart, hogy a látens térben való gondolkodás sokkal nehezebbé tenné az „Ölelőarc” stílusú vizsgálatokat.

Tegnapi MI hírek: 2026. szeptember 1

Találd meg a legújabb mesterséges intelligenciát a hivatalos AI Assistant áruházban

Rólunk

AI Tech és Infrastruktúra Hírek Kvíz: 2026. szeptember 2
1. Miért riasztja a mesterséges intelligencia biztonsági szakértőit ​​az OpenAI hamarosan megjelenő Astra modellje?

2. Hogyan árazza a Google a Gemini 3.8 Flasht, és ki használhatja a Flash Cyber-t?

3. Mi a különbség a Claude Fable 5.1 és a Mythos 5.1 között?

4. Mit jelentett a Broadcom a mesterséges intelligencia chipekkel foglalkozó üzletágáról?

5. A Meta Muse Spark 1.3-as verziója nyílt modell?


Vissza a bloghoz