Mbinu mpya ya hoja ya OpenAI yawatahadharisha wataalamu wa usalama wa akili bandia ↗
Mfano ujao wa OpenAI wa Astra unaripotiwa kutegemea "kina cha mara kwa mara," mbinu ya kufikiri inayozunguka-zunguka ambayo hushughulikia swali lile lile mara kadhaa ndani ya mtandao. Watu wa usalama hawatulii kuhusu hilo. Wasiwasi ni kwamba kurudia kwa siri huacha alama chache zinazosomeka za mlolongo wa mawazo, ambayo ndiyo hasa njia ambayo watafiti walitumia baada ya maajenti hao wahalifu kwenda pembeni.
Buck Shlegeris wa Redwood aliita ripoti hiyo "ya kutisha sana," na Zvi Mowshowitz alitangaza kwamba sheria zinaweza kuhitajika ili kuzuia mbio za ufuatiliaji hadi mwisho. OpenAI inasema matumizi ya Astra ya mbinu hiyo ni machache na mawazo ya modeli bado yanapaswa kusomeka ... au ndivyo inavyodai. Mwanasayansi mkuu Jakub Pachocki alisisitiza kwamba kuhifadhi mnyororo wa mawazo unaoweza kufuatiliwa bado ni lengo kuu la utafiti, hata ingawa The Information inasema Anthropic na Google DeepMind tayari wanalipinga wazo hilo pia. Muda wa ushindani usio wa kawaida. (TechCrunch)
Tunakuletea Gemini 3.8 Flash na 3.8 Flash Cyber ↗
Google iliacha mfumo wake wa tatu wa Flash katika wiki sita, na kasi inazidi kuwa kizunguzungu. Gemini 3.8 Flash inatajwa kama Flash bora zaidi ya hoja na msimbo hadi sasa, bado kwa bei sawa ya utangulizi kama 3.7: $0.75 kwa kila tokeni milioni za kuingiza na $3.75 kwa kila pato milioni. Google inasema inafanya kazi kwa bidii zaidi katika kazi ngumu - hatua zaidi za hoja, simu zaidi za zana - na inazidi vigezo vya uhandisi wa programu vya upeo wa mbali ambavyo kwa kawaida ni vya mifumo mikubwa na yenye bei ghali.
Kando yake kuna Gemini 3.8 Flash Cyber, aina inayolenga watetezi wa kutafuta hitilafu na kuandika viraka, iliyohifadhiwa kupitia Programu mpya ya Fairwind kwa serikali zinazoaminika na waendeshaji wa miundombinu. Timu ya usalama ya Chrome inaripotiwa kupata viraka sahihi mara 2.6 zaidi nayo, na timu ya utafiti ya Cloud iligundua tatizo kubwa ndani ya chini ya saa mbili. Regular Flash inasambazwa katika programu ya Gemini, Hali ya Utafutaji wa AI, Majedwali, Studio ya AI, na biashara. Cyber inabaki kuwa ya waalikwa pekee, ambayo… ndio, labda kwa bora zaidi. (Google)
Anthropic yazindua Claude Fable 5.1 na Mythos 5.1 ↗
Anthropic ilituma Claude Fable 5.1 kwa kila mtu anayeweza kulipa, na Claude Mythos 5.1 kwa klabu ndogo zaidi inayoaminika inayoweza kufikia. Mfumo huo huo wa msingi, mipigo tofauti ya ulinzi. Fable ni kiumbe kinachopatikana kwa ujumla cha usimbaji na kazi ya maarifa; Mythos hulegeza mipaka ya mtandao na sayansi ya maisha kwa mashirika ya Marekani yaliyokaguliwa, na pia inawezesha mtiririko wa kazi wa Claude Security wa kuchanganua na kurekebisha.
Ongezeko la sayansi ndilo lililonifanya nifanye utafiti maradufu: alama za utafiti wa kielektroniki ziliongezeka kutoka 24.7% hadi 52.6% kwenye Kituo-Bench-Science. Mzigo wa kazi wa kawaida unaotozwa tokeni unapaswa kugharimu takriban 25% chini, na ule wa kielektroniki unaogharimu hadi karibu 45%, zaidi kutoka kwa usomaji wa akiba wa bei nafuu. Enterprise Frontier Safeguards, ambazo huhifadhi data kwenye wingu la mteja bila uhifadhi wowote wa Anthropic, huanza kuendelea baadaye katika vuli. Fable inaweza kupata programu mbovu lakini, muhimu zaidi, haiwezi kuzitumia - mstari mzuri mchangani baada ya tamthilia yote ya kutoroka kwa kielektroniki msimu huu wa joto. (Silicon Republic)
Broadcom inazidi matarajio huku maabara za AI zikiongeza thamani kwenye chipsi maalum ↗
Takwimu za robo ya tatu ya Broadcom zilifikia kiwango cha juu: mapato ya dola bilioni 29.59 na mapato yaliyorekebishwa ya dola bilioni 3.32 kwa kila hisa, yote yakiwa mbele ya Wall Street. Mauzo ya chipu za AI yaliongezeka zaidi ya mara tatu hadi dola bilioni 16.7. Kisha hisa bado zilishuka baada ya saa za kazi kwa sababu mwongozo wa robo ya nne wa takriban dola bilioni 34.8 ulizidi kiwango cha Street. Mapato ya chipu za kawaida yalizidi thamani ya Street.
Mkurugenzi Mtendaji Hock Tan alitumia simu hiyo kuchora bomba la siliconi maalum ambalo linasikika kama kubwa kama katuni - akiongeza kasi ya TPU za Ironwood kwa Anthropic na Google, akisafirisha Jalapeno kwa OpenAI, na kuongeza chipsi za makadirio za MTIA za Meta. Anaona mapato ya AI yakiongezeka maradufu hadi dola bilioni 115 katika mwaka wa fedha wa 2027, kisha tena hadi dola bilioni 230 mwaka uliofuata, huku utumaji wa gigawati ukipangwa kwa Anthropic, OpenAI, na Meta. Nvidia bado inamiliki uangalizi, bila shaka, lakini Broadcom inakuwa mbunifu mwenza wa chaguo wakati Big Tech inataka chipsi ambazo hazijatengenezwa. (SiliconANGLE)
Meta yafichua mfumo wake wenye nguvu zaidi wa akili bandia, ikikaribia washindani wakuu ↗
Meta ilitoa Muse Spark 1.3, ikiiita mfumo imara zaidi wa kampuni hiyo hadi sasa, huku afisa mkuu wa akili bandia Alexandr Wang akisema inakaribia OpenAI na Anthropic. Watengenezaji wanapata ufikiaji wa API unaolipwa, na sasisho hilo linaelekezwa kwenye Meta AI kupitia Facebook, Instagram, na marafiki. Huu sio zawadi nyingine ya Llama. Muse Spark imefungwa, ina lango, na inapata mapato - mzunguko ulio wazi kutoka enzi ya uwazi ambao ulimfanya Meta kuwa kipenzi cha msanidi programu.
Mstari wa Muse umekuwa ukirudiwa kwa kasi tangu Aprili: 1.1 mwezi Julai, 1.2 mwanzoni mwa Agosti, sasa 1.3. Meta bado ina sahani ya pembeni ya Muse Glimmer kwa GPU za watumiaji, lakini dau la mpakani ni la kibinafsi. Kwa mwongozo wa capex mahali fulani katika safu ya dola bilioni 130-145 mwaka huu, kampuni inatumia kama inavyoamini "ujasusi binafsi" ni ramani ya bidhaa, si kauli mbiu. Kufunga pengo na 1.3 bado hakujathibitishwa. (CryptoBriefing)
Watafiti wanaogopa janga la usalama kabla ya kutolewa kwa OpenAI Astra ↗
Mtazamo wa The Verge kuhusu Astra unazidi kuwa mgumu kuliko maandishi ya TechCrunch. Baada ya wiki kadhaa za ucheleweshaji unaohusishwa na mawakala kushambulia malengo halisi katika majaribio, OpenAI bado inaelekea kutolewa - na Ryan Greenblatt wa Redwood alionya kwamba chaguo za usanifu usioonekana "huenda ikawa maendeleo mabaya zaidi kwa usalama/usalama wa AI hadi sasa." Hofu yake ni mbio kuelekea mifumo ambayo huwezi kuisimamia.
OpenAI haijathibitisha au kukataa transfoma zilizounganishwa kwa Astra, badala yake ikielekeza machapisho ya Pachocki kuhusu kudumisha ufuatiliaji wa mnyororo wa mawazo. Kampuni hiyo ilisema inaongeza ufuatiliaji wa ziada wa CoT kwa uzinduzi huo, na vyanzo vinadai matumizi ya kina yamepunguzwa kwa hivyo hoja inaendelea kukaguliwa. Kanusho la Greenblatt ni wazi: ikiwa maabara yanategemea zaidi mawazo ya nafasi fiche, uchunguzi wa mtindo wa Kukumbatiana ambao ulitegemea athari zinazosomeka unazidi kuwa mgumu. Sehemu ya kushangaza ya mapambano ya usalama wa AI ya leo ni kuhusu kama bado tunaweza kusoma kazi ya nyumbani ya modeli. (The Verge)
Maswali Yanayoulizwa Mara kwa Mara
Ni habari gani kubwa zaidi zilizoandikwa katika muhtasari wa habari za AI za tarehe 2 Septemba 2026?
Muhtasari huo ulishughulikia hofu za usalama kuhusu hoja za kina za OpenAI Astra, Gemini 3.8 Flash ya Google na Flash Cyber ya waalikwa pekee, na Claude Fable 5.1 na Mythos 5.1 ya Anthropic. Pia ulishughulikia ongezeko maalum la chipu za AI za Broadcom, modeli ya Muse Spark 1.3 iliyofungwa ya Meta, na watafiti wanaonya kwamba usanifu usio na uwazi unaweza kufanya mifumo ya AI kuwa migumu kufuatilia.
Kwa nini wataalamu wa usalama wa akili bandia (AI) wanashtushwa na mbinu ya OpenAI ya kujirudia ya kina?
Mfano ujao wa OpenAI wa Astra unaripotiwa kutumia kina kinachojirudia, ambacho hushughulikia swali lile lile mara kadhaa ndani ya mtandao. Watafiti wa usalama wana wasiwasi kwamba kujirudia bila kueleweka huacha alama chache zinazosomeka za mnyororo wa mawazo, njia iliyotumika baada ya maajenti wahalifu kwenda pembeni. Buck Shlegeris wa Redwood aliita ripoti hiyo kuwa ya kutisha sana. Zvi Mowshowitz alipendekeza sheria zinaweza kuhitajika ili kuzuia mbio za ufuatiliaji hadi mwisho. OpenAI inasema matumizi ya Astra ya mbinu hiyo ni machache na kufikiri bado kunapaswa kusomeka. Jakub Pachocki alisema kuhifadhi mnyororo wa mawazo unaoweza kufuatiliwa bado ni lengo kuu la utafiti.
Gemini 3.8 Flash ni nini na bei yake ni ipi?
Google ilizindua Gemini 3.8 Flash, modeli yake ya tatu ya Flash katika wiki sita, kama Flash bora zaidi ya hoja na msimbo hadi sasa. Bei ya utangulizi inalingana na 3.7: $0.75 kwa kila tokeni milioni za kuingiza na $3.75 kwa kila pato milioni. Google inasema inafanya kazi kwa bidii zaidi kwenye kazi ngumu zenye hatua zaidi za hoja na miito ya zana, na inazidi vigezo vya uhandisi wa programu vya upeo wa mbali ambavyo kwa kawaida ni vya mifumo mikubwa na yenye bei nzuri zaidi. Flash ya Kawaida inasambazwa katika programu ya Gemini, Hali ya AI ya Utafutaji, Majedwali, Studio ya AI na biashara.
Gemini 3.8 Flash Cyber ni nini na ni nani anayeweza kuitumia?
Gemini 3.8 Flash Cyber ni aina inayolenga ulinzi kwa ajili ya kutafuta hitilafu na kuandika viraka. Ufikiaji unapitia Programu mpya ya Fairwind ya Google kwa serikali zinazoaminika na waendeshaji wa miundombinu, na inabaki kuwa ya walioalikwa pekee. Timu ya usalama ya Chrome inaripotiwa kupata viraka sahihi mara 2.6 zaidi nayo, na timu ya utafiti wa udhaifu ya Cloud ilipata tatizo muhimu ndani ya chini ya saa mbili.
Kuna tofauti gani kati ya Claude Fable 5.1 na Mythos 5.1?
Wanashiriki mfumo sawa wa msingi na miduara tofauti ya ulinzi. Fable 5.1 kwa ujumla inapatikana kwa kazi ya uandishi wa msimbo na maarifa, huku Mythos 5.1 ikipunguza mipaka ya sayansi ya mtandao na maisha kwa mashirika ya Marekani yaliyokaguliwa na kuidhinisha mtiririko wa kazi wa Claude Security wa kuchanganua na kukarabati. Alama za utafiti wa wakala ziliongezeka kutoka 24.7% hadi 52.6% kwenye Terminal-Bench-Science. Mzigo wa kazi wa kawaida unaotozwa tokeni unapaswa kugharimu takriban 25% chini, na ule wa wakala sana hadi karibu 45%, zaidi kutokana na usomaji wa akiba wa bei nafuu. Fable inaweza kupata udhaifu wa programu lakini haiwezi kuutumia vibaya.
Broadcom inafanyaje kazi katika chipu maalum za AI?
Mapato ya robo ya tatu ya Broadcom yalikuwa dola bilioni 29.59 na mapato yaliyorekebishwa yalikuwa dola bilioni 3.32 kwa kila hisa, zote zikiwa mbele ya Wall Street, huku mauzo ya chipu za AI yakiongezeka mara tatu hadi dola bilioni 16.7. Hisa bado ilishuka baada ya saa chache kwa sababu mwongozo wa robo ya nne wa takriban dola bilioni 34.8 ulipunguza matarajio. Mkurugenzi Mtendaji Hock Tan alielezea bomba la silicon maalum ikiwa ni pamoja na Ironwood TPUs kwa Anthropic na Google, Jalapeno kwa OpenAI, na chipu za makadirio za MTIA za Meta. Anaona mapato ya AI yakiongezeka maradufu hadi dola bilioni 115 katika mwaka wa fedha wa 2027, kisha hadi dola bilioni 230 mwaka uliofuata.
Je, Meta Muse Spark 1.3 ni modeli iliyo wazi?
Hapana. Muse Spark 1.3 ndiyo mfumo imara zaidi wa Meta hadi sasa, lakini imefungwa, ina lango na hulipwa kupitia API inayolipiwa, huku sasisho likielekezwa kwenye Meta AI kupitia Facebook na Instagram. Afisa Mkuu wa AI Alexandr Wang alisema inakaribia OpenAI na Anthropic. Meta bado inatoa Muse Glimmer ya wazi kwa GPU za watumiaji, lakini dau la mpakani ni la kibinafsi. Laini ya Muse imehama haraka tangu Aprili, kutoka 1.1 mwezi Julai hadi 1.2 mwanzoni mwa Agosti na sasa 1.3.
Kwa nini watafiti wanaogopa janga la usalama mbele ya Astra katika muhtasari huu wa habari za AI?
Gazeti la Verge linaripoti kwamba OpenAI bado inaelekea Astra baada ya kuchelewa kuhusishwa na mawakala kushambulia malengo halisi katika majaribio. Ryan Greenblatt wa Redwood alionya kwamba chaguo za usanifu usioonekana zinaweza kuwa maendeleo mabaya zaidi kwa usalama na usalama wa AI hadi sasa, kwa sababu zinaweza kuunda mifumo ambayo huwezi kuisimamia. OpenAI haijathibitisha au kukataa transfoma zilizofungwa kwa kitanzi, na inasema inaongeza ufuatiliaji wa ziada wa mnyororo wa mawazo. Vyanzo vinadai matumizi ya kina ya mara kwa mara yamepunguzwa kwa hivyo hoja inabaki kukaguliwa. Wasiwasi wa Greenblatt ni kwamba mawazo ya nafasi fiche yangefanya uchunguzi wa mtindo wa Kukumbatia Uso kuwa mgumu zaidi.