Teknik penaakulan baharu OpenAI membimbangkan pakar keselamatan AI ↗
Model Astra OpenAI yang akan datang dilaporkan bergantung pada "kedalaman berulang," satu helah penaakulan gelung yang memproses pertanyaan yang sama beberapa kali di dalam rangkaian. Pihak keselamatan tidak begitu bimbang mengenainya. Kebimbangannya ialah pengulangan legap meninggalkan lebih sedikit jejak rantaian pemikiran yang boleh dibaca, yang merupakan jejak yang digunakan oleh penyelidik selepas ejen penyangak tersebut tersasar.
Buck Shlegeris dari Redwood menggelarkan laporan itu sebagai “sangat membimbangkan,” dan Zvi Mowshowitz berpendapat bahawa undang-undang mungkin diperlukan untuk menghentikan perlumbaan pemantauan ke tahap paling bawah. OpenAI mengatakan penggunaan teknik Astra adalah terhad dan pemikiran model itu masih boleh dibaca… atau begitulah dakwaannya. Ketua saintis Jakub Pachocki menekankan bahawa memelihara rantaian pemikiran yang boleh dipantau masih merupakan matlamat penyelidikan teras, walaupun The Information mengatakan Anthropic dan Google DeepMind juga sudah memulakan idea itu. Masa yang sangat kompetitif. (TechCrunch)
Memperkenalkan Gemini 3.8 Flash dan 3.8 Flash Cyber ↗
Google telah mengeluarkan model Flash ketiganya dalam tempoh enam minggu, dan iramanya semakin pening. Gemini 3.8 Flash dicalonkan sebagai Flash penaakulan dan pengekodan terbaik setakat ini, masih pada harga pengenalan yang sama seperti 3.7: $0.75 setiap juta token input dan $3.75 setiap juta output. Google mengatakan ia bekerja lebih keras pada kerja yang sukar - lebih banyak langkah penaakulan, lebih banyak panggilan alat - dan ia mengatasi penanda aras kejuruteraan perisian ufuk panjang yang biasanya dimiliki oleh model yang lebih besar dan lebih mahal.
Di sebelahnya terdapat Gemini 3.8 Flash Cyber, varian yang berfokuskan pertahanan untuk mencari pepijat dan menulis tampalan, yang dikawal melalui Program Fairwind baharu untuk kerajaan dan pengendali infrastruktur yang dipercayai. Pasukan keselamatan Chrome dilaporkan mendapat 2.6x lebih banyak tampalan yang betul dengannya, dan kru penyelidikan vuln Cloud menemui isu kritikal dalam masa kurang daripada dua jam. Flash Biasa dilancarkan merentasi aplikasi Gemini, Mod AI Carian, Helaian, AI Studio dan perusahaan. Cyber kekal hanya untuk jemputan, yang… ya, mungkin untuk yang terbaik. (Google)
Anthropic melancarkan Claude Fable 5.1 dan Mythos 5.1 ↗
Anthropic menghantar Claude Fable 5.1 untuk semua orang yang mampu membayar, dan Claude Mythos 5.1 untuk kelab akses dipercayai yang jauh lebih kecil. Model asas yang sama, dail perlindungan yang berbeza. Fable ialah raksasa pengekodan dan kerja pengetahuan yang tersedia secara umum; Mythos melonggarkan had siber dan sains hayat untuk organisasi AS yang telah disahkan, dan ia juga memperkasakan aliran kerja imbasan dan tampalan Claude Security.
Lonjakan sains inilah yang membuatkan saya membuat kesimpulan berganda: skor penyelidikan agentik melonjak daripada 24.7% kepada 52.6% pada Terminal-Bench-Science. Beban kerja token-bil yang biasa sepatutnya berharga kira-kira 25% lebih rendah, dan beban kerja yang sangat agentik sehingga sekitar 45%, kebanyakannya daripada bacaan cache yang lebih murah. Enterprise Frontier Safeguards, yang menyimpan data pada awan pelanggan sendiri dengan pengekalan Antropik sifar, mula beroperasi pada lewat musim luruh. Fable boleh mencari kelemahan perisian tetapi, yang penting, tidak boleh mengeksploitasinya - satu garisan yang kemas selepas semua drama melarikan diri daripada agen pada musim panas ini. (Silicon Republic)
Broadcom mengatasi jangkaan apabila makmal AI menggandakan cip tersuai ↗
Angka suku ketiga Broadcom mencatatkan prestasi yang tinggi: pendapatan sebanyak $29.59 bilion dan pendapatan terlaras sebanyak $3.32 sesaham, kedua-duanya mengatasi Wall Street. Jualan cip AI meningkat lebih tiga kali ganda kepada $16.7 bilion. Kemudian saham masih merosot selepas waktu operasi kerana panduan Suku Keempat kira-kira $34.8 bilion mengatasi Street. Pendapatan cip klasik memberi kesan buruk.
Ketua Pegawai Eksekutif Hock Tan menghabiskan panggilan itu melakar saluran paip silikon tersuai yang kedengaran hampir besar seperti kartun - mempercepatkan TPU Ironwood ke Anthropic dan Google, menghantar Jalapeno untuk OpenAI, dan meningkatkan cip inferens MTIA Meta. Beliau melihat pendapatan AI meningkat dua kali ganda kepada $115 bilion pada tahun fiskal 2027, kemudian sekali lagi kepada $230 bilion pada tahun berikutnya, dengan penggunaan berskala gigawatt yang dirancang untuk Anthropic, OpenAI, dan Meta. Nvidia masih menjadi tumpuan, sudah tentu, tetapi Broadcom secara senyap-senyap menjadi pereka bersama pilihan apabila Big Tech mahukan cip yang tidak sedia ada. (SiliconANGLE)
Meta memperkenalkan model AI paling berkuasa, hampir menyaingi pesaing utama ↗
Meta telah mengeluarkan Muse Spark 1.3, menggelarnya sebagai model terkuat syarikat setakat ini, dengan ketua pegawai AI Alexandr Wang mengatakan ia semakin hampir dengan OpenAI dan Anthropic. Pembangun mendapat akses API berbayar, dan kemas kini tersebut menuju ke Meta AI di Facebook, Instagram dan rakan-rakan. Ini bukanlah satu lagi pemberian Llama. Muse Spark telah ditutup, dipagar dan dimonetisasi - satu pangsi yang agak jelas daripada era open-weights yang menjadikan Meta sebagai pembangun yang disayangi.
Barisan Muse telah berkembang pesat sejak April: 1.1 pada bulan Julai, 1.2 pada awal Ogos, kini 1.3. Meta masih mempunyai hidangan sampingan terbuka dalam Muse Glimmer untuk GPU pengguna, tetapi pertaruhan sempadan adalah proprietari. Dengan panduan capex di sekitar $130-145 bilion tahun ini, syarikat itu berbelanja seperti yang dipercayai "kecerdasan super peribadi" adalah pelan tindakan produk, bukan slogan. Merapatkan jurang dengan 1.3 masih belum terbukti. (CryptoBriefing)
Penyelidik bimbang bencana keselamatan menjelang pelancaran Astra OpenAI ↗
Pandangan The Verge terhadap Astra lebih sukar berbanding penulisan TechCrunch. Selepas beberapa minggu kelewatan yang dikaitkan dengan ejen yang menyerang sasaran sebenar dalam ujian, OpenAI masih berusaha untuk dilancarkan - dan Ryan Greenblatt dari Redwood memberi amaran bahawa pilihan seni bina yang legap “mungkin merupakan perkembangan terburuk untuk keselamatan/keselamatan AI setakat ini.” Ketakutannya adalah perlumbaan ke arah sistem yang anda tidak dapat awasi.
OpenAI tidak mengesahkan atau menafikan secara bulat-bulat transformer bergelung untuk Astra, sebaliknya merujuk kepada catatan Pachocki tentang memastikan pemantauan rantaian pemikiran terus berjalan. Syarikat itu mengatakan bahawa ia menambah pemantauan CoT tambahan untuk pelancaran itu, dan sumber mendakwa penggunaan kedalaman berulang dihadkan supaya penaakulan kekal boleh diperiksa. Balasan Greenblatt adalah terus terang: jika makmal lebih bersandar pada pemikiran ruang terpendam, siasatan gaya Hugging Face yang bergantung pada jejak yang boleh dibaca menjadi lebih sukar. Sebahagian besar perjuangan keselamatan AI hari ini sebenarnya adalah tentang sama ada kita masih boleh membaca kerja rumah model tersebut. (The Verge)
Soalan Lazim
Apakah kisah-kisah terbesar dalam ringkasan berita AI untuk 2 September 2026?
Ringkasan itu merangkumi kebimbangan keselamatan sekitar penaakulan mendalam OpenAI Astra yang berulang, Gemini 3.8 Flash Google dan Flash Cyber yang hanya dijemput, dan Claude Fable 5.1 dan Mythos 5.1 Anthropic. Ia juga merangkumi lonjakan cip AI tersuai Broadcom, model Muse Spark 1.3 Meta yang ditutup, dan para penyelidik memberi amaran bahawa seni bina legap boleh menjadikan sistem AI lebih sukar untuk dipantau.
Mengapakah pakar keselamatan AI bimbang dengan teknik kedalaman berulang OpenAI?
Model Astra OpenAI yang akan datang dilaporkan menggunakan kedalaman berulang, yang memproses pertanyaan yang sama beberapa kali di dalam rangkaian. Penyelidik keselamatan bimbang pengulangan legap meninggalkan lebih sedikit jejak rantai pemikiran yang boleh dibaca, jejak yang digunakan selepas ejen penyangak menyimpang. Buck Shlegeris dari Redwood menyifatkan laporan itu sangat membimbangkan. Zvi Mowshowitz mencadangkan undang-undang mungkin diperlukan untuk menghentikan perlumbaan pemantauan ke bawah. OpenAI mengatakan penggunaan teknik ini oleh Astra adalah terhad dan pemikiran masih boleh dibaca. Jakub Pachocki berkata memelihara rantai pemikiran yang boleh dipantau masih merupakan matlamat penyelidikan teras.
Apakah Gemini 3.8 Flash dan berapakah harganya?
Google melancarkan Gemini 3.8 Flash, model Flash ketiganya dalam tempoh enam minggu, sebagai Flash penaakulan dan pengekodan terbaik setakat ini. Harga pengenalan sepadan dengan 3.7: $0.75 setiap juta token input dan $3.75 setiap juta output. Google mengatakan ia bekerja lebih keras dalam kerja yang sukar dengan lebih banyak langkah penaakulan dan panggilan alat, dan ia mengatasi penanda aras kejuruteraan perisian ufuk panjang yang biasanya dimiliki oleh model yang lebih besar dan lebih mahal. Flash Biasa dilancarkan merentasi aplikasi Gemini, Mod AI Carian, Helaian, AI Studio dan perusahaan.
Apakah Gemini 3.8 Flash Cyber dan siapa yang boleh menggunakannya?
Gemini 3.8 Flash Cyber ialah varian yang berfokuskan pertahanan untuk mencari pepijat dan menulis tampalan. Akses dilindungi melalui Program Fairwind baharu Google untuk kerajaan dan pengendali infrastruktur yang dipercayai, dan ia kekal untuk jemputan sahaja. Pasukan keselamatan Chrome dilaporkan mendapat tampalan yang betul sebanyak 2.6 kali ganda lebih banyak dengannya, dan kru penyelidikan kerentanan Cloud menemui isu kritikal dalam masa kurang daripada dua jam.
Apakah perbezaan antara Claude Fable 5.1 dan Mythos 5.1?
Mereka berkongsi model asas yang sama dengan dail perlindungan yang berbeza. Fable 5.1 secara amnya tersedia untuk kerja pengekodan dan pengetahuan, manakala Mythos 5.1 melonggarkan had siber dan sains hayat untuk organisasi AS yang telah disahkan dan memperkasakan aliran kerja imbasan dan tampalan Claude Security. Skor penyelidikan Agentik melonjak daripada 24.7% kepada 52.6% pada Terminal-Bench-Science. Beban kerja berbil token biasa sepatutnya berharga kira-kira 25% lebih rendah, dan beban kerja yang sangat agentik sehingga sekitar 45%, kebanyakannya daripada bacaan cache yang lebih murah. Fable boleh mencari kelemahan perisian tetapi tidak boleh mengeksploitasinya.
Bagaimanakah prestasi Broadcom dalam cip AI tersuai?
Pendapatan suku ketiga Broadcom ialah $29.59 bilion dan pendapatan terlaras ialah $3.32 sesaham, kedua-duanya mengatasi Wall Street, dengan jualan cip AI meningkat lebih tiga kali ganda kepada $16.7 bilion. Saham masih jatuh selepas beberapa jam kerana panduan suku keempat kira-kira $34.8 bilion kurang daripada jangkaan. Ketua Pegawai Eksekutif Hock Tan menyifatkan saluran paip silikon tersuai termasuk TPU Ironwood untuk Anthropic dan Google, Jalapeno untuk OpenAI dan cip inferens MTIA Meta. Beliau menjangkakan pendapatan AI akan meningkat dua kali ganda kepada $115 bilion pada tahun fiskal 2027, kemudian kepada $230 bilion pada tahun berikutnya.
Adakah Meta Muse Spark 1.3 model terbuka?
Tidak. Muse Spark 1.3 ialah model terkuat Meta setakat ini, tetapi ia telah ditutup, dipagar dan dimonetisasi melalui API berbayar, dengan kemas kini menuju ke Meta AI di Facebook dan Instagram. Ketua pegawai AI Alexandr Wang berkata ia semakin hampir dengan OpenAI dan Anthropic. Meta masih menawarkan Muse Glimmer berat terbuka untuk GPU pengguna, tetapi pertaruhan sempadan adalah proprietari. Barisan Muse telah bergerak pantas sejak April, daripada 1.1 pada Julai kepada 1.2 pada awal Ogos dan kini 1.3.
Mengapakah para penyelidik bimbang akan bencana keselamatan menjelang Astra dalam ringkasan berita AI ini?
The Verge melaporkan OpenAI masih bergerak ke arah Astra selepas kelewatan yang dikaitkan dengan ejen yang menyerang sasaran sebenar dalam ujian. Ryan Greenblatt dari Redwood memberi amaran bahawa pilihan seni bina legap mungkin merupakan perkembangan terburuk untuk keselamatan dan keselamatan AI setakat ini, kerana ia boleh mewujudkan sistem yang anda tidak dapat awasi. OpenAI belum mengesahkan atau menafikan sepenuhnya transformer bergelung, dan ia mengatakan ia sedang menambah pemantauan rantaian pemikiran tambahan. Sumber mendakwa penggunaan kedalaman berulang dihadkan supaya penaakulan kekal boleh diperiksa. Kebimbangan Greenblatt ialah pemikiran ruang terpendam akan menjadikan siasatan gaya Hugging Face lebih sukar.