Keputusan pertama Jalapeño menunjukkan kelajuan dan kecekapan yang terkemuka dalam industri dalam inferens AI ↗
OpenAI menerbitkan keputusan prestasi pertama untuk Jalapeño, cip inferens tersuainya. Pada GPT-OSS 120B, ia mengatakan cip tersebut memberikan kira-kira 1.9x lebih banyak daya pemprosesan puncak setiap kilowatt dan sekitar 1.7x lebih rendah latensi hujung ke hujung berbanding sistem perbandingan.
Keuntungan tersebut turut dibawa merentasi DeepSeek R1 dan Kimi K2.5. OpenAI merancang untuk menggunakan Jalapeño di dalam infrastruktur pengkomputerannya sendiri, sementara reka bentuk generasi kedua dan ketiga sedang dijalankan... jadi ya, OpenAI juga semakin menjadi syarikat cip. (OpenAI)
Claude Cowork akhirnya ingat apa yang anda beritahu aplikasi dalam sembang ↗
Anthropic menyatukan ingatan Claude merentasi sembang biasa dan Cowork. Maklumat yang dipelajari semasa perbualan kini boleh mengikuti pengguna ke dalam tugasan ejen, menghapuskan ritual yang agak menjengkelkan iaitu menerangkan projek yang sama berulang kali.
Pengguna boleh memeriksa, mengedit dan memadam topik yang diingati, sementara memori dikemas kini semasa perbualan masih berlaku. Ciri ini diaktifkan secara lalai merentasi pelan Percuma, Pro dan Max. (TechCrunch)
Google Cloud Melancarkan Gemini Enterprise untuk Perundangan ↗
Google Cloud memperkenalkan pakej Gemini Enterprise yang dibina khas untuk peguam, mendorong ejennya melangkaui sembang generik dan menceburi semakan kontrak, penyelidikan undang-undang, pemantauan kawal selia, permintaan privasi dan penggubalan dokumen.
Ia merangkumi penyambung untuk platform seperti Harvey, iManage, Docusign, RelativityOne dan Thomson Reuters, sambil mengekalkan kawalan akses dan tembok etika sedia ada firma. Rampasan tanah ejen AI telah sampai ke jabatan undang-undang... seperti yang dijangkakan, tetapi masih agak pantas. (Sudut Akhbar Google Cloud)
Google Cloud Melancarkan Gemini Enterprise untuk Perkhidmatan Kewangan ↗
Google turut melancarkan tawaran Gemini Enterprise khusus kewangan, termasuk ejen Penyelidikan Kewangan terurus, lebih 50 kemahiran khusus dan 13 penyambung kepada sistem kewangan dan data pasaran.
Platform ini menyasarkan aliran kerja termasuk penilaian risiko kredit, pemantauan portfolio, penyelidikan KYC dan analisis pasaran. CME Group dan Deutsche Bank adalah antara organisasi yang telah terlibat - ejen perusahaan menjadi semakin khusus, hampir seperti perisian yang memakai sut. (Sudut Akhbar Google Cloud)
NVIDIA Mengumumkan Komputer Robotik Jetson Orin Nano 2 untuk Mendefinisikan Semula AI Edge Tahap Permulaan ↗
Nvidia memperkenalkan Jetson Orin Nano 2, sebuah komputer padat yang disasarkan untuk robot, dron dan sistem AI fizikal yang lain. Ia menawarkan 78 trilion operasi sesaat, memori 8GB dan CPU Arm lapan teras.
Nvidia mengatakan prestasi inferens berganda berbanding Nano Super sebelumnya, sementara memadankan prestasinya memerlukan kuasa 40% kurang. Model yang lebih kecil menjadi benar-benar berkemampuan pada perkakasan padat adalah bahagian yang menarik di sini - AI tidak semestinya perlu menghubungi pusat data gergasi lagi. (Bilik Berita NVIDIA)
Perplexity bekerjasama dengan Nvidia untuk melancarkan Portable Computer, ejen AI tempatan sepenuhnya dengan kos token sifar ↗
Perplexity melancarkan Komputer Mudah Alih, membawakan pengalaman Komputer ejennya ke perkakasan tempatan berkuasa Nvidia. Model, fail dan pelaksanaan ejen boleh kekal pada mesin pengguna, dengan kerja yang diselesaikan secara tempatan tidak menggunakan kredit pengebilan awan.
Tugasan bermula secara setempat, dan sistem meminta kebenaran sebelum meningkatkan langkah ke model awan sempadan. Ia dilancarkan di sekitar sistem Nvidia DGX Spark dan Linux dengan GPU RTX yang cukup berkuasa - privasi dan kos tiba-tiba menjadi sebahagian daripada promosi jualan AI setempat, bukan sekadar kelajuan. (Venturebeat)
Anthropic dijangka memberitahu pelabur bahawa ia melihat potensi pendapatan lebih $30 trilion, lapor WSJ ↗
Anthropic dilaporkan sedang bersedia untuk memberitahu pelabur bahawa jumlah pasaran boleh alamatnya boleh melebihi $30 trilion. Perbezaan penting - itulah peluang tahunan teori jika AI menangkap kerja yang berkaitan, bukan Anthropic yang meramalkan ia akan terus mengaut keuntungan $30 trilion. (Reuters)
Angka yang sangat besar itu membantu membingkai perbelanjaan infrastruktur Anthropic, persaingannya dengan OpenAI dan Google, dan kisah pelabur yang lebih luas. Ia merupakan angka yang sangat besar... walaupun mengikut piawaian nombor industri AI. (Reuters)
Soalan Lazim
Apakah maksud keputusan cip Jalapeño OpenAI untuk inferens AI?
OpenAI mengatakan Jalapeño memberikan daya pemprosesan puncak yang lebih tinggi setiap kilowatt dan kependaman hujung ke hujung yang lebih rendah berbanding sistem perbandingannya semasa menjalankan GPT-OSS 120B. Keuntungan serupa dilaporkan dengan DeepSeek R1 dan Kimi K2.5. Keputusan menunjukkan OpenAI semakin mereka bentuk perkakasan berdasarkan keperluan kecekapan dan kelajuan tertentu bagi inferens AI berskala besar.
Bagaimanakah memori kongsi Claude berfungsi merentasi sembang dan Cowork?
Claude kini boleh membawa maklumat yang dipelajari dalam perbualan biasa ke dalam tugasan Cowork, sekali gus mengurangkan keperluan untuk menerangkan projek atau konteks yang sama berulang kali. Pengguna boleh memeriksa, mengedit dan memadam topik yang diingati, manakala memori tersebut boleh terus dikemas kini apabila perbualan berkembang. Menurut pengumuman yang diliputi dalam artikel tersebut, ciri ini diaktifkan secara lalai merentasi pelan Percuma, Pro dan Max.
Apakah yang boleh dilakukan oleh Gemini Enterprise untuk Perkhidmatan Perundangan dan Kewangan?
Tawaran khusus Gemini Enterprise daripada Google Cloud disasarkan kepada aliran kerja khusus industri dan bukannya sembang AI generik. Pakej perundangan ini merangkumi bidang seperti semakan kontrak, penyelidikan, pemantauan kawal selia, permintaan privasi dan penggubalan, manakala versi perkhidmatan kewangan menyokong aliran kerja termasuk penilaian risiko kredit, pemantauan portfolio, penyelidikan KYC dan analisis pasaran. Kedua-duanya juga boleh berhubung dengan data profesional dan sistem perisian sedia ada.
Mengapakah inferens AI tempatan menjadi lebih penting?
Inferens AI tempatan boleh mengukuhkan privasi, mengurangkan pergantungan pada infrastruktur awan dan berpotensi mengurangkan kos penggunaan berterusan. Jetson Orin Nano 2 Nvidia menyasarkan robot, dron dan sistem pinggir lain, manakala Komputer Mudah Alih Perplexity menyimpan model, fail dan pelaksanaan ejen pada perkakasan tempatan yang serasi. Dalam banyak aliran kerja, model awan kemudiannya boleh dikhaskan untuk tugasan yang memerlukan keupayaan tambahan.
Bagaimanakah Komputer Mudah Alih Perplexity memutuskan bila hendak menggunakan AI awan?
Tugasan direka bentuk untuk bermula pada perkakasan tempatan pengguna yang dikuasakan Nvidia, dengan memastikan pelaksanaan model dan fail yang serasi pada mesin. Jika sesuatu langkah memerlukan model awan sempadan, sistem akan meminta kebenaran daripada pengguna sebelum meningkatkannya. Kerja yang diselesaikan secara tempatan tidak menggunakan kredit pengebilan awan, menjadikan pendekatan tersebut relevan kepada pengguna yang mengambil berat tentang privasi dan kos inferens berulang.
Apakah yang dimaksudkan dengan anggaran pasaran AI bernilai $30 trilion yang dilaporkan oleh Anthropic?
Angka yang dilaporkan merujuk kepada pandangan Anthropic tentang potensi pasaran keseluruhan yang boleh ditangani untuk AI, bukan ramalan bahawa Anthropic sendiri akan menjana pendapatan tahunan sebanyak $30 trilion. Ia mewakili nilai teori kerja yang berpotensi ditangani oleh AI di seluruh ekonomi. Anggaran itu juga membantu menjelaskan mengapa syarikat AI terkemuka melabur begitu banyak dalam infrastruktur dan keupayaan perusahaan.