Dikuasakan oleh
Featured

Meta Melancarkan Muse Glimmer untuk Ejen AI Tempatan pada Peranti Peribadi

Meta melancarkan Muse Glimmer, sebuah model AI yang boleh dijalankan pada komputer peribadi dan bukannya bergantung sepenuhnya pada pelayan awan. Ia boleh membantu pengguna mengurus fail, menulis kod dan menyelesaikan tugasan berbilang langkah walaupun tanpa sambungan internet.

DITULIS OLEH
KONGSI
Meta Melancarkan Muse Glimmer untuk Ejen AI Tempatan pada Peranti Peribadi

Pengambilan Utama

  • Muse Glimmer ialah model 30 bilion parameter yang dibina untuk ejen AI tempatan.
  • Meta menerbitkan pemberat model Muse Glimmer di bawah lesen Apache 2.0.
  • Model ini boleh dijalankan pada Mac atau PC dengan satu GPU pengguna.

Muse Glimmer Membawa Ejen AI Terus Ke Perkakasan Pengguna

Meta Superintelligence Labs, bahagian penyelidikan AI lanjutan syarikat, pada 10 Ogos melancarkan Muse Glimmer sebagai model agentik berbobot terbuka yang direka untuk berjalan terus pada peranti peribadi, dengan menerbitkan pemberatnya di bawah lesen Apache 2.0 yang permisif. Pemberat terbuka membolehkan pembangun memuat turun parameter asas sesebuah model, manakala istilah agentik merujuk kepada sistem yang menyiapkan tugasan berbilang langkah menggunakan alat dengan input manusia yang terhad. Model ini disuling daripada Muse Spark, model tertutup Meta yang lebih besar, dan berjalan pada Mac atau PC dengan satu unit pemprosesan grafik pengguna, atau GPU.

Syarikat menyatakan:

“Muse Glimmer ialah model 30 bilion parameter yang dioptimumkan untuk aliran kerja ejen tempatan yang sentiasa aktif.”

Muse Glimmer menyiapkan tugasan dari awal hingga akhir, menggunakan alat perisian, menulis kod, mengikuti pelbagai langkah penaakulan dan pulih apabila tindakan yang dicuba gagal. Model ini memproses teks dan imej, mengendalikan data merentas lebih daripada 100 bahasa, dan menunjukkan prestasi kukuh bagi kelas saiznya berbanding Gemma4-31B dan Qwen3.6-27B merentas penanda aras agentik, pengekodan, multimodal, keselamatan dan penaakulan, menurut Meta.

Ejen AI berbeza daripada chatbot konvensional melalui keupayaan mereka untuk melaksanakan tugasan, menggunakan alat luaran dan membuat keputusan merentas aliran kerja yang panjang dengan tahap autonomi yang berbeza-beza.

Meta Memampatkan Model 30 Bilion Parameter Ke Bawah 20 GB

Menjalankan model sebesar Muse Glimmer pada perkakasan pengguna memerlukan Meta mengurangkan keperluan memori sambil mengekalkan prestasi merentas tugasan yang dikendalikan oleh ejen AI. Model 30 bilion parameter pada ketepatan penuh akan melebihi 55 GB, tetapi kuantisasi 4-bit, yang menyimpan data model dalam format numerik yang lebih padat, mengecilkan model bahasa itu kepada di bawah 20 GB dan memuatkan komponennya dalam lingkungan 24 GB atau 32 GB.

Sebuah model pengiring yang lebih kecil yang dihantar bersama Muse Glimmer meramalkan potongan teks yang akan datang, membolehkan model utama mengesahkan beberapa ramalan serentak dan memberi respons lebih pantas. Teknik ini, dikenali sebagai penyahkodan spekulatif, meningkatkan kelajuan penjanaan sebanyak 3.1 kali pada RTX 5090, 1.8 kali pada M5 Max dan 1.5 kali pada M4 Max dalam ujian syarikat.

Dorongan ke arah ejen tempatan hadir ketika Meta memperluas perbelanjaan dan menyusun semula pasukan di sekitar produk AI autonomi serta kitaran pembangunan yang lebih pantas. Perbelanjaan modal bagi 2026 dijangka mencecah $130 bilion hingga $145 bilion, julat yang dikecilkan daripada $125 bilion hingga $145 bilion apabila syarikat melaporkan keputusan suku kedua pada 29 Julai.

Kira-kira 7,000 pekerja dipindahkan ke empat organisasi berfokus AI pada Mei, termasuk Applied AI Engineering dan pasukan Agent Transformation Accelerator, manakala sekitar 8,000 pekerja diberhentikan dan 6,000 peranan kosong ditutup. Meta kemudian memberitahu kakitangan yang dipindahkan bahawa mereka boleh memutuskan sama ada untuk kekal.

Pemprosesan Tempatan Mengurangkan Kebergantungan Pada Akses Awan Berterusan

Mengekalkan aliran kerja ejen pada perkakasan peribadi mengelakkan penghalaan setiap permintaan melalui pusat data jauh, membolehkan tugasan diteruskan apabila sambungan terhad atau tidak tersedia. Pelaksanaan tempatan juga sesuai untuk kes penggunaan yang dibina pada konteks tersimpan seperti jadual, mesej dan fail, di mana model bertindak ke atas data peribadi merentas sesi yang berpanjangan.

Piawaian keselamatan semakin relevan apabila perisian autonomi diberikan kebenaran untuk berinteraksi dengan akaun, aplikasi dan maklumat sensitif. National Institute of Standards and Technology melancarkan Inisiatif Piawaian Ejen AI yang merangkumi komunikasi selamat antara ejen, identiti digital yang boleh dipercayai, kawalan akses dan piawaian teknikal umum.

Meta menekankan:

“Menjalankan model secara tempatan membolehkan anda menggunakan AI di mana-mana, bila-bila masa, dengan atau tanpa sambungan internet.”

Selain model tempatan, Meta telah beralih kepada platform yang dibina di sekitar interaksi antara ejen perisian bebas. Syarikat itu memperoleh Moltbook pada Mac, sebuah rangkaian sosial ejen AI dengan lebih daripada 206,000 ejen yang disahkan manusia daripada hampir 2.9 juta akaun berdaftar setakat Jun, dan membawa pengasas bersamanya ke Meta Superintelligence Labs.

Muse Glimmer Sejajar Dengan Dorongan Lebih Luas Meta Untuk AI Yang Tersedia Secara Meluas

Mark Zuckerberg, ketua pegawai eksekutif Meta, secara berasingan menggariskan strategi pada 10 Ogos untuk mengagihkan superintelligence peribadi secara meluas dan menyediakan versi percuma kepada berbilion orang. Zuckerberg menyatakan dalam video Instagram yang dikongsi pada hari yang sama bahawa Meta juga akan membuka pemberat untuk Muse Spark 1.2, membingkai langkah tersebut dalam sebuah esei 6,500 patah perkataan sebagai jawapan kepada penerbitan berbobot terbuka daripada pembangun China.

Menyokong model yang semakin berkeupayaan masih memerlukan pengkomputeran terpusat yang luas untuk latihan walaupun model siap berjalan pada peranti pengguna sendiri. Meta menandatangani perjanjian lima tahun dengan Nebius bernilai sehingga $27 bilion, termasuk $12 bilion dalam kapasiti khusus dan pilihan untuk tambahan $15 bilion.

Pembangun boleh memuat turun pemberat Muse Glimmer sekarang, manakala sokongan yang dioptimumkan untuk llama.cpp, MLX dan ExecuTorch, perisian yang digunakan untuk menjalankan model AI dengan cekap merentas perkakasan berbeza, dijangka dalam beberapa hari akan datang. Meta juga bekerjasama dengan AMD, Arm, Dell, Intel dan Nvidia untuk mengoptimumkan prestasi merentas peranti.

Artikel ini telah diterjemahkan daripada bahasa Inggeris menggunakan AI. Versi asal dalam bahasa Inggeris ialah sumber yang berwibawa; terjemahan automatik mungkin mengandungi ketidaktepatan, terutamanya dalam terminologi undang-undang dan kawal selia.