LM Studio bawa GLM-5.3-Flash ke Bionic dengan imej dan Context 1 juta Token

Oleh
KOMCHAD
KOMCHAD membawakan berita terkini tentang IT, AI, telefon pintar, gajet, komputer, keselamatan siber dan inovasi.

LM Studio pantas membawa GLM-5.3-Flash ke Bionic

LM Studio menambah GLM-5.3-Flash terbaharu daripada Z.ai ke Bionic. Platform AI Agent itu kini menawarkan model yang boleh bekerja dengan teks dan imej, mengendalikan Context Window sehingga 1 juta Token serta mempunyai kos penggunaan Cloud yang jauh lebih rendah berbanding GLM-5.2.

Bionic ialah platform LM Studio untuk kerja Agentic pada Mac dan Windows. Sejak diumumkan pada pertengahan Julai, LM Studio terus menambah model dan keupayaan untuk tugasan seperti Coding, Research serta bekerja dengan dokumen dan fail. Platform ini boleh menggunakan model yang dijalankan secara Local pada komputer pengguna dan juga model yang dihoskan di Cloud.

GLM-5.3-Flash menyertai Bionic hanya beberapa jam selepas Z.ai memperkenalkan model itu secara rasmi. Sebelum pelancaran umum, ia sudah menarik perhatian ketika diuji secara anonim di OpenCode dan OpenRouter menggunakan Codename “Ox Alpha”.

Model Mixture-of-Experts 320B dengan hanya 18B Active Parameters

GLM-5.3-Flash dibina sebagai model Mixture-of-Experts dengan jumlah 320 bilion Parameters, tetapi hanya 18 bilion Parameters aktif semasa Inference. Perbezaan ini penting kerana seni bina MoE membolehkan model keseluruhan yang sangat besar digunakan sambil hanya mengaktifkan bahagian tertentu untuk setiap permintaan.

Berdasarkan spesifikasi yang diketengahkan dalam pengumuman, model menyokong Text dan Image Input. Ini membolehkan integrasi Bionic digunakan untuk Workflow yang lebih luas daripada teks sahaja, termasuk tugasan apabila Agent perlu mentafsir maklumat visual bersama arahan bertulis atau dokumen.

Model itu turut menyokong Context Window sehingga 1 juta Token. Kapasiti sebesar ini membolehkan jauh lebih banyak bahan berada dalam satu Session berbanding model dengan Context pendek, menjadikannya relevan untuk Research, Codebase besar dan Agent Workflow yang melibatkan banyak dokumen.

Image Input meluaskan jenis maklumat yang boleh digunakan Bionic Agent

Sokongan Image Input ialah antara tambahan paling praktikal pada GLM-5.3-Flash. Bionic direka untuk Agentic Task dan bukan sekadar Chatbot soal jawab, jadi Multimodal Input memberikan Agent satu lagi jenis maklumat untuk diperiksa ketika menyelesaikan tugasan.

Sebagai contoh, sesuatu Workflow boleh menggabungkan arahan bertulis dengan Screenshot, Diagram atau Visual Material lain. Sumber asal tidak mendakwa semua kemungkinan tugasan visual disokong, namun penambahan Image Input jelas meluaskan jenis maklumat yang boleh diterima model berbanding Setup Text-only.

Keupayaan ini melengkapkan fokus sedia ada Bionic terhadap Coding, Research, Documents dan Files, sambil menyediakan satu lagi pilihan model apabila tugasan memerlukan Text Context dan Visual Input pada masa yang sama.

Context 1 juta Token menyasarkan beban kerja besar dan kompleks

Context Window 1 juta Token ialah satu lagi bahagian utama GLM-5.3-Flash. Context menentukan jumlah maklumat yang boleh dipertimbangkan model dalam satu Request atau Session, maka Window yang lebih besar berguna apabila Agent perlu mengekalkan sejumlah besar bahan.

Dalam penggunaan sebenar, ini boleh membantu ketika bekerja dengan dokumen panjang, banyak fail, bahan Research yang besar atau bahagian luas sebuah Codebase. Context yang besar tidak secara automatik menjamin jawapan lebih baik, tetapi memberi ruang untuk memasukkan lebih banyak Source Material tanpa perlu terus membahagikan semuanya kepada bahagian kecil.

Bagi Bionic yang diposisikan sebagai platform Agent untuk kerja berbilang langkah, kapasiti ini sangat relevan kerana Agentic Workflow sering perlu mengekalkan maklumat daripada langkah terdahulu untuk digunakan pada langkah seterusnya.

LM Studio berkata kosnya 9–10 kali lebih rendah daripada GLM-5.2

Kos ialah satu lagi perkara penting dalam pengumuman. LM Studio berkata GLM-5.3-Flash boleh dijalankan pada kos 9–10 kali lebih rendah daripada GLM-5.2, sambil mengatasi GLM-5.2 dalam perbandingan Performance yang diketengahkan Z.ai.

Kelebihan harga penting untuk Agentic Workflow kerana satu Agent mungkin membuat banyak panggilan model ketika melakukan Research, membaca fail, menulis Code atau menyiapkan tugasan berbilang langkah. Apabila jumlah Model Calls meningkat, Inference Cost yang lebih rendah boleh memberi kesan lebih besar terhadap kos keseluruhan.

LM Studio menjadikan gabungan Performance, Multimodal Input, Long Context dan kos lebih rendah sebagai sebab utama GLM-5.3-Flash merupakan tambahan penting kepada Bionic dan bukan sekadar satu lagi model dalam senarai.

Cloud Inference menggunakan Server AS dengan Zero Data Retention

Bionic menyokong model yang dijalankan secara Local dan juga Cloud Models. Bagi GLM-5.3-Flash dalam Bionic, LM Studio berkata model itu disediakan melalui Server yang berpangkalan di Amerika Syarikat dan Zero Data Retention diaktifkan secara Default.

Ini berbeza daripada menjalankan model sepenuhnya pada komputer Local, apabila Inference boleh kekal pada Hardware pengguna sendiri. Apabila memilih Cloud Model, beban kerja dihantar ke Remote Infrastructure, jadi polisi Zero Data Retention yang dinyatakan LM Studio menjadi bahagian penting dalam penerangan pilihan Cloud.

Perbezaan ini turut mencerminkan pendekatan Bionic secara keseluruhan: pengguna tidak terikat kepada satu kaedah Deployment dan boleh memilih Local atau Cloud Inference mengikut model, keperluan Hardware dan Workflow.

GLM-5.3-Flash menyertai barisan model Bionic yang berkembang pesat

LM Studio mengembangkan Bionic dengan pantas sejak platform itu diumumkan pada pertengahan Julai. Tidak lama selepas pelancaran, syarikat menambah sokongan untuk Kimi K3 daripada Moonshot AI, dan kini GLM-5.3-Flash menjadi satu lagi Cloud Model untuk kerja Agentic.

Menurut perbandingan Benchmark yang dirujuk 9to5Mac, GLM-5.3-Flash mengatasi GLM-5.2 dalam ujian yang diketengahkan Z.ai dan secara umum berada dalam lingkungan yang sama dengan Frontier Models daripada Anthropic, OpenAI, Google dan DeepSeek. Benchmark tidak bermakna model berbeza boleh saling menggantikan dalam semua tugasan, tetapi ia membantu menjelaskan mengapa GLM-5.3-Flash sudah mendapat perhatian sebelum pelancaran rasmi.

Bagi pengguna LM Studio, perkara yang lebih langsung ialah gabungan yang kini tersedia dalam Bionic: Text dan Image Input, Context Window 1 juta Token, seni bina Mixture-of-Experts berskala besar serta kos Cloud yang menurut LM Studio jauh lebih rendah daripada GLM-5.2.

Kongsi artikel ini
Ikuti:
KOMCHAD membawakan berita terkini tentang IT, AI, telefon pintar, gajet, komputer, keselamatan siber dan inovasi.
Tinggalkan komen