LM Studio idinagdag ang GLM-5.3-Flash sa Bionic na may image support at 1M-token context

Ni
KOMCHAD
Inihahatid ng KOMCHAD ang pinakabagong balita sa IT, AI, smartphones, gadgets, computers, cybersecurity, at innovation.

Mabilis na dinala ng LM Studio ang GLM-5.3-Flash sa Bionic

Idinagdag ng LM Studio sa Bionic ang bagong GLM-5.3-Flash ng Z.ai. Dahil dito, may bagong Model ang AI Agent Platform na kayang humawak ng parehong text at images, may Context Window na hanggang 1 milyong tokens, at may Cloud cost na mas mababa nang malaki kumpara sa GLM-5.2.

Ang Bionic ang Platform ng LM Studio para sa Agentic work sa Mac at Windows. Mula nang una itong ianunsyo noong kalagitnaan ng Hulyo, patuloy na nagdagdag ang LM Studio ng mga Model at kakayahang nakatuon sa Coding, Research, at pagtatrabaho sa Documents at Files. Maaaring gumamit ang Platform ng mga Model na tumatakbo nang Local sa sariling computer ng user, pati na rin ng mga Model na naka-host sa Cloud.

Dumating ang GLM-5.3-Flash sa Bionic ilang oras lamang matapos itong opisyal na ilunsad ng Z.ai. Bago pa ang public release, nakakuha na ito ng pansin habang sinusubukan nang anonymous sa OpenCode at OpenRouter sa ilalim ng Codename na “Ox Alpha”.

320B Mixture-of-Experts Model pero 18B lang ang Active Parameters

Ang GLM-5.3-Flash ay isang Mixture-of-Experts Model na may kabuuang 320 bilyong Parameters, ngunit 18 bilyong Parameters lamang ang Active habang ginagawa ang Inference. Mahalaga ang pagkakaibang ito dahil kayang magkaroon ng MoE Architecture ng napakalaking kabuuang Model habang pinapagana lamang ang bahaging kailangan para sa bawat Request.

Ayon sa Specifications na itinampok sa announcement, sinusuportahan ng Model ang parehong Text at Image Input. Dahil dito, hindi limitado sa text ang paggamit nito sa Bionic at maaari itong gamitin sa Workflows kung saan kailangang unawain ng Agent ang visual information kasabay ng written instructions o Documents.

Sinusuportahan din ng Model ang Context Window na hanggang 1 milyong tokens. Sa ganitong laki, mas maraming materyal ang maaaring manatili sa iisang working Session kumpara sa mga Model na may maikling Context, na mahalaga para sa Research, malalaking Codebase at Agent Workflows na maraming Documents.

Pinalalawak ng Image Input ang impormasyong kayang gamitin ng Bionic Agents

Isa sa pinaka-praktikal na dagdag sa GLM-5.3-Flash ang Image Input. Dinisenyo ang Bionic para sa Agentic Tasks at hindi lamang bilang simpleng question-and-answer Chatbot, kaya nagbibigay ang Multimodal Input ng isa pang uri ng impormasyong maaaring suriin ng Agent habang ginagawa ang isang Task.

Halimbawa, maaaring pagsamahin sa isang Workflow ang written instructions, Screenshots, Diagrams at iba pang Visual Material. Hindi sinasabi ng source na saklaw nito ang lahat ng posibleng visual tasks, ngunit malinaw na pinalalawak ng Image Input ang uri ng impormasyong maaaring tanggapin ng Model kumpara sa isang Text-only Setup.

Kaakibat ito ng kasalukuyang focus ng Bionic sa Coding, Research, Documents at Files, at nagbibigay ng isa pang Model option kapag kailangan ng Task ang parehong Text Context at Visual Input.

Ang 1M-token context ay para sa malalaki at komplikadong workload

Isa pang pangunahing bahagi ng GLM-5.3-Flash ang 1 milyong Token Context Window. Ang Context ang nagtatakda kung gaano karaming impormasyon ang maaaring isaalang-alang ng Model sa loob ng isang Request o Session, kaya mahalaga ang mas malaking Window kapag kailangang subaybayan ng Agent ang maraming materyal.

Sa aktuwal na paggamit, maaari itong makatulong sa mahahabang Documents, maraming Files, malalaking Research materials o malawak na bahagi ng isang Codebase. Hindi awtomatikong nangangahulugan ang malaking Context na magiging mas mahusay ang sagot, ngunit nagbibigay ito ng mas malaking puwang para sa Source Material nang hindi kailangang hatiin agad ang lahat sa maliliit na bahagi.

Para sa Bionic na nakaposisyon bilang Agent Platform para sa multi-step work, mahalaga ang kapasidad na ito dahil madalas kailangang panatilihin ng Agentic Workflows ang impormasyong nakuha sa mga naunang hakbang upang magamit sa mga susunod.

Ayon sa LM Studio, 9–10 beses na mas mura kaysa GLM-5.2

Isa ring malaking bahagi ng announcement ang cost. Ayon sa LM Studio, maaaring 9 hanggang 10 beses na mas mura patakbuhin ang GLM-5.3-Flash kaysa GLM-5.2, habang nalalampasan din nito ang GLM-5.2 sa Performance comparisons na itinampok ng Z.ai.

Mahalaga ang mas mababang presyo sa Agentic Workflows dahil maaaring gumawa ang isang Agent ng maraming Model Calls habang nagsasagawa ng Research, nagbabasa ng Files, nagsusulat ng Code o tinatapos ang isang multi-stage Task. Habang dumarami ang Model Calls, mas nagiging kapansin-pansin ang epekto ng mas mababang Inference Cost sa kabuuang gastos.

Kaya itinatampok ng LM Studio ang kombinasyon ng Performance, Multimodal Input, Long Context at mas mababang cost bilang pangunahing dahilan kung bakit mahalagang dagdag ang GLM-5.3-Flash sa Bionic at hindi lamang isa pang Model sa catalog.

US-based Servers ang gamit sa Cloud Inference na may Zero Data Retention

Sinusuportahan ng Bionic ang parehong Local Models at Cloud Models. Para sa GLM-5.3-Flash sa Bionic, sinabi ng LM Studio na inihahatid ang Model mula sa Servers na nasa United States at naka-enable bilang default ang Zero Data Retention.

Iba ito sa pagpapatakbo ng Model nang buo sa isang Local computer, kung saan maaaring manatili sa sariling Hardware ng user ang Inference. Kapag Cloud Model ang pinili, ipinapadala ang Workload sa Remote Infrastructure, kaya mahalagang bahagi ng paglalarawan ng Cloud option ang Zero Data Retention policy na binanggit ng LM Studio.

Ipinapakita rin ng pagkakaibang ito ang mas malawak na approach ng Bionic: hindi limitado ang user sa iisang Deployment model at maaaring pumili sa pagitan ng Local at Cloud Inference depende sa Model, Hardware requirements at Workflow.

Sumali ang GLM-5.3-Flash sa mabilis na lumalaking Bionic model lineup

Mabilis na pinalalawak ng LM Studio ang Bionic mula nang ianunsyo ang Platform noong kalagitnaan ng Hulyo. Hindi nagtagal matapos ilunsad ang Bionic, idinagdag ng kumpanya ang suporta para sa Kimi K3 ng Moonshot AI, at ngayon ay isa na ring Cloud Model para sa Agentic work ang GLM-5.3-Flash.

Ayon sa Benchmark comparisons na binanggit ng 9to5Mac, mas mataas ang score ng GLM-5.3-Flash kaysa GLM-5.2 sa mga tests na itinampok ng Z.ai at sa pangkalahatan ay nasa kaparehong malawak na range ng Frontier Models mula sa Anthropic, OpenAI, Google at DeepSeek. Hindi ibig sabihin ng Benchmarks na maaaring pagpalitin ang magkakaibang Model sa lahat ng Task, ngunit nakatutulong itong ipaliwanag kung bakit nakakuha ng pansin ang GLM-5.3-Flash bago pa ang opisyal na release.

Para sa mga gumagamit ng LM Studio, mas direktang mahalaga ang kombinasyong available na ngayon sa Bionic: Text at Image Input, 1 milyong Token Context Window, malaking Mixture-of-Experts Architecture at Cloud cost na ayon sa LM Studio ay mas mababa nang malaki kaysa GLM-5.2.

Ibahagi ang artikulong ito
Sundan:
Inihahatid ng KOMCHAD ang pinakabagong balita sa IT, AI, smartphones, gadgets, computers, cybersecurity, at innovation.
Mag-iwan ng komento