Laya: libreng mga desisyong System One para sa mga ahente mo, bahagi na ng Melaya at naaabot sa MCP
Bukas na modelong System One ang Laya, bahagi ng Melaya. Libre ang desisyong may tipo, walang output token: ahente, daloy ng proseso, Fast Mode, MCP.
Ang Laya ay isang modelong System One na bukas ang mga parameter, inilabas sa ilalim ng Apache-2.0. Sumasagot ito ng mga tanong na may tipo tungkol sa isang teksto at nagbabalik ng kalibradong posibilidad nang walang likhang token. Inilalathala ito ng mga awtor nito bilang pip package na laya at sa Hugging Face. Hindi ginawa ng Melaya ang Laya. Pinapatakbo ito ng Melaya sa sariling CPU nito at isinasama nang libre: sa mga kasangkapang decide, sa hakbang na decide sa canvas, sa mga Trigger ng Kaganapan, at sa mga ahente ng Fast Mode sa browser at telepono, pati mula sa Claude o ChatGPT sa pamamagitan ng MCP.
Ano ang Laya, at sino ang naglalathala nito
Ang Laya ay isang modelong System One: isang mabilis na modelong desisyon na nagbabasa ng estado, tulad ng isang email, isang post, isang pahina, o isang hilera sa listahan, at sumasagot ng mga tanong na may tipo tungkol dito. Nagbabalik ito ng kalibradong posibilidad para sa bawat opsyon at wala itong likhang token. Nagdedesisyon ito. Hindi ito sumusulat.
Bukas ang mga parameter ng Laya sa ilalim ng lisensyang Apache-2.0. Inilalathala ni NandhaKishorM ang code bilang pip package na laya, at inilalathala ng convaiinnovations ang mga parameter nito sa Hugging Face. Hindi ginawa ng Melaya ang modelo. Pinapatakbo ng Melaya ang bukas na modelong Laya sa mga server nito mismo, at itinatampok ito sa mga ahente at pipeline nito, kaya nakukuha mo ito nang walang kinakailangang paghahanda at walang bayad.
Sa kaibuturan, ang Laya ay isang ModernBERT encoder na may maliliit na decision head. May 421M parameter ang English base checkpoint, at umiiral din ang isang multilingual checkpoint. Bawat tanong ay isa sa tatlong hugis.
- choice: pumili ng isang opsyon mula sa isang hanay, tulad ng billing, technical, o sales
- score: ilagay ang estado sa 2 hanggang 10 na nakaayos na antas, tulad ng mababa, katamtaman, o mataas
- noul: isang sagot na oo o hindi, kung saan ang posibilidad mismo ang senyales
- Bawat sagot ay may answer_confidence, ang kalibradong posibilidad ng opsyong nagwagi
System One kumpara sa isang LLM: kailan gagamitin ang alin
Ang isang large language model ay System Two. Nangangatwiran ito, sumusulat, at tumatawag ng mga kasangkapan, at babayaran mo ang bawat token na nililikha nito. Ang Laya ay System One. Inilalapat nito ang parehong may-tipong paghusga sa libo-libong item, isang encoder pass kada tanong, na walang dapat pang suriin pagkatapos.
Gamitin ang LLM para magplano, sumulat, at harapin ang bukas na pangangatwiran. Gamitin ang Laya kapag ang trabaho ay ilapat ang isang paghusga sa bawat item: idirekta ang isang ticket, suriin ang isang pila, tingnan ang isang hilera sa listahan, harangan ang isang trigger. Ginagamit ng mahusay na mga pipeline ang pareho. Sumasala ang Laya, at ginugol ng LLM ang mga token nito sa kaunting item na nakaligtas.
Kilalanin ang mga limitasyon nito. Maaasahan ang Laya sa malinaw at direktang mga tanong, tulad ng kung awtomatiko ang isang sagot o kung nagtatanong ang isang mensahe tungkol sa presyo. Mahina ito sa mas banayad na kaugnayan, at inilalarawan ng mga awtor nito ang mga base checkpoint bilang mabilis na panimula na maaaring dalubhasain. Mas mahusay ang isang 2-option choice kaysa sa basta-bastang oo o hindi, at ang score ang pinakamahina sa tatlong uri.
Paano pinapatakbo ng Melaya ang Laya nang libre
Pinapatakbo ng Melaya ang Laya sa laya-local, isang internal na serbisyo na pinapanatiling laging handa ang modelo sa sariling CPU ng Melaya. Batay sa sinukat sa server ng produksyon, umaabot ng humigit-kumulang 105 ms ang isang solong desisyon sa bf16 runtime, at umaabot ng humigit-kumulang 69 ms kada desisyon ang mga batch. Bilis iyon ng CPU, hindi ng GPU, at walang babayaran ka kada desisyon.
Naaabot ito ng mga ahente sa pamamagitan ng mga built-in na kasangkapang decide. Pangunahing kasangkapan sila: walang connector, walang susi ng API, walang hakbang na Connect. Pinapanatili ng mga limitasyon sa paggamit kada user ang nakabahaging CPU na magagamit ng lahat.
- decide: tanungin ang isang estado ng isang hanay ng mga tanong na may tipo sa isang pass
- decide_check: isang minsanang harang na nagbabalik ng isang malinaw at tiyak na sagot
- decide_batch: husgahan ang maraming item gamit ang parehong mga tanong at itago ang mga nangungunang resulta
- decide_batch_file: basahin muna ang mga item mula sa isang JSON file, halimbawa, isang koleksyon ng mga post na nakalap
- Ang hakbang na decide sa canvas: isang hakbang sa pipeline na walang tawag sa LLM na maaaring itigil ang pagtakbo kapag iyon ang sinasabi ng sagot
- Mga Trigger ng Kaganapan: isang harang na decide ang maaaring suriin ang bawat papasok na kaganapan bago tumakbo ang anumang aksyon
Ang Laya sa loob ng Fast Mode at sa MCP
Pinapatakbo ng Fast Mode ang isang browser o isang Android phone nang may mas kaunting pabalik-balik sa LLM. Binabasa ng LLM ang screen nang isang pagkakataon lang at nagpapadala ng ilang hakbang sa payak na mga salita. Hinahanap ng Melaya ang bawat target, kumikilos sa pamamagitan ng normal na daan, sinusuri ang epekto, at ibinabalik ang screen sa unang hindi inaasahang pangyayari.
Una munang itinatatag ng deterministic code ang bawat target. Ang Laya ang nakaharang na pangalawang pagpipilian: kapag maluwag ang paglalarawan ng isang hakbang sa target nito, pumipili ang Laya mula sa isang maikling listahan ng mga kandidato, at kikilos lang ang Melaya kapag nalagpasan ng sagot ang hangganan ng kumpiyansa. Sinusuri din ng Laya ang mga kundisyon sa hilera ng listahan, tulad ng kung ang isang hilera ay isang partner sa isang partikular na kumpanya.
Sa pamamagitan ng MCP, naaabot ng Claude, ChatGPT, Cursor, at Claude Code ang Laya sa dalawang paraan: ang mga kasangkapan ng Fast Mode, at ang mga daloy ng proseso na pinapatakbo mo na gumagamit ng mga kasangkapang decide o ng isang hakbang na decide. Walang hiwalay na kasangkapang laya para sa MCP. Sa praktikal na usapin, ang ibig sabihin ng Laya MCP ay gumagana ang Laya sa loob ng mga kasangkapan ng Melaya MCP Server.
- MCP: melaya_browser_fast at melaya_phone_fast
- Mga Daloy ng Proseso at ang Assistant: browser_fast at phone_fast
- Ang mga patakaran mo ay nananatiling may bisa: pinahihintulutang mga site, mga card ng pag-apruba, at ang kill switch
- Android lang ang pagkontrol sa phone
Saan mismo ginagamit ng Melaya ang Laya
Pinapatakbo ng Melaya ang mga sariling tampok nito sa parehong libreng makina. Ang mga pagsumite ng backlink sa Melaya Marketing ay pumupuno ng mga form ng direktoryo gamit ang Fast Mode, kaya itinatatag ng Laya ang mga maluwag na nilarawang field kapag walang nakita ang eksaktong pagtutugma.
May layer ng paghusga ng Laya ang buong-site na SEO audit para sa mga tanong kada pahina. Nagtataas lang ng isyu ang sagot ng Laya kapag nakapasa na ang tanong nito sa isang pinatunayang hangganan ng kawastuhan. Hanggang hindi pa nito nararating ang puntong iyon, umaasa ang audit sa deterministic na mga pagsusuri at hindi kailanman nagtataas ng isyu mula sa hindi pa pinatunayang sagot ng Laya.
Ginagamit ng Melaya ang Laya bilang bantay ng sagot sa mga sariling daloy ng proseso nito para sa pag-abot. Natutukoy ng isang 2-option choice ang mga sagot na nagtatanong tungkol sa mga tuntunin sa pera, at idinidirekta sila sa isang tao.
Laya kumpara sa Jev (TypeSafe)
Ang Jev ay ang hosted na modelong System One mula sa TypeSafe. Tumatakbo ito sa mga GPU, sumasagot sa milliseconds, at sinusukat kada token laban sa iyong sariling susi ng API. Tumatakbo ang Laya sa CPU ng Melaya, umaabot ng humigit-kumulang 105 ms kada desisyon, at walang gastos.
Pareho silang gumagamit ng parehong schema: isang estado, mga tanong na may tipo, ang parehong tatlong uri. Lumilipat ang isang daloy ng trabaho mula sa mga kasangkapang jev_* patungo sa mga kasangkapang decide_* nang hindi na kinakailangang isulat muli ang isang tanong. Iba silang modelo na may ibang kalibrasyon, kaya suriin muli ang mga hangganan mo kapag lumipat ka.
- Piliin ang Laya para sa dami, para sa gastos, at para sa mga desisyon na nananatili sa sariling hardware ng Melaya
- Piliin ang Jev para sa pinakamababang pagka-antala, mababang dami, at walang nakabahaging CPU
Simulan mo ang Laya
Gumawa ng libreng Melaya account. Built-in ang mga kasangkapang decide: laging nasa Assistant ang mga ito, at idinadagdag mo ang mga ito sa kahit anong ahente nang walang kailangang ikonekta.
- Idagdag ang decide_batch sa isang ahente, o ilagay ang isang hakbang na decide sa canvas
- Isulat ang estado nang may label, at ilagay muna ang tekstong hinuhusgahan. Nababasa ng English base ang humigit-kumulang 1,100 na karakter ng estado
- Magtanong ng isang 2-option choice gamit ang maiikling paglalarawang keyword, sa halip na isang basta-bastang oo o hindi
- Iharang batay sa answer_confidence, at iangkop ang hangganan sa ilang may-label na item
- Mula sa Claude o ChatGPT, ikonekta ang Melaya MCP Server, pagkatapos patakbuhin ang daloy ng proseso mo, o pabayaan ang mga kasangkapan ng Fast Mode na tawagan ang Laya para sa iyo
Mga madalas itanong
Ginawa ba ng Melaya ang Laya?
Hindi. Bukas ang mga parameter ng Laya sa ilalim ng lisensyang Apache-2.0, at ito ay mula sa mga orihinal na awtor nito. Nasa pip ang code bilang laya, at nasa Hugging Face ang mga parameter mula sa convaiinnovations. Pinapatakbo ng Melaya ang bukas na modelo sa sariling CPU nito, at itinatampok ito sa mga ahente, mga daloy ng proseso, at Fast Mode nang libre.
Maaari ko bang gamitin ang Laya mula sa Claude o ChatGPT sa pamamagitan ng MCP?
Oo, sa pamamagitan ng Melaya MCP Server. Ginagamit ng mga kasangkapang melaya_browser_fast at melaya_phone_fast ang Laya bilang nakaharang na pangalawang pagpipilian, at pinapatakbo ang Laya ng kahit anong daloy ng proseso na pinapatakbo mo na gumagamit ng mga kasangkapang decide o ng isang hakbang na decide. Walang hiwalay na kasangkapang laya na tatawagan.
Libre ba ang Laya sa Melaya?
Oo. Pinapatakbo ng mga kasangkapang decide, ng hakbang na decide sa canvas, at ng Fast Mode ang Laya sa CPU ng Melaya nang walang bayad kada desisyon at walang susi ng API. Pinapanatiling pantay ang nakabahaging makina ng mga limitasyon sa paggamit kada user.
Gaano kabilis ang Laya?
Sa CPU ng Melaya, umaabot ng humigit-kumulang 105 ms ang isang solong desisyon, at humigit-kumulang 69 ms ang bawat desisyon sa batch. Mas mahal sa oras ang mahahabang estado, kaya panatilihing maikli ang tekstong hinuhusgahan. Sumasagot sa milliseconds ang mga makinang sinusuportahan ng GPU, tulad ng Jev.
Ano ang pagkakaiba ng Laya at Jev?
Pareho silang modelong System One na may parehong schema ng tanong. Ang Jev ay ang hosted na makina ng TypeSafe, na sinusukat kada token sa mga GPU. Bukas ang parameter ng Laya at tumatakbo itong libre sa CPU ng Melaya.
Kaya bang sumulat ng teksto ang Laya o palitan ang LLM ko?
Hindi. Nagdedesisyon lang ang Laya: pumipili ito ng isang opsyon, nagmamarka ng isang antas, o sumasagot ng oo o hindi, na walang likhang token. Panatilihin ang LLM para sa pagplano, pagsulat, at banayad na paghusga.
