Laya: бесплатные решения System One для твоих агентов, встроенные в Melaya и доступные через MCP
Laya: открытая модель решений System One, встроенная в Melaya. Бесплатные типизированные решения с нулём токенов вывода в агентах, конвейерах, Fast Mode и MCP.
Laya является моделью System One с открытыми весами, выпущенной по лицензии Apache-2.0. Она отвечает на типизированные вопросы о фрагменте текста и возвращает калиброванные вероятности, не генерируя ни одного токена. Авторы публикуют её как pip-пакет laya и на Hugging Face. Melaya не создавала Laya. Melaya запускает её на собственном CPU и бесплатно встраивает в инструменты decide, шаг decide на холсте, триггеры событий и агентов Fast Mode для браузера и телефона, в том числе из Claude или ChatGPT через MCP.
Что такое Laya и кто её публикует
Laya относится к моделям System One. Это быстрая модель принятия решений, которая читает состояние, например письмо, пост, страницу или строку списка, и отвечает на типизированные вопросы о нём. Она возвращает калиброванную вероятность для каждого варианта и не генерирует ни одного токена. Она решает. Она не пишет.
Laya распространяется с открытыми весами по лицензии Apache-2.0. NandhaKishorM публикует код как pip-пакет laya, а convaiinnovations публикует веса на Hugging Face. Melaya не создавала эту модель. Melaya запускает открытую модель Laya на собственных серверах и встраивает её в своих агентов и конвейеры, так что ты получаешь её без настройки и без счетов.
Внутри Laya устроена как энкодер ModernBERT с небольшими решающими головами. Базовый английский чекпоинт содержит 421M параметров, также существует многоязычный чекпоинт. Каждый вопрос принимает одну из трёх форм.
- choice: выбор одного варианта из набора, например биллинг, техническая поддержка или продажи
- score: размещение состояния на шкале от 2 до 10 упорядоченных уровней, например низкий, средний или высокий
- noul: ответ да или нет, где сигналом служит сама вероятность
- Каждый ответ содержит answer_confidence, то есть калиброванную вероятность победившего варианта
System One против LLM: когда что использовать
Большая языковая модель (LLM) относится к System Two. Она рассуждает, пишет и вызывает инструменты, и ты платишь за каждый сгенерированный токен. Laya относится к System One. Она применяет одно и то же типизированное решение к тысячам элементов, один проход энкодера на вопрос, и после этого ничего не нужно разбирать.
Используй LLM для планирования, написания текста и открытых рассуждений. Используй Laya, когда нужно применить одно и то же решение к каждому элементу: маршрутизировать тикет, отсеять очередь, проверить строку списка, решить, должен ли сработать триггер. Хорошие конвейеры используют и то, и другое. Laya отфильтровывает, а LLM тратит свои токены только на те немногие элементы, что прошли отбор.
Знай её ограничения. Laya надёжна на конкретных поверхностных вопросах, например, автоматический ли это ответ или спрашивает ли сообщение о цене. Она слабее на тонких вопросах релевантности, и авторы описывают базовые чекпоинты как быструю основу для дальнейшей специализации. Choice с двумя вариантами работает лучше простого да или нет, а score остаётся самым слабым из трёх типов.
Как Melaya бесплатно запускает Laya
Melaya запускает Laya во внутреннем сервисе laya-local, который держит модель прогретой на собственном CPU Melaya. По замерам на продакшен-сервере, одно решение занимает около 105 мс в режиме bf16, а пакетная обработка занимает около 69 мс на решение. Это скорость CPU, а не GPU, и ты не платишь ничего за решение.
Агенты получают доступ к ней через встроенные инструменты decide. Это базовые инструменты: без коннектора, без API-ключа, без этапа подключения. Лимиты запросов на пользователя обеспечивают доступность общего CPU для всех.
- decide: задать одному состоянию набор типизированных вопросов за один проход
- decide_check: разовая проверка, которая возвращает один чёткий ответ
- decide_batch: оценить множество элементов по одним и тем же вопросам и сохранить лучшие результаты
- decide_batch_file: сначала прочитать элементы из файла JSON, например собранные посты
- Шаг decide на холсте: шаг конвейера без вызова LLM, который может остановить запуск, если это подсказывает ответ
- Триггеры событий: фильтр decide может отсеивать каждое входящее событие до того, как сработает любое действие
Laya внутри Fast Mode и через MCP
Fast Mode управляет браузером или Android-телефоном с гораздо меньшим числом обращений к LLM. LLM один раз считывает экран и передаёт несколько шагов простыми словами. Melaya находит каждую цель, действует обычным способом, проверяет результат и возвращает управление при первой неожиданности.
Детерминированный код сначала привязывает каждую цель к элементу интерфейса. Laya служит запасным вариантом с проверкой: когда шаг описывает цель нечётко, Laya выбирает из короткого списка кандидатов, и Melaya действует только тогда, когда ответ превышает порог уверенности. Laya также проверяет условия в строках списков, например, является ли строка партнёром в заданной фирме.
Через MCP Claude, ChatGPT, Cursor и Claude Code обращаются к Laya двумя способами: через инструменты Fast Mode и через конвейеры, которые используют инструменты decide или шаг decide. Отдельного MCP-инструмента laya не существует. На практике Laya MCP означает, что Laya работает внутри инструментов Melaya MCP Server.
- MCP: melaya_browser_fast и melaya_phone_fast
- Конвейеры и Assistant: browser_fast и phone_fast
- Твои правила продолжают действовать: разрешённые сайты, карточки подтверждения и аварийный выключатель
- Управление телефоном доступно только на Android
Где сама Melaya использует Laya
Melaya использует этот же бесплатный движок в своих собственных функциях. Отправка обратных ссылок в Melaya Marketing заполняет формы каталогов через Fast Mode, и Laya привязывает нечётко описанные поля, когда точное совпадение не находит ничего.
Полный SEO-аудит сайта включает слой решений Laya для вопросов по каждой странице. Ответ Laya поднимает проблему только тогда, когда его вопрос проходит проверенный порог точности. До этого аудит полагается на детерминированные проверки и никогда не поднимает проблему на основе непроверенного ответа Laya.
Собственные outreach-конвейеры Melaya используют Laya как фильтр ответов. Choice с двумя вариантами выявляет ответы, где спрашивают о финансовых условиях, и направляет их человеку.
Laya против Jev (TypeSafe)
Jev: хостируемая модель System One от TypeSafe. Она работает на GPU, отвечает за миллисекунды и тарифицируется за токен по твоему собственному API-ключу. Laya работает на CPU Melaya, занимает около 105 мс на решение и не стоит ничего.
Обе модели используют одну и ту же схему: одно состояние, типизированные вопросы, одни и те же три типа. Рабочий процесс переходит от инструментов jev_* к инструментам decide_* без переписывания вопроса. Это разные модели с разной калибровкой, так что при переходе проверь свои пороги заново.
- Выбирай Laya для объёма, экономии и решений, которые остаются на собственном оборудовании Melaya
- Выбирай Jev для минимальной задержки, небольших объёмов и когда не нужен общий CPU
Начни работу с Laya
Создай бесплатный аккаунт Melaya. Инструменты decide встроены: они всегда доступны в Assistant, и ты добавляешь их в любого агента без необходимости что-либо подключать.
- Добавь decide_batch агенту или помести шаг decide на холст
- Сначала напиши размеченное состояние с оцениваемым текстом. Английская базовая модель обрабатывает около 1 100 символов состояния
- Задавай choice с двумя вариантами и короткими описаниями-ключевыми словами вместо простого да или нет
- Фильтруй по answer_confidence и подбирай порог на нескольких размеченных примерах
- Из Claude или ChatGPT подключи Melaya MCP Server, затем запусти свой конвейер или дай инструментам Fast Mode самим вызвать Laya
Часто задаваемые вопросы
Laya создана Melaya?
Нет. Laya создали её исходные авторы и выпустили с открытыми весами по лицензии Apache-2.0. Код доступен на pip как laya, а веса опубликованы на Hugging Face от convaiinnovations. Melaya бесплатно запускает открытую модель на собственном CPU и встраивает её в агентов, конвейеры и Fast Mode.
Могу я использовать Laya из Claude или ChatGPT через MCP?
Да, через Melaya MCP Server. Инструменты melaya_browser_fast и melaya_phone_fast используют Laya как запасной вариант с проверкой, а любой запускаемый тобой конвейер, который использует инструменты decide или шаг decide, запускает Laya. Отдельного инструмента laya для вызова не существует.
Laya бесплатна в Melaya?
Да. Инструменты decide, шаг decide на холсте и Fast Mode запускают Laya на CPU Melaya без платы за решение и без API-ключа. Лимиты запросов на пользователя обеспечивают честное распределение общего движка.
Насколько быстра Laya?
На CPU Melaya одно решение занимает около 105 мс, а пакетные решения занимают около 69 мс каждое. Длинные состояния стоят дороже, поэтому держи оцениваемый текст коротким. Движки на GPU, такие как Jev, отвечают за миллисекунды.
В чём разница между Laya и Jev?
Обе модели относятся к System One и используют одну и ту же схему вопросов. Jev является хостируемым движком TypeSafe с оплатой за токен на GPU. Laya распространяется с открытыми весами и бесплатно работает на CPU Melaya.
Может ли Laya писать текст или заменить мою LLM?
Нет. Laya только принимает решения: выбирает вариант, оценивает уровень или отвечает да или нет, не генерируя ни одного токена. Оставь LLM для планирования, написания текста и тонких суждений.
