Лаборатория могла бы это собрать. Почему всё равно может не выпустить.
15 сентября 2026 года TypeSafe выпустил Jev, тогда ещё в early access. Здесь официальная цена и рассказ об обучении стоят рядом с прайсом действующих игроков: почему модель суждения с бесплатным выходом сталкивается с продажей длинного вывода по token.
Соавтор: folkbench.com (Folkbench — проверяемая платформа оценки и выбора для API ИИ, модельных сервисов и связанных сайтов. Она опирается на опубликованные сведения о сервисе, цены, доступность, задержку и окна доказательств, чтобы помочь пользователям сравнить варианты и выбрать путь.)
Десять текстов в этой серии:
- JEV - Суставу не нужен мозг
- JEV - Почему Jev, который не умеет общаться, подходит Agent
- JEV - Как далеко на самом деле заходит «не может галлюцинировать»
- JEV - Хватает ли «да или нет», выбора и уровня на язык?
- JEV - Лаборатория могла бы это собрать. Почему всё равно может не выпустить.
- JEV - Два demo, которые я прогнал
- JEV - Люди отходят от середины цикла к краю
- JEV - За этой чертой я уже не различаю, кто умнее
- JEV - Некоторые вопросы ему не принадлежат
- JEV - Предельно простая модель, комплект и одна, которая не говорит
15 сентября 2026 года TypeSafe выпустил Jev, и он всё ещё был в early access. Это их первая модель System One. Она только выносит суждения. На болтовню она не опирается. Основатель, Diogo Almeida, раньше занимался следованием инструкциям в OpenAI, на том исследовании, которое стало ChatGPT.
У самого Jev нет технического рва. Любая модельная лаборатория с маленькой командой могла бы сделать свою версию за полмесяца. Технически ничего не загораживает.
Официальная работа действительно сделала кое-что новое. Они построили новую архитектуру. Сэмплер параллельный: один запрос заканчивает суждение, не порождая token за token. Они построили отдельный метод обучения, называется RLCD, обучение с подкреплением на калиброванных решениях. Уверенность, которую сообщает модель, должна совпадать с долей поздних решений, которые верны. Это их реализация. Что стал бы копировать кто-то другой — форму продукта: не генерировать строки и выдавать калиброванные вероятности только на закрытых вопросах. Вопрос зафиксирован заранее, модель возвращает суждение с вероятностью, и код ветвится по этому числу. Полмесяца копирует эту форму. Это не копирует исследование TypeSafe как оно есть. Тому, кто копирует, не надо сначала разбирать это исследование.
Ров заявить трудно. Когда форма зафиксирована, реализацию можно заменить целиком. После замены система, в которую она втыкается, всё ещё получает одно и то же: впереди state, позади суждение.
Продукт чат-модели — строка. Строку можно написать очень длинной, и программе, которой эта строка на самом деле нужна, надо разобрать её ещё раз. Jev строк не производит. Без того отрезка текста, который можно удлинять, у выхода нет счёта, который растёт с длиной.
Прайс действующих игроков
Цена делает это ясным. Вход Jev — $0.042 за миллион token, почти бесплатно, и выход бесплатный. Официально говорят, что выход слишком дёшев, чтобы его мерить. Они также признают, что не могут доказать, будто эта цена не субсидирована. На долгой дистанции они ждут, что цена пойдёт вниз, а не вверх.
Прайс действующих игроков — другой конец. Вход идёт от $0.20 до $10 за миллион token, а выход ещё примерно в пять раз дороже. Деньги чат-модели сидят на длинном выходе. Ответ, чтобы человек прочитал, и шаги, которые Agent продолжает выполнять, оба надо записать текстом. Когда текст длинный, деньги ложатся на сторону выхода. Даже если вход прижат очень низко, одна длинная запись всё ещё основная масса вызова.
Две стороны не сходятся. Действующие игроки продают token. Модель, у которой выход бесплатный, а вход почти бесплатный, съедает торговлю token.
Конфликт структурный. Чем шире используется модель суждения с бесплатным выходом, тем меньше людей покупает token, которые раньше значили «пусть большая модель классифицирует, маршрутизирует и оценивает». Отчёт о расходах сверяют с чеком, и кто-то должен судить, совпадает ли описание с уликой. Срабатывает тревога безопасности, и кто-то должен судить, изолирована ли эта машина сейчас. Суставы такого рода раньше отдавали целиком чат-модели, она писала причину, после чего вывод выкапывали из текста. Выкопанный текст тарифицируется как выход, по более дорогому ярусу. Закрытый вопрос отдаёт суждение напрямую. Обратно приходит набор вероятностей, длина зафиксирована заранее, и нет текста, который можно продолжать писать вниз. Причину можно не писать, и этому ярусу платы некуда лечь.
Что действующий игрок повреждает — собственный отчёт. Чем шире используется модель, тем быстрее падает старая колонка. Это бизнес, который входит снизу. Дешёвое суждение едет вместе с потоком и заменяет мелкие решения, которые раньше звали большую модель. Заменяется не тот вызов сверху, который пишет длинный кусок. Заменяется мелкое решение, которое надо принять на половине потока. Вызовы, которые всё ещё надо медленно выписывать, всё ещё можно продать. Официальное ожидание, что их собственная цена продолжит падать, не заполняет колонку, которую действующий игрок потерял.
Имя Jev взято у William Stanley Jevons. Официальная аналогия — уголь и паровая машина. После того как паровая машина подняла эффективность сжигания угля, угля не стали жечь меньше. Его стали жечь больше. Эффективность растёт, и использование не сжимается. Оно растёт. Дешёвое суждение вызывает использование к жизни. Спросить модель один раз раньше было недёшево, поэтому люди отдавали ей только несколько самых ценных шагов, а остальное писали мёртвыми правилами или смотрели сами. Когда суждение достаточно дёшево, чтобы спрашивать его снова и снова внутри кода, вопросы, которые не стоило спрашивать, прибывают все вместе. Вверх идёт счётчик.
Использование, которое вызывается к жизни, — не тот вид token, который действующие игроки больше всего хотят продавать сегодня. Длина, написанная за один вызов, падает, и выход не тарифицируется. Как бы высоко ни громоздился счётчик, он не входит в таблицу, которой они пользуются сегодня, ту, что зарабатывает на длинном выходе.
Человек, который определяет такую модель
Трудная часть — человек.
Только тот, кто держит взгляд бизнеса и взгляд модели одновременно, видит суставы по всей системе. Суставу нужно не то, что нужно мозгу. Мозгу нужен отрезок слов, который может продолжаться. Сустав слов не хочет. Он хочет результат, по которому можно ветвиться. Если вероятность крепка, программа продолжается. Если вероятность неуверена, её оставляют человеку. Тот, кто только строит модели, легко видит в этом формат выхода. Тот, кто только делает бизнес, легко чувствует, что ещё один вызов большой модели достаточен. Два взгляда должны сидеть на одном человеке, прежде чем этот человек определит такую модель. Таких людей мало. Пункт сам на дорожной карте не появляется.
Хорошо пользоваться такой моделью — человек встречает ту же трудность. Инстинкт может отвечать только на вопросы, на которые инстинкт может ответить. Так ли это и какой из немногих зафиксированных пунктов выбрать — инстинкт может ответить. Писать отрезок содержания, которого не было, или додумывать шаги на вопросе, который ещё не обрамлён, инстинкт удержать не может. Это работа модели другого рода. Инстинкт быстрый, и он дешёвый. Когда программе надо спросить, она спрашивает один раз, и время, и деньги это выдерживают. Сколько бы раз она ни спрашивала, вопросы всё ещё те, которые инстинкт может удержать. Поэтому он остаётся внутри программы, которая продолжает работать.
Большие лаборатории могут это собрать. Люди и вычисления на месте. Закрыть выход из строки в закрытый вопрос — то, через что инженерия может пройти, и это не то же самое, что воспроизвести исследование TypeSafe за полмесяца. Что полмесяца производит — пригодную форму. Реализация TypeSafe всё ещё в их собственных руках.
Эта колонка всё ещё принимает деньги. Как только суждение меняют на закрытый вопрос, а выход делают бесплатным, колонка теряет отрезок. Потерянная часть видна в квартальном отчёте. Место дальше вперёд оставляют проектам, которые всё ещё пишут выход длинным. Контекст продолжает расти, Agent пробегают ещё несколько циклов, и то, что выходит лишним, — ровно тот token, который этот прайс узнаёт.
Они могут это собрать. В начало расписания это не поставят.
Источники
Серия
- Предыдущая: JEV - Хватает ли «да или нет», выбора и уровня на язык?
- Следующая: JEV - Два demo, которые я прогнал