Веб-версияОткрыть в Telegram

ПостНе задумывались для кого делаются все эти мелкие локальные модели размерами 4b-70b, которые вы типа можете запускать на …

19 июня 2026
А
Андруша пишет код
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Не задумывались для кого делаются все эти мелкие локальные модели размерами 4b-70b, которые вы типа можете запускать на своих машинках? Тип, если запустить модельку у себя, подключить в какой-то CLine и попробовать написать код, то получится полная шляпа. А если учесть цену на подписку на решения от openai, антропика или дипсика, то окажется, что локальные решения ещё и экономически неоправданы. Но всё меняется в тот момент, когда ты делаешь какой-нибудь сервис по обработке текста. К примеру, поисковую систему по решениям судов. Да, можно пользоваться большими моделями, но учитывая их ценник, ты скорее обанкротишься, чем найдёшь людей, которые готовы будут тебе платить. Если вы глянете в спецификацию openai протокола, то увидите любопытное поле text_format. Или же так называемый structured output. Он сейчас есть буквально у всех провайдеров https://developers.openai.com/api/docs/guides/structured-outputs?lang=python&example=structured-data. Эта штука позволяет буквально управлять тем что модель генерирует на выход. Простой пример: вы задаёте что контент должен быть формата type Output = { foo: string, } И обработчик ответа будет отбрасывать все токены в аутпуте, пока модель не сгенерирует в ответе именно "foo": "<и тут дальше строка>. И тут уже пригождаются маленькие модели. Потому что они, да, тупые, но мы можем делегировать программисту самую главную задачу: думать. Мы можем форматом ответа тупо задавать то в какую сторону может думать модель(см. картинки 1 и 2) К примеру, я сейчас использую gpt oss 20b для своего сервиса переводов для сериалов и ютуба и её вполне достаточно. Надо просто сделать почти всю работу за модель: - достать из словарей возможные значения слов - описать контекст сцены - подсветить всякие нюансы по типу "эти слова в языках слишком похожи(ложные друзья переводчика), поэтому давай переводить по-другому" - задать пайплайн рассуждений через structured output И, внезапно, модель, которая на церебрасе стоит $0.4/$0.4 за 1М токенов и скоростью 500 t/s начинает иметь смысл. А вот для работы с человеком брать что-то меньше чем всякие попусы и гопоты 5.5 смысла нет, это правда. Слабые модели только для всяких узеньких и конкретных задач Ссылки: - https://developers.openai.com/api/docs/guides/structured-outputs?lang=python&example=structured-data - https://abdullin.com/schema-guided-reasoning/
25 · 1.9K ·

Рядом в ленте

ААндруша пишет кодКакое-то время назад я решил сделать свого агента по типу codex или opencode. Просто потому что "ну я то умный и могу сделать лучше и всё такое". Только было жеААндруша пишет кодhttps://9to5google.com/2026/06/15/google-chromes-next-update-will-mark-the-end-of-popular-ad-blockers/ В следующей версии в хроме отвалятся все норм адблокеры.
это сообщение
ААндруша пишет кодТут очень громкой новостью за последний месяц было переписывание достаточно крупного проекта с Zig на Rust в 90%-автоматизированном режиме. https://bun.com/blogААндруша пишет кодХочу чутка похвастаться/порекламировать сервис, который я сейчас разрабатываю. Очень кратко тут в тексте, подробно же в прикреплённом видео. ТЛДР: сервис изучен
ААндруша пишет кодАндруша пишет код@xavescor_code · канал · Технологии
1 333подписчиков365постов в индексе
Лента площадки Открыть в Telegram

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем