Веб-версияОткрыть в Telegram
AAI и грабли

AI и грабли

@oestick · канал · Технологии · в индексе с 2026-05-02
13 682подписчиков+5 за неделю
6 050средний охват поста
44.2%ER — охват к подписчикам
16постов за 30 дней
A
AI и грабли
MCP → CLI Я только собирался написать, почему CLI сосут, и на что их заменять, как понял, что у меня даже нет поста, почему сосут MCP (от которых мы и ушли к CLI). Исправляю! Сначала напомню в двух словах зачем эти ребята нам вообще нужны: агент сам по себе мало что умеет в мире, где наши данные разбросаны по десяткам веб-приложений, начиная от почты и календаря, заканчивая транскрибаторами звонков, джирами и сервисами электронного документооборота Нужно его к ним как-то коннектить. И на заре агентных систем ребята придумали подсовывать ему новые инструменты как tools (то, что агент может вызывать в цикле перед тем как дать итоговый ответ). Назвали это MCP (model-context-protocol) У стандарта MCP было много исторических болячек: невнятная аутентификация, загромождение контекста всеми методами всех mcp'шек, , отсутствие строгого следования схеме, stateful логика 🥴 Сейчас они по большей части вылечены. Но есть одна главная проблема – это все еще лишний слой абстракции поверх обычного API. То есть, вместо того, чтобы сразу дернуть API нашего условного гитхаба, обвязка агента (она выполняет роль MCP клиента) отправляет это в какой-то MCP сервер (в случае с гитхаб он удаленный, но может быть и локальным), а он уже отправляет это в API Вместо этого, любой агент, у которого есть вызов терминала может либо просто написать скрипт, который будет обращаться к API напрямую, либо вызвать уже сто лет существующую cli-команду gh с нужными параметрами. Всё! И вот какие у этого плюсы: 1. Жрет меньше токенов (потому что не verbose json) 2. Можно стакать вызовы команд в любой последовательности 3. Не обязательно засирать контекст модели всем выводом. Перенаправляем и фильтруем вывод терминальной команды как душе угодно 4. Обычно сильно больше комбинаций параметров 5. Если какой-то функции или параметра нет, агент все так же может написать кастомный скрипт, который сходит в API и сделает то, что нужно Но надо признать, кое-где MCP все-таки нужны – когда у вас есть эфимерн
162 · 8.2K ·
A
AI и грабли
CLI → SDK Выше я писал про то, почему с MCP переходят на CLI (кроме некоторых ситуаций). Сегодня – про еще один переход, которы у меня случился пару недель назад Рассмотрим на примере коннектора к тг У меня самописный CLI тул, куда я понемногу добавляю разные функции. Сначала я его использовал просто для того, чтобы агент отправлял текстовые нотификашки ботиком в чат. Потом добавил туда поддержку медиа. Потом отправку в другие чаты. Потом – чтение предыдущих сообщений в любом чате и парсинг каналов (тут понадобилось перенести с урезанного Bot API на полноценный телеграмный MTProto) И каждый раз когда я прошу сделать что-то, чего в моем CLI нет – агент идет его переписывать. Как результат – я по сути воссоздаю весь интерфейс библиотеки mtcute, но в виде CLI команды. Что уже как бы попахивает лишним слоем Так еще и интерфейс текстовой команды сильно беднее чем интерфейс SDK – нет честной типизации, объектов и т.д. Если я хочу сделать какое-то действие в цикле, или хитро обработать вывод, то агент все равно пишет bash-скрипт поверх CLI Так что пару недель назад, я полностью выпиливаю CLI и просто прописываю агенту, как ему использовать SDK напрямую. То есть он пишет код под задачу и сразу его запускает. А если у меня есть какие-то повторяющиеся задачи – я оставляю их в виде импортируемых TS модулей. Теперь агент может делать что угодно, что можно делать ботом в тг. Мне не нужно заранее продумывать сценарии и постоянно обновлять код. Он сам соберет его точно под задачу из исходных модулей библиотеки, либо моих скриптов. Тут правда я натыкаюсь на пару проблем. Основная – это то, что агент постоянно пишет временные скрипты, что убивает всю легкость, которая была у запуска CLI команды раньше. Да, он может писать код inline прям в команде, но внешние библиотеки так не установятся Решается это достаточно просто – нужен раннер с поддержкой autoinstall Для TS – это bun/deno, а для python – uv Тогда команда агента выглядит примерно так: bun --install=force run - <<
155 · 7.6K ·
A
AI и грабли
Фотография
нажмите — покажем
Сколько нужно денег, чтобы было не нужно? В этот раз меня позвали на совсем не типичную для меня конфу – про то, о чем почти не говорят на публике – личные бабки и стратегии выхода на пенсию (у меня её нет). Спикеры интересные, четырех я регулярно читаю Я решил поиграть на эфире в бунтаря и рассказать, какой капитал важнее денег, как его растить и не продолбать Когда: 3 сентября (ЧТ) в 18:00 мск Стоимость: подписка на каналы спикеров 📱 Регистрация в боте по ссылке  Кто будет на эфире кроме меня: - Владислав Носковец (CEO CareerStation, автор канала «Твой ментор», помогает IT-менеджерам находить работу) Поделится своими источниками дохода и расскажет, почему не планирует выходить на привычную всем пенсию - Иван Глушенков (внедряет ИИ в финансовые организации, закончил физтех, выиграл 18 хакатонов) Расскажет, как 5 лет жил с бюджетами по книге «The Richest Man in Babylon» и разбогател, а потом 5 лет прожил без бюджетов – и почему. Про 4 типа капитала, старость и финансовую безопасность на основе анализа успехов 250 человек ежегодно - Глеб Кудрявцев (руководитель ИИ-лаборатории, ex-CPO Skyeng) Руководил более чем 200 людьми, а теперь пишет код и строит бизнес с ИИ. Расскажет, как рассчитывает дожить до сингулярности и жить при коммунизме - Максим Романовский (Head of AI & Product Engineering) Расскажет, как ИИ помогает повышать финансовую грамотность, покажет свои примеры использования ИИ и какие задачи уже сейчас делегирует - Таня Савельева (фаундер UplinkAI, 2 экзита, Forbes 30u30) Расскажет, почему не ведёт бюджет и вам не советует - Катя Курашева (Founder & CEO R-Founders) Основатель глобального сообщества R-Founders для фаундеров и C-level. Поделится неожиданным выводом: почему у tech-предпринимателей личного капитала часто в разы меньше, чем у тех, кто строит физический бизнес - Юлия Билинкис (основатель Strategicmove education) Расскажет, почему на старость нужно копить не капитал, а покупать будущие денежные потоки и уменьшать будущие обязательные
40 · 6.2K ·
A
AI и грабли
ОтветCLI → SDK Выше я писал про то, почему с MCP переходят на CLI (кроме некоторых ситуаций). Сегодня – про еще один переход, которы у меня случился пару недель назад Рассмотрим на примере коннектора к тг У меня самописный CLI тул, куда я понемногу добавляю разные функции. Сначала я его использовал пр
Много скептицизма прилетело в комменты и даже мне в лс по посту про агентов, которые пишут код ad-hoc вместо использования готовых CLI На самом деле очень рад – это значит, что подписчики вдумчиво читают посты и готовы делиться своим мнением. Ну и я так получаю перспективу, которую сам раньше не замечал, спасибо А теперь еще один аргументом в сторону моей позиции, который вам может понравиться: Понятно, что доверять какому-то экспериментальному подходу от Коли сложнее, чем официальному подходу от топовых ИИ-лаб. Так что просто посмотрите на встроенные скиллы того же кодекса. Подход, про который я пишу уже используется в большинстве из них: Browser/Chrome – inline JS через Node REPL и browser-client Computer Use – inline JS с @oai/sky presentations, spreadsheets — генерируют .mjs с @oai/artifact-tool documents – код через python-docx (но: есть готовые CLI-хелперы) pdf – Python с reportlab/pypdf/pdfplumber Понятно, что не нужно все переводить на этот подход Но вот скинуть агенту мой прошлый пост и спросить, какие из ваших скиллов могут выиграть от этого подхода так же как выигрывают скиллы кодекса из этого поста – может оказаться полезным упражнением
43 · 5.5K ·
A
AI и грабли
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Недавно меня удивил один мой приятель: "Коля, а чем ты еще занимаешься, кроме курсов?" В этот момент я пил чай и даже поперхнулся Вообще, вся моя образовательная деятельность - это процентов 10-20 моей занятости, а с точки зрения денег - скорее благотворительная (не считая b2b воркшопов), учитывая, сколько денег и времени уходит на маркетинг Деньги я зарабатываю тем, что с небольшой командой мы делаем разные сложные ИИ-автоматизации для бизнеса – от финансовой отчетности и агентов для авиации до авто-чаттеров онлифанс агентствам Зачем тогда вообще делать какие-то курсы и портить себе репутацию инфоцыганством? Да хз на самом деле. Кажется, меня просто раздражает, как медленно происходит проникновение ИИ в русскоязычном обществе и хочется это хоть как-то компенсировать. Знаете, что-то из серии: "да почему вы блин не понимаете, что это волшебная палочка" На практике оказалось, что b2c курсы сейчас очень сложно продавать – и рынок эдтеха падает, и спецы часто видят скорее угрозу в ИИ, чем карьерный рост или возможности меньше времени заниматься нелюбимой частью работы, да и просто блин кризис и люди больше экономят. (Ну и я так себе инфоцыган, чего уж) ——— В общем, это будет последний такой широкий b2c поток. Дальше если что-то и будет b2c-шное, то только для руководителей и предпринимателей и только по предварительному отбору и сильно дороже Для всех остальных сегодня еще можно запрыгнуть в последний вагон нашего марафона. В отличие от большинства курсов, он реально работает - до конца первого потока дошли 85% участников, что просто заоблачная цифра для любого онлайн обучения Ну и люди, которые до этого пользовались ИИ как чатом (даже если делали это в клод коде) превратили его в своего личного ассистента, который почти не отличается по возможностям от того, что настроено у меня. В общем, получилось то, за что правда не стыдно. - Начало 1 сентября - Задачи по будням на 15-20 минут - Задачи со звездочкой для тех, кто хочет упороться - Вылет за несделанную до
20 · 6.5K ·
A
AI и грабли
Ссылка
нажмите — покажем
Если вы давно в этом канале, то знаете, что я люблю делать диванные прогнозы на будущее. Один из новых прогнозов: Скоро у openai появится агентная модель уровня sol+ с нативным audio инпутом как у gemini (ставлю на до конца года) Что это будет значить для нас: Для всех, кто работает с генераторами музыки, диалоговыми аудио ботами, монтажем подкастов и т.д. – это огромное подспорье. Как нативное понимание image когда-то позволило сильно прокачать возможности агентов во фронтенде, дизайне и любом другом визуале – если агент "видит" результат работы, он сразу может найти косяки и исправить их. Тот самый feedback loop, где feedback – это сам результат работы Так же будет и с аудио. Сейчас я работаю с локальными генераторами аудио и voice cloning, и этого прям жестко не хватает. Поэтому приходится использовать самодельную версию агента с модельками gemini по API. Из альтернатив есть Antigravity – они добавили это к себе буквально через пару недель после моего эксперимента, причем сразу и с поддержкой видео (это, кстати, единственная причина использовать Antigravity, которую я знаю) Если кому интересно, на чем основывается предсказание про появление омни модельки от openai: Примерно месяц назад я расковырял новый коммит в codex-cli, который добавляет audio как валидный тип результата для tool_calls (наравне с text и image). Так же они добавляют это в поддержку MCP. И даже в dynamic_tools (это тулы, которые можно инжектить в codex извне. Например, codex desktop, который под капотом запускает codex, инжектит туда тулы для управления встроенным браузером и соседними чатами. Короче, раз поддержка добавлена в харнес, то и модели должны быть на подходе Ваш диванный предсказатель, @ai_grably
21 · 6.9K ·
A
AI и грабли
Фотография
нажмите — покажем
Видел недавно интересный тейк, мол, все только хвастаются как внедряют ИИ, но конкретных успешных кейсов никто не показывает. Да и вообще, большая часть ИИ пилотов в компаниях – провалилась Ну во-первых, большая часть пилотов и должны проваливаться по определению – это проверка гипотез А во-вторых, я вижу, что реально успешные внедрения идут не от разработки кастомного решения, а от правильного онбординга уже готовых универсальных агентов (codex/cc) внутри компаний Даже своих клиентов я сейчас отговариваю от кастома – вместо этого мы стали настраивать им агентную инфру с управлением скиллами, трейсиноом сессий и управлением доступами Но это для среднего и малого бизнеса. Про крупняк я очень скептично настроен. Но на конфе от Community Sprints ребята обещают кейсы успешных применений в нетехнических командах известных компаний. Ну, посмотрим Участие бесплатное и без подписок на спикеров (🫢) Я там тоже как-то затесался – покажу один из своих любимых кейсов: Продуктовый/маркетинговый рисерч агентами по одному из самых богатых, но наименее индексируемых хранилищ информации – ютубу Еще будут крутые ребята из известных компаний (круто, что и РФ и международка). Весьма no-bullshit состав, на мой взгляд - многих знаю лично 8-10 сентября со стартом в 18:00 по мск Бесплатная регистрация и подробности по темам – у ребят на сайте
57 · 7.2K ·
A
AI и грабли
Фотография
нажмите — покажем
↑ Cейчас разбирал с Фейблом system card gpt-6-astra и чет опять такими вайбами ai-2027.com повеяло, ух Полтора года назад, когда она жестко зафорсилась в ИИ пузыре, ее мало кто реально прочитал, зато много кто высмеивал в нереалистичности (classic). В целом не удивительно – тогда более-менее в теме актуальных возможностей ИИ были единицы, да и то скорее аккуратные скептики. Да и английский в статье не самый простой. Если кто пропустил, но хочет прочитать – напоминаю, что я тогда выложил перевод на хабр. Даже обе концовски сделал – можно выбрать свою Перевод, кстати, уже тогда был полностью сделан нейронкой (даже картинки), хотя и с кучей хаков, чтобы это было комфортно читать Есть всё-таки что-то ироничное в том, что текст про опасности ИИ полностью переведен самим ИИ Время чтения – пару часов, ощущения – бесценны https://habr.com/ru/articles/898622
81 · 7.3K ·
A
AI и грабли
Фотография
нажмите — покажем
Разбор аудиорежима в кодексе Будет особенно интересно тем, кто сам разрабатывает что-то подобное. Но и просто пользователям тоже постарался сделать полезным – чтобы понимать ограничения таких систем и лучшие практики взаимодействия с ними Короче, я тут на днях делал себе компрессы для глаз (*звуки деда*), а они прям полностью глаза закрывают, там такая маска, типа как для сна Ну и вместо того, чтобы спокойно посидеть и подумать о вечном, я врубил диалоговый режим кодекса и проболтал с ним пол часа вместо положенных мне 15 минут Стало интересно, че это он такой умный, и я полез реверсить билд кодекс аппа – реализация оказалась одновременно и простой, и глубокой. А сам подход можно использовать не только для аудио (но об этом в конце поста) В общих чертах – вы общаетесь не с самой gpt-5.6-sol в полноценном кодекс агенте, а с тупенькой моделькой gpt-realtime-1. Тупенькой, но быстрой. И заточенной под диалоговый формат с переживаниями – без этого естественности не добиться и любое общение будет мучением. Так вот, пока у этой модельки хватает сил самой с вами общаться - она будет. Но как только нужно будет сделать что-то сложное, она побежит к кодекс агенту и даст ему задачку. В этот момент сразу же скажет вам что-то вроде «ну-ка дай подумаю» или «так, разбираюсь». Это важно, чтобы мы чувствовали непрерывность общения – как с людьми Такой типа эффект Джарвис. И это реально работает! Получается интересная система, очень похожая на ту, которая бывает в обычных айти командах: - есть менеджер, который всегда онлайн и быстро отвечает, и который общается с заказчиком - есть исполнитель (например, разработчик), который пилит фичу и отвечает по несколько часов в перерывах между сфокусированной работой А менеджер ему еще по ходу докидывает задачки, если у заказчика появились новые хотелки Что интересного из этого следует для нас как для пользователей: 1. Если в процессе выполнения слишком много докидывать новые хотелки, то результат получится плохим: если вы когда
152 · 6.5K ·
A
AI и грабли
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Поспорил я тут на днях в баре с одной дизейнеркой интерьеров Говорит, что ваши эти ИИшки не держат геометрию и помещают в комнату объекты, которые там физически не могут находиться. А я ей – что ИИшки могут 🤷‍♂️ Говорит, кто проиграет пари – оплачивает весь банкет. А я человек азартный, мне часто вообще пофиг на что именно спорить, да и выпендриваться я люблю. А тут еще и такая возможность Астру потестить в ее родных задачах, чего я до сих пор нормально не сделал Входные условия достаточно неприятные – чертеж и 4 плохих фотки. Но у меня настроен remote коннект на ноут, который в апартах на столе стоит включенным и пару ресетов в запасе В целом то она права – если просто сгрузить все в кодекс и сказать наложить дизайн, то он тупо вызовет imagegen и геометрия точно поедет Но мы уже решали похожие задачи и знаем, что вся соль – в создании промежуточной детерминированной модели. В нашем случае – просто 3д сцены квартиры. Можно в каком-нибудь CAD'е или blender'е, но тут с этим даже не заморачиваюсь Взяв чертеж и загуглив проектную документацию здания (чтобы найти высоту потолков), агент строит базовую модель. Тут все ок Дальше осталось расставить 3д объекты мебели, подогнать виртуальные ракурсы под камеру и уже по 3д сценам запустить генерацию секси картинок в нужном стиле Пока агент работает, я попиваю джин-тоник и рассказываю всратые истории про Таиланд Подгонка камер оказалась сложнее чем я думал и важнее, чем я думал. Я то хотел просто красивые картиночки со слайдерами сделать (см выше), чтобы наглядно показать корректную геометрию комнат. А на самом деле это важно, чтобы определять точные размеры и положение других объектов в помещении Например вон тот радиатор у окна сильно влиял на ширину "спальни" и было не понятно, влезет ли кровать – нужно было точно знать его расположение Поэтому я немного упоролся и отправил агента сначала сделать детектирование углов и линий стен, а потом накинуть немного матмоделирования – по сути итеративную подгонку положения и
226 · 7.9K ·
AI и грабли
Фотография
нажмите — покажем
Что вы знаете про bb? Они называют себя "AI IDE that builds itself". Достаточно молодой проект, который из коробки закрывает целый спектр задач, где раньше приходилось велосипедить всем колхозом. В текстовом варианте можете почитать отличный обзор у Рефата. Я же хочу предложить вам совместно изучить bb в формате практического стрима. Вместе со мной разбираться в особенностях этой IDE будут: 1. Рефат, автор канала "Refat Talks: Tech & AI" (кстати, у нас с Рефатом есть классный стрим про фреймворк Mastra) 2. Коля, автор канала "AI и грабли" Проходить стрим будет на моём YouTube-канале. Дата и время: 21 сентября, 19:00 GTM+3 Ссылка для добавления события в календарь p.s.: Почему парень из Сингапура назвал проект так, будто забыл переключить раскладку на русский язык, чтобы написать "ИИ"?
40 · 5.5K ·
A
AI и грабли
Видео
mediapipe.mp4 · 8.4 МБ · нажмите — покажем
Я уже неделю не могу дописать важный пост про SynthID – метку о том, что контент сгенерирован, которую провайдеры зашивают в картинки (а с недавнего времени еще и в аудио и даже текст), а главное, про мои тесты её удаления Так вот, пока серьёзные посты ждут своей очереди, вот вам несерьёзный – увидел в рилсе девочку, которая себе сделала такое, как на видео. Меня пробило ностальгией, скинул ссылку на рилс опусу, сказал, повтори, только чтобы все чисто в браузере работало Через 3 минуты все было готово. Мозгу очевидно, что это не рокет сайенс уже давно, но чисто на уровне ощущений – очень приятно, что то, на что у меня 9 лет назад ушло несколько месяцев, сейчас можно сделать за три минуты и оно будет даже более залипательным Поиграться самим тут Кстати, если у кого-то есть оригинальные идеи, как использовать mediapipe (это готовый набор примитивов для on-device hand и face трэккинга) не только для забавных демок – поделитесь в комментах
146 · 7.2K ·
A
A
AI и грабли
Видео
agent-retro-reel.mp4 · 9.3 МБ · нажмите — покажем
Скоро: видео-монтаж-слоп во всех лентах страны Opus-5.5 теперь сам такое ваншотит на remotion, в т.ч. офигенно подстраивает звук под анимации. Раньше у меня такое работало только с кучей правок и корректировок, было больно Сейчас для меня выглядит прям неплохо, но как ребята в чате верно заметили, нас всех через пару месяцев от такого будет тянуть блевать (а кого-то, кто глубоко в медиа-генерации, наверное, уже) P.s. контент для видео агент сам насобирал под соусом анализа моих чатов, но полезного там почти ничего нет – со смыслами все еще нужно работать вручную
80 · 4.7K ·

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем