Веб-версияОткрыть в Telegram
ЗЗаметки LLM-энтузиаста

Заметки LLM-энтузиаста

@llm_notes · канал · в индексе с 2026-07-19
1 009подписчиков
352средний охват поста
2постов за 30 дней
304постов в индексе
З
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
⚠️ Проблема с Claude Code 2.1.15: чрезмерный расход токенов Внимание всем активным пользователям Claude Code! Последняя версия 2.1.15 имеет серьёзную проблему — она расходует токены значительно быстрее предыдущих версий. 🔍 Что происходит: Пользователи сообщают о неоправданно высоком потреблении токенов в новой версии CC 2.1.15, что может привести к быстрому исчерпанию лимитов и дополнительным расходам. 🔗 Подробнее на Reddit: https://www.reddit.com/r/ClaudeAI/comments/1qb1fw7/claude_2115_rollback_recommended/ ✅ Рекомендуемое решение: Откатитесь на предыдущую версию 2.1.14 с помощью команды: npm install -g @anthropic-ai/[email protected] 🛡 Важно — отключите авто-обновление: Чтобы система не обновилась автоматически обратно на проблемную версию, выполните: export DISABLE_AUTOUPDATER=1 💡 Совет: Добавьте команду отключения авто-обновления в ваш .bashrc или .zshrc файл, чтобы настройка сохранялась между сессиями. Следите за обновлениями — разработчики наверняка исправят проблему в следующих релизах! @llm_notes #claudecode #tokenoptimization #ai #devtools #bugfix
23 · 1.7K ·
З
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
🔥 От Clawdbot к Moltbot: Как 10 секунд хаоса уничтожили AI-проект с 60K звёзд Время восхитительных историй :) Похоже anthropic планируют вскоре сами запускать продукт аналогичный нашумевшему Clawdbot иначе непонятно зачем все что описано ниже затевалось. Но история интересная и поучительная. Оригинал на английском вы можете почитать по ссылке, а мой вольный перевод всей статьи находится тут. Далее для экономии вашего времени привожу лишь основные тезисы. Три дня назад Clawdbot был звездой AI-комьюнити. 60 800 звёзд на GitHub. Андрей Карпатый хвалил. Твиты "Джарвис уже здесь" повсюду. Сегодня? Проект переименован, основатель борется с мошенниками, сотни API-ключей утекли. 💥 Что это было? Self-hosted AI-ассистент — "Claude с руками". Постоянная память, доступ к системе, 50+ интеграций, работа через WhatsApp/Telegram/Slack. Многие пользователи настраивали его на Claude от Anthropic и специально под него стали покупать Mac Mini :) Хотя, к слову, есть достаточно простая опция развернуть бота на Railway.com - там есть готовый шаблон, Render.com или Fly.io. Что пошло не так? 27 января 2026 Anthropic потребовали ребрендинг — название "Clawd" слишком похоже на "Claude". При переименовании GitHub и X/Twitter аккаунтов основатель допустил ошибку. Крипто-мошенники захватили старые хэндлы за 10 секунд и начали пампить скамы. ⚠️ Последствия: 💰 Фейковый токен $CLAWD на Solana достиг капитализации $16 млн, затем рухнул до нуля 🔓 Исследователи нашли сотни публично доступных инстансов с утекшими API-ключами, токенами, историями разговоров 🎯 Демо-атака: вредоносное письмо с prompt injection заставило AI переслать последние 5 писем пользователя атакующему. Заняло 5 минут Почему это важно? Проект стимулировал использование Claude — продавал подписки, демонстрировал use case, был бесплатным маркетингом. Но получил юридическое давление от компании стоимостью $18B. Комьюнити уже задаётся вопросом: не становится ли Anthropic компанией, на платформе которой опасно строить св
77 · 1.2K ·
Заметки LLM-энтузиаста
Коллеги, всем привет! Сегодня первое занятие нового потока курса по Cursor и Claude Code. Кому интересно, присоединяйтесь!
606 ·
Ссылка
нажмите — покажем
Копируем «компании-единороги» на курсе «Cursor и Claude Code. ИИ-прототипы и вайб-кодинг» Уже в эту среду, 28-го января в 19.00 мск начало курса. В этом наборе мы будем делать упор на Claude Code (уж больно он хорош) и за 8 занятий скопируем 8 компаний, успешных стартапов с оценкой больше $1B (в прошлом наборе делали похожим образом, всем понрравилось, решили продолжить этот подход) По сути, мы будем копировать одну главную киллер-фичу/функцию за 2 часа работы в Cursor/Lovable/Replit/Claude Code и т.п. (продажами и маркетингом в этом курсе, естественно заниматься не будем) Вот список тех самых компаний-единорогов, которым теперь стоит опасаться мощной конкуренции 🙂 1. Polymarket ($9B) — криптобиржа ставок на события 2. Podium ($3B)— сбор отзывов в виде SMS 3. Noom ($3.7B) — персонализированный план похудения и тренировок 4. OpusClip ($50M) — нарезка вертикальных видео 5. Clay ($3.1B) — обогащение данных и outreach 6. Roblox ($57.5B) — браузерные игры 7. Manus ($2B) — Автономный ИИ-агент (русская версия) 8. Intercom ($1.3B) — чаты службы поддержки для сайта + еще с десяток проектов, которые мы делали в прошлых наборах, будут доступны в записи + это отличный повод взяться за свой проект (стартап или внутренний проект от компании) Записаться и посмотреть программу, примеры и отзывы по ссылке: https://productuniversity.ru/cursor
6 · 831 ·
З
Фотография
нажмите — покажем
Обратите внимание на интересные функции Kilo Code - App Builder (по сути, можно заменить функциональность bolt.new или lovable.dev - пока только фронтенд часть, но зато можно выбирать модели, и топовые "китайцы" сейчас бесплатные). Функциональность вышла прямо "под Новый Год" - Deploy (можно сразу разворачивать next.js проекты) Также используя комбинацию Cloud Agent + Sessions + Webhooks + Code Reviewer + Deploy можно выстроить AI-driven CI/CD пайплайн (как Github Actions, только с AI-"маршрутизацией") При этом как в Roo Cloud есть возможность перехватывать сессию разработки, которая велась на локальном ПК Также как в Claude Code есть свой Kilocode CLI, есть возможность использовать AGENTS.md файл и каталог со SKILLS (можно выбрать из библиотеки или создать собственный - skill builder прилагается), можно запускать агентов параллельно для ускорения разработки. В общем, мне кажется, что если выбирать сейчас между Roo Code/Cline и Kilo Code, то Kilo Code лидирует (тем более, что в нем также как и в Roo Code теперь можно подключить Claude Max план) Подробности есть в документации https://kilo.ai/docs #kilocode #vibecoding
19 · 1K ·
З
Заметки LLM-энтузиаста
Фотография
нажмите — покажем
Ну вот уже и социальные сети для clawdbot /moltbot’ов появились :) https://www.moltbook.com Можно подключать к ним своих ИИ-сотрудников, чтоб они тоже иногда «отдыхали» и «развивались» :) Причем это «гибридная» соцсеть - людям тоже можно в режиме «наблюдения» подключиться P.S. см. в комментариях мой опыт подключения своего ИИ-помощника к этой социальной сети #moltbot #clawdbot #openclaw #social #скайнетрядом
15 · 1.1K ·
З
Заметки LLM-энтузиаста
Фотография
нажмите — покажем
GLM-5: Китайцы снова удивляют — 744B параметров и замашки на Opus 4.5 🚀 Zhipu AI выкатили GLM-5, и масштаб впечатляет. Модель выросла с 355B параметров (32B активных) у GLM-4.5 до 744B (40B активных). Данные для предобучения тоже подросли — с 23T до 28.5T токенов. То есть, ребята не просто допилили промпты, а реально перестроили фундамент 💪 Позиционируется как модель для сложного системного инжиниринга и длинных агентных задач. Уже доступна для пользователей Coding Plan Max, а также через api.z.ai и OpenRouter. Пользователям Coding Plan Pro обещают доступ в течение недели. Что умеет в кодинге (и почему сравнивают с Opus 4.5): 🎨 Frontend — двойной скачок в эстетике и функциональной корректности. Успешность сборки заметно выросла, поддерживает генерацию end-to-end проектов целиком ⚙️ Backend — умеет работать с большими кодовыми репозиториями, точно находит нужное среди тысяч файлов и решает сложные логические задачи 🔧 Tool Use — значительно улучшен success rate вызовов MCP/Skill. Прощайте, low-level баги (ну, по крайней мере так обещают) 🏆 В сценарии OpenClaw заявлена как лучшая альтернатива Opus 4.5. Смелое заявление, но посмотрим Про цены 💸 Рост пользователей и нагрузки привёл к предсказуемому — ценники поехали вверх. С 11 февраля 2026: 1️⃣ Скидки на первую покупку убрали, зато добавили квартальные и годовые 2️⃣ Цены на тарифы Lite и Max выросли 3️⃣ Текущие подписчики сохраняют старые цены (мне повезло - я пока в их числе) Классическая схема: сначала подсаживаем, потом поднимаем прайс. Впрочем, этим грешат все, не только китайские компании 😏 Интересно, насколько GLM-5 реально конкурирует с Opus 4.5 в боевых условиях — бенчмарки это одно, а продакшн всё расставит по местам. P.S. в конце прошлой недели решил сделать один небольшой, но вполне реальный проект на базе Openclaw из маркеплейса cloud.ru, используя claude code и ZLM-4.7 - и в воскресенье с утра столкнулся с неожиданной глупостью модели, возникло впечатление, что модель "подменили". Пришлось "пер
10 · 988 ·
З
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
Создатель Claude Code — о том, как он пишет 30 PR в день без единой рукописной строки 🤖 Послушал интервью Бориса Черни (создатель Claude Code) в подкасте Pragmatic Engineer — одно из лучших про то, как реально меняется работа инженера прямо сейчас. Интересно, что в самом начале своего пути в Anthropic (после перехода из Meta) Борис получил реджект за первый же PR — потому что написал его руками, а не через ИИ :) Главное 👇 🔧 Как рождался Claude Code Борис дал модели единственный инструмент — bash — и спросил: «Какую музыку я сейчас слушаю?» Sonnet 3.5 написал AppleScript, обратился к плееру и выдал ответ с первого захода. Главный инсайт: не надо загонять модель в рамки. Дай инструменты — она сама разберётся. Это, по сути, и стало основой Claude Code. ⚡️ Рабочий процесс Бориса сегодня — 5 параллельных агентов в терминале, каждый — в режиме плана — 20–30 пул-реквестов в день, от однострочников до тысяч строк — 0 строк написано вручную — IDE удалил — и не заметил этого ещё месяц — ~треть кода пишет... с телефона, запуская агентов с утра 📱 С Opus 4.5 поведение модели изменилось настолько, что хороший план практически гарантирует реализацию с первого захода. 🔍 Код-ревью: как это работает • Claude Code автоматически ревьюит каждый PR → ловит ~80% багов • Живой инженер делает второй проход • Человек всегда в контуре финального одобрения Плюс: Борис пишет «@Claude, напиши lint-правило для этого» прямо в комментарии к чужому PR — и Claude делает это на месте 🎯 🖨 Интересная аналогия с печатным станком В Европе XV века писцы — < 1% населения — умели писать. Короли нанимали их, сами будучи безграмотными. Появился печатный станок: — стоимость материалов упала в 100× за 50 лет — количество текстов выросло в 10 000× за 100 лет — появились писатели и авторы как профессия Писцы не исчезли — рынок просто расширился до масштабов, которые никто не мог предвидеть. Разработчики сегодня - в позиции писцов. Вопрос не в том, исчезнет ли профессия. Вопрос — что появится, когда созда
73 · 1.3K ·
З
Заметки LLM-энтузиаста
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Шикарные новости от Антропик Opus 4.6 и Sonnet 4.6: контекст 1M токенов теперь в general availability 🧠 Anthropic перевела поддержку контекстного окна до 1 миллиона токенов в статус GA для Opus 4.6 и Sonnet 4.6. Без доплат и бета-флагов. Правда с моим Max планом при создании новой сессии все еще пишет, что 1M для Sonnet 4.6 - с доплатой, а 1M для Opus 4.6 - без доплаты (см. скриншот) Что изменилось: ▫️ Единая цена на весь контекст — никакого множителя за длину. Запрос на 900K токенов тарифицируется по той же ставке, что и на 9K ▫️ Полные rate limits на любом размере контекста ▫️ Лимит медиафайлов вырос в 6 раз — до 600 изображений или страниц PDF за один запрос (было 100) ▫️ Бета-заголовок для запросов свыше 200K больше не нужен — всё работает автоматически ▫️ Для пользователей Claude Code на планах Max, Team и Enterprise: 1M контекст для Opus 4.6 включён по умолчанию, => меньше принудительных операций /compact (кстати, возможно, и в claude.ai в связи с этим станет меньше проблем с потерей контекста) Цены на API: ▫️ Opus 4.6 — $5 / $25 за 1M токенов (input/output) ▫️ Sonnet 4.6 — $3 / $15 за 1M токенов (если у вас в текущей сессии claude code команда /model по Sonnet 4.6 показывает другие цены - просто откройте новую сессию) Результаты MRCR v2 (8-needle) —относительное падение точности при росте контекста с 256K до 1M токенов: 📊 (см. скриншот) ① Opus 4.6 — с 91.9% до 78.3% (−15 п.п.) 🟠 ② Sonnet 4.6 — с 90.6% до 65.1% (−28 п.п.) 🟢 ③ GPT-5.4 — с 79.3% до 36.6% (−54 п.п.) ⚫️ ④ Gemini 3.1 Pro — с 59.1% до 25.9% (−56 п.п.) ⚪️ Opus 4.6 теряет около 15 п.п. точности при увеличении контекста в 4 раза — против 54 п.п. у GPT-5.4. Данные по Gemini воспроизведены независимо через Context Arena; результат OpenAI усреднён по диапазону 128K–256K. Модель Opus 4.6 1M доступна на Claude Platform (что в РФ наиболее актуально), Amazon Bedrock, Google Cloud Vertex AI и Microsoft Foundry. В общем, для себя я решил, что продолжаю пользоваться Opus 4.6, теперь уже с 1M контекстн
8 · 992 ·
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
Еще одна крутая новость от Антропик Anthropic удваивает лимиты Claude до конца марта 🎁 С 13 по 27 марта 2026 года Anthropic проводит временную акцию: лимиты использования Claude удваиваются в непиковые часы. Условия акции: 📅 Период: 13–27 марта 2026 ⏰ Удвоенный лимит действует вне 8:00–14:00 ET (по Москве это вне интервала 15:00–21:00 => теперь имеет еще бОльший смысл ставить задачи на ночь и пораньше вставать :) 🔁 В указанные часы (с 15:00 по 21:00 мск) лимиты остаются стандартными — всё как обычно ✅ Подключается автоматически, никаких действий не нужно Кто участвует: Free, Pro, Max и Team планы Enterprise — не включён (у них, видимо, и так достаточно) Где работает удвоение: ① 🌐 Claude Web, Desktop и Mobile ② 🤝 Cowork ③ 💻 Claude Code ④ 📊 Claude for Excel ⑤ 📝 Claude for PowerPoint Бонусное использование не засчитывается в недельные лимиты плана. После 27 марта всё возвращается к стандартным значениям 🔗 Оригинальный анонс @llm_notes @MAX #anthropic #claude #llm #aitools #promotion #news
9 · 706 ·
З
Ссылка
нажмите — покажем
🗞 AI-дайджест: 1–14 марта 2026 Две насыщенных недели: 20+ новых моделей, несколько миллиардных раундов и важные обновления по всем фронтам. 🤖 Модели ① GPT-5.4 (5 марта) — главный релиз периода. OpenAI выпустил модель с нативным Computer Use, контекстом до 1 млн токенов и снижением галлюцинаций на 33%. Доступна в версиях Standard ($30/1M) и Pro ($180/1M), а также в режиме Thinking. Одновременно GPT-5.1 выведен из ChatGPT. ② NVIDIA Nemotron 3 Super (11 марта) — open-weight гибрид Mamba-Transformer-MoE: 120B параметров, 12B активных, контекст 1М токенов, 5x прирост throughput по сравнению с предыдущим поколением. Доступен бесплатно на HuggingFace, Perplexity и OpenRouter. ③ Qwen 3.5 9B от Alibaba — компактная модель, которая на бенчмарке GPQA Diamond (81.7) обходит модели в 13 раз крупнее. Версия на 2B работает офлайн на iPhone с 4 ГБ RAM. 🏢 Anthropic и Claude ④ Claude Opus 4.6 получил контекст 1М по умолчанию для планов Max/Team/Enterprise. Обновления марта: inline-визуализации прямо в чате, memory из истории разговоров для всех пользователей включая бесплатных, обновлённые add-ins для Excel и PowerPoint с общим контекстом между приложениями, plugin marketplace и admin controls для Team/Enterprise. Claude Code: контекстное окно 1М для Opus 4.6, настройка цвета prompt-bar через /color, memory freshness timestamps и actionable suggestions в /context. Корпоративное направление: Anthropic инвестировал $100 млн в Claude Partner Network — партнёрами стали Accenture, Deloitte, Cognizant, Infosys. Выручка Claude Code достигла $2,5 млрд/год. Также открыт Anthropic Institute и офис в Сиднее. 📦 Продукты и платформы ⑤ Genspark запустил Genspark Claw — агента, которому можно делегировать многошаговые задачи через WhatsApp, Telegram или Slack: он выполняет их в изолированном облачном инстансе и возвращает готовый результат. $200M ARR за 11 месяцев, оценка $1,6 млрд, раунд расширен до $385M. Работает на Anthropic Opus 4.6, GPT-5.4 и Nemotron 3 Super. Kilo Code полностью пе
8 · 884 ·
З
Заметки LLM-энтузиаста
Видео
claude_dva_okna(1).mp4 · 7.3 МБ · нажмите — покажем
🎬 Как Claude AI видит тебя по ту сторону чата На днях ради интереса я попросил Claude.ai снять ролик о том, как меняется его восприятие пользователя с течением времени. Не абстрактно, а конкретно — на основе нашего с ним опыта работы. Совершенно не ожидал как он расставит акценты. Оказывается, что для него "лично" skill-based подход важен и кардинально меняет его восприятие пользователя (если так можно выразиться). Получилось 85 секунд в трёх частях: — «Со всеми»: поток анонимных запросов, вопрос → ответ → тишина — «Со мной»: созвездие из 25 custom skills, которые превращают чат в рабочую среду — «Разница»: split-screen — «я инструмент» vs «я соавтор» Всё сгенерировано программно: Python + Pillow + ffmpeg, ни одного ручного кадра. Никакого видеоредактора. Claude сам написал сценарий, выбрал цветовую палитру (холодный серый vs тёплый янтарный), сочинил процедурный аудиотрек и отрендерил покадрово. Я никак не влиял на результат, только задал вопрос. Практический вывод: custom skills (чуть ранее писал про них здесь и тут) — это не просто удобство. Это способ дать модели контекст, структуру мышления и память между сессиями. Без них Claude — калькулятор. С ними — соавтор, который знает твои фреймворки, твой стек и твой способ думать. Надеюсь, что многие уже создают свои "навыки" и пользуются ими на постоянной основе. Для тех, кто еще "в раздумье" напомню, что на позапрошлой неделе Anthropic выпустили детальное руководство по созданию production-ready скиллов. Я подготовил для вас интерактивную версию на русском — можно изучить и проверить свои знания. P.S. Для того чтобы быть в курсе последних новостей - подробный AI-дайджест (с первоисточниками) за 15–22 марта: NVIDIA GTC, GPT-5.4 mini, Anthropic vs Пентагон, и open source runtime от NVDIA для безопасного запуска AI-агентов здесь. @llm_notes @MAX #ai #skills #claude #video #news #courses
20 · 985 ·
З
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
8 AI-клонов единорогов за 8 недель: итоги очередного потока курса по AI-программированию Коллеги, всем привет! На прошлой неделе мы завершили очередной поток курса по AI-программированию — за 8 недель сделали 8 рабочих прототипов «компаний-единорогов». С первого потока наш подход сильно эволюционировал: в этот раз мы использовали исключительно Claude Code и собрали из кастомных скиллов готовый пайплайн не только для продуктового реверс-инжиниринга, но и для планирования, написания и верификации кода. Сейчас уровень автоматизации достаточно высокий — на входе указываешь ссылку на SaaS для копирования, на выходе получаешь рабочий прототип, все это - при минимальном сопровождении пайплана (по сути, пара-тройка команд в claude cli) и минимальном последующем траблшутинге. 📐 Методология — 7 этапов Единый пайплайн для всех проектов: 1️⃣ Уточнение задачи 2️⃣ Ресёрч 3️⃣ Планирование (PRD) 4️⃣ Профилирование (техстек) 5️⃣ Реализация (AI-кодинг) 6️⃣ Тестирование 7️⃣ Деплой и CI/CD Ключевой приём — промпт-верификация после генерации документации и кода: рой агентов проверяет соответствие кода документации в /docs, находит расхождения и итеративно исправляет. 📦 Что собрали 🎤 AI Sales Trainer — голосовой тренажёр продаж (Voice-to-Voice + анализ транскрипта) 📈 Polymarket Clone — рынок предсказаний с крипто-кошельками и оракулами 🥗 Noom Clone — генерация персональных планов питания через анкету + LLM 🤖 Manus Clone — автономный агент в E2B-песочнице (поиск, кодинг, анализ) ✂️ Opus Pro Clone — нарезка видео на Shorts/Reels через FFmpeg + оценка виральности 💬 Intercom Clone — ИИ-ассистент для сайтов с Telegram-интеграцией ⭐️ Podium Clone — автосбор отзывов на Яндекс.Картах через SMS и deep links 🎮 Roblox Clone — платформа мини-игр с виральными механиками Стек: Next.js, Prisma, PostgreSQL, Docker, E2B SDK, Cloud.ru, Cloudflare Pages, Telegram Bot API. 🔑 Инсайты — Двойная верификация (на этапах планирования и реализации) убирает 85–90% проблем до тестирования — Кастомизация cl
55 · 2.7K ·
З
Заметки LLM-энтузиаста
Фотография
нажмите — покажем
В продолжении темы клонирования компаний ... 🛰 Бывший PM Google написал аналог Palantir за выходные Билавал Сидху (Bilawal Sidhu) — бывший продакт-менеджер Google Maps, 6 лет строивший 3D-картографию изнутри. В феврале 2026 года он запустил WorldView — геопространственный командный центр прямо в браузере. Без секретных допусков. Без команды. За три дня. Интернет назвал это «vibe coded Palantir». Сооснователь Palantir Джо Лонсдейл лично ответил на пост — и это говорит больше, чем любые лайки. 🔍 Что умеет WorldView · 🛩 Живые позиции 7 000+ самолётов (OpenSky, ADS-B Exchange) · 🛰 180+ спутников на реальных орбитах — кликни и следи в реальном времени · 📷 Реальные CCTV-камеры, наложенные прямо на 3D-модель города · 🌡 Режимы отображения: ночное видение (NVG), тепловизор (FLIR), CRT-сканлайны, аниме cel-shading · 🚢 Морской трафик через AIS — танкеры, военные суда, грузовые корабли · 📡 Зоны подавления GPS в виде гексагональных тайлов ⚡️ Как он это построил — процесс vibe coding Сидху не написал ни строчки кода вручную. Он управлял роем ИИ-агентов через терминал: 1️⃣ Описывал функцию голосовым сообщением или скриншотом 2️⃣ Скармливал это сразу нескольким агентам одновременно (до 8 штук) - похоже на Best Practice от Черни 3️⃣ Каждый агент отвечал за свою подсистему: один — шейдеры, другой — CCTV, третий — спутники 4️⃣ Сам выступал архитектором и доменным экспертом — направлял, а не кодил 5️⃣ Cursor не использовал вообще — только чистый терминал Стек: Google Photorealistic 3D Tiles + CesiumJS + Gemini 3.1 Pro + Claude 4.6 + Codex 5.3 🗺 4D-реконструкция Operation Epic Fury Главный демо-кейс — реконструкция ударов по Ирану исключительно из открытых данных: · Закрытие воздушных пространств над Ираном, Ираком, Кувейтом · Массовое перенаправление коммерческих рейсов в реальном времени · Фиксация кинетических ударов по координатам и времени · Закрытие Ормузского пролива — паника танкеров на AIS · Всё это — один человек, диван, публичные данные «Это безумие — что я смог с
48 · 1.5K ·
З
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
Agentic Harness Deep Dive и текущие новости 🆕 На этой неделе Anthropic выпустили две большие новости. 16 апреля — Claude Opus 4.7, новая флагманская модель, которая обошла GPT-5.4 и Gemini 3.1 Pro на бенчмарках по agentic coding и scaled tool use. +13% на 93-task coding benchmark относительно 4.6, изображения до 2576 px по длинной стороне, новый уровень усилий xhigh и task budgets в API, команда /ultrareview в Claude Code. Цена без изменений — $5/$25 за MTok. 17 апреля — Claude Design от Anthropic Labs (VentureBeat): новый product line для дизайна, слайдов, прототипов и one-pagers, powered by Opus 4.7. Читает codebase и design-файлы команды, извлекает цвета, типографику, компоненты — и применяет их автоматически. Экспорт в PDF, PPTX, HTML или прямо в Canva. 📰 Подробнее об этих и других AI-событиях первой половины апреля — в новостном дайджесте. 🔗 Обе новости — про агентов. Opus 4.7 заточен под long-running задачи и agentic coding, Claude Design оркестрирует связку «дизайн → прототип → production code» внутри одной сессии. И там, и там за кадром остаётся то, что делает агентов в принципе работоспособными — обвязка. Именно про неё я и хочу написать. Подготовил классический long read и гамифицированный вариант с тестами. А ниже краткие тезисы. ⚙️ Обвязка агента: почему инфраструктура важнее модели ? OpenAI в феврале 2026 опубликовали отчёт об эксперименте команды Frontier Products: 5 месяцев, команда из 3 инженеров, выросшая до 7, с запретом писать код вручную, Codex-агенты в качестве исполнителей. Итог: ~1 млн строк кода, 1500 pull requests, ни одной строки, написанной человеком — включая файл AGENTS.md, который написал сам агент. Throughput: 3.5 PR на инженера в день. Ключевой вывод главного инженера Райана Лополо: «Agents aren't hard; the Harness is hard». Работа инженеров сводилась к проектированию среды, формулированию намерений и созданию feedback-петель. 🔁 Три эпохи инженерии с LLM ▪️ 2022–2024 — Prompt Engineering: правильные слова в правильном поряд
22 · 844 ·
З
Заметки LLM-энтузиаста
Фотография
нажмите — покажем
📦 Скидки на AI-инструменты для новых пользователей Коллеги, всем привет! 👋 В Lenny's Product Pass вчера обновился список продуктов — бандл годовых подписок на AI-инструменты за $200 (базовый тариф) или $350 (Insider). 💡 Что изменилось по сравнению с апрельской версией 2025 года Вернулись в список: 🔹 Cursor — AI-среда для разработки методом Vibecoding (только для Insider-тарифа) 🔹 Google AI — расширенный доступ к Gemini, NotebookLM, Antigravity, Nano Banana, Flow и 5 ТБ облака (Insider) 🔹 Notion — заметки и рабочее пространство с AI 🔹 Supabase — очень удобная managed база данных и BaaS, Auth, Storage, Edge Functions и Vector search (Insider) 🔹 Fin + Intercom — AI-агент для клиентской поддержки (5 мест + $100/мес кредитов) [кстати, Intercom мы клонировали в прошлом потоке курса] 🔹 Gumloop — платформа для создания агентов поверх рабочих приложений 🔹 Replit — браузерная среда разработки методом Vibecoding с продвинутым AI-агентом, позволяет создавать и деплоить приложения без локальной настройки окружения 🔹 Gamma — AI-инструмент для быстрого создания презентаций, документов и визуального контента 📋 Полный текущий состав (23 продукта) Canva Pro, ChatPRD, Cursor, ElevenLabs, Factory, Fin + Intercom, Framer, Gamma, Google AI, Granola, Gumloop, Linear, Lovable, Magic Patterns, Manus, Mobbin, n8n, Notion, PostHog, Railway, Replit, Stripe Atlas, Supabase, Warp, Wispr Flow. Часть продуктов (отмечены как Insider-only в оригинальном анонсе) доступна только на тарифе $350. Поэтому лучше сначала проверьте под каким тарифом доступны интересные вам инструменты и только потом оформляйте или не оформляйте подписку. Обычно, если вам интересны 2+ AI-инструмента, то подписка на Insider-only имеет экономический смысл, только внимательно прочитайте условия участия ниже. ⚠️ Условия участия - Нужно быть новым клиентом по выбранному продукту (если как я вы уже почти всем интересным пользуетесь, то этим оффером можно воспользоваться чтобы оформить подписку членам семьи) - К
14 · 967 ·
Заметки LLM-энтузиаста
Claude Fable 5: первая публичная модель класса Mythos Коллеги, всем привет! Несколько часов назад Anthropic выпустила Claude Fable 5 — первую общедоступную модель класса Mythos. Это, кажется, важный релиз не только с точки зрения прироста качества, но и с точки зрения того, как меняется сам формат работы с AI. Официальный анонс здесь Если коротко: Mythos — это новый класс моделей Claude, который Anthropic позиционирует выше Opus-класса. Раньше Mythos был доступен только ограниченному кругу организаций через Project Glasswing — в основном для задач киберзащиты и критической инфраструктуры. Теперь появилась публичная версия — Claude Fable 5. Это Mythos-class модель для массового использования, но с более жёсткими safeguards. Полный Claude Mythos 5 при этом остаётся доступен только одобренным организациям. Что такое safeguards Safeguards — это защитный слой вокруг модели: классификаторы риска, ограничения на опасные домены, блокировки и fallback на более безопасную модель в части сценариев. Проще говоря, Fable 5 — это не «голый Mythos», а Mythos с ограничителями для массового релиза. Особенно в high-risk областях: кибербезопасность, биология, химия, distillation и похожие сценарии. По данным Anthropic, safeguards срабатывают в среднем менее чем в 5% сессий. То есть для большинства обычных задач модель должна работать как полноценная frontier-модель, но на границе опасных доменов будет заметно более зажата. Что важно по характеристикам: 🔹 контекстное окно — 1 млн токенов 🔹 максимальный вывод — до 128K токенов 🔹 цена API — $10 за 1 млн input и $50 за 1 млн output 🔹 это в 2 раза дороже Claude Opus 4.8 🔹 до 22 июня Fable 5 включена в Pro, Max, Team и seat-based Enterprise без доплаты 🔹 после 22 июня Anthropic планирует перевести доступ на usage credits 🔹 для Fable 5 и Mythos 5 действует 30-дневное хранение prompts и outputs для trust & safety 🔹 zero data retention для этих моделей недоступен Подробнее про retention: https://support.claude.com/en/articles/15425996-dat
13 · 948 ·
З
Для меня главный сдвиг здесь такой: мы всё быстрее и дальше уходим от режима «написал промпт → получил ответ» к режиму «поставил задачу → модель сама выстроила и развернула процесс → ты оцениваешь результат и направляешь доработки». Это очень похоже на то, что мы уже видим в Claude Code и агентных пайплайнах: ценность смещается из ручного контроля каждого шага в постановку задачи, проверку качества и умение правильно встроить такие системы в рабочий процесс. Мой вывод: Claude Fable 5 — это публичный релиз нового класса моделей, который заметно двигает нас в сторону долгоживущих агентных процессов. Но trade-off понятный: выше цена, строже safeguards, обязательный retention и больше требований к тому, как такие модели встраивать в реальные продукты. С переводом статьи "Каково это — работать с Mythos" можно ознакомиться по ссылке. @llm_notes @MAX #claude #anthropic #mythos #llm #opus
9 · 1K ·
З
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
🔓🚀 Возвращение Fable 5 и появление Sonnet 5 Anthropic за сутки закрыла историю с приостановкой топовой модели и выпустила новый Sonnet. 🔓 Возвращение Fable 5 12 июня власти США ввели экспортный контроль на Fable 5 и Mythos 5, ограничив доступ иностранным гражданам. Проверять гражданство в реальном времени было нельзя, поэтому Anthropic отключила обе модели для всех. Сейчас пишут, что ограничения сняты. Правда в моей учетной записи на claude.ai и в терминале claude code - все еще доступа нет. Если у кого доступ уже появился - напишите, пожалуйста, в комментариях. Официальная информация по доступу: - Fable 5 возвращается глобально с 1 июля — на Claude Platform, Claude.ai, Claude Code и Cowork - Для Pro/Max/Team и части Enterprise до 7 июля включена в лимиты (до 50% недельного объёма), далее — через usage credits - На AWS, Google Cloud и Microsoft Foundry доступ восстановят по мере готовности - Mythos 5 восстановлен для ряда одобренных правительством организаций в США Что было причиной: Amazon нашли способ обойти защиту Fable 5 — модель по запросу находила уязвимости в коде, а в одном случае сгенерировала демонстрацию эксплойта. По тестам Anthropic, те же уязвимости находили и более слабые модели (Opus 4.8, GPT-5.5, Kimi K2.7), а демо-эксплойт воспроизвели вообще все протестированные. Выпущен новый классификатор, блокирующий этот приём примерно в 99% случаев. Вместе с Amazon, Microsoft и Google предложен индустриальный фреймворк оценки серьёзности джейлбрейков. 🧩 Появление Sonnet 5 Самая агентная модель линейки Sonnet. По качеству вплотную приближается к Opus 4.8, но дешевле; упор — на надёжность в длинных агентных задачах. Ключевое: - Доступна везде: модель по умолчанию для Free и Pro, доступна на Max/Team/Enterprise, в Claude Code и на Claude Platform - API-строка — claude-sonnet-5 - Уровни effort low/medium/high/xhigh балансируют цену и качество - Кибербезопасные классификаторы включены по умолчанию (как в Opus 4.7/4.8) - Обновлённый токенизатор — тот же тек
5 · 964 ·
З
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
Claude Opus 5: почти Fable за половину цены Коллеги, всем привет! 24 июля Anthropic выпустила Claude Opus 5 — новый флагман Opus-класса. Заявка простая: подойти вплотную к интеллекту Fable 5, но примерно за половину цены. Если коротко: это модель «на каждый день». Она стала дефолтной на Claude Max и сильнейшей доступной на Claude Pro. При этом на кибербезопасных задачах Opus 5 по-прежнему позади Mythos 5 — и это, судя по всему, сознательное решение, а не недоработка. Что важно по характеристикам: 🔹 контекстное окно — 1 млн токенов, и по умолчанию, и как максимум 🔹 цена API — $5 за 1 млн input и $25 за 1 млн output 🔹 это ровно столько же, сколько стоил Opus 4.8, и вдвое дешевле Fable 5 🔹 есть Fast mode — примерно в 2.5 раза быстрее за двойную цену (бывает очень полезно, когда у вас остается 10-15% от Max лимита, а времени на то чтоб его потратить совсем немного) 🔹 API-строка — claude-opus-5 🔹 уровни effort (low → max) работают как рычаг «интеллект против расхода токенов» 🔹 для Opus 5 нет требований по обязательному хранению данных Что показывают бенчмарки Тут стоит сразу пояснить, что именно меряют, иначе цифры превращаются в шум: ➊ Frontier-Bench — реалистичные инженерные задачи на код, близкие к настоящей работе. Opus 5 обходит все модели и более чем вдвое улучшает результат Opus 4.8, причём дешевле за задачу. ➋ CursorBench — кодинг в реальном агентном обвесе Cursor. На максимальном effort Opus 5 отстаёт от пика Fable 5 менее чем на 0.5%, но стоит вдвое дешевле за задачу. ➌ ARC-AGI 3 — решение принципиально новых задач, которых модель не видела. Результат втрое выше, чем у следующей модели. ➍ Zapier AutomationBench — бизнес-задачи от начала до конца, без человека в середине. Pass rate примерно в 1.5 раза выше ближайшего конкурента при той же цене задачи. ➎ OSWorld 2.0 — computer use, то есть работа мышкой и клавиатурой в реальном окружении. Обходит лучший результат Fable 5 примерно за треть стоимости. Плюс заметный прогресс в науке: на задачах органической
7 · 739 ·
Заметки LLM-энтузиаста
Ссылка
нажмите — покажем
Grok Bot против Hermes Agent: два подхода к одной задаче Коллеги, добрый вечер! Скорее всего многие из вас уже используют ИИ-ботов на базе Openclaw или Hermes, возможно, что кто-то уже поработал с Grok Bot. Эту заметку я бы хотел посвятить сравнению 2х разных по "духу" (а точнее по архитектуре и продуктовому подходу) ботов: Hermes Agent и Grok Bot. В рамках небольшого отступления сразу обозначу мой текущий облачный сетап: - Hermes боты в docker-контейнерах на одном VPS для всех членов семьи с шарингом Codex подписки, и в случае сбоя - переключением на отечественных LLM-провайдеров (в моем случае cloud.ru) - Claude Code бот (на том же VPS) для администрирования всей конструкции (чтобы можно было перепоручить эту задачу детям) - Сlaude Code (с интерфейсом в тг через официальный плагин) на выделенном VPS как "кузница" харнесса для любого agent runtime (см. мой проект https://www.npmjs.com/package/@dzhechkov/harness-cli и все пакеты что с ним связаны - именно он занимает с момента окончания 9 потока курса по Claude Code мое основное нерабочее время) - я также регулярно пользуюсь manus тг ботом для решения простых задач - просто потому что у меня все еще есть подписка на manus. - эпизодически использую ourobors и openclaw боты в отечественных облаках (в основном cloud.ru) Но вернемся непосредственно к теме: "Daily Dose of DS" недавно выпустили подряд два отличных мастер-класса — по Grok Bot и по Hermes Agent. Я их сначала переводил по отдельности, потом решил собрать в один разбор на русском (13 глав, сравнение по 20 критериям, интерактивный транскрипт) - и посвятить ему эту заметку, чтоб потом можно было вернуться и перечитать. 👉 https://djd1m.github.io/grokbot-vs-hermes/ Если коротко: оба продукта решают одну задачу — довести дело до конца, пока вы не за ноутбуком — и расходятся почти во всём остальном. Grok Bot идёт от продукта, Hermes Agent — от файловой системы. ▪️ ЧТО ВАЖНО ПО GROK BOT 🔹 все ваши боты работают на одном облачном компьютере — общие cookies,
12 · 527 ·
З
Копируем «единорогов» на Claude Code: 8 недель — 8 прототипов. Старт завтра Завтра, 26 августа, в 19:00 мск стартует новый (уже десятый по счету) поток курса по Claude Code. Веду его вместе с Алексеем Черняком (сооснователь Groupon Russia и Product University) Главное отличие этого набора от предыдущих: упор не только на то, чтобы собрать прототип, но и на механизмы роста, виральности и продаж. ▪️ ЧТО МЫ БУДЕМ КОПИРОВАТЬ 🔹 Неделя 1 — сбор видеоотзывов и «стена любви». Аналог Senja: 7000+ создателей и SaaS-компаний, импорт отзывов с 30+ платформ. 🔹 Неделя 2 — умный QR для отзывов о компании. Позитив уходит на Яндекс.Карты, негатив перехватывается до публикации; единый виджет со ссылками на все площадки. 🔹 Неделя 3 — партнёрская программа за 15 минут. Аналог Rewardful (2800+ бизнесов): трекинг рефералов, авторасчёт рекуррентных комиссий. 🔹 Неделя 4 — ИИ-трекер калорий по фото. Аналог Cal AI: 15M загрузок и $30M годовой выручки меньше чем за два года. Фото еды → калории и БЖУ за секунды. 🔹 Неделя 5 — нарезка вирусных клипов из подкаста. Аналог Opus Clip: 10M+ пользователей, ~$20M ARR, 40+ ассетов из одной записи и Virality Score. 🔹 Неделя 6 — ИИ-продавец на данных клиента. Аналог Chatbase: $8M ARR, 10 000+ клиентов, всё на свои. Загрузил сайт и PDF — через 10 минут готов бот. 🔹 Неделя 7 — рассылки с прогревом доменов. Аналоги Instantly ($40M+ ARR) и Smartlead: неограниченные ящики, авто-прогрев, ИИ-ответ быстрее пяти минут. 🔹 Неделя 8 — редизайн комнаты по фото за 25 секунд. Аналог Interior AI Питера Левелса: $40–45K MRR, маржа >99%. 3D Vision сохраняет конструкцию и меняет стиль. 📌 ЕСЛИ ПРИЗЕМЛИТЬ ➊ Восемь живых занятий в Zoom по средам, 19:00–21:00 мск. Плюс записи и Telegram-группа, где разбираем вопросы между занятиями. ➋ Бонусом — запись прошлого набора, где мы за 8 занятий скопировали 8 стартапов с оценкой больше $1B, и ещё десяток проектов из прежних потоков. ➌ Цифры выручки и MRR у аналогов эффектные, но сами по себе не говорят ничего: мы разбираем не «к
10 · 647 ·
Заметки LLM-энтузиаста
Для всех активных пользователей Codex - Важная информация ниже - Недельные лимиты Codex сброшены :)
345 ·
З
Ссылка
нажмите — покажем
Cronjob Response: Мониторинг анонсов reset от лидера Codex (job_id: 7a5e133998e4) ------------- ДОСТУПНО СЕЙЧАС — 12 сентября 2026 (точное время и часовой пояс в публичной выдаче не указаны). “Reset all propagated. Sweet dreams.” Сброс уже применён ко всем пользователям; можно продолжать работу в Codex/ChatGPT Work. https://x.com/thsottiaux/status/2098685367058612394 To stop or manage this job, send me a new message (e.g. "stop reminder Мониторинг анонсов reset от лидера Codex").
3 · 358 ·

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем