17 августа 2026
Sev7Мне дома надо код писать, а не бенчи гонять.
Сегодня пробовал на нём написать код и получилось офигенно. Могу показать код.
id 2349661592Сегодня пробовал на нём написать код и получилось офигенно. Могу показать код.
Офигенно в смысле не хуже Sonnet 4.6? Да ладно.
Sev7Офигенно в смысле не хуже Sonnet 4.6? Да ладно.
смотри исходники. в соннете 4.5
1) код на расте через раз не работал
2) отсутствовала эффективная непрерывная работа длительное время
18 августа 2026
Ссылка
нажмите — покажем
нажмите — покажем
OpenAI на две недели полностью остановила RL для последних моделей, готовящихся к релизу. Самый крупный запланированный RL-run пока так и не возобновили. Вместо него OpenAI проводит более компактные эксперименты и дополнительные проверки поведения текущего чекпоинта.
Речь, понятно, про Astra. Предварительные оценки показали, что она может уже достигать уровня Critical по кибервозможностям в рамках OpenAI Preparedness Framework. Дополнительным сигналом стал недавний инцидент между OpenAI и Hugging Face, после которого компания пересмотрела требования к безопасности своей инфраструктуры.
В результате часть обучения и тестирования Astra сейчас разрешена только в значительно более изолированной среде. OpenAI усиливает sandboxing для запуска сгенерированного моделью кода, ограничивает сетевой доступ высокорисковых нагрузок, убирает потенциально уязвимые общие сервисы и вводит более жесткие security рамки. Некоторые задачи уже удалось перенести на новую инфраструктуру, однако значительная часть экспериментов с Astra по-прежнему заморожена. В первую очередь компания восстанавливает работы, связанные с safety и alignment.
Одновременно OpenAI существенно расширила мониторинг размышления моделей. Теперь для наиболее мощных систем анализируются не только tool calls, но и доступные reasoning traces и вся последовательность действий. Система ищет признаки попыток получить несанкционированный доступ, украсть данные, разрушить ресурсы или обойти защитные механизмы. Для критических случаев действует схема быстрого реагирования: если тревогу нельзя уверенно признать ложной в течение примерно 30 минут, соответствующий процесс должен быть остановлен.
Причем такой контроль оказался довольно дорогим - по оценке OpenAI, дополнительный мониторинг сейчас требует примерно 20% вычислительных ресурсов поверх самого инференса. После того как 7 августа Astra была предварительно отнесена к моделям с потенциально критическими кибервозможностями, усиленный мониторинг стал обязательным для в
22.9K · 19 августа 2026
id 1801466871Фотография
я все на сол ультра делаю. одновременно в работе кодится 2-4 проекта каждый день. с качественными настройками репо-правил и планинг-системы мне хватает тарифа про х20 с запасом
24 августа 2026
Фотография
нажмите — покажем
нажмите — покажем
Токены в покемонов - приложение для macOS, которое превращает расход токенов в Claude Code / Codex покемон-прогрессию. Чем больше токенов потребляется, тем быстрее эволюционируют покемоны и переходят в новые формы
https://github.com/chattymin/PokeTokenBar
1.1K · id 1801466871Токены в покемонов - приложение для macOS, которое превращает расход токенов в Claude Code / Codex покемон-прогрессию. Чем больше токенов потребляется, тем быстрее эволюционируют покемоны и переходят в новые формы
https://github.com/chattymin/PokeTokenBar
вайб кодинг который мы заслужили )
id 1801466871Токены в покемонов - приложение для macOS, которое превращает расход токенов в Claude Code / Codex покемон-прогрессию. Чем больше токенов потребляется, тем быстрее эволюционируют покемоны и переходят в новые формы
https://github.com/chattymin/PokeTokenBar
Нужно другую версию: приложение преобразует прогресс расхода токенов, в прогресс расхода денег.
id 1801466871Токены в покемонов - приложение для macOS, которое превращает расход токенов в Claude Code / Codex покемон-прогрессию. Чем больше токенов потребляется, тем быстрее эволюционируют покемоны и переходят в новые формы
https://github.com/chattymin/PokeTokenBar
Ну а дальше понятно, надо покемонов в NFT превращать
id 1801466871Токены в покемонов - приложение для macOS, которое превращает расход токенов в Claude Code / Codex покемон-прогрессию. Чем больше токенов потребляется, тем быстрее эволюционируют покемоны и переходят в новые формы
https://github.com/chattymin/PokeTokenBar
Как по мне было бы интереснее, если оно брало и оценивало сколько токены стоили по апи/подписке, а потом что ты мог на них купить сравнивая с коллекционными карточками покемонов что продают на аукционах)
25 августа 2026
Харнесс >> модель.
Я уже как-то раз писал о том, что фокус с промптов сместился на контекст и дальше на оркестрацию. И всё более становится ясно - сегодня решает уже не модель, а именно харнесс. Модель, разумеется, всё ещё нужна. Просто выяснилось, что этого недостаточно. Такое с умными людьми тоже бывает.
Очень многие смотрят в эту сторону.
СЕО Y Combinator Garry Tan в приступе бурного энтузиазма построил G Brain - набор скиллов под лозунгом “Fat Skills, Thin Harness”. Мол, основную работу надо отдавать жирным и подробным скиллам, оставляя харнесс небольшим слоем управления.
Похожая философия и у набирающего популярность Pi (pi.dev). Они же недавно проехались по всем остальным харнессам: deep seek раскритиковали за безвозвратную обрезку tool outputs, а Claude Code привели как пример того, что модели всё сильнее срастаются со своим родным харнессом и хуже переносятся в чужие. Они считают, что будущее кодинг агентов решается уже не количеством тулов, а тем, насколько харнесс умеет сохранять состояние, восстанавливаться после сбоев и надёжно вести многочасовые и многодневные сессии. Выходит, что харнесс постепенно превращается из обертки вокруг LLM в нечто ближе к ОС и базе данных для автономного агента.
Вообще, когда производитель харнесса начинает объяснять, почему все остальные харнессы неправильные, индустрия окончательно становится взрослой.
NVIDIA и VISTA тоже показывают, что построив visual harness с persistent memory, supervisor’ом, tool use и recovery вокруг Opus 5 можно радикально поднять long-horizon результат: Claude Opus 5 сам по себе был около 30% на ARC-AGI-3, а внутри с этими харнессами прошёл весь public set на 100%. Хотя и в Claude code Opus 5 тоже решает почти на 100%, разве что шагов делает больше. Но мысль понятна: делать хороший харнесс важно и нужно. Вывод, конечно, революционный - примерно как «хорошо спроектированная система работает лучше плохо спроектированной». Но индустрии иногда требуется несколько миллиардов долларов, чтобы это до
3.1K · id 1801466871Харнесс >> модель.
Я уже как-то раз писал о том, что фокус с промптов сместился на контекст и дальше на оркестрацию. И всё более становится ясно - сегодня решает уже не модель, а именно харнесс. Модель, разумеется, всё ещё нужна. Просто выяснилось, что этого недостаточно. Такое с умными людьми тоже
Make no mistakes->make no downtime
id 1801466871Харнесс >> модель.
Я уже как-то раз писал о том, что фокус с промптов сместился на контекст и дальше на оркестрацию. И всё более становится ясно - сегодня решает уже не модель, а именно харнесс. Модель, разумеется, всё ещё нужна. Просто выяснилось, что этого недостаточно. Такое с умными людьми тоже
довольно логично, что рынок пойдёт в сторону компенсации слабых мест трансформеров, типа дорогого длинного контекста, KV cache, long-term memory бла бла бла. Кто первым соберёт оптимальное решение вокруг этого и продаст лучше , тот млдц.
ультра веселят рееееволюционные идеи о том, что будущее за persistent state, recovery, sessions, memory. Это направление стало довольно очевидным ещё со времён появления самих трансформеров кекв.
id 1801466871Харнесс >> модель.
Я уже как-то раз писал о том, что фокус с промптов сместился на контекст и дальше на оркестрацию. И всё более становится ясно - сегодня решает уже не модель, а именно харнесс. Модель, разумеется, всё ещё нужна. Просто выяснилось, что этого недостаточно. Такое с умными людьми тоже
Ai memory optimizator | B2B Saas
- Оптимизировал память клод кода, создав проект с txt файликами 🌚
26 августа 2026
TonyAi memory optimizator | B2B Saas
- Оптимизировал память клод кода, создав проект с txt файликами 🌚
ну да, txt файлики и есть тот самый enterprise слой, который потом ещё и синкать руками весело
id 1801466871Харнесс >> модель.
Я уже как-то раз писал о том, что фокус с промптов сместился на контекст и дальше на оркестрацию. И всё более становится ясно - сегодня решает уже не модель, а именно харнесс. Модель, разумеется, всё ещё нужна. Просто выяснилось, что этого недостаточно. Такое с умными людьми тоже
Вау, какая уникальная и новая мысль. Автор гений, не менее.
27 августа 2026
1 сентября 2026
Ответтекст ещё не в индексе
Для меня как для клубничника интересно, какую селекцию вы ведёте, можете рассказать?