Человек 2.0
Фотография
нажмите — покажем
нажмите — покажем
Китай снова в игре. Xiaomi выпустила убийцу Kimi/Qwen
⠀
Xiaomi выпустила MiMo-V2.6-Pro и MiMo-V2.6-Flash — две разреженные модели с архитектурой смеси экспертов и контекстом на 1 млн токенов. Они мультимодальны, принимают текст, изображения, видео и аудио, а выдают текст. Pro насчитывает 1,02 трлн параметров при 42 млрд активных, Flash — 309 млрд при 15 млрд активных.
⠀
Независимый индекс интеллекта AA оценил Pro в 46 баллов; Xiaomi приводит точное значение 46,32. На старте это первое место среди моделей с открытыми весами — выше Kimi K3 и Qwen3.8 Max. В общем зачёте выше стоят закрытые модели.
⠀
Официальная цена API за 1 млн токенов у Pro: $0.0435 за входные токены при попадании в кэш, $0.435 при промахе и $0.87 за выходные. У Flash — $0.014, $0.14 и $0.28 соответственно. Это те же тарифы, что у MiMo-V2.5. По всем трём позициям Flash обходится втрое дешевле.
⠀
AA также насчитала $0.13 за задачу по своей взвешенной методике индекса. Эта сумма относится к набору задач AA. Стоимость произвольного запроса определяют объём входа, длина ответа и использование кэша.
⠀
Xiaomi заявляет, что Pro при сопоставимом уровне интеллекта обходится в 20–60 раз дешевле зарубежных моделей. Такой диапазон зависит от выбранного закрытого флагмана и методики расчёта стоимости задачи. Для всех запросов и моделей единого коэффициента здесь нет.
⠀
Обучение с подкреплением для Pro заняло рекордные 5 дней 7 часов 29 минут — 127,5 часа. За 30 шагов модель обработала 75 млрд токенов и 753 тыс. траекторий, расходы составили $2,62 млн. Flash прошла свои 30 шагов менее чем за шесть дней и потребовала $0,85 млн.
⠀
Эти суммы покрывают только этап обучения с подкреплением. Xiaomi публиковала ход запуска вместе с расходами и сбоями: переполнением памяти GPU, дисбалансом нагрузки между экспертами, сетевой аварией и пропущенной инфраструктурной ошибкой у Flash.
⠀
Веса и технический отчёт уже доступны под лицензией MIT. Xiaomi также заявила об открытии кода обучения с подкреплением и более 7 тыс. сред с з
13 · 745 · Фотография
нажмите — покажем
нажмите — покажем
Вышли новые модели GPT-6
Токены стали в 2 раза дешевле. Аллилуйя.
В целом, чуть умнее, где-то чуть хуже по бенчам.
У меня Sol оставался рабочей лошадкой в Hermes и я буду рад тому, что теперь на той же подписке буду делать х2 задач.
8 · 741 · Человек 2.0
Фотография
нажмите — покажем
нажмите — покажем
ChatGPT Pro Max за $500 нашли в утечке
⠀
ChatGPT может получить тариф Pro Max за $500 в месяц. И это, мать его, до налогов. В описании обещана максимальная скорость Work и Codex, однако пока тариф существует только в материалах, которые разобрал TestingCatalog: официального анонса OpenAI нет.
⠀
Утечка не раскрывает конкретные лимиты тарифа.
⠀
Связь Pro Max с Cerebras не подтверждена, но желательна.
Единственное заявленное свойство — максимальная скорость Work и Codex.
Остальные характеристики, доступность по регионам и условия подключения пока неизвестны. Исходная публикация с утечкой.
⠀
При этом OpenAI с 10 сентября 2026 года приостановила новые подключения и переходы на Pro за $200.
3 · 472 · Фотография
нажмите — покажем
нажмите — покажем
💬💬💬💬💬Новый выпуск «Чип проверил» уже доступен к просмотру на всех площадках.
За 15 минут разобрал ТОП-10 новостей ИИ за неделю: от Googlebook с Gemini до Claude и Grok. И что из этого стоит вашего внимания.
План выпуска на этот раз полностью подготовил ИИ-агент, а я прошёлся по его сценариями и сел перед камерой. Тот же агент сам смонтировал ролик и подготовил описание с визуалами перед публикацией.
Смотреть выпуск:
😉 YouTube · 😄 VK Видео · 🥰 RUTUBE · ☺️ Дзен
Приятного просмотра!
1 · 425 · Человек 2.0
Фотография
нажмите — покажем
нажмите — покажем
Microsoft строит Autopilot на OpenClaw
⠀
Разработчики Microsoft возвращают доработки в общий проект. Они достаются и тем, кто не пользуется Autopilot.
⠀
Microsoft представила постоянного облачного агента: он следит за рабочими обсуждениями, запрашивает обновления и выполняет повторяющиеся задачи. Раньше продукт назывался Scout. Расширить закрытое тестирование планируют в конце сентября.
Оказалось, его делают на базе OpenClaw.
⠀
В опенсорсную базу уже вошли проверки настроек и доставки сообщений нужному агенту, доработки приложения для Windows, исправления зависаний фоновых задач и дублирующихся ответов.
⠀
Один из примеров: агент больше не должен слепо повторять команду, если неизвестно, выполнилась ли она в первый раз. Тайм-аут ещё не означает, что ничего не произошло.
⠀
Не каждый вклад сотрудника Microsoft становится функцией Autopilot. Но исправления общего проекта доступны за пределами корпоративного продукта.
⠀
Разбор OpenClaw · Анонс
1 · 405 · Фотография
нажмите — покажем
нажмите — покажем
Похоже, OpenAI вслед за Мета (запрещена в РФ), Гуглом и Майкрософт выпустит своего персонального ассистента.
Назвали, судя по слову, коротко. Буквой о. Попробуйте такое погуглить :)
2 · 428 · Человек 2.0
Фотография
нажмите — покажем
нажмите — покажем
Не устроили 15 токенов в секунду — написал свой движок
⠀
Разработчик запускал Qwen3.8-Flash-Next через llama.cpp на RTX 5070 с 12 ГБ видеопамяти. Получал около 15 токенов/с. Решил, что ему мало.
⠀
Написал Strata, свою обвязку конкретно под эту модель и свой компьютер — и, по его замерам, получил около 65 токенов/с с тем же квантом IQ3_XXS. На той же машине: Ryzen 5 7600, 64 ГБ оперативки и Windows.
⠀
При длинном контексте 128K результат для IQ3_XXS ниже: 44,8 токена/с. Указанные в твите 65,1 на 128K относятся к другому, сильнее сжатому варианту Q2_0. Но всё равно впечатляет.
⠀
Ускорил модель на собственном ПК и выложил движок в открытый доступ. Теперь результат можно попробовать воспроизвести.
Инновации, которые нам нужны.
⠀
Рассказ разработчика · Strata · Пост в X
7 · 396 · Ссылка
нажмите — покажем
нажмите — покажем
У голосового агента появилось больше интонаций
ElevenLabs выпустила две модели синтеза речи: Eleven v4 для выразительной озвучки и Eleven v4 Turbo для разговоров с минимальной задержкой. Вместо ровного чтения текста модель учитывает тон, паузы и контекст: одна и та же фраза от врача и персонажа игры звучит по-разному.
⠀
У Turbo медианное время до начала речи — около 150 мс. Обе версии поддерживают более 90 языков и доступны через сервисы ElevenLabs и API.
⠀
Ответочка на вчерашний анонс голосовой модели Google.
Анонс ElevenLabs
14 · 365 · Человек 2.0
Ссылка
нажмите — покажем
нажмите — покажем
Pro за $200 возвращается. Но старой щедрости уже не будет 💀
30 сентября OpenAI снова откроет подписку новым пользователям. Одновременно компания меняет расчёт использования: за те же $200 денежный эквивалент лимита в расходах через API станет примерно вдвое меньше прежнего.
⠀
Что остаётся: скользящий лимит на пять часов не вернут. Недельный запас можно потратить тогда, когда он нужен, хоть сразу.
⠀
Тибо из OpenAI объясняет перемену так: модели стали эффективнее, а цена GPT-6 Sol и Luna в API снизилась на 50%. Компания хочет сближать подписку с оплатой API по факту использования, а не держать разрыв за счёт высокой цены API.
⠀
Завтра также добавят возможности, которые не будут расходовать лимит. Какие именно — пока не раскрывают. Основные анонсы тоже обещаны 30 сентября.
Уходит эпоха субсидирования подписок. А значит, приходит эра китайских открытых моделей.
⠀
Пост Тибо
1 · 330 · Фотография
нажмите — покажем
нажмите — покажем
GPT-6.1 Sol подтянули к Astra. Проверим, что там будут за лимиты
OpenAI выпустила обновлённую Sol: она сильнее GPT-6 Sol в коде, управлении компьютером и профессиональных задачах. На части тестов результат уже близок к GPT-6 Astra. В задачах по коду DeepSWE прирост к прежней Sol составил 6,4 процентного пункта.
⠀
Модель уже доступна в Codex, ChatGPT Work и API. В обычном чате её пока нет.
⠀
Цена API за миллион токенов не изменилась: $2 за вход и $10 за выход. Зато чтение кэша подешевело вдвое: с $0,20 до $0,10.
⠀
В API стало выгоднее держать большой рабочий контекст. А вот сколько задач выдержит недельный лимит подписки с новой Sol — проверим вживую.
OpenAI догонять и догонять Anthropic и Opus 5.5
И знакомьтесь, Dots. У Dots собственный облачный компьютер и браузер, GPT-6 Astra и подключения к вашим приложениям. Можно написать ему в ChatGPT, Slack или Teams, поговорить голосом, поставить задачу и вернуться за результатом.
⠀
Он запоминает предпочтения и правки. Среди сценариев: собрать исправления кода с тестами, обновить материалы к запуску продукта, превратить интервью в заготовки постов и коротких роликов.
⠀
Когда активной задачи нет, агент может искать полезное в подключённых приложениях. Этот фоновый режим работает только на чтение: сам по себе он не отправляет сообщения и не меняет ваши файлы.
⠀
Первый Dots включён в Pro и Business Premium. Доступ запускают постепенно в поддерживаемых регионах; в Enterprise бета включается администратором.
⠀
Разговоры с Dots не расходуют лимит ChatGPT. Задачи в Codex и ChatGPT Work — расходуют.
⠀
Анонс OpenAI
3 · 337 · Фотография
нажмите — покажем
нажмите — покажем
На тарифе за $500 хочется работать, а не караулить счётчик
У Astra Ultrafast в Codex вместе со скоростью генерации растёт расход квоты. OpenAI указывает: токены генерируются до 8 раз быстрее, включённый лимит расходуется с множителем 8x относительно Standard. Когда он исчерпан, в ход идут доступные купленные кредиты — с множителем 6x.
Теперь к тому, как это выглядит на новом тарифе за полкосаря вечнозелёных.
flashloanz сообщает: чуть больше 5 минут с Astra High Ultrafast — минус 9% недельного лимита на тарифе $500.
kagehiko потратил 11% на несколько небольших задач в Ultrafast.
А JP пишет об исчерпании недельного лимита менее чем через 30 минут работы с Astra Ultrafast. Тоже подписка за $500.
Пятьсот долларов. И за них ваш Codex будет работать полчаса в неделю? OpenAI умудрились за неделю убить весь свой бизнес.
Модели работают хреново, деньги стали улетать быстрее. Даже ресеты не спасут, они как пластырь для того, кто харакири сделал.
WTF?
7 · 392 · Пришло письмо от OpenAI
Дали дропом 2500 долларов на акк кредитами, до декабря надо истратить. Они включаются, когда подписка на лимиты налетает.
Pro x20 стал x10. Ушла эпоха субсидий. Теперь, по сути, два акка по 100 долларов лучше чем 1 за 200, потому что у тебя лимитов столько же, но зато два ресета будет даваться, а не один.
Ещё подкинули кость, что до конца октября лимиты повышенные останутся.
Ну, за месяц много воды утечет, может на GLM 5,4 перейдём :)
Работаем.
6 · 394 · Человек 2.0
Фотография
нажмите — покажем
нажмите — покажем
OpenAI сделала нам рабочую лошадку
Ещё один релиз OpenAI — и первая реакция: что они там опять судорожно чинят? А потом смотришь на результат и стоимость GPT-6.1 Sol. Похоже, среди этой суеты и криков о конце OpenAI выпустили самую полезную модель за последние пару месяцев. Рабочую лошадку для Codex и Hermes.
Агенту ведь нужно не только ответить, но и прочитать файлы, найти ошибку, внести правку, запустить тесты. Если не получилось — зайти ещё раз. На этом «ещё раз» и набегает счёт.
Павел Гурын дал моделям два репозитория со 105 специально внесёнными ошибками. Задача — найти и исправить. При максимальных усилиях GPT-6 Astra получила оценку 45, потратив $33 на API. GPT-6.1 Sol — 44 при $6,56.
Один балл разницы. Примерно пятикратная разница в расходах на этот прогон.
Остальные результаты добавляют контекста: GPT-5.6 Sol — 43,5 за $95,35. Opus 5.5 — 41,7 за $58,53. Предыдущая GPT-6 Sol обходилась в $9,33, но набирала 29,3. Теперь у Sol почти результат Astra, а счёт меньше даже собственного предыдущего.
Это именно то, о чем говорил Тибо. Вы будете иметь меньше лимитов, но модели будут дешевле и быстрее достигать нужного вам результата и итоговые затраты будут ниже, чем неделю назад.
Я выбираю такой вариант.
В анонсе OpenAI у Sol 6.1 заявлен близкий к Astra уровень в коде, управлении компьютером и профессиональных задачах. Тарифы API за миллион токенов: $2 за вход, $10 за выход, $0,10 за кэшированный вход. Когда агент часами возится с репозиторием, эти цены участвуют в работе постоянно.
Astra и Opus оставим право удивлять блендерами и презентациями. Для ежедневного Codex и Hermes куда нужнее модель, которой можно поручить следующую задачу без раздумий, стоит ли она счёта, который принесёт официант в конце вечеринки. У GPT-6.1 Sol сейчас очень хорошие шансы занять это место.
Мой личный опыт за 24 часа: около 10 моих проектов наконец-то сдвинулись с мертвой точки. Чисто на Sol 6.1.
Ждите релизов 🔌
5 · 306 · 🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
🎨🎨🎨🎨🎨🎨🎨🎨🎨
Готовы к первому релизу?
1 · 299 · Фотография
нажмите — покажем
нажмите — покажем
«Гермес, ну продолжай»
Странная работа — напоминать ИИ-агенту, чтобы он работал. Поручаешь ему собрать информацию, подготовить обзор, разобраться с файлами и принести результат в Telegram. А потом возвращаешься подталкивать.
Вот эту ручную возню мы и убирали. Шесть месяцев доработок. Не меньше 10 месячных лимитов на тарифах по $200 сожгли на разработку. В том числе ради довольно скромного желания: пореже писать «ну продолжай».
Теперь отдаём нашего Гермеса вам.
В Среде появились Сборки — готовые решения под конкретные задачи, с нужными инструментами, нашими доработками и инструкцией запуска. Можно взять основу, настроить под себя и пользоваться.
Первая — Hermes Powerpack Gen 2. Наша сборка Hermes с 17 плагинами и доработками. Сам Hermes — ИИ-агент, который живёт на вашем сервере. Powerpack убирает часть возни вокруг его ежедневной работы.
После перезапуска шлюза агент возвращается к сохранённым задачам. Если подключённый аккаунт OpenAI упёрся в лимит, переключается на следующий доступный из подключённых.
В подключённых Telegram Business-чатах расшифровывает голосовые — и ваши, и собеседника. Проверяет, отправлены ли ответ и обещанные файлы.
На странице Сборки уже есть полный состав и промпт для установки через coding-агента. На подготовку VPS, подключение модели, установку и первую задачу ориентируйтесь примерно на 30 минут.
Сборка доступна участникам «Среды внедрения ИИ». Свой VPS и доступ к модели оплачиваются отдельно. Рекомендуем подписку ChatGPT Pro и Sol 6.1 medium reasoning.
Посмотреть первую Сборку
Скоро дадим проголосовать за следующие Сборки. Выберем, какую ручную возню убирать дальше.
10 · 427 · Человек 2.0
Видео
github-11389.mp4 · 4.1 МБ · нажмите — покажем
github-11389.mp4 · 4.1 МБ · нажмите — покажем
DLSS — теперь для фото и видео из своей папки
Обычно за DLSS идёшь в настройки игры. В Visual Enhancer можно открыть собственный снимок или ролик и посмотреть, что нейронная обработка сделает с ним.
Допустим, на большом экране старое видео выглядит слишком мелким и нечётким. Здесь можно повысить разрешение, попробовать HDR, сделать движение плавнее за счёт промежуточных кадров. Этапы выбираешь сам — включать всё сразу незачем.
И главное, можно сравнить результат с исходником. Потому что «стало эффектнее» и «так было на самом деле» — разные вещи. Нейронная обработка меняет изображение, а не возвращает подлинные детали, которых в файле не было.
Visual Enhancer использует DLSS 5 через Neuroframe Engine. Для работы нужны Windows 11 и совместимая NVIDIA RTX, но одной надписи RTX на видеокарте недостаточно: доступность функций зависит от конкретной модели, драйвера и нужных компонентов. DLSS 5 поддерживается не на каждой RTX.
Понравившийся результат можно сохранить отдельным файлом или обработать целую подборку. А локальные видео и поддерживаемые онлайн-трансляции — смотреть с обработкой прямо во время воспроизведения.
Это независимый проект, не связанный с NVIDIA. Приложение портативное: скачиваешь ZIP из раздела выпусков на GitHub, распаковываешь и запускаешь.
Visual Enhancer на GitHub
Начать лучше с одного знакомого кадра. На нём легче заметить, где картинка стала лучше, а где — просто другой.
5 · 296 · Человек 2.0
Видео
3.2 МБ · нажмите — покажем
3.2 МБ · нажмите — покажем
POV: вайбкодер, который не даёт полный доступ codex и апрувит каждый запрос агента вручную
3 · 272 · Ссылка
нажмите — покажем
нажмите — покажем
Gemini 4 Argon: миллион токенов на ответ по стартовой цене Sol
Google представила Gemini 4 Argon. Самая любопытная цифра — миллион выходных токенов за один запрос. Примерно объём всей «Войны и мира» на русском. У GPT и Claude обычный потолок — 128 тысяч: почти в восемь раз меньше.
Для работы это возможность получить длинный документ целиком, без десятка сообщений «продолжай». Объём зависит от токенизатора, часть бюджета могут занять рассуждения. Миллионный бюджет есть и у Kimi K3.
Остальные результаты тоже хочется проверить на своих задачах: 77,9% в DeepSWE, первое место в Vals Index и Zapier AutomationBench, 91,7% в LVBench. Код, финансы, право, рабочие процессы, длинные видео.
Стартовые тарифы API — $2 за миллион входных токенов и $10 за миллион выходных. Ровно столько же стоят GPT-6.1 Sol и Claude Sonnet 5.5. У GPT-6 Astra и Claude Fable 5.1 — $10 / $50, в пять раз дороже.
После вводного периода Argon подорожает до $4 / $20. Это уровень GPT-5.6 Sol и Claude Opus 5.5. До Astra и Fable останется разница в 2,5 раза. Кэшированный вход — со скидкой 95%. Тарифы OpenAI · Тарифы Claude.
Пока доступ есть у специалистов по киберзащите из Fairwind и доверенных тестировщиков. Для остальных обещают платный API и Google AI Ultra, без даты.
Теперь ждём доступа. Хочется дать Argon реальную задачу и посмотреть, сколько работы он доведёт до конца.
272 · Человек 2.0
Фотография
нажмите — покажем
нажмите — покажем
Не знаете с чего начать с Hermes? Воспользуйтесь встроенными в него автоматизациями.
Сохраните себе этот список и пробуйте разобраться с одной в день.
Одна освоенная и внедренная автоматизация лучше 10 оставшихся выключенными.
12 · 213 · Человек 2.0
Фотография
нажмите — покажем
нажмите — покажем
Самое обидное в Telegram — пропустить полезную вещь в чате, на который ты сам подписался.
Собрал для Hermes SB-002 — дайджесты твоих чатов. Выбираешь, что читать и за какой период. Агент собирает обсуждения в короткий обзор со ссылками на исходные сообщения.
Это именно те дайджесты, которые вы так любите в Среде.
Рабочие чаты, профессиональные сообщества, каналы про инструменты — подключаешь то, что нужно тебе. Можно попросить:
«Собери главное из этих чатов за неделю».
Или за несколько часов, день, конкретные даты. Период задаёшь сам.
Hermes связывает текстовые сообщения и ответы, подтягивает контекст, учитывает уточнения и исправления. Утверждения отдельно проверяются моделью.
Заинтересовала история — открываешь источник. Можно проверить вывод и вернуться в обсуждение с нужного сообщения.
Первый дайджест сохраняется у тебя. Отправка в Telegram и ежедневное расписание подключаются по желанию. Можно начать с одного обзора.
Нужны свой Hermes на Linux, Telegram и доступ к модели. MiniMax — один из вариантов. Тексты обрабатывает подключённая модель, расходы на неё оплачиваются отдельно.
Сборка доступна участникам «Среда внедрения ИИ» через приватный GitHub. На странице — описание и готовый запрос для установки в Hermes.
Начни с чатов, которые давно откладываешь «на потом».
Открыть сборку SB-002
10 · 226 ·