На первое место в трендах GitHub вышел OpenSandbox — платформа песочниц для ИИ-агентов от Alibaba.
Она позволяет поднимать изолированные окружения, в которых агенты могут запускать код, работать с вебом или управлять рабочим столом. OpenSandbox не привязан к Python, официальные SDK доступны для Python, Java/Kotlin, TypeScript, C# и Go. Также есть CLI и MCP-сервер для Claude Code и Cursor.
Для изоляции поддерживаются gVisor, Kata Containers и Firecracker microVM, а запускать всё это можно как локально через Docker, так и в более масштабной инфраструктуре.
100% опенсорс 😋
⌨️ Халява: Manus стал бесплатным до 25 августа.
ИИ-агент работает без списания кредитов, подключается к Gmail, календарю и Slack, запоминает ваши сценарии и выполняет задачи по расписанию.
Также умеет:
• Искать и анализировать информацию;
• Работать с документами и таблицами;
• Собирать сайты и писать код;
• Создавать презентации, изображения и видео;
• Открывать страницы и заполнять формы.
Бегом перекладывать на агента всё, до чего не доходили руки.
• Попробовать
@aiaiai
Видео airmountains__env_scenic_grand_tour_22_page_pip.mp4 · 4.9 МБ · нажмите — покажем
Видео 135f09dd0200_split0_000001__car_forward_small_08_page_pip.mp · 4.3 МБ · нажмите — покажем
Видео dCzqGcss9x8-4-0-linear_aug_0-fov90-xi0.00__dolly_in_page_pip · 1.5 МБ · нажмите — покажем
SCoPE
Модицфикация видеогенератора для управления камерой. Даешь ей один кадр и траекторию движения камеры - получаешь видео с заданным движением камеры
У каждого пикселя картинки есть луч от камеры в сцену. Пока сцена не сгенерирована, непонятно что там, но луч уже задан пользователем. SCoPE добавляет этот луч в механизм внимания. Внимание начинает сравнивать не только "что изображено" но и "откуда смотрим". Два луча, которые пересекаются в одной точке сцены, усиливают друг друга, так модель понимает геометрию.
• Все типы движения камеры: наезд, отъезд, облёт, подъём краном, произвольные пути
• Можно прогнать сцену с несколькими траекториями
• Управление с клавиш WASD
• Пересъемка входного видео с новой камерой
• Добавляет меньше 0.1% новых параметров - почти бесплатно
Прикручено к #wan22
Гитхаб
HF
#cameracontrol
Видео Sheets_canvas_sizzle_8-13_BxreOfP.mp4 · 27.2 МБ · нажмите — покажем
В Google Sheets добавили новую фичу, которая превращает таблицу в интерактивное мини-приложение
С помощью промпта описываете Gemini, какое приложение хотите получить из таблицы - и он собирает готовый визуальный макет. Дальше все синхронизировано в обе стороны: правите данные в таблице - обновляется макет в canvas, и наоборот.
Функция избавляет от перегрузки строками и столбцами, превращая сырые данные в понятный визуальный формат. В блоге приводят такие примеры, как трекер учебы, дашборд фэнтези-футбола, план рассадки гостей на свадьбе.
Работает через кнопку "Create canvas" в панели Ask Gemini внутри Google Sheets. Макет можно донастраивать новыми промптами, а готовым canvas делиться как обычной вкладкой таблицы - вместе со всеми, у кого есть доступ к файлу.
https://blog.google/products-and-platforms/products/workspace/sheets-canvas-for-google-sheets-spreadsheets/@ppprompt
Всем добрый день! Ищу человека кто занимается ИИ контентом, создание и генерация моделей с 0, фото, видео. Как SFW так и NSFW. Если есть такие специалисты, прошу написать в лс, с примерами/кейсами. Просьба писать тех кто реально умеет делать качественно и хорошо, нужен большой обьем около 100+ роликов. Сделаю быстрый отбор и сразу приступим к работе
Вышел Qwen-3.8 27B!
https://huggingface.co/Qwen/Qwen3.8-27B
Бенчмарки на уровне Claude Opus 4.6, даже чуть лучше. Скачок значительный. Хорошие результаты на агентных задачах и в кодинге.
В комплекте: мультимодальность, контекст 262к токенов (расширяется до 1М), настраиваемый бюджет ризонинга, лицензия Apache 2. Можно запустить на несложном железе после квантизации.
Видео compressO-Timeline 1.mov · 2.3 МБ · нажмите — покажем
✴️ Переводчик с языка жестов появился прямо в смартфоне.
Модель SL2T считывает движения рук, тела и мимику, а затем превращает их в английский текст на экране.
Фича поможет глухим и слабослышащим общаться с людьми без переводчика. Первым её получит Pixel 11, позже список устройств и поддерживаемых языков обещают расширить.
Вот такой ИИ нам нужен.
• Источник
@aiaiai
Видео 🎥 One Model. One Generation. One Complete Shot.Ge.mp4 · 3.7 МБ · нажмите — покажем
Вы будете смеяцца, но у нас новый видео генератор.
И это просто конский монстр. По сравнению с ним Минимакс - это Stable Diffusion 1.5 на два килобайта.
Итак MAGI-2 Preview - открытая unified audio-video модель на 114B параметров, построенная как очень мелкозернистый MoE. Единовременно активируется около 6B параметров, то есть примерно 5% всей ёмкости модели. Sand AI называет это Ultra-Fine-Grained MoE / MagiMoE.
Модель одновременно работает с текстом, видео и аудио в одном Transformer backbone.
Главная архитектурная фишка интереснее самого числа 114B. Backbone - **40 Transformer layers**, из них средние **36 слоёв MoE**, четыре крайних dense. Hidden width 3072 разбивается на **12 независимых head по 256 dimensions**. У каждого head собственный набор из **256 экспертов**, а на токен выбираются Top-6. То есть на одном MoE-слое потенциально существует 12 × 256 = **3072 маленьких expert-блоков**, но конкретный токен использует всего 72 из них. Это позволяет хранить огромное количество специализированных параметров, не прогоняя 114B целиком на каждом diffusion step.
Сейчас заявлены T2V и I2V, причём звук генерируется совместно с изображением, а не приклеивается отдельной моделью после генерации. Выход пока жёстко ограничен 10 секундами. Референсов и редактирования нет.
Генерация двухступенчатая:
- base/preview: 512 × 896
- refiner: 1088 × 1920
- затем при необходимости output ресайзится до настоящих 1080 × 1920.
А теперь праздник: системные требования
Официальный MINIMUM(!):
8 × NVIDIA Hopper GPU.
Типа 8×H100/H200. Общий размер весов - около 307 GB:
- main preview transformer - 228 GB
- Qwen3.5-27B text encoder - 56 GB
- refiner - 14 GB
- Stable Audio Open audio VAE - 5 GB
- Wan 2.2 video VAE - 3 GB
- Turbo VAE decoder - 2 GB.
То есть полный зоопарк - особенно напрягает Stable Audio и древний ВАН.
По счастию Монстр уже есть на Artificial Analysis.
И среди open-weight video models with audio сейчас картина такая:
1. MiniMax H3 - 1192
2. MAGI-2 Previe
Видео dreamina_2026_08_14_1259_Reference_map_🔴_Sara_·_ID_=_@Image_ · 22.1 МБ · нажмите — покажем
Фотография нажмите — покажем
В Dreamina для Seedance 2.5 появилась генерация в 1080p / FHD-классе.
Я проверил не только интерфейс, но и реальный скачанный файл через ffprobe.
Что получаем на выходе:
• Кодек: H.264 / AVC, High Profile
Стандартный файл, который без проблем открывается в DaVinci Resolve, Premiere и большинстве монтажных программ.
• Битрейт: около 26 Мбит/с
Хороший показатель для AI-видео. Файл не выглядит агрессивно пережатым и оставляет нормальный запас для дальнейшего монтажа и цветокоррекции.
• Цвет: 8-bit, YUV 4:2:0
Это не профессиональный 10-bit мастер, но вполне качественный стандартный формат для монтажа и публикации.
• Реальная частота кадров: около 24 fps
В метаданных контейнера можно увидеть 60 fps, но фактически в тестовом файле было 169 кадров за 7 секунд, то есть примерно 24 fps.
• Контейнер: MP4
• Аудио: AAC, stereo, 44.1 kHz
В моём тесте был выбран формат 21:9, поэтому фактическое разрешение файла получилось 2206 × 946 px. Dreamina сохраняет повышенное разрешение с учётом выбранного соотношения сторон.
Цена на турецком аккаунте Dreamina:
5 сек ≈ $2.32 / 194 ₽
10 сек ≈ $4.64 / 388 ₽
20 сек ≈ $9.29 / 776 ₽
30 сек ≈ $13.93 / 1 164 ₽
Главное: Seedance 2.5 в Dreamina теперь можно получать в действительно пригодном для нормального монтажа высоком разрешении, с весьма приличным битрейтом около 26 Мбит/с.