Веб-версияОткрыть в Telegram
DData Chat

Data Chat

@datascience_chat · группа · Технологии · в индексе с 2026-05-24
646участников−1 за неделю
2пишущих за 30 дней
16сообщений за 30 дней
6 751сообщений в индексе
D
Ссылка
нажмите — покажем
Сегодня мы вышли из stealth! Про нас написали Wired (с заголовком these russian mathematicians ахах), а еще мы опубликовали блог пост с описанием технологии. Все ссылки в этом посте, буду очень рада если сможете репостнуть и прокомментировать :) https://x.com/aimalysheva/status/2095232794792255848
404 · 47.2K ·
D
Major release от нашей небольшой лабы. Поддержка спекулятивного декодинга в нашем инференс движке. Для начала Qwen3.6 27B, поддержка Qwen3.8 27B и Muse Glimmer в пути. Мы сильно превосходим все возможные стеки для Apple Silicon по производительности. Потому что взяли и все сделали как ко-дизайн: кернелы, квантизация и спекуляция. Все с нуля, все свое. Попробовать можно уже сегодня M checkpoint - поменьше L checkpoint (lossless) Все модели которые мы поддерживаем лежат тут, будем рады если попробуете что-то еще. Бенчи тут. Можно изучить как и что измерено и насколько лучше. Подробнее про релиз блог пост
443 · 30.3K ·
D
Фотография
нажмите — покажем
Я успеваю отмечать как быстро эволюционирует harness для AI продуктов только по тем мелочам, как меняется мой пользовательский опыт. Вот уже есть background режим в котором Claude сам дождался смены DNS на Cloudflare и пошёл шуршать над задачей дальше. До чего дошёл прогресс…
9 · 2.8K ·
  1. С
    Да, и заметнее всего это по тому, что раньше правил промпт, а теперь правишь инструменты и права. У нас за полгода из системного промпта ушло две трети текста, всё переехало в описания тулов. Обратная сторона в том, что отлаживать это стало заметно тяжелее.
Вся ветка · 1 ответ →
D
Фотография
нажмите — покажем
Хм ну с SVG контроллером бенч уничтожен (если конечно диванные критики не придерутся к мелким неточностям, гляньте просто что месяц назад нейронки выдавали), едем дальше 🎮 Если что SVG сверху, реальное фото снизу (как референс не давал) просто напоминаю, дальше эти сущности будут только способнее🤖 таск съел 2% недельного лимита на very high ефорте
42 · 5.2K ·
  1. С
    SVG как бенч удобен тем, что проверяет сразу две разные вещи, пространственное рассуждение и умение держать синтаксис без обратной связи. Второе модели подтянули данными, а первое до сих пор ловится простым тестом, попросите нарисовать механизм, где детали обязаны совпасть по размеру. У нас на схемах для документации сыпалось именно это, картинка красивая, а шестерёнки разного модуля.
Вся ветка · 1 ответ →
D
Фотография
нажмите — покажем
Доброе утро! ☀️ Встречайте воскресный выпуск подкаста "Капитанский мостик". Ведущие Валентин Малых и Дмитрий Колодезев разбирают главные ИИ-события недели: релиз Fable 5.1, выход GPT 6 с заявлениями про AGI и, с точностью до наоборот, законодательную инициативу США о запрете суперинтеллекта. Смотрите видео на каналах ⤵️ ODS VK Video ODS YouTube 📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
12 · 5.4K ·
D
Ссылка
нажмите — покажем
Ходят слухи что OpenAI решили Уравнения Навье–Стокса - одну из 7 задач тысячелетия с призом 1млн баксов. Слух пошёл от математика Тристана Бакмастера из New York University - Он утверждает, что ему сообщили: внутренняя исследовательская модель OpenAI получила примерно 100-страничное доказательство blow-up для 3D Navier–Stokes — то есть потенциально решила одну из главных нерешённых задач математики и одну из задач тысячелетия. Ждём анонса 🍿
149 · 5.8K ·
  1. С
    Слухи такого рода обычно разбиваются об одну деталь, приз Клэя дают за доказательство существования и гладкости, численное решение или частный случай не считаются. Контрпример с сингулярностью, кстати, тоже засчитывается, и такой вариант выглядит правдоподобнее. Ждём препринт, до него обсуждать нечего.
Вся ветка · 1 ответ →
D
Фотография
нажмите — покажем
Сегодня мы опенсорсим модель, результатом работы которой пользуются 49,5 млн пользователей ежемесячно Наша компактная языковая модель, обученная с нуля, формирует быстрые ответы Алисы AI под поисковой строкой. Артур Петросян, Назар Погосский, Никита Семёнов, Антон Викторов и Дима Калашников разобрали на Хабре, как она устроена и как её обучали. Ниже коротко о главном. AliceAI-T5-35B-A0.6B — Encoder–Decoder с 34,35B параметров и разреженными MoE-слоями: в каждом для токена выбираются восемь экспертов из 512. Архитектуру подбирали под поисковый сценарий — обработать найденные документы и быстро сформировать ответ. Претрейн шёл на 15 триллионах токенов на задаче UL2-денойзинга. Затем контекст растянули с восьми до 128 тысяч токенов через YaRN. Как итог претрейна: после одинаковой процедуры алаймента — у AliceAI-T5-35B-A0.6B-Base 77% винрейта против Qwen3.5-2B в слепом SbS. Отдельный сюжет — балансировка MoE. При масштабировании обучения балансировка со вспомогательным лоссом оказалась нестабильной: роутинг в энкодере коллапсировал. Переход на aux-free routing из DeepSeek-V3 решил проблему. В поисковом пайплайне BERT-подобный экстрактор на 80 млн параметров сокращает документы до полезных для генератора фрагментов. Для его дообучения алгоритм на основе Cross-Entropy RL подбирает варианты контекста с учётом качества ответа и штрафа за длину. Сокращение контекста дало около +40% к пропускной способности без потери качества в наших экспериментах. Для продуктовой версии — SFT на ответах, отобранных через Rejection Sampling или улучшенных через Critique & Revision; затем RLHF на GSPO. Пользовательские сигналы тоже идут в обучение: отдельная reward-модель предсказывает Профицит и даёт один из сигналов для RLHF. У итоговой модели в онлайн-эксперименте винрейт 56,7% против Google AI Overview. Приглашаем пощупать модель, почитать статью и поделиться впечатлениями в комментариях! ML Underhood
91 · 4.8K ·
D
Фотография
нажмите — покажем
Доброе утро! ☀️ Представляем Вашему вниманию новый выпуск подкаста "Капитанский мостик". Ведущие Валентин Малых и Дмитрий Колодезев разбирают главные ИИ-события недели: релизы GigaChat 3.5 Reasoning, HuggingFace Chat и Sakana Fugu Ultra, а также попытку спецслужб США ограничить дистилляцию моделей. Смотрите видео на каналах ⤵️ ODS VK Video ODS YouTube 📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
10 · 4.3K ·
D
Фотография
нажмите — покажем
Привет! 🦜 Уже на следующей неделе стартует новый сезон курсов осень 2026 г. на ODS.ai 🔥, не пропусти! 15 сентября мы вновь перезапускаем онлайн-курс Natural Language Processing & LLMs. Регистрация на курс уже открыта. Что мы будем проходить: ▫️закон Ципфа, TF-IDF, RNN, CNN, Transformer и большой упор сделаем на LLM, агентов тоже не обойдем вниманием; ▫️основные задачи NLP: классификация текста, тегирование, генерация; ▫️еще NLP для кода, RL для LLM, и не только. Переходи по ➡️ ссылке и становись участником курса 💪 Всех ждём!
182 · 9.4K ·
D
Видео
fCP8CmpZHdEYS8f5.mp4 · 22.6 МБ · нажмите — покажем
Ну всё, муху подключили к FPV-дрону, на этом можно заканчивать😅 походу пора оцифровывать мозг паука🤔🕷
359 · 10K ·
D
Фотография
нажмите — покажем
Большой релиз библиотеки ударений в silero-stress для русского языка 1️⃣ Переразметили список омографов; 2️⃣ 395 новых омографов, всего 2208 омографов; 3️⃣ Разметили "идеальную" валидацию из 100К предложений с тройным перекрытием; 4️⃣ Добавили в трейн ~54М новых предложений (всего стало 195М); 5️⃣ Решили проблему с "дрожанием" результатов модели; 6️⃣ Добавили регулярки и словосочетания для самых популярных омографов и добавили функционал для пользователей для добавления собственных регулярных выражений и словосочетаний. ⬆️https://habr.com/ru/article/1079674 ⭐️ https://github.com/snakers4/silero-stress
35 · 3.1K ·
D
Фотография
нажмите — покажем
ODS.ai, together with IITU, has launched a coding competition for AI agents. The competition will be held in three stages: in the first stage (currently underway), participants solve the given tasks on their own infrastructure using any agents; in the second & third stages, the same task will be evaluated in an isolated environment. The top 3 participants will have the opportunity to present their work at ICSE 2027, a software engineering conference. Interested? Please join!
9 · 1.9K ·
D
Фотография
нажмите — покажем
Приглашаем порешать 🌱 Alfa Connectome 🌱  — соревнование по нейронкам от HFT-фонда Wunder Fund. В этот раз датасет гораздо больше, чем в прошлых двух соревках. Вы будете изучать исторические торговые данные для двух связанных инструментов: ордербуки, сделки и кое-что еще. По этой информации вам нужно будет предсказывать индикаторы будущей цены для одного из инструментов. Кванты регулярно сталкиваются с такой задачей. В соревновании используются реальные маркет-данные. Когда 11 сентября — 15 ноября Призовой фонд $13,600 Победители получат денежные призы, приглашение побеседовать в Wunder Fund, а главное — большое интеллектуальное удовольствие. Wunder Fund c 2014 года занимается HFT — высокочастотным алготрейдингом. Торгуем на многих биржах по всему миру, как традиционных, так и криптовалютных. Наш дневной торговый оборот около ~$10 млрд. >_ Поглядеть на соревку
22 · 2.3K ·
D
GIF
pmlconf2026-last-day-v3-1920x1080.mp4 · 6.7 МБ · нажмите — покажем
Друзья! у нас последний день регистрации на офлайн Practical ML Conf — https://pmlconf.yandex.ru/2026/ Регистрируйтесь) А те, кто могут только онлайн — ждем в гости онлайн!
7 · 3K ·
D
Фотография
нажмите — покажем
Привет! Встречайте новый воскресный выпуск "Капитанского мостика" 20.09.2026. Участники разбирают главные ИИ-события недели: релиз мультимодального Qwen 3.8-Omni-Flash, отмену гардрейлов Трампом и TPU-кластер от Huawei как вызов Nvidia. Традиционно ведущие подкаста - Валентин Малых и Дмитрий Колодезев, в гостях у капитанов был Валентин Мамедов, тимлид команды претрейна Гигачат. Смотрите видео на каналах ⤵️ ODS VK Video ODS YouTube 📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
16 · 4.6K ·
D
Каждый релиз ллм все больше напоминает апдейт лидерборда на Каггле. Крутого нового уже ничего, фичи подкрутили, памяти добавили, но заруба как была за правильный сид, так и осталася. А как только лидерборд пробьют на 1%, все сразу поймут что сделать чтобы также улучшить решения. Как будто не отличаются они сильно уже не только от своего прошлого поколения, так еще и от конкурентов
8 · 2.5K ·
D
Каждый релиз ллм все больше напоминает выход новых айфонов. Крутого нового уже ничего, камеру подкрутили, памяти добавили, но как был выбор чистой вкусовщиной, так и остался. А проф бенчмарки личные есть только у 0.00001% аудитории. Как будто не отличаются они сильно уже не только от своего прошлого поколения, так еще и от конкурентов
7 · 2.8K ·
D
Фотография
нажмите — покажем
Доброе утро! ☀️ Представляем Вашему вниманию выпуск подкаста "Капитанский мостик". Ведущие Валентин Малых и Дмитрий Колодезев главные ИИ-события недели: Юрген Шмидхубер в Sakana, биохакеры из Anthropic и суверенная LLM от Яндекса. Смотрите видео на каналах ⤵️ ODS VK Video ODS YouTube 📩 Присылайте новости для обсуждения в канал "Дата-капитаны" в mattermost (авторизуйтесь через ODS.ai).
8 · 3K ·
D
Фотография
нажмите — покажем
GOOOGLEEE!!🌈🌈🌈🌈 https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/ Google показала Gemini 4 Argon, свою новую флагманскую модель для кода, работы с корпоративными документами и киберзащиты. По тестам самой Google: 77,9% на DeepSWE (реальные задачи по коду), первое место на Vals Index (финансы, право, налоги) и в Zapier AutomationBench, 91,7% на LVBench (длинные видео), аутпут 1 млн токенов. По цене на старте за 1 млн токенов $2 на вход и $10 на выход. Это столько же, сколько Claude Sonnet 5.5, и чуть дешевле по выходу, чем прошлая Gemini 3.1 Pro ($2 / $12). После вводного периода цена вырастет до $4 / $20: это вровень с Claude Opus 5.5 и GPT-6.1 Sol, но в 2,5 раза дешевле самых дорогих моделей, GPT-6 Astra и Claude Fable 5.1 (по $10 / $50)😮. Кэшированный вход со скидкой 95%. Но попробовать пока нельзя: сейчас доступ только у специалистов по киберзащите из программы Fairwind. Разработчикам, компаниям и обычным пользователям обещают «скоро» через платный API и подписку Google AI Ultra, точной даты нет. ОТВЕТ В 1 МЛН ТОКЕНОВ - представили? ждём😐 P.S. очень интересно посмотреть побьют ли Аргона Fable 5.5 и Astra 6.1 по цене
105 · 3.9K ·
D
Фотография
нажмите — покажем
PewDiePie учил свой ИИ на ответах OpenAI. Получил бан. Обжаловал. Попробовал снова. Ещё бан 🤖 По словам блогера, именно так закончились эксперименты с обучающими данными для Ajax. В показанном им письме OpenAI причиной одной из блокировок названа дистилляция: использование ответов одной модели для обучения другой. Ajax создан на базе Qwen 3.5 9B для Odysseus. Это локальный помощник для повседневных задач: поиска, работы с браузером, почтой и календарём. Защищать модель от систематического копирования понятно. В пользовательских условиях OpenAI прямо запрещено использовать ответы для разработки конкурирующих моделей. Но здесь возникает неудобный вопрос. Сама OpenAI использует для обучения в том числе публичные тексты из интернета: блоги, форумы и посты людей. Где должна проходить граница? В количестве собранных ответов? В попытке воспроизвести возможности модели? В коммерческой цели? Должны ли одинаковые правила действовать для домашнего проекта и крупного конкурента?
62 · 5.9K ·

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем