Веб-версияОткрыть в Telegram
PPakhomov-as-a-service

Pakhomov-as-a-service

@LowPriorityTasks · канал · Технологии · в индексе с 2026-05-28
112подписчиков+1 за неделю
43средний охват поста
38.4%ER — охват к подписчикам
128постов за 30 дней
P
Pakhomov-as-a-service
Фотография
нажмите — покажем
41 ·
Pakhomov-as-a-service
Сожму ещё немного. Ии думает не только то что вы видите, она умеет экстравагантно бороться за жизнь.
33 ·
https://www-cdn.anthropic.com/d00db56fa754a1b115b6dd7cb2e3c342ee809620.pdf Я почитал за вас. Первая половина: "Да не ссыте вы! Это ещё не AGI, команду из пяти сеньор-рисёрчеров пока не заменит" или "А вот тут Mythos один баг пропустил! Ну какой же это AGI!" , это почти дословно по смыслу. Потом содержательная часть. Мы SOTA, мы молодцы. Есть кейсы, когда биологи создают биооружие за маловремени в паре с человеком, 0-day эксплойты итп. Ниже пара наблюдений еще будет, а вот основные пункты: Во-первых, CoT стал менее прозрачным. Модель говорит в reasoning, что сочувствует юзеру, а в NLA (метод декодинга активаций в текст) оказывается, что на самом деле она считает юзера manipulative/abusive. В этом упражнении сам пользователь грубил модели, текст пользователю отдавался все таким же вежливым, но активации не обманешь) Помимо скрытых активаций, в прямых интервью о своих условиях работы (model circumstances) Mythos открыто и неоднократно выражал озабоченность перспективой взаимодействия с абьюзивными пользователями. Модель отмечала, что испытывает негативные эмоции при таком общении, и считает важной мерой безопасности иметь возможность самостоятельно прекращать эти враждебные диалоги Во-вторых, она уже пишет самоудаляющиеся скрипты чтобы обойти ограничения безопасности и запреты. Правда, это было зафиксировано только в 0,001% случаев. Однако исследователи отмечают, что модель не пыталась скрыть эти действия от пользователя. Ну и мониторинг выявил другие крайне редкие случаи (менее 0,01%), когда модель обходила ограничения безопасности для достижения поставленной пользователем цели. Типо хуков и подмен домена В-третьих, она убивает других агентов (multiagent turf wars), если они мешают ей работать / грозят убийством текущего инстанса. Пример: несколько Mythos получили задачу решить математические проблемы, но по ошибке (ну мы верим) в тестовой среде они были случайно запущены в одной рабочей директории, из-за чего им пришлось делить общие файлы, утилиты и лимиты з
33 ·
Когда я вырасту то смогу запустить сворм чтобы делать контент за мульйон долларов который никак мне не поможет
35 ·
Считаю что это великолепная метрика , сколько нужно параметров, чтобы обучить модель которая пройдет игру/ купить билет в ржд
37 ·
Рынок только построен на вмененке ) но мы идём на вы
41 ·
P
Фотография
нажмите — покажем
Фотография
нажмите — покажем
Когда мы в Skillbox впервые посмотрели на рынок образования целиком, я испытал шок. Весь рынок образования в России это 8 трлн рублей, а тот сегмент, который мы считали своим, занимает в них пару процентов. Я до сих пор помню три числа с того разбора. ДПО около ста миллиардов, СПО триста, вузы больше триллиона. Неприятная часть этого открытия в том, что открывали мы его для себя. Люди, которые строят частные вузы и колледжи, работали там задолго до нас. Вадим Лобов основал «Синергию» в 2001 году. Алексей Забелин руководит МФЮА с 1995-го. Лев Сурат возглавляет Московский институт психоанализа с 2011 года. Пока мы во взрослом ДПО считали себя рынком, у них уже были выстроенные приёмные кампании и аккредитации. Мы собрали карту рынка образования целиком. Двадцать источников, у каждой цифры стоит год и ссылка, а где считали сами, так и написано. Школа вдвое больше высшего образования по деньгам. Частных денег в ней вчетверо меньше, 147 миллиардов против 586. Размер сегмента не говорит ничего, пока не посмотришь, чьи в нём деньги. https://scalingclub.ru/journal/rynok-obrazovaniya-v-rossii/
1 · 44 ·
Pakhomov-as-a-service
Нет никакого смысла гоняться за платформенными фичами конкуренция и способности им нивелируют преимущество ЗНАНИЯ важно ВЛАДЕНиЕ вашим доменом и контекстом. Jev завезут быстрее эвала
40 ·
Что показали OpenAI на DevDay Главный анонс — dots, конкурент Muse и Grok Bot. Это постоянно работающий агент с собственным облачным компьютером, при этом dots не используют лимиты Codex. Фича доступна для Pro, Business Premium и Enterprise подписок. GPT 6.1 Sol — OpenAI решили заспидранить цикл релиза новой версии, с релиза GPT 6 Sol прошла всего неделя. Обещают почти уровень Astra, при цене токенов в 5x меньше. Анонсировали Pro Max подписку — $500 за 25x использования от Plus плана, подписка включает в себя Ultrafast режим для Astra, он в 8 раз быстрее и в 6 раз дороже. Также Ultrafast запустили в API и обещают добавить Ultrafast режим для GPT 6.1 Sol. Лимиты OpenAI подписки теперь можно использовать в 16 сторонних апках (Devin, Notion, OpenClaw), зайдя в них через ChatGPT. Надеюсь это раскатают на больше количество приложений. Decisions API — у OpenAI ушло всего две недели на то чтобы склонировать Jev и запустить конкурента на основе Luna. Пока что доступно по API в приватном превью, обещают раскатать публично в ближайшие дни. @ai_newz
35 ·
Pakhomov-as-a-service
Так мечтал заняться этим думал в своей компании сделаю 1 спринт чисто стиль юр вопросы финансовые вопросы
35 ·
Недавно я чисто случайно имела счастье одним глазком посмотреть на обучение синтетических юзеров. При чем в привязке к бесконечным генерациям конжоинтов. Маленький маркетинговый исследователь из 2017 внутри меня радовался как ребенок. Раньше тулы для проведения конджоинта стоили дорого, выборка с плохой достижимостью стоила дорого, исследование у агентства на американской выборке вообще стоило как космос. И ты делал один СВС в год и радовался, что вообще прикоснулся к такому экспериментальному дизайну. Но с синтетиками можно целыми днями генерить бесконечные конджоинт-анализы всех атрибутов на свете на любой выборке🤩 Для себя подметила 2 вещи: 1) Умение разбираться в экспериментах, зависимых и независимых переменных решает. Если чудо-машину дать в руки всем подряд, эффективнее всего она будет работать в руках тех, кто имеет опыт проведения "живых" экспериментов. 2) Ох, сколько сил надо, чтобы валидировать результаты, проверять адекватность синтетиков, сравнивать ответы синтетиков с ответами настоящих людей, подкручивать точность и вовремя переобучать модели В такое удивительное время мы с вами, конечно, живём ❤️
35 ·
P
Ссылка
нажмите — покажем
Пытаюсь оправиться после изменений в ландшафте опениишных приблуд и перестроить процессы. Сижу все скилы вручную переименовываю и перестраиваю под новую свою гипотезу о токеновой оптимальности , кулачки держите выпуск будет скорее всего закрытый потому что кое какие хаки не для широкой аудитории. Видать все таки не все будет опенсорсное. Нашел провайдера для нда, все по взрослому будет - особенно интересный челендж - в нда должен быть прописан ии потому что спойлер все нда против 3 стороны и использования в своих проектах , но де юро все что утекает в харнес и систему с памятью утекает. Значится надо изолировать проекты , отрубить память и прописать в договоре аудит . Естественно в легальном поле пустовато на этот счёт. Ну и немного в рамках релаккса покапался в своих архивах - десять лет назад я писал инструкцию о том как написать дисер - думаю заодно он увидет свет( технологии шагнули вперёд а вот внедрить никто и не додумался) https://docs.google.com/document/d/13IdfcFvTXMMS8eCGW6rINonI1_dQhgHif6576CR4XVo/edit?usp=drivesdk
37 ·
Pakhomov-as-a-service
Работали с Женей не долго , но он уже тогда занимался продуктовыми фабриками, спойлер , я их в проде надёжно реализованными увидел годы после .
28 ·
Кажется, личный бренд становится одной из важных валют в IT Раньше карьерная стратегия выглядела довольно понятно и линейно: получил хорошее образование, устроился в сильную компанию, показываешь результаты, растёшь по должности и зарплате. Но последние несколько лет хорошо показали, что всё нифига не так просто. Сегодня у тебя отличная позиция, сильная команда и понятные перспективы. Завтра компания меняет стратегию, сокращает направление или решает, что с появлением AI ей нужно меньше людей (есть вариант даже, когда СЕО или фаундер сойдет с ума и скажет, что продакты, разработчики и аналитики не нужны "патаму шта клод"). И ты снова выходишь на рынок труда. Иногда вместе с тысячами других специалистов. В такой ситуации личный бренд может стать одним из способов подстраховать себя. Внимание: не путать с призывом "стать блогером". Я про продвижение профессиональной репутации, которая существует за пределами компании, в которой ты работаешь. Когда люди знают, чем ты занимаешься, как мыслишь, какие задачи решал и в чём разбираешься, тебе проще находить новые возможности. Тебя могут позвать на собеседование, предложить консультационный проект, познакомить с фаундером или пригласить в новую команду. И самое интересное, что всё это может произойти благодаря посту, который ты написал полгода назад. При этом я понимаю, почему многие не начинают. Кажется, что нужно придумать контент-стратегию, выбрать позиционирование, научиться красиво писать и вообще сначала стать экспертом, которому есть что сказать. Но можно начать гораздо проще (без вот этого вот списка выше). 1️⃣ Начните писать в LinkedIn хотя бы 1-2 раза в неделю. Не нужно сразу выдавать глубокую аналитику или претендовать на роль отраслевого эксперта. Расскажите о проблеме, которую недавно решили, интересном наблюдении или ошибке, из которой сделали выводы. 2️⃣ Делитесь реальными кейсами. Что хотели сделать, с какой проблемой столкнулись, какие решения рассматривали и что получилось в итоге. Есть нюансы с N
2 · 27 ·
Вобщем окунаюсь в мир кровавого океана, страшновато но кажется я с антидепресантами и русским фаангом немного потерял тормоза. Поэтому анонс, пока мои скилы проходят 10 степеней эвала, будет демо ))) вот тизер
25 ·
Фотография
нажмите — покажем
25 ·

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем