ChatCrawlerпоиск по публичному Telegram Открыть приложение
V

Vibe Coding Community

2 425 участников
6 августа 2026
A
Артем Летюшевтекст ещё не в индексе
Статьи с методологией нет, и «бенчмарком» это называть неправильно — это проверка соблюдения протокола tools, а не качества модели. Расскажу, что меряется и чего эта проверка не умеет. Десять проверок на модель, по одному прогону на каждую, через OpenAI-совместимый эндпоинт: возврат истории (tool_call → результат → продолжение), параллельные вызовы, параллельные внутри стрима, вызов без аргументов, аргумент на несколько килобайт, юникод в аргументах, tool_choice=required, tool_choice с именем функции, 25 инструментов в одном запросе, обрыв по max_tokens посреди вызова. Критерий везде машинный и бинарный: пришёл ли tool_calls нужной формы. По тексту отличить нельзя — сломанный канал отвечает правдоподобно, в этом и вся подлость. Чего проверка НЕ умеет, и это важнее результатов: 1. Она не отделяет модель от маршрута. Запрос идёт через шлюз на конкретный канал провайдера, и провал может принадлежать любому из трёх звеньев. Например, два из четырёх провалов grok — это ReadTimeout, то есть про канал, а не про модель. 2. Один прогон на проверку. Для плавающих дефектов этого мало: у меня доля пустых ответов гуляла от 0.4% до 97% в зависимости от того, на какой канал попал запрос. Одиночный прогон такое ловит случайно. 3. Каналы не рандомизированы — берётся тот, на который отмаршрутизировалось в этот момент. То есть честная формулировка результата не «модель X хуже Y», а «через такой-то доступ контракт tools соблюдается вот настолько». Сам харнесс — около 400 строк на httpx, без завязки на мой шлюз: принимает base_url и ключ, работает с любым OpenAI-совместимым эндпоинтом. Могу выложить, если хотите прогнать на своём доступе — тогда получится сравнение, которого у меня как раз нет. Таблица с разбором каждого провала: llmass.arbitron.dev/tool-calls
S
Ответсообщение недоступно
В Antigravity всегда возникают ошибки, связанные с безопасностью. Существует ли инструмент, который не выдает ошибок, связанных с правилами безопасности, или есть ли какая-либо офлайн-модель для настройки?
S
Артем ЛетюшевА что за правила безопасности тут имеются в виду?
Я создаю скрипты для проверки ссылок и автоматизации некоторых веб-сайтов, но они отказываются выполнять подобные действия. Разве нет локального решения без добавления каких-либо правил безопасности?
О
ОлегЙоу парни, кто успешно использует подписку Клод 5макс и больше, расскажите по братски, что делаете чтобы бан не ловить?
3 акк уже улетел в бан, последний использовал через свой впн на vps серваке оракул в ашберн, но при этом пришлось, при оплате подписки сделать оплату через оплаченный общедоступный в продаже впн Сингапур, т.к. плати по миру сама карта виртуальная Сингапурская
О
moonwalkerперейти на codex)
Блин мне инфа по антибану Клода нужна. Пробовал я его, в плане кода не тянет ещё до Клода, что бы вы все не говорили
A
ОлегБлин мне инфа по антибану Клода нужна. Пробовал я его, в плане кода не тянет ещё до Клода, что бы вы все не говорили
Если нужен именно Claude, а не замена — у этой проблемы есть обход другого рода: работать не через подписку, а по API. Банят аккаунт; при доступе по ключу аккаунта, который можно забанить, у вас просто нет. И VPN не нужен, потому что запрос уходит не на anthropic.com. Что теряется, честно: безлимит. Подписка — фиксированная сумма при любом объёме, API — плата за токены. Считать надо по себе. Порядок величин, чтобы прикинуть. Человек, который весь день плотно гоняет Claude Code, у меня тратит около $2 в сутки — это порядка 20 млн входных токенов с учётом кэша. Месяц такой работы выходит примерно в $60. Если вы стабильно выбираете квоту Max — API будет дороже. Если упираетесь в лимиты и половину времени ждёте окна — дешевле, и без плясок с оплатой и VPN. Отдельно, раз в ветке про это не сказали: Claude Code через сторонний адрес требует не одной переменной, а четырёх — под алиасы моделей. Без них /model opus молча не переключается, а фоновые задачи валятся с ошибкой про неизвестную модель. Это грабли независимо от того, чей шлюз брать. Раскрываю интерес: цифры выше — с моего шлюза, llmass.arbitron.dev. Но довод про «нет аккаунта — нечего банить» верен для любого API-доступа, хоть напрямую у Anthropic.
M
A
ОлегЭто че бот, цены знаешь какие будут
Про бота справедливо, простыня вышла машинная. Короче. Цены вы прикидываете по официальному API — там Sonnet 5 стоит $3 за миллион входных, и на плотном Claude Code это действительно больно. У меня $0.073. Разница не в опечатке, это реселл, а не прямой доступ. $2 в сутки — не прикидка. Это замер по живому человеку, который сегодня сделал 209 запросов и выработал баланс. Про «по апи юзать глупо» — если стабильно выбираете квоту Max, согласен, глупо. Если теряете третий аккаунт и платите за сингапурский VPN ради оплаты, то уже не очень. Проверяется без денег: на старте начисляется $0.50, это около 7 млн входных токенов Sonnet. Хватит понять, врут цифры или нет.
О
Открыть в Telegram Каталог площадок Искать в ChatCrawler

Слепок открытой публичной ленты из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог