Веб-версияОткрыть в Telegram

Пост🤖 AI-агент с нуля: строим Guardrails

13 августа 2026
A
AI4Dev — AI for Development
Фотография
нажмите — покажем
🤖 AI-агент с нуля: строим Guardrails В прошлый раз мы дали агенту память — теперь он помнит пользователя между сессиями и может вызывать инструменты через MCP. Звучит идеально. Но у нас пока нет ни одного механизма, который контролирует, что агент читает, что делает и что отдаёт обратно. Системный промпт с запретами — это не защита, а иллюзия безопасности. Поскольку языковая модель является вероятностной системой, при определённых входных данных она проигнорирует любую инструкцию. И пока у агента есть инструменты, это уже не проблема некорректного ответа — это удалённая таблица в базе данных, письмо, отправленное не тому адресату, или бесконечный цикл API-вызовов, который сжигает весь лимит за ночь. ⚡️ Представляем четвертую часть видеокурса об AI-агентах от ML-инженера Artezio Антона Максимова! Guardrails — это не фильтр в системном промпте. Это детерминированный код, который принимает решение до того, как данные попали в модель, до того, как выполнено действие, и до того, как результат ушёл к пользователю. В этом выпуске: — Карта угроз LLM-агента: разберем Prompt Injection, Jailbreaking, Hallucination и Data Leakage — Архитектура Guardrails — Три класса методов: детерминированные, специализированные и вероятностные — Allowlist, schema validation, ACL и human-in-loop — что и на каком контуре применять — Пишем Guarded Agent: оборачиваем LangGraph-агент из прошлых уроков в четыре контура защиты 🎬 Смотрите на YouTube или RuTube!
35 · 2.1K ·

Рядом в ленте

AAI4Dev — AI for Development🤔 Какова вероятность выживания человечества в эпоху суперинтеллекта? Исследователь Элиезер Юдковский и президент MIRI Нейт Соарес изложили свой прогноз в книге,AAI4Dev — AI for Development⚡️ ИИ превзошёл людей в искусстве убеждения — какова зона риска? Рассмотрим третью по счету область применения, где искусственный интеллект наглядно демонстриру
это сообщение
AAI4Dev — AI for DevelopmentИИ превзошёл людей в искусстве убеждения — какова зона риска? В лекции рассматриваем третью по счету область применения, где искусственный интеллект наглядно деAAI4Dev — AI for DevelopmentAndrew Ng (кофаундер Coursera, профессор Стэнфорда, экс-глава Google Brain и Baidu AI) опубликовал AI Engineering Skills Map - попытку сформулировать, какие нав
AAI4Dev — AI for DevelopmentAI4Dev — AI for Development@LLM4dev · канал · Технологии
5 311подписчиков1 164средний охват поста
Лента площадки Открыть в Telegram

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем