Evaluating Deep Agents using LangSmith on AWS: практическое руководство по оценке глубоких агентов. В этой статье вы узнаете, как применять пять шаблонов оценки для глубоких агентов, создавать офлайн-
29 мая 2026 г. · 1 мин чтения · Максим Космов

Evaluating Deep Agents using LangSmith on AWS: практическое руководство по оценке глубоких агентов. В этой статье вы узнаете, как применять пять шаблонов оценки для глубоких агентов, создавать офлайн-оценки с помощью pytest и LangSmith, и настраивать онлайн-мониторинг для производства. Руководство использует глубокого агента текст-в-SQL как пример. Полная версия с деталями - guides.kosmoslab.dev
Читайте дальше
Налоговая, которая сама себя чинит (и не просит денег)
OpenAI, Thrive и Crete собрали налогового агента на Codex. Звучит как очередной стартап с презентацией «уберём бухгалтеров», но тут интереснее
Amazon Bedrock Ops Alert: первый прогон
Вдохновились заявкой Amazon о "трёх-слойном" решении для автоматического мониторинга. Ожидали, что система сама будет ловить сбои, поднимать сигналы и даже формировать поддерж-кейсы без лишних шумов
AWS Fundamental NEXUS: табличная модель в SageMaker JumpStart
Сразу бросается в глаза, что процесс деплоя сведён к нескольким кликам, а SageMaker берёт на себя всё, от подготовки окружения до масштабирования. Для тех, кто пока «путает» модели и инфраструктуру, э...