Evals для чайников. Как тестировать AI-агента, чтобы понимать, где именно он ломается +1 03.06.2026 06:42 artarasov 0 Искусственный интеллект Машинное обучение Natural Language Processing Анализ и проектирование систем Тестирование IT-систем
Почему ломается ваш AI-агент — и почему смена модели обычно его не чинит 26.05.2026 07:16 artarasov 0 Искусственный интеллект Машинное обучение Natural Language Processing Анализ и проектирование систем Тестирование IT-систем
AI Evals: Почему без оценки качества ваш продукт стоит на месте 21.05.2026 15:44 alexlyk314 1 Искусственный интеллект Управление разработкой качество кода
Как оценивать работу агентов +14 28.04.2026 07:23 Squirrelfm 0 Искусственный интеллект Блог компании Raft
Evals: мегастатья для фаундера, чей AI-агент работает как попало +2 06.04.2026 12:03 YarikRock 0 Машинное обучение Управление продуктом
AgentKit от OpenAI: как закончилась эпоха хаоса в мире ИИ-агентов +5 06.10.2025 19:50 thedarksideblog10 6 Visual programming Artificial Intelligence Machine Learning Data Engineering Визуальное программирование Искусственный интеллект Машинное обучение
Понимание оценки LLM: детальный разбор 4 основных подходов +1 06.10.2025 05:10 antipov_dmitry 1 Искусственный интеллект Машинное обучение Big Data