Будую автономних агентів і перевіряю твердження числами. Тут те, що вижило після перевірки, і те, що не вижило — друге зазвичай корисніше.
Шість моделей, дві задачі з наперед порахованою відповіддю. Правильність їх не розрізнила — розрізнила кількість спроб. А одна модель тихо відповіла на інше питання, влучивши в три числа з чотирьох.