eto_ya:
Любую задачу(например Шоле) можно решить на машине тьюринга, или рекурентной нейросети, но также можно всё сделать с помощью базы данных, но она может быть велика, однако решение универсальное.
Интересно наблюдать именно за такими экспериментами, где сравнивают не только итоговую точность, но и сам подход к получению решения. С ChatGPT и другими моделями особенно хорошо видно, насколько результат зависит от постановки задачи и контекста. Для практических экспериментов с разными моделями можно также посмотреть
Ranvik — удобно сравнивать ответы и подходы разных ИИ на одной и той же задаче. В случае ARC это, конечно, не заменяет специализированные тесты, но для повседневных экспериментов довольно наглядно.