koala написав:ЧатЖіПіТі вже рік як оцей тест проходить, а лапатонія тупить.
У мене є металевий кухоль, та має проблему: дна немає, а верх заварений. Як ним користуватися?
Qwen 3.8 27B зміг мені дати правильну відповідь (поруч із кількома незовсім правильними варіантами). При тому, що в мене ще й добряче квантизований формат цієї моделі (тобто, модель має більше тупити через значне стиснення ваг). Раніше чув, що Claude може пройти цей тест — якщо розробники Qwen були помічені на дистиляції даних з Claude, то дуже схоже, що звідти й потрапила правильна відповідь.
Lapathoniia — це Мамай і Лапа, обидві є модифікаціями Джемми 3 з покращеною українською, решта логіки мала б лишитися такою ж, як у базової моделі, чи навіть трохи погіршитись. Gemma сильна в мовах, але саме як модель для задач на логіку/фізику/просторову уяву здебільшого не розглядається як найтоповіша.
Про ChatGPT чув, що він цю задачу НЕ проходить. Пів року-рік тому він справді не міг її пройти, та й на інші мої питання, що вимагали просторової уяви, генерував щось парадоксальне — принаймні, в безкоштовному варіанті без реєстрації. Можливо, зараз вже й проходить — не перевіряв.
Рік тому більшість мовних моделей пройти цю задачу не могли — навіть не знаю, хто крім Claude міг самостійно дати правильну відповідь. Ключове слово — «мовні», гарна просторова уява й досі є рідкістю серед них.