Попросив Gemini 3.6 Flash просто порівняти ціни моделей😏
Вона:
— спочатку не дала нормального порівняння;
— потім у таблиці поставила прочерки замість старих цін;
— після питання «лайт точно подорожчав?» вирішила, що порівнювала взагалі з 2.5 Flash-Lite;
— коли я уточнив, що мова про 3.1 Flash-Lite, вигадала для неї ціну $0.50 / $3.00 і заявила, що нова модель подешевшала;
— після скріншота з її ж першою відповіддю знову повернулася до $0.25 / $1.50 і вже порахувала подорожчання на 45,5%.
Тобто модель кілька разів поспіль не змогла втримати дві назви і чотири цифри.🙂↕️
При цьому кожна відповідь була максимально впевнена…
Отже, одного контр-приклада який спростовує гіпотезу Якобіана (задачу яку майже 90р не могли вирішити) було недостатньо, тепер створили формулу для нескінченної сімʼї таких контр прикладів
Кімі К3 — це мікс gpt 5.5 (5.6??) + fable. не знаю як, файнтюном чи чим, бо часу було небагато, але дуже схоже на те
чому я так думаю: інтуїтивно здається, що вона робить те саме як 5.5 в плані фронтенду (я не знаю як Тео це не помітив, якщо чесно), але при цьому вона робить це з розумінням рівня fable.
але з одним мінусом - вона генерить набагато більше токенів ніж обидві ці
ну ладно, ще другий мінус — її локально не запустиш)