Почему открытые модели ИИ становятся более популярными?

e/acc··1 мин чтения·21 комментарий
Компании имеют более или менее фиксированный бюджет на интеллект. Когда модели дешевеют, они не экономят деньги, а покупают на них больше токенов.

Открытые модели уже перешли порог достаточно хороших для большинства задач. GLM-5.2 сравним с Opus-4.8 по ряду бенчмарков при стоимости в 6 раз ниже.

Это вынуждает закрытые модели терять долю почти во всех типах задач. Их единственный вариант - продолжать повышать цены на самые передовые модели.

В итоге moat топовых лаб остается не в моделях (ибо те становятся комодити почти сразу после релиза), а в вертикальном стэке.

Почему? Потому что в экономике ценность собирается там, где есть дефицит, а в данном случае это энергия, чипы, датацентры и именно туда идет большая часть инвестиций всех больших лаб.
e/acc
e/acc

256 публикаций на visbl.me

Пишу про будущее: AI, web3, технологии и общество. Ускоряемся. Автор: @sgershuni Инвестирую: cyber.fund Построил: Credentia, Deep Skills, Codex Town

💬Discussion (21)

Pavlo Kobzar@pavel2077
ну камон, где он там сравним)
Artyom Kireev@ArtemPlayback
+++ купил подписку, поверил, дерьмо лютое - один нейрослоп лепит, на реальных задачах неюзабелен
Aleksandr Proskriakov@aleksandrpros
А в чем он конкретно дерьмо, скакой задачей не смог справиться?
S@mifoz1206
Бро, это шумный тенденциозный чувак
Ян@Yanwork
Можете, пожалуйста,привести пример ваншот задачи на которой он себя сильно хуже показывает?

Как раз проводим аналогичное тестирование. Справляется хорошо
Андрей Жуков@fall_out_bug
как обычно, "сделай твиттер"
Ян@Yanwork
Спасибо проверим на этом тоже
tdesc@tdesc
не жалко токенов?
Ян@Yanwork
Сильно сомневаюсь что даже 5 часовое окно съест
Андрей Жуков@fall_out_bug
а они у glm заканчиваются?
Виталий@vitmgnpro
В кодинге пробовали? Не хуже sonnet 4.6 точно
Yaroslav Shakula@kevinua
написано же - по ряду бенчмарков)

для работы это конечно бесполезно, но все же))
Random 123@AlexUniverse
GLM ещё до кучи на 2х из 3х API запросах спотыкается и режектит. Ретраи конечно выручают, но такое себе...
Anonymous
я написал 3 поста выше о том где он сравним
Anonymous
вам нужно купить учебник "ЛЛМ для чайников", ну ей-богу, ну откуда вы...
Ян@Yanwork
А если серьезно тогда?
Андрей Жуков@fall_out_bug
Если серьезно, то я тоже не нашел, где GLM не справляется. Если только ему действительно давать мега-задачу без спецификаций в голом репо без скилов и агентс
Vadim@VadimLarinTech
Личный пример, у меня саас для изучения английского, три пайплайна, на анализ коротких предложений, на анализ эссе, анализ истории пользователя, все покрыто ивалзами и ни одна модель не из большой тройки близко не приближается даже к gpt 5.1, которая кажется в 4 раза дешевле текущей gpt 5.5.

Ну и в тему получается, сделал осс cli с которой можно ваншотнуть полноценный набор e2e llm call evals, для тех кто не хочет вручную создавать или заморачиваться с deepeval/promptfoo
Буду рад если кто воспользуется https://github.com/VadimLarinTech/lightassay
Nosov Nikita@nik1t7n
звездочка⭐️
4444@cyberJester
время схематозить мульти акком?
Sergey@Serg28
GLM 5.2 делает аудиты дизайна и кода, написанного Codex. Процентов 20% его находок - ошибки. В кодинге еще не опробовал
Плюс в середине дня потребление считается как Х3 от обычного. Так что пока заменой не особо пахнет.
Надеюсь, через 3-6 месяцев сможет хотя бы в части моих задач заменять фронтирные модели.
Join discussion on TelegramComments are synced from Telegram

Связанные темы

Читать далее