Почему ИИ убивает стартапы и как это связано с экономикой?

e/acc··1 мин чтения·51 комментарий
Вышел GPT-5.6 Sol, Fable обнулили и снова слышны возгласы "GPT убил тот стартап" / "Антропик убил этот".

Но в реальности это не победа Антропика и даже не проблема стартапа.

Это про эффективность экономики. Стартапы, как и любые бизнесы, существуют там и тогда, где есть проблема, за решение которой люди готовы платить. И это решение должно быть уникальным и дефицитным, иначе много не заплатят и уйдут к конкурентам.

ИТ-стартапы решали проблему работы с данными, цифровых услуг, развлечений, бизнес задач. Потому что они были дешевле и эффективнее: Excel в сотни раз дешевле, чем считать фин модель на бумажке.

Ровно то же самое делает ИИ — он делает большинство ИТ-стартапов ненужными, потому что вместо того чтобы пользоваться стандартным софтом или платить человеку который этим софтом за вас пользуется, эту же проблему можно решить с помощью модели. Она делает это дешевле, быстрее и надежнее.

То есть, это не GPT убил Duolinguo или Антропик убил Саас по аналитике данных, а просто модели заменили софт и его пользователей так же как софт заменил аналог (ручки, бумажки, пленочные аппараты и заводные будильники) когда-то раньше.
e/acc
e/acc

311 публикаций на visbl.me

Пишу про будущее: AI, web3, технологии и общество. Ускоряемся. Автор: @sgershuni Инвестирую: cyber.fund Построил: Credentia, Deep Skills, Codex Town

💬Discussion (51)

Вячеслав Сан-Клер@antishnapss
Это не ии уничтожил человечество. Просто люди были менее эффективны и более дороги, чем андроиды
lucipurrê
и че делать
Wesna@wesna
Ии курсы
Kane@truekane
Ну а по факту все равно убили. Трансформация.
Причем само взаимодействие меняется.
UI уже не так важен, только как дашборд информационный.

И вообще перестаешь быть аккуратным и теряется необходимость понимать как работает код и проект в целом. Агентность решает, типа это уже его задача понимать что там в проекте, уже все равно не успеваешь за всем следить, поэтому и не стремишься разбираться как оно работает, где файлы, все ли аккуратно сортировано, чисто и так далее.
Slava@slavapvv
Звучит как вот-вот что-то пойдет не так при таком раскладе..
Kane@truekane
Да, но модели постоянно становятся мощнее и переваривают всё.
Поэтому до технического долга и прочего вероятно никто и не дойдет.
Д☰НИС@faterkin
Ага, я по всем своим проектам делаю аудит новыми моделями. И пока проекты со временем становятся только лучше.

Никаких "этот спагетти код никто не разберет и не возможно поддерживать" нет.
Roman@r0man_ai
А вы его сами смотрели этот код и руками тестировали?
Подписываться под непроверенным такое себе вроде🤔
Д☰НИС@faterkin
А зачем мне смотреть?
Работает, и это главное.
Тестами все покрыто.

Когда новая модель делает аудит, периодически что-то улучшает. И я ей верю. Также, как верил бы живым разработчикам 🙂

Я сам не программист, а больше как бизнес заказчик (продакт/проджект)
mlmlml@vixkosla
меня заказчики булили за использование ии, пару раз попроьовал объяснить, потом оставил попытки, причем ребята зумеры по моложе меня
Artem Shtanov@Shtanov
о господи, сочувствую
Д☰НИС@faterkin
Ну ты можешь сказать что руками писал код, в блокноте, даже без использования среды разработки 😂
Константин@psicopium
так зумеры хейтят ии побольше бумеров и миллениалов лол
Д☰НИС@faterkin
Они все хейтят, возраст такой
Roman@r0man_ai
Просто blackbox - сделай вот тут хорошо, уф, отважно.
Помня как недавно такая штука стерла почту одной девушке и весь весь сервис с диска другому чуваку с воплями на весь твиттер, желаю выдержки!
Д☰НИС@faterkin
Мне такие примеры всегда напоминают случаи:

Раньше огород копали 10 мужиков с лопатами. А потом появился трактор.
Но чтобы им пользоваться, надо освоить управление, технику безопасности, учесть нюансы эксплуатации и тп.

Но бабки из другой деревни рассказывают, что трактор это зло! Акстись!
Вон Иваныч соседку задавил и грушу снес на прошлой неделе.

А если сделать разбор ситуации, то оказалось что Иваныч был пьян в синьку, да и вообще трактор водить не умел.
Roman@r0man_ai
С блэкбоксом ассоциация ближе к реальности, как по мне, но даже в вашей аналогии - как будто «ситуация с Иванычем» это не проблема))) Любой кто общался с органами, скажет что така ситуация это капец бизнесу, несмотря на пьяного неумеху Иваныча.
Д☰НИС@faterkin
Мой коммент был про то, что с дуру можно и х.. сломать.
Что, мало случаев, когда сотрудники данные сливали, или переводили вместо 700$ по 700 биткоинов каждому юзеру?

Уверен, случаев с рукожопыми разработчиками больше, чем с рукожопым ИИ. Просто эти случае не такие интересные. А когда ИИ что-то сломал, то это хайп и повод обсудить.

Про черный ящик. Компилятор уже десятилетиями является "черным ящиком".
Большинство программистов не читают машинный код, который он генерирует. Они доверяют компилятору и проверяют результат работы программы.

Сейчас ИИ - новый компилятор. Зачем смотреть код?
Roman@r0man_ai
Вопрос ответственности - когда сломал программист, он залезет и найдет ошибку сам или с помощью другого или даже с помощью ЛЛМ, а когда сломала ЛЛМ, а за ним сидит вайбкодер, который гит от курла не отличит, ну удачи ему починить баг)

Компилятор детерминирован на 100%, а косяки в ЛЛМ лезут и будут долго лезть, вот из недавних - вы понимаете о чем там речь? Уверены что сможете с Клодом выловить и починить возникший bias?

Я за прогресс, но и победные реляции неофитов-миллионеров доставляют, конечно 😁
Artem Shtanov@Shtanov
Это все так, но какой тейк в итоге? Не писать код ллм? Или проверять код через инженеров?

Я к примеру не буду проверять код живыми людьми там, где цена ошибки низкая, пускай лучше 20 минут полежит прод, если это мне стоит 100$, а выдернуть разработчика дороже.

В других кейсах буду.

Наверное есть очень много ситуаций где ЛЛМ не разберется, но большая часть софта который мы все обсуждаем или вайбкодим — это перекладывание джисонов разными интересными методами, сложной логики там кот наплакал, не понимаю где так ломаться
Roman@r0man_ai
Тейк только в охлаждении победных реляций, а так ради Бога 👏
Artem Shtanov@Shtanov
так нет победных реляций. Есть спектр задач успешно решаемый ллм, он растет ~ каждый месяц на Х. Есть задачи которые пока не решаются/плохо/невыгодно, ждем когда доберется до них / не доберется
Roman@r0man_ai
Оу, значит я просто вот тут и тут не так понял, понятно.
Roman@r0man_ai
Вот кстати и это не не месячной давности история, буквально на днях 🤦‍♂️
tdesc@tdesc
ну если программист сидит? в чем проблема и претензия к вайбкодерам?
Sumone Unnoun
Это из серии Пастернака не читал, но осуждаю. Наверное, 90% вайбкодеров - не программисты, какой с них спрос?..
Roman@r0man_ai
Какой - финансовый вестимо 🤔
Random 123@AlexUniverse
я об этом еще полгода назад говорил) вышла новая моделька - прогнал рефакторингом и красота)
Roman@r0man_ai
Но они становятся и дороже, раньше все считали что модели дешевле джун оров поэтому нафиг джунов, сейчас модели уже стоят как джуны а народ только входит во вкус вайбкодинга, дальше модели будут стоить дороже человеков, а еще и разобраться в их спагетти коде надо будет больше токенов - по идее получится развилка или закидывать бабками/токенами непонятный спагетти код или строить человеками более адекватную код базу, что дольше делать, но и дешевле поддерживать, а еще и писать дешевле 🤔
Artem Shtanov@Shtanov
а там точно спагетти код? я не программист, поэтому в код не смотрю, но мне интересно. У меня десяток проектов на 100% навайбкоженых в продакшене + мои PR мерджаться в мой живой продукт на 25к юзеров командой после ревью с минимальными исправлениями или вообще без них.

У меня есть гейты качества, e2e тесты на стендах и т.д.

Точно ли код плохой в этой ситуации? Мне правда интересно, потому что я слышу оч полярные мнения на эту тему.
Roman@r0man_ai
А если это все завтра упадет и не поднимется очередным «hey Claude, we got an error here - pls fix” у вас есть фоллбэк?
С архитектурой у них как-то не очень, имхо, а чтобы залезть внутрь и почекать насколько он верно реализовал план - нужно понимать код, поэтому как проверить что он все сделал по плану? Заливаем в прод и тестим на юзерах?
Artem Shtanov@Shtanov
Проверяется все на тестовых стендах. Что идет в основной продукт — ревьювится разработчиками.

Не могу пока представить ситуацию, в которой что то ТАК упадет, что он поднять не сможет, кроме, разве что, локаута доступа к серверу, было один раз. Он мне объяснил как подключится по vnc и починить.

В остальном с любой инфрой проблем 0. Справедливости ради у меня просто докер контейнеры, а не k8, но энивей, проблем 0. У меня 44 контейнера на сервере, проверил вот.
Roman@r0man_ai
Ну погодите, то есть итоговый продукт ревьюитсЯ разрабами, собственно это объясняет все.


То есть раньше вы бы писали ТЗ этим разрабам - они бы тоже самое кодили и далее по цепочке, теперь вы вместо Тз сразу вайбкодите с помощью агентов, разрабы уже смотрят не Тз а готовый код, акцептуют и далее по той же цепочке.
Artem Shtanov@Shtanov
мой главный бизнес да. Но обратите внимание — 70% пр мерджатся без правок. В остальных есть.

В остальных я один, команды нет, юзеры есть, тот же флоу но без ревью. Просто строгие кволити гейты и дефинишен он дан
Roman@r0man_ai
А как вы чеками перформанс, может там КПД 5% из-за кривой архитектуры или реализации, вы запилили фичу - залили в прод, ура пришло +100 человек - крутяк, а может там кривая логика и эти 100 пришли вопреки ей и реально там фича, которая должна генерить +1000 человек, а вы этого даже и не узнаете?
Artem Shtanov@Shtanov
на тестовом стенде проверяется перформанс с новой фичей — она накатывается, потом прогоняется эмуляция нагрузки в 1000 (как раз) юзеров одновременно, по профилю снятому с прода. Если что то не так, то агент чинит.

Как только даешь агенту нормальный харнесс, растет и качество и автономность

Еще есть автономные агенты которые читают метрики проектов в проде и делают PR если находят проблемы в метриках
Roman@r0man_ai
Я про бизнес логику, кто проверяет что фича реализована как надо с точки зрения архитектуры, логики, сочетания с другими фичами

И кто это все запроектировал и написал- Вы сами без программеского опыта запилили агентскую сеть со стендами, архитектурой продуктов и реализации и деплоем всего этого добра?
Artem Shtanov@Shtanov
Все проверяю я, но в половине проектов честно говоря не проверяю уже, клод на стейдже а потом на проде проверяет.

Да, я запилил с клодом, это же довольно просто. Мне легче, потому что я 12 лет в менеджменте продуктов. Я подобные задачи ставил тысячу раз, я всегда детально погружался в спеки, я знаю зачем нужны индексы, стейджи, и как отвечать на ~70% технических вопросов клода. Но вообще у него написано чтобы он код мне даже не показывал и не заваливал меня терминологией про него, а спрашивал меня про бизнес — а будет ли тут рядом с фичей что то еще, а будем ли расширять вот это, а делаем ли вот такой трейд офф и к чему это приведет и т.д.
Александр Добрый@investorik
с 5.6 сол сравнивал?
Artem Shtanov@Shtanov
пока нет, на этой неделе планирую. Но я кодекс использую либо как имплементатора либо как ревьювера, для всего остального он мне не нравится, об клода думается лучше
Александр Добрый@investorik
в плане думается? лучше идеи толкает?
Artem Shtanov@Shtanov
да. Обсуждается идеи, делается контент/маркетинг, новые фичи или новые проекты — у меня примерно 50% работы это не код, т.е. код там есть конечно, но основа это другие бизнес задачи
Roman@r0man_ai
Понятно у вас бэкграунд такое пилить, я регулярно вижу как сами программисты не вывозят такое, поэтому в части «это легко» я и поспорил, удачи🙏
Eugene@Eugeeene
а до этого трактор заменил мотыги. ну вроде уже жёвано-пережёвано концептуальное понимание кто кого оптимизировал/убил. или еще не?
Ренат@TayKita
Скоро настанут времена когда софт не нужно будет писать в принципе, все будет делать ии сразу, человек просто не будет видеть всю цепочку - сразу готовый ответ
tdesc@tdesc
мы будем летать из Космопорта в межзвездные круизы
️️{"_":"_"}@CRC16
так совсем не интересно будет. дайте покодить
Ренат@TayKita
У нас есть год полтора ещё )
️️{"_":"_"}@CRC16
смотря где... там где у gov фляга свистит мб и больше
Join discussion on TelegramComments are synced from Telegram

Связанные темы

Читать далее