0: Вайб кодинг это новый способ создания программ, в котором ты забываешь, что код вообще существует. Ты просто описываешь, что хочешь на обычном языке, а нейронка пишет весь код за тебя. Сегодня я реализую проект для автоматической нарезки видео под текст сценария и сделаю это с абсолютным вайб.
1: Подходом, вообще не заглядывая в файлы программы, покажу весь процесс создания проекта с нуля до готового приложения поделюсь принципами и подходами, которые использую для максимальной эффективности. И плюс опишу логику, по которой действую во всех своих вайб кодинг проектах. Погнали
2: Привет, меня зовут Олег, днём я разработчик, а по вечерам на этом канале вайбкр пилю свои небольшие проекты, тестирую нейронки и ii инструменты, смотрю, что работает, а что не очень. Что такое вайб кодинг этот термин придумал Андрей карпатый, сооснователь опен иай.
3: И бывший глава эйай тесла в феврале 2025 он написал это новый вид программирования, где ты полностью отдаёшься вайб. Забываешь, что код вообще существует. Это стало возможным, потому что лмки стали слишком хороши. Я прошу сделать максимально тупые.
4: Вещи вроде уменьшу падинку сайдбара вдвое, потому что мне лень самому это искать. Я всегда жму аксепт ол и изменения кода больше не читаю. Когда появляются ошибки, я просто их копипащу без комментариев. Обычно это их чинит. Код разрастается настолько, что я уже не понимаю.
5: Его, как раньше, чтобы разобраться, пришлось бы реально посидеть и почитать его какое-то время такой подход теперь позволяет огромному количеству людей, не имеющих опыта работы с кодом, делать свои мини приложения, автоматизации и микростарт пы, вообще не касаясь Языков, программировани.
6: Теперь продакты, менеджеры, дизайнеры и маркетологи могут реализовывать проекты без привлечения разработчиков. Теперь в 1 можно сделать в десятки раз больше. Однако даже такой Лёгкий на 1 взгляд подход на самом деле не так прост. Да, ты можешь не смотреть в код, но
7: Это не значит, что твой проект создастся сам по себе в лучшем виде каким-то магическим образом. Тебе все ещё нужно чётко описывать требования, контролировать результат и проектировать архитектуру. Часто это совсем неочевидно и не так уж просто. Поэтому сегодня на примере 1 программы
8: Покажу основные нюансы вайб кодинга, плюс поделюсь принципами и фишками, которые использую при такой разработке. Сай. Кстати, если вы кодите что-то серьёзное, поднимаете опенсорс нейронки, обучаете модели или рендерите видео, то узким горлышком вашего проекта
9: Практически гарантированно станет железо, и в таких случаях на помощь приходит имерка это специализированное гпу облако с самым большим ассортиментом видеокарт тесла и rtx в России у ребят доступно 13 моделей, включая ртикс 50 90, эйч 200.
10: И hh 100, а для особо тяжёлых задач есть технология enveel, позволяющая объединять видеокарты в единый мощный кластер. Отдельное удовольствие это посекундная тарификация ресурсов. Ты платишь только за фактическое время использования, запустил сервер на 10 минут и.
11: Заплатил, соответственно, только за 10 минут остановил виртуальную машину и списание прекратилось. Никаких переплат за простой для тех, кому нужен сервер на постоянку. Есть скидки на долгосрочную аренду до 50% в зависимости от конфигурации. Ещё крутая штука. Это библио.
12: А готовых предустановленных образов для работы с ai, то есть разворачиваешь виртуалку, а там уже все готово драйвера cuda и нужные библиотеки, можно сразу начать работать, не тратя время на конфигурацию по ссылке на имерской вы получите + 2.
13: Процентов к 1 пополнению регистрируйтесь, чтобы использовать современные технологии по максимуму, а теперь продолжаем окей. Прежде чем приступить к написанию кода, нам нужно понять, какую проблему мы хотим решить боль у меня вот такая во время производства видео на YouTube.
14: Я или монтажёр тратим десятки часов на отслушивание исходного материала и нарезку лучших дублей для получения драфта, видео, в котором я говорю без запинок нужный текст сценария я задолбался это делать и поэтому хочу автоматизировать. Идея следующая по моим.
15: Наблюдением самый Удачный дубль любой фразы это почти всегда самый последний записанный дубль. Это значит, что можно запилить некий алгоритм, который транскрибирует полное видео со всеми сказанными дублями. Затем мы вместе с ллм просто сопоставим транскрипцию и текст сценария.
16: И в итоге мы сможем получить тайминги последних дублей всех предложений. Затем останется просто автоматически нарезать исходное видео по найденным таймингам. Вроде нормальный подход попробуем сделать, но перед началом реализации программы нам нужно определиться со стеком стеком. Здесь я называю
17: Используемые языки программирования, апи базы данных и другие интеграции к сожалению, нельзя просто начать писать программу без определения конкретного стека стек здесь, по сути, определяет архитектуру проекта, и пока что его выбор лучше не доверять нейросетям.
18: Так как, во первых, это очень критичный этап, от которого сильно зависит сложность, масштабируемость и надёжность проекта нейронки, часто предлагают переусложнённые варианты архитектуры даже для маленьких приложений, а во вторых, нейронкам по умолчанию недоступна актуальная информация о новейших.
19: Сервисах апи и моделях и поэтому собирать какие-то навороченные айсс решения на передовых технологиях не выйдет. Давайте быстренько пробежимся какие компоненты стека вообще бывают и для чего их можно использовать. 1 фронтент это часть приложения, которое запускается в браузер.
20: Пользователя. Тут находится интерфейс, с которым взаимодействует юзер, простейший фронт можно писать на чистой связке html, css и javascript, но по факту стандарт для современных сайтов сейчас это next джиэс, плюс тайпскрипт, тайпскрипт, это типизируем, версия javascript в ней
21: Потенциальные ошибки отлавливаются ещё во время сборки проекта. 2 бэкэнд это все, что выполняется на вашем удалённом сервере. Создание пользователей, обработка информации, управление хранением данных и взаимодействие с внешними апи. Вот самые популярные
22: Стеки самый подходящий для soul проектов это но gs или python go хорош для высоконагруженных серверов, а java kotlin это уже энтерпрайз, уровень для маленьких проектов это перебор, если нужно мобильное приложение to под android стандарт это kotlin плюс.
23: Park композ, а под ios, swift плюс свифт, юай, либо универсальные reactnative на тайп, скрипте и flutter на dart они компилятся на обе платформы из единого исходного кода, хороши для solo проектов, чтобы не выполнять 2 раза 1 и ту же работу, также важно.
24: Часть бэкенда это база данных. Их существует множество типов, но главные 2 это эскьюэль и новый эскьюэль базы данных. Новые эскьюэль нужны для высокой скорости и гибкости, а эскьюэль для простоты и максимальной структурированности 90% проектов будет
25: Достаточно эскьюэль базы самая популярная версия такой бд это постгрес. Я использую её практически везде. Если же проект чисто локальный или супер маленький, то беру ультралегкую альтернативу эскьюэль лайт она хранит все данные в 1 файлике для ii проектов практически всегда.
26: Нужна интеграция с ллм, и тут выгоднее всего подключаться к агрегатору апи типа open роутер такой подход легко позволит менять модели, не переписывая код под каждого провайдера. Если проект взаимодействует с речью, то, как правило, можно законнектить элевен Лапс, опен эйай или минимакс.
27: Конкретный выброс зависит от задачи, а на случай генерации видео или картинок я всегда юзаю фал эйай там самый широкий выбор генеративных моделей по api эти компоненты в различных комбинациях покрывают 90% проектов. Если же ваша задача реально специфичная, то лучше.
28: Делать отдельный ресерч конкретно под неё пример стека под необычную задачу можете глянуть в моём предыдущем видео про saas генератор рилс там ya заюзал немного более нестандартный для меня стек, так как делал сложную задачу с генерацией ай аватаров под текущий проект автонарезку.
29: Видео возьму базовый питон без фреймворков, так как для начала мне будет достаточно просто иметь локальный скрипт на моём компьютере, который решает задачу. Также здесь точно понадобится апи для распознавания голоса возьму опен ай, так как не хочу пока закупать подписку от eleven Лапс и тратить время на
30: Изучение других моделей распознавания речи и 100% для проекта понадобится ллм подрублю опен роутер вроде все по инструментам для работы с кодом возьму курсор. Недавно вышло много крутых моделей. Хочется их потестить в бою, однако в качестве альтернатив можно спокойно брать клод код.
31: Gemini силай, кодекс силай. Они отлично годятся для веб кодинга внутри, имеют достаточный функционал и хорошие модели. И ещё 1 важный момент. Прежде чем писать 1 промп, нужно понять, как конкретно будет работать алгоритм нашей программы. Вот что я придумал. Скрипт должен
32: Принимать на вход видеофайл 4K 25 фпс на выходе я хочу видеть файл эссипи xml формата этот формат хранит в себе информацию о монтажном проекте, и его можно открыть в любой популярной программе для монтажа, затем импортировать исходное видео и программа автомати.
33: Нарежет исходный видос в соответствии с таймингами из scp xml файла как будет формироваться такой файлик вот пошаговый алгоритм 1 из исходного видео будет доставаться аудиодорожка, затем она будет отправлена на транскрибацию, и на выходе этого этапа мы.
34: Получим тайминги каждого сказанного слова. Далее программа будет брать распознанные слова пачками по несколько штук вместе с парой предложений из текста сценария видео эта информация будет отправляться в ллм, которая будет решать в этой пачке звучит только текущее предложение.
35: Или уже следующее если только текущее, то возьмём следующую пачку слов, а предложения сценария оставим теми же, будем повторять так пока не дойдём до слов транскрипции, принадлежащих следующему предложению в сценарии, это будет значить, что все дубли предложения уже найдены.
36: И нам остаётся просто найти тайминги слов последней попытки. Эти тайминги сохраним как успешный фрагмент, который должен попасть в финальный видос и теперь сдвинем выбранные предложения из сценария на 1, взяв следующие как текущее, будем повторять этот алгоритм, пока не дойдём.
37: До конца транскрипции и сценария затем останется лишь сконвертировать сохранённые тайминги успешных последних дублей в scp xml файл в теории должно работать вот теперь погнали реализуем откроем курсор, выберем новую папку туда докину сразу сорс видео и.
38: Текстовый сценарий для проверки скрипта вью оставлю agents, так как это как раз идеальный для нас расклад с такой настройкой мы сосредотачиваемся на работе агента и не особо смотрим в код в правилах проекта, задам наш стек и ограничения, чтобы не думать об этом в будущем нажима.
39: Cursor сеттингс курсор сеттингс рулс энд команс проджект рулс ад рулс в названии введу пайтон в настройках, оставлю олвейс саплай, чтобы правило работало всегда в содержимом, пропишу инструкции для безопасной работы с типами плюс.
40: С описание работы с зависимостями чтобы агент не запутался в библиотеках полный текст. Правила можете глянуть в описании видео тут важно понимать, с каким языком, фреймворком и зависимостями вы работаете, правила будут сильно зависеть от стека например, в моём случае язык python по умолчанию не.
41: И может выплёвывать неожиданные ошибки во время работы программы, соответственно, чтобы этого избежать, я прошу грамотно работать с типами и запускать проверки после каждого изменения кода конкретные особенности технологии вы можете постичь по мере накопления опыта или как вариант можно поговорить с gpt.
42: На предмет подводных камней и нюансов выбранного стека. Окей. Далее попросим агента установить кит репозиторий и гит игнор для него, чтобы наши изменения в будущем надёжно сохранялись и не портились неудачными попытками агента реализовать новую фичу. Гид. Это важнейший инструмент.
43: Хранение версии кода используйте его во всех проектах, где код вам дорог, и вы не хотите его потерять. Гид это, по сути, просто цепочка наборов изменений текстовых файлов, которые более менее надёжно хранятся в Папке, плюс удобно пушится в репозитории типа github точка ком модели.
44: Агентов курсора ставлю опус 4 с половиной, он достаточно крутой. Сейчас вообще рекомендую брать самые умные нейронки, на которые вам хватает бюджета. Интеллект ланки очень сильно влияет на сложность работы со слабыми моделями будет кодить очень больно, они просто не будут следовать вашим
45: Инструкция. Лучшие модели можно смотреть на лидербордах. Например, 1 из самых популярных. Это сайт эм арена точка эйай в разделе текст кодинг. Там как раз сейчас топ 1 это opus 4 с половиной. Далее в гитигнор попрошу добавить наш скрипт точка ткст, так как это не
46: И его не нужно сохранять в репозитории. Плюс попрошу создать 1 коммит в гид, коммиты в гид. Это что-то типа чекпоинтов. Изменения, попавшие в коммит, надёжно сохранены. К ним можно будет вернуться в будущем. Если что-то пойдёт не так. И историю коммитов можно посмотреть справа на вкладке.
47: Guid теперь давайте реализуем 1 этап извлечение аудио из исходного видео я буду специально имплементировать наш алгоритм пошагово, чтобы в случае проблем сразу их замечать и фиксить, плюс тогда задачи для ллм будут не супер тяжёлые, вероятность сделать при таком подходе что-то рабочее.
48: Сильно возрастает. Мы будем идти от простого к сложному, наполняя нашу программу фичами и усложняя основной процесс. Если же попытаемся сгенерировать весь проект в 1 промпт, то вероятность багов будет слишком высокой, и разгребать их будет слишком сложно. Трудно будет понять, что вообще работает.
49: А что нет, все будет запутано, поэтому создам нового агента и введу промт создать пайтон. Скрипт, который принимает видео в качестве параметра, конвертирует его в сжатый мп 3 аудиофайл и сохраняет в папку output слэш, таймстемп. Запроли все изменения и вызовы.
50: Отлично. Аудиофайл создаётся, и звук в нём корректный. Следующим этапом добавим транскрибацию аудио, так как тут понадобится использовать опения зависимости, то докинем эмсипи контакс 7, чтобы программа лучше ориентировалась в том, как работать с библиотеками, если вы не
51: Знаете, что такое mcp и как их подключать то можете глянуть вот этот мой ролик, там я все объясняю. Добавим новое правило проекта, чтобы агент использовал contex 7 всегда, когда ему нужно работать с библиотеками и да, попросим закоммитить текущие файлы. Вообще люблю коммитить вручную так, как будто
52: То надёжнее, но можно и попросить это сделать агента тут в целом без разницы. Разве что описание коммита от агента будет, как правило, более развёрнутым. Теперь можем открыть новый диалог и попросить реализовать транскрибацию. Вот добавь скрипту, который генерирует аудио из видео следующий
53: Так, транскрибацию с помощью open a gpt 4 о транскраб аналог виспер я хочу получить тайминги каждого слова в той же Папке аутпут слэш таймстемп в json файле запускаем теперь программа требует наш open апи ключ сгенерируем его на platform точка.
54: Точка ком, перейдя в настройки api keys криейт нью секрет кей, сохраним его в файлик точка энф, чтобы не потерять, и добавим в игнор кита, чтобы он не попал в наш репозиторий с кодом, так как это secret вообще точка нф файл с параметрами.
55: Граммы это фундаментальный элемент, который должен присутствовать в 99 процентах проектов. В него я рекомендую выносить все глобальные настройки, которые, возможно, придётся менять после релиза. И плюс параметры, которые отличаются на тестовой и production, средах. В общем, если не знаете, что такое перемен,
56: Среды, то копните этот момент поглубже запустим транскрибируется. Ага. Получаем какую-то ошибку, скормлю её в чат. Агент говорит, что формат таймингов слов возможен только с моделью виспер 1 текущая модель gpt 4 о транскрип
57: Типа не может это сделать окей, закину ему документацию api по транскрибации и скажу что все равно хочу gpt 4 о, изучив док он все равно считает что нельзя это реализовать с помощью gpt 4 о чекну сам документацию действительно.
58: Окей, придётся перейти на Visper 1. Запускаем через 18 минут распознавания, получаю результат в json файлики как я хотел заигнорю всю папку output в гид, чтобы эти файлики не подсвечивались синим, как изменения и.
59: И закоммичу текущий прогресс давайте попросим также почистить беспорядок, переместив полезные файлы кода в src, удалив мусор и переименовав файлы в более соответствующие имена, так как транскрибация аудио работает слишком долго, предлагаю переиспользовать результаты.
60: Предыдущих распознаваний если при запуске скрипта указана существующая аутпут папка и если в этой Папке уже есть джейсон с транскрипцией, то будем пропускать шаг распознавания текста. Отлично, теперь шаг пропускается, если json файл уже есть закоммитил.
61: Теперь попробуем реализовать самую сложную часть скрипта. Проход по транскрипции и сценарию для нахождения таймингов последних дублей. Вот такой вот промт получился. Запустим, готово. Теперь поставим нужные переменные в энф и протестим программу запус.
62: Угу. В результате получилась какая-то дичь. Слова начала и конца попыток. Какие-то странные. Плюс тайминги неправильные. Попрошу агента исправить. Спустя несколько минут опус решает, что все исправлено. Окей, пробуем протестить. Ага, тут есть.
63: Проблемы, которые возникают, если некоторые предложения не прозвучали в транскрипции, попрошу исправить. Ага, проблемы все ещё остаются, и корень их в том, что уиспер очень неточно транскрибирует голос, он почему-то игнорирует фразу привет, меня зовут
64: И ещё пару предложений, они полностью отсутствуют транскрипции. Чтобы исправить ситуацию, переключусь на более надёжный апи для транскрибации. Возьму элевен лап скрайб модель. Думаю, агент без проблем разберётся, как это реализовать с помощью контекс 7. Поэтому просто скажу ему переделать виспер на
65: Транскрипцию для запуска нужно сгенерировать. Элла, апи ключ. Захожу на сайт, затем в раздел девелоперс апи кис критки. Подставлю наш файлик точка элф. Готово. Можно запускать. Угу. При запуске опять возникают какие-то проблемы с
66: Поиском предложения с приветствием. Однако слова успешно распознались. Они находятся в транскрипции, поэтому закоммитится и попробуем зафиксить наш алгоритм. Ага. Апдейт нутый алгоритм выдаёт какую-то фигню как результат. Найденные попытки не являются.
67: Последними он выбрал какие-то неудачные обрубки. Попробую поправить через несколько итераций фиксов получаю тайминги попыток, более менее похожих на то, что нужно закоммичу, и попробую добавить шаг рендера, чтобы посмотреть.
68: Какой результат получается, если нарезать по таймингам, реализовать рендер проще, чем делать сразу файлик для импорта в монтажную программу, чтобы рендер Шёл быстрее, прошу генерить файл в 360 p. И вот что получилось я сделал веб сервис, который генерирует видео с вашим аватаром.
69: А также автоматически монтирует рилс со вставками, перебивками и уместными сгенерированными картинками и видео на заднем фоне.
70: Вот такое видео я смог создать за пару минут на моей системе, подав на вход промт сценария и монтажный промт с помощью такого контент завода можно легко создавать вертикальные ролики на автомате без использования камеры микрофона и premier pro.
71: С помощью такого контент завода можно легко создавать вертикальные ролики на автомате без использования камеры микрофона и premier pro.
72: Расскажу, как это все работает, какие нейронки находятся под капотом, как создавал такую систему, какие проблемы встретил и как их создавал, такую хитрую систему, как создавал такую хитрую систему, какие проблемы встретил и как их решал вот несколько моментов.
73: Которые выглядят не очень. Во первых, после каждой фразы есть огромная пауза, видимо, до следующего после ней слова. И также некоторые фразы почему-то дублируются, и в некоторых фразах обрезалась пара слов. Короче, нужно сделать алгоритм более точным. После множества фиксов алгоритм
74: Star запутанным черным ящиком. Поэтому, чтобы понять, как это работает, попрошу нейронку рассказать мне устройство текущей программы. Ага. И ещё попрошу показать промты, которые она использует при вызове ллм. Вижу как минимум 2 проблемы. 1. Судя по алгоритму, мы можем задетектить
75: Любую не последнюю попытку и сказать, что она последняя, так как мы прощаем, если не нашли следующее предложение, надо жёстко требовать наличия следующего предложения, чтобы быть уверенным в том, что все попытки озвучки текущего предложения уже прозвучали, и 2 проблема
76: Это немного неочевидный промт для ллм. В нём не описывается, что конкретно должно быть в Полях, которые мы ожидаем от модели. Попрошу это исправить. Отлично. Прогоню обновлённый алгоритм детекта попыток. Ага, теперь все предложения скипаются, нужно пофиксить.
77: После фикса получается вот такой вот результат нарезки. Привет, меня зовут Олег.
78: Днём я разработчик, а по вечерам на этом канале вайб колер пилю свои небольшие проекты, тестирую нейронки и айа инструменты, смотрю, что работает, а что не очень. Несколько видео назад я показывал, как делал небольшой контент завод на основе хайген элевен, Лапс энайт и gpt.
79: Несколько видео назад я показывал, как делал небольшой контент завод на основе хайген, элевен, лабс, gpt и энайт уже лучше, но все равно почему-то некоторые предложения выглядят как 2 склеенные вместе попытки надо исправить, судя.
80: По логам лм. Запросов, именно ллм ответственна за такую кривую нарезку. Она сама даёт такие индексы слов для выбора попытки попробую изменить модель. Например, на джиминат про отлично проблемное место прошло успешно, однако алгоритм теперь работает слишком дорого.
81: И медленно для оптимизации подрублю модель Санет 4 с половиной. Плюс поставлю количество слов в 1 пачке равным 100. Это позволит находить попытки в 2 раза быстрее. И вот такой вот результат теперь вышел уже. Отлично привет. Меня зовут Олег.
82: Днём я разработчик, а по вечерам на этом канале вайб кодер пилю свои небольшие проекты, тестирую нейронки и эйа инструменты, смотрю, что работает, а что не очень. Несколько видео назад я показывал, как делал небольшой контент завод на основе хайген элевен, лабс, gpt и эйтен попыт
83: Нарезаны корректно, осталось решить пару побочных моментов во первых, чтобы перед началом каждого нарезанного сегмента была хотя бы 1 10 секунда паузы, чтобы нарезка не выглядела такой жёсткой, и, во вторых, чтобы концовка сегмента заканчивалась в конце слова, а не в начале следующего за ним сейчас.
84: Там все ещё большие паузы. Попробуем поресерчить проблему с окончанием фрагментов судя по транскрипции, проблема удлинённых концовок некоторых слов в том, что lm Лапс возвращает неправильные тайминги, например, слово фоне вряд ли реально длится 3 секунды, чтобы.
85: Это исправить. Думаю, можно измерять громкость последнего слова, попытки и обрезать его, как только оно затихнет близко к нулю громкости. Отлично. Теперь наш алгоритм умеет круто распознавать и нарезать видео в соответствии с предоставленным сценарием. И чтобы все это было гибким и редактируемым, заменим.
86: Шаг рендера на генерацию фсипи xml файла он будет открывать нашу нарезку как проект в монтажной программе летс гоу спустя несколько минут доработка готова, и агендер запустил код, сгенерировав фсипи xml для нашего теста попробую импортировать файл в давинчи резолф.
87: Ага, выпадает какая-то ошибка. Закину в агента и попрошу, чтобы попправил кажется проблема в таймингах исходного видео. Окей opus, поправил код, импортируем файл ещё раз и вуаля все отлично работает и теперь можно.
88: Тировать нарезку в любой удобной монтажной программе. Если что-то задетектилось неверно или если хочется нарезать как-то по другому. Единственный момент, который мне не нравится, это какие-то проскакивающие чёрные кадры. Попробую это исправить. Ага. Агент говорит, что проблема
89: Округление таймингов, кадров. Окей, импортируем обновлённый файл. Отлично. Он работает шикарно. И остался ещё 1 небольшой неприятный момент. В 1 дубле есть щелчок пальцами после сказанной фразы. Соответственно, он распознается скриптом обрезающим
90: Концовки как громкая часть и поэтому остаётся в дубле, а не обрезается, так как текущий алгоритм ищет последнее громкое место с конца слова, чтобы это исправить, попробуем изменить алгоритм на поиск тишины с начала слова это должно решить проблему окей после попытки исправить.
91: Это кадры начали обрезаться слишком рано. Агент подумал, что нужно искать тишину сначала всего сегмента, а не только с начала последнего слова. 2 исправление уже получилось верным, но для его проверки придётся перезапустить детект последних дублей либо реализовать обратную совместимость.
92: Предыдущими файлами распознанных попыток лучше перезапущу заново. Вообще не рекомендую соглашаться на реализацию обратной совместимости во время веб кодинга любых алгоритмов, так как это почти всегда мусорный код. Такие манёвры усложняют работу программы без реальной нужды. Рекомендую делать обратную
93: Совместимость, только если ваш проект уже работает в проде с реальными юзерами, и вы на 100% понимаете, что вы делаете после перезапуска алгоритма. Проблема решена и концовки попыток корректно обрезаются. Ура, привет. Меня зовут Олег, днём разработчик, а по вечерам на этом канале вайб кодер пилю.
94: Небольшие проекты. Тестирую нейронки и айа инструменты. Смотрю, что работает, а что не очень. И давайте докинем ещё 1 10 секунду в конец каждого нарезанного Клипа. Отлично. Теперь последние слова не обрезаются и для максимальной юзабельности добавлю возможность подгружать видео.
95: Нескольких камер и дорожку с микрофона, чтобы редактировать их синхронно. Кстати, заметьте, что во время реализации агент начал думать про сложные мультикам клипы, и я сразу написал ему, что можно сделать проще. Часто лучше следить за тем, о чем вообще думает модель, чтобы
96: Видеть моменты, в которых она вас явно не поняла, или мыслить не в ту сторону, плюс в курсор добавили удобную возможность докидывать промты в агента, не дожидаясь полного завершения текущей задачи, можно легко корректировать курс лмки уточняющими инструкциями, однако после апгрейда кода
97: Программа стала работать абсолютно неправильно, и никакие фиксы не помогали. А гим как будто запутался в том, что он вообще делает. Возможная проблема в том, что весь наш код находится в 1 и том же файле и файл разросся уже до 2000 строк. Это уже немного перебор. Обычно я стараюсь удерживать размер
98: Файлов до 1000 строк. Такой размер файла позволяет адекватно работать с кодом без перегрузки контекста модели лишним мусором. Чтобы исправить проблему, откачу изменения и разобью код на файлы по функциям, разделяя их ответственность. Отлично. Он разбил 1 большой файл на несколько понятных Коротких
99: Файлов до 200 строк, и каждый из них достаточно очевидно, называется. Теперь можно будет прикреплять только нужную часть кода в контекст агента по названиям файлов. Легко понять, что они примерно делают. После каждого такого рефакторинга нужно обязательно проверять работу кода. Запустим и проверим, что все рабо
100: Как раньше ага, обнаружился новый глич, при нарезке близких друг к другу фрагментов мы можем случайно включить один и тот же кусочек видео в 2 последовательных кадра, нейронки и айа инструменты. Смотрю, что работает. А что не очень надо это поправить. Пере.
101: Запустим генерацию нарезки. Ага, отлично. Проблема исправлена. Теперь можем вернуться к нашей задаче с мультикамерой запущу тот же самый промт, но с другим контекстом файлов. Плюс доработаю его в тех местах, где в прошлый раз лм. Не поняла меня. Ага. С 1 раза результат ужас.
102: Попробую исправить. Спустя несколько исправлений получил что-то выглядящее как правильный результат, но из 2 входящих видео корректно нарезано только 1 проблемы с синхронизацией или сдвигом таймингов между видео закоммичу промежуточный результат и попробую пофиксить.
103: Коммит таких частичных доработок тоже важен. Даже если программа не работает полностью правильно, лучше комитить все, что страшно потерять. А сейчас я не хочу потерять эту полурабочую сборку и после финального фикса получаю вот такой вот результат в этом видео. Расскажу как это все работает, какие
104: Нейронки находятся под капотом, как создавал такую хитрую систему, какие проблемы встретил и как их решал привет. Меня зовут Олег. Днём я разработчик, а по вечерам на этом канале вайб кодер пилю свои небольшие проекты, тестирую нейронки и айа инструменты и давайте запилим удобный интерфейс для на
105: Проги чтобы выбирать файлы для обработки и отслеживать прогресс готово получился красивый ui с кнопочками и селекторами файлов крутяк. Теперь можно нормально пользоваться нашей программой сегодня я запилил программу, которая экономит десятки часов, автоматизируя нарезку видео.
106: И самое главное, что получилось реализовать этот проект, вообще не заглядывая в код, но во время разработки мне все равно приходилось много думать, анализировать и принимать решения, то есть выполнять те же задачи, что делает базовый программист. Получается, вайб кодинг это тоже программирование с теми же принципами подходами.
107: И логикой разница есть лишь в уровне абстракции классическая разработка тесно связана с классами, методами, функциями и другими объектами на уровне кода, а вайб кодинг скорее заставляет сосредоточиться на бизнес требованиях и архитектуре ты начинаешь думать на уровне стеков.
108: Сервисов, фреймворков и целых систем, потому что сам код начинает быть скрытым за промтами агентов. Однако все-таки в дебаггинге и нагруженных системах скил понимания кода будет существенным плюсом возможность посмотреть и понять, что реально делает программа, позволяет справиться со многими пробле.
109: Проблемами в работе приложения, но в целом основная тенденция развития технологий, как и раньше, сохраняется. Они просто продолжают двигаться от низкоуровневых вещей вверх, к более сложным и абстрактным уровням. Интересно, что будет происходить с этим дальше. А пока подписывайтесь на мой канал.
110: Здесь я продолжу исследовать эйай и его применение в разработке и смежных сферах, тестить модели, инструменты, делать микропроекты, также подписывайтесь на мой telegram канал там я иногда публикую заметки о полезных вещах, связанных с разработкой и ai, и если вам нужно что-то автоматизировать.