23 февраля 2026 г.
Голосовой #vibe-кодинг

Голосовой #vibe-кодинг
Тру-вайбкодеры настолько преисполнились, что не пишут не только код, но даже и промпты. Они их диктуют.
Я несколько раз пробовал, но не преуспел. Поэтому, пока я по старинке пишу (а не диктую) лонгрид с результатами исследования SOTA-моделей (выйдет здесь уже завтра), решил обсудить эту тему с вами.
Мне кажется, голосовые в телеге не любят даже те, кто сам их записывает. Исключение составляют счастливые обладатели премиума. Но когда часто пользуешься распознаванием голосовых (я использую его в 100% случаев), становится понятно, что высокие результаты на бенчах далеко не так хороши в реальных кейсах.
Но у меня не задалось с голосовым вводом не по причине плохого распознавания.
Я пробовал нативную диктовку макоси, MacWhisper (его в итоге оставил для транскрибации созвонов и видео) и Handy. Но дело не в тулинге.
Дело во мне. В отличие от нейронок, я не могу генерировать запрос строго последовательно, токен за токеном. Я скорее конструирую его методом прогрессивного джипега: накидываю основное, потом прохожусь еще раз (или несколько), что-то уточняю, правлю, удаляю.
При этом слепой набор я освоил давным-давно и пользуюсь разными шоткатами, поэтому разница между диктовкой + временем на распознавание и проверку результата практически съедает профит, даже если бы я умел формулировать мысль с первого раза.
Но даже с телефона, где набирать гораздо менее удобно, я пишу промпты руками (о том, как настроил вайб-кодинг на телефоне, тоже скоро будет пост).
Вместе с тем идею накапливать вообще все свои разговоры в базу знаний считаю неизбежным будущим. Но пока, даже при том, что я купил Plaud, это все еще требует каких-то усилий, так что пин 99% времени валяется на полке без дела.
При этом активно использую Станцию с Алисой и без нее уже чувствую себя как-то неуютно.
Если вам удобно вайб-кодить голосом — поделитесь, пожалуйста, секретом в комментариях, как вы это делаете?