🧰 Подборка AI-инструментов Сохряняйте в заметки: все самое релевантное для решения разных задач – чем пользовался / пользуюсь и что считаю полезным. Знак $ рядом с названием = платная подписка. Обвязки для настройки агентных систем: • NanoClaw – мой фаворит: легкий, безопасный, удобный. • Hermes – появился относительно недавно, ключевая фишка, что "из коробки" сам дообучается. • OpenClaw – первопроходец, легко поставить, но много дыр в безопасности. • TrustClaw – переписан ради безопасности, векторная память, не тестировал. • Dify – агента собираешь мышкой на холсте, без единой строчки кода. Порог входа нулевой, но и потолок низкий. IDE – чтобы вам было удобно кодить: • BB – мой фаворит: держит сессии с вашим сервером, подключение в 1 клик, продолжение сессий после восстановления лимита. • CMUX – классический терминал, только на стероидах, раньше пользовался до BB. • Conductor – Mac-приложение для тех, кто не любит терминал: каждой задаче свой воркспейс и своя ветка, в конце показывает готовый диф на ревью. • Vibe Kanban – канбан-доска, где карточки двигают агенты. Наглядно, но компания закрылась – живёт силами сообщества. • Fletch – запирает каждого агента в отдельный клон репозитория, чтобы они не мешали друг другу. Голос как ввод – перестаете печатать на клавиатуре: • Superwhisper ($) – мой фаворит, куча настроек + может работать вообще локально на устройстве без интернета. • Wispr Flow ($) – аналог с более удобным user-flow, но меньшей гибкостью, мне зашел меньше супервиспера. • Willow Voice ($) – младший брат первых двух: дешевле и проще, но и возможностей меньше. • Plaud ($) – диктофон-карточка на встречи, сам расшифровывает. Из другой оперы инструмент, т.к. про встречи, но добавил сюда. • Whisper – опенсорсная база под всем вышеперечисленным. Бесплатно и локально, но обвязку пишете сами. Картинки: • fal.ai ($) – агрегатор моделей: 600+ моделей одним API. Подключил его к своим агентам, закидываю по 10 долларов периодически, генерация стоит центы, удобно. • FLUX.2 klein – открытые веса, крутится у меня локально – использую для простых артов. Требует оперативной памяти на компе, рекомендую лимитировать, а то все повиснет. • Nano Banana Pro ($) – очень сносная генерация графики • Midjourney ($) – по-прежнему самая эффектная картинка, зато текст бывает ломается • Ideogram ($) – заточен под типографику и логотипы, отдаёт результат редактируемыми слоями, но по красоте кадра уступает. Видео (видео не моя тема, но добавил, что знаю): • Kling ($) – сильнейший по движению и консистентности персонажа, в третьей версии подъехал нативный звук и липсинк. • Veo ($) – максимальный фотореализм и 4K, звук генерится вместе с картинкой. • Seedance ($) – единственный, кто собирает многосценный ролик, а не отдельный клип. Живёт внутри Runway. • Runway ($) – не столько модель, сколько монтажный стол вокруг чужих моделей. • Luma ($) – дёшево и быстро для проб, до топа по качеству не дотягивает. Музыка: • ACE-Step – локально, влезает в 4 гигабайта видеопамяти, песня считается за минуты. Тексты пишу с Клодом, музыку здесь. • Suno ($) – лучший в целом: вокал, жанры, тексты. С него стоит начинать, если пробуете впервые. • Udio ($) – самый чистый микс и сильные ремиксы кусками, но трек нельзя вынести за пределы платформы. • ElevenLabs Music ($) – тоже неплохо, можно потестировать. • Riffusion – бесплатно и прямо в браузере, просто чтобы попробовать. Синтез текста в голос – чтобы ваши агенты с вами говорили голосом в чате: • ElevenLabs ($) – эталон реалистичности и клон собственного голоса. При объёме выходит дорого + текст отправляется на их сервера. • Silero – мой фаворит: сильный русский и стандарт де-факто по детекции речи. • Piper – самый лёгкий: крутится на процессоре без видеокарты. У меня на нём стоят три русских голоса. • Fish Speech – клонирует голос по нескольким секундам записи, работает локально, но долго • Kokoro – 82 миллиона параметров и 54 голоса, Apache-2.0: говорят неплохо работает 💳 Многие требуют зарубежную карту. P.S. Рекомендация – при оплате ставьте платежный адрес в Делавере, не будет налогов ;) PARSHIN