Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Короче, ребята, нужна помощь бомжу с 4gb vram. Что есть типа DeepNude, но локальное и нетребовательное, желательно без слишком сложной установки? Остальные характеристики ПК: Ryzen 5 4500, 8x2 ddr4 ram
>>1625940 (OP) О, у меня тоже 4Гб vram, зато обычной оперативы 64Гб, этого хватает даже на генерацию видосов в comfyui, причём это занимает не вечность по времени (но качество шакальное, хотя это от модели зависит). Касательно 8×2 ram как вариант в comfyui взять плагин на gguf, либо скомпилить под видеокарту stable-diffusion.cpp, а потом запускать с флагом -- n-gpu-layers [число слоёв], если, конечно, там такое есть. Может показаться, что возни многовато, но на самом деле в случае с stable-diffusion.cpp достаточно просто в аргументах командной строки прописать необходимые модели.
>>1627428 А, ещё добалю, что наверняка полно приложух на основе stable-diffusion.cpp, которые позволяют избежать работы в командной строке. Об этом можно почитать в readme.md проета в разделе сопутствующих проектов.
ai age verification (подтверждение возраста) на сайте
Аноним02/06/26 Втр 18:12:59№1624341Ответ
привет дрочеры двачеры! столкнулся с трудностями там, где совсем уж не ожидал. при очередном визите на spankbang обнаружил предложение пройти процедуру верификации возраста. процедура довольно простая - доки не нужны, просто лицом в камеру посветить. мне то лет уже достаточно, но светить родным ликом в камеру перед каким-то ИИ, сгенерированным другим ИИ я не хочу. посему встал вопрос - как пройти эту проверку, не "спалив свой фейс?" смена региона для слабаков - хочу один раз закрыть вопрос и спокойно пользоваться, потому проверку нужно именно пройти, а не обойти требование подтверждения возраста.
пробовал показывать камере смарта фотки футболистов - фейлишь несколько попыток, после чего идёшь нахер презагружаешь страницу. и так по кругу.
пробовал OBS virtual camera и видос с "говорящей головой" в качестве источника - сразу схлопывает, говорит прошёл, но доступа к сайту так и не даёт. и так по кругу.
помогайте, умники и умницы! у меня там в разделе "favorites" сохранены очень важные видео, которых на других ресурсах не найти. очень нужно восстановить доступ.
А ты уже задумывался о том, на какой вопрос сможет дать ответ только человек? Есть что то такое что машина никогда не узнает - описания запахов, специфических чувств и другое. Нейросети развиваются. Какой вопрос поставит нейросеть в тупик? На какой вопрос сможет ответить только живой человек?
Сап, недавно наткнулся на сайтик ourdream.ai (nsfw чат + генерация картинок с контекстаб) по сути идеально для меня, но стоит денех и родилась идея организовать это локально с помощью SillyTavern+DrawThings+SD1.5(macOS) Уверен что есть уже умельцы которые смогли это сделать и прошу советов как это сделать лучше. Какие llm выбрать для генерации nsfw чата с персонажем (планирую качать с chub.ai), как лучше всего организовать промпты для last message (в SillyTavern), какую модель брать для генерации картинок (базу планирую SD1.5, мне не нужно супер крутые детализированные картинки, ваще я фанат рисованных nswf комиксов типа milftoon, jago, notenoughmilk etc.) использовать ли LoRA и тд. В общем человек который в это уже углубился и так поймет в чем дело. Помоги анон
>>1623389 (OP) >базу планирую SD1.5, мне не нужно супер крутые детализированные картинки, ваще я фанат рисованных nswf комиксов типа milftoon, jago, notenoughmilk etc. А ты безотносительно твоего громадья планов уже что-нибудь генерировал на 1.5? Для более-менее адекватных картинок она требует специального техпроцесса,заключающегося в генерации по сто картинок подряд, из которых в лучшем случае 5-10 можно будет потом дорабатывать. Для комиксов, таких чтобы с первой попытки выходило что-то более-менее годное, лучше брать сразу z-image. Кроме того, все зависит от доступных тебе ресурсов, ведь как z-image, так и llm требуют изрядно vram и ram.
>>1623408 у меня MacBook M3 pro, 18ram выбрал sd1.5 так как по идее относительно легкая модель и генерит достойный контент (топ за свои бабки), но могу ошибаться так как тотал нуб в этом всем - поэтому прошу совета. Пробовал генерить разные картинки, иногда получается норм, но при одном и том же промпте получается 10 разных картинок, из которых 1-2 более менее то что мне нужно. Мне не нужно супер крутой детализированный контент, мне важнее чтоб каждый раз моделька выдавала стабильно хорошую соответсвенно контексту картинку. То есть я переписываюсь с ботом в Таверне -> жму Generate Image -> Last message -> и оно мне дает адекватную картинку в соответствии с диалогом.
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
С чего начать: - Хочешь кодить с AI эффективно: Cursor или Claude Code - Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter - Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.5, подробности в llama-треде - Хочешь приложение без кода: Lovable или bolt.new - Хочешь автоматизировать рутину: n8n или Langflow - Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке
Кто-то пробовал с агентом чисто на флешке 3.5? Есть много ключей фришных, но может лучше клода взять по подписке? Просто агентов никогда не пробовал, всегда веба хватало
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Ну что, аноны. Штеп уже вышел как недельку. Покатали, какой синопсис по итогу?
Так вижу: идеальный нищуган выбор для тех кто каким то хуем имеет РАМ но не имеет ВРАМ, так как даже на 16врам можно обмазаться абсурдными 70к контекста для необладателей памяти. Моделька в целом глупенькая, с ризонингом дело исправляется.
Новости об искусственном интеллекте №72 /news/
Аноним# OP25/05/26 Пнд 13:39:20№1619422Ответ
Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.
🚀 Последний обзор ИИ новостей:
📰 Главные новости ИИ
Крупные технологические компании добились своего в указе Трампа об ИИ. Отказ президента США от призыва к проверке безопасности новых моделей ИИ — это зеленый свет для безграничной власти технологий. Всего за несколько часов до того, как Дональд Трамп должен был подписать долгожданный указ в четверг, который потребовал бы правительственной проверки безопасности новых моделей искусственного интеллекта перед их выпуском, президент резко отказался от этого. Несмотря на растущую негативную реакцию общественности на эту технологию и предупреждения экспертов о том, что новые модели будут представлять критические риски для безопасности, Трамп пообещал, что правительство США не будет замедлять гонку ИИ.
💰 Финансирование
Сэм Альтман делает эффектное предложение каждому стартапу Y Combinator. Альтман предложил токены OpenAI на сумму 2 миллиона долларов каждому стартапу текущего потока в обмен на долю в стартапе.
Белый дом страхует риски, охватывая различные парадигмы, выделяя гранты на сумму 2 миллиарда долларов девяти компаниям в области квантовых вычислений, включая IBM и Rigetti, при этом правительство получает долю в их капитале.
Франция выделяет 1 миллиард евро дополнительного финансирования на квантовые вычисления для ИИ, поскольку Макрон предупреждает, что ЕС должен идти в ногу с американскими и китайскими успехами.
🏭 Компании
Кризис расходов на ИИ обрушивается на технологических гигантов, поскольку «токенмаксинг» сотрудников дает обратный эффект, вызывая корпоративное сокращение в Microsoft, Meta и Amazon — агентный ИИ потребляет до 1000 раз больше токенов, чем стандартный ИИ.
GitHub признан лидером в магическом квадранте Gartner® для корпоративных ИИ-агентов по написанию кода третий год подряд.
Peec, один из восходящих стартапов Берлина в ИИ, более чем удвоил годовую выручку за несколько месяцев до 10 миллионов долларов, по словам источников.
Stellantis объявила о стратегическом партнерстве с Accenture и NVIDIA для разработки цифровых двойников на базе ИИ на всех своих глобальных производственных предприятиях. Цифровой двойник в данном контексте — это постоянно обновляемая виртуальная копия физической фабрики, работающая на реальных данных с датчиков в производственных цехах. Пилотные проекты стартуют в Северной Америке в 2026 году с планами масштабировать эту архитектуру на все глобальное присутствие Stellantis.
Anthropic завершила секретный контракт с Агентством национальной безопасности и Министерством обороны, разрешающий развертывание моделей ИИ на секретных системах, при этом опустив стандартную формулировку о «любом законном использовании» и запретив использование данных американцев — Белый дом одобрил 9 миллиардов долларов для разведывательных ведомств на покупку передовых чипов.
OpenAI открывает лабораторию ИИ в Сингапуре, поскольку IMDA обновляет концепцию развития ИИ. OpenAI откроет свою первую Лабораторию прикладного ИИ за пределами США в Сингапуре. Лаборатория является частью нового партнерства с Министерством цифрового развития и информации.
📦 Продукты
Начинается эра Google после поиска. Даже если вы ненавидите ИИ, вы будете использовать поиск Google с ИИ.
ИИ-поиск Google настолько сломан, что может «игнорировать» то, что вы ищете.
Форум Meta — это отчасти Reddit, отчасти Facebook и отчасти Google AI Overview. Новое приложение Forum от Meta для iPhone берет группы Facebook и переносит их в отдельное приложение вместе со специальным ИИ-чат-ботом, как ИИ-версию злополучного приложения Groups, которое Facebook закрыл в 2017 году.
Мы опробовали ИИ-очки Google, и они почти готовы. На конференции для разработчиков Google I/O на этой неделе у нас была возможность кратко протестировать готовящиеся очки Google с поддержкой ИИ — не аудио-очки, которые, по словам компании, начнут поставляться этой осенью, а очки, предлагающие комбинированный аудио- и визуальный опыт.
Финский производитель телефонов HMD интегрирует индийского ИИ-чат-бота в новый смартфон в стремлении выйти на местный рынок. Финский производитель телефонов HMD сегодня выпустил свой первый смартфон под названием Vibe 2 5G, который поставляется с предустановленным чат-ботом Indus от индийской ИИ-компании Sarvam.
Google Search получил свое крупнейшее обновление за более чем 25 лет, и эти изменения намного глубже, чем просто переработанный интерфейс. Сама поисковая строка была полностью переосмыслена. Теперь она принимает в качестве входных данных текст, изображения, файлы, видео и даже открытые вкладки Chrome, а также использует подсказки на базе ИИ, которые выходят за рамки автозаполнения, помогая вам сформулировать именно тот вопрос, который нужен.
OpenAI продемонстрировала, что функция работы с изображениями в ChatGPT теперь может заполнять загруженные отсканированные документы, автоматизируя последнее аналоговое убежище бюрократии.
Голос — это следующая абстракция: Google Docs Live позволяет создавать черновики документов голосом.
📱 Приложения
Синтез реалистичных 3D-медицинских изображений в масштабе для выпуска предварительно обученных моделей. NV-Generate-MR-Brain, новая модель для синтетической генерации анатомии человеческого мозга и сегментации структур, построенная на архитектуре MAISI и расширяющая ее в направлении масштабируемых, открытых рабочих процессов для генерации синтетических 3D-медицинских изображений.
Зачем проявлять неуважение к любимому исполнителю с помощью ИИ-ремикса? Spotify и Universal Music Group (UMG) подписали лицензионное соглашение, которое позволит пользователям генерировать ремиксы и каверы из каталога UMG с использованием ИИ.
ИИ используется для воскрешения голосов погибших пилотов. Национальный совет по безопасности на транспорте временно ограничил доступ к своей системе учета дел после обнаружения того, что голоса пилотов, погибших в авиакатастрофе самолета UPS в прошлом году, были воссозданы с помощью ИИ и распространялись в интернете.
ИИ-приложение только что расшифровало древнюю письменность возрастом 3500 лет, и это может переписать историю. Исследователи из Вюрцбургского университета в Германии представили революционный инструмент на базе искусственного интеллекта, который меняет подход ученых к чтению древних глиняных табличек, написанных клинописью, потенциально открывая бесчисленные забытые тайны хеттской цивилизации, когда-то доминировавшей в Анатолии. Инструмент под названием Palaeographicum функционирует как необычайно сложная система распознавания образов, автоматически идентифицируя индивидуальные вариации клинописных знаков, выдавленных в глине более трех тысячелетий назад. Исследователи говорят, что эта разработка представляет собой не что иное, как революцию в исследованиях Древнего Ближнего Востока.
🔓 Открытый исходный код
meituan-longcat/LongCat-Video-Avatar-1.5 — обновленный фреймворк с открытым исходным кодом, который ставит во главу угла экстремальную эмпирическую оптимизацию и готовность к производственному использованию для генерации видео с людьми на основе аудио. Построенная на базовой модели LongCat-Video, версия 1.5 обеспечивает высокостабильный синтез видео с аватарами коммерческого уровня, поддерживающий нативные задачи, включая преобразование аудио и текста в видео (AT2V), аудио, текста и изображения в видео (ATI2V) и продолжение видео, с беспрепятственной совместимостью как с однопотоковыми, так и с многопотоковыми аудиовходами.
G4-MeroMero-26B-A4B-it-uncensored-heretic уже доступен, это дообученная версия gemma-4-26B-A4B-it, с KLD 0.0152 и 12/100 отказов!
Perplexity выпускает Bumblebee, open-source сканер с доступом только для чтения для macOS и Linux, который инвентаризирует пакеты, расширения браузера и конфигурации для выявления рисков в цепочке поставок — он интегрируется с Perplexity Computer для запуска автоматического более глубокого сканирования.
>>1621345 >>1621247 Для лидерства в сфере ИИ не надо производить собственную электронику. Все ИИ на 90% на чипах одной нвидии. Пост не в защиту Пыни, а просто хуйню вы сами пишите.
Как думаете, есть ли смысл в отдельном AI-помощнике для dating apps? Есть небольшой проект RizzAI:
Аноним02/06/26 Втр 16:59:20№1624267Ответ
Работаю в Стабилити Матрикс, очень юзелесс прога для ии, поставил себе более менее модель на базе SD 1.5 и лору на такой же, проблема заключается в том что руки выходят кривоватые, и возможно ли мне стоит перейти на более продвинутые модели, ниже скину пример своих фотографий сделанный на персонажа Тсунаде из наруто, спасибо за любые подсказки
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1622920 Интересно, но я представляю как я потом буду это под свою память растыкивать в батнике и в жопе свербит. А так уже как-то пашет и пойдет. Даже если 25 токенов вместо возможных 40
Собственно, подскажите по сабжу. А то я недавно вдруг осознал, что уже года два как пользуюсь Rope, но ведь за это время нейросети сделали огромный скачок вперёд, так что почти наверняка есть более качественные способы натянуть лицо еот на тело порноактриссы и тд. Интересует именно локальная нейронка, а не онлайн-сервисы.
Есть тут люди с практическим опытом использования LLM в энтерпрайз тех саппорте (софт)? Ну там Rovo AI у джиры, KCS методология, подсасывание и анализ логов из эластика, интеграция с MCP Grafana'ы и вот это вот все. Интересует ваш анекдотический опыт, чем пользовались, стало ли проще жить, сложно ли было реализовать? Гайд не прошу, просто поделитесь самыми высокоуровневыми мыслями, буду благодарен. C ЛЛМкой канеш побрейнштормю, интересны мысли человеков.
- Оператор! - Но я тоже могу вам помочь, какая услуга вас интересует... ‐ Оператор! - Все операторы заняты, но я тоже могу вам помочь, скажите.. - Оператор!
>>1621736 В моем случае речь про вторую линию. Клиенты: первая линия, менеджмент, к которым приходят стейкхолдеры и жалуются. Наша задача - решать проблемы, эскалировать проблемы. В первую очередь интересует всякую унылую херню типа заполнения тикетов данными отдать ИИ, чтобы у специалистов и инженеров было больше времени.
>>1621730 (OP) > Ну там Rovo AI у джиры, KCS методология, подсасывание и анализ логов из эластика, интеграция с MCP Grafana Всё это дохлая однодневная хуйня и вендорлок ради вендорлока. Создаёшь RO токены во всех этих своих нескучных гарфанах и жирах. Пишешь на маркдауне скилл с тремя строчками и примерами curl. Дальше берёшь любой агент от pi до claude и скармливаешь ему задания. с вас 50 тыщ за консультацию
Сап, нейрач, ищу нейронку, которая поможет анализировать взаимодействия муравьёв в формикарии. Уже е
Аноним# OP25/05/26 Пнд 22:51:20№1619702Ответ
Сап, нейрач, ищу нейронку, которая поможет анализировать взаимодействия муравьёв в формикарии. Уже есть какие то варианты для хотя бы помеченных насекомых?
>>1620579 Можешь еще пару десятилетий подождать, высернонки работают только в своих ВАУ-демках и люто сливаются в любых реальных практических задачах. Это фундамент всех нейросетей, благодаря которому они НУ ТОЧНО порешают все через current year + x лет.
Не так давно я решил углубиться в робототехнику с применением RL. В связи с этим всё чаще сталкиваюсь с особенностями и стандартами области. Например штраф за скорость суставов, использование шумных сетей и важность планирования(Те алгоритмы, основанные на моделях).
Какие ещё особенности RL для робототехники вы знаете и имели ли вы подобный опыт с подобными приложениями?
О, моя бакалаврская была об этом! Такая фигня по итогу получилась, даже в симуляторе двигается чёрт знает как. Какие только штрафы я не прописывал, всё было бесполезно. Я перепррбовал несколько библиотек для python, предназначенных как для rl вообще, так и предназначенных специально для роботов. >>1621089 С Isaac sim есть очевидная проблема: требуется топовая комплектация компа. А ещё говорят, что возни много с его настройкой. MuJoCo шикарен, но у него свой особый формат хранения моделей: в других симуляторах используется urdf, а тут mjcf, причём mjcf нельзя нормально сконвертировать в urdf (да, решения есть, но фигня полная). P.S. аттестационная комиссия несмотря на то, что задача была фактически не достигнута, поставила 5.
Аноны подскажите пожалуйста есть ли на просторах интернета ИИ или может какая надстройка для Word которая может делать сноски автоматически?(Сноска пик3) Буду очень благодарен за подскаску и про инвестирую 3 чая в анона.
>>1618839 (OP) мудила, для этого есть специальный тред https://2ch.org/ai/res/299474.html Автоматические сноски можно делать как стандартными средствами Word, так и с помощью современных ИИ-плагинов и менеджеров источников. ------------------------------ ## 🛠️ Встроенный метод в Microsoft Word Word сам нумерует и переносит сноски вниз страницы. Вам не нужны сторонние программы для базовой автоматизации.
Горячие клавиши: Нажмите Alt + Ctrl + F (в Windows) или Cmd + Option + F (в Mac). Через меню: Вкладка «Ссылки» ➡️ кнопка «Вставить сноску». Результат: Номер сноски связывается с текстом автоматически. При добавлении новых сносок нумерация сама пересчитается.
------------------------------ ## 🤖 ИИ-сервисы и плагины для автоматических цитат Если вам нужно, чтобы ИИ сам находил источники, оформлял их по ГОСТу/конкретному стилю и превращал в сноски, используйте эти инструменты: ## 1. Специализированные ИИ-ассистенты
Jenni AI: Пишет текст вместе с вами. Автоматически ищет научные статьи. Генерирует правильные сноски в один клик. SciSpace (Typeset.io): ИИ для работы с научными текстами. Подключается к Word. Сам оформляет цитаты и сноски по тысячам стандартов.
## 2. Умные плагины для Word (Менеджеры библиографии) Это не чистый ИИ, но они полностью автоматизируют создание сносок из вашей базы источников.
Zotero + плагин Zotero Word Integration: Полностью бесплатный инструмент. Выделяете цитату ➡️ нажимаете кнопку ➡️ Zotero сам ставит сноску вниз страницы. * Mendeley Cite: Официальная надстройка для Word от Elsevier. Работает аналогично Zotero.
------------------------------ Если вы хотите автоматизировать создание сносок для научной работы или диплома, напишите, какой стиль оформления (например, ГОСТ) вам нужен. Я подскажу, как лучше настроить Zotero или Jenni AI под эту задачу.
МУЗЫКАЛЬНЫЙ №21 /music/
Аноним29/04/26 Срд 17:38:35№1601065Ответ
1. Suno https://suno.com/ Вышла версия 5.5 (но для тех кто платит денюшку), качество моделей постепенно улучшается: звук, понимание концепций, набора различных жанров. Но в то же время все сильнее урезается для бесплатных юзеров: осталось только 5 бесплатных генераций в день на аккаунт, а также по заявлением некоторых анонов, модель для генерации на бесплатке (на момент создания треда использовалась 4.5) ухудшили. Спам аккаунтами пока что работает. Купить подписку из РФ: 1. https://payment.mts.ru/tools/suno-ai 2. https://plati.market/games/suno-ai/1701/
2. Tunee https://www.tunee.ai Хороший звук, более-менее понимание концептов, но тоже сильно урезан для бесплатных юзеров: режет концепты в промптах, плюс произвольно определяет "цену" за каждую генерация исходя из какой-то "сложности запроса". И получается, что если с бесплатки забацаешь промпт сложнее банальщины "Make cool rock about love for youtube" он может решить что у тебя нет кредитов для такого сложного запроса и пошлет нахуй. Способов оплаты из РФ неизвестно.
3. Sonauto https://sonauto.ai/ Как по мне, недооценённая вещь, особенно учитывая что недавно он обновился до 3.0, который очень даже разъебывает. Но он тут более ограничен тегам и понимает чисто какие-то жанровые теги, гибкости поменьше. Но зато пока что халявный и не ограничен кредитами, генерируй пока есть настроение.
Потихоньку развиваются, стоит внимания ACE-STEP 1.5: https://github.com/ace-step/ACE-Step-1.5 Звук уже на уровне раннего Suno ~2.0-3.0, аноны делают на нем уже приемлемые результаты и постят в тред. Если есть хотя бы 12 GB VRAM и хочется генерировать без цензуры и подписок - можете юзать.
МЁРТВЫЕ ГЕНЕРАТОРЫ
1. Udio (udio.com) - куплен Warner Bros, но затем сами Warner Bros сдали назад и откатили сделку. Но уже успели испортить, больше нельзя скачивать треки, их только доставать из буфера в 160 кбит/с. Плюс непонятно как работающая цензура, которая не дает генерировать треки с определенными тегами. Плюс уже год ебут один и тот же 1.5 allegro. 2. Riffusion, Producer.ai (producer.ai) - куплен гуглом, удалены все старые относительно норм модели, вместо этого запихали безальтернативную каловую модель, которая и промпты сложнее самых нормисных в духе "make cool rock about love" не понимает, и вокал смазывает в какую-то кашу. При этом еще и максимально дегенеративная цензура, которая режет чуть ли не любые попытки сделать просто что-то не попсовое и не "музыку для ютуб".
ПРОЧИЕ ПОЛЕЗНЫЕ УТИЛИТЫ
1. https://www.bandlab.com/mastering Быстрый мастеринг в две кнопки, если хочешь чтобы звучало более слушабельно, но не имеешь навыков в DAW или аудиоредакторах (или лень). 2. https://morpher.ru/accentizer/ Если генерируешь музыку с лириками на русском, то очень часто случается, что твой генератор путает ударения в словах. Прежде чем пихать свою графоманию в генератор, проставь ударения в сервисе по ссылке. И уже из этого сервиса копируй текст в генератор. По крайней мере в Suno это помогает. 3. https://x-minus.pro/ai Быстро вытащить минус или вокал из трека.
Примечание от афтора шапки: в прошлых шапках были ссылки на нерабочие сервисы или полностью мертвые ссылки, я их не включил в шапку