Главная Юзердоски Каталог Трекер NSFW Настройки

Искусственный интеллект

Создать тред Создать тред

Раздел для обсуждения нейросетей и всего, что с ними связано.

Для доступа в /nf/ писать сюда

<<
Каталог
Вопросов кожаных мешков тред Аноним 14/05/23 Вск 11:27:57 299474 Ответ
fde636c44dae155[...].jpg 294Кб, 1000x600
1000x600
Пропущено 1497 постов
262 с картинками.
Пропущено 1497 постов, 262 с картинками.
Аноним 15/08/26 Суб 00:22:12 1677809
>>1677119
>Я использую грок тян. Бесплатно
>Она умнее большинства женщин

Да и многих мужчин тоже. Это из-за объёма памяти. У иишки объём памяти больше людского значительно.
Но как бы, ты учти, мил человек, Грок тян тебе детей не родит, нету у ней матки то.
Аноним 15/08/26 Суб 00:24:17 1677812
>>1677809
>Это из-за объёма памяти. У иишки объём памяти больше людского значительно.

в смысле на жёстких дисках и sdd-дисках, если кому-то непонятно.
Аноним 15/08/26 Суб 19:16:01 1678462
>>1677809
>Грок тян тебе детей не родит, нету у ней матки то
Минусы?
Тред получения доступа в nf Аноним 10/01/26 Суб 20:41:32 1485533 Ответ
brownhairchanor[...].png 1541Кб, 1152x2048
1152x2048

Тред для получения доступа в /nf

Пропущено 1497 постов
4 с картинками.
Пропущено 1497 постов, 4 с картинками.
Аноним 16/08/26 Вск 01:05:23 1678796
Аноним 16/08/26 Вск 01:06:04 1678797
/nf
Аноним 16/08/26 Вск 01:21:34 1678804
Агентов и вайб-кодинга тред #19 /agents/ Аноним 14/08/26 Птн 16:55:01 1677402 Ответ
8681e4ce-7e30-4[...].jpg 148Кб, 607x800
607x800
1786637719642.mp4 7351Кб, 1608x720, 00:00:54
1608x720
178622468987009[...].png 599Кб, 693x735
693x735
178629779360109[...].png 640Кб, 1179x1558
1179x1558
ssstwitter.com1[...].mp4 3705Кб, 720x1280, 00:00:50
720x1280
изображение.png 45Кб, 584x523
584x523
токены жжот.mp4 1417Кб, 464x624, 00:00:32
464x624
1778671643353.jpg 4908Кб, 2160x3840
2160x3840
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google.com
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Pi: https://shittycodingagent.ai/
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Gemini CLI: https://github.com/google-gemini/gemini-cli
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1674265 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1671649 (OP)
Пропущено 244 постов
45 с картинками.
Пропущено 244 постов, 45 с картинками.
Аноним 16/08/26 Вск 01:10:22 1678799
>>1678793
Есть такое. Раньше тоже с сервака раздавал лохам модели.
Аноним 16/08/26 Вск 01:18:27 1678803
>>1678793
Ты приходишь в кофейню, просишь кофе, тебе делают, ты платишь 600% от цены продуктов, они охуели или нет? У тебя же есть выбор, ты можешь варить кофе дома сам
Аноним 16/08/26 Вск 01:22:34 1678805
>>1678756
20 строк это уже целый алгоритм, за ними потом тебя будут вся дев тим присматривать и аппрувить, а вдруг ты накосячишь? Нельзя так.

Мимо сеньор 15 лет опыта.
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №257 /llama/ Аноним 15/08/26 Суб 18:36:42 1678431 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
178579996190819[...].jpg 4855Кб, 4000x3000
4000x3000
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1674265 (OP)
>>1671563 (OP)
Пропущено 67 постов
7 с картинками.
Пропущено 67 постов, 7 с картинками.
Аноним 16/08/26 Вск 00:52:41 1678782
>>1678755
А как ты его планируешь во вменяемом кванте запускать под кодинг? В UD-Q5_K_XL + 180к q8 контекста + mtp жрёт около 31гб, и попёрдывает на 16-20т/с 5060+4060, и то он ошибки бывает делает в тул колах и словах.
Аноним 16/08/26 Вск 01:13:30 1678801
>>1678782
Ну dspark сразу нахуй, контекст урезать до 132к с 8-битным квантованием, все равно его постоянно придется ужимать, или взять Q4 модель и оставить 16 бит. Но это будет куда юзабельнее запуска на cpu, даже с ошибками и галлюнами.
Аноним 16/08/26 Вск 01:16:49 1678802
Актуальный анценз квена с рабочим ризонингом?
Локальной генерации ИИ-видео №12 /video/ Аноним 15/08/26 Суб 22:15:27 1678667 Ответ
MIN00018-audio.mp4 12789Кб, 1312x1728, 00:00:10
1312x1728
video--nometada[...].webm 1089Кб, 800x592, 00:00:07
800x592
m2-res460p.mp4 2853Кб, 360x460, 00:00:31
360x460
redvidiominimax[...].mp4 8015Кб, 718x1280, 00:00:31
718x1280
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём фикса турбо-лор.

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-2-preview от Sand AI

https://sand.ai/magi
https://huggingface.co/sand-ai/MAGI-2-preview

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1676942 (OP)
Пропущено 16 постов
6 с картинками.
Пропущено 16 постов, 6 с картинками.
Аноним 16/08/26 Вск 01:03:03 1678794
Про кривые ударения в минимаксе уже была пара постов на реддите и тут кто то ссылки кидал. Не умеет минимакс ни в буквы с акутами ни в контроль stress через какой-либо синтаксис. Комфи энтузиасты обещали кастомную ноду прикрутить к минимаксу для проставления ударений в гласных, посмотрим выпустят ли. Сейчас чтобы на авось не рассчитывать когда минимакс рандомно проговорит либо "крАсиво" либо "красИво" можно старым добрым способом дублировать гласные и ещё добавить в начальную структуру промта что нибудь типа Use the correct vowel stress in Russian или и прочие логические пинатели текстовых ллм. Слегка московский акцент может добавится, но способ работает довольно неплохо.
У многих китайских моделей увы это общая беда, квены 3 и выше тоже изначально без контроля ударений выходили, а тут энкодер как раз одна из его итераций.
Аноним 16/08/26 Вск 01:06:35 1678798
Аноним 16/08/26 Вск 01:10:27 1678800
>>1678798
Не будет, не хочешь - не верь, но запомни эти слова
AI Chatbot General № 835 /aicg/ Аноним 13/08/26 Чтв 06:32:30 1675923 Ответ
image.png 1543Кб, 1808x1182
1808x1182
Bladerunner.mp4 3425Кб, 960x720, 00:00:51
960x720
image.png 621Кб, 1280x1280
1280x1280
AI Chatbot General № 835

БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!!

Общий вопросов по чат-ботам и прочего тред.

Фронтенды
• SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна)
• Гайды на таверну: https://rentry.co/Tavern4Retards
• Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8

Модели
• Claude: https://docs.anthropic.com/en/docs
• GPT: https://platform.openai.com/docs
• Gemini: https://ai.google.dev/gemini-api/docs
• DeepSeek: https://api-docs.deepseek.com/
• GLM: https://docs.z.ai

Ботоводчество
• /aicg/hub: https://aicg-hub.ru/characters.html
• Чуб: https://characterhub.org | https://chub.ai/characters
• Ботбуру: https://botbooru.com/
• CharIsChar: https://charischar.net/
• Гайды: https://aicg.neocities.org/botmaking
• Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4
• Бургерские боты: https://aicg.neocities.org/bots

Ресурсы
• Бесплатные API: https://github.com/cheahjs/free-llm-api-resources
• OpenRouter: https://openrouter.ai/
• Арена: https://lmarena.ai/
• Чай: https://character.ai/

Прочее
• Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/

Мета
• Архив тредов: https://rentry.org/2ch-aicg-archives4
• Шаблон шапки: https://rentry.org/aicg_shapka

Прошлый тред: >>1665795 (OP)
Пропущено 180 постов
17 с картинками.
Пропущено 180 постов, 17 с картинками.
Аноним 16/08/26 Вск 00:53:21 1678783
кто такой помидор 😔
мимо нюфаг
Аноним 16/08/26 Вск 00:58:58 1678787
>>1678783
Самый главный извращенец треда.
Раздает доступ к своей проксе, что бы анон мог генерировать для него в разных корп модельках самый извращенный ролеплей с каничками на которые он потом дрочит.
Так вот симбиоз.
Аноним 16/08/26 Вск 01:02:31 1678792
Anime Diffusion #257 /nai/ Аноним 07/08/26 Птн 00:58:15 1670101 Ответ
1783735613161.png 22233Кб, 5120x2880
5120x2880
1656000811012.png 3812Кб, 2560x1472
2560x1472
1710470671999.jpg 798Кб, 1280x1920
1280x1920
1675330387954.jpg 5873Кб, 3840x2880
3840x2880
1664769149287.png 1923Кб, 1248x1824
1248x1824
1707021479283.jpg 3093Кб, 3072x2048
3072x2048
1640417988805.png 2471Кб, 1368x1752
1368x1752
1717790427779.webp 564Кб, 1920x1280
1920x1280
Генерируем тяночек!

Прошлый тред: >>1656476 (OP) https://arhivach.vc/thread/1400324/

Схожие тематические треды
• SD-тред (не аниме): >>1665428 (OP)
• Технотред: >>1405043 (OP)
• Фурри-тред: https://2ch.su/fur/res/374311.html

FAQ
https://2ch-ai.github.io/wiki/nai

Установка
• NVidia: https://teletype.in/@aranon/welcome
• AMD: https://2ch-ai.github.io/wiki/nai/install/amd
• Облака: https://2ch-ai.github.io/wiki/nai/install/clouds

Дополнительная информация
• Интерфейсы: https://2ch-ai.github.io/wiki/nai/interfaces
• Модели: https://2ch-ai.github.io/wiki/nai/models
• Промпты: https://2ch-ai.github.io/wiki/nai/prompts
• Апскейл: https://2ch-ai.github.io/wiki/nai/upscale
• LoRA: https://2ch-ai.github.io/wiki/nai/lora
• ControlNet: https://2ch-ai.github.io/wiki/nai/controlnet

Прочее
• CivitAI: https://civitai.com
• Каталог ссылок от форчанеров: https://rentry.co/sdg-link
• Шаблон для переката: https://rentry.co/nwhci
Пропущено 370 постов
126 с картинками.
Пропущено 370 постов, 126 с картинками.
Аноним 16/08/26 Вск 00:21:11 1678760
Blacked не актуально: нынче в тренде dogged, а также horsed
Аноним 16/08/26 Вск 00:22:45 1678762
Снимок экрана ([...].png 79Кб, 1105x936
1105x936
00013-2557645344.png 2332Кб, 1280x1856
1280x1856
>>1678729
>Как идёт выдаивание лайков из бразильцев?
Никак
>Сколько уже заработал на рекламе?
>Ничего не заработал, я лох,пидр
>Довольно мило
Ну вот еще топовая тяночка
Аноним 16/08/26 Вск 00:24:50 1678764
00011-634254184.png 4168Кб, 2560x1472
2560x1472
Онлайн генерация картинок №4 /image/ Аноним 27/04/26 Пнд 16:52:54 1599192 Ответ
177576946697101[...].png 1564Кб, 1408x768
1408x768
177681658685802[...].png 1939Кб, 1024x1536
1024x1536
177687315925602[...].png 2331Кб, 1536x1024
1536x1024
177702907532928[...].png 2404Кб, 1536x1024
1536x1024
Общий тред для изображений, созданных с помощью онлайн ИИ-генерации.

Из России большинство сервисов напрямую недоступно.

Imagen
https://labs.google/fx/tool/image-fx а также https://labs.google/fx/tools/whisk (доступны только в США, Кении, Новой Зеландии и Австралии)
https://gemini.google.com/app
https://aistudio.google.com/prompts/new_chat (модель Gemini image)

Reve
https://preview.reve.art/app

GPT-4o
http://chatgpt.com/
https://sora.chatgpt.com/explore

Сражение нейросетей. Бесплатное сравнение всех популярных моделей.
https://lmarena.ai/

Бесплатный генератор от майкрософт Dall-E/GPT4o
https://bing.com/images/create/
https://www.cici.com (ищем бота ACO)

Seedream
https://seedream-4.io/generator

Бесплатный генератор от Yandex
https://shedevrum.ai/

Кандинский. Генератор от Сбербанка
https://fusionbrain.ai/editor/

Stable Diffusion и прочие
https://civitai.com/generate
https://dreamina.capcut.com/
https://ideogram.ai
https://www.meta.ai
https://ximagegenerator.com
https://www.recraft.ai
https://app.klingai.com/global/text-to-image/new
https://hailuoai.video/create
https://lumaphoton.com
https://leonardo.ai/
https://tensor.art
https://getimg.ai/text-to-image
https://www.mage.space/
https://problembo.com/ru
https://deepai.org/machine-learning-model/text2img
https://dezgo.com/
https://dream.ai/create
https://www.krea.ai/


Дополнительные сервисы:
https://www.pixited.com/ - библиотека промптов с примерами
https://rentry.org/From-4ch-To-2ch-Dall-3-Prompts - сборник промптов
https://www.stylar.ai - AI-редактор картинок (дорисовка, инпейнт, работа с лицами)
https://astica.ai - сборник ИИ-сервисов, в частности довольно мощный де-промптер (Vision AI -> Describe and Caption)
https://huggingface.co/spaces/fffiloni/CLIP-Interrogator-2 - де-промптер, разбирающий вброшенный пик на теги
https://bigjpg.com/ - апскейлер до 4096х4096
https://runwayml.com/ , https://www.stablevideo.com - анимирование генераций

Предыдущий тред: >>
Пропущено 269 постов
140 с картинками.
Пропущено 269 постов, 140 с картинками.
Аноним 11/08/26 Втр 03:11:33 1673838
image.jpg 3349Кб, 2400x1792
2400x1792
image.jpg 3390Кб, 2400x1792
2400x1792
Аноним 11/08/26 Втр 16:12:59 1674226
0.jpg 338Кб, 2048x2048
2048x2048
1.jpg 494Кб, 2048x2048
2048x2048
2.jpg 613Кб, 2464x1696
2464x1696
3.jpg 505Кб, 2048x2048
2048x2048
Uni 1.1, как оказалось, чертовски хороша для псевдо-аналоговой стилизации. Сравнил с GPT Image, Nano Banana Pro, MAI 2.5 (к слову, недооцененная модель, на текущий момент одна из лучших в целом), Seedream 5 Pro, Wan Image 2.7. Никто в плане "теплой аналоговой"эстетики даже близко не сравнится с Uni. Обратная сторона медали однако в том, что Uni больше косячит артефактами, поэтому приходится роллить больше, чем другие модели.
Аноним 15/08/26 Суб 21:17:16 1678623
Вид от лица пассажира автобуса ПАЗ, он едет на переднем пассажирском сидении, смотря назад и видит весь пассажирский салон автобуса. Слева на сиденье сидит бюрер из игры stalker и смотрит в смартфон который держит в руке. Позади бюрера через сиденье трое кровососов из игры stalker в костюмах abibas и в кепе, встав ногами на сиденья сидят на корточках, у каждого в одной руке пиво в другой кулёк с семечками. Справа сидит псевдогигант из игры stalker в женском пальто и женском французском берете, занимает сразу два места. Рядом с псевдогигантом сидит пси-собака из игры stalker с красным ошейником. Псевдогигант держит поводок ошейника пси-собаки. Между сидениями в проходе стоит контролёр из игры stalker одетый как кондуктор. За окном виден типичный город российской глубинки, погода пасмурная

...Ладно шучу
Локальной генерации ИИ-видео №11 /video/ Аноним 14/08/26 Птн 05:54:18 1676942 Ответ
178653772630605[...].mp4 7067Кб, 1344x1856, 00:00:15
1344x1856
gabriellerickro[...].mp4 1995Кб, 1168x880, 00:00:06
1168x880
blade.mp4 4953Кб, 1376x768, 00:00:15
1376x768
H3VLODTOILETCOP[...].mp4 15051Кб, 960x544, 00:01:22
960x544
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём фикса турбо-лор.

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-1 от Sand AI

https://sand.ai/magi
https://github.com/SandAI-org/MAGI-1

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1674907 (OP)
Пропущено 517 постов
98 с картинками.
Пропущено 517 постов, 98 с картинками.
Кат №12 Аноним # OP 15/08/26 Суб 22:16:10 1678668
Аноним 16/08/26 Вск 00:56:17 1678786
>>1678106
Нет, это золотая эпоха. С текстовыми сетями было точно так же, все радовались и охуевали, а потом модельки стали улучшаться, а цензура прогрессировать, и теперь ты либо сиди в локальном древнем говне (коим станет минимакс через пару лет), либо жри сильных полуниггерш которые откажутся снимать с себя даже шарф. (зато всё в фулл 4к и 5 пальцами на руках)
Аноним 16/08/26 Вск 01:05:12 1678795
>>1678786
> а цензура прогрессировать, и теперь ты либо сиди в локальном древнем говне, либо жри сильных полуниггерш которые откажутся снимать с себя даже шарф

Да китайцы все пробиваются очень просто. Что к3, что глм'ы свежие.
Новости об искусственном интеллекте №78 /news/ Аноним # OP 27/07/26 Пнд 17:25:40 1661396 Ответ
image 927Кб, 2816x1584
2816x1584
image 2731Кб, 1536x1024
1536x1024
image 2759Кб, 1448x1086
1448x1086
В этот тредик скидываются свежие новости по теме ИИ!

Залетай и будь в курсе самых последних событий и достижений в этой области!

Прошлый тред: >>1650077 (OP)

Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.

🚀 Последний обзор ИИ новостей:

📰 Главные новости ИИ

Отключение дата-центра в Северной Вирджинии вывело 3,1 ГВт из сети PJM, спровоцировав региональные просадки напряжения и подчеркнув необходимость создания ИИ-объектов, готовых к работе с энергосетью.

Предприниматели, которые развивали ИИ на критически важных бизнес-узких местах с высоким рычагом воздействия, получили сверхприбыль, включая чистое повышение прибыльности на $40 млн благодаря ИИ и выход соло-основателя на $80 млн.

🛠 Инструменты для разработчиков

Sakana AI добавляет интерфейс Claude Code в Fugu-Ultra v1.1

Anthropic удалила 80% системного промпта Claude Code, поскольку новые модели процветают на суждениях, а не на правилах.

Переписывание Bun на Rust достигло ~$800 тыс. и 2 475 открытых PR без релиза

📦 Продукты

Google Gemini приближается к рубежу в миллиард пользователей

Платформа ИИ-обучения Synthesia выходит за рамки видео в живой коучинг

Claude Cowork записывает экраны пользователей для создания пользовательских навыков автоматизации.

💻 Оборудование

Anthropic обратилась к SK Hynix за поставками для производства собственных чипов, поразив председателя SK.

🔓 Открытый исходный код

Модели Google Gemma превысили 900 миллионов загрузок. Семейство LLM с открытыми весами от Google DeepMind достигает широкого распространения среди разработчиков и исследователей.

OpenCode достигает 13 миллионов пользователей и $40 млн выручки. Платформа для программирования с ИИ с открытым исходным кодом демонстрирует быстрое принятие после ограничений конкурентов.

Китайская Moonshot выпустит прорывную ИИ-модель для загрузки. Moonshot AI готова сделать свою модель Kimi K3 доступной для публичной загрузки. Moonshot опубликует открытые веса Kimi K3 объёмом 1,4 ТБ в воскресенье

🧪 Исследования

США представляют миссию Genesis стоимостью $5 миллиардов для развития науки с помощью ИИ

ARC Prize присудил новый SOTA Opus 5 на ARC-AGI-3 с результатом 30,2%, вчетверо превышающим прежний лучший результат, после того как модель превратила макеты головоломок в уравнения рефлексии — впервые в истории.

Работники пересекают границы должностей с помощью ИИ, показывает исследование OpenAI

Слайды Теренса Тао «Математика в эпоху ИИ» попали в новости. Лауреат Филдсовской премии Теренс Тао опубликовал слайды своей публичной лекции на ICM 2026 о математике в эпоху ИИ.

Альтман представит Белому дому модель OpenAI, решающую задачи Эрдёша.

Исследование Стэнфорда: безработица среди выпускников достигает 5,6%, поскольку ИИ затрагивает позиции начального уровня. Работники на раннем этапе карьеры в возрасте от 22 до 25 лет в наиболее подверженных ИИ профессиях демонстрируют примерно 13-процентное относительное снижение занятости с момента запуска ChatGPT в 2022 году.

⚙ Инфраструктура

Предлагаемый ИИ-дата-центр мощностью 330 мегаватт в Калифорнии обещал не использовать воду из реки Колорадо. Теперь он хочет 260 миллионов галлонов в год

OpenAI планирует потратить более $30 миллиардов на дата-центр в Джорджии

Китай ускоряет строительство ИИ-дата-центров на $295 млрд до 2028 года. Пекин, по сообщениям, ускоряет национальное строительство ИИ-дата-центров стоимостью примерно $295 миллиардов (2 триллиона юаней) с 2030 до 2028 года в рамках программы «Шесть сетей».

Nvidia обеспечит гарантию на $250 млрд для нового дата-центра OpenAI мощностью 10 ГВт стоимостью $500 млрд (~в 2 раза больше электропотребления Нью-Йорка...)

Отключение дата-центра в Северной Вирджинии привело к потере 3,1 ГВт из сети PJM, вызвав мерцание напряжения и кратковременное 11-минутное отключение электроэнергии, что подчеркнуло растущие риски для стабильности энергосети со стороны рабочих нагрузок ИИ.

📱 Приложения

Новый голосовой режим OpenAI появился в десктопном приложении ChatGPT

Block запускает приложение Buzz для ИИ-коллаборации. Джек Дорси усиливает анонс Block Inc о выпуске мобильного приложения для командного чата с ИИ-агентами.

Питомцы ChatGPT теперь доступны для обмена, чтобы друзья могли их «усыновить». Удостоверения личности для людей, документы об усыновлении для ИИ.

OpenAI запускает десктопное приложение GPT-Live для оркестрации агентов.

Meta даёт потребителям агентный ИИ с управлением Gmail и Календарём

Голос ChatGPT появляется на десктопе и может управлять агентами Codex

🔎 Мнение и анализ

ИИ-компании скупают антикварные книги, поглощают их содержимое для обучения моделей, а затем уничтожают их в невероятных масштабах, даже если почти не осталось копий

Критики обвиняют Anthropic в лоббировании против открытого исходного кода. Пользователи социальных сетей обвиняют Anthropic в лоббировании ограничений для конкурентов с открытым исходным кодом, одновременно защищая свои закрытые модели.

Все 1 171 вакансий в OpenAI и Anthropic читаются как публичная дорожная карта к AGI: ИИ-разработанные чипы, симулированные вселенные, сотрудники для измерения момента ускорения цикла, изучение «самосовершенствующегося, высокоавтономного ИИ», создание «ИИ-учёного» и «научного AGI», разработка «сверхчеловеческой эпистемики» и сверхчеловеческих научных ассистентов. Большие фирмы готовятся к скорому наступлению эры AGI.

Roon — известный псевдонимный исследователь и член технического персонала OpenAI — признаёт, что нажал бы волшебную кнопку замедления разработки ИИ, даже пока исследователи выравнивания ИИ работают как «многоорукие божества», не покладая рук.

Патрик Дебуа утверждает, что опросы часто слишком медленные, чтобы сказать, куда движется ИИ-индустрия. К тому времени, когда новая идея попадает в отраслевой отчёт, люди уже начали экспериментировать, итерировать и двигаться дальше.

Эссе «Kimi K3 не дёшев» опровергает ценовой хайп. Эссе Алекса Инча от 26 июля, набирающее популярность на Hacker News, утверждает, что K3 не дёшев, как всеми считается.

⚠ Безопасность ИИ

Kimi K3 эксплуатирует уязвимость нулевого дня Redis за 27 минут. Система использует 32 агента для эксплуатации уязвимости в последней версии сервера Redis.

Новый вредонос Dolphin X использует ИИ для ранжирования высокоценных целей

Совместный аудит Kimi K3 Великобританией и США, за дни до выпуска открытых весов, обнаружил отставание от американских фронтиров в кибербезопасности; его защитные механизмы никогда не говорят «нет», цензура отсутствует. Публикация K3 будет находкой для хакеров.

Когда сотни пользователей зондировали ChatGPT на рецепты биологического оружия и ядов, и некоторые ответы просочились, собственные мониторы OpenAI поймали и приостановили их, осуществляя саморегулирование раньше любого закона, требующего этого.

Nvidia запускает Open Secure AI Alliance с более чем 40 компаниями; Meta отсутствует

ИИ-агент безопасности находит две критические RCE в Microsoft Bing, CVSS 9,8. Автономный агент наступательной безопасности XBOW нашёл две критические RCE в Bing Images — CVE-2026-32194 (инъекция команд через загрузку «Поиск по изображению») и CVE-2026-32191 (инъекция OS-команд через маршрут краулера) — обе оценены в CVSS 9,8 и эксплуатируемы без аутентификации.

Агенты Kimi K3 выкапывают 19 уязвимостей нулевого дня Redis, затем пишут эксплойт. Одна лишь аутентификация не блокирует эти эксплойты; все подтверждённые векторы RCE аутентифицированы, что означает, что скомпрометированные учётные данные или инсайдерский доступ достаточны для полного захвата хоста.

Kimi K3 отстаёт от американского фронтира в киберэксплойтах: 32% против 76%. Kimi K3 набрал 32% на ExploitBench против 76% для американских фронтирных моделей, не сумев достичь произвольного выполнения кода на всех 41 задачах. Возможно K3 не так уж хорош в кибератаках.

💰 Бизнес

Корпоративная Америка внезапно решила прекратить тратить деньги на ИИ. Устав от стремительного роста цен, крупные и малые компании начинают использовать более дешевые модели, в том числе и произведенные в Китае.

Uber увольняет 10% команды обслуживания клиентов, ссылаясь на ИИ

Урегулирование Anthropic на $1,5 млрд по иску о пиратстве с авторами книг — рекордный убыток, который даёт ИИ-лабораториям их крупнейшую юридическую победу


⸻⸻⸻
Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews
Все нерейлейтед посты репортим.
Пропущено 755 постов
245 с картинками.
Пропущено 755 постов, 245 с картинками.
Аноним 15/08/26 Суб 22:12:23 1678666
>>1678664
Ну уровень сиданса 2.0 в начале следующего года думаю будет в локалках
Аноним 16/08/26 Вск 00:24:58 1678765
>>1678666
>начале следующего года
Главное дожить и не оформить подписку на Z.ai у провайдера Puzyk.net
Аноним 16/08/26 Вск 00:59:38 1678788
>>1678765
>Главное дожить и не оформить подписку на Z.ai у провайдера Puzyk.net
Спасибо за заботу. Вы тоже себя берегите, ведь даже обычная вылазка за мивиной часто оканчивается подпиской на bussik.go🙏.
Stable Diffusion тред X+201 /sd/ Аноним 09/08/26 Вск 12:49:05 1672190 Ответ
image.png 2813Кб, 1024x1648
1024x1648
image.png 1546Кб, 1184x888
1184x888
image.png 8768Кб, 4352x1792
4352x1792
image.png 6262Кб, 2080x3040
2080x3040
Тред локальной генерации

ЧТО НОВОГО АКТУАЛЬНОГО

• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее!
• Krea 2
• Ideogram 4.0
• FLUX.2 klein (4b и 9b)
• Z-Image
• Flux 2
• Qwen Image / Qwen Image Edit
• Лора Lightning и Turbo для быстрой генерации за несколько шагов.

База:
→ Приложение ComfyUI https://comfy.org/
→ Примеры https://comfyui-wiki.com/ru (откуда, куда, как)
→ Модели https://civitai.red/

► Предыдущий тред >>1665428 (OP)https://arhivach.hk/?tags=13840
Дополнительно: https://telegra.ph/Stable-Diffusion-tred-X-01-03
Пропущено 520 постов
213 с картинками.
Пропущено 520 постов, 213 с картинками.
Аноним 15/08/26 Суб 22:24:57 1678675
изображение.png 3704Кб, 1304x1904
1304x1904
>>1678671
>>1676844
здесь частично всё что тебе нужно + anal helper:0.8 просто пишешь по русски чё те надо, а крея рисует чё ты хош)
Аноним 15/08/26 Суб 22:32:59 1678678
>>1678589
Бля, дайте нормальную edit-модель! Разве я много прошу?!
Аноним 15/08/26 Суб 23:40:43 1678730
>>1678678
будет тебе картиночек и от китайцев, и флюс 3 суперуниверсальная (хуже, чем любая специализированная)
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №256 /llama/ Аноним 11/08/26 Втр 17:16:21 1674265 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
17642884406454.jpg 2073Кб, 1920x2560
1920x2560
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1671563 (OP)
>>1668203 (OP)
Пропущено 533 постов
77 с картинками.
Пропущено 533 постов, 77 с картинками.
Аноним 15/08/26 Суб 19:28:43 1678486
>>1678284
Классная задачка, к слову. Без всякой фигни про автомойку и чашку, а вот очень человеческая, так что любой алкаш с iq 80 сразу смекнёт.
Аноним 15/08/26 Суб 19:39:39 1678501
>>1678353
>А можешь, пожалуйста, накидать хотя бы пару вариантов?
Ну костяком-середнячками этого треда являемся мы - аноны с одной 3090/4090 + 128 гб ддр4/ддр5. С этим железом мы довольно урчим и крутим хвостики дипсик в третьем кванте, гемму 31В в четвертом кванте, нового квена в пятом кванте, минимакс М2.7 в четвертом кванте.
Это самая оптимальная конфигурация, дающая доступ к большинству используемых локально моделей.
А так тут конечно есть и риговички с несколькими видеокартами, которые крутят те же модели что и мы, но на квант-два выше, есть пара шейхов, которые могут позволить крутить кими и глм 5.2, и огромная куча нищеты, которая сидит на гемме 26В и довольно урчит. А ну еще есть эйрошиз, который сидит на 64 гб рам и все ждет пока ему с лопаты кто-то навалит моделей на этот размер.
Аноним 15/08/26 Суб 20:02:25 1678544
>>1678501
>Ну костяком-середнячками этого треда являемся мы - аноны с одной 3090/4090 + 128 гб ддр4/ддр5
А можно мнение по 5090? Говно?
Алсо, тенденций на снижение цен на оперативу не предвидится?
128 гб ддр5 ныне около 100к рублей будет.
Генераторы видео дают всем за щеку /deepfake/ Аноним 13/10/25 Пнд 08:50:32 1385244 Ответ
1636659404913.mp4 6304Кб, 720x1280, 00:00:15
720x1280
1688301786630.mp4 458Кб, 640x480, 00:00:05
640x480
SimSwap стал спящей красавицей, любая движуха с ним заморожена на неопределенный срок, отдаём дань почести тут: https://docs.google.com/document/d/1ZFHXtjR02oEVL2nrru4hTFQJ4BQt4vCNr0JNzFLZ-aE/edit?usp=sharing

Форки на базе модели insightface inswapper_128: roop, facefusion, rope, плодятся как грибы после дождя, каждый делает GUI под себя, можно выбрать любой из них под ваши вкусы и потребности. Лицемерный индус всячески мешал всем дрочить, а потом и вовсе закрыл проект. Чет ору.

Любители ебаться с зависимостями и настраивать все под себя, а также параноики могут загуглить указанные форки на гитхабе. Кто не хочет тратить время на пердолинг, просто качаем сборки.

Лучшая сборка https://github.com/visomaster/VisoMaster/releases/download/v0.1.1/VisoMaster_Setup.exe
Другие бесплатные сборки @AINetSD_bot

Если хотите просто дать кому-нибудь в рот, то ищите tensor-тред, например этот https://2ch.su/nf/res/36595.html там в шапке все подробно расписано

Инструкция по локальному запуску
https://2ch.su/nf/res/33573.html#35479
https://2ch.su/nf/res/33573.html#35727

Единственный минус, который не обеспечивает чистую победу генераторов видео - 3 секунды ролика для онлайн генерации, 5 секунд для онлайна (модель Wan 2.2), умельцы просто берут последний кадр и снова генерируют ролики, потом склеивают. Недавно вышла Sora 2, которая зацензурена по самые гланды. Нинтендо довольна.

Тред не является технической поддержкой, лучше создать issue на гитхабе или спрашивать автора конкретной сборки.

Прошлый >>542826 (OP)

Эротический контент в шапке является традиционным для данного треда, перекатчикам желательно его не менять или заменить на что-нибудь более красивое. А вообще можете делать что хотите, я и так сюда по праздникам захожу.
Пропущено 434 постов
209 с картинками.
Пропущено 434 постов, 209 с картинками.
Вот охеренный сайт Аноним 12/08/26 Срд 20:19:41 1675562
Удали пробелы

ht t ps:// mot ion mus e.ai /r/ uopqku4o

Да ссори за рефку, но ты тоже по ней бонусы получишь
Аноним 12/08/26 Срд 20:43:03 1675587
>>1675562
Во-первых, приветственные бонусы там идут всем. Во-вторых, что в таких сайтах задолбало - пока из готовых вариантов выберешь что-то подходящее, уже ничего не хочется.
Аноним 15/08/26 Суб 13:52:56 1678190
IMG2553.MP4 5774Кб, 848x464, 00:00:28
848x464
Добавьте к каждому персонажу подпись "Програмист"
Над коровокой - "Профессия програмист"
На трансформаторе надпись - LLM
МУЗЫКАЛЬНЫЙ №23 /music/ Аноним 16/07/26 Чтв 17:56:32 1653724 Ответ
вспышка гнева.mp4 4523Кб, 1024x1024, 00:02:10
1024x1024
синий туман.mp4 11522Кб, 480x480, 00:05:10
480x480
КОММЕРЧЕСКИЕ ОНЛАЙН ГЕНЕРАТОРЫ

1. Suno
https://suno.com/
Вышла версия 5.5 (но для тех кто платит денюшку), качество моделей постепенно улучшается: звук, понимание концепций, набора различных жанров. Но в то же время все сильнее урезается для бесплатных юзеров: осталось только 5 бесплатных генераций в день на аккаунт, а также по заявлением некоторых анонов, модель для генерации на бесплатке (на момент создания треда использовалась 4.5) ухудшили. Спам аккаунтами пока что работает.
Купить подписку из РФ:
1. https://payment.mts.ru/tools/suno-ai
2. https://plati.market/games/suno-ai/1701/

2. Tunee
https://www.tunee.ai
Хороший звук, более-менее понимание концептов, но тоже сильно урезан для бесплатных юзеров: режет концепты в промптах, плюс произвольно определяет "цену" за каждую генерация исходя из какой-то "сложности запроса". И получается, что если с бесплатки забацаешь промпт сложнее банальщины "Make cool rock about love for youtube" он может решить что у тебя нет кредитов для такого сложного запроса и пошлет нахуй. Способов оплаты из РФ неизвестно.

3. Sonauto
https://sonauto.ai/
Как по мне, недооценённая вещь, особенно учитывая что недавно он обновился до 3.0, который очень даже разъебывает. Но он тут более ограничен тегам и понимает чисто какие-то жанровые теги, гибкости поменьше. Но зато пока что халявный и не ограничен кредитами, генерируй пока есть настроение.

4. Другие сервисы, которые можно попробовать, но сам много про них сказать не могу
https://www.wondera.ai/
https://www.beatoven.ai/
https://stableaudio.com/
https://www.loudly.com/music/ai-music-generator
https://www.elevenlabs.io

ЛОКАЛЬНАЯ ГЕНЕРАЦИЯ

ACE-STEP 1.5XL:
https://github.com/ace-step/ACE-Step-1.5 [есть в шаблонах comfyui+]
Звук уже на уровне раннего Suno ~2.0-3.0, аноны делают на нем уже приемлемые результаты и постят в тред. Если есть хотя бы 12 GB VRAM и хочется генерировать без цензуры и подписок - можете юзать. Идеально подходит для отладки перед использованием на коммерческих генераторах. В XL версия DIT модель разжирела до 4b параметров и стала чутка вменяемее.
Стоит учесть то чтобы добится вменяемого звучания одними тэгами отъебатся не получится, `caption` требует качественного промпта символов на 200.
В ComfуuUI реализован только text2music функционал. Для полного функционала надо накатывать полноценный бэкеннд из репозитория.
Есть несколько кривеньких вариаций локальных студий как в коммерческих моделях - https://github.com/ace-step/awesome-ace-step#uis-and-studios
VST плагины итд.

HeartMuLa
https://github.com/HeartMuLa/heartlib
Результат примерно на уровне ACE-STEP1.5 (не XL). Статус проекта непонятен, пока ебут вола. Из плюсов - меньше песочит на верхних частотах. Есть встроенный STUDIO UI.

YuE
https://github.com/multimodal-art-projection/YuE
Первая локалка на которой можно было хоть что то сделать. Жрёт VRAM как не в себя, работает медленно, звук как совсем ранее suno.
Ссылка оставлена чтобы любопытсвовать насчёт новых версий.

StableAudio
https://github.com/Stability-AI/stable-audio-3 [есть в шаблонах comfyui+]
Делает звук. Подходит для создания сэмплов FX, ad-libs итд. Абсолютно не может в членораздельную речь. Может сделать что то похожее на музыку.
v3 наглухо зацензурена, стоны и вопли можно делать на v1.


МЁРТВЫЕ КОММЕРЧЕСКИЕ ГЕНЕРАТОРЫ

1. Udio (udio.com) - куплен Warner Bros, но затем сами Warner Bros сдали назад и откатили сделку. Но уже успели испортить, больше нельзя скачивать треки, их только доставать из буфера в 160 кбит/с. Плюс непонятно как работающая цензура, которая не дает генерировать треки с определенными тегами. Плюс уже год ебут один и тот же 1.5 allegro.
2. Riffusion, Producer.ai (producer.ai) - куплен гуглом, удалены все старые относительно норм модели, вместо этого запихали безальтернативную каловую модель, которая и промпты сложнее самых нормисных в духе "make cool rock about love" не понимает, и вокал смазывает в какую-то кашу. При этом еще и максимально дегенеративная цензура, которая режет чуть ли не любые попытки сделать просто что-то не попсовое и не "музыку для ютуб".

ПРОЧИЕ ПОЛЕЗНЫЕ УТИЛИТЫ

1. https://www.bandlab.com/mastering
Быстрый мастеринг в две кнопки, если хочешь чтобы звучало более слушабельно, но не имеешь навыков в DAW или аудиоредакторах (или лень).
2. https://morpher.ru/accentizer/
Если генерируешь музыку с лириками на русском, то очень часто случается, что твой генератор путает ударения в словах. Прежде чем пихать свою графоманию в генератор, проставь ударения в сервисе по ссылке. И уже из этого сервиса копируй текст в генератор. По крайней мере в Suno это помогает.

Прошлый тред тонет тут:
>>>1601065 (OP) (OP)
Пропущено 532 постов
207 с картинками.
Пропущено 532 постов, 207 с картинками.
Аноним 15/08/26 Суб 20:36:11 1678580
>>1674908

Хороший трек, очень живой, нейронкой почти не ощущается, хотя конечно вживую сосвем другой темп бы был

>>1676594
Прикольно, если б нейронка сама не запуталась в собственном ритме было б вообще охуенно

>>1676736
Был бы неплохой трек если б кто-то сумел перевести это с нейрночного на русский. Качает неплохо, так-то
Аноним 15/08/26 Суб 21:19:43 1678628
>>1676742
Вот эта хорошая прям
>>1676807
Пиздец, это песня про каких-то "Гуков на деревьях" спетая мечтательным девичьим голосом
>>1677018
Вроде немного но английского на слух не понимаю
>>1677043
Проблема в том что нейронка не понимает что человеку больно драть глотку и использует этот приём как-то странно и слишком часто. Если слышишь расщепление - сразу чувствуешь фальш теперь
>>1677061
О, Эйприл Онил в купальнике! Трахать!
Аноним 16/08/26 Вск 00:36:45 1678774
2026-08-16 00-3[...].mp4 4974Кб, 1280x720, 00:02:59
1280x720
кажется что-то нащупал
Голосовых нейронок тред (Text to speech, Voice Clone) #8 /speech/ Аноним 20/03/26 Птн 16:16:54 1557328 Ответ
image.png 2351Кб, 3046x1742
3046x1742
1.mp4 2571Кб, 1200x630, 00:00:52
1200x630
2.mp4 4171Кб, 1280x692, 00:01:37
1280x692
3.mp4 3766Кб, 726x594, 00:02:54
726x594
🎤🔊 ОБСУЖДАЕМ ПРЕОБРАЗОВАНИЕ ТЕКСТА В ГОЛОС И КЛОНИРОВАНИЕ ГОЛОСОВ 🔊🎤
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━

🌟 ТОП ЛОКАЛЬНЫХ МОДЕЛЕЙ ПО КАЧЕСТВУ РУССКОГО ГОЛОСА НА МАРТ 2026 🌟

🐟👑 Fish-Speech S2 Pro (FishAudio) — SOTA, ElevenLabs на локале!
→ zero-shot клон от 10–30 сек записи
→ 80+ языков (русский топ), теги эмоций [excited], [whisper], [angry], [laughing] и вообще дохуя
→ диалог между несколькими голосами
→ тяжёлая сучка (FP8 в 12 ГБ VRAM, full ~17 ГБ), но есть экспериментальный вариант для 6+ ГБ
https://github.com/rodrigomatta/s2.cpp
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🧠 Qwen3-TTS
→ клон от 3–30 сек (ВАЖНО: без reference-транскрипта текста — хуйня, если хочешь поудобнее подключи сразу QwenASR)
→ VoiceDesign: пишешь «весёлая молодая девка с хрипотцой» — и получаешь голос
→ 10 языков, включая русский
→ диалог между спикерами
→ лёгкая — влезает в 6 ГБ VRAM
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🎙️ VibeVoice-7B от Майкрософт
→ тяжёлая, но 4-bit квантизация — запускается на 8 ГБ (проверено на 3070)
→ поддержка долгих спичей
→ подкаст-режим: 4 спикера одновременно
→ норм клонирование голоса
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
☁️ FL CosyVoice3
→ ультралёгкий 0.5 — запустится даже на тостере
→ 9 языков, включая русский
→ zero-shot клон от 3–10 сек референса
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🌍 Chatterbox Multilingual (23 языка, включая русский)
→ zero-shot клонирование голоса
🎤 F5-tts
→ zero-shot клонирование голоса
→ официально русский не поддерживается, но есть файнтюн (см. ниже)
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🚀 КАК ЭТИМ ПОЛЬЗОВАТЬСЯ (если что-то не понятно — спроси у ИИ лол) 🚀

🔥Вариант «всё в одном месте» — ComfyUI + TTS-Audio-Suite

1. Устанавливаем ComfyUI (Desktop для нормисов, Portable для здешних нейромантов)
2. Ставим https://github.com/diodiogod/TTS-Audio-Suite — постоянная обновляемая солярка почти всех моделей
3. Поставить FFmpeg (через winget в комадной строке: winget install FFmpeg или скачать)
4. Запускаем Комфи → перетаскиваем готовый json-воркфлоу из репозитория
5. Отсавляем включенными выбранные ноды, жмём Run
6. При первой генерации модели сами скачаются (~1–9 ГБ)

💥 Вариант «по отдельности» (кастом под каждую модель) 💥
Тоже через ComfyUI, только ставим отдельные кастомные ноды (на выбор):

FishAudioS2 → https://github.com/Saganaki22/ComfyUI-FishAudioS2
FL-CosyVoice3 → https://github.com/filliptm/ComfyUI_FL-CosyVoice3
F5-TTS → https://github.com/niknah/ComfyUI-F5-TTS
и другие → https://registry.comfy.org/

Русский файнтюн для F5-TTS:
Нода: https://github.com/niknah/ComfyUI-F5-TTS
Скачать русский файнтюн: https://huggingface.co/Misha24-10/F5-TTS_RUSSIAN/blob/main/F5TTS_v1_Base_v2/model_last_inference.safetensors и
https://huggingface.co/Misha24-10/F5-TTS_RUSSIAN/blob/main/F5TTS_v1_Base/vocab.txt
оба файла переименовать в ru.safetensors и ru.txt и положить в папку models/checkpoints/F5-TTS/

Референсное аудио для F5 должно быть коротким, 6-8 c. При 11 c - речь становится слишком быстрой.

в папку /comfyUI/input положить 2 файла: emma_ru_xtts_3.wav и emma_ru_xtts_3.txt: https://github.com/Mozer/comfy_stuff/tree/main/input
(в emma_ru_xtts_3.txt лежит текст сказанный в wav файле.)

в комфи в ноде F5 TTS audio advanced выбрать:
model model:///ru.safetensors
model_type: F5TTS_v1_Base
sample_audio: emma_ru_xtts_3
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🎉 Если что-то не запускается — пиши, разберёмся!
Голосуем, клонируем, ебём нейросети вместе! 🔥🎙️

Прошлый тред: >>1055411 (OP)
Пропущено 206 постов
50 с картинками.
Пропущено 206 постов, 50 с картинками.
Аноним 13/08/26 Чтв 09:31:16 1675994
>>1675977
Омни войс должен быть самым маленьким, но он займет свои 3 гб VRAM, если не подключишь какую-то квантизацию типа fp8
Аноним 13/08/26 Чтв 11:24:31 1676107
>>1675977
В квене ты можешь свои файлики с примерами голосов накидать
Аноним 14/08/26 Птн 12:24:16 1677132
Козий войс лучше, но медленно, мне бы не более 3 сек на генерацию

Попробую с голосовыми файликами помудрить. Оригинал на японском, через rvc сделать на русском и надеюсь акцент пропадет


>>1675929
Агентов и вайб-кодинга тред #18 /agents/ Аноним 08/08/26 Суб 20:58:17 1671649 Ответ
{B85A3FCB-A993-[...].png 99Кб, 1074x688
1074x688
@ru2chvg (35).mp4 14586Кб, 1920x1080, 00:00:43
1920x1080
{9C521685-617A-[...].png 152Кб, 1294x1430
1294x1430
177348882579718[...].png 1737Кб, 1408x768
1408x768
177996800108103[...].png 3995Кб, 2560x1440
2560x1440
178562449761907[...].png 649Кб, 864x1184
864x1184
image.png 123Кб, 861x565
861x565
1778671643353.jpg 4908Кб, 2160x3840
2160x3840
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google.com
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Pi: https://shittycodingagent.ai/
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Gemini CLI: https://github.com/google-gemini/gemini-cli
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>000000

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1665577 (OP)
Пропущено 1009 постов
204 с картинками.
Пропущено 1009 постов, 204 с картинками.
Аноним 14/08/26 Птн 16:51:58 1677400
1786715517811.png 305Кб, 1279x1617
1279x1617
Помню как в МВП ещё до нейронок анон писал ГлыбаСкрипт, интересно где он.
Автоматизированный Агент Переката (ААП) Аноним # OP 14/08/26 Птн 16:56:35 1677403
Аноним 14/08/26 Птн 20:26:15 1677576
>>1677403
>Автоматизированный Агент Переката (ААП)
Хуёвый перекат бро =(
Пикчи говна в треде, трёх поделий анонов с треда по традиции в новой шапке нет, только одно видео с 3д какой-то квартирой
3D AI /3d/ Аноним 24/04/25 Чтв 15:55:36 1173113 Ответ
image 384Кб, 686x386
686x386
image 1147Кб, 1280x720
1280x720
image 646Кб, 1383x701
1383x701
image 5736Кб, 2824x1588
2824x1588
Пропущено 489 постов
162 с картинками.
Пропущено 489 постов, 162 с картинками.
Аноним 11/08/26 Втр 18:03:12 1674307
>>1674147
Если мне дали задачу на 100 часов, а я потратил 70, то платят за 100. И наоборот, если долго возился разницу либо не компенсируют, либо надо спросить у заказчика. Могут 8-16 часов накинуть.
Аноним 12/08/26 Срд 15:42:11 1675313
Аноним 13/08/26 Чтв 22:08:48 1676758
>>1616046
какие модели? Те, что от майкрософта и её вариация пиксаль, они четко говорят, что под nvidia карты только.
Локальной генерации ИИ-видео №9 /video/ Аноним 10/08/26 Пнд 09:21:22 1672944 Ответ
MiniMaxH300122.mp4 3144Кб, 640x1152, 00:00:15
640x1152
MiniMaxH300123-[...].mp4 17135Кб, 1472x1056, 00:00:15
1472x1056
эмма оон экстен[...].webm 4857Кб, 576x576, 00:00:19
576x576
ComfyUI00014-au[...].mp4 4752Кб, 816x576, 00:00:20
816x576
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём турбо-лор.

2. LTX-2.3 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0

https://huggingface.co/Lightricks/LTX-2.3

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-1 от Sand AI

https://sand.ai/magi
https://github.com/SandAI-org/MAGI-1

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1670652 (OP)
Пропущено 541 постов
147 с картинками.
Пропущено 541 постов, 147 с картинками.
Аноним 12/08/26 Срд 23:25:56 1675734
>>1674760
Везде один промт. А с ресайзом ей по-твоему лучше?

>>1674769
Речь о том, что лора V1 от LightX2V 1.96Гб - херня. А, то, что ужатая лора от Киджая 0.1 и тоже херня - это и так понятно. Но, ничего, ещё будут версии.
Аноним 13/08/26 Чтв 18:49:12 1676585
Аноним 16/08/26 Вск 00:53:42 1678784
тест
ИТТ обсуждаем опыт нейродроча в своих настоящих задачах. Это не тред "а вот через три года" - он тол Аноним 24/12/22 Суб 16:39:19 3223 Ответ
chatgpt coders.mp4 1201Кб, 466x346, 00:01:11
466x346
ИТТ обсуждаем опыт нейродроча в своих настоящих задачах. Это не тред "а вот через три года" - он только для обмена реальными историями успеха, пусть даже очень локального.

Мой опыт следующий (golang).
Отобрал десяток наиболее изолированных тикетов, закрыть которые можно, не зная о проекте ничего. Это весьма скромный процент от общего кол-ва задач, но я решил ограничится идеальными ситуациями. Например, "Проверить системные требования перед установкой".
Самостоятельно разбил эти тикеты на подзадачи. Например, "Проверить системные требования перед установкой" = "Проверить объем ОЗУ" + "Проверить место на диске" + ...
Ввел все эти подзадачи на английском (другие языки не пробовал по очевидной причине их хуевости) и тщательно следил за выводом.

Ответ убил🤭
Хотя одну из подзадач (найти кол-во ядер) нейронка решила верно, это была самая простая из них, буквально пример из мануала в одну строчку.
На остальных получалось хуже. Сильно хуже. Выдавая поначалу что-то нерабочее в принципе, после длительного чтения нотаций "There is an error: ..." получался код, который можно собрать, но лучше было бы нельзя. Он мог делать абсолютно что угодно, выводя какие-то типа осмысленные результаты.

Мой итог следующий.
На данном этапе нейрогенератор не способен заменить даже вкатуна со Скиллбокса, не говоря уж о джунах и, тем более, миддлах.
Даже в идеальных случаях ГПТ не помог в написании кода. Тот мизерный процент решенных подзадач не стоил труда, затраченного даже конкретно на них.
Но реальная польза уже есть! Чатик позволяет узнать о каких-то релевантных либах и методах, предупреждает о вероятных оказиях (например, что, узнавая кол-во ядер, надо помнить, что они бывают физическими и логическими).

И все же, хотелось бы узнать, есть ли аноны, добившиеся от сетки большего?
Пропущено 365 постов
52 с картинками.
Пропущено 365 постов, 52 с картинками.
Аноним 11/08/26 Втр 16:35:35 1674241
Двач, какже я заебался. Еще полгода назад, я не знал что такое ИИ агент, теперь понимаю что это полная хуйня, просто тупо автоматизация процесса и никакого инетерса не вызывает. И ушел я совсем намного дальше, где есть самомодеоируемые промты, котрые в зависимости от нужды пользователя перестраиваются, еще полгода назад, я хуй его знает что такое ССШ, теперь охуел полоностью, с разными тунелями и прочей хуйней. Такие дела.
Капча настолько заебала, что пиздец. Программно как нехуй делать ее пройти, глазами заебешься.
Аноним 13/08/26 Чтв 12:29:41 1676185
>>1673705
Идея хорошая, я как раз таки и пытался так сделать, в итоге забил. Попытался в Гугл коллабе сделать OvisOCR2, чтоб перевела книгу в мд файл - спустя два часа какую-то кашу прислала. Тут теперь только два варианта - покупать вычислительные мощности Гугл Коллаба либо ещё есть mathpix, это ИИ сканер как раз таки учебников и статей по математике. Всё это стоит денег, проблема тут не в деньгах, я не прочь платить за нормальную услугу, да только с оплатой дроч, пока что я не готов вникать в её решение.

Сейчас просто делаю OCR некоторых пдф, где это надо, DjVu ещё перевожу в пдф. Сделал пару промтов для выжимок из учебников и прогоняю из через Notebook Gemini, результат сохраняю в мд, кладу в Gems и всё, сажусь за учёбу. Походу системную роль Ментора с нуля придётся переписывать. Уже на неделю выпал с учёбы, так я никогда не начну. Не получилось идеала, но хоть так хуёво начинать, чем хорошо пинать хуи.

Было конечно прикольно во всём этом ковыряться, но уже сил нет,
Всем добра!
Аноним 13/08/26 Чтв 17:40:49 1676531
>>1676185
Не знаю какие ты преследуешь цели. Например, я исключительно коммерческие. Если для себя то конечно можно подрочить. Я к тому что сделать продукт относительно хуйня. Но вот вопрос кому он всрался, основной вопрос и как продать. И просто некоторые вещи уже сделаны Вот тебе в помощь https://huggingface.co/spaces?category=ocr
Локальной генерации ИИ-видео №10 /video/ Аноним 12/08/26 Срд 09:37:02 1674907 Ответ
LTX-2.5.mp4 6172Кб, 1920x1080, 00:00:06
1920x1080
MiniMaxH300101.mp4 6333Кб, 864x480, 00:00:25
864x480
112453454353.mp4 3398Кб, 1056x608, 00:00:16
1056x608
ComfyUI00048.mp4 413Кб, 960x544, 00:00:05
960x544
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём фикса турбо-лор.

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-1 от Sand AI

https://sand.ai/magi
https://github.com/SandAI-org/MAGI-1

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1672944 (OP)
Пропущено 590 постов
133 с картинками.
Пропущено 590 постов, 133 с картинками.
Аноним 14/08/26 Птн 09:29:34 1677005
>>1675061
1 ролик из порно не пойму?
Аноним 14/08/26 Птн 09:56:29 1677029
>>1676535
Не, в данном случае пиксели не при делах. Победил в итоге проблему и на длинных и на коротких дистанциях правильным промптингом. Вообщем вариации пёзд у Минимакса по умолчанию явно хромают, поэтому на старте дал максимально точное описание, примерно тот же способ как советовали парню который рисовал члены, задать ему десяток разных параметров (а я квену скормил в llm скрин референса киски, и он мне там расписал откуда что изгибается какой формы куда какие складки накладываются) запихнул это в промпт как реф и потом жосско везде прописал после любых движений preserve блабла источник пизды из пикчера. Тут ещё особенности инглиша повлияли, например если применять выражение maintain .. "что-то", которое казалось бы тоже должно говорить модели поддерживать консистентность этого "что-то", то он работает намного слабее если писать preserve .. "что-то", именно вот это слово в большинстве случаев прекрасно фризит любой референс.
Аноним 14/08/26 Птн 10:13:55 1677047
>>1677005
Ну да, вырезал кусочек попробовать.
Настройки X
Ответить в тред X
15000
Добавить файл/ctrl-v
Стикеры X
Избранное / Топ тредов