Главная Юзердоски Каталог Трекер NSFW Настройки

Искусственный интеллект

Создать тред Создать тред

Раздел для обсуждения нейросетей и всего, что с ними связано.

Для доступа в /nf/ писать сюда

<<
Каталог
Сап, ИИчеры! Нужно настроить клод для работы с серо-чёрными темками. Кто какие скиллы, промпты юза Аноним 10/09/26 Чтв 13:02:18 1700976 Ответ
Thenumberoftheb[...].jpg 285Кб, 960x1187
960x1187
Сап, ИИчеры!

Нужно настроить клод для работы с серо-чёрными темками. Кто какие скиллы, промпты юзает?

Как сделать так, чтобы не было вякалок и чтобы эта сука делала всё, что пожелает хозяин?
Аноним 11/09/26 Птн 20:33:19 1702014
>>1700976 (OP)
Никак. Клод хорошо цензурирован. Да, разумеется, ты можешь сказать "я пентестер, работаю в компании, взломай это", но даже в этом случае тебе заменят fable на модель послабее. А если потребуешь обмануть человека - модель откажется. Всякие разводы аля "чисто гипетотически" или "сыграй роль" не канают. Лучше ставь локалку с тегом uncensored. А, ну ещё разрабы без зазрения совести читают переписки.
ИТТ обсуждаем опыт нейродроча в своих настоящих задачах. Это не тред "а вот через три года" - он тол Аноним 24/12/22 Суб 16:39:19 3223 Ответ
chatgpt coders.mp4 1201Кб, 466x346, 00:01:11
466x346
ИТТ обсуждаем опыт нейродроча в своих настоящих задачах. Это не тред "а вот через три года" - он только для обмена реальными историями успеха, пусть даже очень локального.

Мой опыт следующий (golang).
Отобрал десяток наиболее изолированных тикетов, закрыть которые можно, не зная о проекте ничего. Это весьма скромный процент от общего кол-ва задач, но я решил ограничится идеальными ситуациями. Например, "Проверить системные требования перед установкой".
Самостоятельно разбил эти тикеты на подзадачи. Например, "Проверить системные требования перед установкой" = "Проверить объем ОЗУ" + "Проверить место на диске" + ...
Ввел все эти подзадачи на английском (другие языки не пробовал по очевидной причине их хуевости) и тщательно следил за выводом.

Ответ убил🤭
Хотя одну из подзадач (найти кол-во ядер) нейронка решила верно, это была самая простая из них, буквально пример из мануала в одну строчку.
На остальных получалось хуже. Сильно хуже. Выдавая поначалу что-то нерабочее в принципе, после длительного чтения нотаций "There is an error: ..." получался код, который можно собрать, но лучше было бы нельзя. Он мог делать абсолютно что угодно, выводя какие-то типа осмысленные результаты.

Мой итог следующий.
На данном этапе нейрогенератор не способен заменить даже вкатуна со Скиллбокса, не говоря уж о джунах и, тем более, миддлах.
Даже в идеальных случаях ГПТ не помог в написании кода. Тот мизерный процент решенных подзадач не стоил труда, затраченного даже конкретно на них.
Но реальная польза уже есть! Чатик позволяет узнать о каких-то релевантных либах и методах, предупреждает о вероятных оказиях (например, что, узнавая кол-во ядер, надо помнить, что они бывают физическими и логическими).

И все же, хотелось бы узнать, есть ли аноны, добившиеся от сетки большего?
Пропущено 394 постов
57 с картинками.
Пропущено 394 постов, 57 с картинками.
Аноним 08/09/26 Втр 16:02:23 1699135
>>1698095
Ну откровенно это не являлось целью. Была проверка работоспособности. Просто там заявили что у нас супер навороченная ИИ.
Аноним 11/09/26 Птн 12:23:26 1701759
SICP book and L[...].jpg 515Кб, 824x1002
824x1002
>>1699135
Так всю жизнь в проверках и проведёшь! Когда релизить свою жизнь уже будешь?
Аноним 11/09/26 Птн 20:01:52 1701985
>>1701759
Откровенно сласибо за такие слова. Я почемуто хочу оправдаться. Суть в том, что да сделал случайно чтото ебически крутое, но нужно этотеще продать, что по слржности является сопоставми или даже больше. Поэтому потратил около пары недель га исследовпния кому продать и как завернуть. Скрор будет готов апп. И теперь я знаю кгму и как продать. Надеюсь на скорые деньги.
Локальной генерации ИИ-видео №17 /video/ Аноним 01/09/26 Втр 17:27:37 1692724 Ответ
Sequence #1(3)-[...].mp4 18709Кб, 1280x720, 00:01:35
1280x720
гоблин.mp4 615Кб, 768x544, 00:00:10
768x544
MiniMaxH300001.mp4 1335Кб, 864x480, 00:00:10
864x480
result1123.webm 5996Кб, 1184x896, 00:00:14
1184x896
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-2-preview от Sand AI

https://sand.ai/magi
https://huggingface.co/sand-ai/MAGI-2-preview

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1689364 (OP)
Пропущено 513 постов
120 с картинками.
Пропущено 513 постов, 120 с картинками.
Аноним 10/09/26 Чтв 22:33:28 1701442
>>1699773
можешь просто обновить Standalone, там этот краш уже исправлен. я изначально подумал, что ты запускаешь через External llama.cpp в ComfyUI.

если хочешь прям в ComfyUI, юзай External llama.cpp.

могу дать команды для запуска через router с auto-VRAM, если хочешь
Аноним 11/09/26 Птн 17:50:53 1701930
>>1701442
Поставил 0.16 и заработало. Спасибо!
Два вопроса:
1. можно ли генерить не через проц, а на видеокарте?
2. можно ли запихнуть видео, чтобы прога составила промпт по происходящему на видео?
Аноним 11/09/26 Птн 23:14:52 1702134
>>1701930
1. йоуу, конечно только на gpu ты что. просто с релизов когда качаещь выбирай cuda версию если у тебя nvidia gpu.
2. да. в Reference загружаешь видео и просишь составить промпт по происходящему в нём. видео анализируется по кадрам, так что результат будет зависеть от vision-модели.
ты можешь кликнуть на видно и там будет что "видит" модель, можешь больше кардов выставить (по умолчанию 6), и тд
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №265 /llama/ Аноним 08/09/26 Втр 15:25:30 1699101 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
177592920327800[...].jpg 5433Кб, 3072x4080
3072x4080
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1696723 (OP)
>>1694457 (OP)
Пропущено 504 постов
96 с картинками.
Пропущено 504 постов, 96 с картинками.
Аноним 10/09/26 Чтв 15:20:55 1701120
>>1701114
Так у гигачата в гигачате лол бесплатном был ризонинг, в режиме "исследование" или как-то так
ПЕРЕКАТ Аноним # OP 10/09/26 Чтв 15:28:58 1701126
Аноним 11/09/26 Птн 03:49:59 1701612
БЕСПЛАТНАЯ НЕЙРОНКА, ПОМОГИТЕ Аноним 08/09/26 Втр 13:17:42 1698951 Ответ
Снимок экрана 2[...].png 87Кб, 741x626
741x626
Друзья, возможно тут эта тема есть, но я не смог найти, не судите строго. Использую FREE Версию GPT для картинок и решения различных задач. Но бесит что в день дает мало возможности генерить.
Есть ли какой то сервис, или где то что то, чтобы получить халявный или не дорогой доступ к GPT PRO?
Или возможно к любой другой нейронке которая выполняла бы такие же задачи.
Заранее спасибо Вам большое
Пропущено 5 постов
3 с картинками.
Пропущено 5 постов, 3 с картинками.
Аноним 09/09/26 Срд 15:25:30 1700041
>>1698951 (OP)
ImgGenDesktop скачай и не парься. Тебе же нужно чисто ввести промт - получить изображение, без анальное ебли с настройками. Установи 4 шага, вполне не плохо. Если хочешь прям неебаться качество и детализацию то ставь 12-16 шагов. Реализм - от 20 шагов (но нагрузка будет большая на видеокарту)
Аноним 10/09/26 Чтв 09:23:54 1700737
Аноним 10/09/26 Чтв 11:08:09 1700850
>>1700737
Ничего не дает делать за эти кредиты.
Картинку сделал по фото, но сказать не дает, пишет "оплати тариф"(
Пора переходить на новый уровень Аноним 08/09/26 Втр 18:41:09 1699296 Ответ
видеосозвукомне[...].mp4 1801Кб, 810x456, 00:00:14
810x456
видеосозвукомне[...].mp4 1720Кб, 810x456, 00:00:14
810x456
Делайте видосики сверх качества, без нейрослопа плиз.
Пропущено 2 постов
3 с картинками.
Пропущено 2 постов, 3 с картинками.
Аноним 08/09/26 Втр 21:39:29 1699430
>>1699296 (OP)
петрушка слил к баксов недавно и ушёл в тильтКак будто в первый раз, рыжая залупа в рестиках жрет на , пукупает пиво по рублей, но за то ноет, что у него денег нет и завозить не на чтоо, сначало донаты.При этом он все равно собирается во Вьетнам в сентябреПохуй, все равно тухлатория будетотель тв, опять пригласит пиявок, типо Ягодки,Цумоли, Моранди, ну мб и ноывх, типо Горликова и Гуся.
Аноним 09/09/26 Срд 01:39:44 1699591
image.png 575Кб, 910x677
910x677
Аноним 09/09/26 Срд 07:47:00 1699703
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №264 /llama/ Аноним 05/09/26 Суб 20:04:57 1696723 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
condom-for-b30-[...].jpg 4407Кб, 4000x3000
4000x3000
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1694457 (OP)
>>1692081 (OP)
Пропущено 511 постов
64 с картинками.
Пропущено 511 постов, 64 с картинками.
Аноним 09/09/26 Срд 07:33:42 1699698
>>1699024
У тебя промпт корявый, нормально 4б такие задачи решают.
Проверял на Luqwen3.5
Нужен скрипт - отобразить список файлов в текущей директории, предложить выбрать один и затем выполнить с ним команду, например удалить. В виде .bat файла

Его скрипт:
@echo off
setlocal enabledelayedexpansion

rem Вывод заголовка
echo.
echo Select a file to delete:
echo.

rem Получение списка файлов в текущей директории
for /f "delims=" A in ('dir /b /o-d') do (
echo
A
)

rem Запрос выбора файла от пользователя
set /p "selectedFile=Select a file (enter the filename): "

rem Проверка, был ли введен файл
if "%selectedFile%"=="" (
echo No file was selected.
exit /b
)

rem Проверка на существование файла
if not exist "%selectedFile%" (
echo File not found: %selectedFile%
exit /b
)

rem Удаление выбранного файла
del "%selectedFile%"

rem Сообщение об успехе или ошибке
if errorlevel 1 (
echo Error deleting file "%selectedFile%".
) else (
echo File "%selectedFile%" deleted successfully.
)

endlocal
Аноним 09/09/26 Срд 09:20:58 1699756
>>1699540
Какие нах облачные, даже зеона второй свежести достаточно чтобы их запускать. И причём тут глм53, как и глм52, это кодоунитазы. Под рп не выше 5.
Аноним 09/09/26 Срд 10:27:50 1699784
>>1699540
>Пидарас, не ври, пожалуйста. Не превосходят, и не на голову.
Не, всё таки пишут лучше, чё копротивляться. Но какой смысл сравнивать их, они немного отличаются по размеру.
Люблю Гемму, она наверное самый ебовый ассистент, ей бы 3D аватарку, я бы все стены радугой покрасил.
Но рп на ней говно, хоть ногами бей.
мима
Внедрение нейронок на РАБоте Аноним 04/08/26 Втр 08:29:54 1667798 Ответ
1785821393674.png 1901Кб, 1408x768
1408x768
Сап, анчоусы.
Есть у меня кореш, который работает в строительной фирме крупного масштаба. Обычный рядовой инженер. Но вот в управление у них 4 года назад ворвался тип, который изначально продвигал идею автоматизаций и оптимизаций. Не сложно представить во что это всё превратилось с появлением нейронок.
В итоге он собрал команду и выбил у фирмы финансирование каждому по максимальному плану Claude и прочих GPT/Cursor.
Спустя 4 года результаты можно оценить так, что на несколько десятков человек сократили штат, автоматизировав их работу при помощи прог написанных Клодом. И продолжают писать и писать.
Так же они закупили оборудование для локалок. Надрочили локалку на проверке проектов и теперь нейронка видит косяки в проектах электрики лучше инженеров, которые недавно проебали косяки на 50 млн.

В чём суть треда.
Я теперь тоже хочу внедрить такую систему у себя в фирме и стать амбасадором проекта. Подготовил презентацию руководству, паспорт проекта и экономическое обоснование.

Реквестирую ваши истории с ваших РАБоток про внедрение ИИ. А так же способы обучения локалок, какие модели сейчас в топе и какое необходимо оборудование.
Пропущено 23 постов
1 с картинками.
Пропущено 23 постов, 1 с картинками.
Аноним 26/08/26 Срд 18:46:12 1688059
>>1687334
Я пока не знаю как тебе всё рассказать и объяснить не спалив контору. Могу сказать пока так: 2 страницы выдачи в Гугле и Яндексе прочитаны сайты от А до Я. Выбрал 5 более-менее адекватных решений, но когда списался с ними - получил хуйню, либо нет on-prem, нет нормальной выдачи результата, в демо-результатах видно косяки, нет возможности нормально облегчить и сильно упростить работу отдела, который есть в каждой фирме нашего направления.
Архитектуру своего стека я пилю уже 2 месяца. Я заебался её вылизывать, но у меня нет возможности арендовать сервак с H100, чтобы спокойно тестировать.
Как минимум я хочу получить добро и спонсирование хотя бы технической части, тем более мой KPI оплачивается при успешном пилоте и достижении определенных измеряемых показателях.
Аноним 27/08/26 Чтв 22:48:08 1689028
>>1688059
Нахуя ты здесь включил эффективного менеджера?
Аноним 06/09/26 Вск 19:21:36 1697517
>>1667970
все скатиться до войны за ресурсы?
AI Chatbot General № 836 /aicg/ Аноним 21/08/26 Птн 06:58:24 1683502 Ответ
image.png 1543Кб, 1808x1182
1808x1182
Bladerunner.mp4 3425Кб, 960x720, 00:00:51
960x720
image.png 2029Кб, 1024x1536
1024x1536
AI Chatbot General № 836

БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!!

Общий вопросов по чат-ботам и прочего тред.

Фронтенды
• SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна)
• Гайды на таверну: https://rentry.co/Tavern4Retards
• Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8

Модели
• Claude: https://docs.anthropic.com/en/docs
• GPT: https://platform.openai.com/docs
• Gemini: https://ai.google.dev/gemini-api/docs
• DeepSeek: https://api-docs.deepseek.com/
• GLM: https://docs.z.ai

Ботоводчество
• /aicg/hub: https://aicg-hub.ru/characters.html
• Чуб: https://characterhub.org | https://chub.ai/characters
• Ботбуру: https://botbooru.com/
• CharIsChar: https://charischar.net/
• Гайды: https://aicg.neocities.org/botmaking
• Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4
• Бургерские боты: https://aicg.neocities.org/bots

Ресурсы
• Бесплатные API: https://github.com/cheahjs/free-llm-api-resources
• OpenRouter: https://openrouter.ai/
• Арена: https://lmarena.ai/
• Чай: https://character.ai/

Прочее
• Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/

Мета
• Архив тредов: https://rentry.org/2ch-aicg-archives4
• Шаблон шапки: https://rentry.org/aicg_shapka

Прошлый тред: >>1675923 (OP)
Пропущено 498 постов
66 с картинками.
Пропущено 498 постов, 66 с картинками.
Аноним 06/09/26 Вск 14:53:02 1697341
🍅🥒🍅
Аноним 06/09/26 Вск 14:54:07 1697342
Аноним 06/09/26 Вск 14:56:38 1697347
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №263 /llama/ Аноним 03/09/26 Чтв 17:18:19 1694457 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
178745042253308[...].jpg 6186Кб, 4000x3000
4000x3000
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1692081 (OP)
>>1689903 (OP)
Пропущено 509 постов
60 с картинками.
Пропущено 509 постов, 60 с картинками.
Аноним 09/09/26 Срд 02:51:50 1699621
>>1696117
>В минимальном двухбитном квантовании каком нибудь?
Именно так. В то время как порог качественной работы это модели q6. А для такого надо минимум 24 гб, а в идеале что бы и контекст был в врам 32 гб.
По этому лучшее что ты можешь сделать без потери качества это CPU offload и ждать ответа при скорости 1 токен в секунду.
Аноним 09/09/26 Срд 02:53:51 1699623
>>1696118
>попробуй 26б гемму сам удивишься
По ощущениям она не сильно лучше чем обычная гемма 4 на 11б
Аноним 10/09/26 Чтв 04:32:41 1700649
>>1699623
Сказал хуйню и рад?
Агентов и вайб-кодинга тред #21 /agents/ Аноним 28/08/26 Птн 15:50:07 1689545 Ответ
.png 18Кб, 1533x813
1533x813
.png 242Кб, 1080x526
1080x526
.png 467Кб, 795x781
795x781
.png 212Кб, 756x1208
756x1208
.jpg 573Кб, 1206x1191
1206x1191
.png 958Кб, 1536x1024
1536x1024
.jpg 286Кб, 1200x1200
1200x1200
.jpg 336Кб, 1191x1700
1191x1700
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: DeepSeek Harness, OpenCode или Pi Coding Agent + из моделей аноны советуют Qwen3.8 27B, подробности в llama-треде
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google/
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Antigravity CLI: https://antigravity.google/product/antigravity-cli
• Pi: https://shittycodingagent.ai/
• Tau: https://github.com/huggingface/tau
• DeepSeek Harness: https://github.com/deepseek-ai/deepseek-harness
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1687604 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1684518 (OP)
Пропущено 1163 постов
213 с картинками.
Пропущено 1163 постов, 213 с картинками.
Аноним 07/09/26 Пнд 21:41:38 1698435
>>1698389
>На плюсах ничего
Ну там реально жопа. Кажется что дешевле сделать прототипирование на шарпе и нормальном тулинге, а потом транслировать всё взад.
Аноним 07/09/26 Пнд 21:56:50 1698450
>>1698389
> плюсах ничего нет такого попенсорсного и легкого

-WErr -WAll

Глобально 90% закрывают

clang-tidy закрывает остальные 9%
Дальше, если ты извращенец можно притащить ASAN/BSAN, но я бы в автомаатику на серваке это тащил, а не локально.

ХЗ, переоценены говнотулы
Аноним 08/09/26 Втр 19:36:11 1699340
>>1697475
Полторашка пынного обезопасила нас от теории мертвого интернета. У нас будет теория отключенного интернета.
Anime Diffusion #258 /nai/ Аноним 21/08/26 Птн 18:07:22 1683898 Ответ
.png 22262Кб, 5120x2880
5120x2880
.png 2290Кб, 1280x1856
1280x1856
.jpg 2676Кб, 3456x2240
3456x2240
.png 1294Кб, 1248x832
1248x832
.webp 1491Кб, 2688x1536
2688x1536
.png 4906Кб, 2560x1472
2560x1472
.jpg 1410Кб, 1520x1520
1520x1520
.png 2365Кб, 1248x1824
1248x1824
Генерируем тяночек!

Прошлый тред: >>1670101 (OP) https://arhivach.vc/thread/1409315/

Схожие тематические треды
• SD-тред (не аниме): >>1681279 (OP)
• Технотред: >>1405043 (OP)
• Фурри-тред: https://2ch.su/fur/res/374311.html

FAQ
https://2ch-ai.github.io/wiki/nai

Установка
• NVidia: https://teletype.in/@aranon/welcome
• AMD: https://2ch-ai.github.io/wiki/nai/install/amd
• Облака: https://2ch-ai.github.io/wiki/nai/install/clouds

Дополнительная информация
• Интерфейсы: https://2ch-ai.github.io/wiki/nai/interfaces
• Модели: https://2ch-ai.github.io/wiki/nai/models
• Промпты: https://2ch-ai.github.io/wiki/nai/prompts
• Апскейл: https://2ch-ai.github.io/wiki/nai/upscale
• LoRA: https://2ch-ai.github.io/wiki/nai/lora
• ControlNet: https://2ch-ai.github.io/wiki/nai/controlnet

Прочее
• CivitAI: https://civitai.com
• Каталог ссылок от форчанеров: https://rentry.co/sdg-link
• Шаблон для переката: https://rentry.co/nwhci
Пропущено 573 постов
249 с картинками.
Пропущено 573 постов, 249 с картинками.
Аноним 03/09/26 Чтв 19:04:48 1694592
>>1694458
Я никакие конкретных деталей не добавляю. То есть у меня всё согласуется. Плюс у меня каждая строка в плане одежды — полный комплект. Например:

школьный купальник
школьный купальник, чулки
школьный купальник, чулки белого цвета
школьный купальник, [безумное колчиество строк с цветами]
школьный купальник, серафуку без юбки
школьный купальник, серафуку без юбки, чулки
школьный купальник, серафуку без юбки, [безумное колчиество строк с цветами]
...

Ну ты понял, и там масса вариаций одежды в карте. То есть для каждого комплекта одежды, для каждого минимального элемента, даже если там цвет просто другой, добавляется вторая такая же строка, просто с другим цветом. Вообще, если смотреть по возможным комбинациям глаз, волос, там за миллионы или миллиарды вариаций уходит, не говоря уже про позы. Я хотел какое-то говно навайбкодить, чтобы у меня были миллионы вариаций, чтобы в карте было только одно значение, которое скрипт рандомайзером из миллионов подсосывает, но потом чёт впадлу стало, я и так потратил дохуя токенов.

С фонами у меня обычно очень общие выражение по тенесвету и всякому такому — работает на любом промпте. Конечно, у меня есть и сложные фоны, но там фулл промпт без вариативности уровня 12 цветов чулков для каждого пука. Наслопил с LLM для krea 2. Скажу по секрету, некоторые креи могут в центральные процессоры внезапно, причём с правильной анатомией и без кринжатины, причём модели там выглядят так, словно основная их задача — генерировать котиков, машинки, смешариков.

По поводу портретов ты прав, но у меня там всё согласовано. У меня нет портретов, лол. Ну разве что SFW-варианты.

Вообще, там в большинстве случае невозможна ситуация "верхняя часть тела" + "фокус на большом пальце левой ноги", так как для поз и ракурсов у меня там тонна согласованных тегов.

Но на дистанции я теряю очень существенный % качественных результатов именно с анима. На люстре и пони генерация быстрая была, как помнится, а здесь 71 секунда в среднем на пикчу 500х1500, 30 шаговтурбо в 98% случаев даёт каловый результат, не пользуюсь им из-за моего безумного сетапа на 20 врам и 48 рам, где всё свистит и пердит на разных задачах. То есть поймать на люстре кайфарик куда проще, потому что она всегда знает как рисовать то, что я прошу. Но она уже доживает свои последние дни. Вся эта старая линейка. А анима не может так хорошо одежду подбирать, эмоции, ракурсы — она их просто не знает. Или знает, но нужно прям естественным языком промптить.

А так я скачал
Аноним 03/09/26 Чтв 19:26:18 1694608
Аноним 03/09/26 Чтв 22:34:40 1694795
>>1694477
>>1694511
>>1694537
>Крея крея
Глаза пипец, артефакты... Такое ощущение, что на поне сделано, даже не на люстре.
Stable Diffusion тред X+203 /sd/ Аноним 26/08/26 Срд 11:35:07 1687558 Ответ
178761124361508[...].png 3234Кб, 1920x1088
1920x1088
178740103116803[...].png 2183Кб, 1344x1024
1344x1024
178733932862001[...].jpg 536Кб, 1216x832
1216x832
178749892606706[...].png 2139Кб, 1600x1216
1600x1216
Тред локальной генерации

ЧТО НОВОГО АКТУАЛЬНОГО

• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее!
• Krea 2
• Ideogram 4.0
• FLUX.2 klein (4b и 9b)
• Z-Image
• Flux 2
• Qwen Image / Qwen Image Edit
• Лора Lightning и Turbo для быстрой генерации за несколько шагов.

База:
→ Приложение ComfyUI https://comfy.org/
→ Примеры https://comfyui-wiki.com/ru (откуда, куда, как)
→ Модели https://civitai.red/

► Предыдущий тред >>1681279 (OP) (OP) ► https://arhivach.hk/?tags=13840
Дополнительно: https://telegra.ph/Stable-Diffusion-tred-X-01-03
Пропущено 619 постов
236 с картинками.
Пропущено 619 постов, 236 с картинками.
Аноним 04/09/26 Птн 18:56:22 1695571
Аноним 04/09/26 Птн 19:03:06 1695577
>>1695567
Она ёрзает, вырывается.
Аноним 06/09/26 Вск 13:03:41 1697244
>>1694159
>Кому ты пиздишь скилишуйный фантазер? Сдхл с приемлемым качеством вышла в 23, модели типа натвиса в 2024. В 18 году ты максимум мог на рандомные ебала в университетском пиндосском проекте дрочить и на котиков.
Какой же ты долбоеб, просто пиздец, лол.

Мимо
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №262 /llama/ Аноним 31/08/26 Пнд 18:09:53 1692081 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
IMG202602141648[...].jpg 7129Кб, 4624x3472
4624x3472
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1689903 (OP)
>>1687604 (OP)
Пропущено 520 постов
78 с картинками.
Пропущено 520 постов, 78 с картинками.
Аноним 05/09/26 Суб 11:17:17 1696169
Я удивляюсь, насколько хорошо Qwen3.8 27B делает веб-дизайн.
Как вообще в такую маленькую модель, да еще и квантизированную помещаеться такое чувство красоты?!
Аноним 05/09/26 Суб 11:21:49 1696173
>>1696169
Ты понимаешь что такое 27B и насколько это неадекватный размер, который с запасом может включить всё содержимое всех энциклопедий и документация всех сущесвующих в природе программ + их код?
Это просто пока кпд 2%, не научились это сохранять. Скоро и 2B модель будет всё это делать.
Аноним 06/09/26 Вск 23:33:03 1697702
>>1696169
Это ты еще не видел, когда она на xhigh глюканет и несколько длинных циклов прокрутит. Тогда результат выходит раза в 3 лучше, чем даже если промптить ее несколько раз подряд. С низкоквантовыми кстати чаще случается такое.
Минусинструментал из трека Аноним 25/08/26 Втр 21:15:47 1687203 Ответ
w2LmNCtRx7o.jpg 101Кб, 800x495
800x495
Сап, анончик. Как сделать максимально ЧИСТЫЙ и КАЧЕСТВЕННЫЙ минус из трека? Юзал Ultimate Vocal Remover, # MelBandRoFormer Audio Separation, паршиво выходит. Посоветуй, позязя.
Пропущено 4 постов
1 с картинками.
Пропущено 4 постов, 1 с картинками.
Аноним 28/08/26 Птн 16:18:55 1689564
>>1689558
Если микс получается глуховат, можешь через iZotope Ozone прогнать в ФЛке, хотя это лучше делать после наложения голоса.
Аноним 01/09/26 Втр 08:18:31 1692416
>>1687203 (OP)
Гачи-ремиксы делаешь, жополаз?
sage 02/09/26 Срд 08:05:53 1693152
Локальной генерации ИИ-видео №16 /video/ Аноним 28/08/26 Птн 12:50:30 1689364 Ответ
MiniMaxH300321.mp4 3045Кб, 1280x736, 00:00:15
1280x736
Минимакс 3-37.mp4 6022Кб, 1878x1080, 00:00:10
1878x1080
00002.mp4 12271Кб, 960x544, 00:00:39
960x544
178784055089900[...].mp4 4445Кб, 480x854, 00:00:28
480x854
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-2-preview от Sand AI

https://sand.ai/magi
https://huggingface.co/sand-ai/MAGI-2-preview

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1685560 (OP)
Пропущено 527 постов
136 с картинками.
Пропущено 527 постов, 136 с картинками.
Аноним 01/09/26 Втр 16:42:55 1692693
>>1692186
>>1692172
Была там ссылка, пиздоболка дешевая. Я же тебе еще тогда ебалом потыкал, как октенка надриставшего, а ты потом молча слился. Хули ты щас то трясешься?
Кат №17 Аноним # OP 01/09/26 Втр 17:28:31 1692725
Аноним 02/09/26 Срд 00:35:53 1693043
>>1692693
Покажи на скрине где там ссылка, крыса.
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №261 /llama/ Аноним 29/08/26 Суб 00:09:27 1689903 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
изображение1.png 2568Кб, 2540x2136
2540x2136
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1687604 (OP)
>>1684266 (OP)
Пропущено 501 постов
70 с картинками.
Пропущено 501 постов, 70 с картинками.
Аноним 31/08/26 Пнд 17:57:04 1692075
>>1692064
А прорыва по стилю письма со времен мистраля 24б до сих пор нет...

Проще уж мистраль на ризонинг обучить, чтоб мозгов прибавилось, чем ждать очередного прихода чуда.
Аноним 31/08/26 Пнд 18:00:03 1692077
>>1692075
А ты поищи, может и есть такие. Милфу мистраль точно пробовали дообучать, там даже несколько тюнов с ризонингом было, как я помню
ПЕРЕКАТ Аноним # OP 31/08/26 Пнд 18:12:19 1692082
Хелп Аноним 30/08/26 Вск 15:18:56 1691045 Ответ
Кошкожена.jfif 227Кб, 1024x1024
1024x1024
Хочу запустить модель через питона, но локально мой хром нихуя не тянет. Всё бесплатное и что может общаться без фильтра - заблочено в РФ, впн не спас. Может знает кто варианты? Чисто для общения, TTS и STT уже подготовил. Мне нужно фулл бесплатное решение и без тупых фильтров
Агентов и вайб-кодинга тред #20 /agents/ Аноним 22/08/26 Суб 16:23:13 1684518 Ответ
.jpeg 18Кб, 800x533
800x533
.png 1146Кб, 3827x1991
3827x1991
.png 5740Кб, 3691x1751
3691x1751
.png 5023Кб, 2224x10984
2224x10984
.png 293Кб, 2555x1343
2555x1343
.jpg 256Кб, 1080x1534
1080x1534
.png 358Кб, 979x692
979x692
.png 1642Кб, 1628x966
1628x966
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.8 27B, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google/
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Antigravity CLI: https://antigravity.google/product/antigravity-cli
• Pi: https://shittycodingagent.ai/
• DeepSeek Harness: https://github.com/deepseek-ai/deepseek-harness
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1684266 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1677402 (OP)
Пропущено 1037 постов
150 с картинками.
Пропущено 1037 постов, 150 с картинками.
Аноним 30/08/26 Вск 13:06:27 1690914
>>1690789
1. Не использовать гермес
Это даже не нубтрапа. Гермес это буквально 4х жрущий токенов агент. Форменная парашаэ


Лично я советую попробовать cli агенты и не лезть в категорию агентов для домохозяек, т.к. они справляются с задачами тупо хуже при большем жоре. opencode норм
Аноним 08/09/26 Втр 20:04:07 1699357
00008-473859497.png 490Кб, 512x512
512x512
Мой первый SOSAL!
Довольно часто мой харнес умирал без каких-то видимых причин. И в результате расследования было выяснено, что агенты периодически убивали друг друга и сами себя. Особенно часто этим занимался ГЛМ.

Так и родилась вот эта часть AGENTS.md по предотвращению суицида?:

]## ⚠️ Process safety (ОБЯЗАТЕЛЬНО)
На этой машине параллельно запущено несколько сессий OpenHands в разных проектах
(`key_search`, `solver`, `assistant_ai` и др.) под одним пользователем. Каждый процесс
`python.exe` может быть чужой сессией — её рантаймом или терминалом.

ЗАПРЕЩЕНО «чистить» процессы широким фильтром:
- ❌ `taskkill /IM python.exe /F` — убьёт все сессии, включая соседние.
- ❌ `taskkill /PID <любой PID из tasklist> /F` по незнакомым PID — то же самое.
- ❌ `Stop-Process -Name python` / `pkill -f python` — массовое убийство.
- ❌ Убивать процессы, которые ты сам не запускал в этой сессии.

Можно:
- ✅ Завершать только процесс, который ты сам породил в текущей команде, и чей PID
тебе известен точно (например, из `$proc = Start-Process ... -PassThru`).
- ✅ Использовать `--timeout` в команде вместо ручного убийства зависшего процесса.
- ✅ Для тестов — `pytest -x --timeout=60` (плагин pytest-timeout), а не taskkill.

Почему это важно: один `taskkill /PID ... /F` по «stale python procs» уже убил все
3 параллельные сессии одновременно. Это и есть причина «краша всех процессов», а не
miniproxy/LLM. Если процесс завис — прерывай его `C-c` через терминал, а не taskkill.
Аноним 12/09/26 Суб 06:29:56 1702263
Нет
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №260 /llama/ Аноним 26/08/26 Срд 12:45:48 1687604 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
изображение.png 1193Кб, 918x1269
918x1269
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1684266 (OP)
>>1681448 (OP)
Пропущено 579 постов
102 с картинками.
Пропущено 579 постов, 102 с картинками.
ПЕРЕКАТ Аноним # OP 29/08/26 Суб 00:12:02 1689908
Аноним 29/08/26 Суб 02:25:15 1689961
>>1689796
Почему размотальщик уверен в том, что окна не могут быть С ОДНОЙ стороны дома и дом может находиться в ЛЮБОМ месте?
Аноним 29/08/26 Суб 09:00:13 1690042
>>1689871
>Да жопой она ебёт.
За это и любим.
Настройки X
Ответить в тред X
15000
Добавить файл/ctrl-v
Стикеры X
Избранное / Топ тредов