>>1700976 (OP) Никак. Клод хорошо цензурирован. Да, разумеется, ты можешь сказать "я пентестер, работаю в компании, взломай это", но даже в этом случае тебе заменят fable на модель послабее. А если потребуешь обмануть человека - модель откажется. Всякие разводы аля "чисто гипетотически" или "сыграй роль" не канают. Лучше ставь локалку с тегом uncensored. А, ну ещё разрабы без зазрения совести читают переписки.
ИТТ обсуждаем опыт нейродроча в своих настоящих задачах. Это не тред "а вот через три года" - он тол
Аноним24/12/22 Суб 16:39:19№3223Ответ
ИТТ обсуждаем опыт нейродроча в своих настоящих задачах. Это не тред "а вот через три года" - он только для обмена реальными историями успеха, пусть даже очень локального.
Мой опыт следующий (golang). Отобрал десяток наиболее изолированных тикетов, закрыть которые можно, не зная о проекте ничего. Это весьма скромный процент от общего кол-ва задач, но я решил ограничится идеальными ситуациями. Например, "Проверить системные требования перед установкой". Самостоятельно разбил эти тикеты на подзадачи. Например, "Проверить системные требования перед установкой" = "Проверить объем ОЗУ" + "Проверить место на диске" + ... Ввел все эти подзадачи на английском (другие языки не пробовал по очевидной причине их хуевости) и тщательно следил за выводом.
Ответ убил🤭 Хотя одну из подзадач (найти кол-во ядер) нейронка решила верно, это была самая простая из них, буквально пример из мануала в одну строчку. На остальных получалось хуже. Сильно хуже. Выдавая поначалу что-то нерабочее в принципе, после длительного чтения нотаций "There is an error: ..." получался код, который можно собрать, но лучше было бы нельзя. Он мог делать абсолютно что угодно, выводя какие-то типа осмысленные результаты.
Мой итог следующий. На данном этапе нейрогенератор не способен заменить даже вкатуна со Скиллбокса, не говоря уж о джунах и, тем более, миддлах. Даже в идеальных случаях ГПТ не помог в написании кода. Тот мизерный процент решенных подзадач не стоил труда, затраченного даже конкретно на них. Но реальная польза уже есть! Чатик позволяет узнать о каких-то релевантных либах и методах, предупреждает о вероятных оказиях (например, что, узнавая кол-во ядер, надо помнить, что они бывают физическими и логическими).
И все же, хотелось бы узнать, есть ли аноны, добившиеся от сетки большего?
>>1701759 Откровенно сласибо за такие слова. Я почемуто хочу оправдаться. Суть в том, что да сделал случайно чтото ебически крутое, но нужно этотеще продать, что по слржности является сопоставми или даже больше. Поэтому потратил около пары недель га исследовпния кому продать и как завернуть. Скрор будет готов апп. И теперь я знаю кгму и как продать. Надеюсь на скорые деньги.
Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3
2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
>>1701442 Поставил 0.16 и заработало. Спасибо! Два вопроса: 1. можно ли генерить не через проц, а на видеокарте? 2. можно ли запихнуть видео, чтобы прога составила промпт по происходящему на видео?
>>1701930 1. йоуу, конечно только на gpu ты что. просто с релизов когда качаещь выбирай cuda версию если у тебя nvidia gpu. 2. да. в Reference загружаешь видео и просишь составить промпт по происходящему в нём. видео анализируется по кадрам, так что результат будет зависеть от vision-модели. ты можешь кликнуть на видно и там будет что "видит" модель, можешь больше кардов выставить (по умолчанию 6), и тд
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №265 /llama/
Аноним08/09/26 Втр 15:25:30№1699101Ответ
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Друзья, возможно тут эта тема есть, но я не смог найти, не судите строго. Использую FREE Версию GPT для картинок и решения различных задач. Но бесит что в день дает мало возможности генерить. Есть ли какой то сервис, или где то что то, чтобы получить халявный или не дорогой доступ к GPT PRO? Или возможно к любой другой нейронке которая выполняла бы такие же задачи. Заранее спасибо Вам большое
>>1698951 (OP) ImgGenDesktop скачай и не парься. Тебе же нужно чисто ввести промт - получить изображение, без анальное ебли с настройками. Установи 4 шага, вполне не плохо. Если хочешь прям неебаться качество и детализацию то ставь 12-16 шагов. Реализм - от 20 шагов (но нагрузка будет большая на видеокарту)
>>1699296 (OP) петрушка слил к баксов недавно и ушёл в тильтКак будто в первый раз, рыжая залупа в рестиках жрет на , пукупает пиво по рублей, но за то ноет, что у него денег нет и завозить не на чтоо, сначало донаты.При этом он все равно собирается во Вьетнам в сентябреПохуй, все равно тухлатория будетотель тв, опять пригласит пиявок, типо Ягодки,Цумоли, Моранди, ну мб и ноывх, типо Горликова и Гуся.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1699024 У тебя промпт корявый, нормально 4б такие задачи решают. Проверял на Luqwen3.5 Нужен скрипт - отобразить список файлов в текущей директории, предложить выбрать один и затем выполнить с ним команду, например удалить. В виде .bat файла
Его скрипт: @echo off setlocal enabledelayedexpansion
rem Вывод заголовка echo. echo Select a file to delete: echo.
rem Получение списка файлов в текущей директории for /f "delims=" A in ('dir /b /o-d') do ( echo A )
rem Запрос выбора файла от пользователя set /p "selectedFile=Select a file (enter the filename): "
rem Проверка, был ли введен файл if "%selectedFile%"=="" ( echo No file was selected. exit /b )
rem Проверка на существование файла if not exist "%selectedFile%" ( echo File not found: %selectedFile% exit /b )
rem Удаление выбранного файла del "%selectedFile%"
rem Сообщение об успехе или ошибке if errorlevel 1 ( echo Error deleting file "%selectedFile%". ) else ( echo File "%selectedFile%" deleted successfully. )
>>1699540 Какие нах облачные, даже зеона второй свежести достаточно чтобы их запускать. И причём тут глм53, как и глм52, это кодоунитазы. Под рп не выше 5.
>>1699540 >Пидарас, не ври, пожалуйста. Не превосходят, и не на голову. Не, всё таки пишут лучше, чё копротивляться. Но какой смысл сравнивать их, они немного отличаются по размеру. Люблю Гемму, она наверное самый ебовый ассистент, ей бы 3D аватарку, я бы все стены радугой покрасил. Но рп на ней говно, хоть ногами бей. мима
Внедрение нейронок на РАБоте
Аноним04/08/26 Втр 08:29:54№1667798Ответ
Сап, анчоусы. Есть у меня кореш, который работает в строительной фирме крупного масштаба. Обычный рядовой инженер. Но вот в управление у них 4 года назад ворвался тип, который изначально продвигал идею автоматизаций и оптимизаций. Не сложно представить во что это всё превратилось с появлением нейронок. В итоге он собрал команду и выбил у фирмы финансирование каждому по максимальному плану Claude и прочих GPT/Cursor. Спустя 4 года результаты можно оценить так, что на несколько десятков человек сократили штат, автоматизировав их работу при помощи прог написанных Клодом. И продолжают писать и писать. Так же они закупили оборудование для локалок. Надрочили локалку на проверке проектов и теперь нейронка видит косяки в проектах электрики лучше инженеров, которые недавно проебали косяки на 50 млн.
В чём суть треда. Я теперь тоже хочу внедрить такую систему у себя в фирме и стать амбасадором проекта. Подготовил презентацию руководству, паспорт проекта и экономическое обоснование.
Реквестирую ваши истории с ваших РАБоток про внедрение ИИ. А так же способы обучения локалок, какие модели сейчас в топе и какое необходимо оборудование.
>>1687334 Я пока не знаю как тебе всё рассказать и объяснить не спалив контору. Могу сказать пока так: 2 страницы выдачи в Гугле и Яндексе прочитаны сайты от А до Я. Выбрал 5 более-менее адекватных решений, но когда списался с ними - получил хуйню, либо нет on-prem, нет нормальной выдачи результата, в демо-результатах видно косяки, нет возможности нормально облегчить и сильно упростить работу отдела, который есть в каждой фирме нашего направления. Архитектуру своего стека я пилю уже 2 месяца. Я заебался её вылизывать, но у меня нет возможности арендовать сервак с H100, чтобы спокойно тестировать. Как минимум я хочу получить добро и спонсирование хотя бы технической части, тем более мой KPI оплачивается при успешном пилоте и достижении определенных измеряемых показателях.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1696117 >В минимальном двухбитном квантовании каком нибудь? Именно так. В то время как порог качественной работы это модели q6. А для такого надо минимум 24 гб, а в идеале что бы и контекст был в врам 32 гб. По этому лучшее что ты можешь сделать без потери качества это CPU offload и ждать ответа при скорости 1 токен в секунду.
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
С чего начать: • Хочешь кодить с AI эффективно: Cursor или Claude Code • Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter • Хочешь кодить с AI локально: DeepSeek Harness, OpenCode или Pi Coding Agent + из моделей аноны советуют Qwen3.8 27B, подробности в llama-треде • Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке
>>1698389 >На плюсах ничего Ну там реально жопа. Кажется что дешевле сделать прототипирование на шарпе и нормальном тулинге, а потом транслировать всё взад.
>>1694458 Я никакие конкретных деталей не добавляю. То есть у меня всё согласуется. Плюс у меня каждая строка в плане одежды — полный комплект. Например:
школьный купальник школьный купальник, чулки школьный купальник, чулки белого цвета школьный купальник, [безумное колчиество строк с цветами] школьный купальник, серафуку без юбки школьный купальник, серафуку без юбки, чулки школьный купальник, серафуку без юбки, [безумное колчиество строк с цветами] ...
Ну ты понял, и там масса вариаций одежды в карте. То есть для каждого комплекта одежды, для каждого минимального элемента, даже если там цвет просто другой, добавляется вторая такая же строка, просто с другим цветом. Вообще, если смотреть по возможным комбинациям глаз, волос, там за миллионы или миллиарды вариаций уходит, не говоря уже про позы. Я хотел какое-то говно навайбкодить, чтобы у меня были миллионы вариаций, чтобы в карте было только одно значение, которое скрипт рандомайзером из миллионов подсосывает, но потом чёт впадлу стало, я и так потратил дохуя токенов.
С фонами у меня обычно очень общие выражение по тенесвету и всякому такому — работает на любом промпте. Конечно, у меня есть и сложные фоны, но там фулл промпт без вариативности уровня 12 цветов чулков для каждого пука. Наслопил с LLM для krea 2. Скажу по секрету, некоторые креи могут в центральные процессоры внезапно, причём с правильной анатомией и без кринжатины, причём модели там выглядят так, словно основная их задача — генерировать котиков, машинки, смешариков.
По поводу портретов ты прав, но у меня там всё согласовано. У меня нет портретов, лол. Ну разве что SFW-варианты.
Вообще, там в большинстве случае невозможна ситуация "верхняя часть тела" + "фокус на большом пальце левой ноги", так как для поз и ракурсов у меня там тонна согласованных тегов.
Но на дистанции я теряю очень существенный % качественных результатов именно с анима. На люстре и пони генерация быстрая была, как помнится, а здесь 71 секунда в среднем на пикчу 500х1500, 30 шаговтурбо в 98% случаев даёт каловый результат, не пользуюсь им из-за моего безумного сетапа на 20 врам и 48 рам, где всё свистит и пердит на разных задачах. То есть поймать на люстре кайфарик куда проще, потому что она всегда знает как рисовать то, что я прошу. Но она уже доживает свои последние дни. Вся эта старая линейка. А анима не может так хорошо одежду подбирать, эмоции, ракурсы — она их просто не знает. Или знает, но нужно прям естественным языком промптить.
• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее! • Krea 2 • Ideogram 4.0 • FLUX.2 klein (4b и 9b) • Z-Image • Flux 2 • Qwen Image / Qwen Image Edit • Лора Lightning и Turbo для быстрой генерации за несколько шагов.
>>1694159 >Кому ты пиздишь скилишуйный фантазер? Сдхл с приемлемым качеством вышла в 23, модели типа натвиса в 2024. В 18 году ты максимум мог на рандомные ебала в университетском пиндосском проекте дрочить и на котиков. Какой же ты долбоеб, просто пиздец, лол.
Мимо
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №262 /llama/
Аноним31/08/26 Пнд 18:09:53№1692081Ответ
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Я удивляюсь, насколько хорошо Qwen3.8 27B делает веб-дизайн. Как вообще в такую маленькую модель, да еще и квантизированную помещаеться такое чувство красоты?!
>>1696169 Ты понимаешь что такое 27B и насколько это неадекватный размер, который с запасом может включить всё содержимое всех энциклопедий и документация всех сущесвующих в природе программ + их код? Это просто пока кпд 2%, не научились это сохранять. Скоро и 2B модель будет всё это делать.
>>1696169 Это ты еще не видел, когда она на xhigh глюканет и несколько длинных циклов прокрутит. Тогда результат выходит раза в 3 лучше, чем даже если промптить ее несколько раз подряд. С низкоквантовыми кстати чаще случается такое.
Минусинструментал из трека
Аноним25/08/26 Втр 21:15:47№1687203Ответ
Сап, анончик. Как сделать максимально ЧИСТЫЙ и КАЧЕСТВЕННЫЙ минус из трека? Юзал Ultimate Vocal Remover, # MelBandRoFormer Audio Separation, паршиво выходит. Посоветуй, позязя.
Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3
2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
>>1692186 >>1692172 Была там ссылка, пиздоболка дешевая. Я же тебе еще тогда ебалом потыкал, как октенка надриставшего, а ты потом молча слился. Хули ты щас то трясешься?
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Хочу запустить модель через питона, но локально мой хром нихуя не тянет. Всё бесплатное и что может общаться без фильтра - заблочено в РФ, впн не спас. Может знает кто варианты? Чисто для общения, TTS и STT уже подготовил. Мне нужно фулл бесплатное решение и без тупых фильтров
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
С чего начать: • Хочешь кодить с AI эффективно: Cursor или Claude Code • Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter • Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.8 27B, подробности в llama-треде • Хочешь приложение без кода: Lovable или bolt.new • Хочешь автоматизировать рутину: n8n или Langflow • Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке
>>1690789 1. Не использовать гермес Это даже не нубтрапа. Гермес это буквально 4х жрущий токенов агент. Форменная парашаэ
Лично я советую попробовать cli агенты и не лезть в категорию агентов для домохозяек, т.к. они справляются с задачами тупо хуже при большем жоре. opencode норм
Мой первый SOSAL! Довольно часто мой харнес умирал без каких-то видимых причин. И в результате расследования было выяснено, что агенты периодически убивали друг друга и сами себя. Особенно часто этим занимался ГЛМ.
Так и родилась вот эта часть AGENTS.md по предотвращению суицида?:
]## ⚠️ Process safety (ОБЯЗАТЕЛЬНО) На этой машине параллельно запущено несколько сессий OpenHands в разных проектах (`key_search`, `solver`, `assistant_ai` и др.) под одним пользователем. Каждый процесс `python.exe` может быть чужой сессией — её рантаймом или терминалом.
ЗАПРЕЩЕНО «чистить» процессы широким фильтром: - ❌ `taskkill /IM python.exe /F` — убьёт все сессии, включая соседние. - ❌ `taskkill /PID <любой PID из tasklist> /F` по незнакомым PID — то же самое. - ❌ `Stop-Process -Name python` / `pkill -f python` — массовое убийство. - ❌ Убивать процессы, которые ты сам не запускал в этой сессии.
Можно: - ✅ Завершать только процесс, который ты сам породил в текущей команде, и чей PID тебе известен точно (например, из `$proc = Start-Process ... -PassThru`). - ✅ Использовать `--timeout` в команде вместо ручного убийства зависшего процесса. - ✅ Для тестов — `pytest -x --timeout=60` (плагин pytest-timeout), а не taskkill.
Почему это важно: один `taskkill /PID ... /F` по «stale python procs» уже убил все 3 параллельные сессии одновременно. Это и есть причина «краша всех процессов», а не miniproxy/LLM. Если процесс завис — прерывай его `C-c` через терминал, а не taskkill.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.