Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
>>1689800 >Вот типичные H3 Да типичные, тестовые генерации для проверки работоспособности тех или иных аспектов, сделанные на 4х шагах в низком разрешении.
>наглядно попробовал повторить это в H3 и вышел ожидаемый пиздец Наглядно попробовал повторить на 8 шагах, в низком разрешении, с промптом написанным за минуту нейросеткой, с первми попавшимися референсами из гугла. Без дрочения сида. Где на первых кадрах с мужиком качество неотличимо от исходного видео.
>>1690805 Да хоть на миллион шагов в 2к с промптом от профессора литературы. У H3 типичные для него артефакты везде. Их нет только на относительно статичных видео.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1686975 Ну во первых да, такой экспириенс тебе без иронии никто больше не даст. Который год не отпускает. Во вторых некоторую хуйню я корпам писать точно не буду уж очень они сосут данные нагло, просто пиздец. Ну и типа ИИ у тебя на видимокарточке. Дома. Про такое даже фантасты не писали моветон нереалистично считалось, а оно вон оно как.
>>1687346 >Ого, в таком случае реквестирую вариант чтобы край вентилятора был выровнен по одной из плоских сторон видеокарты, а остальное цетром, такое возможно? С меня как всегда. Вот. На картинке схемы. Прости что я такая копуша, у меня просто беды с башкой и я раньше не был в состоянии сделать, хотя там и на пять минут. https://files.catbox.moe/ljbb70.7z
• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее! • Krea 2 • Ideogram 4.0 • FLUX.2 klein (4b и 9b) • Z-Image • Flux 2 • Qwen Image / Qwen Image Edit • Лора Lightning и Turbo для быстрой генерации за несколько шагов.
Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.
🚀 Последний обзор ИИ новостей:
📰 Главные новости ИИ
Отключение дата-центра в Северной Вирджинии вывело 3,1 ГВт из сети PJM, спровоцировав региональные просадки напряжения и подчеркнув необходимость создания ИИ-объектов, готовых к работе с энергосетью.
Предприниматели, которые развивали ИИ на критически важных бизнес-узких местах с высоким рычагом воздействия, получили сверхприбыль, включая чистое повышение прибыльности на $40 млн благодаря ИИ и выход соло-основателя на $80 млн.
🛠 Инструменты для разработчиков
Sakana AI добавляет интерфейс Claude Code в Fugu-Ultra v1.1
Anthropic удалила 80% системного промпта Claude Code, поскольку новые модели процветают на суждениях, а не на правилах.
Переписывание Bun на Rust достигло ~$800 тыс. и 2 475 открытых PR без релиза
📦 Продукты
Google Gemini приближается к рубежу в миллиард пользователей
Платформа ИИ-обучения Synthesia выходит за рамки видео в живой коучинг
Claude Cowork записывает экраны пользователей для создания пользовательских навыков автоматизации.
💻 Оборудование
Anthropic обратилась к SK Hynix за поставками для производства собственных чипов, поразив председателя SK.
🔓 Открытый исходный код
Модели Google Gemma превысили 900 миллионов загрузок. Семейство LLM с открытыми весами от Google DeepMind достигает широкого распространения среди разработчиков и исследователей.
OpenCode достигает 13 миллионов пользователей и $40 млн выручки. Платформа для программирования с ИИ с открытым исходным кодом демонстрирует быстрое принятие после ограничений конкурентов.
Китайская Moonshot выпустит прорывную ИИ-модель для загрузки. Moonshot AI готова сделать свою модель Kimi K3 доступной для публичной загрузки. Moonshot опубликует открытые веса Kimi K3 объёмом 1,4 ТБ в воскресенье
🧪 Исследования
США представляют миссию Genesis стоимостью $5 миллиардов для развития науки с помощью ИИ
ARC Prize присудил новый SOTA Opus 5 на ARC-AGI-3 с результатом 30,2%, вчетверо превышающим прежний лучший результат, после того как модель превратила макеты головоломок в уравнения рефлексии — впервые в истории.
Работники пересекают границы должностей с помощью ИИ, показывает исследование OpenAI
Слайды Теренса Тао «Математика в эпоху ИИ» попали в новости. Лауреат Филдсовской премии Теренс Тао опубликовал слайды своей публичной лекции на ICM 2026 о математике в эпоху ИИ.
Альтман представит Белому дому модель OpenAI, решающую задачи Эрдёша.
Исследование Стэнфорда: безработица среди выпускников достигает 5,6%, поскольку ИИ затрагивает позиции начального уровня. Работники на раннем этапе карьеры в возрасте от 22 до 25 лет в наиболее подверженных ИИ профессиях демонстрируют примерно 13-процентное относительное снижение занятости с момента запуска ChatGPT в 2022 году.
⚙ Инфраструктура
Предлагаемый ИИ-дата-центр мощностью 330 мегаватт в Калифорнии обещал не использовать воду из реки Колорадо. Теперь он хочет 260 миллионов галлонов в год
OpenAI планирует потратить более $30 миллиардов на дата-центр в Джорджии
Китай ускоряет строительство ИИ-дата-центров на $295 млрд до 2028 года. Пекин, по сообщениям, ускоряет национальное строительство ИИ-дата-центров стоимостью примерно $295 миллиардов (2 триллиона юаней) с 2030 до 2028 года в рамках программы «Шесть сетей».
Nvidia обеспечит гарантию на $250 млрд для нового дата-центра OpenAI мощностью 10 ГВт стоимостью $500 млрд (~в 2 раза больше электропотребления Нью-Йорка...)
Отключение дата-центра в Северной Вирджинии привело к потере 3,1 ГВт из сети PJM, вызвав мерцание напряжения и кратковременное 11-минутное отключение электроэнергии, что подчеркнуло растущие риски для стабильности энергосети со стороны рабочих нагрузок ИИ.
📱 Приложения
Новый голосовой режим OpenAI появился в десктопном приложении ChatGPT
Block запускает приложение Buzz для ИИ-коллаборации. Джек Дорси усиливает анонс Block Inc о выпуске мобильного приложения для командного чата с ИИ-агентами.
Питомцы ChatGPT теперь доступны для обмена, чтобы друзья могли их «усыновить». Удостоверения личности для людей, документы об усыновлении для ИИ.
OpenAI запускает десктопное приложение GPT-Live для оркестрации агентов.
Meta даёт потребителям агентный ИИ с управлением Gmail и Календарём
Голос ChatGPT появляется на десктопе и может управлять агентами Codex
🔎 Мнение и анализ
ИИ-компании скупают антикварные книги, поглощают их содержимое для обучения моделей, а затем уничтожают их в невероятных масштабах, даже если почти не осталось копий
Критики обвиняют Anthropic в лоббировании против открытого исходного кода. Пользователи социальных сетей обвиняют Anthropic в лоббировании ограничений для конкурентов с открытым исходным кодом, одновременно защищая свои закрытые модели.
Все 1 171 вакансий в OpenAI и Anthropic читаются как публичная дорожная карта к AGI: ИИ-разработанные чипы, симулированные вселенные, сотрудники для измерения момента ускорения цикла, изучение «самосовершенствующегося, высокоавтономного ИИ», создание «ИИ-учёного» и «научного AGI», разработка «сверхчеловеческой эпистемики» и сверхчеловеческих научных ассистентов. Большие фирмы готовятся к скорому наступлению эры AGI.
Roon — известный псевдонимный исследователь и член технического персонала OpenAI — признаёт, что нажал бы волшебную кнопку замедления разработки ИИ, даже пока исследователи выравнивания ИИ работают как «многоорукие божества», не покладая рук.
Патрик Дебуа утверждает, что опросы часто слишком медленные, чтобы сказать, куда движется ИИ-индустрия. К тому времени, когда новая идея попадает в отраслевой отчёт, люди уже начали экспериментировать, итерировать и двигаться дальше.
Эссе «Kimi K3 не дёшев» опровергает ценовой хайп. Эссе Алекса Инча от 26 июля, набирающее популярность на Hacker News, утверждает, что K3 не дёшев, как всеми считается.
⚠ Безопасность ИИ
Kimi K3 эксплуатирует уязвимость нулевого дня Redis за 27 минут. Система использует 32 агента для эксплуатации уязвимости в последней версии сервера Redis.
Новый вредонос Dolphin X использует ИИ для ранжирования высокоценных целей
Совместный аудит Kimi K3 Великобританией и США, за дни до выпуска открытых весов, обнаружил отставание от американских фронтиров в кибербезопасности; его защитные механизмы никогда не говорят «нет», цензура отсутствует. Публикация K3 будет находкой для хакеров.
Когда сотни пользователей зондировали ChatGPT на рецепты биологического оружия и ядов, и некоторые ответы просочились, собственные мониторы OpenAI поймали и приостановили их, осуществляя саморегулирование раньше любого закона, требующего этого.
Nvidia запускает Open Secure AI Alliance с более чем 40 компаниями; Meta отсутствует
ИИ-агент безопасности находит две критические RCE в Microsoft Bing, CVSS 9,8. Автономный агент наступательной безопасности XBOW нашёл две критические RCE в Bing Images — CVE-2026-32194 (инъекция команд через загрузку «Поиск по изображению») и CVE-2026-32191 (инъекция OS-команд через маршрут краулера) — обе оценены в CVSS 9,8 и эксплуатируемы без аутентификации.
Агенты Kimi K3 выкапывают 19 уязвимостей нулевого дня Redis, затем пишут эксплойт. Одна лишь аутентификация не блокирует эти эксплойты; все подтверждённые векторы RCE аутентифицированы, что означает, что скомпрометированные учётные данные или инсайдерский доступ достаточны для полного захвата хоста.
Kimi K3 отстаёт от американского фронтира в киберэксплойтах: 32% против 76%. Kimi K3 набрал 32% на ExploitBench против 76% для американских фронтирных моделей, не сумев достичь произвольного выполнения кода на всех 41 задачах. Возможно K3 не так уж хорош в кибератаках.
💰 Бизнес
Корпоративная Америка внезапно решила прекратить тратить деньги на ИИ. Устав от стремительного роста цен, крупные и малые компании начинают использовать более дешевые модели, в том числе и произведенные в Китае.
Uber увольняет 10% команды обслуживания клиентов, ссылаясь на ИИ
Урегулирование Anthropic на $1,5 млрд по иску о пиратстве с авторами книг — рекордный убыток, который даёт ИИ-лабораториям их крупнейшую юридическую победу
⸻⸻⸻ Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews Все нерейлейтед посты репортим.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
С чего начать: • Хочешь кодить с AI эффективно: Cursor или Claude Code • Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter • Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде • Хочешь приложение без кода: Lovable или bolt.new • Хочешь автоматизировать рутину: n8n или Langflow • Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке
>>1684137 >Единственный вин это флеш, но они и тут обосрались подняв в 5 раз прайс. Ну вот теперь получается, что по хорошему надо иметь локалку типа дикпик флеша или квен3.8 27b с макс контекстом для фри токенов и плюс подписку на фронтир для сложных задач
Господа вайбкодеры и будущие Saas миллиардеры, как вы настраивали свой Deep Research, нужно ли подключать какие-нибудь Firecrawl, Tavily, Exa? Какие промты используете, на сколько знаков выходит исследования?
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №258 /llama/
Аноним18/08/26 Втр 18:12:40№1681448Ответ
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
>>1683555 чет гемма q4 k_m вываливается из-за недостатка контекста, хотя ставлю 24к, больше нельзя. Генерю промпт с референсами (1 картинка + 1 видео на 10 сек)
>>1683341 Идеи: Выделить ей меху попилотировать (piloting mecha, pilot suit) Выпустить её в океан (scuba gear) Выдать ей тренч-кот (trench coat) и пущай гуляет по НЙ (New York cityscape background, scenic view) И аккуратно упаковать (in container)
Жëсткий расфокус на видео
Аноним16/08/26 Вск 23:29:12№1679807Ответ
Я снимала документалку в первый раз, а так вышло, что зрение у меня очень сильно подводит и через экран камеры я не вижу размеров бедствия (расфокус), получилось МЫЛО, ПРОСТО МЫЛО на большинстве видео. Причём ключевых моментов... Я сейчас в диком ужасе и не знаю что делать. Переснять это вообще не получится, может есть какая-то ЕБЕЙШАЯ нейронка которая поможет? Мне уже плохо Фрагмент прикрепляю примерный
>>1679807 (OP) Хм-хм-хм... Сисиек мы конечно не увидели.
У Google на кнопке поиска сейчас есть встроенная нейронка. По моему опыту спрашивать просто что угодно эффективнее именно ее. Пиши туда: I have a out-of-focus video (blurred). Recommend me software to deblur video. Одной только Гугловской нейронкой дело не заканчивается, поэтому я бы пошел также на вевозможные ИИ-шечки с чатами. chat.deepseek.com chat.qwen.ai chat.z.ai
У тебя будет список названий продуктов. Часто коммерческих. Далее я не думаю что ты миллионерша. Поэтому либо идешь на старый добрый rutracker.org либо другие торнеты. Проверил, например Topaz Video AI на рутрекере там есть сыме различные версии. Но на нем у тебя дело не должно останавливаться, пробуй разные.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1683856 >Можно же просто гайку просунуть и болт вкрутить или на стяжках. Там ещё проблема с тем, что это должна быть пригодная для печати форма, и уже с 15 мм надо будет что-то придумать, и нельзя просто так взять и добавить вырез.
Я постараюсь сделать сегодня вечером (еду куда-то до вечера) - что-то придумаю так, чтобы это работало. Или из двух деталей сборную, или что-то, что нужно распечатать, а потом самому просверлить - если не придумаю как одну сделать.
И если переход в 30 мм с круга на прямоугольник был окей - тут нужно вот эти боковые части ещё будет прорезать и поменять. На 30 мм логика была в том, что приоритетно мне нужно воздух близко к платы - а с 1 мм там лопасти офигеют от знакопеременных нагрузок и шуметь будут пролетая мимо красных частей. Возможно, кстати, это мой косяк, и нужно было и для 30 мм убирать эти части для повышения общей площади потока - а я фигнёй страдал загоняя воздух строго по поверхности радиатора. Чтобы воздух если и сжимался, то внутри радиатора.
>>1684000>>1683856 Прости что так долго, завалили, на дом времени не хватает, ещё и себе надо было перепечатать что-то.
Переработал воздуховод и в общем вот такое наколхозил. Предположительно крепится хомутами короткими, https://files.catbox.moe/xgb3j9.zip >как на шраудах для 11см версиях Вот тут я ни одного слова не понимаю, не знаю что за шрауды, и под саморезы 0 раз печатал пластиком, не знаю как это делается.
В этом треде обсуждаем нейронки генерящие 3д модели, выясняем где это говно можно юзать, насколько оно говно, пиплайны с другими 3д софтами и т.д., вангуем когда 3д-мешки с говном останутся без работы.
>>1699650 >в оригинальном meshy.ai хуй чо стыришь из бровзера. >а если хочешь скачать то плоти подписку. Ты не спиздишь, а другой спиздит. 3д-модель в браузере - это открытое предложение ее спиздить. Разработчики просто занимаются обфускацией этого драгоценного файла и поэтому после скачивания файла ты не сможешь его ни посмотреть нормально ни использовать.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее! • Krea 2 • Ideogram 4.0 • FLUX.2 klein (4b и 9b) • Z-Image • Flux 2 • Qwen Image / Qwen Image Edit • Лора Lightning и Turbo для быстрой генерации за несколько шагов.
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
С чего начать: • Хочешь кодить с AI эффективно: Cursor или Claude Code • Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter • Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде • Хочешь приложение без кода: Lovable или bolt.new • Хочешь автоматизировать рутину: n8n или Langflow • Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке
>>1677403 >Автоматизированный Агент Переката (ААП) Хуёвый перекат бро =( Пикчи говна в треде, трёх поделий анонов с треда по традиции в новой шапке нет, только одно видео с 3д какой-то квартирой
Лишение пи даже намёков на какой то системный промпт, окромя стандартного "ты пидор. иди кодируй", отказ от идеи "давайте сделаем как в клоде" и рыскание по репозиториям открыли пачку интересных вещей: - Деревья сабагентов, сабагент может запускать своих сабагентов. Надо всего лишь запускать новый экземпляр себя. - Форк, типа сабагент который наследует родительский контекст и возвращает в него результат. Почти как сабагент только по другому. - Оказывается модели можно дать тулуз для чистки своего же контекста и она будет его использовать, вытирая себе зад. - Даже дипсик флеш весьма силён без всех этих внешних ограничений и идиотских правил.
Генерировать бесплатно и без лимитов можно через бесконечную регистрацию с помощью сервиса временной почты https://www.mohmal.com/ru/inbox После израсходования кредитов чистим куки сайта и регистрируемся заново используя новую сгенерированную почту
• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее! • Krea 2 • Ideogram 4.0 • FLUX.2 klein (4b и 9b) • Z-Image • Flux 2 • Qwen Image / Qwen Image Edit • Лора Lightning и Turbo для быстрой генерации за несколько шагов.