В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
1. Suno https://suno.com/ Вышла версия 5.5 (но для тех кто платит денюшку), качество моделей постепенно улучшается: звук, понимание концепций, набора различных жанров. Но в то же время все сильнее урезается для бесплатных юзеров: осталось только 5 бесплатных генераций в день на аккаунт, а также по заявлением некоторых анонов, модель для генерации на бесплатке (на момент создания треда использовалась 4.5) ухудшили. Спам аккаунтами пока что работает. Купить подписку из РФ: 1. https://payment.mts.ru/tools/suno-ai 2. https://plati.market/games/suno-ai/1701/
2. Tunee https://www.tunee.ai Хороший звук, более-менее понимание концептов, но тоже сильно урезан для бесплатных юзеров: режет концепты в промптах, плюс произвольно определяет "цену" за каждую генерация исходя из какой-то "сложности запроса". И получается, что если с бесплатки забацаешь промпт сложнее банальщины "Make cool rock about love for youtube" он может решить что у тебя нет кредитов для такого сложного запроса и пошлет нахуй. Способов оплаты из РФ неизвестно.
3. Sonauto https://sonauto.ai/ Как по мне, недооценённая вещь, особенно учитывая что недавно он обновился до 3.0, который очень даже разъебывает. Но он тут более ограничен тегам и понимает чисто какие-то жанровые теги, гибкости поменьше. Но зато пока что халявный и не ограничен кредитами, генерируй пока есть настроение.
ACE-STEP 1.5XL: https://github.com/ace-step/ACE-Step-1.5 [есть в шаблонах comfyui+] Звук уже на уровне раннего Suno ~2.0-3.0, аноны делают на нем уже приемлемые результаты и постят в тред. Если есть хотя бы 12 GB VRAM и хочется генерировать без цензуры и подписок - можете юзать. Идеально подходит для отладки перед использованием на коммерческих генераторах. В XL версия DIT модель разжирела до 4b параметров и стала чутка вменяемее. Стоит учесть то чтобы добится вменяемого звучания одними тэгами отъебатся не получится, `caption` требует качественного промпта символов на 200. В ComfуuUI реализован только text2music функционал. Для полного функционала надо накатывать полноценный бэкеннд из репозитория. Есть несколько кривеньких вариаций локальных студий как в коммерческих моделях - https://github.com/ace-step/awesome-ace-step#uis-and-studios VST плагины итд.
HeartMuLa https://github.com/HeartMuLa/heartlib Результат примерно на уровне ACE-STEP1.5 (не XL). Статус проекта непонятен, пока ебут вола. Из плюсов - меньше песочит на верхних частотах. Есть встроенный STUDIO UI.
YuE https://github.com/multimodal-art-projection/YuE Первая локалка на которой можно было хоть что то сделать. Жрёт VRAM как не в себя, работает медленно, звук как совсем ранее suno. Ссылка оставлена чтобы любопытсвовать насчёт новых версий.
StableAudio https://github.com/Stability-AI/stable-audio-3 [есть в шаблонах comfyui+] Делает звук. Подходит для создания сэмплов FX, ad-libs итд. Абсолютно не может в членораздельную речь. Может сделать что то похожее на музыку. v3 наглухо зацензурена, стоны и вопли можно делать на v1.
МЁРТВЫЕ КОММЕРЧЕСКИЕ ГЕНЕРАТОРЫ
1. Udio (udio.com) - куплен Warner Bros, но затем сами Warner Bros сдали назад и откатили сделку. Но уже успели испортить, больше нельзя скачивать треки, их только доставать из буфера в 160 кбит/с. Плюс непонятно как работающая цензура, которая не дает генерировать треки с определенными тегами. Плюс уже год ебут один и тот же 1.5 allegro. 2. Riffusion, Producer.ai (producer.ai) - куплен гуглом, удалены все старые относительно норм модели, вместо этого запихали безальтернативную каловую модель, которая и промпты сложнее самых нормисных в духе "make cool rock about love" не понимает, и вокал смазывает в какую-то кашу. При этом еще и максимально дегенеративная цензура, которая режет чуть ли не любые попытки сделать просто что-то не попсовое и не "музыку для ютуб".
ПРОЧИЕ ПОЛЕЗНЫЕ УТИЛИТЫ
1. https://www.bandlab.com/mastering Быстрый мастеринг в две кнопки, если хочешь чтобы звучало более слушабельно, но не имеешь навыков в DAW или аудиоредакторах (или лень). 2. https://morpher.ru/accentizer/ Если генерируешь музыку с лириками на русском, то очень часто случается, что твой генератор путает ударения в словах. Прежде чем пихать свою графоманию в генератор, проставь ударения в сервисе по ссылке. И уже из этого сервиса копируй текст в генератор. По крайней мере в Suno это помогает.
У нас тут только нубы и творцы сидят и не занимаются такой хернёй, а с таким вопросом к нам в месяц по трое приходят ( или возможно это всё был ты же )
>>1680098 >>1680101 недооцененные посты. в первом блоке рофельный трек и один прикольный нью метал(?) во втором блоке все хороши, плотный такой звук в 3м
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
Почему у меня нейронка отказывается генерить залупы? У при вставлении/вытаскивании потешный обрубок без шляпы, генерация с конечным фреймом. Модель не понимает чтоли как хуй выглядит и надо хуевую обучающую лору? Хотя у меня нсфв модель.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
>>1676535 Не, в данном случае пиксели не при делах. Победил в итоге проблему и на длинных и на коротких дистанциях правильным промптингом. Вообщем вариации пёзд у Минимакса по умолчанию явно хромают, поэтому на старте дал максимально точное описание, примерно тот же способ как советовали парню который рисовал члены, задать ему десяток разных параметров (а я квену скормил в llm скрин референса киски, и он мне там расписал откуда что изгибается какой формы куда какие складки накладываются) запихнул это в промпт как реф и потом жосско везде прописал после любых движений preserve блабла источник пизды из пикчера. Тут ещё особенности инглиша повлияли, например если применять выражение maintain .. "что-то", которое казалось бы тоже должно говорить модели поддерживать консистентность этого "что-то", то он работает намного слабее если писать preserve .. "что-то", именно вот это слово в большинстве случаев прекрасно фризит любой референс.
>>1675921 Мне обидно. Я ещё с 1.5 сидел. У геминьки, не смотря на слоп, нормальный токенайзер на русике и фразы не такие сухие, есть понимание слэнга. Для РП заебись. Тот же GLM излишне соевый. Хуй теперь знает на чём сидеть, дипсик походу.
>>1675930 Гемени была бы хороша, если бы не клишировала персонажей. У меня она серую мораль неизменно все же кренит то в одну, то в другую сторону. Дипсик же плох в слоуберне и нет мозгов как у гемени. Однако в дум выбирать не приходится
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №255 /llama/
Аноним08/08/26 Суб 19:09:25№1671563Ответ
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1674087 Падажжи, из того, что я знаю, серверные GPU типа cmp170 должны охлаждаться постоянным напором воздуха из оглушительно свистящих турбин, иначе они тут же тротлят и перегреваются. Или есть лайвхаки с СЖО охладом?
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
попробовал ref2va, все почти хорошо только сиськи лезут, лол. походу триггерится на [Shot 5]: The frame changes quickly into - focus on the breasts of a this girl
p.s. спасибо анону за тикток промпт, моар еще универсальных промптов
Вы надоели, придумайте уже нвоый сюжет с сисько стримершей, чтоб она за донаты песни Визарькова пела и в камеру пердела для домашнего задания например.
Агентов и вайб-кодинга тред #17 /agents/
Аноним01/08/26 Суб 11:46:20№1665577Ответ
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
С чего начать: • Хочешь кодить с AI эффективно: Cursor или Claude Code • Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter • Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде • Хочешь приложение без кода: Lovable или bolt.new • Хочешь автоматизировать рутину: n8n или Langflow • Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке
>>1671595 > Пиздец, ты просил показать скиллы чтобы покритиковать? Нет, я просто увидел нашумевший в треде ИКЕЯ скилл и мне была интересна имплементация, че да как
Открываю, а там 25 абзацев хуй пойми чего.
Как-то не тянет на ИКЕЯ не находишь? Собсна говоря чисто по этому и попросил разобрать то, как ИИшки обычно генерируют скиллы по запросу "а сделай мне скилл". Там всегда 25 абзацев мусора вместо передачи сути кратко.
Еще модель любит туда досрать деталей которых не было в основном запросе.
Сомневаюсь, что чел давая задачу нахуячить IKEA скилл думал, что ему нужны секции "делай заебись, а не заебись не делай" х5 раз, дефолтные ошибки которые БЛЯДЬ НИКТО НЕ СОВЕРШАЕТ УЖЕ 11 ЛЕТ, вместо фактических пожеланий че как и куда. Де факто скилл запрещает вложенность глубже 1ой папки, запрещает цепочки функций длинней 1 (т.е. применим адекватно только если модель активно игнорирует инструкцию описанную в этом же блядь скилле), и дублирует то, что модели делают без дополнительных деталей. Тот же сик флеш никогда не срёт функциями которые принимают больше агрументов чем нужно, а тут это целый пункт!
> покритиковать Поинт в том, что если ты просто говоришь сделай "икея скилл" то у тебя выйдет скилл-слоп, типа "топ 128 скиллов дизайнера этой недели" с содержимым ИИ статья с повторениями и абстракциями абы набрать 1200 строк для солидности.
Я все же верю в больший handcraft скиллов и то, что они должны хотябы неплохо отражать че именно хотел автор и желательно быть доработанными. Да даже 1 раз позвать ту же модель что его написала, чтобы она критически его проанализировала и доработала было бы неплохо. Поинт в этом.
По пожеланиям анону: Звать в другой сессии другую модель (или субагент колл) чтобы он обосрал + доработал дизайн скилла который ты только что испек. С первого раза модели делают скилл-слоп за которым не видно идею предлагая просто фантастически магические примеры которые можно только придумать, но не найти.
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №254 /llama/
Аноним04/08/26 Втр 18:18:53№1668203Ответ
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее! • Krea 2 • Ideogram 4.0 • FLUX.2 klein (4b и 9b) • Z-Image • Flux 2 • Qwen Image / Qwen Image Edit • Лора Lightning и Turbo для быстрой генерации за несколько шагов.
Пишу как неведомый в ИИ вам за советом. Использовал грок для создания NSFW контента, а именно генерация картинок и их анимация. Подскажите, есть ли аналоги для подобного функционала или же обход цензуры в грок
Сап, нейрач. Пару месяцев назад начал вайб кодить через claude code используя их десктоп приложение. Но постоянно бан прилетает на аккаунты. Аккаунты свои были, первые два бана покупал подписку через плати.сру, под конец месяца бан прилетал. В третий раз оплатил виртуальной картой, бан через неделю. Квн обмазался платным, подключался к одному серверу, но ip все равно менялся. Щас при покупке подписки уже верификацию просит. Пробежался по треду ai агентов и чувство, что у всех все классно. Есть те кто с банами сталкивался? Что помогло?
>>1670281 >Из-за массового сбора данных Anthropic и другие лаборатории начали внедрять жесткие проверки (вплоть до селфи и паспортов) для доступа к своим продвинутым API Сингулярность.
>>1669841 Имею в виду, когда берёшь конец (последний кадр) и делаешь продолжение. Главное чтобы персонажи не менялись между сценами (для этого можно применять рефы), и чтобы звук был консистентным без резкой смены. Старый грок говнил дизайны персонажей (форму лица и детали), хз как сейчас.
Я щитаю, что делать кино куда интереснее, чем картинки! Можно представить что делаешь трейлер или тизер для своей оригинальной видеоигры: графон, стилизация, эффекты, работа камеры, экшн, моушн, боевые мувы и спеллы, крутые дизайны, сценери, лор вымышленной вселенной, разные монстры и данжи, всё это под бодрую музычку. Хотет делать видосы по своему собственному Dark Souls.
>>1669521 (автор этого псто за 12 часов но этого сообщения порезал себе палец об консерву из-за кривой открывашки и попыток открыть недораскрывшуюся банку ножом)
Ребята,как думаете,сможет ли ии делать к концу 2030 годов такие картинки,что каждый сможет поверить?
Аноним01/08/26 Суб 20:38:13№1665986Ответ
>>1667488 Монитор по мне смотрится вполне правдоподобным, пусть даже чуть нелепые кнопки, но не сильно уходят от того, что бывало, больше по другим моментам претензии серьёзные, по столам, например.
>>1669870 Ну и в итоге только на первом пике 14", и у него на самом деле совсем не такая огромная рамка снизу на пикрел если также прямо смотреть. Остальные 15" и больше. Этот сгенеренный уродец еще и не 4:3, это вообще фиаско.
>>1670155 По мне мониторы выглядят правоподобно. К слову они смотрятся больше, чем на 14 дюймов, скорее на 17. Принципиальные косяки другие, то же отсутствие системных блоков. Косяки с мебелью, если пытаться понять, как там ножки выглядят и где у какого стола его ножки.
Смысл шизовый у картинки, почему так рандомно разбросаты столы, что за ними невозможно сидеть, даже к компам подобратья невозможно, при этом компьютеры включены. Один стол поверх другого, хотя модель одинаковая и высота должна быть одинаковая, но главное, что за бред сам по себе?
Если ты ставишь задачу придумать картинку, что от настоящей не отличишь, то тебе надо брать в качестве референса реальное оборудование, конкретные модели, реальную мебель. Должен быть какой-то смысл у картинки, а не каша из столов, как здесь.
Чем сейчас лучше переводить?
Аноним06/08/26 Чтв 23:40:05№1670054Ответ
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw
Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985
Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.
>>1665796 Да конечно стоят, ниче хардкорного но и всегда будет до чего докопаться, не в промпте так в карточке. Но тут как бы весь смысл в парадоксе, карточка должна быть для кума, а иначе и батю отыгрывать не интересно. Во всякую ваниль я еще со старой гпт наигрался