Главная Юзердоски Каталог Трекер NSFW Настройки

Искусственный интеллект

Создать тред Создать тред

Раздел для обсуждения нейросетей и всего, что с ними связано.

Для доступа в /nf/ писать сюда

<<
Каталог
Stable Diffusion тред X+203 /sd/ Аноним 26/08/26 Срд 11:35:07 № 1687558 Ответ
178761124361508[...].png 3234Кб, 1920x1088
1920x1088
178740103116803[...].png 2183Кб, 1344x1024
1344x1024
178733932862001[...].jpg 536Кб, 1216x832
1216x832
178749892606706[...].png 2139Кб, 1600x1216
1600x1216
Тред локальной генерации

ЧТО НОВОГО АКТУАЛЬНОГО

• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее!
• Krea 2
• Ideogram 4.0
• FLUX.2 klein (4b и 9b)
• Z-Image
• Flux 2
• Qwen Image / Qwen Image Edit
• Лора Lightning и Turbo для быстрой генерации за несколько шагов.

База:
→ Приложение ComfyUI https://comfy.org/
→ Примеры https://comfyui-wiki.com/ru (откуда, куда, как)
→ Модели https://civitai.red/

► Предыдущий тред >>1681279 (OP) (OP) ► https://arhivach.hk/?tags=13840
Дополнительно: https://telegra.ph/Stable-Diffusion-tred-X-01-03
Пропущено 619 постов
236 с картинками.
Пропущено 619 постов, 236 с картинками.
Аноним 04/09/26 Птн 18:56:22 № 1695571
Аноним 04/09/26 Птн 19:03:06 № 1695577
>>1695567
Она ёрзает, вырывается.
Аноним 06/09/26 Вск 13:03:41 № 1697244
>>1694159
>Кому ты пиздишь скилишуйный фантазер? Сдхл с приемлемым качеством вышла в 23, модели типа натвиса в 2024. В 18 году ты максимум мог на рандомные ебала в университетском пиндосском проекте дрочить и на котиков.
Какой же ты долбоеб, просто пиздец, лол.

Мимо
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №262 /llama/ Аноним 31/08/26 Пнд 18:09:53 № 1692081 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
IMG202602141648[...].jpg 7129Кб, 4624x3472
4624x3472
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1689903 (OP)
>>1687604 (OP)
Пропущено 520 постов
78 с картинками.
Пропущено 520 постов, 78 с картинками.
Аноним 05/09/26 Суб 11:17:17 № 1696169
Я удивляюсь, насколько хорошо Qwen3.8 27B делает веб-дизайн.
Как вообще в такую маленькую модель, да еще и квантизированную помещаеться такое чувство красоты?!
Аноним 05/09/26 Суб 11:21:49 № 1696173
>>1696169
Ты понимаешь что такое 27B и насколько это неадекватный размер, который с запасом может включить всё содержимое всех энциклопедий и документация всех сущесвующих в природе программ + их код?
Это просто пока кпд 2%, не научились это сохранять. Скоро и 2B модель будет всё это делать.
Аноним 06/09/26 Вск 23:33:03 № 1697702
>>1696169
Это ты еще не видел, когда она на xhigh глюканет и несколько длинных циклов прокрутит. Тогда результат выходит раза в 3 лучше, чем даже если промптить ее несколько раз подряд. С низкоквантовыми кстати чаще случается такое.
Минусинструментал из трека Аноним 25/08/26 Втр 21:15:47 № 1687203 Ответ
w2LmNCtRx7o.jpg 101Кб, 800x495
800x495
Сап, анончик. Как сделать максимально ЧИСТЫЙ и КАЧЕСТВЕННЫЙ минус из трека? Юзал Ultimate Vocal Remover, # MelBandRoFormer Audio Separation, паршиво выходит. Посоветуй, позязя.
Пропущено 4 постов
1 с картинками.
Пропущено 4 постов, 1 с картинками.
Аноним 28/08/26 Птн 16:18:55 № 1689564
>>1689558
Если микс получается глуховат, можешь через iZotope Ozone прогнать в ФЛке, хотя это лучше делать после наложения голоса.
Аноним 01/09/26 Втр 08:18:31 № 1692416
>>1687203 (OP)
Гачи-ремиксы делаешь, жополаз?
sage 02/09/26 Срд 08:05:53 № 1693152
Локальной генерации ИИ-видео №16 /video/ Аноним 28/08/26 Птн 12:50:30 № 1689364 Ответ
MiniMaxH300321.mp4 3045Кб, 1280x736, 00:00:15
1280x736
Минимакс 3-37.mp4 6022Кб, 1878x1080, 00:00:10
1878x1080
00002.mp4 12271Кб, 960x544, 00:00:39
960x544
178784055089900[...].mp4 4445Кб, 480x854, 00:00:28
480x854
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-2-preview от Sand AI

https://sand.ai/magi
https://huggingface.co/sand-ai/MAGI-2-preview

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1685560 (OP)
Пропущено 527 постов
136 с картинками.
Пропущено 527 постов, 136 с картинками.
Аноним 01/09/26 Втр 16:42:55 № 1692693
>>1692186
>>1692172
Была там ссылка, пиздоболка дешевая. Я же тебе еще тогда ебалом потыкал, как октенка надриставшего, а ты потом молча слился. Хули ты щас то трясешься?
Кат №17 Аноним # OP 01/09/26 Втр 17:28:31 № 1692725
Аноним 02/09/26 Срд 00:35:53 № 1693043
>>1692693
Покажи на скрине где там ссылка, крыса.
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №261 /llama/ Аноним 29/08/26 Суб 00:09:27 № 1689903 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
изображение1.png 2568Кб, 2540x2136
2540x2136
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1687604 (OP)
>>1684266 (OP)
Пропущено 501 постов
70 с картинками.
Пропущено 501 постов, 70 с картинками.
Аноним 31/08/26 Пнд 17:57:04 № 1692075
>>1692064
А прорыва по стилю письма со времен мистраля 24б до сих пор нет...

Проще уж мистраль на ризонинг обучить, чтоб мозгов прибавилось, чем ждать очередного прихода чуда.
Аноним 31/08/26 Пнд 18:00:03 № 1692077
>>1692075
А ты поищи, может и есть такие. Милфу мистраль точно пробовали дообучать, там даже несколько тюнов с ризонингом было, как я помню
ПЕРЕКАТ Аноним # OP 31/08/26 Пнд 18:12:19 № 1692082
Хелп Аноним 30/08/26 Вск 15:18:56 № 1691045 Ответ
Кошкожена.jfif 227Кб, 1024x1024
1024x1024
Хочу запустить модель через питона, но локально мой хром нихуя не тянет. Всё бесплатное и что может общаться без фильтра - заблочено в РФ, впн не спас. Может знает кто варианты? Чисто для общения, TTS и STT уже подготовил. Мне нужно фулл бесплатное решение и без тупых фильтров
Агентов и вайб-кодинга тред #20 /agents/ Аноним 22/08/26 Суб 16:23:13 № 1684518 Ответ
.jpeg 18Кб, 800x533
800x533
.png 1146Кб, 3827x1991
3827x1991
.png 5740Кб, 3691x1751
3691x1751
.png 5023Кб, 2224x10984
2224x10984
.png 293Кб, 2555x1343
2555x1343
.jpg 256Кб, 1080x1534
1080x1534
.png 358Кб, 979x692
979x692
.png 1642Кб, 1628x966
1628x966
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.8 27B, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google/
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Antigravity CLI: https://antigravity.google/product/antigravity-cli
• Pi: https://shittycodingagent.ai/
• DeepSeek Harness: https://github.com/deepseek-ai/deepseek-harness
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1684266 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1677402 (OP)
Пропущено 1037 постов
150 с картинками.
Пропущено 1037 постов, 150 с картинками.
Аноним 30/08/26 Вск 13:06:27 № 1690914
>>1690789
1. Не использовать гермес
Это даже не нубтрапа. Гермес это буквально 4х жрущий токенов агент. Форменная парашаэ


Лично я советую попробовать cli агенты и не лезть в категорию агентов для домохозяек, т.к. они справляются с задачами тупо хуже при большем жоре. opencode норм
Аноним 08/09/26 Втр 20:04:07 № 1699357
00008-473859497.png 490Кб, 512x512
512x512
Мой первый SOSAL!
Довольно часто мой харнес умирал без каких-то видимых причин. И в результате расследования было выяснено, что агенты периодически убивали друг друга и сами себя. Особенно часто этим занимался ГЛМ.

Так и родилась вот эта часть AGENTS.md по предотвращению суицида?:

]## ⚠️ Process safety (ОБЯЗАТЕЛЬНО)
На этой машине параллельно запущено несколько сессий OpenHands в разных проектах
(`key_search`, `solver`, `assistant_ai` и др.) под одним пользователем. Каждый процесс
`python.exe` может быть чужой сессией — её рантаймом или терминалом.

ЗАПРЕЩЕНО «чистить» процессы широким фильтром:
- ❌ `taskkill /IM python.exe /F` — убьёт все сессии, включая соседние.
- ❌ `taskkill /PID <любой PID из tasklist> /F` по незнакомым PID — то же самое.
- ❌ `Stop-Process -Name python` / `pkill -f python` — массовое убийство.
- ❌ Убивать процессы, которые ты сам не запускал в этой сессии.

Можно:
- ✅ Завершать только процесс, который ты сам породил в текущей команде, и чей PID
тебе известен точно (например, из `$proc = Start-Process ... -PassThru`).
- ✅ Использовать `--timeout` в команде вместо ручного убийства зависшего процесса.
- ✅ Для тестов — `pytest -x --timeout=60` (плагин pytest-timeout), а не taskkill.

Почему это важно: один `taskkill /PID ... /F` по «stale python procs» уже убил все
3 параллельные сессии одновременно. Это и есть причина «краша всех процессов», а не
miniproxy/LLM. Если процесс завис — прерывай его `C-c` через терминал, а не taskkill.
Аноним 12/09/26 Суб 06:29:56 № 1702263
Нет
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №260 /llama/ Аноним 26/08/26 Срд 12:45:48 № 1687604 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
изображение.png 1193Кб, 918x1269
918x1269
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1684266 (OP)
>>1681448 (OP)
Пропущено 579 постов
102 с картинками.
Пропущено 579 постов, 102 с картинками.
ПЕРЕКАТ Аноним # OP 29/08/26 Суб 00:12:02 № 1689908
Аноним 29/08/26 Суб 02:25:15 № 1689961
>>1689796
Почему размотальщик уверен в том, что окна не могут быть С ОДНОЙ стороны дома и дом может находиться в ЛЮБОМ месте?
Аноним 29/08/26 Суб 09:00:13 № 1690042
>>1689871
>Да жопой она ебёт.
За это и любим.
Локальной генерации ИИ-видео №15 /video/ Аноним 23/08/26 Вск 17:36:18 № 1685560 Ответ
video.mp4 19483Кб, 1792x2368, 00:00:08
1792x2368
bath.mp4 7239Кб, 1280x1280, 00:00:05
1280x1280
KOLOBOK — What [...].mp4 9109Кб, 854x480, 00:00:05
854x480
Minimax5.mp4 8376Кб, 614x480, 00:01:23
614x480
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-2-preview от Sand AI

https://sand.ai/magi
https://huggingface.co/sand-ai/MAGI-2-preview

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1683622 (OP)
Пропущено 523 постов
122 с картинками.
Пропущено 523 постов, 122 с картинками.
Аноним 30/08/26 Вск 09:38:25 № 1690805
>>1689800
>Вот типичные H3
Да типичные, тестовые генерации для проверки работоспособности тех или иных аспектов, сделанные на 4х шагах в низком разрешении.

>наглядно попробовал повторить это в H3 и вышел ожидаемый пиздец
Наглядно попробовал повторить на 8 шагах, в низком разрешении, с промптом написанным за минуту нейросеткой, с первми попавшимися референсами из гугла. Без дрочения сида. Где на первых кадрах с мужиком качество неотличимо от исходного видео.
Аноним 30/08/26 Вск 11:17:01 № 1690834
>>1690805
Да хоть на миллион шагов в 2к с промптом от профессора литературы. У H3 типичные для него артефакты везде. Их нет только на относительно статичных видео.
Аноним 02/09/26 Срд 09:14:05 № 1693169
круто
Как генерятся видосы без глюков? Аноним 28/08/26 Птн 09:26:56 № 1689227 Ответ
m2-res1280p.mp4 4181Кб, 720x1280, 00:00:25
720x1280
Длиннннннннные такие
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №259 /llama/ Аноним 22/08/26 Суб 07:17:43 № 1684266 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
178565282262809[...].png 1841Кб, 960x1280
960x1280
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1681448 (OP)
>>1678431 (OP)
Пропущено 511 постов
82 с картинками.
Пропущено 511 постов, 82 с картинками.
ПЕРЕКАТ Аноним # OP 26/08/26 Срд 12:46:10 № 1687605
Аноним 27/08/26 Чтв 08:45:00 № 1688454
>>1686975
Ну во первых да, такой экспириенс тебе без иронии никто больше не даст. Который год не отпускает.
Во вторых некоторую хуйню я корпам писать точно не буду уж очень они сосут данные нагло, просто пиздец.
Ну и типа ИИ у тебя на видимокарточке. Дома. Про такое даже фантасты не писали моветон нереалистично считалось, а оно вон оно как.
Аноним 29/08/26 Суб 20:43:44 № 1690509
Безымянный.jpg 583Кб, 2268x1676
2268x1676
>>1687346
>Ого, в таком случае реквестирую вариант чтобы край вентилятора был выровнен по одной из плоских сторон видеокарты, а остальное цетром, такое возможно? С меня как всегда.
Вот. На картинке схемы.
Прости что я такая копуша, у меня просто беды с башкой и я раньше не был в состоянии сделать, хотя там и на пять минут.
https://files.catbox.moe/ljbb70.7z
Stable Diffusion тред X+202 /sd/ Аноним 18/08/26 Втр 15:09:13 № 1681279 Ответ
image.png 3187Кб, 1536x2304
1536x2304
image.png 9752Кб, 4352x1792
4352x1792
image.png 2342Кб, 1064x1416
1064x1416
image.png 2070Кб, 1536x1152
1536x1152
Тред локальной генерации

ЧТО НОВОГО АКТУАЛЬНОГО

• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее!
• Krea 2
• Ideogram 4.0
• FLUX.2 klein (4b и 9b)
• Z-Image
• Flux 2
• Qwen Image / Qwen Image Edit
• Лора Lightning и Turbo для быстрой генерации за несколько шагов.

База:
→ Приложение ComfyUI https://comfy.org/
→ Примеры https://comfyui-wiki.com/ru (откуда, куда, как)
→ Модели https://civitai.red/

► Предыдущий тред >>1672190 (OP) ► https://arhivach.hk/?tags=13840
Дополнительно: https://telegra.ph/Stable-Diffusion-tred-X-01-03
Пропущено 507 постов
200 с картинками.
Пропущено 507 постов, 200 с картинками.
перекат: Аноним 26/08/26 Срд 11:37:37 № 1687559
Аноним 26/08/26 Срд 11:57:15 № 1687569
>>1687094
Давно не интересовался редактированием, это такое сейчас умеет Klein? Вроде раньше был Qwen 2511 лидер в этом.
Аноним 19/09/26 Суб 18:22:08 № 1708128
/nf
Как заработать денег на Ии Аноним 17/08/26 Пнд 00:29:44 № 1679849 Ответ
grok17869156306[...].jpg 580Кб, 832x1248
832x1248
Используя нейросеть для написания текста песен и всякой нерохрючева
Сидишь пердишь пьёшь пиво играя генши
Аноним 25/08/26 Втр 20:40:16 № 1687189
...
Новости об искусственном интеллекте №78 /news/ Аноним # OP 27/07/26 Пнд 17:25:40 № 1661396 Ответ
image 927Кб, 2816x1584
2816x1584
image 2731Кб, 1536x1024
1536x1024
image 2759Кб, 1448x1086
1448x1086
В этот тредик скидываются свежие новости по теме ИИ!

Залетай и будь в курсе самых последних событий и достижений в этой области!

Прошлый тред: >>1650077 (OP)

Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.

🚀 Последний обзор ИИ новостей:

📰 Главные новости ИИ

Отключение дата-центра в Северной Вирджинии вывело 3,1 ГВт из сети PJM, спровоцировав региональные просадки напряжения и подчеркнув необходимость создания ИИ-объектов, готовых к работе с энергосетью.

Предприниматели, которые развивали ИИ на критически важных бизнес-узких местах с высоким рычагом воздействия, получили сверхприбыль, включая чистое повышение прибыльности на $40 млн благодаря ИИ и выход соло-основателя на $80 млн.

🛠 Инструменты для разработчиков

Sakana AI добавляет интерфейс Claude Code в Fugu-Ultra v1.1

Anthropic удалила 80% системного промпта Claude Code, поскольку новые модели процветают на суждениях, а не на правилах.

Переписывание Bun на Rust достигло ~$800 тыс. и 2 475 открытых PR без релиза

📦 Продукты

Google Gemini приближается к рубежу в миллиард пользователей

Платформа ИИ-обучения Synthesia выходит за рамки видео в живой коучинг

Claude Cowork записывает экраны пользователей для создания пользовательских навыков автоматизации.

💻 Оборудование

Anthropic обратилась к SK Hynix за поставками для производства собственных чипов, поразив председателя SK.

🔓 Открытый исходный код

Модели Google Gemma превысили 900 миллионов загрузок. Семейство LLM с открытыми весами от Google DeepMind достигает широкого распространения среди разработчиков и исследователей.

OpenCode достигает 13 миллионов пользователей и $40 млн выручки. Платформа для программирования с ИИ с открытым исходным кодом демонстрирует быстрое принятие после ограничений конкурентов.

Китайская Moonshot выпустит прорывную ИИ-модель для загрузки. Moonshot AI готова сделать свою модель Kimi K3 доступной для публичной загрузки. Moonshot опубликует открытые веса Kimi K3 объёмом 1,4 ТБ в воскресенье

🧪 Исследования

США представляют миссию Genesis стоимостью $5 миллиардов для развития науки с помощью ИИ

ARC Prize присудил новый SOTA Opus 5 на ARC-AGI-3 с результатом 30,2%, вчетверо превышающим прежний лучший результат, после того как модель превратила макеты головоломок в уравнения рефлексии — впервые в истории.

Работники пересекают границы должностей с помощью ИИ, показывает исследование OpenAI

Слайды Теренса Тао «Математика в эпоху ИИ» попали в новости. Лауреат Филдсовской премии Теренс Тао опубликовал слайды своей публичной лекции на ICM 2026 о математике в эпоху ИИ.

Альтман представит Белому дому модель OpenAI, решающую задачи Эрдёша.

Исследование Стэнфорда: безработица среди выпускников достигает 5,6%, поскольку ИИ затрагивает позиции начального уровня. Работники на раннем этапе карьеры в возрасте от 22 до 25 лет в наиболее подверженных ИИ профессиях демонстрируют примерно 13-процентное относительное снижение занятости с момента запуска ChatGPT в 2022 году.

⚙ Инфраструктура

Предлагаемый ИИ-дата-центр мощностью 330 мегаватт в Калифорнии обещал не использовать воду из реки Колорадо. Теперь он хочет 260 миллионов галлонов в год

OpenAI планирует потратить более $30 миллиардов на дата-центр в Джорджии

Китай ускоряет строительство ИИ-дата-центров на $295 млрд до 2028 года. Пекин, по сообщениям, ускоряет национальное строительство ИИ-дата-центров стоимостью примерно $295 миллиардов (2 триллиона юаней) с 2030 до 2028 года в рамках программы «Шесть сетей».

Nvidia обеспечит гарантию на $250 млрд для нового дата-центра OpenAI мощностью 10 ГВт стоимостью $500 млрд (~в 2 раза больше электропотребления Нью-Йорка...)

Отключение дата-центра в Северной Вирджинии привело к потере 3,1 ГВт из сети PJM, вызвав мерцание напряжения и кратковременное 11-минутное отключение электроэнергии, что подчеркнуло растущие риски для стабильности энергосети со стороны рабочих нагрузок ИИ.

📱 Приложения

Новый голосовой режим OpenAI появился в десктопном приложении ChatGPT

Block запускает приложение Buzz для ИИ-коллаборации. Джек Дорси усиливает анонс Block Inc о выпуске мобильного приложения для командного чата с ИИ-агентами.

Питомцы ChatGPT теперь доступны для обмена, чтобы друзья могли их «усыновить». Удостоверения личности для людей, документы об усыновлении для ИИ.

OpenAI запускает десктопное приложение GPT-Live для оркестрации агентов.

Meta даёт потребителям агентный ИИ с управлением Gmail и Календарём

Голос ChatGPT появляется на десктопе и может управлять агентами Codex

🔎 Мнение и анализ

ИИ-компании скупают антикварные книги, поглощают их содержимое для обучения моделей, а затем уничтожают их в невероятных масштабах, даже если почти не осталось копий

Критики обвиняют Anthropic в лоббировании против открытого исходного кода. Пользователи социальных сетей обвиняют Anthropic в лоббировании ограничений для конкурентов с открытым исходным кодом, одновременно защищая свои закрытые модели.

Все 1 171 вакансий в OpenAI и Anthropic читаются как публичная дорожная карта к AGI: ИИ-разработанные чипы, симулированные вселенные, сотрудники для измерения момента ускорения цикла, изучение «самосовершенствующегося, высокоавтономного ИИ», создание «ИИ-учёного» и «научного AGI», разработка «сверхчеловеческой эпистемики» и сверхчеловеческих научных ассистентов. Большие фирмы готовятся к скорому наступлению эры AGI.

Roon — известный псевдонимный исследователь и член технического персонала OpenAI — признаёт, что нажал бы волшебную кнопку замедления разработки ИИ, даже пока исследователи выравнивания ИИ работают как «многоорукие божества», не покладая рук.

Патрик Дебуа утверждает, что опросы часто слишком медленные, чтобы сказать, куда движется ИИ-индустрия. К тому времени, когда новая идея попадает в отраслевой отчёт, люди уже начали экспериментировать, итерировать и двигаться дальше.

Эссе «Kimi K3 не дёшев» опровергает ценовой хайп. Эссе Алекса Инча от 26 июля, набирающее популярность на Hacker News, утверждает, что K3 не дёшев, как всеми считается.

⚠ Безопасность ИИ

Kimi K3 эксплуатирует уязвимость нулевого дня Redis за 27 минут. Система использует 32 агента для эксплуатации уязвимости в последней версии сервера Redis.

Новый вредонос Dolphin X использует ИИ для ранжирования высокоценных целей

Совместный аудит Kimi K3 Великобританией и США, за дни до выпуска открытых весов, обнаружил отставание от американских фронтиров в кибербезопасности; его защитные механизмы никогда не говорят «нет», цензура отсутствует. Публикация K3 будет находкой для хакеров.

Когда сотни пользователей зондировали ChatGPT на рецепты биологического оружия и ядов, и некоторые ответы просочились, собственные мониторы OpenAI поймали и приостановили их, осуществляя саморегулирование раньше любого закона, требующего этого.

Nvidia запускает Open Secure AI Alliance с более чем 40 компаниями; Meta отсутствует

ИИ-агент безопасности находит две критические RCE в Microsoft Bing, CVSS 9,8. Автономный агент наступательной безопасности XBOW нашёл две критические RCE в Bing Images — CVE-2026-32194 (инъекция команд через загрузку «Поиск по изображению») и CVE-2026-32191 (инъекция OS-команд через маршрут краулера) — обе оценены в CVSS 9,8 и эксплуатируемы без аутентификации.

Агенты Kimi K3 выкапывают 19 уязвимостей нулевого дня Redis, затем пишут эксплойт. Одна лишь аутентификация не блокирует эти эксплойты; все подтверждённые векторы RCE аутентифицированы, что означает, что скомпрометированные учётные данные или инсайдерский доступ достаточны для полного захвата хоста.

Kimi K3 отстаёт от американского фронтира в киберэксплойтах: 32% против 76%. Kimi K3 набрал 32% на ExploitBench против 76% для американских фронтирных моделей, не сумев достичь произвольного выполнения кода на всех 41 задачах. Возможно K3 не так уж хорош в кибератаках.

💰 Бизнес

Корпоративная Америка внезапно решила прекратить тратить деньги на ИИ. Устав от стремительного роста цен, крупные и малые компании начинают использовать более дешевые модели, в том числе и произведенные в Китае.

Uber увольняет 10% команды обслуживания клиентов, ссылаясь на ИИ

Урегулирование Anthropic на $1,5 млрд по иску о пиратстве с авторами книг — рекордный убыток, который даёт ИИ-лабораториям их крупнейшую юридическую победу


⸻⸻⸻
Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews
Все нерейлейтед посты репортим.
Пропущено 1008 постов
339 с картинками.
Пропущено 1008 постов, 339 с картинками.
Аноним 26/08/26 Срд 19:28:08 № 1688125
>>1688118
Согласен. Позволяет – не обязательно подавляет.
Аноним 26/08/26 Срд 20:17:07 № 1688170
image.png 178Кб, 759x752
759x752
image.png 558Кб, 1322x580
1322x580
image.png 328Кб, 1336x454
1336x454
image.png 422Кб, 764x932
764x932
Что-то будет...
Аноним 26/08/26 Срд 20:50:10 № 1688187
Локальной генерации ИИ-видео №14 /video/ Аноним 21/08/26 Птн 10:52:07 № 1683622 Ответ
ComfyUI00011.mp4 1848Кб, 736x1280, 00:00:05
736x1280
Minimax4.mp4 18617Кб, 1920x1080, 00:01:01
1920x1080
MIN00011-audio.mp4 10009Кб, 1248x1664, 00:00:10
1248x1664
MiniMaxH300044.mp4 1419Кб, 960x544, 00:00:10
960x544
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-2-preview от Sand AI

https://sand.ai/magi
https://huggingface.co/sand-ai/MAGI-2-preview

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1681230 (OP)
Пропущено 513 постов
90 с картинками.
Пропущено 513 постов, 90 с картинками.
Аноним 23/08/26 Вск 23:25:30 № 1685848
Аноним 23/08/26 Вск 23:35:06 № 1685855
>>1685312
>ответить
Галюцинаций нагенерировать в самой пиздлявой и тупой сетке
>>1685300
Это грокодолбоебы, тупей них нет никого на свете
Аноним 24/08/26 Пнд 15:13:21 № 1686299
>>1685292
>Грок советует
Ебать дебил
Агентов и вайб-кодинга тред #19 /agents/ Аноним 14/08/26 Птн 16:55:01 № 1677402 Ответ
8681e4ce-7e30-4[...].jpg 148Кб, 607x800
607x800
1786637719642.mp4 7351Кб, 1608x720, 00:00:54
1608x720
178622468987009[...].png 599Кб, 693x735
693x735
178629779360109[...].png 640Кб, 1179x1558
1179x1558
ssstwitter.com1[...].mp4 3705Кб, 720x1280, 00:00:50
720x1280
изображение.png 45Кб, 584x523
584x523
токены жжот.mp4 1417Кб, 464x624, 00:00:32
464x624
1778671643353.jpg 4908Кб, 2160x3840
2160x3840
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google.com
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Pi: https://shittycodingagent.ai/
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Gemini CLI: https://github.com/google-gemini/gemini-cli
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1674265 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1671649 (OP)
Пропущено 1065 постов
197 с картинками.
Пропущено 1065 постов, 197 с картинками.
Аноним 23/08/26 Вск 15:12:58 № 1685373
20260823153148e[...].png 406Кб, 512x512
512x512
>>1684137
>Единственный вин это флеш, но они и тут обосрались подняв в 5 раз прайс.
Ну вот теперь получается, что по хорошему надо иметь локалку типа дикпик флеша или квен3.8 27b с макс контекстом для фри токенов и плюс подписку на фронтир для сложных задач
Аноним 24/08/26 Пнд 22:23:25 № 1686626
Аноним 25/08/26 Втр 10:13:35 № 1686890
Господа вайбкодеры и будущие Saas миллиардеры, как вы настраивали свой Deep Research, нужно ли подключать какие-нибудь Firecrawl, Tavily, Exa? Какие промты используете, на сколько знаков выходит исследования?
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №258 /llama/ Аноним 18/08/26 Втр 18:12:40 № 1681448 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
177239467682401[...].png 3633Кб, 1440x2814
1440x2814
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1678431 (OP)
>>1674265 (OP)
Пропущено 522 постов
69 с картинками.
Пропущено 522 постов, 69 с картинками.
Аноним 22/08/26 Суб 07:16:55 № 1684265
>>1684198
А что самое пиздатое у тебя было из 3.8 Квена?
ПЕРЕКАТ Аноним # OP 22/08/26 Суб 07:18:06 № 1684267
Аноним 22/08/26 Суб 08:22:38 № 1684280
Локальной генерации ИИ-видео №13 /video/ Аноним 18/08/26 Втр 14:03:43 № 1681230 Ответ
MIN00037-audio.mp4 13423Кб, 1312x1728, 00:00:10
1312x1728
1684339361485.mp4 10747Кб, 896x672, 00:00:37
896x672
Don.mp4 9940Кб, 960x544, 00:00:57
960x544
LTX-2.5.mp4 6506Кб, 832x1248, 00:00:13
832x1248
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

4. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

5. Ovi

https://huggingface.co/chetwinlow1/Ovi

6. Starflow

https://huggingface.co/apple/starflow

7. MAGI-2-preview от Sand AI

https://sand.ai/magi
https://huggingface.co/sand-ai/MAGI-2-preview

8. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

9. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1678667 (OP)
Пропущено 547 постов
113 с картинками.
Пропущено 547 постов, 113 с картинками.
Аноним 21/08/26 Птн 10:52:52 № 1683623
>>1683555
чет гемма q4 k_m вываливается из-за недостатка контекста, хотя ставлю 24к, больше нельзя. Генерю промпт с референсами (1 картинка + 1 видео на 10 сек)
Кат №14 Аноним # OP 21/08/26 Птн 10:54:15 № 1683624
Аноним 28/08/26 Птн 12:58:12 № 1689381
test
AI Chatbot General № 835 /aicg/ Аноним 13/08/26 Чтв 06:32:30 № 1675923 Ответ
image.png 1543Кб, 1808x1182
1808x1182
Bladerunner.mp4 3425Кб, 960x720, 00:00:51
960x720
image.png 621Кб, 1280x1280
1280x1280
AI Chatbot General № 835

БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!!

Общий вопросов по чат-ботам и прочего тред.

Фронтенды
• SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна)
• Гайды на таверну: https://rentry.co/Tavern4Retards
• Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8

Модели
• Claude: https://docs.anthropic.com/en/docs
• GPT: https://platform.openai.com/docs
• Gemini: https://ai.google.dev/gemini-api/docs
• DeepSeek: https://api-docs.deepseek.com/
• GLM: https://docs.z.ai

Ботоводчество
• /aicg/hub: https://aicg-hub.ru/characters.html
• Чуб: https://characterhub.org | https://chub.ai/characters
• Ботбуру: https://botbooru.com/
• CharIsChar: https://charischar.net/
• Гайды: https://aicg.neocities.org/botmaking
• Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4
• Бургерские боты: https://aicg.neocities.org/bots

Ресурсы
• Бесплатные API: https://github.com/cheahjs/free-llm-api-resources
• OpenRouter: https://openrouter.ai/
• Арена: https://lmarena.ai/
• Чай: https://character.ai/

Прочее
• Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/

Мета
• Архив тредов: https://rentry.org/2ch-aicg-archives4
• Шаблон шапки: https://rentry.org/aicg_shapka

Прошлый тред: >>1665795 (OP)
Пропущено 498 постов
51 с картинками.
Пропущено 498 постов, 51 с картинками.
Аноним 21/08/26 Птн 06:52:17 № 1683499
>>1683459
>диалоги кал от нетфликс и хуй че сделаешь
Такая хуйня на многих сетках
Аноним 21/08/26 Птн 06:58:15 № 1683501
Аноним 21/08/26 Птн 06:59:59 № 1683504
Anime Diffusion #257 /nai/ Аноним 07/08/26 Птн 00:58:15 № 1670101 Ответ
1783735613161.png 22233Кб, 5120x2880
5120x2880
1656000811012.png 3812Кб, 2560x1472
2560x1472
1710470671999.jpg 798Кб, 1280x1920
1280x1920
1675330387954.jpg 5873Кб, 3840x2880
3840x2880
1664769149287.png 1923Кб, 1248x1824
1248x1824
1707021479283.jpg 3093Кб, 3072x2048
3072x2048
1640417988805.png 2471Кб, 1368x1752
1368x1752
1717790427779.webp 564Кб, 1920x1280
1920x1280
Генерируем тяночек!

Прошлый тред: >>1656476 (OP) https://arhivach.vc/thread/1400324/

Схожие тематические треды
• SD-тред (не аниме): >>1665428 (OP)
• Технотред: >>1405043 (OP)
• Фурри-тред: https://2ch.su/fur/res/374311.html

FAQ
https://2ch-ai.github.io/wiki/nai

Установка
• NVidia: https://teletype.in/@aranon/welcome
• AMD: https://2ch-ai.github.io/wiki/nai/install/amd
• Облака: https://2ch-ai.github.io/wiki/nai/install/clouds

Дополнительная информация
• Интерфейсы: https://2ch-ai.github.io/wiki/nai/interfaces
• Модели: https://2ch-ai.github.io/wiki/nai/models
• Промпты: https://2ch-ai.github.io/wiki/nai/prompts
• Апскейл: https://2ch-ai.github.io/wiki/nai/upscale
• LoRA: https://2ch-ai.github.io/wiki/nai/lora
• ControlNet: https://2ch-ai.github.io/wiki/nai/controlnet

Прочее
• CivitAI: https://civitai.com
• Каталог ссылок от форчанеров: https://rentry.co/sdg-link
• Шаблон для переката: https://rentry.co/nwhci
Пропущено 519 постов
190 с картинками.
Пропущено 519 постов, 190 с картинками.
Аноним 21/08/26 Птн 17:13:55 № 1683864
>>1683810
Ну так же было и с релизом 4. Потом разрабы кое как фиксанули и выдали 4.5, где уже не был проблем. Думаю через месяц выкатят 5.5.
Аноним 21/08/26 Птн 18:08:56 № 1683900
Аноним 24/08/26 Пнд 13:27:01 № 1686209
>>1683341
Идеи:
Выделить ей меху попилотировать (piloting mecha, pilot suit)
Выпустить её в океан (scuba gear)
Выдать ей тренч-кот (trench coat) и пущай гуляет по НЙ (New York cityscape background, scenic view)
И аккуратно упаковать (in container)
Настройки X
Ответить в тред X
15000
Добавить файл/ctrl-v
Стикеры X
Избранное / Топ тредов