Главная Юзердоски Каталог Трекер NSFW Настройки

Искусственный интеллект

Создать тред Создать тред

Раздел для обсуждения нейросетей и всего, что с ними связано.

Для доступа в /nf/ писать сюда

<<
Каталог
Цензура Grok Аноним 01/02/26 Вск 13:58:10 № 1506333 Ответ
image.png 991Кб, 784x1168
784x1168
Пишу как неведомый в ИИ вам за советом.
Использовал грок для создания NSFW контента, а именно генерация картинок и их анимация.
Подскажите, есть ли аналоги для подобного функционала или же обход цензуры в грок
Пропущено 20 постов
4 с картинками.
Пропущено 20 постов, 4 с картинками.
Аноним 25/03/26 Срд 10:03:35 № 1561961
seedream 4.5
Аноним 04/05/26 Пнд 19:56:33 № 1604925
>>1544660
Ужс, какой культурный и воспитанный человек. Аж тошнит.
Аноним 08/08/26 Суб 03:49:14 № 1670983
Постоянные баны claude Аноним 17/07/26 Птн 16:04:20 № 1654370 Ответ
177961505118607[...].png 4Кб, 266x95
266x95
Сап, нейрач. Пару месяцев назад начал вайб кодить через claude code используя их десктоп приложение. Но постоянно бан прилетает на аккаунты. Аккаунты свои были, первые два бана покупал подписку через плати.сру, под конец месяца бан прилетал. В третий раз оплатил виртуальной картой, бан через неделю. Квн обмазался платным, подключался к одному серверу, но ip все равно менялся. Щас при покупке подписки уже верификацию просит.
Пробежался по треду ai агентов и чувство, что у всех все классно.
Есть те кто с банами сталкивался? Что помогло?
Пропущено 31 постов
4 с картинками.
Пропущено 31 постов, 4 с картинками.
Аноним 07/08/26 Птн 11:19:46 № 1670281
image.png 72Кб, 246x141
246x141
>>1664441
Обычную Gemini Flash 3.5 из гугловой строки поиска (она же Режим ИИ) спроси на тему:

Китай дистилляция Anthropic баны
Antropic дистилляция отравление вывода
Аноним 07/08/26 Птн 11:37:38 № 1670292
>>1670281
>Из-за массового сбора данных Anthropic и другие лаборатории начали внедрять жесткие проверки (вплоть до селфи и паспортов) для доступа к своим продвинутым API
Сингулярность.
Аноним 07/08/26 Птн 12:27:09 № 1670330
>>1670292
Да какая нахуй сингулярность. Жиды ебаные. А(с)модеи самый что ни на есть яркий жидок.
Anime Diffusion #256 /nai/ Аноним 20/07/26 Пнд 22:28:58 № 1656476 Ответ
1732739666487.png 21547Кб, 5120x2880
5120x2880
1724130651039.png 3899Кб, 2048x1536
2048x1536
1711698663735.jpg 3370Кб, 3072x2048
3072x2048
1661047874528.jpg 770Кб, 1280x1920
1280x1920
1773379628303.jpg 3644Кб, 3072x2048
3072x2048
1745913348087.png 4381Кб, 2560x1472
2560x1472
1707805868088.png 3815Кб, 2560x1472
2560x1472
1720789844100.jpg 1144Кб, 1368x1748
1368x1748
Генерируем тяночек!

Прошлый тред: >>1646899 (OP) https://arhivach.vc/thread/1389290/

Схожие тематические треды
• SD-тред (не аниме): >>1654539 (OP)
• Технотред: >>1405043 (OP)
• Фурри-тред: https://2ch.su/fur/res/374311.html

FAQ
https://2ch-ai.github.io/wiki/nai

Установка
• NVidia: https://teletype.in/@aranon/welcome
• AMD: https://2ch-ai.github.io/wiki/nai/install/amd
• Облака: https://2ch-ai.github.io/wiki/nai/install/clouds

Дополнительная информация
• Интерфейсы: https://2ch-ai.github.io/wiki/nai/interfaces
• Модели: https://2ch-ai.github.io/wiki/nai/models
• Промпты: https://2ch-ai.github.io/wiki/nai/prompts
• Апскейл: https://2ch-ai.github.io/wiki/nai/upscale
• LoRA: https://2ch-ai.github.io/wiki/nai/lora
• ControlNet: https://2ch-ai.github.io/wiki/nai/controlnet

Прочее
• CivitAI: https://civitai.com
• Каталог ссылок от форчанеров: https://rentry.co/sdg-link
• Шаблон для переката: https://rentry.co/nwhci
Пропущено 505 постов
185 с картинками.
Пропущено 505 постов, 185 с картинками.
Аноним 07/08/26 Птн 00:18:23 № 1670076
>>1669841
Имею в виду, когда берёшь конец (последний кадр) и делаешь продолжение. Главное чтобы персонажи не менялись между сценами (для этого можно применять рефы), и чтобы звук был консистентным без резкой смены. Старый грок говнил дизайны персонажей (форму лица и детали), хз как сейчас.

Я щитаю, что делать кино куда интереснее, чем картинки! Можно представить что делаешь трейлер или тизер для своей оригинальной видеоигры: графон, стилизация, эффекты, работа камеры, экшн, моушн, боевые мувы и спеллы, крутые дизайны, сценери, лор вымышленной вселенной, разные монстры и данжи, всё это под бодрую музычку. Хотет делать видосы по своему собственному Dark Souls.
Аноним 07/08/26 Птн 00:58:47 № 1670102
Аноним 07/08/26 Птн 10:57:33 № 1670269
>>1669521
(автор этого псто за 12 часов но этого сообщения порезал себе палец об консерву из-за кривой открывашки и попыток открыть недораскрывшуюся банку ножом)
Ребята,как думаете,сможет ли ии делать к концу 2030 годов такие картинки,что каждый сможет поверить? Аноним 01/08/26 Суб 20:38:13 № 1665986 Ответ
9F74D8D5-1142-4[...].png 1673Кб, 1448x1086
1448x1086
Ребята,как думаете,сможет ли ии делать к концу 2030 годов такие картинки,что каждый сможет поверить? Мне chatGPT сделал такую картинку
Пропущено 7 постов
3 с картинками.
Пропущено 7 постов, 3 с картинками.
Аноним 06/08/26 Чтв 19:32:32 № 1669870
image.png 228Кб, 800x600
800x600
image.png 253Кб, 516x387
516x387
image.png 119Кб, 500x375
500x375
image.png 4204Кб, 2251x2264
2251x2264
>>1667488
Монитор по мне смотрится вполне правдоподобным, пусть даже чуть нелепые кнопки, но не сильно уходят от того, что бывало, больше по другим моментам претензии серьёзные, по столам, например.
Аноним 07/08/26 Птн 03:28:39 № 1670155
hp0298404.jpg 42Кб, 800x600
800x600
>>1669870
Ну и в итоге только на первом пике 14", и у него на самом деле совсем не такая огромная рамка снизу на пикрел если также прямо смотреть. Остальные 15" и больше. Этот сгенеренный уродец еще и не 4:3, это вообще фиаско.
Аноним 07/08/26 Птн 09:26:32 № 1670222
>>1670155
По мне мониторы выглядят правоподобно. К слову они смотрятся больше, чем на 14 дюймов, скорее на 17. Принципиальные косяки другие, то же отсутствие системных блоков. Косяки с мебелью, если пытаться понять, как там ножки выглядят и где у какого стола его ножки.

Смысл шизовый у картинки, почему так рандомно разбросаты столы, что за ними невозможно сидеть, даже к компам подобратья невозможно, при этом компьютеры включены. Один стол поверх другого, хотя модель одинаковая и высота должна быть одинаковая, но главное, что за бред сам по себе?

Если ты ставишь задачу придумать картинку, что от настоящей не отличишь, то тебе надо брать в качестве референса реальное оборудование, конкретные модели, реальную мебель. Должен быть какой-то смысл у картинки, а не каша из столов, как здесь.
Чем сейчас лучше переводить? Аноним 06/08/26 Чтв 23:40:05 № 1670054 Ответ
1000083094.jpg 164Кб, 1036x1200
1036x1200
Чем сейчас лучше переводить?
Локальной генерации ИИ-видео №6 /video/ Аноним 10/06/26 Срд 07:46:38 № 1628892 Ответ
232212-LTX23000[...].mp4 6484Кб, 480x720, 00:00:21
480x720
FEASTlow.mp4 18327Кб, 1280x720, 00:01:09
1280x720
ComfyUI00004.mp4 686Кб, 672x928, 00:00:05
672x928
nava.mp4 6507Кб, 854x470, 00:00:48
854x470
Актуальные модели

1. Wan от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

2. LTX-2.3 - делает локальную генерацию грейт агейн. Подходят лоры от 2.0

https://huggingface.co/Lightricks/LTX-2.3

Известные тюны:
Sulphur
Eros

3. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

4. Ovi

https://huggingface.co/chetwinlow1/Ovi

5. Starflow

https://huggingface.co/apple/starflow

6. MAGI-1 от Sand AI

https://sand.ai/magi
https://github.com/SandAI-org/MAGI-1

7. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

8. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1599474 (OP)
Пропущено 1114 постов
280 с картинками.
Пропущено 1114 постов, 280 с картинками.
Аноним 06/08/26 Чтв 15:38:44 № 1669705
изображение.png 43Кб, 519x478
519x478
>>1668826
А какую модель выбирать, минимакса тонет
Аноним 06/08/26 Чтв 18:07:14 № 1669793
>>1669705
default

просто смотрите официальные воркфлоу комфипидора
Аноним 07/08/26 Птн 02:18:57 № 1670135
image.png 17Кб, 423x292
423x292
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №253 /llama/ Аноним 01/08/26 Суб 11:07:36 № 1665553 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
IMG202606041848[...].jpg 5232Кб, 3468x4624
3468x4624
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1663069 (OP)
>>1661366 (OP)
Пропущено 504 постов
101 с картинками.
Пропущено 504 постов, 101 с картинками.
Аноним 04/08/26 Втр 18:28:52 № 1668218
Аноним 04/08/26 Втр 18:30:59 № 1668220
AIkino.jpg 138Кб, 1080x689
1080x689
>>1668138
Всё когда-нибудь бывает впервые...
Аноним 04/08/26 Втр 19:10:14 № 1668250
>>1667728
А карты между собой хоть на каком-то линке будут? Pcie же не тащит, будет сильно больше чем на ddr5 под разгоном?
AI Chatbot General № 833 /aicg/ Аноним 26/07/26 Вск 07:12:03 № 1660020 Ответ
image.png 1543Кб, 1808x1182
1808x1182
Bladerunner.mp4 3425Кб, 960x720, 00:00:51
960x720
image.png 307Кб, 855x837
855x837
AI Chatbot General № 833

БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!!

Общий вопросов по чат-ботам и прочего тред.

Фронтенды
• SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна)
• Гайды на таверну: https://rentry.co/Tavern4Retards
• Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8

Модели
• Claude: https://docs.anthropic.com/en/docs
• GPT: https://platform.openai.com/docs
• Gemini: https://ai.google.dev/gemini-api/docs
• DeepSeek: https://api-docs.deepseek.com/
• GLM: https://docs.z.ai

Ботоводчество
• /aicg/hub: https://aicg-hub.ru/characters.html
• Чуб: https://characterhub.org | https://chub.ai/characters
• Ботбуру: https://botbooru.com/
• CharIsChar: https://charischar.net/
• Гайды: https://aicg.neocities.org/botmaking
• Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4
• Бургерские боты: https://aicg.neocities.org/bots

Ресурсы
• Бесплатные API: https://github.com/cheahjs/free-llm-api-resources
• OpenRouter: https://openrouter.ai/
• Арена: https://lmarena.ai/
• Чай: https://character.ai/

Прочее
• Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/

Мета
• Архив тредов: https://rentry.org/2ch-aicg-archives4
• Шаблон шапки: https://rentry.org/aicg_shapka

Прошлый тред: >>1656757 (OP)
Пропущено 500 постов
49 с картинками.
Пропущено 500 постов, 49 с картинками.
Аноним 01/08/26 Суб 16:46:04 № 1665796
>>1665791
Может у тебя нсфв промпты стоят и клод триггерится заранее видя их? Клоды же наоборот обожают отыгрывать тему родительства и всё такое
Аноним 01/08/26 Суб 16:46:44 № 1665798
Аноним 01/08/26 Суб 16:50:13 № 1665808
>>1665796
Да конечно стоят, ниче хардкорного но и всегда будет до чего докопаться, не в промпте так в карточке. Но тут как бы весь смысл в парадоксе, карточка должна быть для кума, а иначе и батю отыгрывать не интересно. Во всякую ваниль я еще со старой гпт наигрался
Агентов и вайб-кодинга тред #16 /agents/ Аноним 29/07/26 Срд 21:39:28 № 1663511 Ответ
image.png 139Кб, 1262x549
1262x549
Вайбовый вайб.webm 3224Кб, 640x480, 00:00:59
640x480
1.jpg 227Кб, 1200x1005
1200x1005
1635262289848.png 57Кб, 973x841
973x841
1674014855790.png 48Кб, 405x262
405x262
177612662902122[...].png 1637Кб, 1223x2258
1223x2258
image1.png 79Кб, 763x621
763x621
1778671643353.jpg 4908Кб, 2160x3840
2160x3840
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google.com
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Pi: https://shittycodingagent.ai/
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Gemini CLI: https://github.com/google-gemini/gemini-cli
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1663069 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1660441 (OP)
Пропущено 552 постов
89 с картинками.
Пропущено 552 постов, 89 с картинками.
Аноним 01/08/26 Суб 11:59:48 № 1665587
>>1665579
>>1665581
Так у них полное отсутствие хищников. Никто кроме пиздюка с палкой вороне не страшен. Вот и пухнут.
Аноним 01/08/26 Суб 12:13:40 № 1665596
двач преображае[...].webm 5193Кб, 752x1216, 00:00:08
752x1216
оп это легальный перекат выше?
олсо, запросил у модератора увеличение перекатного лимита в 1000 сообщений

просьба кинуть модератору проьбу или отписаться тут https://2ch.su/d/res/421281.html
Аноним 01/08/26 Суб 12:22:21 № 1665601
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №252 /llama/ Аноним 29/07/26 Срд 12:09:47 № 1663069 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
178519338006708[...].jpg 810Кб, 1600x1267
1600x1267
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1661366 (OP)
>>1659232 (OP)
Пропущено 517 постов
98 с картинками.
Пропущено 517 постов, 98 с картинками.
Аноним 01/08/26 Суб 10:44:35 № 1665542
>>1665538
Так ебут без таких дегенератских выводов
>какие же ллмки тупые пиздос... когда там аги уже?
Выводы каждый сам делает.

Мимо-ебущий-фифи
Аноним 01/08/26 Суб 11:05:59 № 1665552
HNP0Ax7XMAAxP0z.jpg 583Кб, 1588x1890
1588x1890
>>1665481
Первые две ничего потом пошёл кринж. Но виноват в этом юзер!
ПЕРЕКАТ Аноним # OP 01/08/26 Суб 11:08:21 № 1665554
Агентов и вайб-кодинга тред #15 /agents/ Аноним 26/07/26 Вск 17:58:41 № 1660441 Ответ
1785077512097148.jpg 147Кб, 1661x1108
1661x1108
1785077708607126.jpg 230Кб, 2122x1122
2122x1122
1785077313670155.jpg 2126Кб, 2160x3840
2160x3840
1785077419602134.mp4 2670Кб, 1280x720, 00:00:10
1280x720
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google.com
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Pi: https://shittycodingagent.ai/
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Gemini CLI: https://github.com/google-gemini/gemini-cli
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1659232 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1656543 (OP)
Пропущено 556 постов
92 с картинками.
Пропущено 556 постов, 92 с картинками.
Аноним 05/08/26 Срд 12:18:39 № 1668769
from-PixAI-1878[...].png 1910Кб, 1024x1024
1024x1024
>>1668724
Тащ Майор и так deep inspection пакетам проводит, какая разница
Аноним 09/08/26 Вск 16:58:21 № 1672401
Аноним 19/08/26 Срд 11:45:14 № 1681947
Локальные языковые модели (LLM): Gemma, Qwen, Hy3 и прочие №251 /llama/ Аноним # OP 27/07/26 Пнд 17:00:22 № 1661366 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
20260512180456.jpg 4671Кб, 3041x3000
3041x3000
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1659232 (OP)
>>1657043 (OP)
Пропущено 537 постов
77 с картинками.
Пропущено 537 постов, 77 с картинками.
ПЕРЕКАТ Аноним # OP 29/07/26 Срд 12:12:13 № 1663071
Аноним 29/07/26 Срд 12:14:24 № 1663074
>>1663070
В целом здравая идея, но модели все равно по-разному инструкции слушают. Могут по итогу быть расхождения, хотя крупные изменения так реально эффективнее проверять.
Аноним 29/07/26 Срд 12:43:56 № 1663084
>>1663025
А это ты у кого покупал?
Агентов и вайб-кодинга тред #13 /agents/ Аноним 16/07/26 Чтв 03:51:47 № 1653365 Ответ
.png 57Кб, 1438x794
1438x794
.jpg 397Кб, 1645x968
1645x968
.png 244Кб, 2560x1600
2560x1600
.mp4 5478Кб, 1280x720, 00:00:13
1280x720
.webm 16901Кб, 1280x704, 00:00:49
1280x704
.mp4 2051Кб, 480x854, 00:00:23
480x854
.jpg 4870Кб, 2160x3840
2160x3840
.png 677Кб, 1080x1010
1080x1010
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google.com
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Pi: https://shittycodingagent.ai/
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Gemini CLI: https://github.com/google-gemini/gemini-cli
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1652385 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1650619 (OP)
Пропущено 677 постов
133 с картинками.
Пропущено 677 постов, 133 с картинками.
Аноним 27/07/26 Пнд 20:24:52 № 1661666
{8140772D-2B57-[...].png 354Кб, 2079x1321
2079x1321
images (7).jpg 11Кб, 447x447
447x447
Аноним 28/07/26 Втр 00:15:08 № 1661881
8888.png 277Кб, 2560x1598
2560x1598
8889.png 210Кб, 2560x1600
2560x1600
{38859341-C058-[...].png 379Кб, 2560x1599
2560x1599
>>1661666
Всё, сделано. Но тут императивно закрыты все лазейки чтобы педерастический клод код не собирал триггеры, даже в рунет все пообрезал. Работаем чисто локально с клодкодом, без заглядывания даже на российские хостинги для работы. Это можно и потом сделать курсором или ручками. Меня всё устраивает, да и лень делать то что не нужно, потом когда нибудь, может быть допилю, наверное.

>Продукт заточен под: нельзя даже случайно сходить в запрещённую геозону destination.
Цена: нельзя легально «чуть-чуть» на RU‑хостинг, не ослабив модель.

>Напряжение:

>хочешь безопасный egress FR/US для всего;
>и одновременно SSH/SFTP/панель на Timeweb в РФ.
>Полный блок и удобная удалёнка в рунет в одной жёсткой политике не живут — нужен второй режим или дырка по списку.

>Способы решения (на будущее, в бэклоге ROADMAP)
>Allowlist — явный список (timeweb.ru, IP VPS) → direct или отдельный путь до geo-reject.
>Плюс: точечно. Минус: дыра в идеологии; только ручной список + лог.

>Профиль «работа» — на сессию убрать ru из блока, огромный warning, только ручное выключение.
>Грубо, но понятно.

>Split по процессу — Cursor/SSH/scp мимо блока; браузер остаётся жёстким.
>Удобно для кодинга; риск, если агент сам полезет на ozon.

>Два пресета в UI — «бронедверь» (как сейчас) / «лаборатория» (мягче).
>Самый честный UX.

>Вне Вахтёра — для RU‑хостинга отдельная машина/VM без шлюза или ОТКЛ Вахтёра на время деплоя.
>Уже работает без кода.

>Пока выбранный ответ продукта: оставить жёсткий baseline; опции 1–4 — только после явного «делайте».
Аноним 28/07/26 Втр 20:17:08 № 1662693
Новости об искусственном интеллекте №77 /news/ Аноним # OP 11/07/26 Суб 01:24:58 № 1650077 Ответ
image 3234Кб, 1536x1024
1536x1024
image 2759Кб, 1448x1086
1448x1086
В этот тредик скидываются свежие новости по теме ИИ!

Залетай и будь в курсе самых последних событий и достижений в этой области!

Прошлый тред: >>1641475 (OP)

Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.

🚀 Последний обзор ИИ новостей:

📢 Главные новости ИИ

GPT-5.6 Sol от OpenAI набрала 53,6 балла на экзамене Agents' Last Exam, опередив Claude Fable 5 на 13,1 балла и выполнив задачи на 61% быстрее, что подчеркивает ее превосходство в производительности над Anthropic.

Пользователь сообщил, что Claude Cowork успешно автоматизирует задачи, не связанные с написанием кода, такие как анализ контрактов и обслуживание серверов, повышая производительность, несмотря на сохраняющиеся проблемы с доверием и безопасностью.

🧠 Модели

GPT-5.6 и ChatGPT Work от OpenAI нацелены на то, чтобы превзойти Anthropic по цене, скорости и производительности

Meta Superintelligence Labs выпускает Muse Spark 1.1 по низкой цене: мультимодальная модель рассуждений для агентских задач в Meta Model API. Контекстное окно составляет 1 000 000 токенов. Она превосходит Claude Opus 4.8 в бенчмарках для агентов

OpenAI выпустила GPT-5.6 Sol, Terra и Luna, делая упор на больший объем интеллекта на каждый токен; модели оснащены «ультра»-режимом с четырьмя агентами и показывают рекордные результаты в бенчмарках для агентов, хотя Sol и уступает Claude на SWE-Bench Pro.
OpenAI сообщила, что Sol автономно провела дообучение Luna — задачу, которая раньше выполнялась старшей командой, — и назвала создание автоматизированного исследователя «почти реальностью», опередив планы на годы.

Sol стала первой моделью, прошедшей игру ARC-AGI-3, и набрала 92,5% на ARC-AGI-2 при затратах, составляющих одну десятую от стоимости трехмесячной модели, что породило шутливый вопрос: «Когда уже ARC-AGI 4?»

Luna выполняет интеллектуальные задачи уровня 5.5 за 10% от её стоимости, а аналитики из Epoch подозревают, что размер Sol сопоставим с 5.5, так что весь прирост обеспечен исключительно алгоритмами.

Sol обходит DeepSWE, работая за 38% от стоимости Fable, и устанавливает рекорд индекса Coding Agent Index, расходуя вдвое меньше токенов; на CursorBench Fable сохранила за собой корону, но проиграла «по всем пунктам, которые отражаются в вашем счете».

Sol генерировала по 750 токенов в секунду в Blender, создала клон Excel за шесть дней, бросив вызов оригиналу, стала первой моделью GPT, прошедшей Pokémon FireRed, опираясь исключительно на зрение, и за неделю с первой попытки отрисовала воксельный Манхэттен.

Fable установила недосягаемый для соперников рекорд скорости на CIFAR-10, столь изобретательно обыграв правила, что авторы назвали буквоедство барьером на пути самосовершенствования.

Порог входа продолжает снижаться: PrismML умудрилась уместить рекордную 27-миллиардную модель на iPhone.

NVIDIA выпускает Audex (Nemotron-Labs-Audex-30B-A3B): единую аудио-текстовую большую языковую модель, которая сохраняет текстовый интеллект своей базовой модели.

Meta представила Muse Image и Muse Video.

OpenAI выпустила семейство GPT-5.6 (Sol, Terra, Luna), обеспечивающее повышение эффективности использования токенов в задачах программирования до 54%, что снижает затраты корпоративного ИИ.

GPT-5.6 Sol достигает на 54% более высокой эффективности использования токенов в задачах программирования.

🛠 Инструменты для разработчиков

Google AI Studio запускает бесплатные пользовательские поддомены ai.studio для развертывания приложений разработчиков

Anthropic обновляет Claude Code, добавляя изолированный браузер в приложении для взаимодействия с внешней документацией и веб-сайтами. Инструмент командной строки может нажимать на элементы и сохранять сессии браузера.

Google выпускает LiteRT.js, высокопроизводительный веб-вывод ИИ в браузере через WebAssembly и WebGPU

Claude Code и Fable 5 за несколько часов портировали ПК-игру 2003 года Command and Conquer на нативный iOS

Zhipu AI запускает ZCode, чтобы бросить вызов Claude Code и OpenAI Codex за малую часть их стоимости

IBM обновила IBMBob, добавив мультиагентные возможности, аналитику затрат на ИИ и готовые рабочие процессы модернизации, что облегчает узкие места при проверке кода в DevSecOps.

Claude Cowork продемонстрировала надежную автоматизацию рутинной работы, не связанной с кодом, что подчеркивает практическое внедрение ИИ в качестве коллеги.

n8n выпустила рабочий процесс реагирования на инциденты на базе ИИ с использованием конвейеров RAG для автоматического сбора знаний и генерации структурированных инструкций, оптимизируя работу SOC.


📦 Продукты

Александр Ван из Meta выпускает Muse Image, агентский генератор изображений, который планирует промпты с помощью Muse Spark. Релиз включает предварительный просмотр предстоящего Muse Video.

Character.AI представила интерактивные микродрамы с голосовым ИИ. Для начала стартап запускает три микродрамы: романтический сериал под названием «Последнее лето», хоррор-шоу «Ночная игра» и микродраму о выживании в духе «Голодных игр» под названием «Падение Эдема».

OpenAI закрывает свой ИИ-браузер Atlas менее чем через год после запуска, перенося функции просмотра в свое настольное приложение и расширение для Chrome, что указывает на стратегическую переориентацию.

Google будет автоматически маркировать рекламу, созданную с помощью собственных инструментов генеративного ИИ, в Поиске, Discover и YouTube, повышая прозрачность для пользователей.

📱 Приложения

ChatGPT приходит за одной из самых умных функций Chrome от Google
OpenAI расширяет возможности ChatGPT за пределы своего веб-сайта, запускает новое расширение для Chrome, которое может понимать содержимое просматриваемой вами веб-страницы. Расширение позволяет пользователям задавать вопросы о странице, резюмировать статьи, объяснять сложные концепции и даже запускать более длительные задачи на базе ИИ, не покидая браузер.

📰 Инструменты

GPT-Live предлагает полнодуплексное голосовое взаимодействие для ChatGPT, позволяя вести голосовые беседы в реальном времени.

💻 Оборудование

Zhipu AI изучает возможность разработки собственных кремниевых чипов для решения проблемы нехватки оборудования на фоне растущего спроса на ее модели GLM. Недавнее еженедельное использование токенов модели GLM-5.2 этого стартапа подскочило в 27 раз

🖱 Аппаратное обеспечение

Apple подписывает соглашение с Broadcom на производство 15 миллиардов чипов в США

Китайский стартап в области искусственного интеллекта DeepSeek разрабатывает собственный чип для ИИ, сообщают источники.

🔓 Открытый исходный код

Meituan открывает исходный код LongCat-2.0 — MoE-модели с 1,6 триллиона параметров и контекстным окном в 1 миллион токенов

Китайский ИИ-стартап MiniMax планирует открыть исходный код модели с 2,7 триллиона параметров под названием M3 Pro в третьем квартале. Сообщается, что эта модель будет крупнее любой китайской ИИ-модели, представленной в настоящее время на рынке, и более чем в шесть раз превысит размер текущей M3 от MiniMax, который, по данным SCMP, составляет 428 миллиардов параметров.

🧪 Исследования

JPMorgan создает ИИ-агентов, которые превосходят портфель 60/40 в бэктестах. Результаты обнадеживают. Исследователи банка создали массив инвестиционных агентов на базе ИИ, которые переключаются между акциями и облигациями в зависимости от изменяющихся рыночных условий. В бэктестах за последние два десятилетия самая эффективная система превзошла традиционный портфель 60/40 — 60% в акциях и 40% в облигациях — на 0,7 процентных пункта в год с меньшей волатильностью, а также обошла собственную основанную на правилах модель рыночного режима JPMorgan.

Четыре наиболее цитируемых исследования рабочей среды эпохи ИИ, прочитанные параллельно, рассказывают одну историю: прирост производительности от ИИ реален, но радикально неравномерен, и он склоняется в сторону неопытных, четко ограниченных по задачам и проверяемых — а не в сторону экспертов, выполняющих сложную, знакомую работу, и не в сторону предприятий, закупающих пилотные проекты.

Claude по-прежнему недосягаема в задачах пространственного мышления, поэтому OpenAI как нельзя кстати провела аудит SWE-Bench Pro — бенчмарка, в котором безраздельно доминирует Claude, — обнаружила, что 30% его заданий некорректны, и отозвала свое одобрение.

⚙ Инфраструктура

Micron инвестирует 250 миллиардов долларов в США, производство кастомного чипа Meta стартует в сентябре, а SK Hynix оценила свои акции в рамках размещения в США в 149 долларов.

⸻⸻⸻
Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews
Все нерейлейтед посты репортим.
Пропущено 556 постов
202 с картинками.
Пропущено 556 постов, 202 с картинками.
Аноним 28/07/26 Втр 01:09:47 № 1661908
Аноним 29/07/26 Срд 20:50:11 № 1663463
>>1661811
Прогнозы гемини лютая фигня.
06/08/26 Чтв 14:20:17 № 1669655
тест, не обхожу, проверяю
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №250 /llama/ Аноним 24/07/26 Птн 22:08:12 № 1659232 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
17674497335320.jpg 3381Кб, 2699x3595
2699x3595
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1657043 (OP)
>>1652385 (OP)
Пропущено 518 постов
69 с картинками.
Пропущено 518 постов, 69 с картинками.
Локальная ИИ Аноним 28/07/26 Втр 21:25:36 № 1662755
Аноны, всем доброго вечера суток. Это мой первый тред. Мне бы хотелось узнать какая локальная модель хороша для вайб-кода на моем железе:
- RTX 3060 6GB Laptop
- Intel Core i5 13420H
- 16 GB Ram
Аноним 29/07/26 Срд 09:32:48 № 1663001
>>1662755
Попробуй начать с геммы 4 а4 сколько нибудь б
Аноним 31/07/26 Птн 12:51:28 № 1664753
>>1662614
Ты забыл указать, что на тебе надеты зелёные штаны.
Агентов и вайб-кодинга тред #14 /agents/ Аноним 20/07/26 Пнд 23:34:10 № 1656543 Ответ
1682073038621.webp 5Кб, 900x403
900x403
1724291272542.png 27Кб, 1078x335
1078x335
1721055040572.png 18Кб, 901x327
901x327
1636523359484.png 156Кб, 1661x1108
1661x1108
1755375480312.png 1244Кб, 3840x1126
3840x1126
1705674744436.mp4 2670Кб, 1280x720, 00:00:10
1280x720
1630863685166.png 590Кб, 2122x1122
2122x1122
1778671643353.jpg 4896Кб, 2160x3840
2160x3840
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google.com
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Pi: https://shittycodingagent.ai/
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Gemini CLI: https://github.com/google-gemini/gemini-cli
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1652385 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1653365 (OP)
Пропущено 529 постов
76 с картинками.
Пропущено 529 постов, 76 с картинками.
Аноним 27/07/26 Пнд 13:04:35 № 1661098
>>1660239
>ак вы коупите тот факт, что программисты - ВСЁ?
>Вот я вкатился в айти в 2015м, программировать начал в 2019м.
>В 2023 попробовал нейросети, но через браузер. В 2026 залетел уже в эйяй-агентуру. Эта хуйня решает 99% всех задач и проблем, с которыми стаклиаюсь просто в лоб.
Я коуплю тот факт что я ниасили стать программистом ВОТ ЭТИМ ФАКТОМ, что программисты ВСЁ кроме промышленных, как-то программисты АСУ ТП
Аноним 28/07/26 Втр 18:55:17 № 1662631
image.png 13Кб, 708x136
708x136
image.png 203Кб, 1825x893
1825x893
image.png 208Кб, 1797x908
1797x908
Ебало? Ваши Кладкоды больше НЕ-НУЖНЫ.
Аноним 28/07/26 Втр 20:18:07 № 1662695
Ошибка OOM Аноним 26/07/26 Вск 14:58:06 № 1660265 Ответ
1785066342836116.jpg 15Кб, 1311x105
1311x105
1785066105276108.jpg 15Кб, 901x392
901x392
После установки Stable diffusion webUI forge/neo через Stability matrix появляется ошибка OOM, при установке через git clone тоже самое. Пробовал разные версии Python от 3.10.11 до самой новой. На старом компе работало с Python 3.10.11 GTX 950 i5-2500.
Нынешний ПК:
i7-6700k
GTX 1080 (8gb)
16 Гб ОЗУ
В чем может быть проблема? Пробовал разные модели, всегда ошибка
Аноним # OP 26/07/26 Вск 15:03:08 № 1660271
1785066694644168.jpg 53Кб, 871x607
871x607
Какие настройки использую
Аноним # OP 27/07/26 Пнд 11:47:11 № 1661013
Bump
Я хочу создать игру в godot. Какую нейросеть использовать? Где научиться как ей пользоваться? дипсик Аноним 26/07/26 Вск 10:03:37 № 1660092 Ответ
image.png 96Кб, 994x687
994x687
Я хочу создать игру в godot. Какую нейросеть использовать? Где научиться как ей пользоваться? дипсик и гвен как-то не подходят помоему...
Аноним 26/07/26 Вск 10:03:50 № 1660093
бамп
Аноним 26/07/26 Вск 19:17:55 № 1660530
Я взял подписку антигравити,была скидка на 3 первых месяца pro подписки. Когда заканчивается лимит клауда использую джемини.
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №249 /llama/ Аноним 21/07/26 Втр 19:07:28 № 1657043 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
photo2026-07-15[...].jpg 2287Кб, 2560x1920
2560x1920
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1652385 (OP)
>>1648665 (OP)
Пропущено 520 постов
107 с картинками.
Пропущено 520 постов, 107 с картинками.
Аноним 26/07/26 Вск 08:08:28 № 1660032
image 31Кб, 379x519
379x519
image 58Кб, 1120x392
1120x392
>>1660015
Годнота, в Chrome поставилась без вопросов, оллам с лмстудиями тоже не понадобилось, подхватила урл из обычной llama.cpp, переводит страницы по кускам, правда долго хз почему, этот же текст просто в веб интерфейсе квенчика быстрее перевести в 10 раз, может всю страницу по нескольку раз засылает вместо абзацев.
Аноним 26/07/26 Вск 09:03:50 № 1660044
>>1660032
--reasoning-budget 100 помог
+ кнопку Floating translate button в расширении включить и переводить выделенные куски только ей - так скорость сразу стала приемлемой
Аноним 26/07/26 Вск 10:28:41 № 1660121
Чому mtp не работает с обычными Q5 и Q6 квантами от мразермахера и uslop
llama_model_load: error loading model: invalid vector subscript

Но при этом работает с тем же услоповским QAT gemma-4-26B-A4B-it-qat-UD-Q4_K_XL.gguf
и работает с gemma-4-26B-A4B-it-abliterix-v6.IQ4_XS.gguf, который вообще левый без QAT с аблитерацией
Это какой-то заговор?
AI Chatbot General № 832 /aicg/ Аноним 21/07/26 Втр 10:19:43 № 1656757 Ответ
image.png 1543Кб, 1808x1182
1808x1182
Bladerunner.mp4 3425Кб, 960x720, 00:00:51
960x720
image.png 433Кб, 1664x688
1664x688
AI Chatbot General № 832

БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!!

Общий вопросов по чат-ботам и прочего тред.

Фронтенды
• SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна)
• Гайды на таверну: https://rentry.co/Tavern4Retards
• Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8

Модели
• Claude: https://docs.anthropic.com/en/docs
• GPT: https://platform.openai.com/docs
• Gemini: https://ai.google.dev/gemini-api/docs
• DeepSeek: https://api-docs.deepseek.com/
• GLM: https://docs.z.ai

Ботоводчество
• /aicg/hub: https://aicg-hub.ru/characters.html
• Чуб: https://characterhub.org | https://chub.ai/characters
• Гайды: https://aicg.neocities.org/botmaking
• Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4
• Бургерские боты: https://aicg.neocities.org/bots

Ресурсы
• Бесплатные API: https://github.com/cheahjs/free-llm-api-resources
• OpenRouter: https://openrouter.ai/
• Арена: https://lmarena.ai/
• Чай: https://character.ai/

Прочее
• Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/

Мета
• Архив тредов: https://rentry.org/2ch-aicg-archives4
• Шаблон шапки: https://rentry.org/aicg_shapka

Прошлый тред: >>1653015 (OP)
Пропущено 499 постов
50 с картинками.
Пропущено 499 постов, 50 с картинками.
Аноним 26/07/26 Вск 07:03:28 № 1660017
17253824036770.mp4 1484Кб, 1106x1080, 00:00:03
1106x1080
>>1658652
Чёт неистово проиграл
Аноним 26/07/26 Вск 07:10:46 № 1660019
Аноним 26/07/26 Вск 07:13:16 № 1660022
Настройки X
Ответить в тред X
15000
Добавить файл/ctrl-v
Стикеры X
Избранное / Топ тредов