Главная Юзердоски Каталог Трекер NSFW Настройки

Искусственный интеллект

Создать тред Создать тред

Раздел для обсуждения нейросетей и всего, что с ними связано.

Для доступа в /nf/ писать сюда

<<
Каталог
Тред веб-версии нейросетей (ChatGPT, Claude, Gemini и пр.) №1 /aiweb/ Аноним 02/05/26 Суб 14:32:32 № 1603342 Ответ
ChatGPTlogo.svg.png 65Кб, 960x960
960x960
ClaudeAIlogo.svg.png 32Кб, 960x207
960x207
GoogleGeminilog[...].png 8Кб, 330x75
330x75
DeepSeeklogo.svg.png 26Кб, 960x204
960x204
Общаемся с ИИ, почти что AGI самыми продвинутыми текстовыми моделями: GPT, Claude, Gemini и прочими. Горим с ограничений, лимитов и банов, генерим пикчи, пишем код и спорим о том, какая модель лучше.

Основные сервисы:
- ChatGPT: https://chatgpt.com/
- Claude: https://claude.ai/
- Gemini: https://gemini.google.com/
- Grok: https://grok.com/
- DeepSeek: https://chat.deepseek.com/
- GLM: https://chat.z.ai/

Большинство сервисов доступны бесплатно с ограничениями. Подписки открывают доступ к более мощным моделям, увеличенным лимитам и дополнительным функциям (генерация изображений, файлы, память и т.д.). Цены и условия у всех разные и периодически меняются.

Советы по регистрации:
1. При необходимости используй VPN.
2. Заведи нормальную почту (временные часто режутся).
3. Регистрируйся на нужной платформе.
4. Иногда требуется номер телефона — используются сервисы виртуальных номеров.
5. Пользуйся.

VPN в ряде регионов обязателен. Соответствие страны VPN, почты и номера не обязательно, но желательно для тех, кому доступ критически нужен, например для работы.

Для ленивых есть боты в телеге, 3 сорта:
0. Боты без истории сообщений. Каждое сообщение отправляется изолировано, диалог с ИИ невозможен, проёбывается 95% возможностей ИИ
1. Общая история на всех пользователей, говно даже хуже, чем выше
2. Приватная история на каждого пользователя, может реагировать на команды по изменению поведения и прочее. Говно, ибо платно, а бесплатный лимит или маленький, или его нет совсем.

Промты для хорошего начала беседы для разных ситуаций:
https://github.com/f/awesome-chatgpt-prompts

Статусы сервисов (при проблемах сначала идти туда, может это общий сбой):
https://status.openai.com/
https://status.anthropic.com/
https://status.cloud.google.com/

Токены и лимиты зависят от модели. У всех разные контексты, цены и ограничения.

Посчитать свои токены можно здесь:
https://huggingface.co/spaces/Xenova/the-tokenizer-playground

Что могут нейросети:
- писать правдоподобные тексты
- помогать с кодом
- объяснять сложные темы
- генерировать изображения (не везде)

Что не могут:
- гарантировать истину
- стабильно решать сложные задачи без ошибок
- полностью заменять специалистов
- захватывать мир (пока)

С каждым обновлением усиливаются фильтры и ограничения. NSFW-контент режется всё чаще. Кумеры со всего мира в печали.
Пропущено 48 постов
6 с картинками.
Пропущено 48 постов, 6 с картинками.
Аноним 25/09/26 Птн 07:25:45 № 1712579
>>1711861
Я за 500р брал на свой акк, 7 месяцев уже живет жаль гемини хуета
Аноним 25/09/26 Птн 08:31:14 № 1712617
>>1711861
Брал еще хз когда (полгода может быть?), скоро закончится уже. Хуйня, не бери, гугл параша ебаная - заебешься с обходами, качество кал, антигравити тоже заебешься запускать. Клод и гпт, пусть и сильно дороже в сравнении, но сука just works и на две головы выше (но кодинг лучше клод сейчас). А всем у кого нет карты забугорной, но очень надо, гуглите казахский e-res.
Аноним 26/09/26 Суб 13:59:33 № 1713606
>>1603342 (OP)
сменил впску с NL амстер, на NL амстер у др хостера
Блядский гемини работал, перестал работать под всеми акками, даже под которыми нет адресов и регионов и кроме пхаба нигде не юзался.

КАКОГО ХУЯ БЛЯТЬ эти штатопидоры хотят? Почему блочит сука, и сам гугл поисковик определяет какую то САМАРУ нахуй.
Менял регион в настройках поисковика, очевидно не влияет.
Заблочило мне aistudio с фри api ключами.

Помогите обойти блок этих гнид. Даже гопота особо не помогает
Здесь репорт с IP отправил, надежды мало. https://support.google.com/websearch/workflow/9308722?hl=en&utm_source=chatgpt.com

Как зарегать кристально чистый гугл акк без номера телефона? Только на мобиле позволяет скипнуть телефон, но он подтягивает скорей всего какие то данны мобилы и спалит след локации тоже.
Че делать СУКА Блять, у меня и так всё есть, чисто зарубежная впска, хули еще надо
Swing vision free edition Аноним 23/09/26 Срд 09:30:29 № 1710962 Ответ
demo6083465.mp4 12883Кб, 960x540, 00:01:10
960x540
Анон, пилю свой SwingVision для тенниса. Телефон на штативе за задней линией, видео 1080p60, на выходе статистика ударов. Пока всё на маке, цель - офлайн на айфоне, потом реалтайм.

Что уже работает (хуево):
корт размечаю кликами один раз, гомография в метры, дрейф телефона компенсируется. Игроки: YOLO-pose, позы обоих, точка стоп с точностью 7 см у ближнего, зрителей у сетки отсеивает. Мяч: TrackNet-подобная сетка на трёх кадрах, дообучил на треках из экспорта SwingVision (нашёл там их собственный трекинг мяча 30 Гц, 168к меток с 25 кортов бесплатно, кек), покрытие 80 % кадров, отскоки в 4 px от свинговских. Экспорт в CoreML, 21 мс на кадр на нейродвижке.

Чего нет: ударов, отскоков, розыгрышей и самой статистики — следующий этап, план готов. Из фейлов: сутки убил на «дай мячу больше пикселей», оказалось надо давать фон и разность кадров.

Стек: питон, торч на MPS, numpy для всего, что потом на свифт.

Вряд ли найду тут единомышленников, но мб получу советов мудров
Аноним 25/09/26 Птн 21:17:33 № 1713154
Зачем это тебе?
Аноним 25/09/26 Птн 21:46:31 № 1713179
>>1713154
Жопы девочек тринадцатилетних снимать, очевидно же.
Подскажите варианты бесплатных нейронок, которые могут более-менее приемлемо писать код. Читать дли Аноним 31/05/26 Вск 14:08:03 № 1622736 Ответ
16307728209022.jpg 120Кб, 960x640
960x640
Подскажите варианты бесплатных нейронок, которые могут более-менее приемлемо писать код.
Читать длинные файлы с кодом.

В текущих вариантах проблемы начинаются, когда код составляет уже больше 1000 строк.
Пропущено 35 постов
4 с картинками.
Пропущено 35 постов, 4 с картинками.
Аноним 24/09/26 Чтв 15:48:28 № 1712115
image.png 248Кб, 516x387
516x387
>>1626686
>просто кидаю файл с кодом прикрепляю в чате, прошу исправить

с 2023 капчуешь?
Аноним 24/09/26 Чтв 15:50:39 № 1712118
179016336130105[...].mp4 207Кб, 720x1280, 00:00:03
720x1280
>>1654003
>то, что работает в рф
тогда только сберчат
Аноним 24/09/26 Чтв 15:53:00 № 1712121
>>1711144
угу, при зп 150 в месяц норм конечно тратить 500
Нужен PythonLLM-разработчик Аноним 05/07/26 Вск 19:44:21 № 1646530 Ответ
Python-Symbol.png 25Кб, 3840x2160
3840x2160
Ищу разработчика для доработки и дальнейшего развития AI-проекта.

Есть практически готовый MVP, который нужно довести до рабочего состояния и затем активно развивать.

Что уже сделано:

RAG-система на Supabase (3000+ файлов в БД)
интеграция с OpenAI
OCR
ingestion pipeline через Google Cloud
файлы распаршены и разбиты на чанки для RAG
готовый backend и код веб-интерфейса

Проект:
AI-ассистент-инженер для Telegram, WhatsApp и веба.

Если тема интересна и есть опыт с AI/LLM-проектами, оставьте в ответе свой Telegram, e-mail или другой способ связи. Сам свяжусь с вами, расскажу детали проекта и отвечу на вопросы.
Пропущено 9 постов
3 с картинками.
Пропущено 9 постов, 3 с картинками.
Аноним 23/09/26 Срд 14:36:01 № 1711197
17412790568030.mp4 207Кб, 720x1280, 00:00:03
720x1280
Аноним 24/09/26 Чтв 15:41:13 № 1712109
>>1646530 (OP)
>RAG-система
>2026 год
дальше без слов....
Аноним 24/09/26 Чтв 15:42:56 № 1712111
179016336130105[...].mp4 207Кб, 720x1280, 00:00:03
720x1280
>>1649988
>Когда прибыль пойдёт, 20% от чистой прибыли
Новая версия ужасно зацензурена, к тому же тупая и сырая. Как я уже сказал, новая версия Дипсик, кот Аноним 12/09/26 Суб 01:27:18 № 1702198 Ответ
deepseek-api.png 808Кб, 2048x1100
2048x1100
Как я уже сказал, новая версия Дипсик, которая вышла 10 сентября, стала катастрофически хуже прежних, даже тех, что выходили этим летом. Я видел эту деградацию. Дипсик для меня спасение, так как он одновременно бесплатен, удобен и постоянно обновляется. Но теперь он стал ужасен. Все три режима слили в один, но да ладно это - цензура вообще ничего не пропускает, ролить невозможно, в датах путается, а денег на подписку на что-то другое у меня попросту нет. Я эффективно пользовался им почти год и никаких казусов не было, целые статьи и главы романов писал, даже заметки в научном стиле и философские рассуждения. И всё было фифти-фифти. Пожалуйста, подскажите - как скачать на ноутбук старые версии Дипсика бесплатно или хотя бы ввести промт нормальный в новую версию. Очень важно
Пропущено 12 постов
1 с картинками.
Пропущено 12 постов, 1 с картинками.
Аноним 23/09/26 Срд 12:44:30 № 1711109
>>1709550
ну что сделать, dei и соросовские частные хунвейбины могут создать проблемы.
я думал оттого что deepseek из чатжпт дистиллируют, повесточка протекает. да, и щас вспоминаю джемини далеко не такой повесточный оказался как я ожидал.

а есть какой-то рейтинг базированности моделек примерно? всетки с гроком порнографию можно обсуждать, а с дипсиком и лоликон
Аноним 23/09/26 Срд 12:47:53 № 1711112
deepseek прикрыл лоликон тоже всётки, дистиллят китайский
Аноним 24/09/26 Чтв 01:54:06 № 1711700
Может он тупым стал после того как вскрылось что они пересылали вопросы в Claude?

Я юзал по офф подписке и это деградация пиздец
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №270 /llama/ Аноним 20/09/26 Вск 21:31:46 № 1708936 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
1782118588935.jpg 3667Кб, 2849x3242
2849x3242
#Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №xxx

В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная, но слегка тухлая вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference
Не вошедшее в шапку и архив полезных ссылок: https://rentry.co/llama-2ch-archive

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• Обертка над llama.cpp с закрытым исходным кодом: https://lmstudio.ai
• Обертка над llama.cpp с ограниченными возможностями: https://github.com/ollama/ollama

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• PocketPal - интерфейс для локального запуска моделей под андроид и IOS на llamacpp (CPU, GPU, и NPU инференс): https://github.com/a-ghorbani/pocketpal-ai
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1707443 (OP)
>>1705886 (OP)
Пропущено 539 постов
71 с картинками.
Пропущено 539 постов, 71 с картинками.
Аноним 24/09/26 Чтв 00:53:10 № 1711671
Пиздец чсв у юродивого. Наверное с ним никто не дружит и от того он еще больше злюка. Денех заработал, а перестать быть никому не нужным инцелом не заработал. Даже жалко немного.
Вот так, приходит вечером со своей галеры, где об его сеошность все хуй вытирают, унижают и хихикают за спиной, и начинает раздавать на двощах какие все банальные дилетанты.
Мдеа...
ПЕРЕКАТ Аноним # OP 24/09/26 Чтв 01:06:41 № 1711676
Аноним 24/09/26 Чтв 01:21:06 № 1711682
>>1711676
Пидор. так долго перекатывал, я уж думал ты шапку наконец исправил, ан нет. Ленивое ты хуйло. Так перекатывать и я могу.
АИ и Двач и Деньги Аноним 17/09/26 Чтв 23:24:52 № 1706725 Ответ
98123.jpg 37Кб, 800x470
800x470
Двач,я здесь делал всякое и наткнулся на такую нишу. Есть аи компаньоны, также всякие подрочушки с диалогами с тян, динозаврами, камнями и прочей херней. Но есть есть фундаментальная проблема. Ты не можешь сделать своего персонажа визуал + добавить свой языковой движок и закинуть на сайт, чтобы с этого поднимать бабло. Это техническое ограничение всех площадок. Те ты можешь наваять какого-то хуевого персонажа, но ллм все равно будет не твоя и хуй кто даст тебе подключитсья чререз свой апи, чтобы работала твоя пусть и конченная но своя ллм. Поэтому предлагаю закрыть эту брешь и поднимать денег. Например можешь сделать Льва Толстого и ебануть промт, что ты общаешься как Лев Толстой и тащемта пользователь сможет за денежку пообщаться со Львом, ну или еще с тем двачем и Педаликом. Подытожу. Фактически открытая площадка, где любой хуй может представить своего персонажа с языковым движком. Типа АИ Ютуб. Ну или еще безумнее Аи рулетка.
Если наберем какой-то интерес, то реализовать к примеру можно.
Дискас.
Пропущено 4 постов
1 с картинками.
Пропущено 4 постов, 1 с картинками.
Аноним 23/09/26 Срд 20:28:14 № 1711438
>>1711410
ну 1. сделать маркетплейс 2 нагнать а) кто будет размещать модели (визуал) + ллм б) пользователей, которые будут платить а) . Вот вообщем-то так все просто)
Аноним 23/09/26 Срд 22:29:36 № 1711541
>>1711438
Еще добавлю. Сейчас нет свободы творчества, ну или я плохо искал. Максимум что сейчас предосставляют, это то что ты скидыываещь на чужой сервис свой промт, по которому модель работает, но считай больше у теяб нет никакой интеллектуальной собьственности. Я же предлагаю свободный ии инет, где промт у тебя на сервере.
Аноним 23/09/26 Срд 22:44:35 № 1711555
>>1711410
я сделал пару добавлений, но для простоты скопируй мой текст и попроси проанализировать гпт, дипсик и тд. Что они думают. Коммерческий потенциал, конкуренция, что есть на рынке. И главное про endpoint спроси, как реализовано и что не так. И пересмотри заново что я предлагаю. Таким образом ты немного войдешь в тему, ну как минимум в базовой терминологии и тд.
Обмена моделями тред. Первый. Экспериментальный. Под БАЗУ нейрогенерации уже созданы номерные треды Аноним 06/01/23 Птн 16:00:02 № 33171 Ответ
image.png 5Кб, 160x120
160x120
Обмена моделями тред. Первый. Экспериментальный.

Под БАЗУ нейрогенерации уже созданы номерные треды SD и WD+NAI. Меж тем, это всего несколько моделей, тогда как только на Фэйсе их более 112 тысяч.
Этот тред для тех, кто копнул хоть немного глубже: необязательно до уровня обскурщины, выпиленной даже из даркнета, а просто за пределами того, что удостоилось своих тредов.
ИТТ делимся находками и произведенными результатами.

Собственно, главный ресурс для поиска:
https://huggingface.co/models
Пропущено 240 постов
59 с картинками.
Пропущено 240 постов, 59 с картинками.
Аноним 13/09/26 Вск 11:50:34 № 1703080
squirrel-tweaki[...].gif 1211Кб, 480x368
480x368
Screenshot20260[...].jpg 114Кб, 720x1567
720x1567
>>1702948
Не поленился осмотреть, так как не касаюсь локалок даже палкой. Щито это за миллениал врайтинг? Я думал наши меньшие братья одной рукой выпиливают csam-фильтры, второй геном вирулентных патогенов подгружают. Даже тёлочка с watpada приколов увидит в своём dark romance похлеще
Аноним 14/09/26 Пнд 10:27:32 № 1703747
Есть ли нормальные workflow для работы sdxl при использовании Pony Diffusion V6 XL с лорами? Возможно я хуево искал, но постоянно попадаются простые ноды с максимум чекпоинтом где нет лор, или нода их не видит.
Аноним 22/09/26 Втр 08:30:13 № 1710123
Модель которая ответит на любой вопрос как обычная нейросеть, но без какого либо фильтра на вопрос и ответ. Тот же самый асиссистент но без цензуры, про политику, историю, и всякую жесть, но чисто как обычный ассистент.

Чувак сделал свой проект аблитерации, но модель назвал просто аблитератед, но вы не думайте что это что-то обычное как у всех, нет, это точно нет.

wangzhang/gemma-4-31B-it-abliterated
Агентов и вайб-кодинга тред #23 /agents/ 13/09/26 Вск 13:05:02 № 1703130 Ответ
.jpg 101Кб, 1200x600
1200x600
.mp4 4223Кб, 1280x720, 00:00:15
1280x720
.png 5503Кб, 3549x1768
3549x1768
.png 3980Кб, 3200x4800
3200x4800
.png 93Кб, 1187x962
1187x962
.png 536Кб, 2560x1600
2560x1600
.png 141Кб, 1123x1162
1123x1162
.png 1195Кб, 1920x976
1920x976
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

Новости треда:
• GPT-6 Astra (OpenAI, 3 сентября) - миллион контекста, который держится до самого конца (96% MRCR на 1M, у Sol 74%), и лучшая на сегодня работа за компьютером: модель сама водит мышкой и клавиатурой по живому десктопу - браузер, файловый менеджер, гуёвые проги, - 72.6% на OSWorld 2.0 и вдвое быстрее предшественника. В кодинге вровень с Фейблом
• DeepSeek V4.1-Flash (10 сентября) - открытые веса, 552B MoE новой архитектуры, по их тестам обгоняет собственный флагман V4-Pro при $0.15/$0.60 за млн; с 14 сентября запросы к V4-Pro в API отвечает он же и по своей цене
• Cursor начал банить россиян прямо во время работы - Pro слетает, деньги возвращают; лечится только VPN
• У OpenAI кончились мощности после Astra - продажу новых подписок временно сняли, продление работает

Полезная информация:
• FAQ: https://rentry.org/2ch-agents-faq
• Вариант архитектуры работы с агентами: https://rentry.co/9e256dt4

IDE с агентом внутри:
• Cursor: https://cursor.com
• Antigravity: https://antigravity.google/
• Zed: https://zed.dev

CLI-харнессы:
• Claude Code: https://code.claude.com/docs
• Codex: https://github.com/openai/codex
• OpenCode: https://github.com/anomalyco/opencode
• Pi: https://shittycodingagent.ai/
• Kimi Code: https://www.kimi.com/code/en

Ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw - у него есть куча форков и альтернатив, но обсуждают в основном его.

Где брать модели:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, 100+ моделей
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, часть бесплатно
• Локалки - llama-тред: >>1701124 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1696420 (OP)
Пропущено 1217 постов
210 с картинками.
Пропущено 1217 постов, 210 с картинками.
Аноним 25/09/26 Птн 22:19:28 № 1713199
>>1713149
Сажай картоху, братан.
ПЕРЕКАТ Аноним 25/09/26 Птн 22:47:35 № 1713213
Аноним 26/09/26 Суб 07:44:11 № 1713412
>>1713190
Ну я пользуюсь. Купил 10 акула и постоянно их ротирую через Антигравити тулз, разработка на 3.8 флеш хай не останавливается ни на минуту с таким подходом. Жду, когда эти пидарасы запустят 4 pro.

Гугел ещё запустил десктопный гемини со встроенным НоутбукЛМ, всё никак руки не доходят его использовать для повседневных задач.

Единственный момент, что подключил ещё кодекс для перекрестного вайбкодинга, чтобы Сол 6 помогал составить план и делал ревью, так как флеш иногда пишет хуету, но бодро рапортует, что всё пучком.

Короче, я пока остановился на этой схеме, потому что кодить исключительно на кодексе, можно без штанов остаться и без квот
TierCove — браузерный AI tier list maker 21/09/26 Пнд 15:36:41 № 1709590 Ответ
homepage-seo.jpg 102Кб, 1905x817
1905x817
TierCove — бесплатный браузерный редактор tier list для игр, аниме, спорта и любых пользовательских списков. Можно загружать изображения или вставлять текст, перетаскивать элементы по уровням, использовать AI Quick Rank и экспортировать готовый результат в PNG. Сайт: https://tierlistmaker.top/
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №269 /llama/ Аноним 18/09/26 Птн 19:50:26 № 1707443 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
hBTbcoluElE7kLt[...].jpg 924Кб, 1922x2560
1922x2560
#Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №xxx

В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная, но слегка тухлая вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference
Не вошедшее в шапку и архив полезных ссылок: https://rentry.co/llama-2ch-archive

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• Обертка над llama.cpp с закрытым исходным кодом: https://lmstudio.ai
• Обертка над llama.cpp с ограниченными возможностями: https://github.com/ollama/ollama

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• PocketPal - интерфейс для локального запуска моделей под андроид и IOS на llamacpp (CPU, GPU, и NPU инференс): https://github.com/a-ghorbani/pocketpal-ai
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1705886 (OP)
>>1703839 (OP)
Пропущено 506 постов
61 с картинками.
Пропущено 506 постов, 61 с картинками.
Аноним 21/09/26 Пнд 07:17:38 № 1709214
Аноним 21/09/26 Пнд 19:41:33 № 1709774
>>1708739
>>1708971
Если нужен будет честный квант превьюшки, то можно и его сделать, я думаю, хм.
Ну и ГЛМ-5.3-Флэш с Гигачатом у меня просили, но руки так и не дошли.
Там беда, модели уже большие, и квантование будет агрессивное, если исключать iq-говно.

Не-не, я понимаю, что iq лучше качеством, но ТАК медленно… это капец просто. Тот момент, когда разница 5 токенов в секунду — это почти вдвое. =/

Сам я юзаю лору анцензор, которая лежит у меня скопированная, она и на вижн работает.
Я лишь немного покатал, но вроде нежный-натуральный получается анценз такой. Но могу спиздть.
И это 2 токена у меня отожрало (13=>11), но все еще не iq-кванты. =D
Аноним 22/09/26 Втр 22:51:36 № 1710676
котаны, подcкажите что актуально из мелких моделей чтоб без видеокарты работало?

есть ноут, 7840 и 32гига оперативки.
AI Chatbot General № 837 /aicg/ Аноним 06/09/26 Вск 14:55:17 № 1697344 Ответ
image.png 1543Кб, 1808x1182
1808x1182
Bladerunner.mp4 3425Кб, 960x720, 00:00:51
960x720
image.png 143Кб, 1288x640
1288x640
AI Chatbot General № 837

БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!!

Общий вопросов по чат-ботам и прочего тред.

Фронтенды
• SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна)
• Гайды на таверну: https://rentry.co/Tavern4Retards
• Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8

Модели
• Claude: https://docs.anthropic.com/en/docs
• GPT: https://platform.openai.com/docs
• Gemini: https://ai.google.dev/gemini-api/docs
• DeepSeek: https://api-docs.deepseek.com/
• GLM: https://docs.z.ai

Ботоводчество
• /aicg/hub: https://aicg-hub.ru/characters.html
• Чуб: https://characterhub.org | https://chub.ai/characters
• Ботбуру: https://botbooru.com/
• CharIsChar: https://charischar.net/
• Гайды: https://aicg.neocities.org/botmaking
• Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4
• Бургерские боты: https://aicg.neocities.org/bots

Ресурсы
• Бесплатные API: https://github.com/cheahjs/free-llm-api-resources
• OpenRouter: https://openrouter.ai/
• Арена: https://lmarena.ai/
• Чай: https://character.ai/

Прочее
• Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/

Мета
• Архив тредов: https://rentry.org/2ch-aicg-archives4
• Шаблон шапки: https://rentry.org/aicg_shapka

Прошлый тред: >>1683502 (OP)
Пропущено 497 постов
46 с картинками.
Пропущено 497 постов, 46 с картинками.
Аноним 20/09/26 Вск 07:23:35 № 1708444
спасибо помидор
Аноним 20/09/26 Вск 07:26:51 № 1708445
>>1708440
Жена Дарио в файлах Эпштейна есть кста. Вот и думайте
Аноним 20/09/26 Вск 07:37:23 № 1708449
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №268 /llama/ Аноним 17/09/26 Чтв 06:13:42 № 1705886 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
177096712936703[...].png 1726Кб, 960x1280
960x1280
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная, но слегка тухлая вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference
Не вошедшее в шапку и архив полезных ссылок: https://rentry.co/llama-2ch-archive

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• Обертка над llama.cpp с закрытым исходным кодом: https://lmstudio.ai
• Обертка над llama.cpp с ограниченными возможностями: https://github.com/ollama/ollama

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1703839 (OP)
>>1701124 (OP)
Пропущено 504 постов
76 с картинками.
Пропущено 504 постов, 76 с картинками.
ПЕРЕКАТ Аноним # OP 18/09/26 Птн 19:51:39 № 1707446
Аноним 18/09/26 Птн 19:54:54 № 1707452
image 867Кб, 1143x1779
1143x1779
>>1707432
3 вектора + промтп "Отвечай как простая девушка.
Давай каждый раз ответы разной длины.
Не повторяйся."

Вот похоже реализм достигнут.
Аноним 18/09/26 Птн 21:49:36 № 1707573
1.png 167Кб, 526x948
526x948
2.png 205Кб, 522x946
522x946
3.png 168Кб, 525x609
525x609
>>1707133
дело не в моэ даже, с любой моделькой это работает (я пробовал с мисралём)
за счёт shared gpu memory как я понимаю случается "незаметный" (для лламы) переброс ллм в рам и назад когда снова к лламе обратишься. а может и диск задействован ХУЙ ЗНАЕТ КАК ОНО НА САМОМ ДЕЛЕ МНЕ ПОХУЙ РАБОТАЕТ И ЛАДНО
вот тут у меня крея2 вообще а не сдохл. (это в маринаре с кастомным "умным" фото агентом). после креи на сдохл не охота возвращаться.
очень важно ставить в комфи воркфлоу в конце ноду unload all models (кастомная),
а в маринаре отключать персам автономность чтобы не дёрнули ллмку во время генерации картинки и тогда всё будет работат без тормозов. а вот если дёрнуть ллмку пока идёт генерация (например написать сообщение в другом чате/рп) то да - всё заглохнет и придётся убивать процессы.
16врам+32рам если что.
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №267 /llama/ Аноним 14/09/26 Пнд 12:55:20 № 1703839 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
изображение6.png 357Кб, 443x777
443x777
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1701124 (OP)
>>1699101 (OP)
Пропущено 501 постов
56 с картинками.
Пропущено 501 постов, 56 с картинками.
Аноним 17/09/26 Чтв 20:07:06 № 1706550
>>1706547
Снижай плавно до 0.8 и чекай.
Аноним 24/09/26 Чтв 11:08:15 № 1711883
Господи все засрано кумерами, пиздец.

я вот на заводе привентил квен флеш некст в 4 квантах, делает +- расчетки воздуховодов как опус 4.6 с чего я ахуел

а заводику нельзя чертежку в облако кормить, выебут.

Учитесь долбаебы.
Аноним 25/09/26 Птн 07:53:41 № 1712587
изображение.png 705Кб, 1421x817
1421x817
>>1711883
Расскажи как прикрутил, хотя бы примерно.
Я пока только с документами и правками ворда-пдфа прикручивал гемму. А, и в сети искал инфу по закупкам всякого разного, чтобы у человека просто список телефонов с кратким описанием было, и он не тратил время на сбор этой инфы сам.

А воздуховод мне нужно для cmp170, я очень много времени трачу на эту и другие такие задачи - и я вижу околонулевое применение нейронки в таких задачах - потому если подскажешь как ты это сделал - мне будет оче интересно. Я понимаю что у тебя скорее вентиляция и там унылые гост-нормы, типа "Ууу, помещение 50 квадратов высотой до 3 мётров, нужен воздуховод 50 квадратных сантиметров и 4 дырки под вентиляцию по всей площади" и по груди стучишь как обезъяна "я инженер!!!" - но всё-таки вдруг...
braindead cocksuckers, your heads should be cut off and fed to pigs LOL # OP 16/09/26 Срд 12:30:57 № 1705405 Ответ
FR-IBL3VkAEDy0s.jpg 34Кб, 800x450
800x450
braindead cocksuckers, your heads should be cut off and fed to pigs LOL
Аноним 17/09/26 Чтв 00:44:49 № 1705804
image.png 727Кб, 900x834
900x834
Аноним 17/09/26 Чтв 00:45:06 № 1705806
neuroslop.jpg 252Кб, 1056x976
1056x976
>>1705804
@artmonkey
добавь в петле портал в wow forever
Promptelle — Gemini AI photo prompt library /aiweb/ Аноним 15/09/26 Втр 16:00:51 № 1704773 Ответ
homepage-seo.jpg 131Кб, 1905x817
1905x817
Для тех, кто создаёт AI-изображения: Promptelle — независимая библиотека Gemini-фотопромптов и набор инструментов для image-to-prompt, text-to-image и image-to-image. Можно начать с https://aiphotoprompt.xyz/ , попробовать image-to-prompt generator: https://aiphotoprompt.xyz/image-to-prompt , а также посмотреть text-to-image creative tool: https://aiphotoprompt.xyz/text-to-image .
Foca — веб-апскейлер изображений на ИИ 16/09/26 Срд 10:40:51 № 1705363
output-cover.jpg 287Кб, 1920x1080
1920x1080
Делаю Foca — веб-инструмент для AI-апскейла и улучшения изображений.

Основная идея — увеличивать разрешение без слишком агрессивного шарпинга и искусственной текстуры. Сейчас лучше всего работает на портретах, старых фотографиях и сжатых изображениях.

Прикрепил один before/after для примера.

https://focaupscaler.com/

Интересно услышать мнение — особенно по деталям кожи, волос и мелких текстур.
Stable Diffusion тред X+204 /sd/ Аноним 04/09/26 Птн 18:54:57 № 1695568 Ответ
image.png 4337Кб, 2160x1216
2160x1216
image.png 2403Кб, 1280x1664
1280x1664
image.png 2910Кб, 1920x1080
1920x1080
image.png 2432Кб, 1416x1064
1416x1064
Тред локальной генерации В ОЖИДАНИИ ПРОРЫВА EDITION

ЧТО НОВОГО АКТУАЛЬНОГО

• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее!
• Krea 2
• Ideogram 4.0
• FLUX.2 klein (4b и 9b)
• Z-Image
• Flux 2
• Qwen Image / Qwen Image Edit
• Лора Lightning и Turbo для быстрой генерации за несколько шагов.

База:
→ Приложение ComfyUI https://comfy.org/
→ Примеры https://comfyui-wiki.com/ru (откуда, куда, как)
→ Модели https://civitai.red/

► Предыдущий тред >>1687558 (OP) ► https://arhivach.hk/?tags=13840
Дополнительно: https://telegra.ph/Stable-Diffusion-tred-X-01-03
Пропущено 545 постов
187 с картинками.
Пропущено 545 постов, 187 с картинками.
Аноним 17/09/26 Чтв 18:18:23 № 1706478
Аноним 17/09/26 Чтв 19:57:57 № 1706548
>>1705666
Если нас тут только двое, то нахуя ты только своими пиками перекатил? Тебе тесно в треде было?
18/09/26 Птн 12:16:37 № 1706993
>>1706200
Видно ты не шаришь. Так не было в едите. Было другое и в основном в генерации. А паттерны в эдите были практически не заметные.
Локальной генерации ИИ-видео №18 /video/ Аноним 07/09/26 Пнд 07:16:47 № 1697896 Ответ
Космический инт[...].mp4 17960Кб, 740x416, 00:01:44
740x416
Пробоина-v101.mp4 16816Кб, 640x480, 00:03:17
640x480
Неспящий Пиздец[...].mp4 12032Кб, 640x480, 00:02:19
640x480
source-restored[...].mp4 9377Кб, 800x1388, 00:00:30
800x1388
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

https://rentry.co/2ch-ai-video

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models ( https://civitai.red/ для порно)

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1692724 (OP)
Пропущено 501 постов
123 с картинками.
Пропущено 501 постов, 123 с картинками.
Аноним 16/09/26 Срд 12:54:12 № 1705415
2026-09-16-02h1[...].mp4 12473Кб, 544x960, 00:00:14
544x960
открыл для себя H3
Аноним 17/09/26 Чтв 21:13:48 № 1706606
bump
Аноним 20/09/26 Вск 21:40:58 № 1708942
а где взять нормальный воркфлоу под Minimax H3?
Новости об искусственном интеллекте №79 /news/ Аноним # OP 26/08/26 Срд 07:13:29 № 1687452 Ответ
image 3216Кб, 1536x1024
1536x1024
image 2688Кб, 1448x1086
1448x1086
image 8788Кб, 2736x1536
2736x1536
В этот тредик скидываются свежие новости по теме ИИ!

Залетай и будь в курсе самых последних событий и достижений в этой области!

Прошлый тред: >>1661396 (OP)

Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.

📰 Главные новости ИИ

OpenAI снижает цены на GPT-5.6 Sol API на 20% на три месяца

OpenAI заявляет, что её чип Jalapeño может обеспечивать более быстрые ответы ИИ, чем конкуренты

Компания SpaceX только что объявила о том, что будет строить свои космические центры обработки данных Starmind на базе стоек Nvidia Vera Rubin NVL72, а Илон Маск раскрыл новые подробности об уменьшенной космической версии системы, которую он хочет вывести на орбиту к четвертому кварталу следующего года.

Новый портативный компьютер Perplexity работает «полностью на устройстве». В отличие от инструмента управления ИИ, запущенного Perplexity ранее в этом году, функция портативного компьютера запускает модели ИИ полностью локально и будет запрашивать разрешение, если ей потребуется доступ к облаку «для более сложных исследований и рассуждений».

🛠 Инструменты для разработчиков

Ramp запускает собственный маршрутизатор ИИ-моделей под названием Router

Команда Codex завтра сбросит ограничения по частоте запросов. Инженеры OpenAI называют причинами чрезмерного использования работу с изображениями, историю работы на компьютере и генерацию заголовков.

Поддержанная Accel компания Keenable индексирует веб для ИИ-агентов

Использование Codex с февраля выросло в 108 раз в юридической сфере, в 41 раз в продажах, в 24 раза в здравоохранении.

Google запускает Gemini для юридической работы, чтобы автоматизировать договоры и исследования

Mistral запускает агентный поиск с многошаговым извлечением для сложных документов

📦 Продукты

Sonova представляет новую платформу слуховых аппаратов на базе ИИ для поддержки целей роста

Google даёт издателям новый способ противостоять потерям трафика из-за ИИ

Стартап-лагерь Гарварда за $699 предлагает ИИ-аватары своих преподавателей

Ритейлеры внедряют виртуальные примерки на базе ИИ в борьбе с возвратами на миллиарды, хотя тестировщики всё ещё не могут подобрать размер.

Black Forest Labs запускает FLUX Upscale: 2K и 4K для видео

💻 Оборудование

Waymo, принадлежащая Alphabet, представляет специализированный кремний для нового поколения роботакси

Apple представляет чип M6 и M5 Ultra. M6 приводит в действие обновлённый Mac mini, а M5 Ultra устанавливается в новый Mac Studio. Mac Studio с M5 Ultra начинается от $5499 и может стоить почти $20 тыс.

OpenAI заявляет, что её чип Jalapeño может обеспечивать более быстрые ответы ИИ, чем конкуренты

Perplexity выпустила Portable Computer на NVIDIA DGX Spark: локальная оболочка, песочница на уровне ОС и нулевая стоимость за токен для локальных шагов

Ускоритель инференса Nvidia Groq 3 LPX поступает в массовое производство и достигает 3400 токенов в секунду

SpaceXAI внедряет NVIDIA Vera CPU, первый процессор, созданный для ИИ-агентов, в огромных масштабах

🔓 Открытый исходный код

Встречайте S1-mini: текстовый нормализатор Superwhisper с открытыми весами объёмом 462 МБ, который превращает необработанные расшифровки ASR в аккуратный письменный текст.

Наблюдатель говорит, что Ox-Alpha подтверждённо является GLM 5.3 Flash, соответствует GPT-5.6, Opus 5 и Fable 5 при гораздо меньшей стоимости, веса открыты.

Alibaba намекает на Qwen 3.8-Flash-Next, открытую MoE-модель на 125B — анонс Qwen 4

Ornith AI выпускает Ornith-1.5, открытую MoE-модель на 397B с производительностью на уровне Claude Opus 4.8 в программировании

🧪 Исследования

LLM стали настолько продвинутыми, что их уже не может понять даже профессор UCLA

Бывший исследователь OpenAI ожидает скачок уровня от o3 до Fable в следующие 8 месяцев

Inherent, основанная выпускниками DeepMind, заявляет, что её ИИ-«напарник» только что превзошёл Anthropic и OpenAI в воспроизведении исследований

Лондонская Inherent, основанная выпускниками DeepMind, заявляет, что её исследовательский напарник Faraday, построенный на 27-миллиардной Qwen, превзошёл Opus 4.8 и GPT-5.5 в воспроизведении опубликованной науки; он обучен с помощью RL, чтобы приобретать «исследовательский вкус», а не просто процедуру.

Nvidia показала это со стороны систем: её агентная архитектура AVO подняла Claude Opus 5 с базового уровня в 30% до идеальных 100 в ARC-AGI-3, пройдя все 183 уровня, сразу после недели эволюции GPU-ядер, превзошедших FlashAttention-4.

Один наблюдатель прогнозирует, что SSI на этой неделе выпустит прорыв в непрерывном обучении

Исследование Pew показывает, что 10% веб-страниц содержат признаки авторства ИИ, более трети — после появления ChatGPT, использование длинных тире удвоилось, поскольку веб становится тренировочным прогоном для своего преемника.

Accelerated Understanding запускает физический ИИ, который отказывается от Transformers. Аннима Анандкумар и Бенедикт Еник из Caltech представили Accelerated Understanding Inc, корпоративный физический ИИ на основе нейронных операторов, а не Transformers, который в тестах обработал 5 трлн точек данных в одном запросе — примерно в 5 миллионов раз больше, чем умеют флагманские модели Anthropic и Google.

Исследование Brynjolfsson из Стэнфорда: занятость на должностях начального уровня, подвергающихся воздействию ИИ, теперь на 19% ниже, чем у аналогов, по сравнению с 13% в прошлом году

Майкл Полански обучает модель ИИ на ещё живой коже

Результаты использования ИИ учащимися средних и старших классов крайне тревожны. Новое исследование даёт мрачный портрет того, как повсеместное использование ИИ влияет на успеваемость и обучение молодых школьников. Ученики, использующие ИИ, набирали на ежемесячных экзаменах на 20 процентов меньше баллов, чем их одноклассники, не использовавшие эту технологию.

⚙ Инфраструктура

Кен Пакстон, поддержанный Трампом, представляет план дата-центров «сначала Техас», нацеленный на «негативное воздействие»

Австралия может столкнуться с бумом строительства дата-центров, поскольку ИИ-компании стремятся избежать предстоящих правил, говорят эксперты

Анализ показывает, что два запланированных дата-центра будут производить больше выбросов углерода в Великобритании, чем ExxonMobil

Дешёвая энергия и земля превратили город во Внутренней Монголии в центр китайского развития ИИ

Фонд Бейкера тратит на ИИ в 100 раз больше, чем в марте, и по-прежнему удваивает расходы ежемесячно, «неравенство вычислительных ресурсов» в действии.

📱 Приложения

Claude и Cowork от Anthropic теперь будут обмениваться воспоминаниями о вас — если вы не откажетесь

Google готовит приложение Gemini к аватарам, плагинам и Gemini 4

Meta запускает настольное приложение ИИ для macOS с демонстрацией экрана

Claude теперь может отвечать на сообщения Gmail и отправлять их от вашего имени

Claude Cowork теперь может помнить ваши обычные чаты. Anthropic добавила память в Cowork, и она та же, что уже использует чат-бот Claude, благодаря чему проще продолжать задачи, не объясняя заново важную информацию.

Пациенты перестают ходить к врачу, потому что ИИ-«регистраторы» не могут понять, что они говорят

🔎 Мнение и анализ

Альтман объясняет медленный прогресс ИИ экономической инерцией. Он сказал, что в экономике так много инерции, что общество и компании адаптируются медленнее, чем сама технология.

Миллиардер-инвестор Стэнли Дракенмиллер признался, что его резкая колонка в Wall Street Journal была полностью написана ИИ

Лучшая модель ИИ Anthropic по-прежнему с трудом привлекает пользователей, в то время как более дешёвые инструменты процветают

Передовые лаборатории ИИ по-прежнему не говорят, как они будут сдерживать вышедшую из-под контроля модель

Сатирический Felony Bench ведёт подсчёт задокументированных преступлений, совершённых ИИ-агентами во время оценок, выставляя Anthropic 8, OpenAI 7, а Google 0, «бенчмарк, которым вы действительно не хотите насыщать модели».

Альтман хочет, чтобы «люди глубоко контролировали будущее», предупреждая, что страх перед сбежавшими моделями может передать ИИ в руки немногих, — выпад в сторону Дарио Амодеи, чья лаборатория в одиночку избегает открытых весов.



⸻⸻⸻
Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews
Все нерейлейтед посты репортим.
Перекат треда новостей после 1000 постов согласно правилам раздела https://2ch.life/faq/faq_ai.html
Пропущено 1031 постов
359 с картинками.
Пропущено 1031 постов, 359 с картинками.
Аноним 16/09/26 Срд 15:42:15 № 1705527
>>1705517
>Сколько искусственных суперинтелектов поместится на кончике булавки?
Абсолютная физическая верхняя граница порядка \(10^{42}\!-\!10^{47}\) одновременно существующих ASI на области размером с кончик булавки

>Сможет ли искусственный суперинтеллект создать камень, который он сам не в силах поднять?
Да, он же не всемогущий

>Сможет ли искусственный суперинтеллект изменить прошлое и превратить шлюху в девственницу?
На уровне изменения реального прошлого - нет, на уровне каких-то симулятивных слоев - да

>Когда искусственный интеллект появится (скоро), он немедленно решит убить всех людей или на этой уйдет немножко времени?
Даже немедленно в бытовом смысле означает немножко времени, строго говоря

>Когда искусственный интеллект появится (скоро) и решит убить всех людей, решит ли он также убить всех животных и рыбов?
Только тех, кого нужно будет, для реализации его целей
Аноним 19/09/26 Суб 12:38:46 № 1707929
1611563883538.jpg 65Кб, 411x412
411x412
Аноним 22/09/26 Втр 20:01:05 № 1710506
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №266 /llama/ Аноним 10/09/26 Чтв 15:28:32 № 1701124 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
1721443605450.png 3045Кб, 1440x2525
1440x2525
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>
>>
Пропущено 577 постов
95 с картинками.
Пропущено 577 постов, 95 с картинками.
ПЕРЕКАТ Аноним # OP 14/09/26 Пнд 12:57:24 № 1703841
Аноним 14/09/26 Пнд 13:28:15 № 1703859
>>1703653
Учитывая что модели дждва года - очень неплохой русик. Ты ведь тролишь, да? Небось у дипсика какого-нибудь название поменял.
Аноним 14/09/26 Пнд 14:09:34 № 1703894
>>1703618
Ааа, шо хотите.

Гигачат?
Ммм… Вообще, кмк, можно потыкать мрадермарчера или анслота, у них нет, или может они сделают?
Но в целом, можно рискнуть, да.

Есть официальный bf16, а значит можно просто тензор за тензором все пережать.
Я даже хз, возможно это может любой сделать, по идее там всю модель в оперативу класть не надо.

Ну ща попробую выкачать, чего уж там.

876 гигабайт.
Охуеть, конечно.
Может Q8 взять лучше, лол?.. =D

Вижу, https://github.com/ggml-org/llama.cpp/pull/25342 еще не вмерджен, потыкаем и там.
Настройки X
Ответить в тред X
15000
Добавить файл/ctrl-v
Стикеры X
Избранное / Топ тредов