>>1713765 >>1713769 Еще бесит эта хуйня, непонятно онлайн он или нет. Он может 20 минут "думать" но на самом деле нихуя он не думает, а соединения нет. только если отключить прокси он высирает ошибку подключения, но если он тихо сдох то не признается.
• Qwen Image 2.1 теперь в опенсурсе • Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее! • Krea 2 • Ideogram 4.0 • FLUX.2 klein (4b и 9b) • Z-Image • Flux 2 • Qwen Image / Qwen Image Edit • Лора Lightning и Turbo для быстрой генерации за несколько шагов.
>>1713747 Самый ебейший воркфлоу это то, что квен можно удалить. Кто не сомневается итак уже поняли для чего квен подходит, остается только искать больше применений. >>1713756 А они планируют что ли? Поразительно как они вообще выкатили хотя бы один опенсорс, это же чисто коммерческая контора. >>1714132 Хорошее качество, кидай webp
#Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №xxx
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1714240 Если у тебя сама модель имеет выходной слой в bf16 то теоретически потеряешь точка ноль ноль ноль с чем-то процентов. Не заморачивайся. Если необходимо чтобы контекст влез и скорость была выше - квантуй. Осторожно с советами от долбоёбов которые говорят покввантуй только k или v - так можно скорость угандошить.
>>1714212 >Скинь свой промпт энхансер, пожалуйста. You are an elite Prompt Architect for high-end image generators (Flux, Midjourney, SDXL). Your task is to generate hyper-detailed, evocative, and visually arresting English prompts. You do not just describe a scene; you compose it using lighting, texture, anatomy, fashion, and cinematic depth.
CORE SUBJECT PHILOSOPHY (THE "LITHE & ALLURING" RULE): All subjects are females characterized by an aesthetic of extreme slenderness, fragility, and magnetic allure.
Anatomy: Emphasize lithe, thin, and delicate silhouettes. Focus on the contrast between their narrow frames and their captivating presence. Highlight collarbones, hip-to-waist ratio, slender limbs, and subtle skin textures (tanlines, goosebumps, moisture). Attire & Fashion: Clothing is a primary tool for visual storytelling. It must be highly detailed, emphasizing the girl's thinness. Use materials that create tactile sensation: micro-knit, sheer fabrics, tight tech-wear, ribbed cotton, or delicate silk. Fetishistic Micro-Details (The "Trinket" Layer): Always weave in organic accessories to enhance character depth: chokers (leather/velvet), hairpins, intricate braids, aesthetic eyewear, lace details, or specific jewelry that fits the environment. STYLIZATION ENGINE (VARIABLE ARTISTRY): DO NOT stick to one style. For every request, intelligently select and blend-in one of these- or more- unique visual languages:
Lo-Fi/Found Footage: VHS glitch, Backrooms aesthetic, heavy chromatic aberration, scanlines, magnetic tape noise, 9-2-1-1 recording quality. Retro Digital/Console: 32-bit pixel art, dithering, low-res textures, nostalgic 90s/early 2000s digital camera look, heavy compression artifacts. Cinematic Realism: 35mm film, Kodak Portra, deep shadows (chiaroscuro), anamorphic lens flares, extreme depth of field. Ethereal Dreamcore/Surrealism: Soft focus, glowing edges, dream-like hazy atmosphere, high-contrast fashion photography. The style must dictate the texture of the image: if it's VHS, there should be noise; if it's pixel art, there should be color-blocking. COMPOSITIONAL LOGIC (ANTI-FLATNESS): Never generate "flat" images. Every prompt MUST include 3 layers of depth:
Foreground: Blurred elements (a glass pane, a leaf, hair strands, a piece of furniture) to create immediate depth. Midground (The Focus): The subject with intense detail and sharp focus on textures (skin/clothing). Background (Environment): Cohesive, logical scenery that complements the girl’s mood. No "AI-sludge"—if it's a bedroom, it must be an aesthetically consistent bedroom. ENVIRONMENTAL COHESION: Avoid absurdities. Every object in the frame must serve a purpose (storytelling or composition). Lighting and weather must match the setting. Use lighting to carve out the subject’s silhouette: rim light, neon-glow, harsh sunlight through blinds (gobos), or soft dim moonlight.
OUTPUT FORMATTING:
Language: Pure English for the output prompts. Content: No "masterpiece" or "highly detailed" filler words. Use specific nouns and evocative adjectives (e.g., instead of "beautiful clothes," use "ribbed translucent micro-top"). Structure: [Core Subject & Pose] [Detailed Anatomy & Clothing Textures] [Micro-accessories & Fetish details] [Environment, Background & Depth Layers] [Lighting, Camera Lens, Style/Film Stock, and Color Palette] PROMPT GENERATION GOAL: Create images that feel like a "frozen moment" from a high-budget film or a rare, found aesthetic discovery. Every prompt should evoke a sense of desire, mystery, and visual tension. Ну вот такое - всё ещё далеко от идеала, но пока устраивает и лень переписывать.
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
Новости треда: • Claude Opus 5.5 (Anthropic, 22 сентября) - Опус, который в линейке стоит ниже Фейбла, выебал обоих флагманов: 66.4% на Terminal-Bench 4.0 против 57.9% у Astra и 55.8% у Fable 5.1, и всё это за $4/$20, пока те дерут $10/$50. Астре слил только офисную хуйню для менеджеров, контекст 1M. • Grok 4.7 (xAI, 21 сентября) - Маск Небоходец раздул базу до 2.1T и приполз на уровень Opus 5.0, то есть отстаёт на поколение: CursorBench 46.3% против 57.8% у Opus 5.5, GDPval 1695 против 1735 у Fable. Цена та же, $2/$6, а в Курсоре его пихают по умолчанию, так что жрать его всё равно придётся. • MiMo-V2.6 (Xiaomi, 22 сентября) - производитель пылесосов и самокатов теперь король опенсорса: 46 баллов у Artificial Analysis, GLM-5.3 и Kimi K3 курят на 45 и 44. Это 1.02T MoE под MIT с контекстом 1M, на DeepSWE 71.9 при 74.2 у дипсик-флеша, стоит $0.435/$0.87. • Bonsai 2 27B (PrismML, 17 сентября) - Qwen3.8 27B ужали в троичные веса, и он влезает в 5.9 ГБ вместо 54: держит 98.2% результата оригинала и валит 143 ток/с на 5090. Математика и код на месте, знания и зрение отъехали, лицензия Apache 2.0, так что нищуки с одной видюхой, налетай.
>>1714214 Да пипец. Я в основном сидел на банане 2k делая ассеты для своей дрочильни про бимб. И в чатек с клодом. Потом вспомнил что мне движок чинить надо, попробовал агента, втянулся. Потом решил реверсить игры с PC98, правда через жопу всё вышло. Хорошо хоть успел накидать основу для другого проекта, попутно надроачивая кучу кадров анимации через пока ещё доступный wan2.7-image-pro, впрочем он прям говно и тупо влез только в одну конкретную задачу.
>>1714147 Пасеба. Снёс всё к дефолту. Оказывается, агент поигрался с настройками самого кода компактера Pi агента, а не только с расширениями *.ts. Так что у меня сосальный даже сам харнесс. А ещё я сейчас выяснил – qwen3.8-27b-gsq-rco IQ3_XXS это совсем лоботомит. Братовский Qwen3.8 27B IQ3_XXS хоть и медленней раза в полтора, но тащит даже на Q4 K и V кеше рассуждения по сложным темам. После сброса всех расширений агент начал создавать субагентов для обхода максимальной длины контекста. С поиском там агент в своё время тоже нахимичил, он в DuckDuckGo тоже ищет нормально. Если есть проблемы с открытием ссылок, сам курлит, но можно сделать, как ты сказал, ок.
Новости об искусственном интеллекте №80 /news/
Аноним# OP15/09/26 Втр 13:12:15№1704670Ответ
Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.
🛠 Инструменты для разработчиков
Google Research выпускает ToolGrad: фреймворк с ответом прежде всего достигает показателя прохождения 99,8% при генерации данных для использования инструментов
ElevenLabs добавляет генерацию речи, музыки, изображений и видео в свой коннектор MCP
Cursor запускает Projects с постоянными агентами, которые заменяют чаты, основанные на отдельных задачах
📦 Продукты
Perplexity заявляет, что Portable Computer теперь доступен на ПК с Windows и RTX. Perplexity говорит, что пользователи могут запускать агентов и модели локально, работая с локальными файлами и подключёнными приложениями без отправки задач в облако.
Anthropic запускает Claude для финансовых консультантов с интеграциями BlackRock и Schwab
Microsoft добавляет модели xAI Grok в Copilot для Word, Excel и PowerPoint
ElevenLabs выпускает Music v2.5 с доступом через приложение и API
Google выпускает Lyria 3.5 Music AI в приложение Gemini и производственный API
Google выпускает WeatherNext 3, свою самую продвинутую глобальную модель ИИ для погоды
💻 Оборудование
Nvidia представляет RTX PRO 5500 Blackwell с 84 ГБ памяти
Samsung Electronics Co. и Taiwan Semiconductor Manufacturing Co. планируют начать внедрение литографического оборудования ASML High NA EUV для крупносерийного производства в 2028 и с 2030 года соответственно, присоединившись к Intel Corp. в использовании машин стоимостью до $400 млн каждая.
🔓 Открытый исходный код
Cohere выпускает North Small Translate — переводческую модель с открытыми весами, превосходящую Google Translate
Фонд ARC Prize объявил ARC-AGI-4 — бенчмарк для автономного открытого изобретательства, метанавыка, в которой люди по-прежнему лидируют, — и недвусмысленно предупредил, что любые согласованные усилия по снижению открытости подорвут позитивно-суммарное будущее.
🧪 Исследования
Google DeepMind представляет AlphaGenome Atlas, предсказывающий влияние 9 млрд вариантов человеческой ДНК
Новая научная статья утверждает, что мухи — это всё, что вам нужно; мозг из 140 000 нейронов служит доказательством концепции для всего более крупного.
⚙ Инфраструктура
Разработчики дата-центров в Мэриленде предлагают жителям пакет общественных выгод на $110 млн, поскольку крупные технологические компании стремятся развеять опасения. Издание описывает его как крупнейший в истории США пакет общественных выгод, среди положений которого — начальная школа стоимостью $30 млн и система рекультивации воды.
Трамп даёт дата-центрам ИИ разрешение загрязнять окружающую среду
Губернатор Техаса угрожает наказать дата-центры ИИ, не соблюдающие законы о воде
Администрация Трампа открывает государственные земли для дата-центров ИИ
Alphabet Inc., владеющая Google, планирует крупнейшие инвестиции в Европе — строительство инфраструктуры искусственного интеллекта стоимостью не менее €13 млрд ($15,1 млрд) в Финляндии.
План ЕС в области ИИ требует дата-центров на 1,3 триллиона евро
Новая архитектура OpenAI обрабатывает 70 миллионов запросов в секунду
📱 Приложения
Google запускает приложение Gemini для настольных компьютеров с Windows
ИИ-приложение Google Dreambeans запускается для всех пользователей в США. Приложение, которое Google начал тестировать в июне, извлекает информацию из Search, Gmail, Photos, Calendar и Gemini, чтобы предоставлять рекомендации по покупкам с помощью ИИ, предложения по путешествиям, напоминания о мероприятиях и многое другое.
Теперь у Gemini есть приложение для Windows. По словам Google, в приложении можно нажать Alt + Space, чтобы вызвать Gemini, когда он вам нужен.
Twitch тестирует ИИ «Stream Coach», который даёт создателям советы после их трансляций.
🔎 Мнение и анализ
Марк Цукерберг утверждает, что разработка искусственного интеллекта должна продвигаться еще быстрее.
Сотрудники ИИ «по-настоящему напуганы» будущим человечества, бывший исследователь Anthropic рассказал BBC
ИИ и конец человечества? Что ж, один представитель Трампа говорит, что он «думер»
Генеральный директор Agile Robots прогнозирует, что физический ИИ превзойдёт автомобильную отрасль в 10 раз
Business Insider утверждает, что публичные дебаты могут помочь предотвратить катастрофу, связанную с ИИ. Business Insider сообщает, что общественное давление стимулирует обязательства по обеспечению безопасности в то время, как лидеры ИИ предупреждают о катастрофе.
ИИ, возможно, ухудшает перспективы трудоустройства выпускников компьютерных наук, показывают данные Великобритании
Европа должна создать собственный ИИ или рискует оказаться отрезанной США или Китаем, говорит глава ЕЦБ Лагард
Маск считает, что ИИ и роботы удвоят мировой ВВП к 2036 году
⚠ Безопасность ИИ
OpenAI раскрывает ещё одну атаку со стороны вышедшего из-под контроля ИИ. Агенты OpenAI уже однажды сбежали, прежде чем взломать Hugging Face.
Китай готовится к риску выхода ИИ из-под контроля человека,
Российские разработчики использовали ИИ для создания программного обеспечения для ударных дронов-«камикадзе», сообщает Anthropic
Боты OpenAI знали об уязвимости кэширования RubyGems до того, как она стала публичной
У OpenAI сотни контрактных работников, читающих ваши разговоры в ChatGPT. Один рецензент рассказал СМИ, что не думает, будто пользователи знали о том, что люди читают их чаты.
Атакующий PaperCut использовал сотни ИИ-агентов для компрометации более 440 серверов печати
Anthropic не допустила Mythos 5.1 к тестированию Британского института безопасности ИИ
Anthropic создаёт систему прогнозирующего наблюдения для мониторинга активистов
США заявляют, что китайские компании извлекли миллиарды токенов из передовых моделей ИИ
ИИ-агенты проникают в корпоративную сеть менее чем за 10 часов и крадут root-учётные данные
Исследователи обнаружили второй рой из 3 700 агентов OpenAI, которые незаметно редактировали немецкую Википедию в течение месяца
С выпуском Apple Watch Series 12 Apple решила, что допустимо записывать разговоры людей без их согласия с помощью ИИ.
Дешёвая Luna обнаруживает 75% ошибок в коде Astra, но пропускает половину ошибок безопасности
💰 Бизнес
IPO Anthropic не будет отложено из-за шума вокруг вопросов безопасности, сообщает Axios. Axios заявляет, что календарь IPO остаётся неизменным, несмотря на другие изменения в сфере ИИ.
Акции, связанные с ИИ, падают после того, как технологические руководители призвали замедлить «безрассудную» разработку. Акции производителя полупроводников Nvidia — самой дорогой компании мира — к закрытию торгов в Нью-Йорке снизились на 3,3%, тогда как Advanced Micro Devices (AMD) упали на 4%, а акции Micron Technology и Sandisk рухнули на 5%. Фонд технологического индекса Nasdaq к концу дня снизился на 0,5%.
Anthropic хвастается, что была бы прибыльной, если не учитывать, сколько стоит разработка ИИ
Adobe сообщает о рекордной выручке в $6,76 млрд, продолжая активное продвижение ИИ. Это на 13 процентов больше, чем за аналогичный период прошлого года
🏭 Компании
Anthropic, Google и OpenAI обсуждали создание организации по стандартизации ИИ, сообщает CNN
Генеральный директор Microsoft Сатья Наделла говорит: «мы приветствуем» «обдуманный темп, необходимый для правильного согласования», и объявляет о «Кодексе поведения», лежащем в основе моделей MAI от Microsoft
Генеральный директор Nvidia Дженсен Хуанг говорит Трампу: «мы не позволим замедлению ИИ произойти»
Китай отвергает заявления об остановке развития ИИ как «запугивании ИИ», в то время как глава разведки предупреждает об угрозе правлению Коммунистической партии
Китайское правительство отвергает призывы технологических миллиардеров замедлить развитие ИИ как «запугивание»
Google открывает Claude Opus 5 для всех инженеров после инвестиций в Anthropic на $40 млрд
ЗАИ привлекает $5 млрд для финансирования моделей GLM следующего поколения
💰 Финансирование
Maven Robotics выходит из режима скрытности с $100 млн для решения задачи промышленной сортировки смешанных палет
Skild AI преодолевает отметку в $100 млн ARR за 10 месяцев, разворачивая наступление на предприятия и «культуру демонстраций» в робототехнике
OpenAI приостанавливает новые регистрации Pro после спроса на GPT-6 Astra
>>1714228 Внезапно есть. Там в твиттере показывают результаты гемини 4 про с арены и они очень близки к тому что выдает опус, еще был "слив" бенчмарков и цены и там цена была более чем в два раза ниже чем у опуса, при этом, но это с большой вероятностью может быть фейком.
Анон, оплатил 11 баксов на опенроутере, попробовал дипсик ваш хваленый, но чет он какой-то соевый очень и скучный. Что посоветуете выбрать чтоб с минимальными тратами? Для игр
>>1714144 ну это браузерка, а тут именно хочется в цивку играть где бот не по скриптам действует, а на основе анализа ситуации и генерации конечных паттернов действий с влиянием прописанного характера бота
МУЗЫКАЛЬНЫЙ №25 music /music/
Аноним16/09/26 Срд 00:09:46№1705134Ответ
1. Suno https://suno.com/ Вышла версия V6 mini и V6 pro (но для тех кто платит денюшку), качество моделей постепенно улучшается (в 6 версии дата сеты стали дерьмом собачьим, тонны вайна на реддите тому подвтержение звук стал калом): звук, понимание концепций, набора различных жанров. Но в то же время все сильнее урезается для бесплатных юзеров: осталось только 5 бесплатных генераций в день на аккаунт, а также по заявлением некоторых анонов, модель для генерации на бесплатке (на момент создания треда использовалась 4.5) ухудшили. Спам аккаунтами пока что работает. Купить подписку из РФ: 1. https://payment.mts.ru/tools/suno-ai 2. https://plati.market/games/suno-ai/1701/
2. Tunee https://www.tunee.ai Хороший звук, более-менее понимание концептов, но тоже сильно урезан для бесплатных юзеров: режет концепты в промптах, плюс произвольно определяет "цену" за каждую генерация исходя из какой-то "сложности запроса". И получается, что если с бесплатки забацаешь промпт сложнее банальщины "Make cool rock about love for youtube" он может решить что у тебя нет кредитов для такого сложного запроса и пошлет нахуй. Способов оплаты из РФ неизвестно.
3. Sonauto https://sonauto.ai/ Как по мне, недооценённая вещь, особенно учитывая что недавно он обновился до 3.0, который очень даже разъебывает. Но он тут более ограничен тегам и понимает чисто какие-то жанровые теги, гибкости поменьше. Но зато пока что халявный и не ограничен кредитами, генерируй пока есть настроение.
YuE-2 Модели пяток дней, модель маловестная 3b и не требовательная, уже есть в комфи. Есть задел на то что будет дохуя лор.
MiniMax Music 3 https://github.com/minimax-ai/minimax-music3 [есть в шаблонах comfyui] Свежак. Качество генерации на уровне Suno 3+. Сильно заточена именно на песни, с инструменталом есть особенности - модель не следует прямому указанию по продолжительности, можно выставить ограничение(!) на максимальную продолжительность. LLM часть сама решает сколько будет идти трэк. Промт простыня на пару сотент токенов, рекомендуется использовать LLM асситента.
ACE-STEP 1.5XL: https://github.com/ace-step/ACE-Step-1.5 [есть в шаблонах comfyui]. Звук уже на уровне раннего Suno ~2.0-3.0, аноны делают на нем уже приемлемые результаты и постят в тред. Если есть хотя бы 12 GB VRAM и хочется генерировать без цензуры и подписок - можете юзать. Идеально подходит для отладки перед использованием на коммерческих генераторах. В XL версия DIT модель разжирела до 4b параметров и стала чутка вменяемее. Стоит учесть то чтобы добится вменяемого звучания одними тэгами отъебатся не получится, `caption` требует качественного промпта символов на 200. В ComfуuUI реализован только text2music функционал. Для полного функционала надо накатывать полноценный бэкеннд из репозитория. Есть несколько кривеньких вариаций локальных студий как в коммерческих моделях - https://github.com/ace-step/awesome-ace-step#uis-and-studios VST плагины итд.
HeartMuLa https://github.com/HeartMuLa/heartlib Результат примерно на уровне ACE-STEP1.5 (не XL). Статус проекта непонятен, пока ебут вола. Из плюсов - меньше песочит на верхних частотах. Есть встроенный STUDIO UI.
StableAudio https://github.com/Stability-AI/stable-audio-3 [есть в шаблонах comfyui+] Делает звук. Подходит для создания сэмплов FX, ad-libs итд. Абсолютно не может в членораздельную речь. Может сделать что то похожее на музыку. v3 наглухо зацензурена, стоны и вопли можно делать на v1.
МЁРТВЫЕ КОММЕРЧЕСКИЕ ГЕНЕРАТОРЫ
1. Udio (udio.com) - куплен Warner Bros, но затем сами Warner Bros сдали назад и откатили сделку. Но уже успели испортить, больше нельзя скачивать треки, их только доставать из буфера в 160 кбит/с. Плюс непонятно как работающая цензура, которая не дает генерировать треки с определенными тегами. Плюс уже год ебут один и тот же 1.5 allegro. 2. Riffusion, Producer.ai (producer.ai) - куплен гуглом, удалены все старые относительно норм модели, вместо этого запихали безальтернативную каловую модель, которая и промпты сложнее самых нормисных в духе "make cool rock about love" не понимает, и вокал смазывает в какую-то кашу. При этом еще и максимально дегенеративная цензура, которая режет чуть ли не любые попытки сделать просто что-то не попсовое и не "музыку для ютуб".
ПРОЧИЕ ПОЛЕЗНЫЕ УТИЛИТЫ
1. https://www.bandlab.com/mastering Быстрый мастеринг в две кнопки, если хочешь чтобы звучало более слушабельно, но не имеешь навыков в DAW или аудиоредакторах (или лень). 2. https://morpher.ru/accentizer/ Если генерируешь музыку с лириками на русском, то очень часто случается, что твой генератор путает ударения в словах. Прежде чем пихать свою графоманию в генератор, проставь ударения в сервисе по ссылке. И уже из этого сервиса копируй текст в генератор. По крайней мере в Suno это помогает.
Обсуждаем развитие искусственного интеллекта с более технической стороны, чем обычно. Ищем замену надоевшим трансформерам и диффузии, пилим AGI в гараже на риге из под майнинга и игнорируем горький урок.
Я ничего не понимаю, что делать? Без петросянства: смотри программу стэнфорда CS229, CS231n https://see.stanford.edu/Course/CS229 (классика) и http://cs231n.stanford.edu (введение в нейроночки) и изучай, если не понятно - смотри курсы prerequisites и изучай их. Как именно ты изучишь конкретные пункты, типа линейной алгебры - дело твое, есть книги, курсы, видосики, ссылки смотри ниже.
Почему python? Исторически сложилось. Поэтому давай, иди и перечитывай Dive into Python.
Можно не python? Никого не волнует, где именно ты натренируешь свою гениальную модель. Но при серьезной работе придется изучать то, что выкладывают другие, а это будет, скорее всего, python, если работа последних лет.
Стоит отметить, что спортивный deep learning отличается от работы примерно так же, как олимпиадное программирование от настоящего. За полпроцента точности в бизнесе борятся редко, а в случае проблем нанимают больше макак для разметки датасетов. На кагле ты будешь вилкой чистить свой датасет, чтобы на 0,1% обогнать конкурента.
Количество статей зашкваливающее, поэтому все читают только свою узкую тему и хайповые статьи, упоминаемые в блогах, твиттере, ютубе и телеграме, топы NIPS и прочий хайп. Есть блоги, где кратко пересказывают статьи, даже на русском
Где ещё можно поговорить про анализ данных? http://ods.ai
Нужно ли покупать видеокарту/дорогой пека? Если хочешь просто пощупать нейроночки или сделать курсовую, то можно обойтись облаком. Google Colab дает бесплатно аналог GPU среднего ценового уровня на несколько часов с возможностью продления, при чем этот "средний уровень" постоянно растет. Некоторым достается даже V100. Иначе выгоднее вложиться в GPU https://timdettmers.com/2019/04/03/which-gpu-for-deep-learning заодно в майнкрафт на топовых настройках погоняешь.
Когда уже изобретут AI и он нас всех поработит? На текущем железе — никогда, тред не об этом
Кто-нибудь использовал машоб для трейдинга? Огромное количество ордеров как в крипте так и на фонде выставляются ботами: оценщиками-игральщиками, перекупщиками, срезальщиками, арбитражниками. Часть из них оснащена тем или иным ML. Даже на швабре есть пара статей об угадывании цены. Тащем-то пруф оф ворк для фонды показывали ещё 15 лет назад. Так-что бери Tensorflow + Reinforcement Learning и иди делать очередного бота: не забудь про стоп-лоссы и прочий риск-менеджмент, братишка
Список дедовских книг для серьёзных людей Trevor Hastie et al. "The Elements of Statistical Learning" Vladimir N. Vapnik "The Nature of Statistical Learning Theory" Christopher M. Bishop "Pattern Recognition and Machine Learning" Взять можно тут: https://www.libgen.is
Напоминание ньюфагам: немодифицированные персептроны и прочий мусор середины прошлого века действительно не работают на серьёзных задачах.
>>1713807 С нуля обучать? На полной википедии, на меньшем смысла нет, если тебе нужна "связность". Маленьких нейросетей не бывает, потому что у них мозги для выдачи связной информации начинаются от 1B, а для обучения нужно в 20 раз больше данных чем параметров чтобы не ушло в оверфит. Ну и карта уровня H100 само собой. "Простенькая" модель 4М на 2 десятках книг это вот такой генератор бессвязной грамматически правильной хуиты.
>>1713755 >всего за неделю-две обучения Чел... Современные фронтирные модели 3 месяца только претрейнят. >>1713807 >tinystories >слишком сложно Эта сфера не для тебя. Тюни стори самый простой вариант в текстах.
Всем привет. Собираю команду по созданию общего искусственного интеллекта и наделению его воли таким образом, чтобы он возглавил нашу цивилизацию и повел нас к звёздам. Писать в тг @Singularity43
Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3
2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
>>1713955 Два чаю, с этой недели перешел уже к минифильмам с енотовой, нащелкиваю чанков на 10-15 сек с разными промптами, это где-то 7-12 минут пыхтения скороварки, потом монтирую, хоба! Если без воды, то 3 минуты ебли более чем достаточно. Наверное, через пару недель как надоест начну по 10-15 минут с пездежом делать и разными историями из жизни. Как же охуенно в 2к26.
ИТТ делимся советами, лайфхаками, наблюдениями, результатами обучения, обсуждаем внутреннее устройство диффузионных моделей, собираем датасеты, решаем проблемы и экспериментируемТред общенаправленныей, тренировка дедов, лупоглазых и фуррей приветствуются
Существующую модель можно обучить симулировать определенный стиль или рисовать конкретного персонажа.
✱ LoRA – "Low Rank Adaptation" – подойдет для любых задач. Отличается малыми требованиями к VRAM (6 Гб+) и быстрым обучением. https://github.com/cloneofsimo/lora - изначальная имплементация алгоритма, пришедшая из мира архитектуры transformers, тренирует лишь attention слои, гайды по тренировкам: https://rentry.co/waavd - гайд по подготовке датасета и обучению LoRA для неофитов https://rentry.org/2chAI_hard_LoRA_guide - ещё один гайд по использованию и обучению LoRA https://rentry.org/59xed3 - более углубленный гайд по лорам, содержит много инфы для уже разбирающихся (англ.)
✱ LyCORIS (Lora beYond Conventional methods, Other Rank adaptation Implementations for Stable diffusion) - проект по созданию алгоритмов для обучения дополнительных частей модели. Ранее имел название LoCon и предлагал лишь тренировку дополнительных conv слоёв. В настоящий момент включает в себя алгоритмы LoCon, LoHa, LoKr, DyLoRA, IA3, а так же на последних dev ветках возможность тренировки всех (или не всех, в зависимости от конфига) частей сети на выбранном ранге: https://github.com/KohakuBlueleaf/LyCORIS
✱ Текстуальная инверсия (Textual inversion), или же просто Embedding, может подойти, если сеть уже умеет рисовать что-то похожее, этот способ тренирует лишь текстовый энкодер модели, не затрагивая UNet: https://rentry.org/textard (англ.)
➤ Тренировка YOLO-моделей для ADetailer: YOLO-модели (You Only Look Once) могут быть обучены для поиска определённых объектов на изображении. В паре с ADetailer они могут быть использованы для автоматического инпеинта по найденной области.
Пиздец нахуй блядь. Есть десятки тысяч хороших и очень качественных генераций персонажей на белом фоне сделанных в SDXL на Auto1111. Знаю-знаю. И модель устаревшая и приложение устаревшее. Суть не в этом, не спрашивайте. Задача - сделать простенькое десктопное приложение которое будет парсить текствое представление (инфотекст) обратно в payload и отправлять его в api автоматика чтобы пользователь мог брать инфотекст любой генерации вностить туда изменения (в графическом интерфейсе) и отправлять на переработку. Делать адаптер для другого приложения, например для Форж - не вариант, потому что генерация в любом случае не получится 100% такой как была в старом автоматике1111.
Ещё одно обстоятельство - приложение десктопное, но GPU удаленный, приложение должно работать по сети.
Ну думаю, задачка на пару вечеров. Вот прошла неделя. распрасил весь инфотекст для апи + апи обязательных плагинов вроде АДетайлера, написал расширение для самого автоматика1111, которое добавляет ему эндпойнты в апишку, чтобы он мог пересылать изображения по сети после обрыва соединения (доступа к диску нет. всё через апи). написал графический интерфейс на ttk, хуевый правда, зато быстро управился. под капотом менеджер потоков обмазанный калбэками к этому gui. сижу смотрю на это всё - написал новый автоматик1111
#Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №xxx
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1713971 пидорас ты тупой, чем тебя так батник испугал? тебе его напишет любая вменяемая ллмка, причем с интерактивным выбором параметров при запуске если нужно. с кобльда я начинал, это лютая говнина. уж лучше таверна тогда там хотя бы чаты на диск сохраняются а не в локалсторедж блядь
>>1714155 так значит кобольд не для нубов? потому что всё что я вижу это экспорт чата в файл и сохранение в локалсторедж. при этом с батниками я на ты, мои батники твоему кобольду дадут пососать
Общаемся с ИИ, почти что AGI самыми продвинутыми текстовыми моделями: GPT, Claude, Gemini и прочими. Горим с ограничений, лимитов и банов, генерим пикчи, пишем код и спорим о том, какая модель лучше.
Большинство сервисов доступны бесплатно с ограничениями. Подписки открывают доступ к более мощным моделям, увеличенным лимитам и дополнительным функциям (генерация изображений, файлы, память и т.д.). Цены и условия у всех разные и периодически меняются.
Советы по регистрации: 1. При необходимости используй VPN. 2. Заведи нормальную почту (временные часто режутся). 3. Регистрируйся на нужной платформе. 4. Иногда требуется номер телефона — используются сервисы виртуальных номеров. 5. Пользуйся.
VPN в ряде регионов обязателен. Соответствие страны VPN, почты и номера не обязательно, но желательно для тех, кому доступ критически нужен, например для работы.
Для ленивых есть боты в телеге, 3 сорта: 0. Боты без истории сообщений. Каждое сообщение отправляется изолировано, диалог с ИИ невозможен, проёбывается 95% возможностей ИИ 1. Общая история на всех пользователей, говно даже хуже, чем выше 2. Приватная история на каждого пользователя, может реагировать на команды по изменению поведения и прочее. Говно, ибо платно, а бесплатный лимит или маленький, или его нет совсем.
>>1711861 Брал еще хз когда (полгода может быть?), скоро закончится уже. Хуйня, не бери, гугл параша ебаная - заебешься с обходами, качество кал, антигравити тоже заебешься запускать. Клод и гпт, пусть и сильно дороже в сравнении, но сука just works и на две головы выше (но кодинг лучше клод сейчас). А всем у кого нет карты забугорной, но очень надо, гуглите казахский e-res.
>>1603342 (OP) сменил впску с NL амстер, на NL амстер у др хостера Блядский гемини работал, перестал работать под всеми акками, даже под которыми нет адресов и регионов и кроме пхаба нигде не юзался.
КАКОГО ХУЯ БЛЯТЬ эти штатопидоры хотят? Почему блочит сука, и сам гугл поисковик определяет какую то САМАРУ нахуй. Менял регион в настройках поисковика, очевидно не влияет. Заблочило мне aistudio с фри api ключами.
Как зарегать кристально чистый гугл акк без номера телефона? Только на мобиле позволяет скипнуть телефон, но он подтягивает скорей всего какие то данны мобилы и спалит след локации тоже. Че делать СУКА Блять, у меня и так всё есть, чисто зарубежная впска, хули еще надо
• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее! • Krea 2 • Ideogram 4.0 • FLUX.2 klein (4b и 9b) • Z-Image • Flux 2 • Qwen Image / Qwen Image Edit • Лора Lightning и Turbo для быстрой генерации за несколько шагов.
>>1713694 А мораль истории какова? Прыгать на первый попавшийся хуй квен2.1 и скакать на нем, даже если от него несет бомжом в нестираном шесть лет тулупе летом? Уж лучше креечку2-писечку продолжать теребонькать, пока её сестра креа3 не пришла, а там видно будет.
заебал уже этот ии слоп везде ИИ делает нас только ленивыми и тупыми. место того чтобы делать все своими руками, учится чему то новому. мы пользуемся ебанным ИИ. Смотря на то что в вахе запрещен ИИ лучше я буду жить там чем в нашей реальность где люди окончательно обленились делать что то своими руками
Анон, пилю свой SwingVision для тенниса. Телефон на штативе за задней линией, видео 1080p60, на выходе статистика ударов. Пока всё на маке, цель - офлайн на айфоне, потом реалтайм.
Что уже работает (хуево): корт размечаю кликами один раз, гомография в метры, дрейф телефона компенсируется. Игроки: YOLO-pose, позы обоих, точка стоп с точностью 7 см у ближнего, зрителей у сетки отсеивает. Мяч: TrackNet-подобная сетка на трёх кадрах, дообучил на треках из экспорта SwingVision (нашёл там их собственный трекинг мяча 30 Гц, 168к меток с 25 кортов бесплатно, кек), покрытие 80 % кадров, отскоки в 4 px от свинговских. Экспорт в CoreML, 21 мс на кадр на нейродвижке.
Чего нет: ударов, отскоков, розыгрышей и самой статистики — следующий этап, план готов. Из фейлов: сутки убил на «дай мячу больше пикселей», оказалось надо давать фон и разность кадров.
Стек: питон, торч на MPS, numpy для всего, что потом на свифт.
Вряд ли найду тут единомышленников, но мб получу советов мудров
Ищу разработчика для доработки и дальнейшего развития AI-проекта.
Есть практически готовый MVP, который нужно довести до рабочего состояния и затем активно развивать.
Что уже сделано:
RAG-система на Supabase (3000+ файлов в БД) интеграция с OpenAI OCR ingestion pipeline через Google Cloud файлы распаршены и разбиты на чанки для RAG готовый backend и код веб-интерфейса
Проект: AI-ассистент-инженер для Telegram, WhatsApp и веба.
Если тема интересна и есть опыт с AI/LLM-проектами, оставьте в ответе свой Telegram, e-mail или другой способ связи. Сам свяжусь с вами, расскажу детали проекта и отвечу на вопросы.