Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
Новости треда: • Claude Opus 5.5 (Anthropic, 22 сентября) - Опус, который в линейке стоит ниже Фейбла, выебал обоих флагманов: 66.4% на Terminal-Bench 4.0 против 57.9% у Astra и 55.8% у Fable 5.1, и всё это за $4/$20, пока те дерут $10/$50. Астре слил только офисную хуйню для менеджеров, контекст 1M. • Grok 4.7 (xAI, 21 сентября) - Маск Небоходец раздул базу до 2.1T и приполз на уровень Opus 5.0, то есть отстаёт на поколение: CursorBench 46.3% против 57.8% у Opus 5.5, GDPval 1695 против 1735 у Fable. Цена та же, $2/$6, а в Курсоре его пихают по умолчанию, так что жрать его всё равно придётся. • MiMo-V2.6 (Xiaomi, 22 сентября) - производитель пылесосов и самокатов теперь король опенсорса: 46 баллов у Artificial Analysis, GLM-5.3 и Kimi K3 курят на 45 и 44. Это 1.02T MoE под MIT с контекстом 1M, на DeepSWE 71.9 при 74.2 у дипсик-флеша, стоит $0.435/$0.87. • Bonsai 2 27B (PrismML, 17 сентября) - Qwen3.8 27B ужали в троичные веса, и он влезает в 5.9 ГБ вместо 54: держит 98.2% результата оригинала и валит 143 ток/с на 5090. Математика и код на месте, знания и зрение отъехали, лицензия Apache 2.0, так что нищуки с одной видюхой, налетай.
Только если ты не против, что 75% затраченных токенов на задачу были потрачены на фоновые операции харнесс
Почетное последнее место в кодинг бенчах. Это как агентится через опенклов, но зачем-то сидя за ПК, а не через телегу. Опенклов допёр заколлабится с pi чтобы закрывать кодинг задачи, hermess - нет.
ТЛДР - буквально хуже, чем расширяйка на вскод типа cline, а это показатель. Въёбывать поделке что хуже cli агентов это надо уметь
>>1713259 Тоже. Когда делаешь запрос - вылезает верификация, принимаешь, начинает работать и потом опять просит. >>1713273 Хм. Попробую перебрать сервера из имеющихся, но итак на самом чистом сижу.
Похоже новую версию выкатят на днях, раз новый раунд ограничений доступа.
>>1713286 А если нажать Enter или отредачить старое сообщение в прошлом диалоге?
>в итоге в треде тупо 0 скриншотов с антигравити и что они там делают вообще не ясно. Лол, всего 20мб лимит. Ну пох, ужал, так даже смешней. Всё равно это всё незаконченные WIP. >>1713196 → Бля, ну вот чё ты хрюкаешь? Я как пересел на клод в 23, потом на гемини в 2026, к калугпт больше не возвращался. Раз в полгода-год тестил как он справляется и могу сказать, что с 2023 по 2026 в калгпт НИЧЕГО не поменялось. Он как делал дешевый (а зачастую просто неработающий) кал даже на простейших задачах, так и продолжает это делать. Демонстративно прикладываю результат калагпт и точно то же на сайте гемини пару недель назад. Меня не должно ебать то, что он якобы в теории, по заверениям блоггеров, что-то там может, если установить их вишмастер, а потом еще и платить x2-x5 больше чем за инет. В иде и гугл делает лучше. Я зашел на их сайт, как заходил с момента его открытия - он мне выдает поеботу аля дипсик. Всё. Про другие продукты этой каловой компании я вообще молчу. Пикчи с фильтром мочи и чешуи, поломанная перспектива аля sd1.4 или даже sd3 - и всё это я вижу от тех, кто в других сетках (в гугловских в основном) делал шедевры мирового уровня нахуй. Сам я к этому говну не прикасаюсь больше чем для разового теста. Единственная достойная хуйня, которую они сделали - Sora 2. И та закрылась с позором. Но я не хрюкаю об этом каждый раз как кто-то пишет про калгпт как ты.
В общем, может гемини чудес и не делает, его ещё не надрочили на модную графику и на популярные MCP, чтобы потом записывать поразительные тиктоки, но свою работу он выполняет. Особенно в написании программ - не отличить от клода, разве что по стилю интерфейса. Это уже далеко не Bard с которого все угарали. Будь уверен - гемини делает дела более чем достойно. И в отличии от шизоидного маркетинга двух других компаний, он их делает за секунды-минуты, а не часы нахуй.
>>1713353 Лол, иронично >зачем ты пердолингом занимаешься >Будь добр заплатить еще раз) >Потом еще раз >Того глядишь, на 10ый раз дойдёт, что не стоит работать с конторой пидорасов >Калгпт берет оплату потраченным временем на его изъёбы >Тебе говорят, что смысла ебстись с каломгпт никакого, ты выбираешь еблю по часу в день или больше взамен на хуевый результат за много часов
>>1713354 >А если нажать Enter или отредачить старое сообщение в прошлом диалоге? Лол, я как дебич лез в кишки электрона, ловил http запросы и чистал json'ы, чтобы понять причину, а оно банально при клике enter запрос может отправить. Короче оно написало что нужно верифицировать аккаунт, я перешел по ссылке, попросило отсканировать QR, я подрубил впн на телефоне, отсканил его и все подтвердилось даже без всяких подтверждений номера телефона и т.д. Ржака короче
>>1713354 Достаточно посмотреть на бесплатную версию гопоты, которая всегда была самая всратая по лимитам, а примерно год назад там добавили фичу чтобы экономить токены и говно в принципе перестало что-то внятное делать, а зачастую в принципе отказывается писать код или уходит от ответа. Очевидно, что и по подписке тебя накормят таким же говном, просто чуть лучше. Я хз кто это покупает и верит в шизобредни про астру лол, неужели людей еще недостаточно раз наебывали?
>>1713405 Астра хуета, которая жрет лимиты как не в себя и долго делает задачу, буквально по полчаса. Последняя версия гопоты, которая была сверхохуенная, отвечала по делу и кодила, это 5.5, но её закрывают с 14 октября. Остальные новомодные Солы, Терры, Астры и Луну впридачу можно засунуть в очко Жидальтману
>>1713443 Сейчас вместо Сола 5.6 продвигают Сол 6, якобы он экономичнее по токенам. Но как он отвечает - это полный пиздец, буквально "это не гарантировано, это не подтверждено", то ест он постоянно виляет жопой и вообще может не доделать задачу и остановиться на полпути, что 5.6 версия, что 6 версия. Я их рот ебал постоянно давать пинков под жопу, никакие сосалы не помогают
>>1713455 А альтернативы разве есть? Клод с анальной верификациями и банами ни за что (хотя у меня есть старый аккаунт, мб попробую, вдруг повезёт), антигравити где по слепку ануса выявляют реальную локацию. Остальное совсем говно небось.
>>1713460 У меня свой ВПН, который я поднял через свой сервер и Антигравити с Кодексом себя отлично чувствуют. Сначала ебался с глобальными переменными прокси, но этот вариант оказался костылем, потому что не вся информация прогружалась в харнессы, например, использование лимитов.
Потом при помощи Антигравити поднял свой ВПН, который работает чере throne на ноуте, причем сам Антигравити прописал правила для открытия российских сайтов напрямую, а заболоченные сервисы нормально открывались в браузере и десктопный телеграмм впридачу.
Проблема в том, что у Кодекса стали ебанутые лимиты, которых не хватает, у меня про за 100 баксов, плюс модели стали работать по полчаса нахуй и отвечают бесяче. Поэтому я сейчас работаю через Антигравити, и только аудит плана и код-ревью у меня делает Кодекс. Аккаунты в Антигравити я переключаю через Антигравити Тулз с гитхаба
>>1713468 Я имхо не хочу ебаться с антигравити, даже с учётом наличия своего сервера, это не особо спасёт, когда на странице смены страны гугл тыкает меня в то, что я в РФ. Посмотрю что у клода и приму решению что и где остаться.
Там ещё Жидальтман начал прогревать гоев на 500 долларовую подписочку через сброс лимитов, подсаживая пользователей на то, чтобы они постепенно привыкали к новым квотам и крутили дальше токены в дофаминовом угаре
>>1713471 У клода ёбнутая хуйня есть, что она даёт 1 миллион контекстного огня и анальные условия кэширования. Есть способ ограничивать его окно до 250к токенов?
А что объективно блять мешает дать всем с подпиской безлимитную (даже если упёрся в недельный лимит) обосанную 6 луна, которая не расходует лимит и имеет принцип fair-use с некоторыми ограничениями? Да тупая, но дешёвая пиздец и можно подсадить быдло на него, чтобы бесконечно крутили кодекс на этом говне, а не на сол с выпрашиванием ресетов.
>>1713495 Так она и сейчас по идее условно безлимитная, глядя на ее потребление? Но вообще рот ебал луны, этот лоботомит требует или указания всех пограничных случаев и невероятной точности в промпте, или ты чувствуешь что играешь с обезьяной лапой. Нахуя мне такие приключения если даже дипсак и бенчмакшенный мимо меньше под себя срут? Я уж молчу про подписку на клода. Причём Сол нынче тоже укурок ебучий. Короче я последние дни просто не использую чат гпт кроме собственно чата для ресерча.
>>1713495 >Да тупая А где тупая? На уровне СОТА годичной давности, когда все уже по-полной вайбкодили за обе щеки. Вы зажрались просто, либо вам в голову бенчмарками насрали. Никому из ИТТ на самом деле не нужны ни опусы, ни фейблы, ни астры, вы не делаете ничего такого сложного. Луны и гемини 3.8 флеш выше крыши. Да даже muse 1.3 или дипсика.
Тем более если ты хочешь иметь хоть какой-то контроль над кодбазой, то стоит задачи разбивать на подзадачи поменьше, и мелкие модели для этого подходят идеально. А ебашить "зделой гта10 за один промт" это то еще слопожорство.
>>1713516 А где тупит твой смартфон китайский за 8к рублей? На уровне флагманов 10 летней давности, когда уже все телефоны покупали за обе щёки. Вы зажрались просто...
>>1713521 У меня, неиронично тилибон - какая-то параша от сяоми, которую взял в 19 или 20 году, после того как старый аналогичный случайно оставил в такси.
Ответственно заявляю, мы на ПЛАТО. Более крутые модели особо не нужны. Отличие только иногда в кост-эффишенси, и в том, что более хайр-тир фронтиры лучше понимают, что же там очередняра хотел на самом деле, и генерять икея-стайл браузерную игру, или гуи враппер над ффмпег.
>>1713542 Нищий биокарлик, спок. Перефирия должна быть максимально дешевой и меняться по щелчку пальцев, если возникает необходимость. Аналогично юзаю дешевые мембранки и мышки. Аналогично с моделями - это тоже перефирия. Небольшие улучшения в удержании лонг-хорайзона и парсинга очереднярского реквеста у хайт-тир моделей не стоят сейчас той цены, которые требуют. Особенно, когда сейчас целый ворох моделей с перформансом на уровне впопус 4.6-4.8 и выше.
>>1713573 Берешь опенкод, подключаешь к модели, пишешь ему - ты сейчас подключен к опенкоду, дай лайфхаки как пользоваться этим харнесом. Например, напиши что такое agents.md . ей богу, 2026 год, а такие люди еще существуют.
Чем отличается coding agent от харнеса? Некоторые называют клод или кодекс харнесом, а некоторые кодинг агентом, а харнес при этом это как будто нечто поверх этого, надстроенное юзером
>>1713583 Ну да, наверное я зря так, извини. Но ты сам напрашиваешься, для коммунити полезнее будет если бы ты пошел сам пробовать, и свой отзыв тут оставил или сам нашел и рассказал нам о об этих самых "нюансов".
>>1713585 Сейчас реально проще конкретику у ллмки узнать и быстрее. У людей лучше спрашивать о всяких инструментах о которых ты не знаешь, типа сарафанного радио. Ллмки такое не подскажут, такое только у людей.
Как вы делаете аутпут агента более единообразным и предсказуемым? Сразу говорю: SDD, кастомных субагентов уровня if-else-statement-coordinator, и кучу макулатуры.md не предлагать, это ничего кроме увеличения расхода токенов не дает.
Я вот пытаюсь в lint-maxxing, врубил все неврубленные по дефолту правила, подтюнил + навалил кастомных, частично это помогает, но не позволяет закрыть вопросы уровня "а точно ли агент положил эту функцию в тот файл который нужно?", "а правильно ли он разнел логику по сущностям", "хорошее ли название у данного класса?", и т.д. Даже опущ 5.5 жестко серит в этом. Единственный вариант который вижу это придумывать такую архитектуру, в которой жестко детерминировано абсолютно всё, где можно жестко зафейлить пайплайн если положить файлик не в ту папку, но как будто это практически нереально, ведь невозможно предугадать все принципиально возможные затупы в природе
>>1713603 > SDD, кастомных субагентов уровня if-else-statement-coordinator, и кучу макулатуры.md не предлагать, это ничего кроме увеличения расхода токенов не дает > жестко детерминировано абсолютно всё, где можно жестко зафейлить пайплайн С этим только таблетки помогут. Или написание всего кода руками. Ты ведь не хочешь чтобы нейронка работала и тратила токены.
>>1713603 не понял, как ты линтерами собрался архитектуру проверять отдельный субагент ревьювер единственный путь, назови его дяди Боб, опиши подробно персональ. Еще поверх второго ревьювера можешь добавить с токсичным характером
>>1713605 > нет жесткого энфорсинга Куда пропал? Буквально в любом агенте можно поставить хук на завершение задачи и валидировать, при отказе валиации он физически не может отказаться исправлять.
Про какой "контекст инжиниринг" говорят говорящие головы, если всё что там описывается любой харнес делает сам по дефолту? Или это курсы для разработчика кастомного харнеса?
>>1713603 >но не позволяет закрыть вопросы уровня "а точно ли агент положил эту функцию в тот файл который нужно?" Линтеры не это решают тому що. Как ты сможешь статическими правилами проверить, корректна ли логика? Для этого нужен ревью.
Хз, можешь попровать писать на языках, которые жестко ограничивают, каким образом можно писаь код. Типа раста (говна). От части мотивация перехода буна с зига на раст в том, что в зиге надо следовать стайлгайду, а в расте тупа нихера нельзя делать, кроме того как надмозги придумали и еще тот факт, что антропику стало неприятно, что кривизну клод-кода высмеивают, и они купили бун, который под копотом говна, и перейти на клевый язык, который все проблемы исправит.
>>1713609 >хук на завершение задачи Задача в понимании того же клода это подкапотная хуйня, про которую промтер даже не в курсе, и что конкретно ты там собрался проверять не понятно. А хука на уровне "работа выполнена" не существует нигде, я по крайней мере не знаю, где бы такой был. Это первое. >при отказе валиации он физически не может отказаться исправлять. Кто "физически" мешает? >>1713608 >отдельный субагент ревьювер Кто конкретно мешает рутовому агенту сессии заигнорить ревьюера и сказать что все готово (но на самом деле не готово)?
Нужно делать свой харнесс. За курс по контекст-инжинирингу заплатил 29500р, так что моя архитектура верная, ошибки быть не может. Мне не подходят курсоры, опенкоды и пи. Я смотрю на придурков с их опусами и сосалами на 50к токенов, которые не понимают, что всё равно агент насрет в проекте, или снесет хоум директори. Ну это ладно. Давайте взглянем на то, как они менеджат контекст. АГЕНТС.мд, рулес, СОУЛ.мд (с неграми жанр музыки), папочка .мд файлов. Вы думаете эти малоумные осилили что-то сложнее букваря и настольной книги сантехника за свою жизнь? С ними не обсудить РАГи, LSP, валидацию кода через LEAN, аст-греп, или на худой конец как точно менеджить ризонинг или прифилить контекст в уже проверенной и известной кодовой базе. Я сомневаюсь, что на дваче найдутся понимающие агентную разработку.
>>1713616 Дефолтное ревью ревьюит только потенциальные баги, она не ревьюит стиль кода в широком смысле. А если ты делаешь свое ревью, то для меня открытый вопрос как, потому что я не понимаю. Оно же должно делаться на основе чего-то? То есть на основе макулатуры (прозы так называемой), а проза это неверифицируемое говно.
>>1713631 Чел, ревью ты можешь сам делать без агентов.
У меня на парочке средних проектов прокнуло проконтролить 3-5 МРов, и подробно описывать что не так, и что надо поменять, и иногда самому комиты вносить, которые перелопачивали архитектуру. Я потом собрал это все в один лог, попросил агента суммировать, и делать согласно вот этим правилам. Это более-менее работает. Но есть проекты, где это совсем не проканало.
>>1713608 Где прописано что субагент ревьюер должен быть запущен, и как обеспечивается что билд упадет если субагент ревьюер не будет запущен. Как проверяется качество ревью субагента ревьюера? Как обеспечивается чтобы ревью было конечным, а не бесконечным (всегда можно найти до чего доебаться, тем более для ллм)?
>>1713638 > как обеспечивается Харнессом. > Как обеспечивается чтобы Промптом.
Ты там либо на лоботомитах сидишь, либо первый день вайбкодишь. Нейронка не сможет прочитать твои мысли ни в каком варианте, но если ты адекватно опишешь буквами кашу из своей головы, то оно на фронтирах будет провалидированно корректно с вероятностью 99%.
>>1713642 Ты не ответил где прописано что субагент ревьюер обязательно должен быть запущен. >> как обеспечивается >Харнессом. Каким харнессом, и как конкретно обеспечивается. >Промптом. Конечность ревью обеспечивается промтом? Дай мне это промт >Ты там либо на лоботомитах сидишь Я сижу на попущ 5.5, до этого 5
>>1713647 > Ты не ответил где прописано что субагент ревьюер обязательно должен быть запущен. Ты долбаёб? Тебе уже сказали - хук. Он гарантированно запускает что тебе надо когда надо. И агент внутри хука может поставить флаг что задачу завершать запрещено, написать что нужно исправить и харнесс продолжит вызывать модель. > Конечность ревью Ни один фронтир не залупится на ревью. Промпты не нужны. Это не решение задачи тысячелетия чтоб он с первого раза не понял что не так.
>>1713579 Если хочешь разобраться дип как все работает - лучше pi. Если попользоваться - опенкод. В pi можно догрузить че там тебе надо из опенкода за 2-3 промпта вида "сделай вебпоиск". Из крутого - можешь придумать дизайн лучше изкоробочных для ряда функций, например того же вебпоиска (у меня через camofox обходит антибот защиту), и работает без сервисов просто локальными скриптами.
Глобально для меня лично киллер фича pi в том, что ему не нужен всл под виндой и он просто работает.
А так, дифчик небольшой. Хз че чел порвался, что pi какой-то позерский. Щас бы рваться от упоминания пи лол. Стандартный харнесс когда тебе важнее путь чем результат. И путь вполне комфортный, много понимаешь в процессе впила фичей и понимаешь что тебе нужно, а что не нужно
Если хошь могу тебе подкинуть дизайнов штук если интересно. Типа как вебпоиск вколдовать или судо (или админа) выдать для туллколла.
>>1713653 >Тебе уже сказали - хук. По какому именно хуку у тебя запускается ревьюер? >Он гарантированно запускает что тебе надо когда надо. Ты запускаешь новую сессию через cli? >агент внутри хука может поставить флаг что задачу завершать запрещено Где хранится флаг? >Ни один фронтир не залупится на ревью. На основе чего у тебя происходит ревью?
>>1713656 >Единообразие достигается STYLEGUIDE.MD Где он находится? Как тестируется, что верификатор правильно детектит и понимает нарушения стайлгайда, эвалом? Если да, то с каждой вышедшей моделью заново переписывается стайлгайд? >в скилле который зовёт твой исполнитель А если не зовёт скил, что дальше? Нет способов заставить вызывать скил, не прописав эксплицитно. Тогда вопрос, где именно это эксплицитно написано?
>>1713663 Нет, он не знает такие вещи, если ты сам ему не говоришь прямым текстом как надо. Максимум что он тебе предлагает это дописать портянку текста в AGENTS.md и новый скил создать
>>1713612 > "контекст инжиниринг" говорят говорящие головы Про раг, мертвую хуйню из 2025, неактуальную настолько, насколько можешь представить.
За такие советы в пору ебало бить. Контекст-инженер лол.
Раг не используется буквально ни одной актуальной системой. К агентному кодингу не относится
Только параша построенная в 2024\2025 для чатиков её использует по причине "работает - не трожь, за систему 250 млн уплочено".
> Или это курсы для разработчика кастомного харнеса? До мая 2026 года, все что рты говорили - не актуально. Полная хуета, активный вред. Индустрия появилась буквально полгода назад, курсы продают - цыгане, а не эксперты в отрасли
>>1713622 >А хука на уровне "работа выполнена" не существует нигде У меня бтв просто скилл работает "ревью кода. Запускай по завершении задачи для валидации принятых решений" в дескрипшене.
>>1713666 >Где он находится? Где положишь там и находится, это скилл который описывает review.py "input.md" "output.md" Где зовётся субагент с длинным промптом и прописанным тобой стайлгайдом. Если не работает - правь.
> Как тестируется, что верификатор правильно детектит и понимает нарушения стайлгайда, эвалом? Тобой. Ты планируешь стайлгайд зирошотнуть или что? Совсем ебанат?
> понимает нарушения стайлгайда sweet summer child. Тебе еще столько предстоит узнать про точность формулировок))))
> Если да, то с каждой вышедшей моделью заново переписывается стайлгайд? Каждая новая модель будет находить новые дыры в твоём стайлгайде и интрепретировать по разному, от чего ты калибруешь стайлгайд +\- регулярно чтобы закрыть эти дыры
> А если не зовёт скил, что дальше? Меняешь формулировку в дескрипшене. Спрашиваешь почему не запустил, просишь поправить формулировку так, чтобы запустил.
Ей богу, ты минималсосал из шапки не читал или что? Гайд на архитектуру зачитай, там все пояснено как работает.
> Нет способов заставить вызывать скил, не прописав эксплицитно. extension сделай на pi, чтобы он звал субагента который оценивал бы "задача завершена" с последней точки выполнения через tree который будет верифицировать, что задача все и делать твой хуйк. Я считаю оверинжинирингом того, что можно сделать промптом
Оптимизировать человека из агентов практически нереально т.к. ты формально наладчик конвеера по производству софта. Без тебя - все всегда разъебётся. Магии не произошло.
>>1713691 Причем здесь твоя панель? Речь идет о том что "настрой себя чтобы было заебись" не работает. Нужно конкретно знать что промтить и представлять как это должно выглядеть чтобы верифицировать результат. Если ты сам этого не знаешь, то ты это и не можешь запромтить, проблема курицы и яйца.
>>1713737 У меня почти год тащили и когда закупки дошли поставили RTX6000 больших пачку. Контора большая бтв.
Если у тебя чел хочет локалки из соображений безопасности - ок. У моей конторы такое требование есть. А вот если безопасность похуй и по шапке фсб на аудите не даст, то можно просто подписку взять любую и это целесообразнее. Риг за 5 мультов чтобы крутить аналог дипсик4-про в плане мозга это хуйня затея
>>1713774 Сколько в данных на которых иишка тренировалась данных о том, как эффективно настраивать харнесы? Буквально 0, исчезающе малая величина. Поэтому все что касается рефлексии, нужно максимально конкретно и точно описывать, что ты хочешь, потому что ну не знает агент, что надо настроить такой-то скрипт по такому-то хуку, если ты прямо об этом не скажешь
>>1713546 У тебя достаточно хорошие модели и так. Всякая СОТА нужна либо чистым вайберам что скидывают вообще всё на модель с промптом "сделай заебись", либо всяким топовым ресерчерам. Если ты просто сваливаешь на модель механическую работу по написанию кода то что луна, что дипсик достаточны.
>>1713638 Кастомный харнесс, он запускает агента-реализатора, ждёт завершения, потом запускает ревьюверов, ждёт вывода. Если ревьюверы сказали что говно то запускает реализатора с начальной задачей и описанием косяков. Повторять пока ревьюверы не будут сексуально удолетоворены. Технически можно сделать и промптом, но агент может обмануть.
>>1713874 Что ты понимаешь под кастомным харнесом? 1) Полностью свое решение со своим тулами, своим жизненным циклом, своей памятью, своим TUI, и т.д. 2) Решение на основе pi 3) Некий мета-харнесс поверх имеющегося харнесса типа клода 4) Встраивание скриптов в хуки существующего харнеса
Если про агентов заговорили, кто с мультиагентами работает? А точнее как? Самостоятельно пишете инструкции, что-то готовое используете? Есть какой-то дефолт? В т.ч. для pi/opencode.
>>1713906 Что угодно способное дёрнуть агента с тулузами и прочитать результат работы. Поверх агента стоит хуйня с плёткой заставляющая агентов работать.
>>1713887 >цикл А кастомный харнесс нахуя для while в питон цикле?
complexity merchant эз из.
Ты просто говоришь с чуваком который буквально такой цикл построил (но немного для другой задачи), чтобы лоботомитами фиксить по 1-3 ошибок компиляции из имеющихся 2к+ после прохода деобфускатора.
Мне кастомный харнесс не понадобился. Даже extension не понадобился. Просто скрипт который зовёт агента с промптом
Поэтому я не выкупаю, нахуя впринципе даже нюхать идею кастомного харнесс, чтобы он что? Заменил скрипт написанный агентом для агента же на 200 строк? Может виндовс каждый раз с 0 будем переписывать когда нужно обои поменять или что?
>>1713912 >мультиагентами работает Ты имеешь ввиду субагентов или работу в N сессий?
Если работу в N сессий - просто ебашу на плюсик в вскодном терминале
Если субагентов - в зависимости от конструкции от норм идеи, до просто скама на токены. Паттерн оркестрации как сделать так, чтобы оркестратор не собирал 200к контекста инфы как таску сделать вместо того, чтобы просто дать задачу суббику - не придумал.
Функционально единственный адекватный прям щас гарантированно рабочий 10\10 юзкейс без вопросов это... субагент внутри скрипта.
Т.е. твой агент имеет скилл типа deep-analyze path/to/query.md path/to/output.md где у тебя изначально прописана вся логика для субагентов (тут вообще 4 субагента с разными задачами, разными промптами и у коллекторов вообще есть туллколлы), мега промптами и прочее которое собирает всю инфу, прогоняет калибрует отдаёт отчет в нужном виде.
т.е. субагенты в скриптах - работают. Субагенты которых спамит оркестратор... ну скорее нет. Токенов жрёт дохуя, результат средненький, местами хуже чем делать без субагентов.
Этот подход работает. Т.к. твой говнооркестратор, будь он хоть мега впопусом, не сможет в процессе придумать достойный пайплайн или промпт для субагента. Отточенный проверенный отработанный промпт живущий внутри скрипта в любом случае будет лучше.
>>1713923 В данном сценарии программа дёргает агента 1, чтобы реализовал, когда тот заканчивает, дёргается агента 2 чтобы тот отревьюил, с командой отдать вывод в определённом формате. Потом программа смотри на результат аегнта 2, если агент ответил что результат не ок - то идёт на начало цикла, но в промпт агента 1 добавляет результат ревью. Примерно так.
Субагенты внутри скриптов - работают. Там отлаженный, подготовленный пайплайн, уже учтено как субагент будет насирать, он уже доработанный и тонкости поправлены. Ревью какой, веб поиск, аналитика по туалетной бумаге как скрипт который зовёт харнесс в хедлессе - круто.
Субагенты как штука которую спамит твой агент делать подзадачу - с большего, не лучше чем посадить агента ебстись с задачей в лоб. По токенам даже дороже. Результаты крайне рандомные. У меня не получилось сделать нормальный оркестратор. Мой либо маялся сбором 100% инфы по задаче, либо субагент понимал его вообще не так и делал не то. В итоге мастер агент тратил больше времени на правки и изучение что там субагенты сделали верификации и сбор пред и постусловий.
>>1713940 А, и у меня никогда не было нормально параллелящихся задач.
Я как эти куллстори про ДЕС ТЫЩ субагентов слушаю, я вообще не выкупаю, о чем говорят. Типа из-за фейлур рейта в 47% у субагентов они пиздошат сразу 100, чтобы оркестратору было увлекательно или что?
Кароч хз воины, носите свои куллстори как запустили задачу на 30 субагентов и получили лучший результат чем въебать /new и нормально сформулировать че хотел
>>1713942 Хз, я прямо здесь и сейчас не очень глубоко погружен в разработку через агентов, но запилил пару проектов, хуяча левой пяткой по клавиатуре. Код не правил и даже практически не читал. И задачи периодически сами параллелились. Например, после создания спеки в superpowers при реализации он сам предлагает запустить работу в параллель 2-3 агента. Works like a charm.
Но да, за потреблением токенов я пока что не то чтобы сильно слежу.
А так, база, сабагенты -- ревью, поиск инфы, написание тестов. Да всё можно делегировать. По ощущениям нужно найти точку корректной конфигурации.
Какие методы посоветуете от забывчивости агента на локальной llm под pi-cli?
Накатил себе qwen3.8-27b-gsq-rco IQ3_XXS с 65536 контекста, medium thinking, K и V кеш с Q8 сжатия, чтобы работал на 16 Гб VRAM на скорости 50 t/s + заставил агента допилить харнесс чтобы он организовал автосжатие так, чтобы часть инфы контекста сливалась в файл и ещё каких-то нововведений, типа слива обобщённой инфы из файла прямо в контекст, которые он понаходил поиском методов от забывчивости в интернете и набыдлокодил себе. Автосжатие начинается при достижении половины контекста при условии, что агент закончил думать.
И это всё нихуя не помогает. При более-менее сложной задаче, требующей более 20 ходов и размышлениями в одном блоке более 20k токенов, модель начинает забывать, что уже делала. В итоге я миллион раз прошу этого скибидитойлета записывать всё, что он там разузнал, при каждом всплеске его размышлений, чтобы эта скотина не создавала одни и те же инструменты заново и не перепроверяла а что ета тут за артефакты какие-то оставлены, выглядит так, что всё уже сделано, тут же такие классные названия файлов final_full_completed_zalupa фича лежит, хотя по факту там какой-то выкидыш или сырое говно от очередной попытки реализации, про которую уже никто ничего не знает.
>>1713946 >Код не правил и даже практически не читал. И задачи периодически сами параллелились. Например, после создания спеки в superpowers при реализации он сам предлагает запустить работу в параллель 2-3 агента. Works like a charm. bruh... вроде серьезные темы обсуждали...
cline даёт бесплатно в сутки лям токенов, можешь с дипсик4-флеш побеседовать. Мета - взять подписку. Я продаю идею брать опенкод за 10$ и гонять глм-5.3-флеш. Кто-то продаёт идею брать фронтиры.
> qwen3.8-27b > 3 bit
Граница неюзабельности. Ближе к неюзабельно. Слишкой лоботомизировал его 3ий квант. В 8ом он реально неплох и может пободаться с 4-флеш и приближается к 4-про, но 3ий... пумпурум.э 4ый еще ниче такой https://www.youtube.com/watch?v=WNMnbba35VI, но глобально, все что ниже 6ти кал.
> модель начинает забывать, что уже делала >, K и V кеш с Q8 сжатия
>>1713988 > При более-менее сложной задаче Декомпозицией. Оркестратор запускает агентов для исследования, если необходимо, разбивает план на несколько шагов, записывает в файл и для каждого шага запускает отдельного агента. >>1713997 дебила не слушай, подними контекст до 128к, можешь в к4 квантовать - ничего страшного не случится. Автосжатие, по-хорошему, не нужно.
>>1713995 Писал через openspec. Сейчас цель -- настроить harness, сабагенты так, чтобы агент с минимальным вмешательством переписал приложение полностью на другой стек. Все в качестве эксперимента и получения опыта на своей шкуре.
Чел приумал 7 сортов субагентов, задачи под них не описал. Чистый ролеплей, 0 смысла. Хочется ролеплея - делай сам, пусть это будет хацкерка из харуки сузумии, а не какой-то дроч на БИБЛИОТЕКАРЯ нахуй)))) семь божественных существ, Pantheon нахуй))
https://github.com/code-yeongyu/oh-my-openagent Правило интернетов такое, видишь приставку oh-my => закрываешь вкладку. В 100% случаев насрали. Все что там могло быть хорошего, было спизжено и вставлено. Как сборка скайрима на 10500 модов которые все друг с другом конфликтят и теперь этим говнищем пользуешься ты.
>>1714019 > и размышлениями в одном блоке более 20k токенов, модель начинает забывать, что уже делала. Тебя не смутило, что у чела уже сейчас хуёво > можешь в к4 квантовать У него в к8 проёб что делала, а ты предлагаешь до 4ех жать)
Как это в теории должно работать? Пиздец, и этот еще дебилами раскидывается
Скачал cline затестить НОВУЮ КРУТУЮ АНАНИМНАЮ МАДЕЛЬ!!! Вырубается каждые 10 минут и приходится писать continue, работает со скоростю 4 токена в секунду, при этом зачем-то при запуске модели в cline само по себе включается antigravity(!) и эта хуйня туда мой реальный айпишник спалила, молюсь чтоб айпишник опять не отъебнули, как в прошлый раз. Конченый, сука, мусор
>>1714057 > Автосжатие начинается при достижении половины контекста при условии, что агент закончил думать. > 30k > типа слива обобщённой инфы из файла прямо в контекст, которые он понаходил поиском методов от забывчивости в интернете и набыдлокодил себе
Бляха, а ты прав. Чел там плотно пересосал так то.
Пользуйся он просто pi минимальным без его введений, было бы получше. Но 65к контекста это рофл конечно. Но я так кодюкал локалкой (квен 3.5 А3б 35б) в мае - вообще работает, даже чет справляется.
Тут он сам себе насрал своими ручками. Подъём до 256к не поможет, пока он не выкинет весь свой мусор нахуй
>>1714063 Я бы даже сказал, подключи он щас фронтир в свою мега систему, рискует начать забывать че делал и лажать туллколлы. Такая машина лоботомизации явахуе
Чел, а можешь ляпнуть "Сделай summary.md с кратким (до 2ух абзацев каждый, лучше - меньше) описанием расширений и скиллов что у меня добавлены в pi" Было бы занятно почитать, что ты там такого пересосал. Твои идеи ахуеть
Попробовал выполнить запрос из Python. под VPN. Возвращается ошибка:
The run fails with HTTP 401: "Unauthorized: Please make sure you're using the latest version of Cline and re-authenticate your Cline account." The apiKey field in your connection JSON is empty (""), so no auth header is sent. The Cline gateway appears to require a live account token rather than an anonymous public key like Zen's Bearer public. If you paste in a real apiKey, add this line before the User-Agent header: REQ.add_header("Authorization", "Bearer YOUR_CLINE_API_KEY")
Выполнение завершается ошибкой HTTP 401: "Unauthorized: Please make sure you're using the latest version of Cline and re-authentication your Cline account." Поле apiKey в вашем JSON-файле подключения пустое (""), поэтому заголовок аутентификации не отправляется. Шлюз Cline, по-видимому, требует токен действующего аккаунта, а не анонимный открытый ключ, как, например, открытый ключ Bearer в Zen. Если вы вставляете настоящий apiKey, добавьте эту строку перед заголовком User-Agent: REQ.add_header("Authorization", "Bearer YOUR_CLINE_API_KEY")
>>1713997 Этого челика давно смотрел, да. Qwen 3.8 27b по факту хорошо сжимается, c IQ3_XSS что-то делает и даже лучше, последовательнее и чище, чем 3.6 35b. Я понимаю, что наиболее адекватный результат будет на облачных нейронках, но меня интересует задрочиться что-то запилить локально и чтобы оно даже юзабельным оказалось. >>1714019 >Декомпозицией. Оркестратор запускает агентов для исследования, если необходимо, разбивает план на несколько шагов, записывает в файл и для каждого шага запускает отдельного агента. Попробую сюда копать, спасибо. Сейчас погонял K V кеш на Q4 со 128k контекста и агент сразу в луп ушёл с одной и той же мыслью и командой на пробной задаче с долгой историей. Даже промпты типа "stop looping" не помогают. Однако, если K кеш выставить на дефолтный F16, при этом V понизить до 4, то таки 80k контекста c 48 t/s уже вытягивает. Где-то читал, что K кеш лучше вообще не сжимать, а V уже можно до 4 понизить. Это с учётом того, что я сижу с агентом за одной машиной в браузере, и нейронке не всегда хватает видевопамяти, чтобы отрисовать бровзер и не начать тормозить. >>1714031 Там хуёво, в основном, от того, что агент пытается расшифровать Kinescope DRM видево своей думкалкой, но ему 33k контекста на постоянке уже не хватает. Он как уйдёт в свой аутизм с размышлениями на 20k, потом такой, бля, а чё я вообще делаю здесь, и начинает всё вспоминать сначала, забывая уже всё, что он там думал. Наверное, автосжатие с упреждением полезно только если у тебя и так контекста от 128k. Когда его 65 и стоит автосжатие последнего и лишнего от 30k он начинает реально забывать всё быстро на сложных задачах. Если отключить эту киллер-фичу с заблаговременным автосжатием, то он последовательно думает до 65k, а потом сжатием нехило так разом обнуляется до необходимости всё повторять. >>1714069 Чел, там такое икеа сосал, что ты ахуеешь ещё больше. Оно костыльное, сырое, написано с учётом забывчивости агента и поэтому лезут какие-то баги. И я, ессесно, временами не понимаю, что происходит вообще. Поэтому периодически вырубаю расширения ts переименовыванием в .bak и еду дальше.
Содержимое summary.md по твоему запросу: # Summary: расширения и скиллы в pi
## Расширения (custom, `~/.pi/agent/extensions/`)
### guardrails-unified.ts (+ guardrails.json) Единый диалог-гейт для всех трёх фич @aliou/pi-guardrails (policies / permissionGate / pathAccess): перед рискованным действием поднимает субагента на риск-анализ, затем показывает Allow once / Allow for session / Deny. NO-RISK действия пропускаются без диалога с автоподтверждением (TUI-карточка + событие в Dashboard). Все вердикты пишутся в `guardrails-risk-log.md`.
### compaction-checkpoint.ts Структурированная компакция: перед сжатием контекста генерирует summary по жёсткому шаблону (Goal / User Constraints / Done / In Progress / Tried & Failed), а после — детерминированно реинжектирует ключевые секции в LLM-контекст. Ведёт `TASK_STATE.md` (Auto Ledger, tried-and-failed, user constraints) и budget ~1500 токенов на summary; при ошибке — fallback на стандартную компакцию pi.
### session-search/index.ts FTS5 полнотекстовый поиск по всем прошлым сессиям (`~/.pi/agent/sessions//.jsonl`): user-сообщения, ответы ассистента с командами и compaction summaries. Инструмент `session_search`, инкрементальная индексация по mtime+size, база `sessions.db`.
### session-memory.ts Семантический (векторный) recall по тем же прошлым сессиям + daily-логам + MEMORY.md: эмбеддинги all-MiniLM-L6-v2 на CPU, sqlite-vec KNN. Инструмент `memory_recall`; при компакции автоматически подтягивает релевантный контекст из других сессий по TASK_STATE.md и inject'ит его в LLM-контекст.
### research-assistant.ts Изолированный web-ресёрч субагент: инструмент `task_research` и команда `/research <topic>`. Субсессия на той же локальной модели, только web_search/fetch_content, без RAG/guardrails/скиллов — контекст основной сессии не загрязняется; отчёты сохраняются в `research-assistant/reports/`.
### lmstudio-sync.ts Синхронизация реестра моделей LM Studio: при старте, обновлении процента заполнения контекста и смене модели на lm-studio делает refresh реестра — дашборд всегда видит актуальные модели.
## Пакетные расширения (settings.json → packages)
- pi-web-access — инструменты `web_search` / `fetch_content` (поиск по вебу, fetch страниц/PDF/видео). - @aliou/pi-guardrails — пакет правил безопасности; его встроенные хуки выключены в конфиге, фактическое enforcement делает companion-расширение guardrails-unified.ts. - pi-local-rag — локальный RAG по файлам проекта: `rag_index` / `rag_query` (BM25+вектор), store `~/.pi/rag`, авто-refresh. - pi-memory — инструменты памяти: `memory_write` / `memory_search` / `memory_forget` / `memory_restore` для MEMORY.md и daily-логов. - pi-agent-dashboard extension* — интеграция с Dashboard (canvas, карточки событий).
## Скиллы (`~/.pi/agent/skills/`)
### current-info-search Дата-осознанный веб-поиск: сам определяет сегодняшнюю дату и применяет recency-фильтры. Для актуальных тем — свежие модели, новости, версии ПО.
### task-decomposition Структурированный разбор задач: выбор паттерна исполнения (chaining, routing, parallelization, orchestrator-workers, evaluator-optimizer), эффективное использование инструментов, защита от устаревших данных.
### youtube-extraction Извлечение информации из YouTube-видео: кадры (диаграммы/код на экране) + транскрипт речи, точечные запросы по таймстампам.
>>1714112 >65 и стоит автосжатие последнего Хз зачем ты ебёшься с автосжатием руками при 50% контекста, когда в пи есть родное рабочее до 4ех компакций норм - автосжатие. Работает - нормально из коробки. Реально бы выбросил свою глупость и получил бы эффективных +50% контекста.
> то он последовательно думает до 65k, а потом сжатием нехило так разом обнуляется до необходимости всё повторять. Попробуй по минимал сосал делать все ультра мелкими шагами тут только так. Ну либо бахнуть 128к контекста и стараться. Я понимаю, что тебе путь интересней цели, но фришками будет побсыстрей)
> guardrails.json ) Чел) Не работает). git-bash -c "rm rf /" пробьёт твой гардрейлс, а ты на него тратишь и своё время и время и мозги агента. Убирай.
Рабочие методики защиты - завести отдельного юзера, из под этого юзера с лимитированными правами на удаление вне рабочей папки - поднять консоль - пользоваться так.
Решать проблему разграничения прав на уровне харнесс глупая затея. У нас даже в треде есть какой-то пост про чувака из твиттора который 200гб юзер папки клодом фронтирным снёс. Пилил свой гардрейлс)))
> compaction-checkpoint.ts Чем родная то не устроила? Я бы сосальщиков, уж тем более когда у тебя крайне лимитированные ресурсы на расстояние вытянутой палки не пускал. Хз че делает, а замеров очевидно ты не делал.
> budget ~1500 токенов на summary ))) А вот и причина потери внимания твоим челипиздриком) У тебя лимит в 1.5к токенов на суммари. Ясен хуй, что будет все проёбано. Сноси, ахуевай, и больше сосалы в экстеншены не ставь.
> session-search/index.ts Если агент это не видит - проблемы не вижу. Лично я планирую как нибудь прикинуть дизайн поиска по сессиям, но мне откровенно впадлу что-то выдумывать.
> ### session-memory.ts У тебя же прошлый... такой же...
> Инструмент `memory_recall`; при компакции автоматически подтягивает релевантный контекст из других сессий по TASK_STATE.md и inject'ит его в LLM-контекст. > inject'ит Ууу) У тебя уже 1500 бюджетный суммари повторяется в контексте, хуя даёшь, уже 2 экстеншена и оба ЕБУТ твой же юзкейс
> ### research-assistant.ts > без RAG )))))))))))))
А нахуя тебе экстеншен, на то, что является скриптом? Пиздец. Я бы снёс, стремно и непонятно. Почему это не питонячий скрипт с промптами для субагентов + SKILL.md с описашкой лол?
> ### lmstudio-sync.ts > lmstudio ССЗБ, в треде локалок - инструктаж на работу с llama.cpp, пользуйся инструментами для взрослых, а не хуйнёй для вкатунов. Выбрасывается, ведь llama.cpp позвляет обозвать модель любым именем, которое ты хардкодишь в кастомного агента и ебли больше нет.
> ## Пакетные расширения (settings.json → packages) Уфф, пожалуйста, молю, нихуя не бери с стора. ВООБЩЕ НИХУЯ.
> pi-web-access Мусор который вяжет тебя к сервисам которые ищут ХУЖЕ чем ddgs либа на питоне. Еще и с лимитами. Еще и за деньги Удали нахуй эту парашу и сделай себе экстеншен что будет искать ЛУЧШЕ чем за деньги:
Создай pi-расширение из двух инструментов: web_search ищет URL в открытом вебе (бесплатный DuckDuckGo, возвращает только ссылки), а extract_page скачивает одну страницу, извлекает текст (trafilatura) и через изолированный model-call возвращает лишь │ дистиллированный ответ.
Если фэнси и не жалко место на диске: Сырой HTML никогда не попадает в главную сессию; при антибот-блокировках (403/Cloudflare) — фолбэк через headless-браузер camoufox.
Поздравляю, ваш вебпоиск обходит решения за деньги.
> @aliou/pi-guardrails Удоляй. Театр безопасности так еще и срёт.
> RAG Ты троллишь сука? Какой нахуй раг? Ты пизданулся? РАГ уступает папке с мд файлами. Я хуй знает, въеби по ебалу тому, кто тебе посоветовал раг. Я вахуе Это не кандидат под снос, это буквально ВРЕД, ёбаный врот. Это вредит еще больше чем 3ий квант.
> pi-memory Это уже 3е расширение для пробега по памяти. У меня 0 расширений для пробега по памяти. Я в деле уже полгода.
Возможно дело в том, что такое расширение просто не нужно.
> pi-agent-dashboard extension Чтобы ты мог заценить как РАГ + пиздец с токенами не работает еще и на графиках))))))
> ### current-info-search Выброси нахуй каку.
Решение: Создай pi-расширение, которое на старте сессии один раз фиксирует дату/время, день недели и таймзону, и через before_agent_start дописывает их в системный промпт. Добавь также блоки про Git Bash на Windows (без cmd /c) и неперсистентный cd между │ вызовами bash.
> ### youtube-extraction Это может быть просто в Agents.md "у меня установлены: ddgs, yt-dlp". Видишь как кратко? А у тебя 32к контекст
КАРОЧ ТЫЛДЫР: Удаляй все. Вообще все. Можешь папку ~/.pi снести и начать заново
Дальше - запусти предложенные мной промпты, получи 2 расширения и работу работай. Проект свой пинай по минимал сосалу. Так доберешься до успеха
>>1714121 Чуть проебался с веб поиском когда делил на спойлеры
Создай pi-расширение web-search из двух инструментов. web_search (query) ищет через бесплатный DuckDuckGo без ключей и возвращает только компактный список кандидатов: номер, title, URL, snippet. extract_page (url + task) детерминированно скачивает страницу, выжимает читаемый текст через trafilatura, затем передаёт его одному изолированному model-call, который возвращает лишь дистиллированный ответ на задачу. Сырой HTML и рассуждения никогда не попадают в главную сессию.
>>1714125 Курсор про, моделька Грок 4.7 >>1714120 Да, доступа, код денежный, логины пароли, фото жопы. >>1714129 Он из контейнера в докере наружу вылез и начал ковыряться
>>1714121 >>1714128 Челик, благодарочка, что кинул гайд для агентов, да ещё и по конкретно моему юзкейсу. Единственное что, у меня web_search полностью бешплатый и даже что-то ищет так неплохо. Остальное СОСАЛ от агента я немного вообще не понимаю, как работает. Там, на самом деле, даже то, что скачано, основательно переписано самим агентом. Про llama.cpp давно задумывался перейти, но чё-то как-то похуй было. В принципе, можно, конечно.
>budget ~1500 токенов на summary Этот СОСАЛ от агента сжимает не весь контекст по такому бюджету, а только ту самую старую часть, что вылезает за лимиты. Там два типа компакции - при достижении лимита в 30k и при достижении 65k, когда уже срать некуда. Но попробую сыграть без сосалов заново, ладно.
>>1714143 >web_search полностью бешплатый и даже что-то ищет так неплохо
1000 запросов в месяц, не облизывайся). Лучший Firecrawl, но экстакция содержмого страниц у него за деньги, а без экстракции веб поиск буквально мусор который тебе подпихивает на 90% пиздёж из суммари суммари и протухшей инфы.
Но результаты прям измеримо хуже вброшенного варика. Я хз. Посади агента, рассудить твой "бешплатный" поиск через сервис и бесплатный поиск через скрипты в эктсеншене. Пусть он определится что лучше. Мой определился, что лучше вместо инжиниринга скрипта с ротацией 150 ключей и 3ех сервисов чтобы искать в инетрнете, просто запускать рабочий скрипт из 2ух тулов со стабильным качеством ответов
> ищет так неплохо Плохо. Потому-что не смотрит содержимое страниц.
> Остальное СОСАЛ от агента я немного вообще не понимаю, как работает Выбрасывай что угодно что не понимаешь. А вообще иди от 0. Это работает лучше.
> Про llama.cpp давно задумывался перейти Там +\- тривиально, ну и у тебя же АГЕНТ. Посади его дрочить цифры в конфиге лол) Можешь залогинится в cline по моделс который я кинул и посадить 4-флеш подбирать тебе циферки и подкачивать и траить другие кванты.
Единственное - сначала поиск ему почини блядь, а то твой "неплохо" не позволит ему почитать содержмое хаггингфейса.
> Но попробую сыграть без сосалов заново Если ты глубоко не понимаешь че происходит - в контекстные игрища не лезь. Родной компактер написан достаточно хорошо и НЕ лажает. У тебя тупая модель + мало контекста. Тебе мусорные 20 экстеншенов объявляющие каждый по 2к токенов в систем не нужны. Поэтому буквально все выбрасывай. И ресерч за 1к токенов который может быть скиллом и память, которая заменяется на "ты можешь грепнуть историю сессий кстати"
Блять, клодище. PowerShell использовать не умеет, чтоб код в файл написать пишет скрипт на питоне, постоянно пишет в чат что heredoc не принял что-то... Какой же ублюдочный харнесс у клода, пиздец просто.
>>1714166 У меня и у коллег все прекрасно работало и работает в Claude Code. И Windows PowerShell, и Python и Bash, что угодно. Разумеется, все с Claude Code в порядке, столько-то версий и столько-то людей его в мире используют. Проблема явно у тебя, либо с твоей ОС, либо с железом компьютера.
>>1714199 Я тоже еврей, но линия роста моих золотых кудрей была стабилизирована еще 15 лет назад на приемлемых для меня условиях.
Не ну рил, имагинируйте, этот чел продает разработку лекарства от странеия СКОРО С ПОМОЩЬЮ ЭЙАЙ, когда надо было все мощности пустить на спасение волос.
Я хз в курсах ли тут кто был про бесконечный агентский режим на арена ыы, но лафа закончилась сегодня. Ебал я их род. Месяц занимался какой-то хуйнёй вместо того чтобы наделать себе инструментов или ещё чего полезного. Теперь всё...
>>1714211 >Я хз в курсах ли тут кто был про бесконечный агентский режим на арена ыы, но лафа закончилась сегодня в смысле? что за режим и как он закончился? арена аи закрылась?
>>1714211 Арена за этот год совсем скурвилась. Даже сильных старичков не дают в директ чате потрогать. Только говно. В баттл режиме тоже преференция на какие-то говны. По итогу пользуюсь ей только из-за того, что 5.2 гопота слишком хороша в стилизации текстов, и мне нужна редактура текста, и генерить много филлерного контента для моей рыпыгэ.
>>1714211 А смысл, если там одни огрызки в директ чате. Я иногда гэмблю и кидаю промпт в сравнение моделей, в надежде что выпадет какая-то годная, иногда выпадает фронтир модель, недавно гоночку опусом 5.5 создал
>>1714214 Да пипец. Я в основном сидел на банане 2k делая ассеты для своей дрочильни про бимб. И в чатек с клодом. Потом вспомнил что мне движок чинить надо, попробовал агента, втянулся. Потом решил реверсить игры с PC98, правда через жопу всё вышло. Хорошо хоть успел накидать основу для другого проекта, попутно надроачивая кучу кадров анимации через пока ещё доступный wan2.7-image-pro, впрочем он прям говно и тупо влез только в одну конкретную задачу.
>>1714147 Пасеба. Снёс всё к дефолту. Оказывается, агент поигрался с настройками самого кода компактера Pi агента, а не только с расширениями *.ts. Так что у меня сосальный даже сам харнесс. А ещё я сейчас выяснил – qwen3.8-27b-gsq-rco IQ3_XXS это совсем лоботомит. Братовский Qwen3.8 27B IQ3_XXS хоть и медленней раза в полтора, но тащит даже на Q4 K и V кеше рассуждения по сложным темам. После сброса всех расширений агент начал создавать субагентов для обхода максимальной длины контекста. С поиском там агент в своё время тоже нахимичил, он в DuckDuckGo тоже ищет нормально. Если есть проблемы с открытием ссылок, сам курлит, но можно сделать, как ты сказал, ок.
ЕБАТЬ гойский жид альтман, у меня сука два аккаунта, свапнулся между ними, когда на первом 5% лимита осталось. Так на втором сука аккаунте он дожрал лимит первого и только потом приступил ко второму аккаунту, когда уже был залогинен на второй акк. Это что за жидовская поебень?
>>1714222 > начал создавать субагентов для обхода максимальной длины контекста Моё мнение, что расходы на формулировку задачи субагенту сравнимы или хуже чем просто пофармить в лицо компакцию
Хз, продолжаешь ли ты нюхать 65к контекста, но подъём до 128 позволил бы тебе закрывать задачку в 1 компакт, что не сильно вредит памяти агента. С правками впишется до 3ех компакций и норм.
Компакции делать до упора в лимит смысла нет очевидно)
Не успел пропердеться уже +160 постов, вы ебанулись, что вы тут обсуждаете так активно уже полгода. Потом спрашивают почему юзеры антигравити не постят - они вайбкодят, а не серут в тред кругосуточно. >>1713370 О, я из-за твоего сообщения решил релог сделать, случайно запустил верификацию в другом браузере и тоже запросило верифицировать сам аккаунт гугла. Уже видел такую хуйню, когда пытался войти на другой сайт через гуглоакк. Это у них в целом новая тема - вставить всем анальные зонды, верифицировать аккаунты по телефону. Бтв, сама верификация такая удобная, просто уведомление принять, без всех этих кодов. Удобно зонд вошёл. Даже не стал менять адрес, если забанят, то сообщу, похуй. Никогда ещё не банили за полгода гуглпро или 2 года юзания гуглонейронок. Возможно это они так заранее готовятся к более массивному апдейту, новый сайт гемини, новый про с ребрендингом, под конец финансового года гляди выдадут.
Повзрослел профессионально, решил как Легенда тредов Икея собрать свой скилл плагин для Cursor . 2сh Skill manager v7.0 Отдельно наверное еще соберу плагин для работы в среде 1С, там пиздец сколько скиллов нужно.
>>1714337 По факту, если у тебя есть профессиональный бэкграунд или с аналитикой лады, то можно выезжать на одном GRILL-ME скилле. Но 95% обывателей это не дано, поэтому скилл менеджер и обертка за 5 баксов с прошлого треда
Давно не заходил, какой положняк сейчас по агентам? Клод с подписочкой за 100 долларов всё ещё топ? А то мне стало токенов не хватать, был план капкан делигировать выполнение рутинных задач себе квену на моей 5080, но не знаю, как это реализовать.
>>1714200 А ты ашкеназ? Я ведь написал еврей-ашкенази, а не просто "еврей". Просто еврей это то же самое что иудей, всего лишь последователь религии и вытекающего отсюда образа жизни. Таким образом, евреи на самом-то деле определяются религиозно, информационным образом. Хотя при другом подходе евреев можно выделить и этнически (ашкеназим, сефардим). Так вот я это всё к тому, что если ты еврей чисто религиозно а сейчас просто "унаследованно" (мама-папа-бабушка так сказали) то нет ничего удивительного в том что ты генетически отличаешься от акеназов и рост волос у тебя иной.
Что касается слов потом, про рил и имаджинируйте, то я тебе скажу так. Ты таки зумер, вырос в атмосфере тотального рекламного наёба, и похоже что не различаешь громкие рекламные заявления чтобы и миллиарды и инвесторы текли еще больше. Большинство генерируемого словесного слопа вокруг AI есть ложь неотличимая от правды и наоборот, смотря с какой стороны посмотреть кому выгодно. Такое бывает и в реальной жизни в еврейских анекдотах, тебе бы стоило их получше знать.
>>1714215 Я там уже конечно что-то проебал, но в чем была вкусность? Ибо я просто не знаю. Агентный режим это было что-то нужное, пиздатое? Как с его помощью можно было сделать что-то хорошее, полезное, годное (чтобы оно было у меня, а не на вебе).
>>1714374 В смысле нахуй гемини 4. Не глядя на названия (заметив только первое) я скрипя душой признал, что мой геминька не ебёт, вторая конина лучше. А оказалось, что это тоже гемини. Остальные две просто шлак. Окажется, что демонстрация из кими
>>1714217 Что есть лучшего на Arena на сентябрь 2026? Предположительно: Opus 5 HIGH Grok 4.6 High GPT 5.2 HIgh Gemini 3.1 Pro Mimo 2.5 Pro GLM 5.2 Max DeepSeek v4.1 Flash Max
>>1714364 > 16 гнилобайт Ну вообще можно, в треде недавно заселился локальщик с 16 врама, можешь посмотреть на его тяготы и лишения и передумать)
Могу посоветовать только не придумывать сосалы и держать +/- отдельный пустой pi для покрута локалки чтобы систем не отъедал под 50% от твоего капаситета токенов
Из практичного могу предложить тебе взять подписочную модель и пусть она дрочит сама llama.cpp конфиги подбирая лучшие t/s в фоне следующие 20 часов
Но это в любом случае на поиграться. 10$ на опенкод го дадут больше и более качественной модели, чем любые потуги с локалками
>>1714398 >опенкод го Впервые слышу, цены уж больно вкусные, в чем подвох? Алсо, опенроутер скурвился? Давно не заходил (как подписку на клод оформил), а сейчас смотрю, не пускают на сайт, ip не нравится. При чем у меня два разных есть, и оба не по нраву. Пидарасы.
>>1714415 >Впервые слышу, цены уж больно вкусные, в чем подвох? 60$ эквивалента в токенах дают. Улетает достаточно оперативно если честно если использовать фронтир
Если народные дипсики - подвоха нет. Я оплачиваю Технобанком Беларуси. Если хошь - могу дропнуть рефералку для друга) рефералки отменли :с
У них дизайн в этом месяце поменяли, теперь мой акк типа легаси и я не могу посмотреть нормально лимиты пользования подпиской. Пока у меня лично все прекрасно работает. Юзал glm5.3-flash, но он какой-то странный, пересел обратно на glm5.2
Братва, какой нынче положняк, чтобы баны не ловить, в частности от антропиков? Все работало почти год нормально через их конфиг, там в env прокся прописывалась. Вчера вечером аккаунт забанили, я новый купил, он конечно тоже отъехал - через час, лол. Денег не особо жалко, но хотелось бы верстать все в зад. Планирую на удаленном сервере клод код запускать теперь по ssh, но возникает ПРОБЛЕМА что оно без гуев и никаких блендеров-хуендеров и почей гуи там не будет, только код. Я наверное тут не один с такой проблемой столкнулся, есть мысли?
>>1714422 >я новый купил, он конечно тоже отъехал - через час нельзя сразу после покупки хардокоркод ебашить, там чуть ли н сразу на это автобан. надо минимум неделю там с ним "поговорить" чтобы снизить риски
>>1714333 Хз, когда экспортирую контекст как хтмл, в системном промпте есть время. Плюс сам, когда изучал АнАтОмИю систем-промпта, видел, что вроде как добавляется. В общем хз, надо еще раз посмотреть.
>>1714426 лол, интересно. Не, просто для понимания, старый аккаунт у меня наверное с год работал безо всяких проблем. Я также отдаю себе отчет, что в принципе понять, что новый аккаунт используется на том же ПК для обхода бана может даже убогая локальная нейронка, не то что антропики.
Вот думаю как не просесть теперь в качестве самого сервиса так сказать, потому что кодить это одно - там push/pull и много ума не надо, а вот самые новые блага типа блиндера и графона жаль, конечно. Сиська грустит.
>>1714428 они первые дни под микроскопом новые аки рассматривают. Первые неделю-полторы нужно его на всякой херне гонять, желательно на языке откуда и ты создал акк и не закидывать сразу 100$, а сначала неделю месяц-посидеть на 20$
>>1714350 >400 хуйня какая-то, у меня за пару месяцев несколько тысяч накопилось
причем чуть более чем 95% из них sol сформулировал сам, я только кнутом его ебашил и пряниками подкармливал
теперь уже привычным стало просто давать ему ссылку на жиру, и раз в 3-4 часа взглянуть, появились ли у негок какие-то вопросы по ходу работы, если да то ответить кратко
в таком режиме он над некоторыми тикетами по 2-3 суток ебашит, потом я делаю pr - и подозреваю что код-ревью каким-то похожим образом протекает, лол
ентерпрайз, удаленка, буквально даже начинаю иногда думать что жизнь таки удалась
>>1714422 Все это здесь я писал месяц назад, треды еще плавают, а ты ленивая жопа. Все баны связаны только с продавцами. Тот кто тебе пишет что дело в русском языке ввода модели или коде - несет хуйню выдумывая и ничего не зная. Если бы они такое начали делать, это потенциальная само-подстава под огромный скандал (забан пользователей на основании их национальной принадлежности).
У тебя ИИ в поиске гугла есть? Спроси: Какие предосторожности надо соблюдать при покупке аккаунта Anthropic из россии в сентябре 2026 года?
Господа, поясните за положняк. Имею акк на опенроутере заруганный через гитхаб, все работало и работает, но третьего дня решил закинуть $20 и соснул. Проблема в том что эта почта давно мертва. Ок, ладно. Выдоил акк досуха, Решил зарегать новый, где почта есть, но не получается. Что через гитхаб, что через гугл, что просто на почту. Прохожу капчу и... бесконечное ожидание подтверждения. ЧЯДНТ?
>>1714455 Я думаю ты прав, но чуть глубже - я платил раньше всегда через челиков с платисру, и все было ок. В этом месяце я апнул подписку со 100 баксов до 200 виртуальной картой, и через неделю прилетел бан. А второй аккаунт забанили просто потому что с того же компа (я поменял прокси, но это само-собой легко палится). В общем не надо было выебываться с новыми способами оплаты и кормить перекупов дальше. Теперь как отмыть пеку от подозрений - вопрос открытый, еще предстоит подумать. Или просто пересаживаться на впс.
>>1714458 >>1714455 Я вас не понимаю, в чем проблема купить виртуальный номер, оформить карту bybit и оплачивать ей? Элементарные действия. Потом как белые люди пользуетесь и не трясетесь.
>>1714467 Ты этой картой платишь прямо на сайте? Или апл\гугл пей? Я бы предпочел с криптой лишний раз дело не иметь в наше неспокойное время, можно не туда кинуть бабки и отьехать за какое-нибудь финансирование ВСУ.
>>1714471 >Ты этой картой платишь прямо на сайте? Да >Я бы предпочел с криптой лишний раз дело не иметь в наше неспокойное время, можно не туда кинуть бабки и отьехать за какое-нибудь финансирование ВСУ. Есть белые криптобиржи, я покупаю через цифра банк, потом перевожу на bybit. За покупку комса 1.5%, плюс за перевод, она зависит от сети, я плачу 3.5 USDT, если переводить условно 500 USDT, то меньше процента выходит.
>>1714481 Окей. Нет, в принципе, с оплатой у меня вопросов нет. То был эксперимент, и вероятно неудачный. Проблема у меня теперь с тем, как верстать все в зад. Ну посмотрим что коктропики ответят на мою маляву.
Вот для знания и понимания подробнее бы. Откуда и как платил. plati.market? Продавец? Имя? Откуда и как ходил. VPN ? Какая? Что использовал (Claude Code?). Что делал (хакерил?).
Вопросы не праздные, мне бы все же этот ебаный антропик надо, хотя я и давно считаю что просто не надо иметь с ними дело.
P.S. Gemini из гуглопоиска спросил как я тебе советовал?
>>1714508 Без проблем. >Откуда и как платил. plati.market? Продавец? Имя? Платил ProSeller.inc с плати сру, с ними проблем не было. Потом взял виртуальную карту (конкретный сервис называть не буду, но они почти все реселлят одни и те же карты), и вот через неделю бан. >Откуда и как ходил. VPN ? Какая? Резидентский прокси Италии. Настроен был прямо в конфиге клода. >Что использовал (Claude Code?). Что делал (хакерил?). Только claude code и больше ничего. Писал моды на игры и финтех (не спрашивай). >Gemini из гуглопоиска спросил как я тебе советовал? Неа, мне в целом ситуация ясна, если сами антропики не разбанят, то с компа мне клод больше не запустить - буду крутить напрямую на впске в какой-нибудь финляндии.
>>1714512 C СНГшными странами надо осторожней. У меня есть ВПСка в Грузии, в довесок к их местному банку, и не все нейросети считают ее айпишник грузинским. Клод и ГПТ пускают, а Гемини нет, отвечая что страна не поддерживается, хотя по документации Гемини страна поддерживается. С каким-нибудь Нидерландами/Финкой проще, даже если по геобазе айпи приходится на соседнюю Бельгию/Швецию, там уже похуй.
>>1714378 Там у агента своё рабочее пространство, если без гиитхаба, то всего 128 метров файлов можешь навайбкодить и скачать всё что хочешь готовое. Можешь попросить его запустить у себя прогу которую лень ставить на комп. Можешь создать на гитхабе новый пустой проект или к существующему подключаешь, и даёшь ему задание какое хочешь. Он тебе и релизы делает и всё подряд, короче норм интеграция как у взрослых. Ты пошел посрать, вернулся, а на гитхабе уже готовый релиз твоей игры или проги. Это и сейчас работает, просто доить весь день не получится.
>>1714516 Не о бу ча е мы е, когда же вы уже научитесь? Гугл имеет СВОЙ СОБСТВЕННЫЙ ГЕОТЕГГИНГ. Это всемирный сука пылесос который всасывает ЛЮБУЮ доступную ему инфу о сидящих через этот айпишник, коррелирует её между собой, и выводит сколько на нём сидит челиков из какой локи. Если твоя впска на протяжении нескольких дней (а в последнее время часов) шарится с челами и устройствами из одной локи, для него она переезжает в эту локу, аналогично возможен обратный переезд. Всякие геоайпи и прочие ASN это фоллбэк который он использует когда не уверен.
Гмайл, андроид, реклама, фингерпринты браузера, страна реги акка, GPS, видимые БС опсосов, видимые вайфай точки, соседние блютус устройства, MAC адреса в лане, небо, аллах, цвет твоих трусов, всё это собирается и коррелируется. Некоторые сервисы гугла (поиск) юзают меньше инфы для корреляции, некоторые (гемини, реклама) больше. На то что это впн ему похуй, тебе надо выделенный айпи (похуй грузинский или нет) который ни с кем другим не шарится (это можно чекнуть) и используется тобой только для этого, а не смишнявки на ведре через него смотреть.
Некоторым другим типа попенов с куктропиками ещё и на впны не похуй. Но и инфы у них поменьше чем у гугла, точнее у детекторов-подрядчиков, услугами которых они пользуются.
>>1713210 (OP) кто codex юзает он не стал тупее за последние два дня ? после ресета работает х10-20 медленнее. У меня никогда не было задач которые он решает 2 часа, все тоже самое что и раньше, но раньше максимум 20 минут уходило, сейчас 2 часа и очень медленно ест лимиты.
Еще есть такая же тема на офф форуме и там чел скрины приложил и ру интерфейс у него. То есть могут замедлять тупо для РУ пользователей работу. У вас все норм ? Кто еще юзает
>>1714606 У меня друг наоборот радовался, что когда я навайбкодил впн клиент под винду, через него кодекс заработал очень быстро. Тебе это не особо поможет, но это значит, что скорость ответа кодекса напрямую может зависеть от скорости\пинга твоего впн\прокси. Тупо для ру замедлять не могут, потому что ру тупо не пускают.