Фотография
натисніть — покажемо
натисніть — покажемо
Давно шукав адекватну прогу, яка просто показує ліміти AI-інструментів і коли вони скинуться.
І ось нарешті знайшов - Codenotch.
Це open source інструмент із максимально простим інтерфейсом.. і що важливо - можна самому вибрати, де він буде висіти.. зверху, знизу, справа або зліва.
Для кожного AI-інструмента він може показувати:
- скільки ліміту вже використано
- коли буде наступний reset
- які агенти зараз працюють
- статус активних сесій
- кілька акаунтів Claude окремо
Ще кілька прикольних штук:
1/ Нотифікації про ліміти
Може повідомити, коли ти вже добрався до 80% або 100% ліміту. Не треба кожні 20 хвилин заходити і перевіряти..
2/ Моніторинг агентів
Можна бачити, чи агент реально працює, завершив завдання або чекає на твою відповідь..
3/ Кілька акаунтів
Якщо маєш personal + work акаунти, їх можна відстежувати окремо..
4/ Ollama теж підтримується
Якщо ганяєте локальні моделі, Codenotch може показувати RAM/VRAM, context limit, завантажені моделі та навіть швидкість генерації в tok/s..
Підтримує Claude, Codex, Cursor, Antigravity, GLM, Grok, OpenCode та інші AI tools.
Забирайте: https://github.com/vinzdg/codenotch
#tools
Свідки AGI
1.4K · Oleg Makarikhinтекст ще не в індексі
Я взагалі нічого руками не пишу. Написання коміту - це частина автоматизованого флоу, його і не треба писати руками
Гикер †1532500⚰Типу щоб сесійне вікно відкривалось як можна раніше
Ссылка
натисніть — покажемо
натисніть — покажемо
отут шось роблять таке
https://github.com/tappress/claude-code-warmup
Гикер †1532500⚰А хайку дьоргаєш кожні 5 годин?
Все через опус, max тарифа вистачає, щоб не паритись з довжиною сесії. Ні разу не заходила з опусом за ліміти, при тому, що він у мене фулл-тайм працює. Але мій флоу передбачає багато атомарних коротких сесій, щоб контекст не розростався і модель не починала деградувати
JeenВсе через опус, max тарифа вистачає, щоб не паритись з довжиною сесії. Ні разу не заходила з опусом за ліміти, при тому, що він у мене фулл-тайм працює. Але мій флоу передбачає багато атомарних коротких сесій, щоб контекст не розростався і модель не починала деградувати
Там же є компресія, у тому числі примусова....
Vladyslav support.od.uaТам же є компресія, у тому числі примусова....
Модель всеодно втрачає контекст і починає гірше працювати
Гикер †1532500⚰Та будь яка. А компресія насправді прям фігово працює
Краще щоб зробив handoff і очистити контекст
хз, та ніби норм працює... хіба на чомусь архіобємному воно може і дійсно всратись, але я шось таке прям мега потужне не видавав... тому поки навіть з урахуванням що клодкод працює з локальною не сильно розумною моделькою - норм, вистачає
з цікавого, qwen3.8:27b реально умовно розумна, прям аналіз вся фігня, і прям цікаві моменти і нюанси в коді помічає, але через це страждає швидкодія... тому тут якраз класно якщо є можливість кластеризувати, типу основний девайс з нею думає аналізує і роздіє на сусідню машину наприклад з qwen3-coder задачки які воно вже штампує швидко
Гикер †1532500⚰Часом буває що його не туда заносить або щось переплутає і коли ніби все розібрали аж мається контекст і він тіряє ту цепочку розмови і повторює ті з помилки
ну, це і без компресії бувало... тому хз, стверджувати що саме через неї контекст пердолить - так собі
Гикер †1532500⚰без компресії рідше. будь який великий контекст неачинає потрохи підгнивати, і цю гниль тягне за собою. ну чисто моя думка, я обично хендофф роблю очищаю і пускаю заново, особливо якщо сесія невдала.
Фотография
натисніть — покажемо
натисніть — покажемо
в мене без автокомпресії на локалці взагалі тупо вилітало коли починало вилазити за межі) але то було коли через докер модел ранер крутив... на олламі значно краще вертиться, і ресурси прям всі всі вижерає які виділяються і т.д... на скріні це з тим квен3.8... коптило на всі гроші