Веб-версияОткрыть в Telegram

ВеткаПривет всем! Здесь многие выкладывают свои проекты, выложу и я свое поделие. Если кто не знает, то последнии версии прод…

19 сообщений · –
I
Фотография
нажмите — покажем
Привет всем! Здесь многие выкладывают свои проекты, выложу и я свое поделие. Если кто не знает, то последнии версии продвинутых моделей от Antropic и OpenAI вполне так неплохо умеют в hardware. Поэтому некоторое время назад возникла идея - а не написать ли мне собственный NPU (штука, которая умеет работать с нейронками, если кто не знает). Так появился Cormorant. Раньше для подобного требовались годы работы и большая инженерная команда. У меня же на это ушло всего где-то месяца 3 чистого времени. Система работает на FPGA от AMD и позволяет производить инференс для различных моделей. Вместо того, чтобы загрузить одну единственную модель и на это успокоиться я решил сделать расширяемый фреймворк, который бы поддерживал обычные CNN, небольшые LLM, VLM, TTS модели. Все это может быть загружено на плату с энергопотреблением порядка 4-х ватт. Список поддерживаемых моделей, бенчмарки и исходный код проекта тут: https://github.com/phoenix367/cormorant
  1. T
    А какая производительность у разных моделей?
    1. I
      Если говорить про LLM то 4 - 10 токенов/с в зависимости от модели. Можно сделать значительно больше
  2. K
    А что если посадить его на FPGA асик с hmb2? Они по идее сейчас должны быть дешёвые
    1. I
      Интересная идея. Взять бы еще его где.
      1. В
        Собрать робота который будет тестировать и ремонтировать, набрать дохлых доноров из них собрать живые. Еще и денег можно поднять на ремонтах)
          1. В
            Я сейчас на еспшках собираю анализатор батарей для ноутов и электротранспорта) и тестировщика майнов ноутов.
  3. A
    Как щас вивадо? Норм? И как ллм под верилог нынче
    1. I
      Норм, я его не открываю ))))) все фпга похоронили, а сейчас видимо возрождение будет. Из за дороговизны ГПУ и развития ИИ ассистентов. Они иногда такие решения предлагают, до которых просто так не додумаешься
      1. A
        Только сегодня просто утром думал что хотел бы что-то подобное поискать попробовать
    1. I
      Локальный чат запустить? Ну видимо да, можно. Модели которые я тестировал все меньше 1 ГБ памяти потребляют.
      1. Ⲓ
        В целом сейчас можно уже ллмки запускать и так, и через цп и через ГП , но скорость хромает
      2. В
        Прикольно, так можно обойти ф3-151 и нигде не хранить перс данные, они на телефоне у юзера остаются. Кайф🙏🏻
AAgent codingAgent coding@agent_coding · группа · Технологии
1 006участников90пишущих за 30 дней
Лента площадки Открыть в Telegram

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем