🤯Локальные LLM-ки на подъеме — некий Кулибин запуcтил
Карпатовскую llama2.c на Galaxy Watch 4!
Моделька не самая жирная, но это пока. Через год-два 1B параметров будет на часах бегать. Персональный ассистент у вас на руке!
Скорость:
Модель с 15M параметров: 22 токенов/сек*
Модель с 43M параметров: 8 токенов/сек
Вот вам еще небольшая подборка моих постов, про локальнные LLM:
- LLaMa с text-retrieval плагином:
тык-1,
тык-2
- LLama-7B на на макбуке:
тык
- LLaMa-30B на макбуке (4-bit + mmap):
тык
- llama2.c или Карпатый запускает LLaMa-2-7B на рисоварке:
тык
- Falcon 180B дома на маке M2 Ultra:
тык
*
один токен - это чуть меньше одного слова.
@ai_newz
Обсуждение 32
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram