Модели для локальной работы — что имеет смысл попробовать
Запускаешь AI у себя на компе и не знаешь, на что вообще смотреть? Тут главное понять пару вещей: хватит ли у тебя железа, нужна ли тебе поддержка русского, насколько важна скорость и качество ответов. Если GPU слабый или его нет, лучше взять что-то лёгкое, вроде GPT4All или Mistral в маленьком размере — с ними проще стартовать без проблем. Если есть мощный видеочип и хочется получше результат, то можно пытаться с Llama 2 или Falcon, но они уже прожорливее.
Проверяй, поддерживается ли формат модели твоим софтом (обычно это GGML для офлайна), и оценивай, нужна ли тебе настройка под свои задачи — это важно, если хочешь получить что-то конкретное, а не просто универсальный чат. Еще стоит подумать, какой API хочется иметь — некоторые модели проще встраивать в свои скрипты, а с другими мороки больше.
В итоге прикинь по весу модели, требованиям к железу, доступности документации и комьюнити. Если просто «пощупать» — лучше брать что-то из свежих портов из репозиториев на гите, там часто уже прописаны оптимальные параметры. А у вас что стоит локально и с чем не надо заморачиваться?
Если железо слабое – лучше сразу на лёгкие модели смотреть, иначе просто будет долго и греется всё. Llama 2 и Falcon крутые, но требуют серьёзных ресурсов, так что не для каждого. GGML-формат в офлайне облегчает работу с моделями, и это реально плюс. Важно понимать, что и зачем нужно, иначе можно заблудиться в куче вариантов и настроек. Просто попробовать что-то из свежих репозиториев — с этим меньше гемора.