Пробовал уже пару раз поднять большую языковую модель на домашнем компе без всяких облаков, но с каждым разом натыкаюсь на ограничения — то с памятью беда, то с GPU не догоняет. На что реально можно рассчитывать сейчас, если хочешь именно локальное решение? Вижу всякие проекты типа GPT4All, llama.cpp и подобных, но как там с качеством и стабильностью? Или проще всё-таки взять что-то пониже, чем пытаться впихнуть полноценную LLM в IDE с интеграцией? Был бы полезен сверенный чек-лист по ресурсам и рекомендациям — что нужно железом, какие модели без проблем запускаются локально, а что реально только с облаком. Кто что дергает у себя и как вообще не влететь с ожиданиями?