Для домашнего запуска LLM реально хватает той же RTX 3060 с 12 ГБ, особенно если взять облегчённые модели типа llama.cpp или GPT4All. Конечно, скорость будет не молниеносная, но для изучения и тестов пойдёт. Главное — не ждать идеального опыта сразу и быть готовым пару раз поковыряться с настройками, чтобы всё заработало. По крайней мере, это гораздо лучше, чем тупить в облаке с задержками.