Используется ollama o1_t-lite-it-1.0_q8_0.gguf Хотя работать должно с любой моделью Только обязательно надо выставлять OLLAMA_NOHISTORY = 1 в системных переменных
voice4.py - это версия немножко доведенная до ума, к сожалению, без приличной видеокарты будет тормозить безжалостно voice5.py - это версия, которая, ныряет по API за халявным Qwen, llm конечно, подглюкивает, но не больше человека в среднем :)