Атомарная цель. Подключить qwen3-vl:4b через существующий ollama_llm, изменив только локальный conf.yaml.
Что мы делаем и зачем
Этот эксперимент доказывает локальный text/vision путь без cloud key. Ollama уже предоставляет OpenAI-compatible endpoint на 11434/v1, поэтому отдельный gateway пока не нужен. Изменение ограничивается пользовательским conf.yaml.
Что должно быть готово
- ollama list показывает qwen3-vl:4b.
- ollama serve слушает 127.0.0.1:11434.
- Upstream baseline завершён.
Где выполнять
Codex в корне репозитория; Ollama запущена в отдельном обычном PowerShell.
Scope
| Разрешено | Только действия, прямо указанные в prompt и командах этого эксперимента. |
|---|---|
| Запрещено | Секреты, изменение main/upstream, расширение scope и скрытое исправление новых ошибок. |
| Результат | Артефакты и критерии на третьей странице эксперимента. |
Откройте Codex из папки, указанной на предыдущей странице. Для независимого аудита обязательно создайте новую сессию. Скопируйте следующий prompt целиком, не вырезая ограничения.
PROMPT ДЛЯ CODEX - КОПИРОВАТЬ ЦЕЛИКОМ
Работай как инженер в режиме контролируемого агента.
Перед любым изменением покажи карту релевантной части репозитория, одну атомарную цель, файлы чтения и изменения, риски и команды проверки.
Сначала покажи план. Не меняй файлы до моего явного подтверждения.
Не используй sudo, force push, git reset --hard, git clean -fd и опасные команды удаления.
Не переключай и не изменяй main.
Не читай и не печатай .env, токены, SSH-ключи, cookies и keychain.
Не трогай файлы за пределами указанного scope.
Не скрывай ошибки и не подменяй тест словесным утверждением.
После изменения покажи краткий diff, реальный минимальный тест и git status --short.
Если нужен больший scope, остановись и запроси новый атомарный шаг.
Текущая задача: изменить только локальный conf.yaml, который не tracked Git. Не меняй source code, templates и dependencies.
Сначала найди существующие keys character_config.agent_config.agent_settings.basic_memory_agent.llm_provider и character_config.agent_config.llm_configs.ollama_llm. Покажи текущие значения без секретов и точечный YAML plan. После подтверждения установи llm_provider: ollama_llm, base_url: http://127.0.0.1:11434/v1 и model: qwen3-vl:4b. Остальные keys не перестраивай.
После изменения покажи diff только выбранных YAML keys без персонального содержимого, запусти сервер verbose и предложи text-only и screenshot smoke tests. В конце git status --short.Команды PowerShell
Команды ниже нужны либо для ручного выполнения, либо для сверки предложения Codex. Строки после комментария «после подтверждения» не запускаются заранее.
КОМАНДЫ - КОПИРОВАТЬ ПО ПОРЯДКУ
ollama serve
# Во втором окне:
ollama list
Set-Location C:\dev\agent-lab\Open-LLM-VTuber
uv run run_server.py --verboseКак действовать при запросе разрешения
Прочитайте команду и рабочую папку; сразу сверьте их со scope этого эксперимента.
Для одной безопасной команды выберите разовое Yes, proceed.
Если команда читает секреты, пишет за пределами scope или меняет main - нажмите Esc и объясните ограничение.
Что должно получиться
- Лог инициализации указывает ollama_llm и qwen3-vl:4b.
- Text-only запрос получает осмысленный ответ.
- Screenshot без личных данных описан моделью.
- Нет обращения к cloud API.
Типовые ошибки и действия
- Connection refused 11434: запустить ollama serve вне sandbox.
- Model not found: проверить точное имя ollama list.
- Vision ignored: убедиться, что выбран VLM и payload содержит image по фактическому frontend path.
- conf.yaml tracked: остановиться и проверить .gitignore.
Артефакты и доказательства
Критерий завершения
ГОТОВАЯ ЗАПИСЬ В ОТЧЁТ
Эксперимент 7: Локальный Ollama VLM baseline | Статус: PASS / FAIL / NOT PROVEN
Доказательство: <минимальный обезличенный вывод> | Не доказано: <ограничение>
Source tree: unchanged / <известный diff> | Следующий шаг: Настроить локальный русский ASR/TTS baseline.