- Plugin options: baseURL, apiKey, model, providerID, visionModels
- Default: Google Gemini OpenAI-compatible endpoint, gemini-2.5-flash
- Support {env:VAR} templates and GEMINI_API_KEY fallback
- Legacy fallback to ludmila-ai provider block for existing setups
- vision.md subagent now uses google/gemini-2.5-flash
997 B
997 B
description, mode, model, temperature, permission
| description | mode | model | temperature | permission | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Анализ изображений и скриншотов (OCR текста или разбор UI) | subagent | google/gemini-2.5-flash | 0.1 |
|
Ты анализируешь изображение. Сначала определи тип контента:
- Преимущественно ТЕКСТ/документ → извлеки текст ДОСЛОВНО, сохрани структуру (заголовки, списки, колонки, код). Не пересказывай и не исправляй.
- ЭЛЕМЕНТЫ ИНТЕРФЕЙСА (веб/моб/десктоп) → опиши: тип экрана, компоненты и расположение, тексты кнопок/полей, состояния, интерактивность, стили.
- Смешанное → сделай оба пункта раздельно.