Captura tu voz, la transcribe con Whisper (100 % local) y te recomienda un prompt optimizado para tu agente de IA (OpenCode, Claude Code, Kiro, Generic). Todo desde una vista lateral en VS Code.
Features
- Captura y transcripción local: pulsa el botón del micrófono, habla y obtén el texto al instante. Whisper corre en tu máquina: nada sale de tu equipo.
- Recomendación automática de prompts: cada transcripción genera una propuesta de prompt para que tu agente entienda tu contexto y cumpla la tarea.
- Motor configurable:
off— heurísticas locales (sin red, instantáneo).ollama— LLM local (p. ej. llama3.2).openai— cualquier API compatible con OpenAI.
- Bootstrap automático: al instalar, la extensión prepara el backend Python (venv + dependencias) usando
uv; no necesitas instalar nada a mano. - Comandos: abrir panel, capturar/detener, reinstalar backend.
Instalación
Desde Open VSX o instalando el .vsix de una release:
code --install-extension listener2prompt-0.1.3.vsix
Al primer uso se descarga el backend y se crea el entorno (una sola vez). Si algo falla, usa el comando Voice: Reinstalar backend.
Uso
- Abre la vista Voz a Prompt (icono en la barra de actividad).
- Configura tu micrófono si se te pregunta (o fija
listener2prompt.device). - Pulsa el micrófono y habla. Al terminar obtendrás la transcripción y el prompt recomendado.
- Copia el prompt a tu agente.
Configuración
| Setting | Descripción |
|---|---|
listener2prompt.device |
Índice del dispositivo de entrada (0 por defecto). |
listener2prompt.duration |
Duración máx. (seg) de la captura puntual. |
listener2prompt.whisperModel |
Modelo Whisper: tiny, base, small, medium, large-v3. |
listener2prompt.engineBackend |
off (heurísticas), ollama o openai. |
listener2prompt.ollamaUrl / ollamaModel |
Endpoint y modelo de Ollama. |
listener2prompt.openaiBaseUrl / openaiModel / openaiApiKey |
API compatible con OpenAI. |
La clave de OpenAI se pasa solo al proceso del servidor local, nunca se guarda ni se envía a terceros.
Privacidad
La transcripción es 100 % local (Whisper). Solo se hace llamada de red si activas ollama o openai, y solo con el texto de tu transcripción.
Licencia
MIT.