Rama JARVIS-GREEN, independiente de master (el nucleo naranja queda intacto). - README propio del carril verde con diagrama de arquitectura y capturas del panel. - verde/: arranque, panel web, puente de voz (escucha local con faster-whisper + habla con la voz del naranja), pruebas (07 voz, 08 escucha), config y notas. - Integracion RAG: nucleo/saber/busca_cli.py + skill buscar-en-apuntes, para que el agente consulte el mismo indice que el nucleo. - Todo local (127.0.0.1); sin datos personales (rutas y modelo de GPU scrubeados).
58 lines
3.3 KiB
Text
58 lines
3.3 KiB
Text
# JARVIS verde — plantilla del ~/.hermes/.env
|
|
#
|
|
# ESTE FICHERO NO TIENE NI UNA CLAVE, y eso es a proposito, no un descuido.
|
|
#
|
|
# El carril verde es 100 % local: el cerebro es Ollama en 127.0.0.1, la voz es
|
|
# Piper, el oido es whisper y la memoria es un SQLite. Ninguna de esas cuatro
|
|
# cosas pide credencial. Lo que hay debajo esta comentado como DOCUMENTACION
|
|
# de que habilitaria cada clave y que se llevaria fuera de la maquina, para
|
|
# que la decision sea explicita el dia que se tome y no un descubrimiento.
|
|
#
|
|
# Ademas hay un motivo mecanico para dejarlo vacio: el instalador llama a
|
|
# maybe_start_gateway(), que arranca un servicio en segundo plano SI encuentra
|
|
# un token de mensajeria aqui. Sin tokens, sale antes de hacer nada. Es lo que
|
|
# garantiza que instalar no levante nada.
|
|
|
|
# ── El cerebro ─────────────────────────────────────────────────────────────
|
|
#
|
|
# Ollama no pide clave. Si Hermes insistiera en una para el proveedor
|
|
# "custom", la guia oficial dice que sirve cualquier cosa:
|
|
# OPENAI_API_KEY=no-key
|
|
|
|
# Modelos locales lentos: el limite por defecto se queda corto en CPU.
|
|
# En esta maquina el 4b va en GPU y no hace falta, pero si algun dia se prueba
|
|
# un modelo grande contra los 62 GB de RAM, esto es lo que evita el corte.
|
|
# HERMES_API_TIMEOUT=1800
|
|
|
|
# ── Voz ────────────────────────────────────────────────────────────────────
|
|
#
|
|
# ELEVENLABS_API_KEY hablar y oir por ElevenLabs.
|
|
# Saca el TEXTO de cada respuesta (TTS) y el AUDIO de tu
|
|
# microfono (STT). Desde 6 $/mes para uso comercial.
|
|
# Descartado: Piper hace lo mismo aqui y es MIT.
|
|
#
|
|
# GROQ_API_KEY oir por Groq. Tier gratuito y mas rapido que local,
|
|
# pero manda el audio crudo de tu microfono fuera.
|
|
|
|
# ── Memoria ────────────────────────────────────────────────────────────────
|
|
#
|
|
# HONCHO_API_KEY el "Hancho AI" del video, que en realidad es Honcho, de
|
|
# Plastic Labs. Perfilado del usuario por pasadas de
|
|
# razonamiento. 2 $/M tokens mas 0,001-0,50 $ por consulta.
|
|
# Es AGPL-3.0 y se puede autoalojar con docker compose y
|
|
# PostgreSQL+pgvector, PERO su razonamiento exige clave de
|
|
# Gemini, Anthropic u OpenAI: autoalojarlo daria el codigo
|
|
# libre y seguiria sacando las conversaciones.
|
|
# Descartado. La memoria es el SQLite de Hermes.
|
|
|
|
# ── Canales ────────────────────────────────────────────────────────────────
|
|
#
|
|
# CUIDADO: poner cualquiera de estos hace que el instalador OFREZCA levantar
|
|
# el gateway como servicio de systemd. Mientras el verde sea un banco de
|
|
# pruebas, se quedan fuera.
|
|
#
|
|
# TELEGRAM_BOT_TOKEN
|
|
# DISCORD_BOT_TOKEN
|
|
# SLACK_BOT_TOKEN
|
|
# SLACK_APP_TOKEN
|
|
# WHATSAPP_ENABLED
|