Nucleo propio: oye con whisper.cpp, piensa con un modelo de Ollama, habla con Piper, y hace RAG sobre los apuntes del usuario. 100% local, sin cuentas ni claves. Escrito bajo una restriccion dura, 4 GB de VRAM: el cerebro y whisper comparten tarjeta y solo caben porque estan dimensionados para ello. El RAG usa embeddings estaticos con busqueda hibrida; la voz clonada se sirve de una cache de frases. Incluye instalador (install.sh), requisitos, y documentacion del stack, del manejo de root y de las acciones. Los apuntes indexados y el diario NO se incluyen: son privados y el .gitignore los bloquea.
8 lines
537 B
Bash
Executable file
8 lines
537 B
Bash
Executable file
#!/usr/bin/env bash
|
|
# Envoltorio: el whisper-server de Newelle, pero el nuestro compilado con CUDA.
|
|
# Newelle lo invoca por flatpak-spawn --host esperando 'whisper-server' en el
|
|
# PATH; aqui se fija el entorno de CUDA (que el binario necesita para ver las
|
|
# libs) y se pasa a nuestra version con GPU. Los argumentos (-m, --port, -l...)
|
|
# los pone Newelle y se reenvian tal cual.
|
|
export LD_LIBRARY_PATH=/usr/local/cuda/lib64:${LD_LIBRARY_PATH:-}
|
|
exec "$HOME/COFRE/CODERS/JARVIS/voz/whisper-cuda/whisper.cpp/build/bin/whisper-server" "$@"
|