JARVIS/config/qwen3.5-4b-jarvis.Modelfile
sito 55e967b940 Portabilidad, licencia GPL-3.0 y diagrama del stack
Portabilidad (el repo estaba escrito como si solo sirviera para el portatil
del autor):
- num_gpu ya NO se fija en los Modelfile: Ollama reparte las capas segun la
  VRAM, asi el modelo va igual en GPU pequeña, grande o CPU. Se documenta
  cuando conviene fijarlo (solo tarjetas de 4 GB muy justas).
- install.sh detecta el gestor de paquetes (apt/dnf/pacman/zypper) y la GPU
  (NVIDIA/AMD/ninguna), sin asumir Debian ni CUDA.
- README reescrito: el hardware es una REFERENCIA (lo probado), no un
  requisito. Nueva seccion de portabilidad: cualquier distro, cualquier
  escritorio (ventanas necesitan X11+xdotool, degradan solas en Wayland),
  GPU opcional.
- Eliminado config/jarvis-herramientas.json: llevaba rutas personales.

Licencia: GPL-3.0 (copyleft).

docs/stack.svg: diagrama del stack (oir-pensar-hacer-hablar), reemplaza el
ASCII en el README. Anadido que el RAG sube la recuperacion de 48 a 82%
(hit@1) medido.
2026-08-16 15:53:35 +02:00

21 lines
979 B
Text

# Variante de qwen3.5:4b para JARVIS.
#
# Crear o recrear: ollama create qwen3.5:4b-jarvis -f qwen3.5-4b-jarvis.Modelfile
#
# ── PORTABILIDAD DE GPU ─────────────────────────────────────────────────────
#
# num_gpu (cuantas capas van a la tarjeta) NO se fija aqui a proposito: Ollama
# lo reparte segun la VRAM disponible, asi que el modelo funciona igual en una
# tarjeta pequeña, en una grande, o en CPU. Si lo fijas, lo atas a UNA tarjeta.
#
# Solo tiene sentido fijarlo si quieres reservar VRAM para whisper en una
# tarjeta MUY justa (p.ej. 4 GB). En ese caso, y solo ahi, descomenta y ajusta:
#
# # PARAMETER num_gpu 24 # deja ~1,5 GB para whisper en una tarjeta de 4 GB
#
# num_ctx 4096 es un contexto conservador; en una tarjeta con mas VRAM puedes
# subirlo (8192, 16384...) para que recuerde mas conversacion.
FROM qwen3.5:4b
PARAMETER num_ctx 4096