# Variante de qwen3.5:4b para JARVIS. # # Crear o recrear: ollama create qwen3.5:4b-jarvis -f qwen3.5-4b-jarvis.Modelfile # # ── PORTABILIDAD DE GPU ───────────────────────────────────────────────────── # # num_gpu (cuantas capas van a la tarjeta) NO se fija aqui a proposito: Ollama # lo reparte segun la VRAM disponible, asi que el modelo funciona igual en una # tarjeta pequeña, en una grande, o en CPU. Si lo fijas, lo atas a UNA tarjeta. # # Solo tiene sentido fijarlo si quieres reservar VRAM para whisper en una # tarjeta MUY justa (p.ej. 4 GB). En ese caso, y solo ahi, descomenta y ajusta: # # # PARAMETER num_gpu 24 # deja ~1,5 GB para whisper en una tarjeta de 4 GB # # num_ctx 4096 es un contexto conservador; en una tarjeta con mas VRAM puedes # subirlo (8192, 16384...) para que recuerde mas conversacion. FROM qwen3.5:4b PARAMETER num_ctx 4096