Herramientas de usuario

Herramientas del sitio


inteligencia_artificial:intro_llm

Diferencias

Muestra las diferencias entre dos versiones de la página.

Enlace a la vista de comparación

Próxima revisión
Revisión previa
inteligencia_artificial:intro_llm [2026/06/16 14:23] – creado albertointeligencia_artificial:intro_llm [2026/06/16 14:35] (actual) – [6. Estructura de Software en Entornos Locales] alberto
Línea 132: Línea 132:
  
 <code> <code>
-[Open WebUI]  ---(Petición HTTP/JSON API)--->  [Ollama Engine]  --->  [Drivers CUDA] ---> [RTX 3060 VRAM] +[Open WebUI]  ---(Petición HTTP/JSON API)--->  [Ollama Engine]  --->  [Drivers CUDA] -----------> [RTX 3060 VRAM] 
-  (UI/Chat)                                     (Carga de GGUF /       (Cálculo de Tensores    (Pesos + KVCache) +  (UI/Chat)                                    (Carga de GGUF /       (Cálculo de Tensores        (Pesos + KVCache) 
-                                                 Gestión de Capas)       con PyTorch de bajo nivel)+                                               Gestión de Capas)      con PyTorch de bajo nivel)
 </code> </code>
  
Línea 141: Línea 141:
   - **Entorno de Contenerización (Ej. Docker):** Proporciona un entorno seguro y aislado (//sandbox//) con permisos restringidos para que agentes locales ejecuten código creado por la IA sin poner en riesgo el sistema operativo anfitrión.   - **Entorno de Contenerización (Ej. Docker):** Proporciona un entorno seguro y aislado (//sandbox//) con permisos restringidos para que agentes locales ejecuten código creado por la IA sin poner en riesgo el sistema operativo anfitrión.
   - **Capa Matemática de Bajo Nivel (Ej. PyTorch / CUDA):** Framework subyacente que traduce las operaciones de tensores del script a instrucciones binarias de álgebra lineal ejecutables directamente por el silicio de la GPU.   - **Capa Matemática de Bajo Nivel (Ej. PyTorch / CUDA):** Framework subyacente que traduce las operaciones de tensores del script a instrucciones binarias de álgebra lineal ejecutables directamente por el silicio de la GPU.
 +
 +----
 +> **Nota:** //Generado con Gemini Flash con nivel de pensamiento avanzado a partir de conversación mantenida. Junio 2026.//
inteligencia_artificial/intro_llm.1781612601.txt.gz · Última modificación: por alberto

Donate Powered by PHP Valid HTML5 Valid CSS Driven by DokuWiki