[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"package:cask:llama-app:es":3,"releases:stats:cask:llama-app:es":254,"related:cask:llama-app:es":255,"markdown:3:4581:bi4b7g":308},{"artifacts":4,"autoUpdates":45,"categories":46,"conflictsWith":52,"dependsOn":55,"deprecated":69,"description":70,"descriptionEn":71,"developer":72,"disabled":69,"displayName":73,"downloadSha256":74,"downloadSize":75,"downloadUrl":76,"editorChoice":69,"formulaeUrl":77,"homepage":78,"iconUrl":79,"installCommand":80,"installs":81,"installs30d":82,"isFont":69,"isLibrary":69,"kegOnly":69,"kind":85,"latestRelease":86,"machineTranslated":69,"minMacos":68,"name":73,"names":115,"platforms":118,"primaryCategory":223,"rank30d":224,"releaseCount":225,"releaseStats":226,"repoUrl":78,"screenshots":232,"sourceLocale":109,"sourceUrl":240,"summary":241,"summaryTranslation":242,"supports":245,"tags":247,"tap":252,"token":117,"version":114,"versionChangedAt":253},{"apps":5,"binaries":7,"entries":8,"pkgs":44},[6],"Llama.app",[],[9,16,23],{"declaration":10,"phase":14,"sources":15,"type":14},{"uninstall":11},[12],{"quit":13},"app.llama.Llama","uninstall",[],{"declaration":17,"phase":20,"sources":21,"target":19,"type":22},{"app":18,"target":19},[6],"\u002FApplications\u002FLlama.app","install",[6],"app",{"declaration":24,"phase":41,"sources":42,"type":43},{"zap":25},[26],{"trash":27},[28,29,30,31,32,33,34,35,36,37,38,39,40],"~\u002F.llama-app","~\u002F.local\u002Fbin\u002Fllama","~\u002FLibrary\u002FApplication Support\u002FLlama","~\u002FLibrary\u002FApplication Support\u002FLlamaBarn","~\u002FLibrary\u002FCaches\u002Fapp.llama.Llama","~\u002FLibrary\u002FCaches\u002Fapp.llamabarn.LlamaBarn","~\u002FLibrary\u002FCaches\u002FSentryCrash\u002FLlama","~\u002FLibrary\u002FHTTPStorages\u002Fapp.llama.Llama","~\u002FLibrary\u002FHTTPStorages\u002Fapp.llamabarn.LlamaBarn","~\u002FLibrary\u002FHTTPStorages\u002Fapp.llamabarn.LlamaBarn.binarycookies","~\u002FLibrary\u002FPreferences\u002Fapp.llama.Llama.plist","~\u002FLibrary\u002FPreferences\u002Fapp.llamabarn.LlamaBarn.plist","~\u002FLibrary\u002FWebKit\u002Fapp.llamabarn.LlamaBarn","cleanup",[],"zap",[],true,[47],{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},"lucide:sparkles","Herramientas de IA","ai","zh-CN",{"casks":53,"formulae":54},[],[],{"arch":56,"casks":58,"formulae":59,"macos":60,"requirements":61},[57],"arm64",[],[],">= 15",{"arch":62,"macos":66},[63],{"bits":64,"type":65},64,"arm",{">=":67},[68],"15",false,"Llama es una aplicación para la barra de menús de macOS que permite ejecutar modelos de lenguaje localmente con llama.cpp. Está pensada para desarrolladores y usuarios de IA local que buscan un controlador ligero, descarga de modelos, una interfaz de chat integrada y una API que puedan utilizar otras aplicaciones.\n\n## Modelos y API\nLa aplicación inicia un servidor local en el puerto 9931, con endpoints de API bajo \u002Fv1. Usa un motor llama.cpp instalado o instala un motor precompilado para Mac. Detecta los modelos compatibles que ya existen, recomienda modelos adecuados para el equipo e instala modelos GGUF de Hugging Face. Los modelos se cargan cuando se solicitan y se descargan de la memoria cuando están inactivos. Puedes usar la interfaz web integrada, clientes compatibles de chat o editores, agentes de programación o solicitudes directas a la API. La versión 0.44.0 también admite modelos de decisión: el endpoint \u002Fv1\u002Fsystemone devuelve probabilidades para opciones de preguntas tipadas, y los modelos compatibles muestran una etiqueta «Decision». Puede descargar borradores DFlash disponibles; el editor afirma que son hasta un 50 % más rápidos que MTP, una afirmación que depende de la carga de trabajo. Una página para crear solicitudes admite solicitudes de chat de OpenAI, OpenAI Responses y del estilo de Anthropic, con imágenes, herramientas y opciones de salida estructurada cuando el modelo seleccionado las admite.\n\n## Instalación y recursos\nDescarga el DMG oficial de Llama y coloca la aplicación en Aplicaciones, o usa `brew install --cask llama-app`. El cask actual requiere un Mac con Apple Silicon arm64 y macOS 15 o posterior. El catálogo ahora muestra 0.44.0, mientras que el enlace de descarga del paquete actual todavía apunta al DMG histórico 0.43.0 (1,226,629 bytes). El archivo de publicación oficial 0.44.0 Llama.dmg ocupa 1,257,897 bytes; son artefactos distintos. Los pesos de los modelos y los motores de inferencia descargados requieren mucho más espacio en disco que este controlador. El tamaño del modelo, la cuantización, la longitud del contexto y la concurrencia determinan los requisitos de memoria y rendimiento; las recomendaciones de la aplicación son útiles, pero no garantizan que todos los modelos funcionen bien.\n\n## Red, cuentas y costes\nLa inferencia se ejecuta en el Mac. Descargar modelos o un motor precompilado requiere acceso a la red y es independiente de la inferencia local. El uso habitual de localhost no requiere una suscripción a inferencia en la nube. Los repositorios de Hugging Face pueden ser públicos o estar restringidos; se aplican sus condiciones de acceso y las licencias de los modelos. La aplicación tiene licencia MIT, mientras que los pesos de los modelos y las herramientas externas tienen licencias independientes. El acceso mediante Tailscale requiere que el servicio de Tailscale esté instalado por separado y que se haya iniciado sesión; también está sujeto a su propia cuenta y condiciones.\n\n## Exposición a la red y precauciones prácticas\nDe forma predeterminada, solo se puede acceder al servidor desde el Mac. En Ajustes se puede vincular a Tailscale o a la red actual. El README advierte que «This network» se vincula a todas las interfaces y que el servidor no tiene contraseña de forma predeterminada; usa ese modo solo en una red de confianza y evita combinarlo con el modo de agente en una red que no sea tuya. La inferencia local no garantiza que los clientes de red habilitados deliberadamente o las descargas no generen tráfico. Comprueba quién puede acceder al servidor y qué pueden hacer los agentes conectados.\n\nLas sustituciones personalizadas de modelos en ~\u002F.config\u002Fllama\u002Fmodels.user.ini pueden anular los ajustes de la aplicación basados en la memoria. Guarda copias antes de modificarlas y revisa los avisos sobre opciones ignoradas. Los clientes externos pueden enviar solicitudes privadas o usar agentes con capacidad para utilizar herramientas; comprueba sus permisos y las acciones que generan. Las fuentes examinadas no establecen un requisito general de Accesibilidad ni de Acceso total al disco. Concede acceso solo a las ubicaciones de modelos y configuración, y a los flujos de trabajo que quieras utilizar.\n\nFuentes: [Proyecto oficial, almacenamiento y comportamiento de red](https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS), [versión 0.44.0](https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Freleases\u002Ftag\u002F0.44.0), [API del servidor llama.cpp](https:\u002F\u002Fgithub.com\u002Fggml-org\u002Fllama.cpp\u002Ftree\u002Fmaster\u002Ftools\u002Fserver), [licencia MIT](https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Fblob\u002Fmain\u002FLICENSE).","Menu bar app for running local LLMs","GGML organization and Llama contributors","Llama","f772824972442506614596879bb69192c4c8c17f4ead5d6bbb3ccdeef73f9b00",1257897,"https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Freleases\u002Fdownload\u002F0.44.0\u002FLlama.dmg","https:\u002F\u002Fformulae.brew.sh\u002Fcask\u002Fllama-app","https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F8fd3bf680130\u002Fa584f25a6670-256.png","brew install --cask llama-app",{"d30":82,"d365":83,"d90":84},298,1178,922,"cask",{"bodyMarkdown":87,"brewCommittedAt":88,"hasNotes":45,"id":89,"isLatest":45,"isPrerelease":69,"machineTranslated":69,"publishedAt":90,"sections":91,"source":108,"sourceLocale":109,"summary":110,"title":111,"translation":112,"version":114},"Llama now runs decision models. Instead of chatting, they answer a typed question with a probability for each option, through the server's `\u002Fv1\u002Fsystemone` endpoint. They carry a Decision chip, and their model page links to a guide on how to use them.\n\n- Download DFlash draft heads when available: up to 50% faster than MTP\n- Update the engine to b11429, switching right away when no model is loaded\n- Merge the Downloads and Command settings tabs into a new Advanced tab\n- Rename the Web UI settings tab to Chat and its setting to custom web app\n- Open the quick prompt without bringing Settings to the front\n\nSource: [Official 0.44.0 release](https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Freleases\u002Ftag\u002F0.44.0).","2026-10-08T13:45:25Z",3427,"0001-01-01T00:00:00Z",[92,98,102],{"area":93,"items":94},"Models",[95,96,97],"Run decision models through \u002Fv1\u002Fsystemone with option probabilities.","Show a Decision chip and a guide link on compatible model pages.","Download available DFlash draft heads; publisher claims up to 50% over MTP.",{"area":99,"items":100},"Engine",[101],"Update to b11429; switch immediately when no model is loaded.",{"area":103,"items":104},"Settings",[105,106,107],"Merge Downloads and Command into Advanced.","Rename Web UI to Chat and the setting to custom web app.","Open the quick prompt without bringing Settings to the front.","editorial","en-US","Adds decision models and DFlash draft heads, and reorganizes settings.","Llama 0.44.0",{"locale":109,"machineTranslated":69,"sourceLocale":109,"status":113},"source","0.44.0",[73,116,117],"llamabarn","llama-app",[119,154,189],{"arch":57,"artifacts":120,"conflictsWith":140,"dependsOn":143,"downloadSha256":74,"downloadUrl":76,"macos":152,"minMacos":68,"requiresRosetta":69,"tag":153,"version":114},{"apps":121,"binaries":122,"entries":123,"pkgs":139},[6],[],[124,129,133],{"declaration":125,"phase":14,"sources":128,"type":14},{"uninstall":126},[127],{"quit":13},[],{"declaration":130,"phase":20,"sources":132,"target":19,"type":22},{"app":131,"target":19},[6],[6],{"declaration":134,"phase":41,"sources":138,"type":43},{"zap":135},[136],{"trash":137},[28,29,30,31,32,33,34,35,36,37,38,39,40],[],[],{"casks":141,"formulae":142},[],[],{"arch":144,"casks":145,"formulae":146,"macos":60,"requirements":147},[57],[],[],{"arch":148,"macos":150},[149],{"bits":64,"type":65},{">=":151},[68],"27","arm64_golden_gate",{"arch":57,"artifacts":155,"conflictsWith":175,"dependsOn":178,"downloadSha256":74,"downloadUrl":76,"macos":187,"minMacos":68,"requiresRosetta":69,"tag":188,"version":114},{"apps":156,"binaries":157,"entries":158,"pkgs":174},[6],[],[159,164,168],{"declaration":160,"phase":14,"sources":163,"type":14},{"uninstall":161},[162],{"quit":13},[],{"declaration":165,"phase":20,"sources":167,"target":19,"type":22},{"app":166,"target":19},[6],[6],{"declaration":169,"phase":41,"sources":173,"type":43},{"zap":170},[171],{"trash":172},[28,29,30,31,32,33,34,35,36,37,38,39,40],[],[],{"casks":176,"formulae":177},[],[],{"arch":179,"casks":180,"formulae":181,"macos":60,"requirements":182},[57],[],[],{"arch":183,"macos":185},[184],{"bits":64,"type":65},{">=":186},[68],"26","arm64_tahoe",{"arch":57,"artifacts":190,"conflictsWith":210,"dependsOn":213,"downloadSha256":74,"downloadUrl":76,"macos":68,"minMacos":68,"requiresRosetta":69,"tag":222,"version":114},{"apps":191,"binaries":192,"entries":193,"pkgs":209},[6],[],[194,199,203],{"declaration":195,"phase":14,"sources":198,"type":14},{"uninstall":196},[197],{"quit":13},[],{"declaration":200,"phase":20,"sources":202,"target":19,"type":22},{"app":201,"target":19},[6],[6],{"declaration":204,"phase":41,"sources":208,"type":43},{"zap":205},[206],{"trash":207},[28,29,30,31,32,33,34,35,36,37,38,39,40],[],[],{"casks":211,"formulae":212},[],[],{"arch":214,"casks":215,"formulae":216,"macos":60,"requirements":217},[57],[],[],{"arch":218,"macos":220},[219],{"bits":64,"type":65},{">=":221},[68],"arm64_sequoia",{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},406,13,{"brewLag":227,"cadence":231,"count30d":229},{"compared":228,"earlierCount":229,"medianMinutes":230},4,1,153722867,"weekly",[233],{"caption":234,"height":235,"machineTranslated":45,"sourceLocale":109,"theme":236,"thumbUrl":237,"url":238,"width":239},"Captura histórica de la barra de menús de la versión 0.28 en el README oficial, etiquetada como LlamaBarn, que muestra los modelos instalados y la configuración.",720,"light","https:\u002F\u002Fcdn.opennavo.com\u002Fscreenshots\u002Fuploads\u002Fscreenshot\u002Fe36068d98d10\u002Fe7ceab1f0a06-640.png","https:\u002F\u002Fcdn.opennavo.com\u002Fscreenshots\u002Fuploads\u002Fscreenshot\u002Fe36068d98d10\u002Fe7ceab1f0a06-1280.png",1280,"https:\u002F\u002Fgithub.com\u002Fhomebrew\u002Fhomebrew-cask\u002Fblob\u002FHEAD\u002FCasks\u002Fl\u002Fllama-app.rb","Controlador para la barra de menús de macOS: modelos GGUF locales, inferencia llama.cpp, chat web integrado y API de modelos compatibles.",{"locale":243,"machineTranslated":69,"sourceLocale":109,"status":244},"es-ES","manual",{"arm64":45,"requiresRosetta":69,"status":246,"x86_64":69},"known",[248,249,250,251],"Local AI","LLM","llama.cpp","Open source","homebrew\u002Fcask","2026-10-09T07:15:26.193153Z",null,[256,266,276,287,297],{"accentColor":257,"autoUpdates":69,"deprecated":69,"disabled":69,"displayName":258,"editorChoice":69,"iconUrl":259,"installs30d":260,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":45,"name":258,"primaryCategory":261,"rank30d":262,"sourceLocale":109,"summary":263,"token":264,"version":265,"versionChangedAt":253},"#18449E","Osaurus","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F27e60dc1e65e\u002F4b631a582622-256.png",143,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},653,"Aplicación de IA nativa para Apple Silicon con modelos locales y en la nube, agentes persistentes, memoria, herramientas aisladas y API compatibles.","osaurus","0.25.20",{"autoUpdates":45,"deprecated":69,"disabled":69,"displayName":267,"editorChoice":69,"iconUrl":268,"installs30d":269,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":45,"name":267,"primaryCategory":270,"rank30d":271,"sourceLocale":109,"summary":272,"token":273,"version":274,"versionChangedAt":275},"Perplexity AI","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F86b5e9494fcd\u002F8b68a118fae2-256.png",262,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},434,"Búsqueda e investigación con IA para Mac, con flujos de trabajo de ordenador personal en archivos conectados, aplicaciones nativas y la web.","perplexity","26.39.0","2026-10-07T09:38:40.131182Z",{"accentColor":277,"autoUpdates":45,"deprecated":69,"disabled":69,"displayName":278,"editorChoice":69,"iconUrl":279,"installs30d":280,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":69,"name":278,"primaryCategory":281,"rank30d":282,"sourceLocale":109,"summary":283,"token":284,"version":285,"versionChangedAt":286},"#122F4A","DeepL","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F4ce34e596711\u002F4e5160d11e3e-256.png",173,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},590,"Asistente de traducción y escritura para Mac, con atajos entre aplicaciones, traducción de documentos, glosarios y captura de texto en pantalla.","deepl","26.6.14916780","2026-10-07T09:38:28.442235Z",{"accentColor":288,"autoUpdates":45,"deprecated":69,"disabled":69,"displayName":289,"editorChoice":69,"iconUrl":290,"installs30d":291,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":45,"name":289,"primaryCategory":292,"rank30d":293,"sourceLocale":109,"summary":294,"token":295,"version":296,"versionChangedAt":286},"#E7CC0D","EXO","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F64c002ff065e\u002F6112dd44ccff-256.png",230,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},481,"Un sistema de inferencia de IA local de código abierto que detecta dispositivos cercanos y distribuye modelos compatibles entre los equipos de un clúster de Mac.","exo","1.0.71",{"accentColor":298,"autoUpdates":45,"deprecated":69,"disabled":69,"displayName":299,"editorChoice":69,"iconUrl":300,"installs30d":301,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":69,"name":299,"primaryCategory":302,"rank30d":303,"sourceLocale":109,"summary":304,"token":305,"version":306,"versionChangedAt":307},"#FFCB28","Jan","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F959cc9db27d5\u002Faba6ce13c525-256.png",217,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},504,"Aplicación de escritorio de IA con modelos locales, descargas, chat, asistentes, proveedores de nube opcionales, herramientas MCP y API local compatible con OpenAI.","jan","0.8.6","2026-10-09T11:16:07.323276Z","\u003Cp>Llama es una aplicación para la barra de menús de macOS que permite ejecutar modelos de lenguaje localmente con llama.cpp. Está pensada para desarrolladores y usuarios de IA local que buscan un controlador ligero, descarga de modelos, una interfaz de chat integrada y una API que puedan utilizar otras aplicaciones.\u003C\u002Fp>\n\u003Ch3 class=\"on-md-heading-1\">Modelos y API\u003C\u002Fh3>\n\u003Cp>La aplicación inicia un servidor local en el puerto 9931, con endpoints de API bajo \u002Fv1. Usa un motor llama.cpp instalado o instala un motor precompilado para Mac. Detecta los modelos compatibles que ya existen, recomienda modelos adecuados para el equipo e instala modelos GGUF de Hugging Face. Los modelos se cargan cuando se solicitan y se descargan de la memoria cuando están inactivos. Puedes usar la interfaz web integrada, clientes compatibles de chat o editores, agentes de programación o solicitudes directas a la API. La versión 0.44.0 también admite modelos de decisión: el endpoint \u002Fv1\u002Fsystemone devuelve probabilidades para opciones de preguntas tipadas, y los modelos compatibles muestran una etiqueta «Decision». Puede descargar borradores DFlash disponibles; el editor afirma que son hasta un 50 % más rápidos que MTP, una afirmación que depende de la carga de trabajo. Una página para crear solicitudes admite solicitudes de chat de OpenAI, OpenAI Responses y del estilo de Anthropic, con imágenes, herramientas y opciones de salida estructurada cuando el modelo seleccionado las admite.\u003C\u002Fp>\n\u003Ch3 class=\"on-md-heading-1\">Instalación y recursos\u003C\u002Fh3>\n\u003Cp>Descarga el DMG oficial de Llama y coloca la aplicación en Aplicaciones, o usa \u003Ccode>brew install --cask llama-app\u003C\u002Fcode>. El cask actual requiere un Mac con Apple Silicon arm64 y macOS 15 o posterior. El catálogo ahora muestra 0.44.0, mientras que el enlace de descarga del paquete actual todavía apunta al DMG histórico 0.43.0 (1,226,629 bytes). El archivo de publicación oficial 0.44.0 Llama.dmg ocupa 1,257,897 bytes; son artefactos distintos. Los pesos de los modelos y los motores de inferencia descargados requieren mucho más espacio en disco que este controlador. El tamaño del modelo, la cuantización, la longitud del contexto y la concurrencia determinan los requisitos de memoria y rendimiento; las recomendaciones de la aplicación son útiles, pero no garantizan que todos los modelos funcionen bien.\u003C\u002Fp>\n\u003Ch3 class=\"on-md-heading-1\">Red, cuentas y costes\u003C\u002Fh3>\n\u003Cp>La inferencia se ejecuta en el Mac. Descargar modelos o un motor precompilado requiere acceso a la red y es independiente de la inferencia local. El uso habitual de localhost no requiere una suscripción a inferencia en la nube. Los repositorios de Hugging Face pueden ser públicos o estar restringidos; se aplican sus condiciones de acceso y las licencias de los modelos. La aplicación tiene licencia MIT, mientras que los pesos de los modelos y las herramientas externas tienen licencias independientes. El acceso mediante Tailscale requiere que el servicio de Tailscale esté instalado por separado y que se haya iniciado sesión; también está sujeto a su propia cuenta y condiciones.\u003C\u002Fp>\n\u003Ch3 class=\"on-md-heading-1\">Exposición a la red y precauciones prácticas\u003C\u002Fh3>\n\u003Cp>De forma predeterminada, solo se puede acceder al servidor desde el Mac. En Ajustes se puede vincular a Tailscale o a la red actual. El README advierte que «This network» se vincula a todas las interfaces y que el servidor no tiene contraseña de forma predeterminada; usa ese modo solo en una red de confianza y evita combinarlo con el modo de agente en una red que no sea tuya. La inferencia local no garantiza que los clientes de red habilitados deliberadamente o las descargas no generen tráfico. Comprueba quién puede acceder al servidor y qué pueden hacer los agentes conectados.\u003C\u002Fp>\n\u003Cp>Las sustituciones personalizadas de modelos en ~\u002F.config\u002Fllama\u002Fmodels.user.ini pueden anular los ajustes de la aplicación basados en la memoria. Guarda copias antes de modificarlas y revisa los avisos sobre opciones ignoradas. Los clientes externos pueden enviar solicitudes privadas o usar agentes con capacidad para utilizar herramientas; comprueba sus permisos y las acciones que generan. Las fuentes examinadas no establecen un requisito general de Accesibilidad ni de Acceso total al disco. Concede acceso solo a las ubicaciones de modelos y configuración, y a los flujos de trabajo que quieras utilizar.\u003C\u002Fp>\n\u003Cp>Fuentes: \u003Ca href=\"https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\" target=\"_blank\" rel=\"noopener noreferrer\">Proyecto oficial, almacenamiento y comportamiento de red\u003C\u002Fa>, \u003Ca href=\"https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Freleases\u002Ftag\u002F0.44.0\" target=\"_blank\" rel=\"noopener noreferrer\">versión 0.44.0\u003C\u002Fa>, \u003Ca href=\"https:\u002F\u002Fgithub.com\u002Fggml-org\u002Fllama.cpp\u002Ftree\u002Fmaster\u002Ftools\u002Fserver\" target=\"_blank\" rel=\"noopener noreferrer\">API del servidor llama.cpp\u003C\u002Fa>, \u003Ca href=\"https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Fblob\u002Fmain\u002FLICENSE\" target=\"_blank\" rel=\"noopener noreferrer\">licencia MIT\u003C\u002Fa>.\u003C\u002Fp>\n"]