[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"package:cask:llama-app:pt":3,"releases:stats:cask:llama-app:pt":254,"related:cask:llama-app:pt":255,"markdown:3:4309:93mbno":308},{"artifacts":4,"autoUpdates":45,"categories":46,"conflictsWith":52,"dependsOn":55,"deprecated":69,"description":70,"descriptionEn":71,"developer":72,"disabled":69,"displayName":73,"downloadSha256":74,"downloadSize":75,"downloadUrl":76,"editorChoice":69,"formulaeUrl":77,"homepage":78,"iconUrl":79,"installCommand":80,"installs":81,"installs30d":82,"isFont":69,"isLibrary":69,"kegOnly":69,"kind":85,"latestRelease":86,"machineTranslated":69,"minMacos":68,"name":73,"names":115,"platforms":118,"primaryCategory":223,"rank30d":224,"releaseCount":225,"releaseStats":226,"repoUrl":78,"screenshots":232,"sourceLocale":109,"sourceUrl":240,"summary":241,"summaryTranslation":242,"supports":245,"tags":247,"tap":252,"token":117,"version":114,"versionChangedAt":253},{"apps":5,"binaries":7,"entries":8,"pkgs":44},[6],"Llama.app",[],[9,16,23],{"declaration":10,"phase":14,"sources":15,"type":14},{"uninstall":11},[12],{"quit":13},"app.llama.Llama","uninstall",[],{"declaration":17,"phase":20,"sources":21,"target":19,"type":22},{"app":18,"target":19},[6],"\u002FApplications\u002FLlama.app","install",[6],"app",{"declaration":24,"phase":41,"sources":42,"type":43},{"zap":25},[26],{"trash":27},[28,29,30,31,32,33,34,35,36,37,38,39,40],"~\u002F.llama-app","~\u002F.local\u002Fbin\u002Fllama","~\u002FLibrary\u002FApplication Support\u002FLlama","~\u002FLibrary\u002FApplication Support\u002FLlamaBarn","~\u002FLibrary\u002FCaches\u002Fapp.llama.Llama","~\u002FLibrary\u002FCaches\u002Fapp.llamabarn.LlamaBarn","~\u002FLibrary\u002FCaches\u002FSentryCrash\u002FLlama","~\u002FLibrary\u002FHTTPStorages\u002Fapp.llama.Llama","~\u002FLibrary\u002FHTTPStorages\u002Fapp.llamabarn.LlamaBarn","~\u002FLibrary\u002FHTTPStorages\u002Fapp.llamabarn.LlamaBarn.binarycookies","~\u002FLibrary\u002FPreferences\u002Fapp.llama.Llama.plist","~\u002FLibrary\u002FPreferences\u002Fapp.llamabarn.LlamaBarn.plist","~\u002FLibrary\u002FWebKit\u002Fapp.llamabarn.LlamaBarn","cleanup",[],"zap",[],true,[47],{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},"lucide:sparkles","Ferramentas de IA","ai","zh-CN",{"casks":53,"formulae":54},[],[],{"arch":56,"casks":58,"formulae":59,"macos":60,"requirements":61},[57],"arm64",[],[],">= 15",{"arch":62,"macos":66},[63],{"bits":64,"type":65},64,"arm",{">=":67},[68],"15",false,"Llama é um aplicativo para a barra de menus do macOS que executa modelos de linguagem localmente com llama.cpp. É indicado para desenvolvedores e usuários de IA local que desejam um controlador compacto, downloads de modelos, uma interface de chat integrada e uma API que outros aplicativos podem usar.\n\n## Modelos e API\nO app inicia um servidor local na porta 9931, com endpoints de API em \u002Fv1. Ele usa um mecanismo llama.cpp instalado ou instala um mecanismo pré-compilado para o Mac. Detecta modelos existentes compatíveis, recomenda modelos adequados à máquina e instala modelos GGUF do Hugging Face. Os modelos são carregados quando solicitados e descarregados quando ficam inativos. Use a interface Web integrada, clientes compatíveis de chat e edição, agentes de programação ou solicitações diretas à API. A versão 0.44.0 também oferece suporte a modelos de decisão: o endpoint \u002Fv1\u002Fsystemone retorna probabilidades para opções de perguntas tipadas, e modelos compatíveis exibem um selo Decision. O app pode baixar cabeças de rascunho DFlash disponíveis; o publicador informa geração até 50% mais rápida que MTP, uma alegação que depende da carga de trabalho. Uma página para montar solicitações oferece requisições no estilo OpenAI chat, OpenAI Responses e Anthropic, com configurações de imagens, ferramentas e saída estruturada quando compatíveis com o modelo selecionado.\n\n## Instalação e recursos\nBaixe o DMG oficial do Llama e coloque o app em Aplicativos, ou use `brew install --cask llama-app`. O cask atual requer um Mac Apple Silicon arm64 e macOS 15 ou posterior. O catálogo agora lista 0.44.0, enquanto o link de download do pacote atual ainda aponta para o DMG histórico 0.43.0 (1,226,629 bytes). O artefato de lançamento oficial 0.44.0 Llama.dmg tem 1,257,897 bytes; são artefatos distintos. Os pesos dos modelos e os mecanismos de inferência baixados exigem muito mais espaço em disco do que este controlador. O tamanho do modelo, a quantização, o comprimento do contexto e a simultaneidade determinam os requisitos de memória e desempenho; as recomendações do app são úteis, mas não garantem que todo modelo funcione bem.\n\n## Rede, contas e custos\nA inferência é executada no Mac. Baixar modelos ou um mecanismo pré-compilado requer acesso à rede e é algo separado da inferência local. O uso comum de localhost não exige uma assinatura de inferência em nuvem. Os repositórios do Hugging Face podem ser públicos ou ter acesso restrito; aplicam-se os termos de acesso próprios e as licenças dos modelos. O app usa a licença MIT, enquanto os pesos dos modelos e as ferramentas externas têm licenças distintas. O acesso pelo Tailscale requer o serviço Tailscale instalado separadamente e com sessão iniciada, sujeito à própria conta e aos próprios termos.\n\n## Exposição à rede e precauções práticas\nPor padrão, o servidor só pode ser acessado pelo Mac. Nas configurações, é possível vinculá-lo ao Tailscale ou à rede atual. O README alerta que a opção This network vincula todas as interfaces e que, por padrão, o servidor não tem senha; use esse modo apenas em uma rede confiável e evite combiná-lo com o modo de agente em uma rede que não seja sua. A inferência local não garante que clientes de rede ou downloads habilitados deliberadamente não gerem tráfego. Verifique quem pode acessar o servidor e o que os agentes conectados podem fazer.\n\nAs substituições personalizadas de modelos em ~\u002F.config\u002Fllama\u002Fmodels.user.ini podem sobrescrever as configurações calculadas com base na memória. Guarde cópias antes de alterá-las e analise os avisos sobre opções ignoradas. Clientes externos podem fornecer prompts privados ou usar agentes com capacidade de ferramentas; verifique as permissões e as ações geradas por eles. As fontes analisadas não estabelecem uma exigência geral de Acessibilidade ou Acesso Total ao Disco. Conceda acesso somente aos locais dos modelos e arquivos de configuração, e aos fluxos de trabalho que pretende usar.\n\nFontes: [Projeto oficial, armazenamento e comportamento da rede](https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS), [versão 0.44.0](https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Freleases\u002Ftag\u002F0.44.0), [API do servidor llama.cpp](https:\u002F\u002Fgithub.com\u002Fggml-org\u002Fllama.cpp\u002Ftree\u002Fmaster\u002Ftools\u002Fserver), [licença MIT](https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Fblob\u002Fmain\u002FLICENSE).","Menu bar app for running local LLMs","GGML organization and Llama contributors","Llama","f772824972442506614596879bb69192c4c8c17f4ead5d6bbb3ccdeef73f9b00",1257897,"https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Freleases\u002Fdownload\u002F0.44.0\u002FLlama.dmg","https:\u002F\u002Fformulae.brew.sh\u002Fcask\u002Fllama-app","https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F8fd3bf680130\u002Fa584f25a6670-256.png","brew install --cask llama-app",{"d30":82,"d365":83,"d90":84},298,1178,922,"cask",{"bodyMarkdown":87,"brewCommittedAt":88,"hasNotes":45,"id":89,"isLatest":45,"isPrerelease":69,"machineTranslated":69,"publishedAt":90,"sections":91,"source":108,"sourceLocale":109,"summary":110,"title":111,"translation":112,"version":114},"Llama now runs decision models. Instead of chatting, they answer a typed question with a probability for each option, through the server's `\u002Fv1\u002Fsystemone` endpoint. They carry a Decision chip, and their model page links to a guide on how to use them.\n\n- Download DFlash draft heads when available: up to 50% faster than MTP\n- Update the engine to b11429, switching right away when no model is loaded\n- Merge the Downloads and Command settings tabs into a new Advanced tab\n- Rename the Web UI settings tab to Chat and its setting to custom web app\n- Open the quick prompt without bringing Settings to the front\n\nSource: [Official 0.44.0 release](https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Freleases\u002Ftag\u002F0.44.0).","2026-10-08T13:45:25Z",3427,"0001-01-01T00:00:00Z",[92,98,102],{"area":93,"items":94},"Models",[95,96,97],"Run decision models through \u002Fv1\u002Fsystemone with option probabilities.","Show a Decision chip and a guide link on compatible model pages.","Download available DFlash draft heads; publisher claims up to 50% over MTP.",{"area":99,"items":100},"Engine",[101],"Update to b11429; switch immediately when no model is loaded.",{"area":103,"items":104},"Settings",[105,106,107],"Merge Downloads and Command into Advanced.","Rename Web UI to Chat and the setting to custom web app.","Open the quick prompt without bringing Settings to the front.","editorial","en-US","Adds decision models and DFlash draft heads, and reorganizes settings.","Llama 0.44.0",{"locale":109,"machineTranslated":69,"sourceLocale":109,"status":113},"source","0.44.0",[73,116,117],"llamabarn","llama-app",[119,154,189],{"arch":57,"artifacts":120,"conflictsWith":140,"dependsOn":143,"downloadSha256":74,"downloadUrl":76,"macos":152,"minMacos":68,"requiresRosetta":69,"tag":153,"version":114},{"apps":121,"binaries":122,"entries":123,"pkgs":139},[6],[],[124,129,133],{"declaration":125,"phase":14,"sources":128,"type":14},{"uninstall":126},[127],{"quit":13},[],{"declaration":130,"phase":20,"sources":132,"target":19,"type":22},{"app":131,"target":19},[6],[6],{"declaration":134,"phase":41,"sources":138,"type":43},{"zap":135},[136],{"trash":137},[28,29,30,31,32,33,34,35,36,37,38,39,40],[],[],{"casks":141,"formulae":142},[],[],{"arch":144,"casks":145,"formulae":146,"macos":60,"requirements":147},[57],[],[],{"arch":148,"macos":150},[149],{"bits":64,"type":65},{">=":151},[68],"27","arm64_golden_gate",{"arch":57,"artifacts":155,"conflictsWith":175,"dependsOn":178,"downloadSha256":74,"downloadUrl":76,"macos":187,"minMacos":68,"requiresRosetta":69,"tag":188,"version":114},{"apps":156,"binaries":157,"entries":158,"pkgs":174},[6],[],[159,164,168],{"declaration":160,"phase":14,"sources":163,"type":14},{"uninstall":161},[162],{"quit":13},[],{"declaration":165,"phase":20,"sources":167,"target":19,"type":22},{"app":166,"target":19},[6],[6],{"declaration":169,"phase":41,"sources":173,"type":43},{"zap":170},[171],{"trash":172},[28,29,30,31,32,33,34,35,36,37,38,39,40],[],[],{"casks":176,"formulae":177},[],[],{"arch":179,"casks":180,"formulae":181,"macos":60,"requirements":182},[57],[],[],{"arch":183,"macos":185},[184],{"bits":64,"type":65},{">=":186},[68],"26","arm64_tahoe",{"arch":57,"artifacts":190,"conflictsWith":210,"dependsOn":213,"downloadSha256":74,"downloadUrl":76,"macos":68,"minMacos":68,"requiresRosetta":69,"tag":222,"version":114},{"apps":191,"binaries":192,"entries":193,"pkgs":209},[6],[],[194,199,203],{"declaration":195,"phase":14,"sources":198,"type":14},{"uninstall":196},[197],{"quit":13},[],{"declaration":200,"phase":20,"sources":202,"target":19,"type":22},{"app":201,"target":19},[6],[6],{"declaration":204,"phase":41,"sources":208,"type":43},{"zap":205},[206],{"trash":207},[28,29,30,31,32,33,34,35,36,37,38,39,40],[],[],{"casks":211,"formulae":212},[],[],{"arch":214,"casks":215,"formulae":216,"macos":60,"requirements":217},[57],[],[],{"arch":218,"macos":220},[219],{"bits":64,"type":65},{">=":221},[68],"arm64_sequoia",{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},406,13,{"brewLag":227,"cadence":231,"count30d":229},{"compared":228,"earlierCount":229,"medianMinutes":230},4,1,153722867,"weekly",[233],{"caption":234,"height":235,"machineTranslated":45,"sourceLocale":109,"theme":236,"thumbUrl":237,"url":238,"width":239},"Captura histórica da barra de menus da versão 0.28 no README oficial, identificada como LlamaBarn, mostrando os modelos instalados e as configurações.",720,"light","https:\u002F\u002Fcdn.opennavo.com\u002Fscreenshots\u002Fuploads\u002Fscreenshot\u002Fe36068d98d10\u002Fe7ceab1f0a06-640.png","https:\u002F\u002Fcdn.opennavo.com\u002Fscreenshots\u002Fuploads\u002Fscreenshot\u002Fe36068d98d10\u002Fe7ceab1f0a06-1280.png",1280,"https:\u002F\u002Fgithub.com\u002Fhomebrew\u002Fhomebrew-cask\u002Fblob\u002FHEAD\u002FCasks\u002Fl\u002Fllama-app.rb","Controlador na barra de menus do macOS para modelos GGUF locais, inferência com llama.cpp, chat web integrado e APIs compatíveis com modelos.",{"locale":243,"machineTranslated":69,"sourceLocale":109,"status":244},"pt-BR","manual",{"arm64":45,"requiresRosetta":69,"status":246,"x86_64":69},"known",[248,249,250,251],"Local AI","LLM","llama.cpp","Open source","homebrew\u002Fcask","2026-10-09T07:15:26.193153Z",null,[256,266,276,287,297],{"accentColor":257,"autoUpdates":69,"deprecated":69,"disabled":69,"displayName":258,"editorChoice":69,"iconUrl":259,"installs30d":260,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":45,"name":258,"primaryCategory":261,"rank30d":262,"sourceLocale":109,"summary":263,"token":264,"version":265,"versionChangedAt":253},"#18449E","Osaurus","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F27e60dc1e65e\u002F4b631a582622-256.png",143,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},653,"Aplicativo de IA nativo para Apple Silicon com modelos locais e na nuvem, agentes persistentes, memória, ferramentas isoladas e APIs compatíveis.","osaurus","0.25.20",{"autoUpdates":45,"deprecated":69,"disabled":69,"displayName":267,"editorChoice":69,"iconUrl":268,"installs30d":269,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":45,"name":267,"primaryCategory":270,"rank30d":271,"sourceLocale":109,"summary":272,"token":273,"version":274,"versionChangedAt":275},"Perplexity AI","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F86b5e9494fcd\u002F8b68a118fae2-256.png",262,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},434,"Busca e pesquisa com IA para Mac, com fluxos de trabalho de computador pessoal entre arquivos conectados, aplicativos nativos e a web.","perplexity","26.39.0","2026-10-07T09:38:40.131182Z",{"accentColor":277,"autoUpdates":45,"deprecated":69,"disabled":69,"displayName":278,"editorChoice":69,"iconUrl":279,"installs30d":280,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":69,"name":278,"primaryCategory":281,"rank30d":282,"sourceLocale":109,"summary":283,"token":284,"version":285,"versionChangedAt":286},"#122F4A","DeepL","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F4ce34e596711\u002F4e5160d11e3e-256.png",173,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},590,"Assistente de tradução e escrita para Mac, com atalhos entre apps, tradução de documentos, glossários e captura de texto da tela.","deepl","26.6.14916780","2026-10-07T09:38:28.442235Z",{"accentColor":288,"autoUpdates":45,"deprecated":69,"disabled":69,"displayName":289,"editorChoice":69,"iconUrl":290,"installs30d":291,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":45,"name":289,"primaryCategory":292,"rank30d":293,"sourceLocale":109,"summary":294,"token":295,"version":296,"versionChangedAt":286},"#E7CC0D","EXO","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F64c002ff065e\u002F6112dd44ccff-256.png",230,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},481,"Um sistema de inferência de IA local de código aberto que descobre dispositivos próximos e distribui modelos compatíveis em um cluster de Mac.","exo","1.0.71",{"accentColor":298,"autoUpdates":45,"deprecated":69,"disabled":69,"displayName":299,"editorChoice":69,"iconUrl":300,"installs30d":301,"isFont":69,"isLibrary":69,"kind":85,"machineTranslated":69,"name":299,"primaryCategory":302,"rank30d":303,"sourceLocale":109,"summary":304,"token":305,"version":306,"versionChangedAt":307},"#FFCB28","Jan","https:\u002F\u002Fcdn.opennavo.com\u002Ficons\u002Fuploads\u002F959cc9db27d5\u002Faba6ce13c525-256.png",217,{"icon":48,"machineTranslated":45,"name":49,"slug":50,"sourceLocale":51},504,"Aplicativo de IA para desktop com modelos locais, downloads, chat, assistentes, provedores de nuvem opcionais, ferramentas MCP e API local compatível com OpenAI.","jan","0.8.6","2026-10-09T11:16:07.323276Z","\u003Cp>Llama é um aplicativo para a barra de menus do macOS que executa modelos de linguagem localmente com llama.cpp. É indicado para desenvolvedores e usuários de IA local que desejam um controlador compacto, downloads de modelos, uma interface de chat integrada e uma API que outros aplicativos podem usar.\u003C\u002Fp>\n\u003Ch3 class=\"on-md-heading-1\">Modelos e API\u003C\u002Fh3>\n\u003Cp>O app inicia um servidor local na porta 9931, com endpoints de API em \u002Fv1. Ele usa um mecanismo llama.cpp instalado ou instala um mecanismo pré-compilado para o Mac. Detecta modelos existentes compatíveis, recomenda modelos adequados à máquina e instala modelos GGUF do Hugging Face. Os modelos são carregados quando solicitados e descarregados quando ficam inativos. Use a interface Web integrada, clientes compatíveis de chat e edição, agentes de programação ou solicitações diretas à API. A versão 0.44.0 também oferece suporte a modelos de decisão: o endpoint \u002Fv1\u002Fsystemone retorna probabilidades para opções de perguntas tipadas, e modelos compatíveis exibem um selo Decision. O app pode baixar cabeças de rascunho DFlash disponíveis; o publicador informa geração até 50% mais rápida que MTP, uma alegação que depende da carga de trabalho. Uma página para montar solicitações oferece requisições no estilo OpenAI chat, OpenAI Responses e Anthropic, com configurações de imagens, ferramentas e saída estruturada quando compatíveis com o modelo selecionado.\u003C\u002Fp>\n\u003Ch3 class=\"on-md-heading-1\">Instalação e recursos\u003C\u002Fh3>\n\u003Cp>Baixe o DMG oficial do Llama e coloque o app em Aplicativos, ou use \u003Ccode>brew install --cask llama-app\u003C\u002Fcode>. O cask atual requer um Mac Apple Silicon arm64 e macOS 15 ou posterior. O catálogo agora lista 0.44.0, enquanto o link de download do pacote atual ainda aponta para o DMG histórico 0.43.0 (1,226,629 bytes). O artefato de lançamento oficial 0.44.0 Llama.dmg tem 1,257,897 bytes; são artefatos distintos. Os pesos dos modelos e os mecanismos de inferência baixados exigem muito mais espaço em disco do que este controlador. O tamanho do modelo, a quantização, o comprimento do contexto e a simultaneidade determinam os requisitos de memória e desempenho; as recomendações do app são úteis, mas não garantem que todo modelo funcione bem.\u003C\u002Fp>\n\u003Ch3 class=\"on-md-heading-1\">Rede, contas e custos\u003C\u002Fh3>\n\u003Cp>A inferência é executada no Mac. Baixar modelos ou um mecanismo pré-compilado requer acesso à rede e é algo separado da inferência local. O uso comum de localhost não exige uma assinatura de inferência em nuvem. Os repositórios do Hugging Face podem ser públicos ou ter acesso restrito; aplicam-se os termos de acesso próprios e as licenças dos modelos. O app usa a licença MIT, enquanto os pesos dos modelos e as ferramentas externas têm licenças distintas. O acesso pelo Tailscale requer o serviço Tailscale instalado separadamente e com sessão iniciada, sujeito à própria conta e aos próprios termos.\u003C\u002Fp>\n\u003Ch3 class=\"on-md-heading-1\">Exposição à rede e precauções práticas\u003C\u002Fh3>\n\u003Cp>Por padrão, o servidor só pode ser acessado pelo Mac. Nas configurações, é possível vinculá-lo ao Tailscale ou à rede atual. O README alerta que a opção This network vincula todas as interfaces e que, por padrão, o servidor não tem senha; use esse modo apenas em uma rede confiável e evite combiná-lo com o modo de agente em uma rede que não seja sua. A inferência local não garante que clientes de rede ou downloads habilitados deliberadamente não gerem tráfego. Verifique quem pode acessar o servidor e o que os agentes conectados podem fazer.\u003C\u002Fp>\n\u003Cp>As substituições personalizadas de modelos em ~\u002F.config\u002Fllama\u002Fmodels.user.ini podem sobrescrever as configurações calculadas com base na memória. Guarde cópias antes de alterá-las e analise os avisos sobre opções ignoradas. Clientes externos podem fornecer prompts privados ou usar agentes com capacidade de ferramentas; verifique as permissões e as ações geradas por eles. As fontes analisadas não estabelecem uma exigência geral de Acessibilidade ou Acesso Total ao Disco. Conceda acesso somente aos locais dos modelos e arquivos de configuração, e aos fluxos de trabalho que pretende usar.\u003C\u002Fp>\n\u003Cp>Fontes: \u003Ca href=\"https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\" target=\"_blank\" rel=\"noopener noreferrer\">Projeto oficial, armazenamento e comportamento da rede\u003C\u002Fa>, \u003Ca href=\"https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Freleases\u002Ftag\u002F0.44.0\" target=\"_blank\" rel=\"noopener noreferrer\">versão 0.44.0\u003C\u002Fa>, \u003Ca href=\"https:\u002F\u002Fgithub.com\u002Fggml-org\u002Fllama.cpp\u002Ftree\u002Fmaster\u002Ftools\u002Fserver\" target=\"_blank\" rel=\"noopener noreferrer\">API do servidor llama.cpp\u003C\u002Fa>, \u003Ca href=\"https:\u002F\u002Fgithub.com\u002Fggml-org\u002FLlama-macOS\u002Fblob\u002Fmain\u002FLICENSE\" target=\"_blank\" rel=\"noopener noreferrer\">licença MIT\u003C\u002Fa>.\u003C\u002Fp>\n"]