Depois de finalmente ter interligado todo o site e a documentação a um fluxo de tradução à prova d’água (usando o po4a por cima do Hugo), que por acaso usa exatamente o mesmo conjunto de ferramentas e a mesma lógica do aplicativo Ansel, tive a ideia de automatizar as traduções vazias, primeiro a partir dos arquivos de tradução do software, depois por meio da API do ChatGPT, que faz um trabalho bastante razoável ao traduzir a sintaxe Markdown.
Trabalhando sozinho, você não pode contar com a preguiça social , então tem que ser esperto. Você pode ver a lista de coisas que já automatizei em segundo plano para o Ansel.
Tendo escrito eu mesmo todo um mecanismo de busca com IA, o que significa principalmente um rastreador web (porque essa foi a parte mais tediosa de escrever e depurar), tive a oportunidade de ver este site pelos olhos de um bot. Peça por peça, modifiquei os modelos HTML e os metadados para facilitar o rastreamento, a indexação e a busca, primeiro para o mecanismo de busca interno,1 depois para a Chantal AI .
Mesmo com a Chantal, ainda recebo perguntas recorrentes demais sobre informações que já estão escritas em algum lugar. Claro, a documentação está um pouco atrasada em relação ao código, mas as mensagens de commit que escrevo procuram ser não técnicas o suficiente para que usuários avançados entendam o que anda acontecendo no software atualmente.
Eu entendo que não há nada pior do que ficar preso no seu problema sem uma resposta em tempo hábil, mas então eu não teria como servir de suporte técnico para cada sujeito em cada fuso horário com tudo o que precisa de ajuste neste software estúpido. O que significa que ainda há uma lacuna a preencher.
A principal desvantagem da Chantal é que o modelo de linguagem é bastante pesado de retreinar, e eu não teria como automatizar isso em algum servidor. Além disso, os sites não podem ser rastreados rápido demais sem que os servidores os bloqueiem, então isso não consome muita energia, mas exige que algum computador fique ligado por uma semana com uma conexão estável de internet. O que significa que atualizo o modelo de linguagem e o índice web apenas 4 vezes por ano. No momento, o índice web contém 63.452 páginas, o modelo de linguagem conhece 47.579 palavras, e eu finalmente consegui torná-lo razoavelmente compatível com as limitações de E/S de memória de uma hospedagem compartilhada.
O plano, neste momento, é automatizar o rastreamento do site em algum servidor, porque isso não é pesado demais, e depois retreinar o modelo durante a noite no meu próprio computador (o que leva cerca de 4 h de computação e quase todos os meus 32 GB de RAM…).
De qualquer forma, durante minhas brincadeiras com a API do ChatGPT, descobri que você pode treinar seu próprio GPT personalizado.2 Isso é tão simples quanto alimentá-lo com conteúdo de texto que ele possa usar, e agora o ChatGPT também pode carregar sites, sitemaps e pode ser configurado para enviar requisições a APIs Rest. Então, sem mais delongas, conheça o Ansel GPT .
O Ansel GPT está configurado para armazenar em cache e atualizar uma vez por semana as issues do Github, os commits, as postagens do fórum da comunidade e todo o presente site. Ele é capaz de fornecer respostas complexas (e bastante precisas) sobre qual módulo usar, como e quando, no Ansel, bem como sobre conceitos de teoria das cores. Também o configurei para usar o backend da Chantal AI, que é (quase) uma API Rest, e o GPT seguirá os links indexados pela Chantal para melhorar suas respostas.
A ressalva é que o uso do Ansel GPT é reservado aos assinantes do ChatGPT Plus, então tenho a sensação de que trabalhei 2 dias configurando tudo para que a OpenAI possa lucrar com o meu trabalho. Mas, de qualquer forma, se isso ao menos representar menos trabalho para mim no médio-longo prazo, vamos considerar uma vitória.
Translated from English by : Claude. In case of conflict, inconsistency or error, the English version shall prevail.