Como encontrar um único caractere chinês em um diário misto de chinês e inglês
Se o seu diário não retornar resultados para um caractere chinês, primeiro verifique qual aplicativo e modo de busca você está usando. Em seguida, teste uma nota conhecida com uma consulta de um caractere, um termo de dois caracteres e uma palavra em inglês. Compare os resultados com o comportamento documentado do aplicativo antes de alterar configurações ou presumir que o caractere está ausente. Os mecanismos de busca variam: alguns usam limites de palavras, outros oferecem uma busca básica separada, e algumas documentações não especificam como o texto em chinês é correspondido.
Comece pela documentação de busca do próprio aplicativo
A busca é um recurso do aplicativo, não uma regra universal. Um diário pode usar um índice de texto completo (full-text), uma varredura de texto básica ou mais de um modo. Mesmo produtos desenvolvidos sobre o SQLite podem diferir na extensão do SQLite, no tokenizador e no tratamento específico do aplicativo. Por exemplo, [o Joplin documenta o uso do SQLite FTS4](https://joplinapp.org/help/apps/search/) e afirma que alterna para um modo personalizado em idiomas que não usam delimitadores de palavras latinas, incluindo o chinês. Sua página também distingue a correspondência de termos exatos da correspondência de substrings no modo FTS documentado. Esses detalhes descrevem o Joplin; eles não definem o comportamento de outros diários.
Procure a versão exata do produto e da plataforma e, em seguida, observe se o manual descreve busca de texto completo, um modo básico, correspondência de tokens ou palavras, correspondência de substrings, comportamento específico para o idioma e conteúdo indexado, como anexos. Não deduza que uma caixa de busca examina cada caractere visível apenas porque aceita a inserção de texto em chinês. Por outro lado, não presuma que um índice rejeitará texto em chinês: o aplicativo pode ter um modo com suporte ao idioma ou outra implementação.
Crie uma pequena nota de controle
Use uma nota conhecida como verificação de controle. Por exemplo, crie uma nota fictícia com o seguinte corpo: “山水 — 北京 — journal”. Aqui, 山 é um caractere único conhecido; 北京 é um termo conhecido de dois caracteres; e journal é uma palavra de controle em inglês. Salve a nota, aguarde qualquer intervalo documentado de indexação e busque cada item separadamente. Registre se a nota aparece para 山, 北京 e journal. Estas são verificações propostas, não resultados de testes em um aplicativo real.
Se journal também não encontrar a nota, verifique primeiro se ela está salva, incluída na conta ou caderno selecionado e nos campos pesquisados. Se journal funcionar, mas nenhuma das consultas em chinês der resultado, o problema é mais específico do tratamento de CJK ou de como os termos de busca são interpretados. Se 北京 funcionar, mas 山 não, registre essa distinção: isso pode apontar para um comportamento de termo mínimo ou de limite de token, mas o resultado por si só não identifica a causa.
Compare a busca de texto completo, básica e por substring com atenção
Em uma busca de texto completo, o aplicativo pode dividir o texto em termos e fazer a correspondência com esses termos indexados. Já a busca por substring procura uma sequência de caracteres dentro de um texto maior. São comportamentos diferentes: corresponder a um termo inteiro não significa necessariamente corresponder a cada sequência mais curta contida nele. O Joplin documenta explicitamente essa distinção para suas consultas FTS e afirma que seu modo CJK personalizado evita a dependência de delimitadores de palavras latinas. O prefixo de barra oblíqua documentado no aplicativo alterna para a busca básica em casos que o FTS não lida bem, embora o Joplin alerte que esse modo pode ser bem mais lento. Use essa sintaxe apenas no Joplin e somente conforme descrito em seu manual atual.
A documentação do banco de dados pode explicar por que os detalhes de implementação importam, sem no entanto prever os resultados de um aplicativo. A [documentação do FTS5](https://sqlite.org/fts5.html) do SQLite descreve tokenizadores configuráveis, incluindo as opções Unicode61 e trigram. A documentação citada do Joplin, contudo, menciona o FTS4. Portanto, exemplos do FTS5 não podem ser usados para afirmar que o Joplin, ou qualquer outro diário, utiliza esses tokenizadores. Consulte a própria documentação do aplicativo antes de aplicar explicações em nível de banco de dados.
Diagnostique o padrão, não apenas a consulta que falhou
Use esta sequência para delimitar o problema:
Não transfira os operadores de busca ou conclusões de um aplicativo para outro. O [guia do usuário do Notas da Apple](https://support.apple.com/guide/notes/search-your-notes-not18ab658ed/mac) descreve a busca no corpo das notas e em vários tipos de anexos, e observa que os recursos disponíveis podem depender da conta. Ele não especifica os limites de tokens em chinês nem garante a recuperação de substrings de caractere único. Quando a documentação oficial omite esse ponto, a conclusão confiável é simplesmente que o comportamento não está documentado ali.
O que as buscas de controle podem indicar
A nota de controle ajuda a diferenciar entre uma nota ausente, um escopo de busca incorreto e um problema de busca específico do idioma. Ela não comprova como o aplicativo indexa cada nota, anexo, conta ou idioma. Mantenha registrados juntos o aplicativo exato, a plataforma, a versão, o modo de busca e os três resultados das consultas; esse registro compacto é mais útil do que apenas dizer “a busca em chinês não funciona”. Se você precisa de consultas confiáveis de caracteres individuais para um arquivo real, confirme o comportamento com suas próprias notas representativas antes de reorganizá-las ou reimportá-las.
