Par exemple, rechercher it, it:, “it, it:”, “it, it:”,, "it, it:", ou it, it:”. Cela ne remonte pas ce message, bien qu’il contienne « it, it: ».[1]
De plus, lorsque vous appuyez sur le bouton de recherche, les guillemets “” sont transformés en "". Je n’aime pas cette expérience, je ne sais pas s’il s’agit d’un bug.
Plateforme : Edge sur Android, try.discourse.org, reproductible en mode sans échec
Au cas où il serait supprimé automatiquement : le contenu du message de test est : It, « it, it: », it, oandnxkwbs. ↩︎
Je pense que it est un mot vide (stop word) qui est exclu de la recherche. Avez-vous essayé de reproduire le problème avec un mot qui ne figure pas dans cette liste, afin de vérifier que cela concerne bien la ponctuation ? Are specific terms ignored from searches? - #5 by codinghorror
Je ne parviens plus à le reproduire sous une autre forme. Peut-être que le forum sur lequel j’ai constaté le problème utilise une version obsolète de Discourse.
En fait, je pense que je peux reproduire le problème. Essayez de trouver ce message en cherchant we don't
Et la recherche de « just-use-interface{}/object; we don’t need generics » ou de "just-use- interface{} / object ; we don't need generics" ne le trouve pas
Mais la recherche de just-use- interface{} / object ; we don't need generics le trouve
Oui, c’est correct… on ne peut tout simplement pas rechercher it… si vous essayez ici, vous n’obtenez aucun résultat. Les mots qui sont susceptibles d’apparaître un nombre extrême de fois (I, the, a, les pronoms, etc.) sont exclus de l’indexation car ils apparaissent trop souvent pour fournir une différenciation significative.
même chose ici, we et don't (techniquement don et t) ne sont pas indexés
cette situation est un peu différente… pour :
"just-use- interface{} / object ; we don't need generics"
cela ne fonctionnera jamais, les guillemets demandent une correspondance exacte et les espaces empêchent qu’il s’agisse d’une correspondance exacte
dans le cas d’une recherche de :
"just-use-interface{}/object; we don't need generics"
le texte du message d’origine contient une guillemet typographique (don’t) mais la recherche les supprime, donc on ne peut jamais obtenir une correspondance exacte pour l’un… cela signifie que les messages et la recherche ne sont pas exactement symétriques, ce qui est peut-être quelque chose qui pourrait être amélioré
c’est parce que sans les guillemets, vous ne recherchez pas une correspondance exacte, donc il repère les termes “interface”, “object”, “need”, “generics” et ce message est le meilleur match pour ces termes
J’ai trouvé très difficile de trouver les sujets que je cherchais, même avec des mots très courants. C’est un problème déjà mentionné par le passé, et il y a eu une expérience d’intégration de Typesense il y a quelques années.
Je me demande s’il existe de vrais projets d’amélioration de la fonction de recherche de Discourse ? C’est l’un des outils les plus utilisés, et je pense qu’il a besoin d’une refonte et d’un peu d’attention.
Et je me demande s’il y a une raison technique d’exclure « we » et « don’t » (don, t) de l’indexation pour la recherche. Est-ce parce qu’ils sont trop courants ?
Les mots vides sont des mots très courants, qui apparaissent dans presque tous les documents et qui n’ont aucune valeur discriminante. Par conséquent, ils peuvent être ignorés dans le contexte de la recherche en texte intégral. Par exemple, chaque texte en anglais contient des mots comme a et the, il est donc inutile de les stocker dans un index.