Hice un proyecto simple para probar free text search usando Spring Data Elasticsearch. Aquí está mi entidad:
@Document(indexName = "flag", type = "flag") public class Flag { @Id private String flagCode; @MultiField(mainField = @Field(type = FieldType.String)) private String flagName; // setters and getters }Ahora, mi operación de búsqueda se ve así:
SearchQuery searchQuery = new NativeSearchQueryBuilder() .withQuery(fuzzyQuery("flagName", freeText)) .build(); List<Flag> flags = elasticsearchTemplate.queryForList(searchQuery, Flag.class); Con esto, solo obtengo objetos cuyo flagName coincide exactamente con flagName donde quiero que si al menos 2 caracteres coinciden, debería ser una coincidencia .
Si es relevante, mi archivo DataConfig se ve así:
@Configuration @EnableElasticsearchRepositories(basePackages = "com.shubham.dao") @ComponentScan(basePackages = "com.shubham.data") public class DataConfig { @Value("${elasticsearch.clustername}") private String clusterName; @Value("${elasticsearch.host}") private String elasticsearchHost; @Value("${elasticsearch.port}") private int elasticsearchPort; @Bean public Client client() throws Exception { Settings esSettings = Settings.settingsBuilder() .put("cluster.name", clusterName) .build(); //https://www.elastic.co/guide/en/elasticsearch/guide/current/_transport_client_versus_node_client.html return TransportClient.builder() .settings(esSettings) .build() .addTransportAddress( new InetSocketTransportAddress(InetAddress.getByName(elasticsearchHost), elasticsearchPort)); } @Bean public ElasticsearchOperations elasticsearchTemplate() throws Exception { return new ElasticsearchTemplate(client()); } }¿Qué estoy haciendo posiblemente mal? Soy novato en Elasticsearch.
De forma predeterminada, la consulta fuzzy tiene una configuración de borrosidad de AUTO , lo que significa que
En su caso, cuando indexe India , se indexará el token india (en minúsculas).
In implica 4 ediciones => ninguna coincidenciaInd implica 3 ediciones => ninguna coincidenciaIndi implica 2 ediciones => ninguna coincidenciaIndia implica 1 edición => coincidenciaProbablemente necesite usar edge-ngram para tokenizar sus datos en lugar de usar fuzziness, que no es adecuado para buscar prefijos como parece estar dispuesto a hacer.