Intento seleccionar solo lexemas de la columna ts_vector no anidada:
select lexeme from (select unnest(to_tsvector('russian', description)) from cards) as roots; Pero no funciona, porque SQL no sabe nada sobre la columna de lexeme . ¿Cómo puedo seleccionar solo lexemas de ts_vectors no anidados?
Encontré una forma lacónica de hacerlo:
SELECT (unnest(to_tsvector(description))).lexeme FROM cardsLo que te encontraste:
SELECT (unnest(to_tsvector(description))).lexeme FROM cards; El formulario SQL estándar equivalente con la función de devolución de conjuntos en la lista FROM es un poco más detallado, pero más fácil de integrar en consultas más grandes:
SELECT d.lexeme FROM cards c LEFT JOIN LATERAL unnest(to_tsvector(c.description))) d;Relacionada:
Desde Postgres 9.6 hay una segunda variante "sobrecargada" de unnest() . Citando las notas de la versión :
Agregar nuevas funciones para datos
tsvector(Stas Kelvich)Las nuevas funciones son
ts_delete(),ts_filter(),unnest(),tsvector_to_array(),array_to_tsvector()y una variante desetweight()que establece el peso solo para lexemas específicos.
Énfasis en negrita mío.
Ver:
SELECT proname, proargtypes::regtype[], prorettype::regtype FROM pg_proc where proname = 'unnest'; proname | proargtypes | prorettype --------+------------------+----------- unnest | [0:0]={anyarray} | anyelement unnest | [0:0]={tsvector} | record (2 rows)db<>violín aquí
La función está documentada en el manual entre las funciones de búsqueda de texto :
unnest(tsvector, OUT lexeme text, OUT positions smallint[], OUT weights text) Devuelve un conjunto de setof record con columnas de salida con nombre. Por lo tanto, podemos referirnos al lexeme de columna directamente como lo hicimos.