历史版本。 PostgreSQL 8.4 已结束支持。 请参阅 当前版本手册.
F.34. test_parser #
test_parser是一个全文检索自定义解析器的示例。它并不做任何特别有用的事情,但可以作为开发你自己的解析器的起点。
test_parser识别由空白分隔的单词,并且只返回两种词元类型:
mydb=# SELECT * FROM ts_token_type('testparser');
tokid | alias | description
-------+-------+---------------
3 | word | Word
12 | blank | Space symbols
(2 rows)
这些词元编号是特意选择为与默认解析器的编号兼容的。这使我们可以使用它的headline()函数,从而让示例保持简单。
F.34.1. 用法
运行安装脚本会创建一个文本搜索解析器 testparser。它没有可供用户配置的参数。
你可以用如下方式测试这个解析器:
mydb=# SELECT * FROM ts_parse('testparser', 'That''s my first own parser');
tokid | token
-------+--------
3 | That's
12 |
3 | my
12 |
3 | first
12 |
3 | own
12 |
3 | parser
实际使用时需要建立一个使用该解析器的文本搜索配置。例如:
mydb=# CREATE TEXT SEARCH CONFIGURATION testcfg ( PARSER = testparser );
CREATE TEXT SEARCH CONFIGURATION
mydb=# ALTER TEXT SEARCH CONFIGURATION testcfg
mydb-# ADD MAPPING FOR word WITH english_stem;
ALTER TEXT SEARCH CONFIGURATION
mydb=# SELECT to_tsvector('testcfg', 'That''s my first own parser');
to_tsvector
-------------------------------
'that':1 'first':3 'parser':5
(1 row)
mydb=# SELECT ts_headline('testcfg', 'Supernovae stars are the brightest phenomena in galaxies',
mydb(# to_tsquery('testcfg', 'star'));
ts_headline
-----------------------------------------------------------------
Supernovae <b>stars</b> are the brightest phenomena in galaxies
(1 row)