Вопрос по sphinx. Почему like на ходит больше записей в базе чем sphinx по одному и тому же слову?
Пример есть две строки для поиска
- 6406 Pz.Kpfw.VI Ausf.E Tiger I Late Production
- 6800 Танк Wittmann'sLast Tiger
слово для поиска Tiger. Первую запись sphinx находит вторую нет, like находит обе. По другим словам например 6800 или Wittmann или st Tiger, вторая запись находится. Но это еще не все, если в первую запись добавить в любое место еще одно слово Tiger то sphinx начинает находить и первую запись.
символы в обеих строках одинаковые проверял через md5 файл конфигурации
source src1
{
type = mysql
sql_host = localhost
sql_user = user_name
sql_pass = *************
sql_db = links
sql_port = 3306
#sql_query_pre = SET NAMES utf8
sql_query_pre = SET CHARACTER SET utf8
sql_query_pre = SET NAMES utf8
#sql_query = SELECT * FROM links
sql_query = SELECT l.idlinks,l.title as title, l.search_string as search_string, l.brand as brand, ul.text_request as text_request, art FROM links l LEFT JOIN users_request ul ON ul.url = l.url;
sql_field_string = title
sql_field_string = brand
sql_field_string = art
sql_field_string = search_string
sql_field_string = text_request
}
index test
{
source = src1
morphology = stem_en, stem_ru
path = /var/lib/sphinx/test
docinfo = extern
#charset_type = utf-8
wordforms = /var/python_script/wordforms.txt
stopwords = /var/python_script/stopwords.txt
charset_table = 0..9, A..Z->a..z, _, -, a..z, U+410..U+42F->U+430..U+44F, U+430..U+44F, U+401->U+451,
U+451, U+2D ,' ,/ ,&,U+2E, U+2C, U+0022, U+00C1->a,U+00C2->a,U+00C3->a,\ ... очень длинная портянка
dict = keywords
index_exact_words = 1
min_word_len = 2
min_infix_len = 2
#min_prefix_len = 5
expand_keywords = 1
#enable_star = 1
html_strip = 1
}
searchd
{
listen = 127.0.0.1:9312
listen = 9306:mysql41
log = /var/log/sphinx/searchd.log
query_log = /var/log/sphinx/query.log
read_timeout = 5
max_children = 30
pid_file = /var/run/sphinx/searchd.pid
seamless_rotate = 1
preopen_indexes = 1
unlink_old = 1
binlog_path = /var/lib/sphinx/
}