字典序第k小子串-SAM入门

给一个长度不超过90000的串S,每次询问它的所有不同子串中,字典序第K小的,询问不超过500个。

很经典的题目了,简单的来说就是1,建SAM,2,dfs求每个串包含了多少串,3,从SAM的头往后面找,每次从’a’找到’z’,一但找到哪个包含的串数比k多,那么就判定当前找的字母属于我们找的子串。(因为是从a开始的)。否则,k比一个串所包含的串总数还大,就减去这个字母代表的串数。

//
// Created by acer on 2021/2/16.
//
//判断子串,不同子串个数,所有子串字典序第i大,最长公共子串

#include <cstring>
#include <iostream>
#include "string"


#define mem(x, i) memset(x,i,sizeof(x))
using namespace std;
const int MAXN = 3e5 + 10;

int len[MAXN << 1];
int ch[MAXN << 1][27];
int fa[MAXN << 1];
int last = 1;
int tot = 1;
int p;

void add(int c) {
    p = last;
    last = ++tot;
    int np = last;
    len[np] = len[p] + 1;
    for (; p && !(ch[p][c]); p = fa[p]) ch[p][c] = np;
    if (!p) fa[np] = 1;
    else {
        int q = ch[p][c];
        if (len[q] == len[p] + 1) fa[np] = q;
        else {
            int nq = ++tot;
            memcpy(ch[nq],ch[q],sizeof(ch[nq]));
            fa[nq] = fa[q];
            len[nq] = len[p] + 1;
            fa[np] = fa[q] = nq;
            for (; p && ch[p][c] == q; p = fa[p]) {
                ch[p][c] = nq;
            }
        }

    }

}

char s[MAXN], s1[MAXN];

int solve() {
    int len1 = strlen(s1 + 1);
    int ans =0 ; int tmp = 0;
    for (int i = 1; i <= len1; ++i) {

        int c = s1[i] - 'a';
        if (ch[p][c]) p = ch[p][c], tmp++;
        else {
            while (p && !(ch[p][c]))
                p = fa[p];
            if (!p) p = 1, tmp = 0;
            else {
                tmp = len[p] + 1;
                p = ch[p][c];
            }
        }
        ans = max(ans,tmp);
    }
    return ans;
}
int count[MAXN<<1];
void dfs(int k) 
{
    if (count[k]) return;
    count[k] = 1;
    for (int i = 0; i <= 26; ++i) {          //此处是实现算法的关键,通过从a遍历到z来计算字典序
        if (!ch[k][i]) continue;
        dfs(ch[k][i]);
        count[k]+=count[ch[k][i]];       //很明显,count的意义就是节点k的串总数,k所代表的也是一个字母
    }
}
int main() {
    scanf("%s", s + 1);
    int l = strlen(s + 1);
    for (int i = 1; i <= l; ++i) {
        add(s[i] - 'a');
    }
    int T;
    dfs(1);
    scanf("%d",&T);
    while (T--){
        int k;
        int now = 1;
        scanf("%d",&k);
        while (k)
        {
            if (!k) break;
            for (int i = 0; i <= 26; ++i) {
                if (ch[now][i]) {
                    if (count[ch[now][i]] >= k) {     //因为不能往前找,所以找到的第一个大于k的就肯定是属于答案的子串中
                        putchar(i+'a');
                        --k;
                        now = ch[now][i];
                        break;
                    } else
                        k-=count[ch[now][i]];       //这个字母包含的不够多
                }
            }

        }puts("");
    }
}

版权声明:本文为weixin_45509601原创文章,遵循CC 4.0 BY-SA版权协议,转载请附上原文出处链接和本声明。