1. 程式人生 > >spoj687字尾陣列-5

spoj687字尾陣列-5

http://www.spoj.pl/problems/REPEATS/
題意:給你一個串,求這個串中所有連續重複子串重複的最大次數。。如cababab,為3。。。

分析:
這題純粹看的羅大牛的論文的,還沒怎麼看懂,還百度了報告。。我是想不到方法了。。
只考慮重複次數>=2的情況,列舉連續重複子串的重複那部分的長度,對長度為L時,則[0, L-1] , [L, 2*L-1] , [2*L, 3*L-1].....匹配的開始位置一定在其中的相鄰兩個區間中,所以按照常理我們需要對所有的組合情況進行考慮,但是實際上我們只需要對i=L*k 時,求lcp(i, i-L) 這兩個字尾考慮,然後得到能往後延伸的lcp為h,然後再考慮一下j=i-(L-tmp%L)這個位置的lcp(j, j-L)這個位置。。。
以前也木有這個概念,原來O(n/1+n/2+n/3+...+n/n) = O(nlogn)

詳情見http://hi.baidu.com/fhnstephen/blog/item/870da9ee3651404379f0555f.html

程式碼:

#include<stdio.h>
#include<string.h>

#define maxn 50011
int wa[maxn],wb[maxn],wv[maxn],ws[maxn];
int cmp(int *r,int a,int b,int l)
{
	return r[a]==r[b]&&r[a+l]==r[b+l];
}
void da(int *r,int *sa,int n,int m)
{
     int i,j,p,*x=wa,*y=wb,*t;
     for(i=0;i<m;i++) ws[i]=0;
     for(i=0;i<n;i++) ws[x[i]=r[i]]++;
     for(i=1;i<m;i++) ws[i]+=ws[i-1];
     for(i=n-1;i>=0;i--) sa[--ws[x[i]]]=i;
     for(j=1,p=1;p<n;j*=2,m=p)
     {
       for(p=0,i=n-j;i<n;i++) y[p++]=i;
       for(i=0;i<n;i++) if(sa[i]>=j) y[p++]=sa[i]-j;
       for(i=0;i<n;i++) wv[i]=x[y[i]];
       for(i=0;i<m;i++) ws[i]=0;
       for(i=0;i<n;i++) ws[wv[i]]++;
       for(i=1;i<m;i++) ws[i]+=ws[i-1];
       for(i=n-1;i>=0;i--) sa[--ws[wv[i]]]=y[i];
       for(t=x,x=y,y=t,p=1,x[sa[0]]=0,i=1;i<n;i++)
       x[sa[i]]=cmp(y,sa[i-1],sa[i],j)?p-1:p++;
     }
     return;
}
int rank[maxn],height[maxn];
void calheight(int *r,int *sa,int n)
{
     int i,j,k=0;
     for(i=1;i<=n;i++) rank[sa[i]]=i;
     for(i=0;i<n;height[rank[i++]]=k)
     for(k?k--:0,j=sa[rank[i]-1];r[i+k]==r[j+k];k++);
     return;
}

int RMQ[maxn];
int mm[maxn];
int best[20][maxn];
void initRMQ(int n)
{
     int i,j,a,b;
     for(mm[0]=-1,i=1;i<=n;i++)
     mm[i]=((i&(i-1))==0)?mm[i-1]+1:mm[i-1];
     for(i=1;i<=n;i++) best[0][i]=i;
     for(i=1;i<=mm[n];i++)
     for(j=1;j<=n+1-(1<<i);j++)
     {
       a=best[i-1][j];
       b=best[i-1][j+(1<<(i-1))];
       if(RMQ[a]<RMQ[b]) best[i][j]=a;
       else best[i][j]=b;
     }
     return;
}
int askRMQ(int a,int b)
{
    int t;
    t=mm[b-a+1];b-=(1<<t)-1;
    a=best[t][a];b=best[t][b];
    return RMQ[a]<RMQ[b]?a:b;
}
int lcp(int a,int b)
{
    int t;
    a=rank[a];b=rank[b];
    if(a>b) {t=a;a=b;b=t;}
    return(height[askRMQ(a+1,b)]);
}
int n, a[maxn], sa[maxn], ans;
char s[maxn], s1[3];

void cal()
{
	int i, j, k, tmp;
	ans = 1;
	for(k=1; k<=n; k++) //迴圈長度。。
	{
		for(i=k; i<n; i+=k)
		{
			tmp = lcp(i, i-k);
			if(tmp/k+1>ans)
				ans = tmp/k+1;
			j = i-(k-tmp%k);
			if(j-k>=0)
			{
				tmp = lcp(j, j-k);
				if(tmp/k+1>ans)
					ans = tmp/k+1;
			}
		}
	}
}

int main()
{
	int i, cas;
	scanf("%d", &cas);
	while(cas--)
	{
		scanf("%d", &n);
		for(i=0; i<n; i++)
		{
			scanf("%s", s1);
			a[i] = s1[0]-'a'+1;
		}
		a[n] = 0;
		
		da(a, sa, n+1, 4);
		calheight(a, sa, n);
		for(i=0; i<=n; i++)
			RMQ[i] = height[i];
		initRMQ(n);
		cal();
		printf("%d\n", ans);
	}

	return 0;
}