UVA 11019 Matrix Matcher ( 二维字符串匹配, AC自动机 || 二维Hash )
题目: 传送门
题意: 给你一个 n * m 的文本串 T, 再给你一个 r * c 的模式串 S;
问模式串 S 在文本串 T 中出现了多少次。
解:
法一: AC自动机 (正解) 670ms
把模式串的每一行当成一个字符串, 建一个AC自动机。
然后设cnt[ x ][ y ] 表示文本串中,以 (x, y) 这个点为矩阵右上角的点,且矩阵大小为 r * c的矩阵与模式串匹配了多少行。
那最终统计答案的时候, 只需要 o(n * m) 枚举所有点,记录那些 cnt[ x ][ y ] == n 的点 的个数。 就是答案。
那我们建完AC自动机后, 就可以枚举文本串的每一行,让其去跑 建成的AC自动机, 记录匹配情况即可。
文本串的第 x 行和 模式串的 第 i 行匹配, 则, cnt[ x - i + 1][ y ] ++;
我的代码里有一个 nx[ ] 数组, 这个数组的作用是。
若模式串中, 存在多行字符是完全相等的情况, 则你文本串和当前字符串匹配,可能有多种情况。
比如,你模式串的第3行和第5行是完全相等的, 那么, 你要是文本串匹配到了模式串的第3行,那么你也同样匹配到了第5行。
所以,增加nx[]数组来存,同一字符串的不同编号。
#include <bits/stdc++.h>
#define LL long long
#define rep(i, j, k) for(int i = j; i <= k; i++)
#define dep(i, j, k) for(int i = k; i >= j; i--)
#define mem(i, j) memset(i, j, sizeof(i))
using namespace std; const int N = 1e3 + , M = 1e4 + ; struct Trie {
int ch[M][], val[M], Fail[M], tot, nx[M], last[M], cnt[N][N];
void init() {
mem(ch[], ); val[] = ; tot = ; last[] = ; mem(cnt, ); mem(nx, );
}
int get(char Q) {
return Q - 'a';
}
void join(char s[], int pos) {
int now = ; int len = strlen(s);
rep(i, , len - ) {
int id = get(s[i]);
if(!ch[now][id]) {
mem(ch[tot], ); val[tot] = ; last[tot] = ;
ch[now][id] = tot++;
}
now = ch[now][id];
}
nx[pos] = val[now];
val[now] = pos;
}
void getFail() {
queue<int> Q; while(!Q.empty()) Q.pop();
rep(i, , ) {
if(ch[][i]) {
Q.push(ch[][i]);
Fail[ch[][i]] = ;
last[ch[][i]] = ;
}
}
while(!Q.empty()) {
int now = Q.front(); Q.pop();
rep(i, , ) {
int u = ch[now][i];
if(!ch[now][i]) ch[now][i] = ch[Fail[now]][i];
else {
Q.push(ch[now][i]);
Fail[u] = ch[Fail[now]][i];
last[u] = val[Fail[u]] ? Fail[u] : last[Fail[u]];
}
}
}
}
void add_ans(int x, int y, int u) {
if(u) {
if(x - val[u] + >= ) {
cnt[x - val[u] + ][y]++;
}
int tmp = val[u];
while(nx[tmp]) {
tmp = nx[tmp];
if(x - tmp + >= ) cnt[x - tmp + ][y]++;
}
add_ans(x, y, last[u]);
}
}
void print(char s[], int x) {
int len = strlen(s + ); int now = ;
rep(i, , len) {
int id = get(s[i]);
now = ch[now][id]; if(val[now]) {
add_ans(x, i, now);
}
else if(last[now]) {
add_ans(x, i, last[now]);
}
}
}
};
Trie AC;
char s[][], ss[];
int main() {
int _; scanf("%d", &_);
while(_--) {
AC.init();
int n, m; scanf("%d %d", &n, &m);
rep(i, , n) scanf("%s", s[i] + );
int r, c; scanf("%d %d", &r, &c);
rep(i, , r) {
scanf("%s", ss); AC.join(ss, i);
}
AC.getFail(); ///建AC自动机
rep(i, , n) { /// 对文本串每一行跑AC自动机,记录匹配情况
AC.print(s[i], i);
}
int ans = ;
rep(i, , n) rep(j, , m) {
if(AC.cnt[i][j] == r) ans++;
}
printf("%d\n", ans);
}
return ;
}
法二: 二维Hash 40ms
参考: 博客
#include <bits/stdc++.h>
#define LL long long
#define ULL unsigned long long
#define rep(i, j, k) for(int i = j; i <= k; i++)
#define dep(i, j, k) for(int i = k; i >= j; i--)
#define mem(i, j) memset(i, j, sizeof(i))
using namespace std;
const int N = 1e3 + ;
const unsigned int hash1 = 1e9 + , hash2 = 1e9 + ;
char a[N][N], b[][];
unsigned int p1[N], p2[N];
unsigned int hs[N][N];
void init() {
p1[] = ; p2[] = ;
rep(i, , N - ) p1[i] = p1[i - ] * hash1, p2[i] = p2[i - ]* hash2;
}
int main() {
int _; scanf("%d", &_); init();
while(_--) {
int n, m; scanf("%d %d", &n, &m);
rep(i, , n) scanf("%s", a[i] + );
int x, y; scanf("%d %d", &x, &y);
rep(i, , x) scanf("%s", b[i] + );
rep(i, , n) rep(j, , m) { /// 预处理n * m矩阵的二维前缀和。(三个方向的前缀和,)
hs[i][j] = hs[i - ][j - ] * hash1 * hash2 + (hs[i - ][j] - hs[i - ][j - ] * hash2) * hash1 + (hs[i][j - ] - hs[i - ][j - ] * hash1) * hash2 + a[i][j];
}
unsigned int S = , C;
rep(i, , x) rep(j, , y) { ///算模式串的hash值
S += b[i][j] * p1[x - i] * p2[y - j];
}
int ans = ;
rep(i, x, n) rep(j, y, m) { ///枚举文本串所有x*y矩阵,o(1)算出它们的hash值
C = hs[i][j] - hs[i - x][j - y] * p1[x] * p2[y] - (hs[i][j - y] - hs[i - x][j - y] * p1[x]) * p2[y] - (hs[i - x][j] - hs[i - x][j - y] * p2[y]) * p1[x];
if(S == C) ans++;
}
printf("%d\n", ans);
}
return ;
}
UVA 11019 Matrix Matcher ( 二维字符串匹配, AC自动机 || 二维Hash )的更多相关文章
- UVA 11019 Matrix Matcher 矩阵匹配器 AC自动机 二维文本串查找二维模式串
链接:https://vjudge.net/problem/UVA-11019lrjP218 matrix matcher #include<bits/stdc++.h> using na ...
- UVA - 11019 Matrix Matcher (二维字符串哈希)
给你一个n*m的矩阵,和一个x*y的模式矩阵,求模式矩阵在原矩阵中的出现次数. 看上去是kmp在二维情况下的版本,但单纯的kmp已经无法做到了,所以考虑字符串哈希. 类比一维情况下的哈希算法,利用容斥 ...
- UVa 11019 Matrix Matcher - Hash
题目传送门 快速的vjudge传送门 快速的UVa传送门 题目大意 给定两个矩阵S和T,问T在S中出现了多少次. 不会AC自动机做法. 考虑一维的字符串Hash怎么做. 对于一个长度为$l$的字符串$ ...
- uva 11019 Matrix Matcher
题意:给出一个n*m的字符矩阵T,你的任务是找出给定的x*y的字符矩阵P在T中出现了多少次. 思路:要想整个矩阵匹配,至少各行都得匹配.所以先把P的每行看做一个模式串构造出AC自动机,然后在T中的各行 ...
- UVA 11019 Matrix Matcher(ac自动机)
题目链接:http://uva.onlinejudge.org/index.php?option=com_onlinejudge&Itemid=8&page=show_problem& ...
- UVA 11019 Matrix Matcher(二维hash + 尺取)题解
题意:在n*m方格中找有几个x*y矩阵. 思路:二维hash,总体思路和一维差不太多,先把每行hash,变成一维的数组,再对这个一维数组hash变成二维hash.之前还在想怎么快速把一个矩阵的hash ...
- AC自动机(二维) UVA 11019 Matrix Matcher
题目传送门 题意:训练指南P218 分析:一行一行的插入,一行一行的匹配,当匹配成功时将对应子矩阵的左上角位置cnt[r][c]++;然后统计 cnt[r][c] == x 的数量 #include ...
- UVA 11019 Matrix Matcher(哈希)
题意 给定一个 \(n\times m\) 的矩阵,在给定一个 \(x\times y\) 的小矩阵,求小矩阵在大矩阵中出现的次数. \(1 \leq n,m \leq 1000\) \(1\leq ...
- UVA - 11019 Matrix Matcher hash+KMP
题目链接:传送门 题解: 枚举每一行,每一行当中连续的y个我们hash 出来 那么一行就是 m - y + 1个hash值,形成的一个新 矩阵 大小是 n*(m - y + 1), 我们要找到x*y这 ...
随机推荐
- xorm实例-创建xorm,映射
创建xorm引擎 //在xorm里面,可以同时存在多个Orm引擎,一个Orm引擎称为Engine, //一个Engine一般只对应一个数据库. //Engine通过调用`xorm.NewEngine` ...
- 基于CentOS6.5的Dubbo及Zookeeper配置
基于CentOS的Dubbo及Zookeeper配置 需要提前准备好的资料: 1.首先配置java环境 步骤: 将jdk的包上传至centos服务器的/opt目录下,并且解压 tar -zxvf jd ...
- Linux 系统中如何进入退出 vim 编辑器
在 Linux 中,vim 编辑器是系统自带的文本编辑器,但要修改某个文本文件,可不是像 Windows 那样操作,更有新手,进入 vi 编辑器后,无法退出以致于强制关机,其实,这个vim(vi)也是 ...
- C#精粹--协变和逆变
概念 协变和逆变来源于类型和类型之间的绑定,C#4.0开始在泛型的接口和委托上支持协变和逆变,不过在这个版本之前的委托也是支持协变和逆变的.比如数组就支持协变,但是这不是一个好的特性,这C#初期版本从 ...
- JSON C# Class Generator
http://www.xamasoft.com/json-class-generator/ JsonHelper.cs using System; using System.Collections.G ...
- oracle 查询 10题
说明:表数据来自oracle 初始用户之一scott里面的三个初始表:emp,dept,salgrade --1.查询员工表中工资最高的雇员的员工号.员工姓名.工资和部门号. select empno ...
- 【CH1809】匹配统计(KMP)
题目链接 摘自https://www.cnblogs.com/wyboooo/p/9829517.html 用KMP先求出以a[i]为结尾的前缀与b匹配的最长长度. 比如 f[i] = j,就表示a[ ...
- 怎么让自己的本地php网站让别人访问到
怎么样才能把本地的web网站项目让别人访问到呢?我来给分享一下. 第一:下载jnat工具: 第二:注册一个key; 第三:jnat工具初始化(一键注册本地的Apache+PHP环境): 第四:在jna ...
- 原子性atomic/nonatomic
原子性:并发编程中确保其操作具备整体性,系统其它部分无法观察到中间步骤,只能看到操作前后的结果. 决定编译器生成的getter和setter是否原子(natomic)操作. i 因此,atomic ...
- Hybris做增强的两种方式:In App Extension和Side by Side Extension
传统的扩展方式,即In-App增强方式,Hybris开发顾问通过Extensions的方式进行二次开发,生成的Custom Extensions同Hybris标准的Extensions一起参加构建,构 ...