Skip to content
体验新版
项目
组织
正在加载...
登录
切换导航
打开侧边栏
s920243400
PaddleOCR
提交
523c7785
P
PaddleOCR
项目概览
s920243400
/
PaddleOCR
与 Fork 源项目一致
Fork自
PaddlePaddle / PaddleOCR
通知
1
Star
1
Fork
0
代码
文件
提交
分支
Tags
贡献者
分支图
Diff
Issue
0
列表
看板
标记
里程碑
合并请求
0
Wiki
0
Wiki
分析
仓库
DevOps
项目成员
Pages
P
PaddleOCR
项目概览
项目概览
详情
发布
仓库
仓库
文件
提交
分支
标签
贡献者
分支图
比较
Issue
0
Issue
0
列表
看板
标记
里程碑
合并请求
0
合并请求
0
Pages
分析
分析
仓库分析
DevOps
Wiki
0
Wiki
成员
成员
收起侧边栏
关闭侧边栏
动态
分支图
创建新Issue
提交
Issue看板
未验证
提交
523c7785
编写于
3月 22, 2021
作者:
B
Bin Lu
提交者:
GitHub
3月 22, 2021
浏览文件
操作
浏览文件
下载
电子邮件补丁
差异文件
Update FAQ.md
上级
f745eef5
变更
1
隐藏空白更改
内联
并排
Showing
1 changed file
with
23 addition
and
10 deletion
+23
-10
doc/doc_ch/FAQ.md
doc/doc_ch/FAQ.md
+23
-10
未找到文件。
doc/doc_ch/FAQ.md
浏览文件 @
523c7785
...
@@ -11,19 +11,32 @@
...
@@ -11,19 +11,32 @@
*
[
近期更新(2021.3.22)
](
#近期更新
)
*
[
近期更新(2021.3.22)
](
#近期更新
)
*
[
【精选】OCR精选10个问题
](
#OCR精选10个问题
)
*
[
【精选】OCR精选10个问题
](
#OCR精选10个问题
)
*
[
【理论篇】OCR通用
37
个问题
](
#OCR通用问题
)
*
[
【理论篇】OCR通用
40
个问题
](
#OCR通用问题
)
*
[
基础知识1
2
题
](
#基础知识
)
*
[
基础知识1
3
题
](
#基础知识
)
*
[
数据集
7
题
](
#数据集2
)
*
[
数据集
8
题
](
#数据集2
)
*
[
模型训练调优1
8
题
](
#模型训练调优2
)
*
[
模型训练调优1
9
题
](
#模型训练调优2
)
*
[
【实战篇】PaddleOCR实战14
1
个问题
](
#PaddleOCR实战问题
)
*
[
【实战篇】PaddleOCR实战14
3
个问题
](
#PaddleOCR实战问题
)
*
[
使用咨询5
2
题
](
#使用咨询
)
*
[
使用咨询5
4
题
](
#使用咨询
)
*
[
数据集18题
](
#数据集3
)
*
[
数据集18题
](
#数据集3
)
*
[
模型训练调优32题
](
#模型训练调优3
)
*
[
模型训练调优32题
](
#模型训练调优3
)
*
[
预测部署39题
](
#预测部署3
)
*
[
预测部署39题
](
#预测部署3
)
<a
name=
"近期更新"
></a>
<a
name=
"近期更新"
></a>
## 近期更新(2021.3.22)
## 近期更新(2021.3.22)
#### Q2.1.13: PaddleOCR提供的文本识别算法包括哪些?
**A**
: PaddleOCR主要提供五种文本识别算法,包括CRNN
\S
tarNet
\R
ARAE
\R
osetta和SRN, 其中CRNN
\S
tarNet和Rosetta是基于ctc的文字识别算法,RARE是基于attention的文字识别算法;SRN为百度自研的文本识别算法,引入了语义信息,显著提升了准确率。 详情可参照如下页面:https://github.com/PaddlePaddle/PaddleOCR/blob/release/2.0/doc/doc_ch/algorithm_overview.md#%E6%96%87%E6%9C%AC%E8%AF%86%E5%88%AB%E7%AE%97%E6%B3%95
#### Q2.2.8: DBNet如果想使用多边形作为输入,数据标签格式应该如何设定?
**A**
:如果想使用多边形作为DBNet的输入,数据标签也应该用多边形来表示。这样子可以更好得拟合弯曲文本。PPOCRLabel暂时只支持矩形框标注和四边形框标注。
#### Q2.3.19: 参照文档做实际项目时,是重新训练还是在官方训练的基础上进行训练?具体如何操作?
**A**
: 基于官方提供的模型,进行finetune的话,收敛会更快一些。 具体操作上,以识别模型训练为例:如果修改了字符文件,可以设置pretraind_model为官方提供的预训练模型
#### Q3.1.53: 预测时提示图像过大,显存、内存溢出了,应该如何处理?
**A**
: 可以按照这个PR的修改来缓解显存、内存占用 https://github.com/PaddlePaddle/PaddleOCR/pull/2230
#### Q3.1.54: 用c++来部署,目前支持Paddle2.0的模型吗?
**A**
: PPOCR 2.0的模型在arm上运行可以参照该PR https://github.com/PaddlePaddle/PaddleOCR/pull/1877
<a
name=
"OCR精选10个问题"
></a>
<a
name=
"OCR精选10个问题"
></a>
## 【精选】OCR精选10个问题
## 【精选】OCR精选10个问题
...
@@ -576,13 +589,13 @@ repo中config.yml文件的前后处理参数和inference预测默认的超参数
...
@@ -576,13 +589,13 @@ repo中config.yml文件的前后处理参数和inference预测默认的超参数
-
如果没有其他需要,可以在解码数据的时候指定模式为三通道,例如如果使用opencv,可以使用cv::imread(img_path, cv::IMREAD_COLOR)。
-
如果没有其他需要,可以在解码数据的时候指定模式为三通道,例如如果使用opencv,可以使用cv::imread(img_path, cv::IMREAD_COLOR)。
-
如果其他模块需要处理四通道的图像,那也可以在输入PaddleOCR模块之前进行转换,例如使用cvCvtColor(&img,img3chan,CV_RGBA2RGB)。
-
如果其他模块需要处理四通道的图像,那也可以在输入PaddleOCR模块之前进行转换,例如使用cvCvtColor(&img,img3chan,CV_RGBA2RGB)。
<a
name=
"数据集3"
></a>
#### Q3.1.53: 预测时提示图像过大,显存、内存溢出了,应该如何处理?
#### Q3.1.53: 预测时提示图像过大,显存、内存溢出了,应该如何处理?
**A**
: 可以按照这个PR的修改来缓解显存、内存占用 https://github.com/PaddlePaddle/PaddleOCR/pull/2230
**A**
: 可以按照这个PR的修改来缓解显存、内存占用 https://github.com/PaddlePaddle/PaddleOCR/pull/2230
#### Q3.1.54: 用c++来部署,目前支持Paddle2.0的模型吗?
#### Q3.1.54: 用c++来部署,目前支持Paddle2.0的模型吗?
**A**
: PPOCR 2.0的模型在arm上运行可以参照该PR, https://github.com/PaddlePaddle/PaddleOCR/pull/1877
**A**
: PPOCR 2.0的模型在arm上运行可以参照该PR https://github.com/PaddlePaddle/PaddleOCR/pull/1877
<a
name=
"数据集3"
></a>
### 数据集
### 数据集
...
...
编辑
预览
Markdown
is supported
0%
请重试
或
添加新附件
.
添加附件
取消
You are about to add
0
people
to the discussion. Proceed with caution.
先完成此消息的编辑!
取消
想要评论请
注册
或
登录