图片转LaTeX:截图识别公式的做法与校对要点

图片转LaTeX 指的是把一张含公式的图片,通过公式识别转成可编辑的 LaTeX 源码。它解决的是一类很具体的麻烦:手头只有 PDF 截图或拍照,却要把公式重新录进自己的文档。

什么情况下值得用

  • 从 PDF 论文里摘一条公式到自己的稿子中
  • 把纸质教材、板书照片里的公式录入
  • 接手别人给的图片版讲义,要改其中的公式

如果公式本来就有源码(比如对方能给你 .tex 文件),直接拿源码永远比识别再校对省事。识别是在「拿不到源码」时才划算。

影响识别结果的三件事

清晰度。截图时尽量按原始分辨率截,不要先缩小再放大。糊掉的下标是识别错误的主要来源。

倾斜与背景。拍照时保持正对,避免阴影和反光。带底纹、水印的扫描件识别难度明显更高。

排版复杂度。单行公式最稳。多行对齐的方程组、大矩阵、带注释的推导,识别之后往往需要手工调整结构。

🔴 拿到结果之后必须校对的三处

识别结果不要直接用。按这三处过一遍,能挡掉绝大部分错误:

一、上下标层级。这是最高发的一处。x^{10} 被识别成 x^10 时,渲染出来是 x¹0——只有 1 上了标。凡是多字符的上下标,都要确认花括号在不在:

x^{10}        a_{i+1}        e^{-x^2}

二、括号配对与大小。多层嵌套时容易漏一个右括号。另外 (\left( 的区别在于后者会跟着内容自动变高:

\left( \frac{a}{b} \right)

三、易混字符。这几组在低分辨率下经常互换,逐个确认比事后排查省事:

容易被认错的 实际可能是
l(小写 L) 1(数字一)、I(大写 i)
0(零) O(大写 o)、\circ
\times x(字母 x)
\cdot .(句点)

校对完之后放到哪里

校对好的 LaTeX 可以直接用在 LaTeX 文档里。如果目标是 Word,先转成 Word 能识别的公式格式再粘贴,这样贴过去仍然是可编辑的公式对象,之后还能改;直接贴图片的话,下次要改就得从头再来一遍。

想试试整条链路,可以拿一张论文截图走一遍「识别 → 校对 → 导出」,看看在你自己的素材上识别率如何。

一个实际的工作习惯

批量处理时,建议识别一条就校对一条,不要攒到最后统一改。攒着改的问题在于:等你回头看第 20 条时,已经不记得原图长什么样了,只能再翻回去对照,反而更慢。

常见问题

图片转 LaTeX 的识别率取决于什么?
主要看清晰度和排版。截图分辨率足够、公式不倾斜、背景干净时结果最稳。手写体和带水印的扫描件识别难度明显更高。
识别出来的 LaTeX 可以直接用吗?
建议先校对再用。上下标层级、括号配对和易混字符是三处高发出错点,改动成本远低于事后在成稿里找错。
识别结果能直接放进 Word 吗?
可以先把 LaTeX 转成 Word 能识别的公式格式再粘贴,这样贴过去仍是可编辑公式,而不是一张图片。