gpt-5.6-luna 降价以后就想把它接到 Hermes 里玩玩,最近在同学开的一家辅导机构里打工,于是交给他的第一个任务就是从几份 PDF 资料里帮我拼一份讲义。结果惨不忍睹,他第一反应是切下题目直接拼到一起,我教他用 mineru 识别,用 Typst 或 LaTeX 制作PDF,但图文排版崩的没眼看,套模板也不行。
于是我就做了个新的物理讲义模板,重点是实现了图文自动混排,效果如下图:
加入文本和图片后能自动决定图片大小和排版方式,不会让ai弄出一张图占一页的奇葩布局了。
模板还有不少小问题,看上去感觉不是很舒服,但我不懂这一块有点不知道从哪个方向修。链接在下面,欢迎各位试用并指正。
(PS: Hermes里的agent拉完了,让他读完markdown自己写Typst,他写完还是LaTeX语法然后又写了个python脚本自动转换,结果还是一坨。示例文件是pi里的gpt-5.6-luna生成的,effort开的是high
(PPS: mineru的公式识别有不少问题,小块行内公式很容易漏。示例里的公式有不少是ai自己读图片修正的。现在正准备测一下哪一种OCR方案效果最好
