本页目录
哪些图由代码排版,哪些由生图模型画出?
Vizcept 有两条出图流程。你的图走哪一条,决定了你需要核对什么。
| 图的类型 | 怎么画出来 | 可以放心的部分 | 仍需核对的部分 |
|---|---|---|---|
| 句法树 | 语言模型分析句子;代码负责布局和排版 | 词和标签用字体排出,与分析结果写的一致,每个标签各占其位;SVG 保留可编辑的真实文字 | 分析本身:成分划分、标签是否符合你课程采用的句法框架、词是否与你的句子一致 |
| 句子图解 | 同上:先由语言模型分析,再由代码按 Reed–Kellogg 格式布局 | 同上;另有基于真实句子的测试,检查每个词都画了出来、任意两段文字都不重叠 | 同上 |
| 研究框架 | 语言模型从你的描述里读出构念和它们之间的路径;代码负责摆方框、画箭头 | 构念名按分析结果用字体排出,每个假设编号只落在一条箭头上,中介在路径上、调节指向路径 | 分析本身:谁是中介、每条箭头的方向、构念名是否与你的章节一致 |
| 其他所有类型,包括 PRISMA 流程图 | 生图模型根据你的描述画出整张图 | 每种图的版式惯例都已写进给模型的指令 | 每个标签、每条箭头、每个数字 |
如果你上传的是草图或照片、文字里有字体排不出的字符(中文、日文、韩文都在其中),或者分析失败,这三种代码排版的图都会改由生图模型绘制。这些图需要和其他生图模型画的图一样完整核对。每个工具页都写明了它走哪条流程。
代码排版这条流程怎么运作?
- 分析:语言模型读取你的句子,只返回句子的结构——句法树是带标签的括号串,句子图解是 Reed–Kellogg 结构。这一步不画任何东西。
- 检查:画图之前,代码先校验结构:括号必须配对,每个节点都要有标签,每个字符都必须是字体里有的。任何一项不通过,就重新分析,或交给第二个模型分析。
- 排版:代码确定每个节点和每条线的位置,再用 Tinos(一款兼容 Times 的字体)排出文字。PNG 由矢量轮廓渲染而成;下载的 SVG 保留可以编辑的真实文字。
- 兜底:草图和照片、含有字体排不出的字符(比如中文、日文或韩文)的句子,以及分析失败的请求,都会转给生图模型。你仍然能拿到一张图,只是慢一些,而且需要按下文的方法完整核对。如果你的输入里根本没有句子,请求会失败,不扣积分。
由代码画图时,不会拼错词,也不会把标签画糊。它只能照着分析结果画——所以真正要仔细读的,是分析。
自动化测试检查什么?
排版代码的任何改动,都要先通过一套测试才能上线。
- 句子图解:测试用例包括一组手写的句型,以及 16 条真实句子的分析结果;分析里的每个词都必须出现在图中,任意两段文字都不得重叠。重叠按字形的实际轮廓测量,而不是估算。
- 句法树:括号串必须能解析,词语保持原有顺序,挂在各自的范畴节点下;括号不配对或为空的一律拒绝;每个语迹(移位痕迹)都会生成一条移位箭头,没有语迹就没有箭头。
- 字体:字体画不出的字符,例如中文、日文和韩文,会在画图前被检测出来,这些请求改走生图模型,而不是印出一个个空方框。
测试不检查的,是分析在语言学上是否符合你采用的句法框架。那部分是模型的判断,请像读同学的答案那样去读它。
代码排版的工具目前还做不到什么?
- 从右向左书写的语言:希伯来语和阿拉伯语的句子还不能从右向左排版,词序可能会反过来。不要把它们用在要发表的树图上。
- 中文、日文和韩文:这些请求会交给生图模型,因为排版用的字体不包含这些字符。请核对图中的字。
- LaTeX 导出:还没有 qtree 或 forest 格式的导出。请改为下载 SVG 或 PNG。
- 有争议的分析:在各句法框架意见不一的地方,比如省略位置、扰序(scrambling)、小句(small clause),模型只会选其中一种分析。请告诉它你的课程采用哪一种。
生图模型画的图常出什么错,怎么核对?
生图模型是把文字当作像素画出来的。它会犯人不会犯的错,而且反复出现的总是那几种:
- 拼错或编造的词,长的专业术语尤其容易出错。
- 同一个标签出现两次,或者同一个框画了两遍、连了两遍线。
- 箭头方向画反,或者连错了框。
- 数字走样:1,234 变成 1,243,合计也对不上了。
- 出现你没要求的文字,比如凭空多出的副标题。
花五分钟核对一遍,几乎都能发现:
- 对照原始材料逐个读标签——框架图对照第 2 章,PRISMA 对照筛选表格,工作流程图对照方法部分。
- 顺着每条箭头从起点走到终点,把它表示的关系念出来。
- 把每个数字重新加一遍。PRISMA 的数字从一个框到下一个框必须对得上。
- 如果有错,就在编辑器里标出来并描述要怎么改,或者修改描述后重新生成。每个版本都保存在工作台里,可以退回之前的版本。
出错有多频繁?同一段框架描述我们跑了十次,文字每次都对,调节箭头有四次落错了路径;逐次结果见 FigureLabs 对比页。
接下来哪些图会改由代码排版?
研究框架已经切到「先分析、再由代码排版」这条流程上,构念名和假设编号现在是排出来的,不是画出来的。下一个是 PRISMA 流程图——那类图里错一个数字代价最大。在某种图切换过来之前,它的工具页会注明由生图模型绘制;切换之后,本页也会更新。做不到的日期,我们不会给出。
关于准确性的常见问题
Vizcept 能做到完全准确吗?
不能,任何用到 AI 的工具都做不到。代码排版句法树或句子图解时,词会和分析结果写的一字不差,但分析本身仍可能出错。由生图模型绘制的图(包括其他所有类型的图)需要完整核对一遍。
哪些类型的图由代码排版?
句法树、句子图解和研究框架;但如果你上传的是草图或照片、文字里有字体排不出的字符,或者分析失败,就改由生图模型绘制。PRISMA 流程图、图形摘要以及其他类型的图,目前都由生图模型绘制。
为什么我的句法树和教材上的不一样?
不同教材采用的句法框架不同。在工具里选择传统短语结构、X-bar 或最简方案的标签,并在提示里用英文写明教材的惯例,例如 "use DP rather than NP"(用 DP 而不是 NP)或 "show the trace of the moved auxiliary"(标出移位助动词的语迹)。提示里只要出现汉字,这张树就会改由生图模型绘制。
代码排版的图会多扣积分吗?
不会。无论用哪种方式画,一张图的价格都一样:2K 为 5 积分,4K 为 8 积分。如果你的输入里没有句子,请求会失败,不扣任何积分。
发现错误该怎么办?
在编辑器里修改,或改正描述后重新生成;之前的版本都保留在工作台里。如果代码排版的树反复在同一个结构上出错,请把句子发到 [email protected],方便我们修正指令。
看看代码排版的句法树
输入一个句子,选一个句法框架,再把画出的树和你自己的分析对照一下。
