AI 例句:语法都对,语感不一定对
本文性质: 观察 + 模型(Observation / Model) 证据标签: 观察 Observation/模型 Model/假设 Hypothesis/实证 Evidence
本篇涉及的证据类型:观察 Observation/模型 Model/假设 Hypothesis。凡属本院课堂观察与教学模型的部分,均不作效果承诺。
工具生成的例句,语法上挑不出毛病,读起来却总觉得哪里不对劲。问题往往不在语法,而在词与词之间的搭配和使用场合。
句子对了,为什么读起来还是不对
本院写作课上,这种情况反复出现:学生把工具给的例句原样搬进作文,句子成分完整、时态也正确,可放在段落里就像从别处剪过来的一截,前后没有铺垫,用词的正式程度和上下文也不搭。另一种表现是同一句话换个场景就不成立——在书面语里自然的说法,放进日常对话里显得别扭。以上为本院课堂观察记录(2019 年至今),属课堂观察,未做统计检验。
通顺和地道是两个指标
语言的合理性不只在语法这一层。语料库语言学的基本发现之一,是词的意义有很大一部分由它经常和哪些词一起出现决定(Firth 1957 提出搭配概念,Sinclair 1991 系统化了搭配研究)。搭配是约定俗成的,无法只靠规则推导出来。工具生成句子时按概率选择下一个词,语法约束通常能被满足,但「哪些词常一起出现」这一层信息,取决于它训练语料的构成与配比。所以通顺与地道是两个不同的指标:前者看结构与逻辑,后者看词的共现习惯。
本院的三条口径
本院据此定了三条口径。第一,例句只当提示,不当范本:用它来确认一个词可以怎么用,而不是直接搬进自己的文章。第二,拿真实语料对照:把一个词放进搜索引擎或原版读物里,看它在真实文本里和谁相邻。第三,记搭配不只记单词:把词和它最常见的两三个伙伴一起记,用词块的方式存进笔记(词块教学法参见 Lewis 1993,词汇与搭配的整理参见 Nation 2001)。
三条边界
三条边界。第一,并不是工具给的例句都不地道,常见词的常规用法大多没问题,出问题的多在低频词与特定文体上。第二,语料库对照需要一定的检索能力,初学者容易把不同语域的例句混在一起。第三,本校没有做过工具例句与真实语料在搭配分布上的对照实验,本文的判断属内部模型与课堂观察层,不作效果承诺。
今天就能开始
今天从工具给的例句里挑三句,分别到原版读物或真实语料里找同一个词的其他出现位置,比较搭配是否一致。
本文依据
- 观察来源: 本院写作课课堂观察记录(2019 年至今):例句搬运造成的语境不搭,在作文批改中反复出现,属课堂观察,未做统计检验。
- 模型出处: 「例句当提示、真实语料对照、记搭配不只记单词」三条,为本院 AI 教育研究组内部教学模型。
- 待验证项: 工具例句与真实语料例句在搭配分布上的整体差异有多大,本院尚无量化数据,按待验证项处理。
- 外部文献: Firth 1957(搭配概念的提出);Sinclair 1991(Corpus, Concordance, Collocation);Lewis 1993(词块教学法);Nation 2001(词汇学习与搭配)。