基于生成式人工智能的眼动样本生成及识别
谭雪青1
宋军2
张慢慢3
臧传丽3
1.天津师范大学 心理学部,天津 300387;河南理工大学 机械与动力工程学院,河南 焦作 4540002.河南理工大学 机械与动力工程学院,河南 焦作 4540003.天津师范大学 心理学部,天津 300387
摘要:目的 生成式和传统人工智能模型是信息时代的关键工具.在这些技术的助力下,眼动过程的样本生成与识别显得尤为关键,它已成为深入研究认知机制的重要手段.为了推动生成式人工智能在眼动技术领域的应用发展,解决眼动样本生成及因网络深度增加而导致的不透明性和不可解释性问题,并深入挖掘与幼儿语言发展相关的眼动数据,方法 采集4~6岁幼儿理解不同焦点结构的眼动数据,采用生成式人工智能模型-变分自编码器(variational autoen-coder,VAE)和传统模型-多层感知器(multi-layer perceptron,MLP)识别眼动模式的发展差异并尝试生成新样本,基于灰色关联分析和混淆矩阵对生成式数据集进行解释.结果 结果表明:(1)VAE生成的 4岁组、5岁组和 6岁组幼儿眼动数据集精度高于MINIST数据集(mixed Na-tional Institute of Standards and Technology database),且与MLP分析结果一致,具有准确性、多样性和一定的可解释性;(2)生成式眼动数据及混淆矩阵结果表明,在无焦点结构句式中,幼儿在4~5岁、5~6岁两个阶段理解水平均有提升,而宾语焦点结构和主语焦点结构的眼动特征在4~5岁变化较小,5~6岁变化较大,说明幼儿对焦点结构的理解在5岁是一个关键期,这符合幼儿焦点结构理解发展规律.结论 提出的人工智能耦合分析方法,具备有效识别眼动特征发展模式的能力,并能据此生成可靠的新样本.这一方法不仅为生成式人工智能与眼动技术的融合开辟了新的途径,而且为复杂语言理解问题提供了全新的思考方向.
关键词:生成式人工智能变分自编码器多层感知器眼动
分类号:TP391.4(计算技术、计算机技术)B842.5(心理过程与心理状态)
资助基金:国家自然科学基金(31800920)河南省教育科学规划重点课题资助项目(2025JKZD16)
论文发表日期:2025-02-27
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:9( 145-153 )
英文信息展开
河南理工大学学报(自然科学版)

河南理工大学学报(自然科学版)

CSTPCD北大核心
ISSN:1673-9787
年,卷(期):2025,44(1)
所属栏目:机电·智能化