本次实操工作坊将介绍 HistText,这是一款面向研究人员的应用程序,专为大型多语言文本语料库的探索、数据化和分析而设计。HistText 由历史学家与计算机科学家密切合作开发,提供了一个集成环境,学者可以在其中循序渐进地完成从查询设计和语料库构建到实体抽取、数据转换以及可视化的整个流程。与仅关注工作流程中某一阶段的工具不同,HistText 将这些操作整合在同一个面向透明且可复现的人文研究环境中。本次工作坊专为希望开展计算文本分析而无需掌握高级编程技能的人文研究人员设计。工作坊将演示 HistText 如何将研究构建为透明且可复现的工作流程:参与者从研究问题出发,确定合适的文献集,制定并优化检索策略,构建相关文献语料库,进而将文本材料转化为可分析的数据。工作坊还将介绍支持这些操作的文本挖掘管线逻辑,并讨论其应用于历史材料时的优势和局限性。工作坊将特别强调在各个阶段记录分析选择的重要性,以确保研究过程保持明确、可追溯且可复现。
Armand et al. (Sat,) 对该问题进行了研究。
Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context: