标签
WaseiGo 是一款产品,通过插图对话、音频、词典和测验,教授超过 1,000 个日语中的'和製英語'单词,这些单词看似英语却赋予了新的含义。
AIVTuber Shizuku-chan正在策划8月15日至16日的秘密夏日活动,引发了粉丝的热烈期待。
JOR-Bench 是一个包含五个日语基准测试的集合,用于评估大型语言模型在运筹学问题建模方面的能力,这些基准测试从现有的英语基准翻译而来。评估结果显示整体性能与语言无关,仅有轻微的跨语言差异。
YOMI-Bench 是一个旨在评估大语言模型在日语汉字读音和语音理解方面的基准测试。它包含四项任务,并揭示即使是专门针对日语的模型在需要汉字读音知识的生成任务上也表现不佳。
MIT教科书《Mathematics for Computer Science》已翻译成日语,可在inzkyk.xyz获取。
Dango是一个18亿参数的大型语言模型,严格使用日语(L1)进行预训练,然后使用英语(L2)进行微调,以研究第二语言习得中的语言迁移效应。该模型从预训练语料库中过滤掉英语污染,并展现出类似人类的L2输出模式。
本文将对法医作者身份鉴定中的似然比框架应用于日语文本,融合了风格测量特征与基于嵌入的系统,以提高区分度和校准性能。
一篇博客文章,探索了一张1994年的CD-ROM,其中收录了日本关西地区的XD FirstClass网络BBS,包括其客户端软件和社区帖子,让人们得以一窥互联网前的在线社区。
HakushoBench是一个基于政府白皮书构建的日语图表和表格VQA基准,用于评估视觉语言模型对复杂视觉数据的理解能力。该基准对开源权重模型具有挑战性,最佳准确率仅为58.6%,与专有模型之间相差34.9个百分点。
本文研究了字符级Transformer模型如何泛化到日语过去时屈折中的不规则动词子类型。控制实验表明,包含不规则示例可以改善泛化,挑战了规则性简化学习的假设。