一位开发者创建了一个极小的语言模型,其权重文件为842KB,包含107,776个参数,使用双词子字。该模型设计用于直接在浏览器中运行,并在一个偏向短篇故事生成的混合语料库上进行了训练。

  • 该模型仅重842KB,包含107,776个参数。
  • 它利用双词令牌逐个拼写单词,而不是将它们链接起来。
  • 训练数据偏向微型故事,尽管语料库是混合的。
  • 研究结果在Zenodo上以“Phasor-Face Transformers (PrismFormer)”为名记录。

作者旨在在接下来的几天内完善该模型,以提高其生成短篇叙事时的输出质量。