VideoX-Qwen 推出以数据为中心的指令驱动视频编辑框架
研究人员推出了 VideoX-Qwen,这是一个集成框架,将可扩展的数据构建与模型训练相结合,以推进通用、指令驱动的视频编辑。该系统利用生产流水线组织专用模型生成方向性编辑记录,从而在添加、删除、替换和属性任务中产生超过 120 万份高质量样本。
研究人员推出了 VideoX-Qwen,这是一个集成框架,将可扩展的数据构建与模型训练相结合,以推进通用、指令驱动的视频编辑。该系统利用生产流水线组织专用模型生成方向性编辑记录,从而在添加、删除、替换和属性任务中产生超过 120 万份高质量样本。
一位计算语言学家和豪萨语自然语言处理专家推出了一个新的数据集,旨在豪萨语语境下评估大语言模型在医疗保健和安全方面的表现。
FlyEye 项目发布了首个紧凑型神经元级数据集,以及配套的浏览器和运行时开发工具包。本次发布包括托管在 Hugging Face 上的 Tubban/flyeye-escape-neuron-v1 数据集。
Adaption Labs推出了“Invent a Dataset”功能,该功能可直接从自然语言任务描述生成结构化、可用于训练的数据集,无需种子语料库、预定义模式或标注指南。该工具可通过Adaption应用、Python SDK和REST API使用,用户可下载生成的行数据,格式包括JSONL、JSON、CSV或Parquet。
作者介绍了TrialGPT 2.0,这是一个面向实际部署的AI辅助临床试验推荐系统,可根据患者需求和流程优先级评估哪些试验值得考虑。
一篇新教程详细记录了从基本原理出发构建和训练字节级 BPE 分词器的逐步过程。该指南涵盖了关键的实现细节,例如 Unicode 感知的预分词、增量对频率更新以及使用惰性删除的最大堆。
Open ASR Leaderboard 首次引入了全球南方语言,包含两个新的评估集:Monsoon en-IN(印度英语)和 Monsoon hi-IN(印地语)。这些新增内容旨在解决当前基准测试中人口统计多样性不足的问题,而过去的基准测试历来侧重于欧洲语言。
作者发布了 Calibra,一个旨在在数据消耗 GPU 资源之前识别机器人模仿学习数据集中不良演示的工具。
Harmonic Frontier 发布了 Celtic Constellation Reference Sessions 数据集的预览,其中包含传统和现代凯尔特合奏编曲的对齐多轨录音。架构由对齐对组成,每首作品包括干燥的隔离音轨、经过制作链处理的同一表演以及最终混音。
康斯坦丁·齐奥尔科夫斯基的完整个人档案,共包含 51,008 页和 2,019 个档案文件,已作为 CC0 数据集发布。该合集跨越了这位自学成才的火箭理论家五十年的工作成果,包括手写手稿与打字副本。