VideoX-Qwenが指示ベースのビデオ編集のためのデータ中心フレームワークを導入
研究者らは、汎用かつ指示駆動のビデオ編集を推進するために、スケーラブルなデータ構築とモデル学習を組み合わせた統合フレームワークであるVideoX-Qwenを発表しました。このシステムは、方向性編集レコードを生成するために特殊化されたモデルを整理する生産パイプラインを利用し、追加、削除、置換、属性タスクにわたって120万以上の高品質サンプルをもたらします。
研究者らは、汎用かつ指示駆動のビデオ編集を推進するために、スケーラブルなデータ構築とモデル学習を組み合わせた統合フレームワークであるVideoX-Qwenを発表しました。このシステムは、方向性編集レコードを生成するために特殊化されたモデルを整理する生産パイプラインを利用し、追加、削除、置換、属性タスクにわたって120万以上の高品質サンプルをもたらします。
計算言語学者でありハウサ語自然言語処理の専門家が、ハウサ語における医療と安全性の文脈で大規模言語モデルを評価するために設計された新しいデータセットを導入しました。
FlyEyeプロジェクトは、ブラウザおよびランタイム用開発キットと共に、初のコンパクトなニューロンレベルデータセットを公開しました。このリリースには、Hugging FaceにホストされているTubban/flyeye-escape-neuron-v1データセットが含まれます。
Adaption Labsは、シードコーパス、事前定義されたスキーマ、またはラベリングガイドを必要とせず、自然言語のタスク記述から構造化されたトレーニング準備完了のデータセットを直接生成する機能「Invent a Dataset」を発表しました。このツールはAdaptionアプリ、Python SDK、REST APIを通じて利用可能で、ユーザーは生成された行をJSONL、JSON、CSV、またはParquet形式でダウンロードできます。
著者らは、実世界での展開を対象としたAI支援型臨床試験推奨システムであるTrialGPT 2.0を発表し、患者のニーズとワークフローの優先度に基づいてどの試験を検討に値するかを評価する。
新しいチュートリアルでは、第一原理からバイトレベルのBPEトークナイザーを構築し学習する手順が文書化されています。ガイドでは、Unicode対応の事前トークン化、ペア頻度のインクリメンタル更新、遅延削除付き最大ヒープの使用など、実装の重要な詳細がカバーされています。
Open ASR リーダーボードは、2つの新しい評価セットである Monsoon en-IN(インド英語)と Monsoon hi-IN(ヒンディー語)を通じて、初のグローバルサウス言語を導入しました。これらの追加により、歴史的にヨーロッパの言語に焦点を当ててきた現在のベンチマークにおける人口統計的多様性の欠如という課題に対応します。
著者は、GPU リソースを消費する前にロボティクス模倣学習データセット内の不良デモンストレーションを識別するために設計されたツール、Calibra をリリースしました。
Harmonic Frontier は、伝統的および現代のケルトアンサンブル編曲のアライメントされたマルチトラック録音を含む Celtic Constellation Reference Sessions データセットのプレビューを公開しました。アーキテクチャはアライメントされたペアで構成され、各作品にはドライな分離ステム、制作チェーンを通じて処理された同じパフォーマンス、そして完成したミックスが含まれます。
コンスタンチン・ツィオルコフスキーの完全な個人アーカイブが、CC0データセットとして公開されました。このアーカイブは5万1,008枚のシートと2,019件のアーカイブファイルで構成され、独学でロケット理論を研究した人物の50年分の作品を網羅し、手書き原稿とタイピングされた写本を含みます。