ガイド
AIモデルの比較方法
ランキングではなく実際の課題から始めましょう。同じ条件で回答品質、総費用、速度、言語対応、データの扱いを比較します。
要点
Oossaの確認項目:同じ例を使い、モデルの版、日付、設定、誤りを記録します。企業の主張と独立したテストを区別しましょう。これは比較方法であり、製品ランキングではありません。
Oossa · Oossa公開日:
AIの支援で作成・翻訳しています。以下の原典をご確認ください。
モデル →
今日
モデル
Transformers 5.18.0、ストリーミング話者識別モデルを追加
Hugging Faceの新バージョンには、ライブ音声で最大8人の話者を識別できるストリーミングモデル「Nemotron 3 Diarization」が含まれる。
モデル
Runway、汎用ロボット向けモデル「Praxis‑1」を発表
Runway Researchは、動画で学習したオープンウェイトのロボット行動モデル「Praxis‑1」を発表。Noble Machines、Standard Bots、Ultraが初期テストを行っている。
モデル
Blackfuel、契約済み売上高が2億5000万ドル超と発表
AIモデルの実運用に向けた世界規模のコンピューティングネットワークを構築中だというが、顧客やインフラの詳細は明らかにしていない。
モデル
llama.cpp、BF16行列入力のCPU処理を修正
リリースb11292では、depthwise convolutionで使われるBF16行列入力にCPUが対応。Vulkanの対応判定も厳格化されました。
モデル
Google、TPUで動画のスパース注意処理を2.4倍高速化
Googleによると、タイルに合わせた注意カーネルにより、TPU v6e 1チップでレイテンシが短縮した。報告された高速化は注意カーネルに限られ、動画生成パイプライン全体のものではない。
モデル
Hugging Face、Open TTS Leaderboardを公開
新たなランキングは客観的な指標でオープンソース音声モデルを評価。数週間かかる作業を数時間に短縮する。