韓国のAIスタートアップ企業Bidraftは、最近Hugging Faceプラットフォームで自社開発のオープンソース基盤モデルAether-7B-5Attnを発表しました。このモデルはApache-2.0ライセンスのもとで公開されており、モデルの重みだけでなく、トレーニングデータのレシピ、全トレーニングコード、ハイパーパラメータ、トレーニングログ、中間チェックポイント、評価コードを完全に開示し、真の意味での完全公開型モデルの構築を目指しています。
Bidraftはソウルに本社を置くAIディープテクノロジー企業で、Pre-AGIレベルのAI技術や量子計算技術に基づく物理、化学、生命科学、医薬品研究開発などの分野を網羅しています。会社はDarwinモデルファミリー、AETHERアーキテクチャ、PROMETHEUSワールドモデル、HEPHAESTUS組み込みAIからなる4層統合AGIシステムを提案し、公式ウェブサイトでは「Darwinが結果を生み出し、AETHERが未来を設計する」という発展方向を明確にしています。
BidraftがHugging FaceでAether-7B-5Attnオープンソースモデルを発表
2026年、DarwinシリーズモデルはK-AIランキングで総合1位を獲得し、GPQA Diamondスコアは90.9%、Polarisの新薬開発ランキングでは14項目で1位を獲得、メタ認知ランキングでも1位となりました。DarwinモデルファミリーはHugging Faceでの累計ダウンロード数が100万回を突破しています。モデル開発に加えて、会社は推論加速エンジンVKAEや軽量運行エンジンVKUEなどのAIインフラ技術も同時に開発しています。
Aether-7B-5Attnは、合計パラメータ数65.9億の混合専門家アーキテクチャを採用しており、各トークンで約29.8億のパラメータのみを活性化して推論効率を向上させています。モデルは、Full Attention、Differential Attention、Sliding Window、NSAシリーズの疎注意力、Hybrid方式の5種類の異種注意力メカニズムを統合しています。49層のネットワークは7×7のラテン方陣構造で配置されており、特定の注意力方式が特定の深さに集中するのを避けています。
トレーニングには16枚のNVIDIA B200 GPUを使用し、データ規模は約1442億トークンです。データ構成の中で数学が37.8%、韓国語が21.6%、英語が21.6%を占めており、英語中心のモデルではなく、韓国語と英語の両方を考慮した自主基盤モデルです。
基盤モデル、指示モデル、リアルタイムデモはすべてHugging Faceで公開されています。

