カスタマーサービスや販売担当者との通話の自動化、会議記録装置の普及、そして音声を主なインターフェースとするAIスマートグラスに至るまで、数十億ドルがこの分野に流入しています。一方で、主要なAIラボはモデルの高速なイテレーションを進め、ハードウェア製造企業もユーザー向けの最高の音声インタラクション体験を実現しようと尽力しています。しかし、これらの新技術には厳格なテストとフィードバックループが必要であり、それを不断に最適化していきます。アイスランドに拠点を置くスタートアップ企業Trebleは、大規模なモデルメーカー、ロボット企業、および消費者向けハードウェアメーカーにとって、音声技術の裏側の主要インフラとなることを目指しています。

この会社は、2020年に音響エンジニアのFinnur PindとJesper Pedersenによって設立されました。最近、Trebleは1800万ドルのAラウンド拡充資金調達に成功しました。今回の資金調達はPaladin Capital Groupがリードし、既存の投資家であるKOMPAS VC、Frumtak Ventures、EIC、およびOmega ehfが追加投資を行いました。また、2024年に獲得した1200万ドルの投資を含め、これまでの総資金調達額は4000万ドルを超えています。現在、同社の顧客リストにはアマゾン(Amazon)やログテック(Logitech)などの業界の巨頭が含まれています。

具体的な製品部門において、Trebleの業務は主にシミュレーションとデータ生成に焦点を当てています。語音AI企業向けには、合成データ生成プラットフォームを提供しており、語音強化、ノイズ抑制、モデルトレーニングなどに広く応用可能です。また、このプラットフォームはさまざまな複雑な環境下で語音AIモデルのテストと性能評価を行うことができ、研究室に詳細なフィードバックを提供します。注目すべき点は、今年の早い時期にHugging Faceと提携し、異なるリアルな場面における語音認識モデルの評価基準を発表したことです。

共同創業者のFinnur Pindは、音声AIの核心的な課題はデータの問題であり、そのことこそが次の世代のモデルとハードウェアにとっての重要な機会であると述べています。長期間にわたり、ほぼすべての音声関連のAIはインターネットから収集された録音やデータで訓練されてきましたが、Trebleは高精度な物理シミュレーションが音声データを作成するための新しい代替手段となり得ると信じています。

ソフトウェアレベルでのデータと評価に加え、このスタートアップはハードウェアレベルでの音声設計とテストにも重点を置いています。例えば、ヘッドホンやスピーカー製造企業と密接に協力し、仮想プロトタイプ技術を通じて製品の実際の音質表現を正確に評価したり、スマートスピーカーが異なる配置場所でのコマンド認識効果をテストしたりするのを支援しています。最近では、Trebleの事業範囲はスマートグラスやさまざまなAIウェアラブルデバイスのシミュレーションテスト領域へと拡大しました。

未来の技術ビジョンについて語ったFinnur Pindは、次世代のウェアラブルデバイスに対する高い期待を示しています。彼は、イヤホンやスマートグラスのようなデバイスが将来的には「超強力な聴力」機能を持つようになる可能性があると考えています。これにより、ユーザーは複雑な音学的環境でもより明確に聞こえるようになります。たとえば、賑やかなレストランで2メートル以内の会話を強調したり、セミナーで周囲の雑音を自動的に静音化したりすることなどが可能になります。

今後の展望について、Trebleは実体AI分野にさらに焦点を絞る予定です。主にロボット、自動車、無人航空機(UAV)などの企業にサービスを提供し、テストとシミュレーションを通じて、これら実体ハードウェアが音声に基づく機能をよりよく実現できるように支援していきます。

Paladin Capital Groupの副社長Francois Ruetherは、投資の論理について語り、Trebleが異なるモデルやデバイスをシミュレートできるプラットフォームが業界において非常にユニークであり、その扱う分野が拡大していくにつれて、プラットフォームの重要性も増すと述べました。彼の見解では、ますます多くの製品が音声の理解に依存するようになる中で、このインフラストラクチャーが語音AI、ウェアラブルデバイス、ロボティクス、および実体AI分野においてますます価値を発揮するようになるでしょう。この過程で、顧客は常に自身のモデル、製品、開発ワークフローの所有権を保持しながら、シミュレーションネイティブな音響インフラストラクチャー層を通じて共に恩恵を受けることができます。