9月20日、青海師範大学で教師教育の高品質な発展と校慶70周年を祝う会議の科学技術成果展示セッションにおいて、我国初のチベット語対応マルチモーダルAI入力法「Zhidada AI入力法」とそのチベット文字フォントセットが正式に公開されました。
この入力法はチベット語インテリジェント全国重点実験室によって開発され、同実験室が独自所有する大規模モデルおよび関連するAIインフラを基盤としており、スマートフォンやパソコンなどすべての端末をカバーし、文章、音声、画像などのマルチモーダル入力をサポートしています。また、統一アカウントを通じて単語リストや入力習慣を同期できます。
3つの地方言の音声、チベット語・中国語・英語混合OCR
青海師範大学教授で、チベット語インテリジェント全国重点実験室の常務副主任を務めるドラ氏は、「Zhidada AI入力法」は「Zhidada」大規模モデルを核心技術として開発されたと述べました。入力方法に関しては、標準的なチベット語キーボードレイアウトに厳密に従ってテキスト入力が可能であり、チベット語のラテン文字転写をサポートして学習のハードルを低下させています。音声入力では、ウェイズン(衛藏)、アンダオ(安多)、カンバ(康巴)の三大方言の書面語と口語をカバーしており、中国語・チベット語・英語の混合音声入力をサポートしています。OCR認識入力では、漢字・チベット語・英語の混合文字を撮影またはスクリーンショットで認識でき、文書デジタル化や教材整理、事務処理などのシナリオに適しています。
この入力法の語彙ライブラリは、教育、法律、文学など23の分野の用語をカバーしており、ユーザーの入力習慣、よく使う単語や表現を自動的に記憶します。研究チームは当日、この入力法に適したチベット文字フォントセットも公開しました。これは、太字、白抜き、芸術体、毛筆体の4種類のスタイルを含んでいます。
発表会ではさらに、「Zhidada」大規模モデルの紹介も行われました。このモデルは9つのバージョンをリリースしており、パラメータの規模は8億から1000億に及び、オンライン上で3つの主要モデルを配置しており、56の言語間翻訳および画像や動画の理解をサポートしており、教育、研究、政府業務などの分野で活用可能です。
VIP会員