インミのマルチモーダルAI対話型デジタルヒューマンシステム- は現在、スタンドアロンのオールインワン ターミナルとして出荷されています。- は、裸眼 3D ディスプレイ、大規模な言語モデル推論、ローカルのプライベート ナレッジ ベースを 1 つのユニットにまとめたものです。-組織は、機密データを外部クラウド経由でルーティングすることなく、それを構成し、ブランド化し、実行します。
最後の点は、当然のことと考えるのが難しくなりました。公共機関や企業は、共有 AI インフラストラクチャに何が組み込まれ、それがどこに行き着くのかについて警戒を強めています。システムのプライベート RAG (検索-拡張世代) ナレッジ ベースは、クライアント独自の環境内でコンテンツを保存および処理します。エクスポートとバックアップはワンクリックで実行できます。

システムが実際に行うこと
この端末は仮想アテンダント - として機能し、訪問者の質問に答え、ユーザーにサービスを案内し、テキスト、画像、ビデオ、音声応答など、クエリに適合する形式で情報を返します。訪問者は、音声キーワード、タッチスクリーン、顔検出の 3 つの方法でインタラクションを開始できます。 3 つのモードは一緒に実行することも、管理バックエンドから個別にオン/オフを切り替えることもできます。
音声処理では、中国語{0}}英語の会話-とノイズ フィルタリング マイクのサポートがカバーされています。固定-再生キオスクとは異なり、システムは文の途中での中断を受け入れます。-訪問者は、応答が終了するのを待たずにフォローアップで割り込むことができます。-国際的な観光施設や国境を越えたエンタープライズ環境向けに追加の言語を構成できます。-
AI 推論のために、システムは DeepSeek、Doubao、ERNIE Bot、Xunfei Spark、およびオプションで GPT-4.0 に接続します。また、クライアント-が提供する独自の API エンドポイント-も受け入れます。これは、すでに内部モデル インフラストラクチャを構築しており、デジタル ヒューマンにサードパーティ サービスではなくそれを実行させたい組織に役立ちます。
アバターレイヤー
ビジュアル コンポーネントは、メガネやヘッドセットを使用せずに、裸眼 3D レンチキュラー ディスプレイ - の深度レンダリングで実行されます。アバター ライブラリには、ビジネス、政府、観光業にわたる専門的な役割をカバーする 200 を超える事前構築済みキャラクターが含まれており、導入時に 3 つの標準セットが含まれています。-クライアントは、管理インターフェイスを通じてカスタムのエンタープライズ キャラクターをアップロードできます。
各アバターには 3 つのモーション セットがあります。つまり、微表情を伴う空呼吸、挨拶ジェスチャー(お辞儀、うなずき、手を振る)、そして話された内容と同期する説明モードの手の動きです。-アバター - の切り替えや言語モードの切り替え、たとえば中国語のビジネスパーソンから英語を話すガイド - への切り替え - は実行時に音声コマンドによって行われ、バックエンドの再構成は必要ありません。
音声クローンを作成すると、クライアントは特定の音声をシステムに取り込むことができます。広報担当者や組織の人物からの短い録音は、クローンのトレーニングを受けます。デジタルヒューマンはその声で話します。どのアバターが実行されているかに関係なく、複数の TTS プロファイルをインストールして交換できます。

ナレッジ管理とコンテンツ構成
非公開ナレッジ ベースでは、Q&A ペア用の Excel ファイル、プレゼンテーション中のスライド進行が自動同期される PowerPoint デッキ、特定のインタラクション ポイントでトリガーされるビデオ アセットなど、さまざまな形式のコンテンツを利用できます。{0} - の天気、ニュースのライブクエリ - は、厳選された機関向けコンテンツと並行して実行されます。
日々の管理はゼロコードのビジュアル エディタを通じて実行されます。-{{1}オペレーターは、グラフィカル インターフェイスを通じてウェイク ワード、音声速度、ペルソナ設定、オーディオ プロファイルを調整します。変更はシステムを再起動しなくてもすぐに有効になります。バックエンドは段階的な権限制御を使用するため、さまざまなオペレーターの役割は、アクセスを許可されているもののみを表示および編集します。

ハードウェア構成と導入形式
この端末には、標準 LCD または裸眼 3D レンチキュラーのいずれかで、6 つの画面サイズ - 21.5、27、32、43、49、55 インチ - があります。-エンクロージャのオプションには、ブラッシュメタル、強化ガラス、ラッカー仕上げが含まれます。ブランド化はレーザー彫刻またはスクリーン印刷によって行われます。設置は、キャスター付きの自立型フロアユニット、壁掛けブラケット、またはデスクトップスタンドとして取り付けられます。
| パラメータ | 仕様 |
|---|---|
| 表示サイズ | 21.5″ / 27″ / 32″ / 43″ / 49″ / 55″ |
| 表示の種類 | LCD / ベアアイ 3D レンチキュラー |
| ウェイクモード | 音声キーワード / タッチパネル / 顔認証(組み合わせ可能) |
| 音声認識 | 中国語-英語バイリンガル、ノイズに強い指向性マイク- |
| サポートされる AI モデル | DeepSeek、Doubao、ERNIE ボット、Xunfei Spark、GPT-4.0 (オプション)、カスタム API |
| アバターライブラリ | 200+ アセット、3 つの標準セットが含まれ、アバターごとに 3 つのモーション グループ |
| 知識ベース | ローカルのプライベート RAG。 Excel / PPT / 動画のマルチフォーマットのインポート- |
| ネットワーク | Wi-Fi + 有線イーサネット(デュアル-リンク冗長性) |
| インストール | 床置き- / 壁掛け- / デスクトップ |
OEM および ODM 構成システムインテグレーターと再販業者が利用できます。ソフトウェアのカスタマイズには、ブート アニメーション、エンタープライズ ビジュアル アイデンティティに対する完全な UI テーマの置き換え、モジュール レベルのアクティベーション制御が含まれます。{1}}ハードウェアには、クライアント ブランドのエンドツーエンドの - エンクロージャ、起動シーケンス、UI - が同梱されており、クライアントが必要とする場合にはメーカー ID は表示されません。
システムが導入されている場所
現在、政府の行政センター、博物館の展示ホール、企業のショールーム、病院部門のロビー、大学キャンパスのインフォメーション ポイント、銀行の支店フロアに導入されています。 Yingmiがターゲットとする5つのセクターは、政府および公共サービス、企業スペース、文化観光、教育および医療、金融機関である。
政府 35%
8 台のユニットを稼働させ、1 日あたり 2,{3}} 人の訪問者を処理する市の行政センターにおけるフロントデスクの行列のプレッシャーを軽減-
自動車小売業 30拠点
CRM 設定ログを使用して、新エネルギー車ブランドの全国ショールーム ネットワーク全体で標準化された製品説明{0}
文化遺産 +60%
歴史上の人物の声で展示物をナレーションする裸眼 3D アバターを導入した州立博物館での来館者の滞在時間の増加{0}}

配送とアフターセールスの構造-
導入は、要件の相談、ソリューションの見積もり、契約、コンテンツの制作、製造と出荷、オンサイトの設置、販売後の引き渡しという 7 つの段階を経ます。{0}{1}導入後のサポートには、生涯にわたるソフトウェア アップデート、24 時間のリモート技術対応、ナレッジ ベースのメンテナンス ヘルプ、オペレータ トレーニングが含まれます。--緊急対応のためのスタンバイ ユニットをアドオンとして利用できます。-
調達チームにとって、実践的な問題は、データがどこに保存されるか、システムの音声とブランドを既製のものではなく組織的なものにできるかどうか、継続的な運用にどの程度の社内 IT 関与が必要かという 3 つの点に集中する傾向があります。{0}-プライベート デプロイメント アーキテクチャ、音声クローン作成、ゼロコード管理バックエンドはそれぞれ、これら 3 つの懸念事項のいずれかを対象としています。- ただし、これらが大規模な環境にどれだけ耐えられるかは、特定の環境とクライアント自身のインフラストラクチャの準備状況によって異なります。





