EBOX × EAR CLOUD EAR CLOUD
ホーム / コア技術 / ソフト・ハード一体

ソフト・ハード一体:音声 AI のために生まれたチップ、企業システムのために生まれたプラットフォーム

EBOX-200 端末は Espressif の新世代フラッグシップ ESP32-S31 を採用;EAR CLOUD プラットフォームは蒸留軽量大モデルを動作——エッジ・クラウド連携、GPU サーバー不要。

ESP32-S31蒸留 Qwen3-4BGPU 不要プライベート展開
EBOX-200 HARDWARE

ESP32-S31 · 音声 AI フラッグシップ SoC

Espressif 2026 年量産の新世代デュアルコア RISC-V チップ。公式ポジション:スマートスピーカー、エッジインテリジェンス、産業オートメーション。

項目仕様
演算デュアルコア RISC-V 320MHz、単核 128-bit SIMD ワイドパス、AI 命令アクセラレーション
性能CoreMark は前世代 S3 比 約 65% 向上、端側ニューラル推論に余裕
大容量メモリ250MHz DDR PSRAM、SiP 最大 64MB——端側モデルが動く
接続Wi-Fi 6+Bluetooth 5.4(LE Audio)+802.15.4+ギガビット Ethernet MAC
オーディオデュアル I2S コントローラ、ハードウェア級の音声同期、低遅延・高忠実度
工業級セキュリティセキュアブート+Flash / PSRAM 暗号化+AES / RSA / ECDSA ハードウェアアクセラレーション
拡張60 GPIO、DVP カメラ、LCD——将来の製品展開用に確保
EAR CLOUD PLATFORM

蒸留軽量モデル · 大モデルを GPU なしサーバーで動かす

大モデルの能力を 1B–4B 規模に蒸留し、量子化と推論最適化を組み合わせ——16 コア / 32GB サーバー 1 台で 5 並列、顧客サーバールームでのプライベート展開。

蒸留軽量モデル · Qwen3-ASR / Qwen3-4B

認識モデル 1.7B、理解モデル 4B、量子化して CPU のみでリアルタイム動作——大モデルの文脈理解力を保ち、GPU コストを削減。大手のモデル能力を、工場級の導入ハードルで。

業界ホットワード · Context Biasing

1万トークン級の語彙コンテキスト注入:品目名・ロケーション番号・ロット番号が認識偏置に直接入る——「A-12 棚」「M8 ナット」のようなマニアックな語の認識精度が汎用モデルを大きく上回る。

NLU 二重ルート · 速い質問は速く答え、難しい質問は大モデルが

頻出質問(在庫照会 / ロケーション / 入出庫)はルールエンジンで企業システム直結、約 1 秒で回答;ロングテールの複雑な質問は大モデルが兜底。頻出ルートは確定的で信頼でき、ロングテールルートは知的で柔軟。

MCP 企業システム対接 · ゼロ改修

標準プロトコルで既存システムのインターフェースをラップ、お客様のシステムは一行も変更不要——立ち上げは月単位ではなく週単位。

16 コア / 32GB
サーバー 1 台構成 · 500GB · GPU 不要
5 並列
サーバー 1 台の収容力、水平スケール可
週単位で立ち上げ
対接期間 · プライベート納品
0 外部送信
ウェイク/検出は端側、認識/理解/合成はすべてイントラ内
次のページ:次へ:4 段階デプロイ構成

現場にサーバーが何台要るか、一緒に算出しましょう

1 台の試験導入から GPU クラスタまで、導入ロードマップをお描きします。