product

製品情報

もじ太 – Transcription Server

大切な会話を、記憶ではなく記録に。

音声や映像を外部へ出さない安全性の高いオンプレミス型文字起こしサーバー「もじ太」

もじ太サーバーとブラウザ画面
会議、商談、採用面接――。
仕事では、さまざまな場面で重要なことが「会話」で伝えられています。
しかし、時間が経ってから、
「そのように説明したはず」
「そのようには聞いていない」
と、お互いの認識が食い違ってしまうことがあります。

すべてをメモするのは大変です。
録音していても、長時間の音声から必要な箇所を探し出すには時間がかかります。
「もじ太」は、録音・録画したデータを文字起こしし、重要な会話を「あとから確認できる記録」に変えるオンプレミス型文字起こしサーバーです。
こんなことで困っていませんか?
  • 会議中、メモを取ることに集中して話を聞けない
  • 重要な説明を「言った・言わない」にしたくない
  • 録音はしているが、あとから全部聞き直すのが大変
  • 議事録の作成に時間がかかっている
  • 過去の会話から必要な発言をすぐに探したい
  • 顧客情報や個人情報を含む音声を外部クラウドへ送りたくない
「もじ太」なら、音声・映像データを社内サーバー内で文字起こし。
文字から必要な場所を探し、その場所の元音声まで確認できます。
採用面接の「言った・言わない」を防ぐ

面接で説明した採用条件、記録に残っていますか?

採用面接では、仕事内容、給与、勤務時間、休日、勤務地、試用期間など、入社後の働き方に関するさまざまな説明や確認が行われます。

しかし、面接から実際の入社までには時間が空くこともあります。
入社後になって、
「面接ではこう聞いていた」
「そのような説明はしていない」
と、求職者と企業の間で認識の違いが生じることも考えられます。
こうした「言った・言わない」を防ぐためには、採用面接でどのような説明や質疑応答が行われたのかを記録しておくことが大切です。

面接の録音データを「確認できる記録」へ

「もじ太」なら、面接を録音した音声データをアップロードするだけ。
面接内容を自動で文字起こしします。
さらに話者分離により、面接担当者と応募者それぞれの発言を分けて確認できます。
たとえば面接後に、

  • どのような仕事内容を説明したか
  • 給与や勤務時間について何を説明したか
  • 応募者からどのような質問があったか
  • その質問に会社側がどう回答したか
  • 入社時期や勤務条件についてどのような話をしたか
といった内容を振り返ることができます。

さらに「もじ太」の字幕ビューアーでは、文字起こしした文章をキーワードで検索できます。
たとえば「給与」と検索。
該当する発言を見つけたら、その場所から元の音声を再生できます。
文字だけを見るのではなく、「実際にどのような言葉で説明したのか」まで確認できます。
長時間の録音データを最初から聞き直す必要はありません。

採用面接だからこそ、外部へ出さない。

採用面接では、氏名、職歴、経歴など、応募者に関する大切な情報を取り扱います。
クラウド型の文字起こしサービスを利用する場合、音声データをインターネット経由で外部サービスへ送信して処理する仕組みもあります。
「もじ太」はオンプレミス型。
音声・映像データを外部クラウドへ送信することなく、社内ネットワーク内で文字起こしを行います。
大切な採用面接のデータを社外へ出さずに、記録として残す。
機密性の高い会話を扱う業務だからこそ、オンプレミスという選択肢があります。
※採用面接を録音・記録する場合は、事前に応募者へ利用目的等を説明し、同意を得るなど、適切な運用をおすすめします。

「もじ太」が活躍するのは採用面接だけではありません
商談・打ち合わせ
お客様との打ち合わせでは、仕様、価格、納期、作業範囲など、重要な内容が数多く話し合われます。
「誰が、いつ、何を話したのか」を記録しておけば、後から認識の違いが生じた際の確認にも役立ちます。
社内会議
会議中はメモを取ることよりも、議論に集中。
会議終了後に文字起こしされた内容を確認できるため、議事録作成の負担を軽減できます。
「あの話はどこで出た?」という場合も、キーワード検索ですばやく探すことができます。
お客様からのヒアリング
システム開発、設計、コンサルティングなど、お客様へのヒアリング内容を記録。
担当者がメモした内容だけではなく、お客様が実際に話した内容まで振り返ることができます。
要件の確認や認識違いの防止にも役立ちます。
機密性の高い会議
経営会議、人事面談、研究開発、製品開発など、外部サービスへデータを送信することに不安がある会議にも。
「もじ太」は社内ネットワーク内で処理するため、機密性の高い音声・映像データを社外へ出すことなく文字起こしできます。
録音するだけでは、「記録」は活用できない。

録音データを残していても、
「どこでその話をしたのかわからない」
となれば、確認するために長時間の音声を聞き直さなければなりません。
「もじ太」は、録音された会話を文字に変換するだけではありません。

  • 話者で分ける。
  • 文字で読む。
  • キーワードで探す。
  • 元の音声で確認する。
音声を「保存する記録」から「使える記録」へ変えます。

音声・映像データは社内に。

「もじ太」は、OpenAIのオープンソース音声認識モデル「Whisper」を社内サーバー上で稼働させます。
音声・映像データを外部クラウドへ送信せず、社内ネットワーク内で処理。
インターネット上の文字起こしサービスへ機密情報をアップロードすることに不安がある企業でも導入しやすい仕組みです。

操作はかんたん

ブラウザから音声・映像ファイルを「もじ太」へアップロード。
あとはサーバーが文字起こしを行います。
文字起こしした内容は字幕ビューアーから確認できます。

  • 話者ごとに発言を表示
  • 文字列検索
  • 任意の場所から元音声・映像を再生
  • 重要な発言をブックマーク
  • 字幕テキストをダウンロード
専用アプリを各パソコンへインストールする必要はありません。

「あのとき、何と話した?」

そんなとき、すぐに確認できる環境を。
会議、商談、採用面接。
仕事の中で交わされる大切な会話を、あとから確認できる記録として残しませんか?

もじ太サーバーとブラウザ画面
「もじ太 PLUS」なら翻訳できます!

日本語・英語・ベトナム語・中国語・フィリピン語・ネパール語・インドネシア語・韓国語の8言語への翻訳に対応。

【製造・建設】
・現場ミーティングの内容を外国籍作業員にも正確に共有できます
【介護・医療】
・会議内容や引継ぎ、注意事項を母国語で確認できます
【自治体・教育】
・外国籍住民・留学生との会議内容を正確に共有できます
【企業全般】
・海外拠点・外国籍社員との情報共有に

「もじ太」の紹介動画

音声や映像を外部クラウドへ出さない。
オンプレミス型文字起こしサーバー「もじ太」

導入方法や利用環境についても、お気軽にご相談ください。

仕様

ハードウェア仕様

CPU AMD Ryzen 5 9600X BOX Socket AM5 / 6コア 12スレッド / 3.9GHz
メモリ DDR5 / PC5-44800 / 32GB(16GB x 2)
SSD 1TB / NVMe PCIe Gen5 x 4 M.2 Type 2280
GPU NVIDIA GeForce RTX 5060 8GB
ネットワーク 2.5ギガビット LAN
ネットワーク 2.5ギガビット LAN
ワイヤレスLAN なし
映像出力 DisplayPort1.4 x 2 / HDMI x 1
フロント I/O ヘッドフォン / ヘッドセットジャック x 1、USB 3.2 Gen1 Type-C x 1、USB 3.2 Gen1 Type-A x 2、USB 2.0 Type-A x 2
リア I/O DisplayPort 1.4 x 2、HDMI x 1、USB 2.0 Type-A x 2、USB 3.2 Gen1 Type-A x 2、RJ-45 LANポート x 1、BIOS Flashbackスイッチ、HD オーディオ Jacks:ラインイン / フロントスピーカー / マイクロフォン
電源 500W電源(80+ Bronze、ピーク550W)
寸法 W168 x D219.3 x H218.3mm(8L) ※突出部を除く
その他 キーボード、マウス 付属
※ハードウェア仕様は変更することがあります。また、カスタマイズも可能ですのでご相談ください。

ソフトウェア仕様

  もじ太 もじ太 PLUS
文字起こし 〇 〇
話者分離 〇 〇
フィラーワード※1除去 〇 〇
字幕ビューアー 〇 〇
特定文字の置き換え 〇 〇
機械翻訳 ー 〇
(日本語・英語・ベトナム語・中国語・フィリピン語・ネパール語・インドネシア語・韓国語)
※1 フィラーワードとは、「え~と」「あの~」「その~」など会話の隙間に発する言葉。

対応音声形式

音声ファイル 動画ファイル(音声トラックを自動抽出)
MP3(.mp3)、WAV(.wav)、M4A(.m4a)、AAC(.aac)、FLAC(.flac)、OGG(.ogg)
最大ファイルサイズ:2GB
MP4(.mp4)、MOV(.mov)、AVI(.avi)、MKV(.mkv)、WebM(.webm)
最大ファイルサイズ:2GB
【ご注意】文字起こしの精度は録音データの品質に左右されます。ノイズの少ない明瞭な音源をご用意ください。

ライセンス

文字起こし OpenAI Whisper large-v3(オープンソース音声認識モデル、ライセンス:MIT License)
話者分離 pyannote/speaker-diarization-3.1(提供元:pyannote / Hervé Bredin、ライセンス:MIT License)
機械翻訳 google/madlad400-3b-mt(提供元:Google、ライセンス:Apache License 2.0)
OPUS-MT(提供元:Helsinki-NLP、ライセンス:Apache License 2.0)
※各OSSのライセンス全文は製品内にて提供します。
PDF icon パンフレットはここをクリックしてください

お問い合わせ

contact

株式会社ロジックベースのお問い合わせ窓口はこちらです。

お問い合わせ