News Observation Lab for Future

ローカルAIで画面の意味を即座に把握し、次の操作を案内するNextCueAI

Close-up of an AI-driven chat interface on a computer screen, showcasing modern AI technology.

概要

NextCueAI は、分かりにくい画面やエラーダイアログ、設定ページ、フォームなどのスクリーンショットを解析し、画面に何が映っているか、何が問題なのか、次に取るべき具体的なアクションを日本語で提示するローカルファーストの AI アシスタントです。

主な機能

  • スクリーンショットをドラッグ&ドロップ、貼り付け、またはファイル選択で取り込む
  • 画面に映っている内容、問題点、次にすべきステップを段階的に説明
  • 簡易説明モードと詳細説明モードを切替可能
  • 英語とシンハラ語の両方に対応し、UI にローカルフォントを同梱
  • ローカルで動作する Olllama と Gemma ビジョンモデルを利用し、プライバシーを保護

対象ユーザー

コンピュータ操作に慣れているものの、見慣れない画面で戸惑うことが多いユーザー(例:コロンボのガラダリホテル勤務の 26 歳 Iru​ka Ak​ash)向けに開発されました。

導入方法

Windows 用 MSI パッケージが提供されており、インストール後は Node.js が不要です。ただし v1.0.1 では Olllama と Gemma モデルを別途インストールする必要があります。

ダウンロード先:
GitHub リポジトリ、
リリースページ

プライバシーとローカル実行の理由

スクリーンショットにはアカウント名、メールアドレス、個人情報、システム情報など多数の機密データが含まれる可能性があります。そのため、画像はローカルブリッジ(127.0.0.1)へ送信され、外部のクラウドへ転送されません。

技術構成

  • フロントエンド: React、TypeScript、Vite
  • ローカルブリッジ: 軽量 Express が画像検証・正規化・メタデータ除去を担当
  • デスクトップ版: Electron で Windows 向け MSI 配布
  • AI 応答は「見えているもの」「起こり得る事象」「次のアクション」「ステップバイステップのガイダンス」「注意」「自信」の項目で構成

対応画像形式と制限

PNG、JPEG、WebP をサポートし、最大 10 MB まで。アニメーション画像や不適切な入力は拒否されます。

ユーザーインターフェース

画像を中心に配置した UI で、ドラッグ&ドロップ、クリップボード貼り付け、ファイルピッカー、プレビュー、削除、言語・モード選択、分析キャンセル・再試行・結果コピーが可能です。

テストとリリース

単体テスト、API テスト、E2E テスト、レスポンシブ・アクセシビリティチェックを GitHub Actions で自動実行。現在のリリースは NextCueAI v1.0.1(Windows x64 MSI)。

今後の展望

次期リリースでは Olllama の自動検出、モデルのインストールガイド、アプリ内からのダウンロード、セットアップ進捗表示、途中停止からの復旧機能を追加し、セットアップのハードルを下げる予定です。

オープンソースの意義

プライバシー保護とローカル実行を核に据えたオープンソースプロジェクトとして、ユーザーはコードを検証し、外部 AI プロバイダーにデータを送信せずに安心して利用できます。

免責事項・利用上の注意

本サイトは情報提供および調査研究を目的としており、投資勧誘を目的とするものではありません。掲載情報には自動取得・自動翻訳・AI分析による内容が含まれます。投資判断はご自身の責任で行ってください。

詳細を確認する →