Google AI Edge Foresight、会議メモをオフラインで作成
Googleの実験的なMacアプリGoogle AI Edge Foresightは、Gemma 4と、7億4000万パラメーターの埋め込み(エンベディング)モデルEmbeddingGemma 2を使い、走り書きをデバイス上で会議メモに仕上げる。
4 分で読めます

数字で見る
- parameters in EmbeddingGemma 2, the search model
- 740M
- active memory for text-only search, per Google
- 191MB
- active memory for the full multimodal model
- 567MB
Googleは、クラウドに何も送らずに会議メモを作成する実験的なMacアプリ、AI Edge Foresightを公開した。会議を聞き取り、デバイス上で文字起こしし、ユーザーの大まかな走り書きを完全なメモに仕上げる。アプリは2026年10月6日、GoogleのEmbeddingGemma 2モデルと同時に登場した。普通のノートパソコンが今や単独でどれだけのAI処理をこなせるかを示している。
Foresightの機能
Googleの開発者ブログは、Foresightを「コンテキストを理解する会議のパートナーを、デバイスに直接届ける実験的なアプリ」と呼んでいる。ビデオ通話中にも対面の会議中にも使える。
中心となる考え方は走り書きだ。会議が進む間、ユーザーは9to5Googleの言う「覚えておきたいことのための」短い箇条書きを書き留める。アプリはバックグラウンドで聞き取り、会議の文字起こしをもとに、その箇条書きを整ったメモに展開する。TechCrunchは、片側にユーザーの走り書き、もう片側にAIのメモが並ぶ分割画面を説明している。ユーザーは文字起こしの最中も自分のメモを入力できる。
Foresightは質問にも答える。9to5Googleによると、Live Assistanceモードは会議中に出た質問を聞き取り、自動で答える。チャット機能を使えば、後から自分の資料について質問できる。
ファイルも読み込む
ユーザーは、プロジェクトのフォルダー、参考資料、図、カレンダーをForesightに指定できると、9to5Googleは報じている。Google Driveも利用できる。TechCrunchは、知識源としてPDF、Google Docs、Microsoft Officeのファイル、プレーンテキスト、Markdown、ウェブのブックマークを挙げている。会議での発言がそれらのファイルに関係するとき、アプリはリアルタイムで答えを示せる。
Googleのブログによると、このアプリはクロスモーダル検索に対応している。平たく言えば、画像、文書、文字起こし、メモを、普段の言葉による1つの質問で検索できる。
デバイス上の構成
ブログによると、処理を担うのはGoogleの2つのモデル、Gemma 4とEmbeddingGemma 2だ。Gemma 4はGoogleのオープンモデルのファミリーで、TechCrunchによると、チャットはGemma 4を搭載したアシスタントが担当する。
EmbeddingGemma 2は検索を担う。エンベディングモデルは、テキスト、画像、音声を、意味をとらえた数値のリストに変換する。意味が似たものは似た数値になる。そのため、アプリは言葉が違っていても関連する文書を見つけられる。
9to5Googleによると、EmbeddingGemma 2のパラメーターは7億4000万で、Gemma 4のアーキテクチャをもとに作られ、Apache 2.0ライセンスで提供される。Googleによると、テキストのみの重みなら約191 MBのアクティブメモリで動く。フルのマルチモーダルモデルには約567 MBが必要で、これはPixel 11 Proでの計測値だ。この小ささこそが、EmbeddingGemma 2がスマートフォンでマルチモーダル検索を実行できる理由である。
| 項目 | 各情報源の記述 |
|---|---|
| プラットフォーム | Macのみ、Apple Silicon向けに最適化(TechCrunch、GoogleのFAQを引用) |
| モデル | Gemma 4とEmbeddingGemma 2(Google) |
| ネットワーク | 完全にオフラインで動作(Google、TechCrunch) |
| 費用 | クラウドのサブスクリプション費用なし(Google) |
| ステータス | 実験的(Google) |
| ダウンロード | developers.google.com/edge/foresight |
Googleのブログは「機密データがデバイスの外に出ることはない」と述べている。Mac側の最低macOSバージョンやメモリ要件を示した情報源はない。
Googleが作った理由
TechCrunchは、Foresightを人気のAIメモアプリGranolaの競合と位置づけており、両者は分割画面のレイアウトを共有している。ただしTechCrunchは、このアプリは主に、オフラインで動くGoogleのGemmaモデルのショーケースだとみている。さらに、Googleが将来、クラウドベースのメモアプリをGeminiアプリに組み込む可能性もあると推測している。TechCrunchによると、同じGoogleのチームは4月に、オフラインで動くAI音声入力アプリを公開した。
市場は混み合っている。TechCrunchによると、WisprとCalendlyはここ数か月で独自のメモアプリを公開し、Superhumanは9月にFathomを買収した。
開発者にとっての意味
Foresightは単体のアプリだが、ローカルAIの実際に動く参照設計でもある。
- 真似できるパターンとして扱う。 検索用の小さなエンベディングモデルと、回答用の大きなモデルの組み合わせは、標準的な検索(retrieval)構成だ。Foresightは、その構成がサーバーなしでノートパソコン上で動くことを示している。
- メモリの予算を確認する。 テキストで約191 MB、マルチモーダルで約567 MBなので、EmbeddingGemma 2は他のアプリと並んで収まる。Gemma 4モデルのフットプリントは公表されていないので、それを前提に計画する前に自分のMacで試すこと。
- クラウドツールが禁止されている場面で検討する。 会議の音声を外部サービスに送れないチームもある。オフラインのメモアプリならその問題を避けられる。ただし、実験的なアプリにはやはりセキュリティレビューをするのが賢明だ。
- 粗さは覚悟する。 GoogleはForesightを実験的と位置づけている。まだ重要な会議の唯一の記録にはしないこと。
- 今のツールと比べる。 クラウドのメモアプリに料金を払っているなら、同じ会議で両方を動かし、メモを並べて比べること。
出典
関連記事

EmbeddingGemma 2、マルチモーダル検索をスマートフォンで実現
Google DeepMindのEmbeddingGemma 2は、テキスト、コード、画像、動画、音声を7億4000万パラメーターで1つのベクトル空間に写す。テキストのみなら、必要なRAMは約191 MBだ。エンベディングの新世代である。

SynthIDの画像透かしに64ビットのID用フィールド
ある研究論文によれば、SynthID(シンスID)の画像透かしには64ビットのデータベースID用フィールドが含まれる。ただしGoogleは個々の利用者を追跡していないと説明する。

Google CloudのGemini agent、仕事をClaudeに振り分けられる
Google Cloudは10月8日、非公開プレビューの業務エージェントGemini agentを発表した。仕事をGeminiまたはClaudeで実行し、数時間から数日にわたって作業を続けられる。