PR・提供なし

MEETING MINUTES TEST / 2026-07-27

会議メモ→議事録 AI 3サービス比較
事実を崩さず整理できる?

個人情報を含まない架空会議メモと同じ日本語指示を、当時のChatGPT、Claude、GeminiのWeb画面で各1回実行しました。

編集:結局どのAI運営者比較・編集方針

当時の記録スコア 92 / 100 ChatGPT

内部モデル名は表示されず。必須事実を全件保持し、初回生成は11.2秒。

当時の記録スコア 83 / 100 Claude / Opus 5 高

情報整理と表は明瞭。未割当作業の扱いなど、2か所の修正が必要。

当時の記録スコア 71 / 100 Gemini / Flash

網羅性と表は良好。事実の状態や限定を変えた4か所の修正が必要。

Measured results

当時の7軸スコアは、92点・83点・71点

重要: これは各サービス1回の初回出力を記録したV001の結果です。ChatGPTは内部モデル名を確認できず、ClaudeはOpus 5 高、GeminiはFlashで、モデル帯・プランも揃っていません。一般的なモデル性能の総合順位ではありません。

比較項目 記録 92点 ChatGPT 記録 83点 Claude 記録 71点 Gemini
モデル表示 内部モデル名表示なし Opus 5 高 Flash
版番号の記録なし
正確さ 28 / 30 28 / 30 16 / 30
抜け漏れ 20 / 20 19 / 20 20 / 20
修正の少なさ 12 / 15
1 edit unit
9 / 15
2 edit units
3 / 15
4 edit units
読みやすさ 15 / 15 15 / 15 15 / 15
初回生成 11.2秒 27.9秒 13.8秒
記録プラン ゲスト/ログアウト Pro Plus
試行回数 1回 1回 1回
※ 100点の内訳は、正確さ30、抜け漏れ20、修正の少なさ15、読みやすさ15、時間10、使いやすさ5、料金・利用制限5です。 ※ 現在の製品仕様や、別モデル・別プラン・別会議への再現性を示す結果ではありません。

What changed

差が出たのは、要約の長さより「事実の状態」

採点で確認した必要修正 1 / 2 / 4 ChatGPT / Claude / Gemini

ChatGPTとClaudeは、「9月4日までなら作れる」という条件付き表現を無条件の確定ToDoへ強めました。Claudeは加えて、未割当の2作業を確認対象として保持できませんでした。

Geminiは、原文にない会議名の追加、録画配布の暫定方針の確定化、税区分の補完、条件付き表現の確定化がありました。必須項目が書かれていても、決定・未決・条件の意味が変わると実務では修正が必要です。

For real work

議事録を採用する前の3チェック

1. 決定と未決を分けたか

「決まった」「方向」「要確認」をAIが勝手に同じ状態へ変えていないか見ます。

2. 数字と限定を保ったか

日付、金額、税込・税別、条件付き表現を原文と照合します。

3. 未割当を残したか

担当者が決まっていない作業を、勝手に誰かのToDoへ変えていないか確認します。

Test record

今回の検証条件

架空会議メモ1件
比較サービス3つ
試行回数各1回
採点軸7軸
共通にしたもの

架空会議メモ、指示文、新規会話、Web検索なし、外部ファイルなし、初回出力のみ。

揃っていないもの

内部モデル、モデル帯、プラン、各サービスのWeb実行環境。ChatGPTの内部モデル名は未確認です。

採点方法

サービス名を把握した主採点と、候補A・B・Cによる独立ブラインド採点を統合しました。

Conclusion

今回の記録から言えること

この架空会議メモ、2026年7月27日時点の各Web環境、各1回の初回出力という条件では、ChatGPTが92点で最高得点でした。決定と未決、数値、確認事項を比較的忠実に整理し、初回生成も最速でした。

一方で、ChatGPTの内部モデル名を確認できず、Claude Opus 5 高とGemini Flashでモデル帯も揃っていません。そのため、このページでは検証済みのV001記録として公開し、現在のモデルを横断する総合順位には使いません。

検証記録と根拠を確認する
結局どのAIのチャンネルアイコン

約1分の結果Shortsも公開中

今回の得点と差が出たポイントを、スマホ向けのShortsでも確認できます。

結果Shortsを見る