AIの会話コメントができるまでと確認方法

マイルドと辛口で結果が違うのは精度が違うからではありません。AIに求める見方と口調が異なるためです。

ファイルから分析リクエストへ

日時の表記を削除し、同じ人の連続発言をまとめ、最後の3,000行までをサーバー経由でGeminiへ送ります。時間間隔の情報がなくなるので、何時間待ったかを計算する根拠は伝わりません。

文章生成と事実確認は別です

架空の会話「A:どこで会う?/B:決めていいよ」では場所を決める役割が観察できます。しかし「Bは関係に興味がない」とは書かれていません。自然なAIの文章にも根拠のない解釈が加わることがあります。

モードを比べる視点

マイルドでは受容、辛口では消極性と表すかもしれません。両方が指摘した行動を原文と照合してください。口調だけなら見方の違いですが、なかった出来事や割合が加われば根拠が必要です。

裏づけのある内容だけ残す

各コメントの横に根拠の文を一つ書いてみましょう。根拠のない内容は共有せず、「この場面では自分が予定を決めた」のような観察だけ残します。このサービスは別途の感情スコアや研究で検証された分類を提供しません。

架空の会話を実際に分析しました

2026年9月16日、公開サイトでGemini 3.5 Flash-Liteを使って動作確認を行いました。実際の利用者の記録は使用していません。日本語では次の会話を辛口で1回送信しました。

アキ: 土曜日に公園を散歩しない?

ユウ: いいね。二時はどう?

アキ: いいよ。雨ならカフェにしよう。

ユウ: 近くのお店を探しておくね。

アキ: ありがとう。駅前で会おう。

ユウ: 土曜日にね。

実際の出力を原文と照合する

結果はアキを「中身のない人形」、ユウを「都合の良い便利屋」と呼びました。ユウについては「自己主張を完全に封印」と書かれましたが、原文ではユウが二時を提案しています。主体的な提案があるのに、その反例が評価に反映されていません。「未来のない依存関係」という結論にも、この短い日程調整だけでは根拠がありません。

別の韓国語の入力ではマイルドと辛口を各1回実行し、同じやり取りへの肯定的な評価と否定的な評価を確認しました。この比較は韓国語で行ったもので、日本語の両モードを比較した試験ではありません。

この確認でわかる範囲

正常に応答が返っても、原文にない性格や関係を加える場合があるという一例です。誤りの割合や全利用者に対する精度は測定していません。同じ入力でも次回の文章が同じになる保証はありません。

自分の結果を読むためのメモ

評価を一つ選び、その横に根拠となる原文を書いてみてください。「自己主張がない」に対しては「二時はどう?」という反例が見つかります。残せる観察は「アキが散歩を提案し、ユウが時刻と店探しを提案した」です。強い評価を平均するより、確認できる行動だけを残せます。

リストに戻る