AI比較

AI比較

AIはどこで嘘をつく?3つに罠を仕掛けたら「出典」が危ない

AIはどんなときに嘘(ハルシネーション)をつく?ChatGPT・Gemini・Claudeの3つに「わざと罠」を仕掛けて検証しました。結果、架空の関数・法律・機能など「存在しないもの」は3つとも見抜いて作り話ゼロ。でも「根拠の論文を出典つきで教えて」と聞くと、実在する論文に誤った著者名や数字を自信たっぷりに混ぜるケースが。一番危ないのは存在チェックより「出典・数字の細部」でした。実際のやり取りと、会社員が事故らない裏取りチェックを解説します。
AI比較

会議メモの要約、結局どのAIが使える?同じメモで採点した

会議メモの要約、ChatGPT・Gemini・Claudeで結局どれが一番「そのまま社内共有に使える」?まったく同じ会議メモと同じ指示を3つのAIに与え、25点満点(要点網羅・正確さ・見やすさ・そのまま共有できる度・素直さ)で採点した再現可能な比較実験です。総合1位はChatGPT(24点)、Claude(22点)・Gemini(21点)が僅差で続く結果に。使ったメモも採点基準も全公開。差が出た「ToDoと宿題の分け方」や各AIのクセ、用途別の選び方まで解説します。