2026年10月5日(月) 海外のAIニュースを、日本語で最速に。 最終更新

海外のAI一次情報を、毎日日本語で。

活用事例一次情報

Lathoaは子どもがAIのわざとの誤りを探す算数アプリ、出題前に別モデルと検算で確認

画像はAIで生成したイメージです

3行でわかる

  1. Lathoaは、ロボットのErrolが段階的に解いた算数の答えから、わざと混ぜた誤りの1手を10〜14歳の子どもが探すアプリだ
  2. Lathoaの作者によるとLLMにわざと間違えさせるのは難しく、検算と別モデルの解答で食い違う問題は捨ててから出題している
  3. Lathoaは問題作成と子どもの説明の採点にAnthropicのClaudeを使う。無料は1日3問、有料は年66.99ドルから

子ども向け学習アプリ「Lathoa」の作者が現地時間9月30日、Hacker Newsの「Show HN」で同アプリを紹介しました。AIのロボットがわざと間違えた算数の解き方を見せ、10〜14歳の子どもがどの手順が誤りかを探して理由を書きます。投稿は50ポイント・26件のコメントを集めました。運営はスイスのZeroEx Tsitsipas Labsです。

何を作ったか

Lathoaとは、AIの答えをうのみにせず、誤りを見抜く力を算数で鍛えるアプリです。遊び方は、ホームページで登録なしに解ける例題を見るとよくわかります。「3時45分に始まる90分の映画はいつ終わるか」という問題に、ロボットの「Errol」が3つの手順で答え、途中で「90分は0.90時間」と換算して4時35分と結論づけます。子どもは誤った手順をタップし、どこがおかしいかを自分の言葉で書きます。

誤りがいつも入っているわけではありません。作者はHNのコメント欄で、5問に1問は正しい解き方だと説明しており、何でも疑えば点が取れる作りにはしていません。誤りの説明まで書くと経験値が増え、たまるとRookieからSherlockまで探偵の階級が上がります。ランキング表は、保護者が有効にした場合だけ出ます。

難しさはObvious・Sneaky・Expertの3段階です。ヘルプによると、正答率が80%を超えると難しく、50%を下回ると易しくなります。範囲は米国の共通学力基準(Common Core)の4〜8年生に合わせた計算・分数・比・代数の入り口・初歩の図形で、子どもがAIと自由に会話する機能はありません。

Lathoa公式サイト「Things parents actually ask.」公式ドキュメント

There's no open-ended chat. Kids interact with structured cases; they don't talk to a model.

自由なチャットはありません。子どもは決まった形式の問題に取り組むだけで、モデルと会話はしません。

原文を読む(lathoa.ai)

どう作ったか

プライバシーポリシーによると、問題の作成と、子どもが書いた説明の採点にはAnthropicのClaudeを使っています。通信はすべてCloudflare AI Gatewayを経由し、名前やメールアドレス、アカウントの識別子は送らないとしています。データベースと認証はSupabase、決済はStripeです。作者はHNで、アプリ自体もClaudeの助けを借りて作ったと認めています。

開発でいちばん手こずったのは、AIにわざと間違えさせることだったと作者は書いています。

Show HN: Lathoa(作者の投稿)公式発表

The part that surprised me: it's hard to get an LLM to be wrong on purpose. Half the time it gives you the right answer and calls it wrong, or a "mistake" that's actually correct.

意外だったのは、LLMにわざと間違えさせるのが難しいことです。半分ほどは、正しい答えを出して誤りだと言うか、実は正しい「間違い」を出してきます。

原文を読む(news.ycombinator.com)

対策として、問題は子どもに届く前に検証にかけられます。作者の説明を整理すると、仕組みと残る穴は次のとおりです。

検証の段階 何をするか 残る穴
算術チェック 計算できる部分を、AIを使わない通常のプログラムで厳密に計算し直す 今は英語の問題だけ。小数点にコンマを使うドイツ語とギリシャ語は、数字の読み取りがまだうまくいかない
別モデルの解き直し Errolの解き方を見せずに、別のモデルに同じ問題を解かせる 1つ目のモデルと同じ間違いをすると見逃す
判定 どこかで食い違いが出た問題は捨てる ―

作者はこのほか、食い違いやプロンプトインジェクション(AIへの不正な指示の混入)を見つける評価の段階も重ねているとしています。サイトは英語・ドイツ語・ギリシャ語で提供されています。

成果と反応

利用者数などの数字は公表されていません。料金は、無料プランが1日3問・易しい段階のみです。有料は1人用のLearnerが月6.99ドルか年66.99ドル、保護者向け機能付きのParentが月9.99ドルか年95.99ドル、子ども4人まで使えるFamilyが月14.99ドルか年143.99ドルです。

Hacker Newsの反応は、学び方そのものへの問いと、作りへの注文に分かれました。前者では、ある利用者が「批判的に考える練習にはなるが、いつそれを使うべきかの練習にはならない」と指摘し、Khan Academyや学校の授業にも同じ種類の問題があるという声も出ました。後者では、例題の誤りが易しすぎるという感想や、サイトの文章がAIで書かれたように見えるという批判がありました。

当初は解く速さも点数に入れていました。速さは深く考えることを妨げるとの指摘に、作者は急ぐ癖がつくとして速さの要素を外したと返信しています。作者自身は、人の間違いを見つけることが自分で解くこととは違う学びになるのかを、教える立場の人に聞きたいとしています。

日本のビジネスへの影響

現時点で日本語には対応しておらず、問題も米国の学習基準に沿っています。ブラウザとiOS、Androidで使えるため、英語の算数教材として家庭で試すことはできます。

参考になるのは、教育サービスの企画者と、生成AIで問題やクイズを作る開発者です。「AIに正しく答えさせる」のではなく「AIの誤りを教材にする」という逆の発想と、AIが作った問題を出す前に決まった計算と別モデルの二重チェックに通して怪しいものを捨てる作り方は、日本語の教材や社内研修の確認テストにも応用できます。

今すぐやれることは、登録なしで遊べるホームページの例題を1問解き、誤りの見せ方と説明の書かせ方を確かめることです。注意点は、作者自身が認めるとおり、2つのモデルが同じ誤りをすれば検証をすり抜けることです。日本語で同じ仕組みを作るなら、数字や単位の表記揺れの読み取りを先に固める必要があります。Claudeなどのモデルを組み込む費用はAI API(LLM)の料金比較で確かめられます。

一次情報

AIデジマは、公式発表・X投稿・論文などの一次情報を起点に、複数の情報源を照合して日本語でまとめています。情報の収集・翻訳・下書き・照合にはAIを使い、編集方針と最終責任は編集長が負います(AIの活用について)。誤りを見つけた場合は訂正のご連絡をお願いします。

この記事の編集責任者

田中智大

AIデジマ編集長/株式会社ドイル 代表取締役

株式会社ドイル代表。元Googleで広告営業・コンサルティングに従事し500社以上を担当。広告運用とAIエージェント開発を手がける。