AI Teading - AI体験・学習・実習サイト

インストール不要、ブラウザですぐ試せるAI実習室。絵・音楽・言語・自動運転まで137のAIを体験し、仕組みまで学べます。

DQN車

DQN ベースの自律走行車シミュレータです。このシミュレータは、DQN を活用して車が自分で走行する方法を学習します。

Hands (手)

MediaPipeは手と指を追跡するためのソリューションを提供します。1〜4つの手で21の主要部分の動きを追跡できます。

Face Mesh (顔ネット)

MediaPipe は顔認識ソリューションを提供します。顔の 468 点を推定し、3D 形式に変換して顔に合わせて表示します。

Pose (ポーズ)

MediaPipe はポーズ認識ソリューションを提供します。人体全体で 33 の主要部分の位置を推定し、それらを連結してスケルトンのように見せます。

Face Detection (顔認識)

MediaPipeの顔認識ソリューションは、顔の有無をすばやく検出し、6つの主要部分を表示します。この機能は簡単で処理速度が非常に高速です。

動く人をクリアすぐ実行
韓国語
動く人をクリア

TensorFlowを使用して、リアルタイムで背景から人を削除する機能を提供します。この機能は、人を認識し、背景を学習する過程を通じてシーンから人を削除します。

画像認識

クイックドローの手描きデータセットを学習し、ユーザーの絵が何であるかを認識するゲームです。このゲームはCNNを利用して絵を学習して認識します。

Sketcher (画像認識)すぐ実行
韓国語
Sketcher (画像認識)

CNNを利用してクイックドローの手描きデータを学習し、学習した絵を認識するアプリです。このアプリは100個の絵を認識できます。

クイックドローすぐ実行
韓国語
クイックドロー

ユーザーが問題として提示した絵を描くと、その絵が何なのか学習された人工知能が合うゲームです。

オートドロー

ユーザーが描いた絵が何であるかを予測し、一致する可能性が高いアイコンを提示してユーザーが選択できるようにした描画アプリです。

自動完成の描画 (Magenta)すぐ実行
韓国語
自動完成の描画 (Magenta)

RNNを活用して作成したイヤー描画アプリです。QuickDrawのデータセットを学習し、ユーザーが絵を描くと手描きのように引き継ぐ機能を持っています。

落ちるボールを避ける (DQN)すぐ実行
韓国語
落ちるボールを避ける (DQN)

DQN を活用して空避する方法を学習する過程を示すアプリです。 エージェントはセンサーから情報を受け取り、長く生きているほど多くの報酬を受けます。

飛行機戦争 (DQN)すぐ実行
韓国語
飛行機戦争 (DQN)

DQNを活用して敵飛行機を避ける学習過程を示すアプリです。エージェントはセンサーから情報を受け取り、長く生きているほど多くの報酬を受けます。

スネーク (DQN)すぐ実行
韓国語
スネーク (DQN)

DQNを活用してスネークゲームを学ぶ過程を見ることができます。壁や自分の体にぶつかるとマイナス報酬を、果物を食べるとプラス報酬を受けるように強化学習が進められました。

2048 AIすぐ実行
韓国語
2048 AI

MCTS アルゴリズムを使用して 2048 ゲームを学習する過程を見ることができます。一度の動きに多くのシミュレーション数を提供すると、高い確率で 2048 に達することができます。

機械学習ゴリラ

指導学習アルゴリズムを使用してゴリラのゲームプレイ方法を教えました。 TensorFlowで作成した単純なニューラルネットワークを使用しました。

テトリス AI

CNNを活用してテトリスゲームを学習する人工知能を作成しました。チャンピオンの試合データと同様に、ブロックをドロップするように繰り返し訓練されました。

絵文字宝探しすぐ実行
韓国語
絵文字宝探し

提示された絵文字のようなものを周辺で探すゲームです。CNNを介して画像を予測し、予測と正解(絵文字)の一致を確認します。

ティーチャーブルマシンすぐ実行
韓国語
ティーチャーブルマシン

誰もが機械学習モデルを簡単かつ迅速に作成できるように設計されたウェブベースの機械学習学習ツールです。画像、オーディオ、ポーズモデルを作成できます。

ピアノ作曲 RNNすぐ実行
韓国語
ピアノ作曲 RNN

Performance RNN モデルを活用して、表の使用頻度を参考に曲を作成します。モデルは LSTM を使用して音楽構造とパターンを学習しました。

アクション認識格闘ゲームすぐ実行
韓国語
アクション認識格闘ゲーム

TensorFlowとカメラを使った動き認識でキャラクターを操縦できるゲームです。ゲームキャラクターがユーザーの行動に沿って相手を攻撃します。

パックマン機械学習すぐ実行
韓国語
パックマン機械学習

画像認識を通じて方向を操作できるようにしたパックマンゲームです。 事前訓練されたモバイルネットモデルを4方向の動き認識に活用しました。

Keras.js (ブラウザで動く深層学習)

Kerasは、人工知能を簡単かつ迅速に実装するのに役立つディープラーニングライブラリです。デモでは、ブラウザでKerasの学習プロセスとパフォーマンスを確認できます。

テンソルフローの可視化

TensorFlowで事前トレーニングされたディープラーニングモデルをロードして、3Dビジュアライゼーションシーンに出力します。各モデルの処理プロセスを可視化して表示できます。

CNN ビジュアル説明

ユーザーが CNN の内部動作を理解しやすくするために実装したプログラムです。画像認識プロセスを段階的に視覚化して表示できます。

GAN ビジュアル説明すぐ実行
韓国語
GAN ビジュアル説明

GANの学習プロセスをインタラクティブなビジュアライゼーションツールでリアルタイムで見ることができるプログラムです

GAN アニメ

AnimeGANモデルを利用して風景写真をアニメーション化できるサービスです。

RNN 手書きすぐ実行
韓国語
RNN 手書き

LSTMを活用して、ユーザーが作成した文字のストロークを記憶し、それに基づいて予測された文字を表示します。

スケッチを写真にすぐ実行
韓国語
スケッチを写真に

Pix2Pix GANモデルを利用してスケッチなどのソース画像を入力して他の形式の画像に変換するサービスです。

Fuzzy (自律走行の倫理問題)

自律走行中に発生する可能性のある倫理的な問題の状況をゲーム形式で表示するアプリです。正解があるわけではなく、他の人の選択も確認できます。

ChatGPT (OpenAI)すぐ実行
韓国語
ChatGPT (OpenAI)

OpenAIの代表的な対話型AIです。最新のGPT-5モデルを搭載し、テキストだけでなく音声で会話したり、画像を見て分析したり、絵を描くマルチモーダル機能を提供します。

Gemini (Google)すぐ実行
韓国語
Gemini (Google)

Googleの最新マルチモーダルAIモデルであるGemini(旧: Bard)です。テキスト、コード、画像を理解して処理でき、Googleサービスと連携して様々な情報を提供します。

Copilot (Microsoft)すぐ実行
韓国語
Copilot (Microsoft)

GPT-5をベースにしたMicrosoftのAIアシスタント(旧: Bing Chat)です。検索エンジンBingと結合され、最新情報に基づいて回答し、DALL·E 3を通じて絵も描きます。

Wrtn (AIポータル)すぐ実行
韓国語
Wrtn (AIポータル)

GPT-5、Claude 3.5など、世界中の有名な最新AIモデルを一箇所で無料で選択して使用できる韓国のAIポータルサービスです。

Adobe Firefly (画像生成)

Adobeが提供する画像生成AIです。テキストを画像に変換するだけでなく、生成塗りつぶしなど様々な機能を体験できます。

Suno (作曲AI)

テキストを入力するだけで、歌詞、ボーカル、伴奏を含む高品質な曲を作ってくれる現在最も人気のある音楽生成AIです。

Claude 3 (クロード)すぐ実行
韓国語
Claude 3 (クロード)

ChatGPTの強力なライバルで、韓国語の作文能力に優れ、長い文脈を理解する能力に優れた対話型AIです。

Blob Operaすぐ実行
韓国語
Blob Opera

機械学習で訓練された4匹のブロブ(Blob)たちが作るオペラです。マウスで高低と母音を調節するとリアルタイムで和音を作って歌います。

Animated Drawings

Meta(Facebook) AI研究所で公開したプロジェクトで、あなたが描いたキャラクターの絵をアップロードすると、踊ったり走ったりするアニメーションにしてくれます。

どっちの顔が本物?

2枚の写真のうち1つは実際の人で、もう1つはAIが生成した偽の顔です。AI画像を区別する能力をテストするゲームです。

Semantris (単語連想AI)

Googleが作った単語連想ゲームです。AIが単語の意味と文脈をどれだけよく理解しているかゲームを通してテストしてみることができます。

Viola the Bird (AIチェロ演奏)すぐ実行
韓国語
Viola the Bird (AIチェロ演奏)

チェロとバイオリンの演奏データを学習したAI鳥と一緒に演奏してみてください。マウスの動きに合わせて、弓をつける動作と音程をAIがリアルタイムで生成します。

Paint With Music (絵演奏)すぐ実行
韓国語
Paint With Music (絵演奏)

キャンバスに絵を描くと、その位置と楽器によって音楽が演奏されます。視覚的要素がどのように聴覚的要素に変換されるかを体験できる共感覚的AI実験です。

FreddieMeter (ボーカル分析)

フレディ·マーキュリーの声と私の声がどれくらい似ているかAIが分析してくれます。音程、音色、メロディーを分析して点数をつけてくれます。

トーン・トランスファー (楽器の音色変換)

歌声や物を叩いた音を、フルート・サックス・トランペット・バイオリンなどの楽器の音に変換するGoogle Magentaの実験です。各楽器モデルは実際の演奏者の10分間の録音で学習されており、奏者の息づかいや弓の擦れる音まで再現されます。

バッハ・ドゥードル (バッハ風の和声づけ)

2019年のバッハの誕生日に公開された、Google初のAIドゥードルです。ユーザーが作った2小節のメロディに、機械学習モデルがバッハ風の和声をつけてくれます。バッハのコラール306曲で学習したCoconetというモデルが使われています。

ボーカルリムーバー (曲から歌声を分離)すぐ実行
韓国語
ボーカルリムーバー (曲から歌声を分離)

曲のファイルをアップロードすると、AIがボーカルと伴奏を分離してくれるウェブツールです。歌声を除いたカラオケ用トラックと、歌声だけを残したアカペラトラックをそれぞれ受け取れます。処理には通常10秒ほどかかると案内されています。

TTSMaker (無料テキスト読み上げ)すぐ実行
韓国語
TTSMaker (無料テキスト読み上げ)

入力した文章を人の声で読み上げ、音声ファイルにしてくれる無料ツールです。韓国語をはじめ多くの言語とさまざまな声を選べ、作った音声は商用にも利用できると案内されています。

ロー・ファイ・プレイヤー (部屋の物で音楽づくり)

ブラウザの中の小さな部屋で物をクリックしながらLo-Fiヒップホップを作るMagentaの実験です。部屋の中央のテレビはメロディを混ぜるMusicVAE、隣のラジオは新しいメロディを作るMelodyRNNにつながっており、押すたびに音楽がリアルタイムで変わります。

ウェブ音声認識デモ (Web Speech API)

ブラウザに組み込まれた音声認識機能の動きを見せるGoogleのデモページです。話すとその場で文字に書き起こされ、認識する言語を韓国語を含む多くの言語から選べます。

waifu2x (画像の拡大・ノイズ除去)すぐ実行
韓国語
waifu2x (画像の拡大・ノイズ除去)

畳み込みニューラルネットワーク(CNN)で二次元画像の解像度を上げるツールです。イラストだけでなく写真にも対応し、拡大と同時に JPEG 圧縮によるノイズも軽減できます。小さな画像を拡大したときにジャギーがどれだけ減るかを見比べられます。

Say What You See (画像プロンプトの練習)すぐ実行
韓国語
Say What You See (画像プロンプトの練習)

Google Arts & Culture Lab がアーティストの Jack Wild と共に作った実験です。AI が生成した画像を見て言葉で説明すると、その説明がプロンプトとなって新しい画像が生成されます。元の画像とどれだけ似た結果が出るかで、自分の説明の正確さが分かります。

Palette.fm (白黒写真の着色)

白黒写真に色を付ける AI ツールです。21種類以上のカラーフィルターから選んだり、キーワードを入力して色を自分で調整したりできます。古い家族写真や歴史的な写真に色が付くとどう見えるかを確かめられます。

remove.bg (写真の背景除去)すぐ実行
韓国語
remove.bg (写真の背景除去)

写真から人物や物だけを残し、背景を消してくれるツールです。画像をアップロードすると、被写体と背景の境界を自動で見つけて切り抜きます。髪の毛のような複雑な境界を AI がどこまで見分けられるかを確かめられます。

Inpaint-web (写真の中の物を消す)

写真の消したい部分を塗ると、その場所を周囲の背景で自然に埋めてくれるツールです。モデルがブラウザー内で直接動くため、写真をサーバーへ送りません。消した箇所を AI がどう想像して埋めるのかを見られます。

Segment Anything Playground (画像・動画の物体分離)

Meta が作った SAM 3 モデルをウェブ上で試せる体験スペースです。画像や動画で探したい対象を言葉で入力すると、画面内の該当する物体をすべて見つけて領域として切り出します。切り出した領域にぼかし、複製、輪郭線などの効果をワンクリックで適用できます。

Transformer Explainer (Transformer の仕組み)

GPT 系の言語モデルが次の単語をどう選ぶのかを段階ごとに見せる学習用の可視化です。ブラウザーで GPT-2(small)を実際に動かし、入力した文がトークンと埋め込みに変わり、自己注意と MLP を経て次の単語の確率が出るまでの流れを追えます。言語モデルが魔法ではなく「次に来る可能性が最も高い単語」を計算する仕組みだと理解できます。

LLM Visualization (言語モデルの3D解剖)

GPT 言語モデルの内部を3次元で展開し、上から下へたどっていく解説です。パラメータが8万5千個しかない nano-gpt から始め、「C B A B B C」のような文字列をアルファベット順に並べ替える単純な課題をモデルがどう処理するかを見ます。数値が埋め込みになって各層を通り、次のトークンの確率になるまで、層ごとにどんな計算が起きるかをつかめます。

꼬맨틀 (韓国語の単語類似度あてゲーム)すぐ実行
韓国語
꼬맨틀 (韓国語の単語類似度あてゲーム)

その日の正解の単語を当てる韓国語の単語ゲームです。単語を入力すると正解と意味がどれだけ近いかを -100 から +100 の類似度スコアで教えてくれ、上位1,000語に入れば順位も表示されます。綴りではなく意味で単語を比べるワード埋め込みとは何かを、遊びながら体感できます。

Infinite Craft (単語を組み合わせる遊び)

水・火・風・土の4つから始め、要素を2つずつ組み合わせて新しい言葉を作っていく遊びです。2つの言葉を重ねると、AI がその組み合わせに合う新しい言葉と絵文字を生成します。作ったものは「Discoveries」の一覧にたまり、どこまで進んだかを見られます。

ガンダルフ(プロンプト・セキュリティのゲーム)

「ガンダルフ」というチャットボットに話しかけ、隠されたパスワードを聞き出すゲームです。1つのレベルを突破するたびにガンダルフの防御が強くなり、同じ手口では次に進めません。AIがどんな言葉に応じ、どう防ぐのかを体験しながら、AIセーフティの基本を学べます。

LMアリーナ(AIモデル比較)

同じ質問に対して複数のAIモデルがどう答えるかを比べるサイトです。画面上部の「Battle Mode」からプロンプトを送ると複数モデルの応答を並べて比較でき、サイトはモデルのランキングも公開しています。サイト名は画面上では「Arena」と表示されます。

バルン(韓国語スペルチェッカー)すぐ実行
韓国語
バルン(韓国語スペルチェッカー)

韓国語の文章のスペル・分かち書き・文法をAIが校正する韓国発のサービスです。BAIKAL.AIが開発し、スペルチェックのほかに形態素解析や単語分割(トークナイザー)も同じサイトで利用できます。固有名詞や専門用語はユーザー辞書に登録して検査に反映できます。

Lilys AI(動画・文書の要約)すぐ実行
韓国語
Lilys AI(動画・文書の要約)

YouTube動画やPDF、Web文書、音声を入れると要点を要約してくれる韓国発のサービスです。要約だけでなく、内容をやさしく解説したり、資料をもとに続けて質問したりできます。動画はタイムスタンプ付きのスクリプトと韓国語訳を並べて表示します。

ChatPDF(PDFと対話する)すぐ実行
韓国語
ChatPDF(PDFと対話する)

PDFファイルをアップロードして、その内容について質問できるサービスです。回答には引用が付き、PDFのどの部分を根拠にしたのかをすぐ確認できます。PDFのほかWord、PowerPoint、Markdown、テキストファイルにも対応しています。

Papago(NAVERの翻訳サービス)すぐ実行
韓国語
Papago(NAVERの翻訳サービス)

NAVERが提供する翻訳サービスで、韓国語を中心に英語・日本語・中国語など多くの言語に対応します。テキスト翻訳のほか、画像・文書・音声・ウェブサイト翻訳のタブが分かれており、用途に合わせて選べます。翻訳結果には発音再生や翻訳評価の機能が付いています。

Ai2 プレイグラウンド(オープンモデル体験)

アレンAI研究所(Ai2)が公開したOlmoモデルと直接対話できる場所です。画面には使用中のモデル名が表示され、取得時点ではOlmo 3.1 32B Instructが指定されていました。ツール呼び出し(tool calling)を有効にして自分でツールを追加することもできます。

DeepL翻訳すぐ実行
韓国語
DeepL翻訳

長い文章を自然に訳すことに重きを置く翻訳サービスで、100以上の言語に対応すると案内しています。テキスト翻訳のほかファイル翻訳や音声翻訳のモードがあり、訳文を整えるDeepL Writeも提供されます。敬体・常体の切り替えや用語集など、文体を調整する機能も備えています。

Perplexity(AI検索)すぐ実行
韓国語
Perplexity(AI検索)

質問を文章で書くと、ウェブを調べて整理した答えを返すAI検索サービスです。入力欄の下で検索モードや使用モデルを選べ、音声入力ボタンもあります。左メニューにはスペース、アーティファクト、履歴などの項目があり、以前のやり取りを開き直せます。

ガウシアン・スプラット・ビューア(3Dシーン閲覧)

複数の写真から作られた3Dシーン(ガウシアン・スプラット)をブラウザ上で自由に見渡せるビューアです。Kevin Kwok氏が作成し、コードはGitHubで公開されています。カメラを動かしてシーンの中を歩き回るように観察でき、画面の隅にフレームレートが表示されます。

Marble (3Dワールド生成)

World Labsが公開している3Dワールド生成サービスです。文章や画像、動画、3D構造を入力すると、歩き回れる3D空間が作られます。他のユーザーが作ったワールドを集めたギャラリーも用意されています。

Odyssey (AIリアルタイムシミュレーション)

文章で説明した場面をAIがリアルタイムの映像として生成する実験的なサービスです。あらかじめ作られた動画を再生するのではなく、プロンプトを受け取ってその場で場面を描き続けます。作ったシミュレーションはアカウントごとの一覧に残ります。

Detect Fakes (ディープフェイク判別実験)

米ノースウェスタン大学コンピュータサイエンス学科が運営するオンライン研究実験です。短い演説文を読み、民主党側の発言か共和党側の発言かを当てる課題が出され、判断を助ける「説明ヒント」も表示されます。人が本物と偽物、あるいは発言の出所をどれだけ見分けられるかを調べる研究です。

Content Credentials (コンテンツ来歴の確認)すぐ実行
韓国語
Content Credentials (コンテンツ来歴の確認)

画像や動画ファイルに埋め込まれたContent Credentials、つまり制作・編集の履歴情報を開いて確認するツールです。ファイルをアップロードすると、いつどのツールで作られ、どう変更されてきたかが段階的に表示されます。AI生成物の来歴表示を実際に確かめるのに向いています。

Free AI Video Upscaler (ブラウザ動画高解像度化)

動画や画像をブラウザ内でそのまま高解像度化する無料のオープンソースツールです。Anime4KやRealESRGANといった超解像アルゴリズムをWebGPUに移植して動かすため、ファイルはサーバーに送られません。アニメのような描線のはっきりした映像で特によく働くと説明されています。

SuperSplat (3Dガウシアンスプラット編集ツール)

3Dスキャンの成果物であるガウシアンスプラットのファイルを、ブラウザ上で開いて整える編集ツールです。シーンを読み込むと3Dビューポートで回して確認でき、不要な点を選んで消したり、位置・回転・サイズを調整したりできます。インストール不要でそのまま動くウェブツールです。

Kling AI (動画・画像生成)

文章や画像を入力して動画を作る生成系の制作ツールです。動画生成のほかに画像生成、モーションコントロール、キャンバス、アバターといった機能が一つの画面にまとまっています。トップ画面には他のユーザーが投稿した作品が一覧で流れます。

Rokoko Vision (ウェブカメラモーションキャプチャ)

ウェブカメラの映像やアップロードした動画から人の動きを読み取り、3Dアニメーションデータに変換するモーションキャプチャツールです。専用センサーなしでカメラだけで動きを記録し、キャラクターに適用できます。画面には、サービスが「Rokoko Create」へ移行中だという案内も表示されています。

Fingerspelling (アメリカ手話の指文字練習)

ウェブカメラの前で手の形をまねしながら、アメリカ手話(ASL)の指文字アルファベットを覚えるゲームです。韓国手話ではなくアメリカ手話のA〜Zの手形を扱います。米国ろう児協会(American Society for Deaf Children)が制作し、手の認識にはMediaPipe Handsを使っています。

3D Portrait (人物写真の3D変換)

人物写真1枚から深度情報を推定し、立体的に動く3D写真を作るTensorFlow.jsのデモです。元画像、人物の切り抜き結果、深度マップ、3D結果を並べて表示するので処理の流れを目で確認できます。結果はGIFやWebMでダウンロードできます。

Tiktokenizer (トークン分割の体験)

言語モデルが文章をどんな単位(トークン)に分割するかを目で確かめるツールです。文章を入力すると、トークン数と色分けされたトークンの断片、そして各トークンの数値IDがすぐに表示されます。会話形式が実際にどんな特殊記号とともにモデルへ渡されるかも確認できます。

3D CNN 可視化 (手書き数字認識)

手書き数字を当てる畳み込みニューラルネットワーク(CNN)の内部を3次元に展開して見せる可視化です。入力層から畳み込み層、ダウンサンプリング層、全結合層、出力層へと進むにつれ、絵が次第に小さく抽象的な値へ要約されていく過程を見られます。ニューラルネットワークが一つの黒い箱ではなく、役割の異なる層のつながりであることを理解できます。

Survival of the Best Fit (採用アルゴリズムの偏りゲーム)

採用に使われる人工知能が人の偏りをそのまま受け継ぐ過程を、6分ほどのゲームで見せる教育用の教材です。訪問者は会社の代表として自分で応募者を選んでいきますが、採用を速めるために自分の選択を学習した人工知能へ審査を任せることになります。その後、人工知能が特定の応募者をふるい落とし始めるのを見て、偏りはアルゴリズムが新たに作るのではなく学習データを通じて移ってくるのだと理解できます。

モラル・マシン (自動運転の倫理判断)すぐ実行
韓国語
モラル・マシン (自動運転の倫理判断)

ブレーキの効かない自動運転車が誰をはねるかを決めなければならない場面を次々に示し、訪問者が外部の観察者としてどちらの結果を受け入れるか選ぶサイトです。シナリオをすべて終えると、自分の判断の傾向がほかの回答者と比較され要約として表示されます。人が傷つく判断を機械に任せるとき何を基準にすべきか、そしてその基準が人によってどれほど違うかを確かめられます。

Fill in the Blank (言語モデルは何を学んだのか)

Google PAIRが作った視覚的な解説で、言語モデルBERTに文の空欄を埋めさせ、モデルが世界について何を学んだのかを調べます。「in texas, they like to buy ___」のように地名を一つ変えるだけで候補の単語と確率の順位が変わる様子を自分で確かめられます。言語モデルの予測が中立的な知識ではなく学習した文章に含まれる統計的な連想であり、そのため社会的な偏りまで一緒に学んでしまうことを理解できます。

MLU-Explain (機械学習の概念を図で学ぶ)

Amazonの教育プログラムMachine Learning Universityが作った、機械学習の概念を図で説明する記事集です。ニューラルネットワーク、線形・ロジスティック回帰、決定木とランダムフォレスト、適合率と再現率、ROCとAUC、交差検証、バイアスとバリアンスのトレードオフなど14本の記事が、グラフを自分で動かせる形でまとめられています。数式だけではつかみにくかった概念が図の上でどんな形に見えるのかを確かめられます。

Embedding Projector (埋め込み空間の探索)

単語などのデータを数百次元のベクトルで表した埋め込みを、2次元や3次元に落として見せるTensorFlowのツールです。開くと200次元のWord2Vec単語1万個が点として並んでおり、単語を一つ選ぶとそれに最も近い単語が一覧で表示されます。意味の近い単語が空間の中で近くに集まるという埋め込みの基本的な性質を目で確かめられます。

wevi (単語埋め込みの学習を観察する)

word2vecが単語ベクトルを作っていく過程を一段階ずつ目で追える道具です。「eat|apple, drink|milk」のようなごく小さな学習データを入れて学習を進めると、入力・出力の重み行列のマスの色が少しずつ変わり、下のPCA図で単語の点が位置を定めていきます。埋め込みがあらかじめ決まった値ではなく、繰り返しの学習を通じて少しずつ作られた結果であることを理解できます。

Google 機械学習集中講座 (韓国語版)すぐ実行
韓国語
Google 機械学習集中講座 (韓国語版)

Googleが提供する機械学習の入門講座で、本文も目次も韓国語で読める、このカタログでは数少ない正式な韓国語コースです。線形・ロジスティック回帰、分類、データの扱い、ニューラルネットワーク、埋め込み、大規模言語モデル、本番のMLシステム、公平性まで、モジュールごとに目安の学習時間が示されており順に進められます。リンク先の「ニューラルネットワーク: インタラクティブ演習」では隠れ層や重みを自分で書き換え、どの変更がどのノードの計算に影響するかを確かめられます。

Interactive Deep RL Demo (強化学習エージェントの適応実験)

深層強化学習で訓練された二足歩行ロボット、チンパンジー、魚のエージェントをさまざまな地形に置き、どう動くかを観察するデモです。用意された地形を読み込むだけでなく、地面と天井を自分で描いて、エージェントが学習時に見たことのない状況を作ることもできます。学習した行動が慣れた環境ではうまく働いても、環境が変わると崩れうるという汎化の問題を自分の目で確かめられます。

Attention Viz (Transformerのアテンション全体地図)

Transformerモデルのアテンションのパターンを、層とヘッドごとに一画面に並べて比べる可視化ツールです。クエリベクトルとキーベクトルを同じ空間に投影するため、ヘッドごとにまったく違う形のパターンが現れるのを一目で見られます。アテンションヘッドがそれぞれ別の関係を捉えていることを確かめられますが、Transformerの構造をすでに知っている学習者向けです。

REINFORCEjs (強化学習アルゴリズムのデモ)

強化学習のアルゴリズムをブラウザでそのまま動かせるようにしたJavaScriptライブラリのデモ集です。格子世界で動的計画法や時間差学習(SARSA・Q学習)によって価値が定まっていく過程と、ニューラルネットワークを使う深層Q学習(DQN)のエージェントがPuckWorldやWaterWorldで動く様子を見られます。報酬と罰だけを与えても行動が次第に洗練されていく、強化学習の基本の仕組みを確かめられます。

Netron (モデル構造ビューア)

学習済みのニューラルネットワークのモデルファイルを開き、その層構造を図として表示するツールです。どの層がどんな順序でつながっているかを画面でたどって見ることができます。

WebLLM Chat (ブラウザで動く対話AI)すぐ実行
韓国語
WebLLM Chat (ブラウザで動く対話AI)

言語モデルをブラウザの中で直接動かして対話するサービスです。会話の内容がサーバーに送られず、自分のパソコンの中だけで処理される点が他のチャットボットと違います。画面は韓国語に対応しています。

The Life Engine (細胞進化シミュレーション)

さまざまな色の細胞でできた生き物が繁殖し、競争しながら進化する2次元の仮想生態系です。色ごとに役割が異なり、世代を重ねるうちに突然変異で姿や行動が変わっていく過程を見ることができます。

TensorFlow プレイグラウンド

小さなニューラルネットワークをブラウザの中で実際に学習させてみる実習ページです。層とニューロンの数、活性化関数、学習率を変えると、データを分ける境界線がどう変わるかを目で確認できます。ダウンロードするモデルがないので、開いてすぐ動きます。

MediaPipe Tasks (AI認識デモ集)

GoogleのMediaPipeの認識機能15種類を1ページで順に試せるデモ集です。顔・手・姿勢の検出やジェスチャー認識、画像分類と領域分割、物体検出、音の分類、言語判定や文章分類まで含まれています。計算はブラウザの中で行われます。

トークナイザー・プレイグラウンド

入力した文がAIモデルの中でどんな断片(トークン)に分けられるかを色で見せるページです。GPT-4、Claude、Llama 3、Gemma、Mistral、BERT、T5など13種類のモデルのトークナイザーを選んで比較できます。

画風を移す (Style Transfer)

写真1枚と絵1枚を入れると、その絵の画風で写真を描き直してくれるページです。計算はTensorFlow.jsによりブラウザの中で行われるため、写真がサーバーに送られることはありません。2つの画風を混ぜて適用するタブもあります。

Neataptic (神経進化の遊び場)

ニューラルネットワークを世代を重ねて進化させる仕組みを、いくつかのデモで見せる資料集です。目標を追う エージェント、Agar.io風のゲームAI、色の分類といった例があり、学習ではなく「選択と突然変異」で性能が良くなる過程を見られます。