HANDS-ON AI TUTORIALS

AI実装|動かして学ぶ

画像処理・自然言語処理・生成AIを、Google ColabとPythonで実際に動かしながら学ぶ実践チュートリアル集です。環境構築の手順からデモ実装まで、コピーして試せる形でまとめています。

🐍 Python📓 Google Colab対応🖼 画像 / ✍ 言語 / 🎨 生成AI💰 すべて無料

✨ 生成AI・LLMを使う

ChatGPT・Claude・LLM・Hugging Face transformersなど、大規模言語モデルを使いこなす実装チュートリアル。

2024年6月18日

【LangChain v0.2入門】第5回:エージェントの構築

2024年6月17日

【LangChain v0.2入門】第4回:RAGの構築

2024年6月16日

【LangChain v0.2入門】第3回:チャットボットの作り方

2024年6月15日

【LangChain v0.2入門】第2回:シンプルな言語モデル(LLM)アプリケーションの構築

2024年6月14日

【LangChain v0.2入門】第1回:LangChainのユースケース

2024年5月24日

【LLM】Google ColabでPhi-3-mediumを動かす(日本語)

2024年4月26日

【LLM】Google ColabでPhi-3-miniを動かす(日本語)

2024年4月23日

【日本語LLM】Google Colabでsuzume-llama-3-8B-japanese-ggufを動かす

2024年4月19日

【日本語LLM】Google ColabでJapanese-Starling-ChatV-7Bを動かす

2024年3月9日

ChatGPTを超える性能?話題のAI『Claude 3』を徹底検証!

2024年2月17日

【日本語LLM】Google ColabでDeepreneur-blue-lizardを動かす

2023年11月2日

【日本語LLM】約50,000文字の日本語文章を一度に処理できるCyberAgentLM2-7B-Chatのモデルを実装する

2023年11月2日

【日本語LLM】Google Colabでjapanese-stablelm-instruct-ja_vocab-beta-7bを実装する

2023年6月8日

【LLM】DePlotでグラフからテキストに変換する【DePlot】

2023年6月8日

chatgpt-prompt-engineering-for-developersで学ぶプロンプトエンジニアリング【ChatGPT】

2023年5月1日

【LangChainまとめ】LangChainの概要【LLM】

2023年4月28日

「ChatGPT」に対抗? HuggingChatの概要と事例まとめ

2023年4月22日

【GPT-4】今さら聞けない!自律AIエージェント入門【ChatGPT】

🎨 画像・音楽・動画を生成する

つくる系の生成AIを実際に動かすチュートリアル。

🖼 画像生成

2023年11月12日

【Stable Diffusion】Google Colabで SDXLの画像生成を高速化(1秒以下)できるLCMを試す【画像生成】

2023年11月7日

【画像生成】Google Colab で DALL-E 3 のAPIでテキストから画像生成を試す(Stable Diffusionとの比較あり)

2023年10月19日

【Stable Diffusion】SDXLによる画像生成入門【画像生成】

2023年10月15日

【Stable Diffusion】Google ColabでBRA V7の画像生成【画像生成】

2023年10月14日

LLaVA-1.5 で画像からテキストに変換する

2023年5月30日

【Stable Diffusion】BRA V5で画像生成してみる【画像生成】

2023年1月30日

【Text-based Image Editing】InstructPix2Pixでテキストを元に画像を編集する

2022年10月8日

【画像生成2022】Stable Diffusion第4回 〜Dreambooth Concepts Libraryを試してみる〜

2022年9月15日

【画像生成2022】Stable Diffusion第3回 〜日本語のテキストから画像生成(txt2img)を試してみる〜

2022年8月31日

【画像生成2022】Stable Diffusion第2回 〜テキストと画像から画像生成(img2img)を試してみる〜

2022年8月26日

【画像生成2022】Stable Diffusion第1回 〜テキストから画像生成(txt2img)を試してみる〜

2022年4月14日

【MaskGIT】:画像の指定した部分を指定した単語の画像に置き換える

2022年4月8日

【VAE】入力したテキストに応じた画像生成ができる「rq-vae-transformer」を試してみる

🎬 動画生成

2024年7月15日

【LivePortrait】1枚の画像から自然な人物動画を作成するLivePortraitを実装する

2023年12月9日

【動画生成】画像が動き出す!magic-animate入門

2023年2月1日

【Image Diffusion】Tune-A-Videoでテキストから動画生成する

🎵 音楽生成

2023年11月7日

【音声生成】Google Colab で OpenAI API の Text-to-Speech による音声生成を試す(6種類聞き比べ)

2023年7月6日

【音楽生成】Audiocraftで音楽を自動生成する【MusicGen】

2023年3月27日

【音声合成】VOICEVOXで音声ファイルを作成する

👁 画像を認識・解析する

コンピュータビジョンの実装チュートリアル。

※ 記事によっては公開時点のライブラリバージョンを前提にしています。動かない場合は各ライブラリの最新ドキュメントもあわせてご確認ください。

🎯 物体検出・セグメンテーション

2024年2月27日

【物体検出2024】YOLOv9を試してみる 〜導入からデモまで〜

2023年5月6日

【物体検出2023】YOLO_NASを試してみる 〜導入からデモまで〜

2023年4月13日

【Segment Anything②】Google Colabでマスクの自動生成を実装する

2023年4月12日

【Segment Anything】Google Colabでゼロショットセグメンテーションを実装する

2023年1月21日

【物体検出2023】YOLOv8まとめ⑦  物体検出のためのアノテーション

2023年1月20日

【物体検出2023】YOLOv8まとめ⑥  物体検出のためのデータ収集

2023年1月19日

【物体検出2023】YOLOv8まとめ⑤  マスク着用をリアルタイムに判定 〜オープンソースデータセットの学習と評価〜

2023年1月18日

【物体検出2023】YOLOv6(v3.0)まとめ②  推論の引数と座標とスコアの出力

2023年1月17日

【物体検出2023】YOLOv6(v3.0)まとめ①  YOLOv6を試してみる 〜導入からデモまで〜

2023年1月16日

【物体検出2023】YOLOv8まとめ④  YOLOv8における推論結果と座標について

2023年1月15日

【物体検出2023】YOLOv8まとめ③  YOLOv8でセグメンテーションを試してみる

2023年1月14日

【物体検出2023】YOLOv8まとめ②  推論の引数と座標とスコアの出力

2023年1月13日

【物体検出2023】YOLOv8まとめ①  YOLOv8を試してみる 〜導入からデモまで〜

2022年11月27日

【セグメンテーション2022】OneFormerを試してみる 〜導入からデモまで〜

2022年11月22日

【物体検出2022】YOLOv7まとめ第8回 BoT-SORTで物体追跡(MOT)を実装する

2022年8月27日

【物体検出2022】YOLOv7まとめ第7回 Instance segmentationを実装する

2022年8月18日

【物体検出2022】YOLOv7まとめ第6回 姿勢推定(Human Pose Estimation)を実装する

2022年7月29日

【物体検出2022】YOLOv7まとめ第5回 オリジナルデータセットの学習

2022年7月21日

【物体検出2022】YOLOv7まとめ第4回 物体検出のためのアノテーション

2022年7月21日

【物体検出2022】YOLOv7まとめ第3回 物体検出のためのデータ収集

🛠 画像の加工・復元(超解像・ノイズ除去・背景削除など)

2023年1月22日

【フレーム補間】FILMを使ってフレーム補間を実装する

2022年12月13日

【anonymization】DeepPrivacy2 を使って人物写真を匿名化してみる

2022年11月13日

【Matting】Remgbを使って画像から背景を削除する

2022年10月5日

【超解像】SwinIRを使って画像を高解像度化してみる

2022年7月6日

【Python活用】「yt-dlp」を使ってYouTube動画や音楽をダウンロードする

2022年5月17日

🔰YOLOv5で実装する物体検出入門|第7回:動画の物体検出 〜座標やスコアのCSV出力とその応用

2022年4月22日

【Inpainting】E2FGVIを使って動画から人を消してみる

2022年4月14日

【MaskGIT】:画像の指定した部分を指定した単語の画像に置き換える

2022年4月4日

【Denoising】SCUNetによるブラインドノイズ除去を試してみる

2022年2月24日

Robust Video Mattingで高解像度動画からリアルタイムで人物切り抜きを試してみる

2022年2月19日

【🔰はじめての超解像】Real-ESRGANを使って画像を高解像度化してみる

2022年2月15日

【画像修復】Lamaによる写真から人物や自動車を消すInpainting(画像修復)の実装

2022年2月4日

【セグメンテーション】PaddleSegで動画の背景を入れ換えてみる

🧭 分類・追跡・顔・3D

2023年10月22日

【3D】Google colabでDreamGaussianによる3Dモデル生成を実装する

2023年5月11日

【Shap-E】テキストから3Dオブジェクトを作成を試してみる

2022年12月13日

【anonymization】DeepPrivacy2 を使って人物写真を匿名化してみる

2022年11月22日

【物体検出2022】YOLOv7まとめ第8回 BoT-SORTで物体追跡(MOT)を実装する

2022年9月28日

【画像分類2022】🔰ViTで実装する画像分類入門

2022年5月9日

顔写真からアニメーション作成 〜Thin-Plate Spline Motion Model for Image Animation〜

2022年3月29日

【物体検出】YOLOXまとめ|第5回:Motpyによる物体追跡を実装する

2022年3月19日

【物体追跡】motpyでMultiple Object Trackingを実装する

2022年1月7日

【はじめての画像分類】Google ColabでEfficientNetV2を使って画像分類

🧰 Python実務ツール

PDF処理・Python基礎・時系列分析・音声認識など、実務に効く周辺スキル。

2024年3月5日

【Python活用】arxivライブラリを用いて論文情報を取得する

2023年12月18日

【Tips🔰】Google colabでwikipediaライブラリを用いてwikiの情報を取得する

2023年12月17日

【Tips🔰】Google colabでLaTeX形式の数式の画像を作成する

2023年11月7日

【音声認識2023】Google Colab で「Whisper large-v3」を使ってYouTube動画を文字起こしする(large-v2との精度比較あり)

2023年6月27日

【PDF】PDFファイルの論文から画像を出力する

2023年4月16日

「Faster Whisper」で英語のYouTube動画を日本語で文字起こしする

2023年4月15日

【音声認識2023】音声からテキストへ変換する「Faster Whisper」でYouTube動画の文字起こしを実装する

2022年12月27日

【Tips🔰】Google colabでPDFから表を取り出しCSVファイルを保存する

2022年12月5日

🔰Dartsではじめる時系列分析入門②

2022年12月4日

🔰Dartsではじめる時系列分析入門

2022年11月18日

【Python入門】クラス(Class)の使い方

2022年9月26日

【音声認識2022】音声からテキストへ変換する「Whisper」でYouTube動画の文字起こしを実装する

2022年7月6日

【Python活用】「yt-dlp」を使ってYouTube動画や音楽をダウンロードする