Python

機械学習

【Python】AI生成画像で画像分類させてみた【学習プログラム実装編】

前回の記事ではStable DiffusionBiRefNetOllamaを組み合わせることで画像生成~COCOフォーマットのデータセットを一括で作成する手順について解説しました。今回は、実際にAI画像のみで作成したデータセットを読み込み、...
画像処理

【Python】RANSACアルゴリズムによる楕円検出【OpenCV】

以前の記事ではRANSACアルゴリズムを使った直線検出について解説しました。実際に直線検出を行う場合、ハフ変換で済んでしまう場合も多いので、別の例でもRANSACの効果を確認してみます。そこで、今回は楕円検出を行い、RANSACアルゴリズム...
ソフトウェア

【Python】CodexでVS CodeからWordPressへ自動投稿してみた

ブログを書いていると、たまに「自動でブログ記事を書いてWordPressへの投稿までできればいいのに」と思うことがあります。WordPressへ記事を投稿する場合、通常は管理画面を開いて記事を作成・投稿します。一方で、WordPressには...
機械学習

【Python】AI画像でCOCOデータセットを自動生成する方法【Ollama+Stable Diffusion+BiRefNet】

Deep Learningで画像認識を行う場合、まずは画像を集めて学習用のデータセットを作る必要があります。画像を集めたら、被写体の位置やラベル付けを行う「アノテーション」という作業も必要になります。これらの作業を大量の画像に対して行う必要...
プログラミング

【Python】BiRefNetで画像の背景を除去する方法

画像から背景を消去して被写体だけの画像を作る場合、背景差分処理などが思い浮かぶと思います。背景差分処理とは、あらかじめ背景だけの画像を撮っておいて、被写体が写っている画像との差分を取ることで被写体の領域だけを抽出するという手法です。ただ、同...
機械学習

【Python】OllamaとStable Diffusionで画像生成を自動化してみる【ローカル環境】

画像認識の学習を行う上でデータセットを大量に用意するのが難しい場合があります。既存のデータセットを利用するという方法もありますが、商用利用できない場合も多いし、汎用的なデータで学習されているので、自分用に特化させる場合は自前のデータでファイ...
画像処理

【Python】RANSACアルゴリズムによる直線検出【OpenCV】

RANSACアルゴリズムは、外れ値を多く含むデータからモデルに適合する点を抽出して最適なモデルを推定する手法です。画像処理では直線や楕円検出に用いられます。例えば左のような画像から直線検出したい場合、そのまま直線を当てはめると外れ値に引っ張...
プログラミング

【Real-ESRGAN】Stable Diffusionで4K画像を生成する方法【Python】

Stable Diffusionはデフォルト設定で4K画像を出力することを想定していません。SD1.5で512×512、SDXLでも1024×1024pxが基準の解像度です。直接4K(3840×2160)を指定することもできますがVRAMの...
環境構築

【Python】Real-ESRGANの環境構築

今回は画像アップスケーラー「Real-ESRGAN」の環境構築についてまとめました。Stable Diffusionなどで生成した画像を4Kなどに拡大する場合、Resizeのみではディテールの復元はできません。Real-ESRGANはAIで...
環境構築

【Python】Stable Diffusionを導入して画像生成してみた【環境構築】

PCを新調してGPUも搭載したので画像生成AIを試してみたくなりました。画像生成はクラウドなら有料で制限ありのサービスが多い中Stable Diffusionはローカル環境なら回数制限なしで利用できるようです。導入方法もいくつかあるようです...