はじめに transformerとtext_encoderをSDNQ(SD.Next Quantization)で4bit量子化しました。 torchao、bitsandbytesでもやってみましたが、4bit量子化は実行できても実際にモデルを実行する時にgroup_offloadingのところで躓いてうまくできませんでした。 環境…
はじめに touch-sp.hatenablog.com 前回の続きです。Two-stage distilled generationでは縦、横それぞれ倍の動画が作成されます。 latent_upsampleのダウンロード uvx hf download Lightricks/LTX-2.5-Diffusers \ --local-dir LTX-2.5-Diffusers \ --includ…
はじめに touch-sp.hatenablog.com 前回はモデルをロードするたびに量子化を行っていました。それでは無駄が多いので量子化したモデルを保存して再利用することにしました。 量子化 text_encoderの量子化と保存 import torch from transformers import Gemma…
環境 Ubuntu 24.04 on WSL2 Python環境構築 uvを使用しています。pyproject.tomlを載せておきます。 [project] name = "ltx" version = "0.1.0" description = "Add your description here" readme = "README.md" requires-python = ">=3.13" dependencies =…
llama.cpp 環境 Ubuntu 24.04 on WSL2 ビルド llama.cppはこちらの方法でビルドしました。 モデルのダウンロード uvx hf download meta-models/Muse-Glimmer-30B-GGUF \ --local-dir Muse-Glimmer-30B-GGUF \ --include "muse-glimmer-30B-kquant-17gb.gguf"…
環境 Ubuntu 24.04 on WSL2 Python環境構築 uvを使用しています。pyproject.tomlを載せておきます。 [project] name = "ltx" version = "0.1.0" description = "Add your description here" readme = "README.md" requires-python = ">=3.13" dependencies =…
環境 Ubuntu 24.04 on WSL2 Python環境構築 uvを使っています。 pyproject.tomlを載せておきます。 [project] name = "ocr" version = "0.1.0" description = "Add your description here" readme = "README.md" requires-python = ">=3.12,<3.13" dependenc…
使用したPC こちらのPCを使っています。 Windows 11 Home Core i7-12700H GeForce RTX 3080 Laptop VRAM 16GB RAM: 32GB SSD: 1TB NVMe SSD 環境 Ubuntu 24.04 on WSL2 事前準備 Ubuntuに以下をインストールする必要がありました。 sudo apt install -y buil…
環境 Ubuntu 24.04 on WSL2 Python環境構築 事前にCUDA toolkitをインストールしておく必要はありません。 git clone https://github.com/Aratako/Irodori-TTS.git cd Irodori-TTS uv sync --extra cu128 # NVIDIA CUDA 12.8 実行 Voice cloning uv run --no…
環境 Windows 11 Python環境構築 pyproject.tomlを載せておきます。 uv syncで簡単に構築できます。 [project] name = "voice-clone" version = "0.1.0" description = "Add your description here" readme = "README.md" requires-python = ">=3.13" depend…
OS環境 Ubuntu 24.04 on WSL2 環境構築 sudo apt install python3.12-dev python3.12-venv build-essential python3 -m venv .venv source .venv/bin/activate git clone https://github.com/OpenMOSS/MOSS-TTS.git cd MOSS-TTS/moss_soundeffect_v2 pip ins…
左が元画像、右が今回作成した画像 プロンプトは「Add wings to the astronaut」 Pythonスクリプト import torch from diffusers import JoyImageEditPipeline from diffusers.quantizers import PipelineQuantizationConfig from diffusers.utils import lo…