26/06/29 12:20:17.75 j+8cxsRc0.net
前スレ
【超解像】Lada part4
URLリンク(egg.5ch.io)
Lada
URLリンク(github.com)
Jasna
URLリンク(github.com)
Lada-EX
URLリンク(codeberg.org)
2:名無しさん@お腹いっぱい。
26/06/29 12:21:19.15 j+8cxsRc0.net
検出モデル v2_accurate
URLリンク(huggingface.co) の
lada_vr_mosaic_detection_model_v2_accurate.pt
除去モデル basicvsrpp-generic_v1.2_full
URLリンク(huggingface.co) の
lada_mosaic_restoration_model_generic_v1.2_full.pth
■ 不具合があった場合に試してみる事
・GPUスケジューリング オフ
スタートメニュー>設定>システム>ディスプレイ>グラフィックの設定
ハードウェア アクセラレータによるGPUスケジューリング>オフ
・最新グラフィックスドライバに更新
3:名無しさん@お腹いっぱい。
26/06/29 12:22:15.41 j+8cxsRc0.net
2026/03/30(月) 19:03:50.79ID:ZE0uzXT90
■ Jasna-0.5.0+v2_accurate+basicvsrpp-generic_v1.2_full
(1) model_weightsフォルダのv4_fastとgeneric_v1.2を削除するかリネームする
(例)
lada_mosaic_detection_model_v4_fast.pt.bak
lada_mosaic_restoration_model_generic_v1.2.pth.bak
(2) model_weightsフォルダに
lada_mosaic_detection_model_v4_fast.onnx
lada_mosaic_detection_model_v4_fast.win.engine
があったら削除する
(3) >>1の検出モデルと除去モデルをmodel_weightsフォルダに入れ、それぞれ
lada_mosaic_detection_model_v4_fast.pt
lada_mosaic_restoration_model_generic_v1.2.pth
にリネームする
(4) jasna-guiを起動して検出モデルをlada-yolo-v4にする
4:名無しさん@お腹いっぱい。
26/06/29 14:00:16.46 RAAATRMI0.net
>>3
0.7.2ではもうリネームいらなくね?
5:名無しさん@お腹いっぱい。
26/06/29 17:34:03.40 vwvoDzdm0.net
最新版まだ使ってないんだけど検出モデルも除去モデルもリネームいらなくなってるの?
6:名無しさん@お腹いっぱい。
26/06/29 18:05:30.48 YsR1Xqg60.net
しばらく見ないうちに課金なってたw
コーヒー15ドル奢る時、アカウント作らなくても決済する時に入力するメアドにkeyが送られて来るの?
7:名無しさん@お腹いっぱい。
26/06/29 18:10:47.05 JLGs7bE/0.net
課金にはなってないな 間抜け以外は
8:名無しさん@お腹いっぱい。
26/06/29 18:58:38.36 XcNYtWt80.net
間抜けでもいい。たくましく生きてほしい
9:名無しさん@お腹いっぱい。
26/06/29 19:47:09.40 tjFBfdZg0.net
>>4,5
lada_vr_mosaic_detection_model_v2_accurate.ptだと認識しない
lada_mosaic_detection_model_v2.ptにリネームすると認識してlada-yolo-v2が選べる
rfdetrは検出精度yolo-v2と同じくらいだと思ってたけど盛大に取りこぼすのあった
扱ってるものがアレだから参考上げれないけど
10:名無しさん@お腹いっぱい。
26/06/29 19:56:33.82 JZpenkDT0.net
>>2, >>3 の情報は古い
最新版は
★検出モデルはデフォルトの rfdetr-v5 のままでOK
顔モザは無視してNSFWモザだけに反応してくれる
性能が高すぎて、しきい値を小さくし過ぎると小さなモザイクまで検出してしまい、エラーになる場合がある。
エラーを回避するしきい値の目安は 4k 動画で 0.15
(ただし、この場合のエラーは無視しても動画生成には問題ない)
★lada_mosaic_restoration_model_generic_v1.2_full.pth は意味ない
デフォルトの lada_mosaic_restoration_model_generic_v1.2.pth のままでOK
モザイク破壊性能を上げたければ自分でモデルをファインチューンするしかない
11:名無しさん@お腹いっぱい。
26/06/29 20:06:12.79 JZpenkDT0.net
前スレ >>993, >>994
ちゃんと学習するにはクリップ数換算で 10,000 クリップ以上だぞ
いちいち確認とか修正なんかしてられない
ちなみに2時間の動画から平均200クリップ出来るとすれば、50本の動画が最低でも必要
12:名無しさん@お腹いっぱい。
26/06/29 20:30:11.13 hO/Bkf1q0.net
ここに居る人間にとって50本はそれほどの本数では無いだろうけど質を揃えるのが難しいな
13:名無しさん@お腹いっぱい。
26/06/29 20:46:25.83 FX3V5MIB0.net
>>10
ソースによってはrfdetr-v5でしきい値下げてもyoro-v2よりもモザイクを取りこぼすやつが実際ある、
と言ってる人いるのに(自分の手持ちソースでも実際複数ある)
自身の環境で起こってる事だけで人にも必要ないって言い続けるのは違うと思うわよ?
14:名無しさん@お腹いっぱい。
26/06/29 20:49:00.42 C4rJDxcf0.net
歯や舌、口回りの学習ってできないの?
ティンポはいいんだけど、女優さんの歯が自然でなくなるんだよね
15:名無しさん@お腹いっぱい。
26/06/29 21:08:37.28 uFnuXug50.net
>>7
コーヒー奢る金も無いのかお前は
どうせコーヒー代から作られた新モデルが出たら使うんだろ?乞食がよ
16:名無しさん@お腹いっぱい。
26/06/29 21:20:59.68 VYRPayJ80.net
>>11
復元モデルのファインチューン結果の良し悪しってどうやって評価してるの?
見た目の印象だけだと判断むずいと思う
学習に使ってない素材で、旧/新を同じ条件で回して LPIPS か SSIM の数字で比べられない?
それで揃って良くなってれば説得力ある
17:名無しさん@お腹いっぱい。
26/06/30 00:04:57.27 IkHIJ5Ee0.net
>>13
rfdetr-v5がダメとか言ってる方がレアケース・ノイジーマイノリティだわ
たぶん、アニメとか、VHS,DVD時代のエロビデオとか、インタレース解除もしてないようなソースを使ってるんだろうな
StreamFab とかを使ってFanzaの実写配信動画をmp4保存したFHD画質のやつならrfdetr-v5で全く問題ない
18:名無しさん@お腹いっぱい。
26/06/30 00:22:42.17 IkHIJ5Ee0.net
>>16
stage1 の学習スクリプトを回せばvalidationで PSNR, SSIMが算出されるんだからそれを見ればいいだろ
19:名無しさん@お腹いっぱい。
26/06/30 02:44:17.57 mImh/BV70.net
やっぱFC2が一番いいわ
Fullは消したとこがぐるぐるになる
20:名無しさん@お腹いっぱい。
26/06/30 05:20:03.57 LzVA+hJv0.net
>>18
まあ素人同士だしそんなもんかもだけど、それ学習データの中での数字だよね?
同じ分布だから上がって当然な気もするし、自分でも試してみる
21:名無しさん@お腹いっぱい。
26/06/30 07:14:21.66 Cfe/vRsm0.net
valのデータが使われるんだから違うでしょ
22:名無しさん@お腹いっぱい。
26/06/30 09:37:13.12 d+MXcFdV0.net
カード払いか、google Payのみか・・・
PayPalで払えないなら止めておこう
23:名無しさん@お腹いっぱい。
26/06/30 12:26:27.37 xUZApKzE0.net
PayPalはつかえないんでプリペイド型クレカで払った
ひとつ持ってると便利だよ
24:名無しさん@お腹いっぱい。
26/06/30 13:26:17.12 IkHIJ5Ee0.net
>>20
お前は分かったつもりになっているだけで実は何も分かっていないタイプのダメ人間だな
>>21 の言うとおり、
用意した学習データの一部、例えば5% 程度をランダムに選んで学習に使うデータから分離して、テスト専用に使う
だからテストとしては公平なわけ
てかまぁ、つべこべ言わずに自分でファインチューンモデルを作って試してみれば数値なんて見なくても一目瞭然で違う結果が得られることが分かるわ
25:名無しさん@お腹いっぱい。
26/06/30 16:22:53.64 pHm+tBUO0.net
Ladaはアップデートされなくなったし
自分でモデルをファインチューンしていくしかないね
26:名無しさん@お腹いっぱい。
26/06/30 18:35:18.30 4qH6maB20.net
>>17
rfdetr-v5の藻残りには、女正規を顔と誤判断して残している場合がある
この機能をオフにできるようにするか、顔藻と判断するしきい値を設定できるようにしてくれないと使えない
さすがに、画面いっぱいの女正規の藻が数秒の1シーンまるごとそのまま残ってしまったのには笑った
27:名無しさん@お腹いっぱい。
26/06/30 18:56:07.56 sln8Y2JK0.net
俺の環境ではyoloの方が取りこぼし多くて困ってrfdetr-v5にしたら出なくなった。何でこんなに人によって言うことが違うのか?
28:名無しさん@お腹いっぱい。
26/06/30 19:15:42.59 3THwJIjd0.net
>>27
そりゃソースの画面サイズ、モザイクのサイズ、閾値設定によるからなあ
V4?accurate?それによっても
29:名無しさん@お腹いっぱい。
26/06/30 20:02:34.60 +AFornhc0.net
最初から入ってるv4_fastはダメだけどv2_accurate追加するか置き換えれば取りこぼしなくなる
稀だけどv2_accurateで気になる程取りこぼしたらrfdetr試す
rfdetrが取りこぼしたのをv2_accurateが問題なく復元する逆パターンもある、どっちがいいとは言い切れないな
30:名無しさん@お腹いっぱい。
26/06/30 21:05:36.60 K+J34nvw0.net
>>27
エロ動画は
星の数ほど
あるんだよ
31:名無しさん@お腹いっぱい。
26/06/30 21:48:08.94 H92XcwPZ0.net
みつを
32:名無しさん@お腹いっぱい。
26/07/01 00:05:19.40 0i/dsBK00.net
>>27
>>17
33:名無しさん@お腹いっぱい。
26/07/01 01:01:36.07 pt+Of6wm0.net
学習方法と適用方法をまとめてくれる親切な方、お願いします。
本家で使いたいです。
34:名無しさん@お腹いっぱい。
26/07/02 16:16:30.18 XvbBuy2a0.net
あげ
35:名無しさん@お腹いっぱい。
26/07/02 16:40:46.39 XmQ2llsp0.net
まん
36:名無しさん@お腹いっぱい。
26/07/02 16:43:47.68 7R5qQbgu0.net
じゅう
37:名無しさん@お腹いっぱい。
26/07/02 18:27:15.09 9a6gzjVT0.net
VR動画をMacで見たくてCodexでVRPlayer作ったけど、
これはモザイク消したくなるなあwww
38:名無しさん@お腹いっぱい。
26/07/02 18:49:19.29 uuC/8DDm0.net
>>33 AIを頼ったほうが早いと思う
Fine tuneの事を全然わかっていなかった俺でもできた
やってみるのが一番だった
復元モデルv1.2を手持ちのデータでfine tune (stage 2)を回した結果
ソース189本を作品単位で train/val を分けてリークは回避(train 2713クリップ / val 375クリップ)
データ生成に約13時間、学習(20000 iters)は約4時間、VRAM 10.2GiB で完走 (Linux, RTX5080)
Stage 2の学習は破綻なし val PSNR は 36.88→36.98 と緩やかに上がって GAN も安定
成果はディテールの改善 未学習の実動画2本の目視でどっちも良くなってた
また、データセットのクリーニングは信頼できるソース使えば神経質にやる必要なかった
抜き取り目視確認で削除ゼロ、watermark や非NSFW は学習時の自動フィルタ任せで済んだ
適当に選んだデータでstage 2だけでも改善効果がわかるんだから
データしっかりそろえてstage 1から回せばもっと効果が期待できるのか?と思った
39:名無しさん@お腹いっぱい。
26/07/03 02:18:26.67 pmlGAFRQ0.net
意味ないだろ、それ
stage1 BasicVSR++ の学習
stage2 GAN の学習
なんだからな
40:名無しさん@お腹いっぱい。
26/07/03 02:28:29.68 xkSil+nl0.net
ここの住人が色んな事しだしてるけど劇的な進化は起きないよ
素直に課金して新モデルを待つわ
41:名無しさん@お腹いっぱい。
26/07/03 09:46:10.70 pmlGAFRQ0.net
それこそ無駄だわ
42:名無しさん@お腹いっぱい。
26/07/03 12:04:07.33 EzbmEsVH0.net
>>41
いや、多くのユーザーは、そんな知識も要してないから、課金で時間と手間を買うというスタンスもありだと思う。
俺も何度読み直してもやり方が理解できない。Windowsで?Linuxで?そこもわからん素人だから。
43:名無しさん@お腹いっぱい。
26/07/03 16:11:07.44 BpGa8xdy0.net
作者はBasicVSR++とdiffusionを組み合わせたモデルを作るのかな
要求スペックは高くなりそう
44:名無しさん@お腹いっぱい。
26/07/03 17:11:20.50 CYJKkO6V0.net
>>43
URLリンク(github.com)
2週前にSD1.5モデルに対する疑問に答えてるやつだけど
>If I would have cluster of H100 and millions of data I would jump straight to video diffusion model
>(もしH100のクラスタと数百万のデータがあれば、迷わずビデオ拡散モデルに取り掛かるのですが)
↑やる気はあるけどもH100をレンタルする費用と素材がたくさん要るって事みたい
レンタル代は最近の時価で時間当たり500~600円くらい?らしいんで、個人的には15㌦出すだけでやってくれるんならありがたい話
最近は値下がり気味ではあるらしい
45:名無しさん@お腹いっぱい。
26/07/03 17:15:36.22 yvA/ey3z0.net
ケチケチせんと応援したれや
46:名無しさん@お腹いっぱい。
26/07/03 17:18:51.23 B1vGpLmT0.net
こんな端金ケチる奴がどうやってソース動画集める気なんだろうか
47:名無しさん@お腹いっぱい。
26/07/03 17:29:24.87 e3ow4i8i0.net
数百万のデータ
48:名無しさん@お腹いっぱい。
26/07/03 17:30:20.44 e3ow4i8i0.net
実際、相当儲かってると思うよ
中国人が金投げまくってる
49:名無しさん@お腹いっぱい。
26/07/03 17:50:50.83 5fp5V6rH0.net
433サポート*15USD*160.92=104.5万円、言う程か?
作者は自分の時間と機材にどんだけ費やしてんだ
50:名無しさん@お腹いっぱい。
26/07/03 19:37:14.08 2/ARpdbw0.net
応援はケチってもGPUには桁違いの大盤振る舞い。みんなRTX40,50シリーズでしょ
俺なんていまだに2060
51:名無しさん@お腹いっぱい。
26/07/03 20:53:57.54 e3ow4i8i0.net
46の「こんな端金ケチる奴」=作者の事だろ
お布施をケチる話と平行して語るな
52:名無しさん@お腹いっぱい。
26/07/03 23:22:04.17 xkSil+nl0.net
認知がおかしい奴おる
53:名無しさん@お腹いっぱい。
26/07/04 15:37:31.81 BA5w5DPG0.net
ファインチューンやってみたいけどwindowsでのLadaデベロッパーインストールもpython scriptsの実行も全然うまくいかん
ChromeAIモードに聞くぐらいでは無理か
54:名無しさん@お腹いっぱい。
26/07/04 16:31:23.85 9hgDqjxy0.net
wslでやればいい
55:名無しさん@お腹いっぱい。
26/07/04 20:32:56.65 Ykwj0lm80.net
そのコメントで出来るようになる位だったらこんなところで詰まってないと思う
>>53
何がうまく行っていないのを自分が理解できていないとしたら
まずはインストールガイドに沿って一行一行実行してその結果をAIに投げて解説してもらえば
56:名無しさん@お腹いっぱい。
26/07/05 02:43:32.61 ret+urHj0.net
仕事していてそんな暇はないので課金して待ちます
57:名無しさん@お腹いっぱい。
26/07/05 09:26:41.28 152wcSWB0.net
JavP知って、そうかAIにこんなことさせるかって感心したが、普通のLadaでさらにレベル上がっててこれで充分だわ
LinuxとかUbuntuとか環境まさぐってまで、ようやらんw
4060tiでFHD 2時間のが2時間くらいかかるけどな
58:名無しさん@お腹いっぱい。
26/07/05 10:43:00.12 KD/OMflw0.net
>>57
多分自分と同じくらいのITリテラシーだと思うが、jasnaのguiならそれほど敷居高くないからやった方がいい
ladaと比較して速度も品質も大幅にあがる
javp<<<lada<<jasna(rtx二次解像ON)
59:名無しさん@お腹いっぱい。
26/07/05 11:49:25.89 rfE+qrjz0.net
これからは文系でもgithubのアプリをAIで学んで改造して使う時代なんだよな
エロのおかげで時代についていける
60:名無しさん@お腹いっぱい。
26/07/05 18:24:10.09 sqU5dH+l0.net
>>58
品質とは破壊の精度のことかと思いますが
精度はjavp比劇的に向上しているとは思わなかったですね。向上していることは間違いないですが。
ただ、処理速度は劇的に速くなりましたよね。
61:名無しさん@お腹いっぱい。
26/07/05 19:00:09.81 152wcSWB0.net
>>58
jasnaのguiなら簡単?
あんまアレコレ攻めたくないんだがw
JavpからはLadaでかなり品質上がったし、時間も倍速くなったが
62:名無しさん@お腹いっぱい。
26/07/05 19:23:21.41 3JuQAhAa0.net
ladaで満足できてるなら、まーそれで良いんじゃない
63:名無しさん@お腹いっぱい。
26/07/05 19:53:45.82 tDyiF4To0.net
jasnaなんとなく使ってなかったけど時間出来たから使ってみた
WindowsGUI版だけど簡単だった
最初の追加ダウンロードだけ時間が読めなかったけどほっといたら終わってた
64:名無しさん@お腹いっぱい。
26/07/05 20:04:31.15 152wcSWB0.net
>>63
3分割されてる7zip解凍して、起動するだけ?最初に環境構築が入るだけならやってみたい
65:名無しさん@お腹いっぱい。
26/07/05 20:23:17.74 tDyiF4To0.net
>>64
起動時に環境チェック入ってアドバイスが出る
うちはNVIDIAコントロールパネルの3D設定を調整しろって英語で出ただけ
LadaWin最新版が正常に動いてる環境
66:名無しさん@お腹いっぱい。
26/07/05 20:29:51.88 6jiwCY5r0.net
Javplayerの精度に満足できず、使わなくなって1年以上放ったらかしにしてたけど、これなんの作品って聞くスレに貼ってあった動画が、流出モノかと勘違いする出来で驚いて、いろいろ検索するうちにLadaを知った。そして今はjasna。開発者には感謝しかない。
67:名無しさん@お腹いっぱい。
26/07/05 21:30:24.06 d1FcuHEL0.net
javski先生は結局モデルがあかんって話なのかな…
あれにjasnaのモデルとかぶち込めたり出来ねぇかな
やる意味はないけどモザイク判定細かくシーン毎にピン打って手動で数値いじれるからさ
68:名無しさん@お腹いっぱい。
26/07/05 22:25:15.62 TwnQhWCG0.net
>>60
rtxvsr込みだと劇的向上してるよ
まぁ、好みの動画が違うというオチだろうw
69:名無しさん@お腹いっぱい。
26/07/06 11:43:17.11 gW9RhDZ70.net
>>68
60
あ、誤記ごめんlada比で、です
javp比は雲泥の差
70:名無しさん@お腹いっぱい。
26/07/06 12:14:11.07 5vsUiU900.net
>>69
だよな 何を言ってるんだ?と思ってたw
71:57
26/07/06 13:40:08.63 w7S/Gf9n0.net
Jasnaやってみた。21秒の動画を処理させて初回35分くらいかかったが、2回目は20秒で終わった。はっやいな!しかもLadaと比べるとちょっと詳細さ上がってる。
72:57
26/07/06 15:34:43.93 w7S/Gf9n0.net
いや、Jasnaは処理速度、Ladaとほぼ変わらんかった
これはもうLadaでGPU100%行ってたんで、
4060Tiの限界なんだろうな。
73:名無しさん@お腹いっぱい。
26/07/06 19:33:57.51 fMFLvwgC0.net
うちの4070tiだとたぶん、FHDの動画は実時間の半分くらいかな
4060ti比でcudaコア二倍、TDPも二倍だからそりゃそうなるって話だと思う
ちな、VR TOOLで今時の8k破壊は50分程度の作品でトータル13時間とかかかる
破壊より左右の分割と結合が長いが、2Dとは比べられない興奮を得られるよw
74:名無しさん@お腹いっぱい。
26/07/06 20:22:00.02 odM85Hu90.net
Jasnaのデフォルト検出モデルrfdeter-v5は重いからな
lada-yolo-v4も試して処理時間比べてみな
なお、検出モデルと動画の相性があるから仕上がりは要確認
75:57
26/07/06 20:23:20.61 w7S/Gf9n0.net
あれ?うちの4060TiもFHDの動画は実時間の半分くらいだよ
VR TOOLってのはWindowsで簡単に扱えないよね?
JavPでVRを処理してみたけど、あんなレンズ球面に歪んだのはうまくいかなったよ
76:57
26/07/06 20:28:51.63 w7S/Gf9n0.net
>>74
ありがとう
やってみる
77:名無しさん@お腹いっぱい。
26/07/06 21:08:07.90 7RFQjQhN0.net
部屋がまじでサウナみたいになるなw、冷房もあるが電気代もう使いたくないんで推しの女優だけにしぼることにする
78:名無しさん@お腹いっぱい。
26/07/06 21:42:52.72 8qlurE+90.net
北海道はまだ寒いらしいぞ
79:名無しさん@お腹いっぱい。
26/07/07 00:40:32.94 wNsMIyrR0.net
>>75
URLリンク(codeberg.org)
windowsでguiで直感的に使えるよ
導入は合ってるかわからないけど、jasna入ってるディレクトリに上書きでいけた
jasnaが6ならそのままいけて、7.2だと実行ファイルの名前が変わってnot foundエラー出るから、chat-gptの言うとおりにjasna.exeのコピーをふたつ作ってそれぞれ、jasna-cli.exe jasna-gui.exeにしたらいけた
たぶん、実際はvr toolboxがcliを参照してるぽい
80:名無しさん@お腹いっぱい。
26/07/07 02:09:32.24 XKAyM1o50.net
>>67
jasnaが凄くなったのは高解像モデルのBasicVSRがBasicVSR++に進化した所が大きいんだと思う。
BasicVSR++の作者による解説↓
URLリンク(ckkelvinchan.github.io)
これの下の方のResultsのとこ、車のホイールの高解像化結果をマ○コに置き換えて思い返してみると妙に腑に落ちるw
JAVPの頃はまだ++じゃなかったと思うから、復活して++を実装すると変わる可能性はありそうだけど、博士の手持ちの追加学習材料が貧相だっていう噂もあるし。
そういう点では追加学習済みmosaic_restoration_modelファイルの交換やら合体ができると一番効率がいいんだよな。
81:名無しさん@お腹いっぱい。
26/07/07 03:35:46.43 aKfHUGgX0.net
にわかか
82:名無しさん@お腹いっぱい。
26/07/07 05:31:03.55 k19Fcvp60.net
今はBasicVSR++の後継待ちなのかな
Fable 5が月額固定で使えるうちに後継を検討してもらったが
ものになっりそうなのは二次復元でSeedVR2を使うやつ
ComfyUI用に公開されているソースとモデルがそのまま流用できた
かなり重くなるけど古い動画では効果あり
コーヒー代稼ぎの邪魔になるからJasnaには組み込まないけど