>>69
情報サンクスです SwiftVRは知らなかったです
調べてみたら重たいモデルだけどMPSで動かす想定になっているのでMacに向いている作りのようですね
自分の環境に落としてトライしてみたところ、素の構成だとOOMが出てダメだったけど
コミュニティ版(LightX2V)の内容とFlashVSRでやった高速化手法を取り込んだら
素のFlashVSR_plusより7倍位速くなったw (要RTX40系以降のグラボ)
RTX5080でscale 2倍(640x480→1280x960)を試したら48〜50fps(VRAM使用量 8〜8.4GiB)で処理できてる
マジでリアルタイム級の速さ
まだちょっとしか試してないけどFlashVSR x2の結果と比べてアプスケ品質は同等、過鮮鋭は抑え気味でより自然な絵になる印象です
二次復元をこっちに乗り換えるのはアリだな・・・
【超解像】Lada part6
2026/09/25(金) 18:22:09.11ID:OF0xc8aw0
74名無しさん@お腹いっぱい。
2026/09/25(金) 19:02:27.87ID:mRzb+kUn075名無しさん@お腹いっぱい。
2026/09/25(金) 19:03:44.38ID:mRzb+kUn02026/09/25(金) 20:14:02.39ID:OF0xc8aw0
>>75
SwiftVRのローカル版でやった最適化はデバイスに依存しないメモリ削減と、CUDAを前提とする高速化
MPSで使えるのは前者だけの見込みだけどMac持ってないので試せないっす
(1) デバイスに依存しないメモリ削減
次の4つはPyTorchの標準的な演算だけで書かれており、CUDA専用のAPIを使っていない
・ReAEのフレームバッチ処理(出典:LightX2V)
状態を持たない層を数フレームずつ処理し、出力は1つの確保済みテンソルに書き込む
・decoderの分割(出典:LightX2V)
最後のTGrowまでの状態を持つ部分を先に実行し、捨てるフレームを除いてから、フル解像度の後半を実行
・TGrowとUpsampleの順序入れ替え(出典:独自)
TGrowは空間方向に点ごとの演算なので、nearestのUpsampleと順序を交換でき、4分の1の画素数で実行できる
・QKV融合後の元の重みの解放(出典:独自)
融合前のQ、K、Vの投影を解放(約2.6GiB)
SwiftVRのローカル版でやった最適化はデバイスに依存しないメモリ削減と、CUDAを前提とする高速化
MPSで使えるのは前者だけの見込みだけどMac持ってないので試せないっす
(1) デバイスに依存しないメモリ削減
次の4つはPyTorchの標準的な演算だけで書かれており、CUDA専用のAPIを使っていない
・ReAEのフレームバッチ処理(出典:LightX2V)
状態を持たない層を数フレームずつ処理し、出力は1つの確保済みテンソルに書き込む
・decoderの分割(出典:LightX2V)
最後のTGrowまでの状態を持つ部分を先に実行し、捨てるフレームを除いてから、フル解像度の後半を実行
・TGrowとUpsampleの順序入れ替え(出典:独自)
TGrowは空間方向に点ごとの演算なので、nearestのUpsampleと順序を交換でき、4分の1の画素数で実行できる
・QKV融合後の元の重みの解放(出典:独自)
融合前のQ、K、Vの投影を解放(約2.6GiB)
2026/09/25(金) 20:14:34.37ID:OF0xc8aw0
つづき
(2) CUDAを前提とする部分
以下の4つの施策は、いずれもCUDAでしか効果がない
・cuDNN attention:名前からわかる通りNVIDA GPU専用
・FP8 DiT:torch._scaled_mm はCUDAとROCm専用で、TritonはMetalに対応してない
・DiTのfusion(torch.compile):WindowsとLinuxでは、InductorがTritonのカーネルを生成
・ReAE fusion:torch.cudnn_convolution_relu と torch.cudnn_convolution_add_relu はCUDA専用
(2) CUDAを前提とする部分
以下の4つの施策は、いずれもCUDAでしか効果がない
・cuDNN attention:名前からわかる通りNVIDA GPU専用
・FP8 DiT:torch._scaled_mm はCUDAとROCm専用で、TritonはMetalに対応してない
・DiTのfusion(torch.compile):WindowsとLinuxでは、InductorがTritonのカーネルを生成
・ReAE fusion:torch.cudnn_convolution_relu と torch.cudnn_convolution_add_relu はCUDA専用
78名無しさん@お腹いっぱい。
2026/09/25(金) 21:05:03.25ID:2P5cMOgf079名無しさん@お腹いっぱい。
2026/09/25(金) 22:51:06.77ID:AHkPOcwf0 今まで4KVRしか試してなかったのでデュアルフィッシュアイに変換した時の画質についてはよくわからなかったけど、8K匠で試してみることにした
8K匠はhevc59.94fpsで出力も同じなので、元動画の映像ビットレートを1.5倍(ハードエンコによる画質低下等も考慮)したビットレートを指定した
映像最大ビットレートは取得できなかったが、先ほどのビットレートをさらに1.5倍したものを最大ビットレートとして指定した(これに伴い-cqの指定はやめた)
なお、丸い映像の外の部分を黒にしたのは、そこに映像があるとその部分に無駄にビットレートを割いてしまうのでそれを避けるため
ffmpeg -i input.mp4 -vf "drawbox=0:0:iw/2:ih:black,drawbox=iw/2:0:iw/2:ih:black,v360=hequirect:fisheye:in_stereo=sbs:out_stereo=sbs" -c:v hevc_nvenc -rc vbr -b:v 174000k -maxrate:v 261000k -c:a copy output.mp4
ファイルサイズは、元の動画の約1.47倍になったのでだいたい計算通り
とりあえず、jasnaで「SBS-左右別処理」にかける前にQuest2で見比べたが、画質の劣化は感じられなかった
ちなみに、jasnaで「SBS-左右別処理」(cq22)すると、映像ビットレートは56.8Mbps、映像最大ビットレートは220Mbpsに落ちたのでもっとcqの値を下げた方がよさそうだ
いずれにせよ、適正なビットレートを指定すればデュアルフィッシュアイで十分な画質が得られるので >>70 の処理までは必要ないと思った
8K匠はhevc59.94fpsで出力も同じなので、元動画の映像ビットレートを1.5倍(ハードエンコによる画質低下等も考慮)したビットレートを指定した
映像最大ビットレートは取得できなかったが、先ほどのビットレートをさらに1.5倍したものを最大ビットレートとして指定した(これに伴い-cqの指定はやめた)
なお、丸い映像の外の部分を黒にしたのは、そこに映像があるとその部分に無駄にビットレートを割いてしまうのでそれを避けるため
ffmpeg -i input.mp4 -vf "drawbox=0:0:iw/2:ih:black,drawbox=iw/2:0:iw/2:ih:black,v360=hequirect:fisheye:in_stereo=sbs:out_stereo=sbs" -c:v hevc_nvenc -rc vbr -b:v 174000k -maxrate:v 261000k -c:a copy output.mp4
ファイルサイズは、元の動画の約1.47倍になったのでだいたい計算通り
とりあえず、jasnaで「SBS-左右別処理」にかける前にQuest2で見比べたが、画質の劣化は感じられなかった
ちなみに、jasnaで「SBS-左右別処理」(cq22)すると、映像ビットレートは56.8Mbps、映像最大ビットレートは220Mbpsに落ちたのでもっとcqの値を下げた方がよさそうだ
いずれにせよ、適正なビットレートを指定すればデュアルフィッシュアイで十分な画質が得られるので >>70 の処理までは必要ないと思った
2026/09/26(土) 07:46:03.16ID:z841LKsi0
Jasna有料の静止画をSD1.5で変換するのって、アニメCGとかでも
元の構図を維持したままモザイク下だけ修正してくれますか?
あまり大きく変わるようならStable Diffusion Web UIでi2iにかけた方が良いんだろうけど
Discordの入り方がよく分からないから投稿サンプルとか見てみたいです・・・
元の構図を維持したままモザイク下だけ修正してくれますか?
あまり大きく変わるようならStable Diffusion Web UIでi2iにかけた方が良いんだろうけど
Discordの入り方がよく分からないから投稿サンプルとか見てみたいです・・・
2026/09/26(土) 08:35:37.80ID:0bsE2n450
レスを投稿する
ニュース
- 第2次大戦に触れトランプ氏「米中は同盟国」、当時は中華民国…「抗日」巡る中国の言説補強する恐れ ★8 [蚤の市★]
- 【通信】ahamo初の値上げ 「大盛りオプション」撤廃、40GB・60GB・120GBの3段階制に [自治郎★]
- 「暗い未来に子供を産みたくない…」それでも左派よりも右派の方が「たくさん子供を産む」のはなぜか【米研究】 ★2 [首都圏の虎★]
- 「習氏より先に言うとは…」 トランプ氏同盟国発言、日本政府内に困惑 ★3 [蚤の市★]
- 【避妊】望まない妊娠の可能性、性交渉経験がある女性の3人に1人が経験 「楽観視」「相手が望まず」製薬会社調査 [煮卵★]
- 【大阪】堺市が「副首都」に名乗り 都構想は否定「二重行政存在しない」 [煮卵★]
- X民「古文漢文は、高校まで真面目にやっても読み書きできる様にならないカリキュラムに後退している」ジャップの糞教育で古典教養が崩壊 [782112767]
- 日本人「高市早苗はあなたの国でどう思われていますか?」➡世界中で嫌われていると判明 [603416639]
- 【大爆笑】俺様、ァマゾンで誰かに52000円分購入されるwwwwwwwwww [782460143]
- 昔のネット「チョンに比べれば中国はまだマシ」→現在「中国許すまじ😡」 この変化なんで? [668024367]
- 令和の日本人「金!金!汗水流さず楽して稼ぎたい!」日本人が『金の亡者』になったのはなぜなの?昭和や平成はこんなことなかったよな [257926174]
- 【正論】高市首斬り発言の中国総領事「日本人が反中なのは、中国への正しい理解が著しく欠如していることに依る」 [668024367]