>>52
mac book pro AppleM4 16GBです
大体30分くらいの動画で30〜1時間で処理が完了しました。
【超解像】Lada part6
53名無しさん@お腹いっぱい。
2026/09/24(木) 16:48:33.00ID:wZJvhzBI054名無しさん@お腹いっぱい。
2026/09/24(木) 17:11:21.94ID:Sa4EMlXh055名無しさん@お腹いっぱい。
2026/09/24(木) 17:13:40.61ID:Sa4EMlXh056名無しさん@お腹いっぱい。
2026/09/24(木) 17:13:54.29ID:wZJvhzBI0 >>54
ありがとうございます。試してみますね。
ありがとうございます。試してみますね。
57名無しさん@お腹いっぱい。
2026/09/24(木) 17:14:41.56ID:wZJvhzBI058名無しさん@お腹いっぱい。
2026/09/24(木) 17:35:09.36ID:Sa4EMlXh059名無しさん@お腹いっぱい。
2026/09/24(木) 18:07:27.22ID:wZJvhzBI060名無しさん@お腹いっぱい。
2026/09/24(木) 18:10:46.97ID:Sa4EMlXh061名無しさん@お腹いっぱい。
2026/09/24(木) 18:18:32.24ID:wZJvhzBI0 >>60
60~180fpsと結構差がありました
60~180fpsと結構差がありました
62名無しさん@お腹いっぱい。
2026/09/24(木) 18:26:50.29ID:Sa4EMlXh063名無しさん@お腹いっぱい。
2026/09/24(木) 18:28:26.50ID:wZJvhzBI064名無しさん@お腹いっぱい。
2026/09/24(木) 18:31:45.22ID:Sa4EMlXh065名無しさん@お腹いっぱい。
2026/09/24(木) 21:49:46.19ID:WD6kqzGy0 mioh
ネイティブ並列数を10まで増やしました。
M5 maxやultraなら400とか500とかfps出るような気がします。
どなたか試してもらえませんか?
ネイティブ並列数を10まで増やしました。
M5 maxやultraなら400とか500とかfps出るような気がします。
どなたか試してもらえませんか?
66名無しさん@お腹いっぱい。
2026/09/25(金) 03:22:38.48ID:AHkPOcwf0 魚眼VRでzelefans-vr-yolo-v2を使って「SBS+魚眼」すると下方左右でモザ残りが発生するし、rfdetr-vr-v1でも結果はいまいち
で、色々試してみた結果、最初にデュアルフィッシュアイに変換してからzelefans-vr-yolo-v2で「SBS-左右別処理」するのが最も良い結果となった
もちろん、元の柱状投影に戻さなくても、デュアルフィッシュアイのままで再生できる
【デュアルフィッシュアイへの変換コマンド例】
ffmpeg -i input.mp4 -vf "v360=hequirect:fisheye:in_stereo=sbs:out_stereo=sbs" -c:v hevc_nvenc -cq 22 -c:a copy output.mp4
で、色々試してみた結果、最初にデュアルフィッシュアイに変換してからzelefans-vr-yolo-v2で「SBS-左右別処理」するのが最も良い結果となった
もちろん、元の柱状投影に戻さなくても、デュアルフィッシュアイのままで再生できる
【デュアルフィッシュアイへの変換コマンド例】
ffmpeg -i input.mp4 -vf "v360=hequirect:fisheye:in_stereo=sbs:out_stereo=sbs" -c:v hevc_nvenc -cq 22 -c:a copy output.mp4
67名無しさん@お腹いっぱい。
2026/09/25(金) 03:30:13.06ID:AHkPOcwf0 デュアルフィッシュアイは周辺部分の歪みが少なくなるので、普通に2Dとして再生した時に結果の確認もやりやすいし、なんなら、2D再生して楽しむこともできる
2026/09/25(金) 08:30:13.85ID:5Rs+d2Mo0
魚眼はv8に比べて9、10は認識が悪くなってしまったからv8を使ってる
映像全体の魚眼変換をやると
映像全体の画質がモヤっとしていると感じたのでもうやらないな
映像全体の魚眼変換をやると
映像全体の画質がモヤっとしていると感じたのでもうやらないな
69名無しさん@お腹いっぱい。
2026/09/25(金) 10:04:39.98ID:mRzb+kUn0 Jasna modi作者様
swiftVRというプロジェクトはご存知ですか?
https://github.com/H-oliday/SwiftVR
macでやってみたら試験段階ですが、めちゃ良好。
FlashVSRを動かしてないので比較はできませんが、
面白いと思います。
ご存知でしたら、忘れてください笑
swiftVRというプロジェクトはご存知ですか?
https://github.com/H-oliday/SwiftVR
macでやってみたら試験段階ですが、めちゃ良好。
FlashVSRを動かしてないので比較はできませんが、
面白いと思います。
ご存知でしたら、忘れてください笑
70名無しさん@お腹いっぱい。
2026/09/25(金) 10:27:32.80ID:AHkPOcwf0 >>68
「SBS-左右別処理」も「SBS+魚眼」も中央部分は良いが、上下端に近づくと横に拡大された映像に対して復元を行うので2Dの時と比べると品質はかなり落ちる
それに対して、魚眼VRをデュアルフィッシュアイに変換した状態で復元を行うと、映像に歪みが少ないので2Dの時に近い品質が得られる
ということで、破壊部分に限って言えばこれがベストだと思われるが、変換したことで動画全体の画質が低下するというのなら、非常に時間はかかるが以下の方法はどうだろう
1. 元の魚眼VR動画(動画1)をデュアルフィッシュアイに変換して動画2を作成する
2. jasnaで動画2を「SBS-左右別処理」して動画3を作成する(zelefans-vr-yolo-v2推奨)
3. 動画2と動画3で、各ピクセルのRGB値の差の絶対値の合計がしきい値以上の部分だけを抜き出し、さらにfisheye⇒hequirectに戻した動画4を作成する(ffmpegで1回で可能)
4. 動画1に対して、動画4の画像がある部分(black以外の部分)を置き換える(ffmpegで可能、非常に複雑になるが3と4も1回でできるかも?)
(動画2〜動画4は全て一時ファイルになるので、品質は上げていい)
なお、デュアルフィッシュアイに変換した時、丸い映像の外の部分が気になるなら、このようにすれば黒くなる
ffmpeg -i input.mp4 -vf "drawbox=0:0:iw/2:ih:black,drawbox=iw/2:0:iw/2:ih:black,v360=hequirect:fisheye:in_stereo=sbs:out_stereo=sbs" -c:v hevc_nvenc -cq 22 -c:a copy output.mp4
もちろん、blackの部分をwhiteに変えれば白くなるし、redに変えれば赤とかもできる
左右の色を変えて紅白も可能だけど、ヘッドセット被って片目ずつ瞑って見ると映像の切れ目の色が違ってしまう
「SBS-左右別処理」も「SBS+魚眼」も中央部分は良いが、上下端に近づくと横に拡大された映像に対して復元を行うので2Dの時と比べると品質はかなり落ちる
それに対して、魚眼VRをデュアルフィッシュアイに変換した状態で復元を行うと、映像に歪みが少ないので2Dの時に近い品質が得られる
ということで、破壊部分に限って言えばこれがベストだと思われるが、変換したことで動画全体の画質が低下するというのなら、非常に時間はかかるが以下の方法はどうだろう
1. 元の魚眼VR動画(動画1)をデュアルフィッシュアイに変換して動画2を作成する
2. jasnaで動画2を「SBS-左右別処理」して動画3を作成する(zelefans-vr-yolo-v2推奨)
3. 動画2と動画3で、各ピクセルのRGB値の差の絶対値の合計がしきい値以上の部分だけを抜き出し、さらにfisheye⇒hequirectに戻した動画4を作成する(ffmpegで1回で可能)
4. 動画1に対して、動画4の画像がある部分(black以外の部分)を置き換える(ffmpegで可能、非常に複雑になるが3と4も1回でできるかも?)
(動画2〜動画4は全て一時ファイルになるので、品質は上げていい)
なお、デュアルフィッシュアイに変換した時、丸い映像の外の部分が気になるなら、このようにすれば黒くなる
ffmpeg -i input.mp4 -vf "drawbox=0:0:iw/2:ih:black,drawbox=iw/2:0:iw/2:ih:black,v360=hequirect:fisheye:in_stereo=sbs:out_stereo=sbs" -c:v hevc_nvenc -cq 22 -c:a copy output.mp4
もちろん、blackの部分をwhiteに変えれば白くなるし、redに変えれば赤とかもできる
左右の色を変えて紅白も可能だけど、ヘッドセット被って片目ずつ瞑って見ると映像の切れ目の色が違ってしまう
71名無しさん@お腹いっぱい。
2026/09/25(金) 10:34:16.60ID:AHkPOcwf0 この方法だと、元の動画1から最終動画への再エンコードも4で行う1回だけとなる
2026/09/25(金) 18:11:36.97ID:aEWAA+E+0
mioh Universal 0.14.3-014
M6 32GB 設定はデフォのまま
動画情報: 1920x1080 / 29.969fps / 13:52
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 76.2fps / 経過 05:27
並列構成: 時間バッチ1レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 89.9fps / 経過 04:37
並列構成: 時間バッチ2レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 91.6fps / 経過 04:32
並列構成: 時間バッチ3レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 81.4fps / 経過 05:06
並列構成: 時間バッチ4レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 50.2fps / 経過 08:17
並列構成: 時間バッチ5レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 29.6fps / 経過 14:02
並列構成: 時間バッチ6レーン
M5 maxやultraなら400とか500とか出るの?
M6 32GB 設定はデフォのまま
動画情報: 1920x1080 / 29.969fps / 13:52
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 76.2fps / 経過 05:27
並列構成: 時間バッチ1レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 89.9fps / 経過 04:37
並列構成: 時間バッチ2レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 91.6fps / 経過 04:32
並列構成: 時間バッチ3レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 81.4fps / 経過 05:06
並列構成: 時間バッチ4レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 50.2fps / 経過 08:17
並列構成: 時間バッチ5レーン
処理統計: 24929フレーム / 検出対象22101フレーム / 復元321クリップ / 29.6fps / 経過 14:02
並列構成: 時間バッチ6レーン
M5 maxやultraなら400とか500とか出るの?
2026/09/25(金) 18:22:09.11ID:OF0xc8aw0
>>69
情報サンクスです SwiftVRは知らなかったです
調べてみたら重たいモデルだけどMPSで動かす想定になっているのでMacに向いている作りのようですね
自分の環境に落としてトライしてみたところ、素の構成だとOOMが出てダメだったけど
コミュニティ版(LightX2V)の内容とFlashVSRでやった高速化手法を取り込んだら
素のFlashVSR_plusより7倍位速くなったw (要RTX40系以降のグラボ)
RTX5080でscale 2倍(640x480→1280x960)を試したら48〜50fps(VRAM使用量 8〜8.4GiB)で処理できてる
マジでリアルタイム級の速さ
まだちょっとしか試してないけどFlashVSR x2の結果と比べてアプスケ品質は同等、過鮮鋭は抑え気味でより自然な絵になる印象です
二次復元をこっちに乗り換えるのはアリだな・・・
情報サンクスです SwiftVRは知らなかったです
調べてみたら重たいモデルだけどMPSで動かす想定になっているのでMacに向いている作りのようですね
自分の環境に落としてトライしてみたところ、素の構成だとOOMが出てダメだったけど
コミュニティ版(LightX2V)の内容とFlashVSRでやった高速化手法を取り込んだら
素のFlashVSR_plusより7倍位速くなったw (要RTX40系以降のグラボ)
RTX5080でscale 2倍(640x480→1280x960)を試したら48〜50fps(VRAM使用量 8〜8.4GiB)で処理できてる
マジでリアルタイム級の速さ
まだちょっとしか試してないけどFlashVSR x2の結果と比べてアプスケ品質は同等、過鮮鋭は抑え気味でより自然な絵になる印象です
二次復元をこっちに乗り換えるのはアリだな・・・
74名無しさん@お腹いっぱい。
2026/09/25(金) 19:02:27.87ID:mRzb+kUn075名無しさん@お腹いっぱい。
2026/09/25(金) 19:03:44.38ID:mRzb+kUn02026/09/25(金) 20:14:02.39ID:OF0xc8aw0
>>75
SwiftVRのローカル版でやった最適化はデバイスに依存しないメモリ削減と、CUDAを前提とする高速化
MPSで使えるのは前者だけの見込みだけどMac持ってないので試せないっす
(1) デバイスに依存しないメモリ削減
次の4つはPyTorchの標準的な演算だけで書かれており、CUDA専用のAPIを使っていない
・ReAEのフレームバッチ処理(出典:LightX2V)
状態を持たない層を数フレームずつ処理し、出力は1つの確保済みテンソルに書き込む
・decoderの分割(出典:LightX2V)
最後のTGrowまでの状態を持つ部分を先に実行し、捨てるフレームを除いてから、フル解像度の後半を実行
・TGrowとUpsampleの順序入れ替え(出典:独自)
TGrowは空間方向に点ごとの演算なので、nearestのUpsampleと順序を交換でき、4分の1の画素数で実行できる
・QKV融合後の元の重みの解放(出典:独自)
融合前のQ、K、Vの投影を解放(約2.6GiB)
SwiftVRのローカル版でやった最適化はデバイスに依存しないメモリ削減と、CUDAを前提とする高速化
MPSで使えるのは前者だけの見込みだけどMac持ってないので試せないっす
(1) デバイスに依存しないメモリ削減
次の4つはPyTorchの標準的な演算だけで書かれており、CUDA専用のAPIを使っていない
・ReAEのフレームバッチ処理(出典:LightX2V)
状態を持たない層を数フレームずつ処理し、出力は1つの確保済みテンソルに書き込む
・decoderの分割(出典:LightX2V)
最後のTGrowまでの状態を持つ部分を先に実行し、捨てるフレームを除いてから、フル解像度の後半を実行
・TGrowとUpsampleの順序入れ替え(出典:独自)
TGrowは空間方向に点ごとの演算なので、nearestのUpsampleと順序を交換でき、4分の1の画素数で実行できる
・QKV融合後の元の重みの解放(出典:独自)
融合前のQ、K、Vの投影を解放(約2.6GiB)
2026/09/25(金) 20:14:34.37ID:OF0xc8aw0
つづき
(2) CUDAを前提とする部分
以下の4つの施策は、いずれもCUDAでしか効果がない
・cuDNN attention:名前からわかる通りNVIDA GPU専用
・FP8 DiT:torch._scaled_mm はCUDAとROCm専用で、TritonはMetalに対応してない
・DiTのfusion(torch.compile):WindowsとLinuxでは、InductorがTritonのカーネルを生成
・ReAE fusion:torch.cudnn_convolution_relu と torch.cudnn_convolution_add_relu はCUDA専用
(2) CUDAを前提とする部分
以下の4つの施策は、いずれもCUDAでしか効果がない
・cuDNN attention:名前からわかる通りNVIDA GPU専用
・FP8 DiT:torch._scaled_mm はCUDAとROCm専用で、TritonはMetalに対応してない
・DiTのfusion(torch.compile):WindowsとLinuxでは、InductorがTritonのカーネルを生成
・ReAE fusion:torch.cudnn_convolution_relu と torch.cudnn_convolution_add_relu はCUDA専用
78名無しさん@お腹いっぱい。
2026/09/25(金) 21:05:03.25ID:2P5cMOgf079名無しさん@お腹いっぱい。
2026/09/25(金) 22:51:06.77ID:AHkPOcwf0 今まで4KVRしか試してなかったのでデュアルフィッシュアイに変換した時の画質についてはよくわからなかったけど、8K匠で試してみることにした
8K匠はhevc59.94fpsで出力も同じなので、元動画の映像ビットレートを1.5倍(ハードエンコによる画質低下等も考慮)したビットレートを指定した
映像最大ビットレートは取得できなかったが、先ほどのビットレートをさらに1.5倍したものを最大ビットレートとして指定した(これに伴い-cqの指定はやめた)
なお、丸い映像の外の部分を黒にしたのは、そこに映像があるとその部分に無駄にビットレートを割いてしまうのでそれを避けるため
ffmpeg -i input.mp4 -vf "drawbox=0:0:iw/2:ih:black,drawbox=iw/2:0:iw/2:ih:black,v360=hequirect:fisheye:in_stereo=sbs:out_stereo=sbs" -c:v hevc_nvenc -rc vbr -b:v 174000k -maxrate:v 261000k -c:a copy output.mp4
ファイルサイズは、元の動画の約1.47倍になったのでだいたい計算通り
とりあえず、jasnaで「SBS-左右別処理」にかける前にQuest2で見比べたが、画質の劣化は感じられなかった
ちなみに、jasnaで「SBS-左右別処理」(cq22)すると、映像ビットレートは56.8Mbps、映像最大ビットレートは220Mbpsに落ちたのでもっとcqの値を下げた方がよさそうだ
いずれにせよ、適正なビットレートを指定すればデュアルフィッシュアイで十分な画質が得られるので >>70 の処理までは必要ないと思った
8K匠はhevc59.94fpsで出力も同じなので、元動画の映像ビットレートを1.5倍(ハードエンコによる画質低下等も考慮)したビットレートを指定した
映像最大ビットレートは取得できなかったが、先ほどのビットレートをさらに1.5倍したものを最大ビットレートとして指定した(これに伴い-cqの指定はやめた)
なお、丸い映像の外の部分を黒にしたのは、そこに映像があるとその部分に無駄にビットレートを割いてしまうのでそれを避けるため
ffmpeg -i input.mp4 -vf "drawbox=0:0:iw/2:ih:black,drawbox=iw/2:0:iw/2:ih:black,v360=hequirect:fisheye:in_stereo=sbs:out_stereo=sbs" -c:v hevc_nvenc -rc vbr -b:v 174000k -maxrate:v 261000k -c:a copy output.mp4
ファイルサイズは、元の動画の約1.47倍になったのでだいたい計算通り
とりあえず、jasnaで「SBS-左右別処理」にかける前にQuest2で見比べたが、画質の劣化は感じられなかった
ちなみに、jasnaで「SBS-左右別処理」(cq22)すると、映像ビットレートは56.8Mbps、映像最大ビットレートは220Mbpsに落ちたのでもっとcqの値を下げた方がよさそうだ
いずれにせよ、適正なビットレートを指定すればデュアルフィッシュアイで十分な画質が得られるので >>70 の処理までは必要ないと思った
レスを投稿する
ニュース
- 「習氏より先に言うとは…」 トランプ氏同盟国発言、日本政府内に困惑 ★2 [蚤の市★]
- 第2次大戦に触れトランプ氏「米中は同盟国」、当時は中華民国…「抗日」巡る中国の言説補強する恐れ ★7 [蚤の市★]
- 高市総理「日米は非常に強い絆で結ばれた同盟国」 トランプ大統領の“中国は同盟国だった”発言受け [首都圏の虎★]
- 【野球】広島東洋カープの矢野雅哉・前川誠太選手を書類送検 ゾンビたばこを巡る容疑 広島県警 [Ailuropoda melanoleuca★]
- 「暗い未来に子供を産みたくない…」それでも左派よりも右派の方が「たくさん子供を産む」のはなぜか【米研究】 [首都圏の虎★]
- パナソニックが市販カーナビ生産終了へ 30年以上の歴史に幕、スマホナビの普及など受け [少考さん★]
- 【悲報】貧困ジャップさん、4年前に発売された中古のiPhone14に群がる [153736977]
- 【悲報】千葉市民、悲痛な叫び「あぁ、今頃野田元総理がまだ国会議員だったらこんな酷いことにはなってないのに!!」 [591180291]
- なんで自分精神病は同じお気に入りフレーズ多用するのか?
- 発達障害の最近のお気に入りワード「ショートスリーパー」
- 【高市日本】イギリス人🇬🇧「高市早苗を見てるとアジア人全員が平等に作られたわけではないんだなと分かる」 [165981677]
- 女性「たのしいピクニック女は、男は好きでも女が見るとめっちゃ不安になる。生きる力がない女なのよ。それが分からないの?」 [592058334]