探検


【ローカルAI】MacでローカルLLM

2026/09/16(水) 17:54:11.77ID:y+VBQ2NH0
ここからAIのコピペばかりになるのか
2026/09/16(水) 18:41:03.18ID:CpLv8C8v0
ボットの内容を消費期限切れの生肉が喋るだけのスレ
5名称未設定
垢版 |
2026/09/16(水) 18:58:23.78ID:Czt86LFY0
ローカルLLMなど愚の骨頂!!
6名称未設定
垢版 |
2026/09/16(水) 19:04:59.21ID:wMXRKQ9S0
exoクラスタ組んでもMLXしか対応してないからHuggingFaceのモデルを入れる時点で限られる
2026/09/16(水) 19:36:21.24ID:HTSsg1WE0
会社で使ってるchatbotがクソなんでローカルAIをローカルサーバーに入れて、社内のナレッジ共有に利用とか出来たら嬉しい
chatbot入れた担当は首にしろ
8名称未設定
垢版 |
2026/09/16(水) 20:10:20.47ID:xCOQwXYd0
なんでLLM限定?
9名称未設定
垢版 |
2026/09/16(水) 20:51:59.62ID:Ly4/tnO50
スレ立てた奴がアホでAIの事何もしらんから
クソスレなんてこのまま放置でOK
10名称未設定
垢版 |
2026/09/16(水) 21:07:49.23ID:MLmGAtDI0
スレタイに、mini studioを入れないあたり
隔離スレと見せかけて過疎スレを作って、本スレでLLMの話題を封じるアリバイ作りですか
2026/09/16(水) 23:18:28.70ID:4IR+LJsk0
>>7はコンプラ違反で告発されればいいと思うよ。
12名称未設定
垢版 |
2026/09/17(木) 08:47:34.48ID:a7UFs43h0
64GB Mac mini M4 ProでローカルAI使ってる、その印象

キャパのギリギリを狙って​Llama3.3 70B Q4試してみたけど、思考の深さはさすがの70Bながら4bitまで蒸留したのがかなり悪い方向に効いていて「思考力は高いけど知識の少ない人」みたいな感じになってる

逆にメモリ的にかなり余裕のあるGemma4 32B Q8の方が賢い感じがする
蒸留で消えてしまった知識が案外大事だったんだなと気付いた

この辺り、実際に使ってみないと分からんよね
こういう情報交換できるといいなと思ってます
13名称未設定
垢版 |
2026/09/17(木) 13:04:36.98ID:aWfibVuq0
個人用途ならSearXNG MCPは導入したいところ
14名称未設定
垢版 |
2026/09/17(木) 19:30:21.07ID:HdVZe/UI0
>>12
それは蒸留じゃなく量子化では
もうllamaは全然駄目で本質的にGemma4に劣る
Metaも分かってるから開発者を変えてMuse Sparkにしたわけで
15名称未設定
垢版 |
2026/09/17(木) 21:59:14.99ID:SM2Djwkm0
64GBならQwen3.8 27B、Gemma4-31B、Gemma4-28B A4B,Ornith 1.5 35Bあたりがいいと思う
Llamaはもう古いし誰も使ってない
16名称未設定
垢版 |
2026/09/18(金) 03:05:48.62ID:jctzH7zE0
コーディングにはQwen強いよね
LMStudio BionicでQwen 3.8 27Bに「こういうアプリ作って」とか「このアプリをこう直しといて」みたいなことお願いして一晩回しとくと、だいたいできてる
翻訳だと圧倒的にQwenよりGeminiの方が上手いけど
17名称未設定
垢版 |
2026/09/18(金) 07:42:29.44ID:1okFyNWf0
>>15
Gemma4 26B A4Bだね(そこだけ数字が違う)
うちもQwen, Gemma4, Ornithに落ち着いた
QwenとGemma4の非検閲版も入れてる

>>16
Bionicはいまいちだったけど良くなったなら試してみようかな
Gemma4の日本語は砕けすぎな感じのときもあるのでQwenの正確な翻訳も好き
18名称未設定
垢版 |
2026/09/18(金) 08:12:00.76ID:jctzH7zE0
私は文芸翻訳だからかもしれないけど、QwenよりGemma4の方が翻訳家的な仕事をちゃんとしてくれる
Gemmaは場面や話者で文のスタイルを適切に切り替えるのが本当に上手い

マイナー言語から日本語に翻訳してるという特殊事情があるからかもしれないけど
19名称未設定
垢版 |
2026/09/18(金) 11:05:03.52ID:NcviEiPe0
>>15
96GB、128GBならどうなる?
どこまでメモリ積むか悩むわ
20名称未設定
垢版 |
2026/09/18(金) 11:18:20.20ID:jctzH7zE0
miniスレで16GBや24GBでもローカルLLM活用してるって人いるよね
どう使ってるのか具体的に聞いてみたい気はする
どんなモデル使ってるの?用途は?
21名称未設定
垢版 |
2026/09/18(金) 12:28:00.89ID:1okFyNWf0
>>19
現状は>>15のしか候補がないんだよね
Qwen3.8-122B-A10Bが出るという噂はあったけど出てないし
結局1台ローカルLLM専用に出来るなら32GBで間に合うし、他の仕事をしても48GBで足りそう

DGX Sparkが128GBなので合わせたものを作りそうなものなのに意外に出てこない
M5 ProでもDGX Sparkより速い、MaxやUltraは更に速いと思われるので良いモデルが出ると面白いね
22名称未設定
垢版 |
2026/09/18(金) 12:32:02.52ID:1okFyNWf0
>>20
Qwen3.5 9B, Gemma4 E4Bと12B, Ornith1.5 9Bは16GBは十分動く
翻訳や文法、誤植のチェックとかに使えるよ
化学や物理の問題もまあまあ出来るし自分でやらないと勉強にならんとかお断りされない非検閲モデルもある
23名称未設定
垢版 |
2026/09/18(金) 12:41:25.99ID:NcviEiPe0
>>21
ありがとう。現状別PCでqwen3.8 27B q4使ってて、それを別用途に使いたいから、LLM専用で買おうと思ってるんだよね
64GBを超えると馬鹿高いし、48か64が妥協点なのかな
凄いモデルあるなら96以上狙ってもいいんだけど
24名称未設定
垢版 |
2026/09/18(金) 13:38:40.82ID:jctzH7zE0
>>22
軽いモデルだと速度がめちゃくちゃ速いから、それはそれで使い所ありますよね
25名称未設定
垢版 |
2026/09/18(金) 14:37:39.78ID:rC76XPuS0
>>20
miniスレの言ってる事アテにするな
推論やるにしても最低32GB、可能なら64GB
64GB構成で30Bクラスが回せるから一番コスパいいのがこれ
LLMやるならstudio買えっていうアホがたまにいるけど
企業がLLM用に大量購入してるのがmac mini
26名称未設定
垢版 |
2026/09/18(金) 14:49:08.71ID:sUrhf4V/0
32GBはどこまでやれるの?
2026/09/18(金) 15:07:03.46ID:IbCQN6QT0
LLMって単純にいうけど具体的には何のために何をするの?
28名称未設定
垢版 |
2026/09/18(金) 15:10:57.68ID:jrdcz93n0
JC,JKのエロ動画作成じゃないの?ローカルじゃないと危ないからな
29名称未設定
垢版 |
2026/09/18(金) 15:12:33.30ID:pXjpFhSH0
>>26
32GBでも、例えばGemma4 31b Q4とかQ6とかは一応動くのよ

ただ、ずっと動かしてるとオーバーフローで暴走したりするので常用するためには色々工夫が必要な感じ

あと量子化が意外とクオリティ(私の場合は翻訳だけど)の低下を招くんだよね

なんか色々試行錯誤したりがしんどくなって64GBに買い替えたらすこぶる快適
30名称未設定
垢版 |
2026/09/18(金) 16:02:39.24ID:seskumME0
ローカルLLMで何ができるかって?
自分がやりたいことをやれば良いだけ。
それができる機材を買えば良いだけ。
大金がつぎ込めないなら、クラウドでサブスクすれば良いだけのはなし。
あと、メモリが多いと、細かいところを気にしなくてもよくなるので、無駄な時間が減る。
それから、複数台あると、クラスタ以外でも使い分けができて幸せになる?
31名称未設定
垢版 |
2026/09/18(金) 16:34:13.65ID:rC76XPuS0
ちなみに32GB構成でもそこまで悪くない、それ以下になると逆にコスパ悪いってだけ
32GB構成で学割で20万円、これで30B級が普通に回るからコスパはめっちゃ良い
企業は大口契約で学割よりも安く大量購入できるからmac miniが一番コスパええんやろね
レスを投稿する


ニューススポーツなんでも実況