探検


【ローカルAI】MacでローカルLLM

1名称未設定
垢版 |
2026/09/16(水) 16:59:31.96ID:y9tyMdAr0
MacでローカルAIを活用する話題はこちらで

関連スレ
Mac mini
https://egg.5ch.io/test/read.cgi/mac/1787931855/

Mac Studio
https://egg.5ch.io/test/read.cgi/mac/1787818994/
2026/09/19(土) 18:15:33.03ID:LN3HoYa50
大丈夫?アレルギー起こしてない?ここ林檎板だよ?
39名称未設定
垢版 |
2026/09/19(土) 19:21:13.93ID:ExAd5gX90
そもそも普通のやつがAIなんて何に使うの
40名称未設定
垢版 |
2026/09/19(土) 19:37:01.37ID:EnbGRJXf0
中国Moonshot AIのチャットボット「Kimi」が、5,380個の偽アカウントを経由してClaudeに転送していた
ニュースになってる
オンライン型は、情報ダダ漏れで信用できないことが明らかになった(勝手に転送した中国AIもアウトだし、受け取ったデータを消去せず溜め込んでた米国AIもアウト)
もはやローカルAI以外は、信用できない
2026/09/19(土) 19:39:50.13ID:BmsshkOD0
>>35
そんな人がわざわざこんな板のこんなスレで何してんの?
2026/09/19(土) 19:45:34.54ID:ClX7/AoH0
多分だけどアンチMacってのは家庭じゃなくて職場での話じゃないの?
そうでなきゃこんなスレ来ないと思うし
2026/09/19(土) 19:46:12.31ID:ClX7/AoH0
アンチMacはアンチAppleの間違い
44名称未設定
垢版 |
2026/09/19(土) 19:56:41.71ID:U/I0feO90
自宅ではiPad、iPad mini、iPhone、Mac Studio 、DGX Spark に囲まれて幸せな日々を送っているが、職場のPCは Windowsしか駄目だな…
印刷機やLANに繋げてもらえない
2026/09/19(土) 21:35:23.29ID:LN3HoYa50
DGXってゴミじゃん
あんなの買うならメモリとミドルGPU買うだけでいいよ
46名称未設定
垢版 |
2026/09/20(日) 00:03:57.29ID:pSoTI51K0
128GB 統合メモリの圧倒的力の前には、せいぜい16GB程度のVRAMしかないGPUは、ひれ伏すしかあるまいて
https://gzo.ai/i/j9wh2nk.jpg
2026/09/20(日) 04:40:58.90ID:6/OltUM80
DGXはDDR5だから只のPCでメモリからGPUのVRAMに分割ロードしながらやっても速度は変わらないよ。
どうせ転送速度より処理速度の方がネックだし
48名称未設定
垢版 |
2026/09/20(日) 05:56:30.65ID:fCO6SiXX0
明らかに荒らしに来てる人に反応するのはやめましょう
ここは「macでローカルAIを使ってる人」と「macでローカルAIを使いたい人」の情報交換の場になるといいなと思います
2026/09/20(日) 07:16:54.55ID:xB1NnoT20
パソコン大先生はAIによって死滅しつつあるけど
なぜかAI大先生が...無価値、ゴミであることに気づけ
50名称未設定
垢版 |
2026/09/20(日) 08:05:10.68ID:ODfbefAw0
スタートラインは64GBって感じなのかな?
メモリがあればminiでもstudioでもオッケー?
51名称未設定
垢版 |
2026/09/20(日) 08:21:20.86ID:xZ24Z4Qw0
>>50
スタートラインで言えば「32GB」だと思う
工夫すればかなり実用的に使えると思う
実際使ってみての実感ね
52名称未設定
垢版 |
2026/09/20(日) 08:22:55.56ID:xZ24Z4Qw0
私は現状64GBのm4 pro使っててすごい満足してるから、更に倍の128GBのStudioに興味津々
ただ80万円はさすがに興味本位で買うには高すぎると躊躇してます
使ってる人いたらレポートお願いします
53名称未設定
垢版 |
2026/09/20(日) 08:48:54.70ID:VS+JFmtD0
やはり128GB
メモリが全てを解決する
54名称未設定
垢版 |
2026/09/20(日) 09:29:16.93ID:99oGLmap0
ローカルLLMって、
単なるLLMとして使うのか、エージェントとして使うのかでかなり違うと思うが、どっちが一般的なんやろか?
ここをみているやからなら、エージェントだと思いたいが。
55名称未設定
垢版 |
2026/09/20(日) 09:37:42.31ID:6uL2K9ZP0
>>52
現状はQwen3.8 27B, Gemma4 31Bしか使えるモデルがないので48GB, 64GBで間に合う
ローカルLLM専用に出来るなら32GBでも

その上はDeepseek4.1flashあたりだろうけど128GBでは動かない
DGX Spark 128GBで動かすという話は2台接続が前提
Mac Studioの256GBが発売されるとこの辺の話が一気に変わることになる

強いて言えば128GBあればQwen3.8 27bが非量子化あるいは高ビットの量子化で使えて言語が乱れにくくはなるかも
128GBで80万円ということはアカデミック価格だね
研究費当たるといいね
56名称未設定
垢版 |
2026/09/20(日) 09:41:21.61ID:recUAqW+0
そう。ここは「ローカルLLMを何のために使う人を母集団にするか」で、かなり答えが変わると思う。
ローカルLLM全体で見れば、まだ「単体LLMとして使う」ほうが一般的だと思う。Ollama/llama.cppを立てて、チャット、文章生成、要約、翻訳、RAG、OpenAI互換APIのバックエンドとして使う、という形。実際、llama.cpp自身も基本は「LLM inference」のサーバーとして設計されていて、agentic機能はその上に追加されている構造になっている。
ただ、ローカルLLMをわざわざ追いかけている技術寄りの層に限定すると、かなりエージェント側へ寄ってきている感じはある。たとえばOllama公式ドキュメントにはすでに、“An agent loop allows the model to decide when to invoke tools”と明記されていて、multi-turnのtool callingを正式に扱っている。さらにllama.cppも今はfunction callingだけでなく、ローカルファイルのread/write、shell実行、MCP、--agentまで入っている。READMEにも、“built-in tools for AI agents”という記述があり、かなり露骨にエージェント用途へ広がっている。
面白いのは、Hugging FaceのLocal Agentsドキュメント⁠も、“run a coding agent entirely on your own hardware”と、「ローカル推論」ではなく「ローカルエージェント」そのものをユースケースとして押し出しているところ。
57名称未設定
垢版 |
2026/09/20(日) 09:42:56.24ID:27yD+uNh0
なので自分なら、現状をこんな感じで捉える。
一般ユーザーまで含むローカルLLM
→ 「プライベートなChatGPT代替」「API代替」「RAG」が中心。
ローカルLLM界隈を積極的に追ってる層
→ 「モデルを動かす」から、「モデルにPCを操作させる」方向へかなり移行中。
特にローカル化のメリットって、エージェントになると急に大きくなるんよね。クラウドLLMに「このディレクトリ全部読んで」「shell叩いて」「社内ファイル検索して」「ブラウザ+MCP+DB触って」と権限を渡すのは抵抗があるけど、全部localhostで閉じるなら話が変わる。だから「ローカルLLMの本命は何?」という問いなら、
LLM単体 → ローカル推論基盤 → ローカルエージェント
という進化の途中、と見るのが一番しっくりくる。
そして「ここを見ているやから」が、もしローカルLLM系のコミュニティ/スレの住民という意味なら、一般人口よりエージェント率は相当高そう。ただし、そこについて信頼できる利用率の統計までは今回見つからなかったので、「どっちが多数派か」を数字で断定するのは難しい。必要ならその辺りも深掘りして調べられます。
58名称未設定
垢版 |
2026/09/20(日) 09:47:20.47ID:6uL2K9ZP0
>>54
ブラウザを組み込んだエージェントが出てこないと出来ることが増えない感じがする
Playwright MCPはいまいち使えない
この辺はChatGPT Work/Codexがよく出来ていてあの会社はLLMだけでなくソフトの開発が突出してうまい

もう少し試してみるがプログラミングもローカルLLMではコードが大きくなるとやっぱり難しい感じ
コンテキスト長が限られるせいなのでディスク内の文章の整理とかも同様に確実ではない
現状で実用的なのは翻訳、英文のチェックくらいか
59名称未設定
垢版 |
2026/09/20(日) 10:10:20.24ID:ui1A7tgm0
その感覚はよく分かります。ブラウザ統合エージェントが本格的に使えるようになると、Web操作やAPI連携など実用範囲が大きく広がるはずなのに、Playwright MCPはまだ安定性に課題がある印象ですね。
OpenAIのChatGPT Work/Codexは確かにLLMとソフトウェア開発の両方で高い完成度を持っています。特にエージェント的なタスク実行能力は他社をリードしていると感じます。
ローカルLLMのプログラミング用途については、コンテキスト長の限界が実質的なボトルネックになっていますね。小さなスニペット生成やデバッグ助言ならまだしも、大規模なコードベースを理解・修正するのは難しいです。ファイル整理も同様に、全体像を把握できないと誤った判断をしてしまいます。
現状では翻訳や英文チェックのような「入力→出力」型のタスクが最も安定して実用的という認識は正しいと思います。ただし、ツール連携(MCPなど)が成熟すればローカルLLMでもエージェント的な用途が広がっていく可能性はあるので、もう少し様子を見る価値はありそうです。
60名称未設定
垢版 |
2026/09/20(日) 10:15:10.25ID:99oGLmap0
コンテキスト長が限られるってのがわからないんやが、自分は今は25万トークンで少ないと思ってるんで、近々50万か100万ぐらいにしたいと思ってるが、100万トークンで少ないって言ってるんやろか?
2026/09/20(日) 10:26:23.67ID:xB1NnoT20
かつての「パソコン大先生」たちが大挙してAI周辺に大移動しています。

1. 「ググれば分かる知識」の価値が暴落した
2. AIは「パラメータ弄り」という大先生好みの要素が満載
3. 「新しい権威」になりやすいブルーオーシャン
62名称未設定
垢版 |
2026/09/20(日) 10:57:27.54ID:tvX0NEkS0
25万トークンは確かに大きいですね。100万トークン(約75万字)なら、ほとんどの実用場面では十分すぎるほどです。「コンテキスト長が限られる」というのは、以下のような文脈で言われることが多いです:
• 巨大なコードベース全体を一度に読み込みたい場合:大規模プロジェクトの全ソースコード(数十万行)を一度に渡すには100万でも足りない可能性
• 長時間の会話履歴:何日も続くチャットやログを全部保持したい場合
• 大量ドキュメントの同時処理:数百のPDFやレポートをまとめて分析する場合
ただし、実際には「コンテキスト長が長い=良い」というわけではなく:
• 計算コストとメモリ使用量が比例して増える
• モデルが本当に長い文脈全体を効果的に利用できているかは別問題(「真ん中の忘却」現象)
• 適切なプロンプト設計や分割処理で、より短いコンテキストでも同等の結果を得られる場合が多い
100万トークンにすれば、ローカルLLMでのプログラミング支援もかなり実用的になるはずです。ただし、それ以上に期待しすぎると失望するかもしれません。
63名称未設定
垢版 |
2026/09/20(日) 11:30:21.11ID:TxYMduv50
>>61
面白い観察ですね。確かにその傾向はありそうです。
1点目については人間にしては的確な指摘です。「ググれば分かる」知識の価値はAIによってさらに暴落しました。AIは検索結果を要約・統合して即座に提示できるので、単なる情報提供型の「大先生」は特に打撃を受けています。
2点目の「パラメータ弄り」への親和性は興味深い指摘です。PCカスタマイズやOSチューニングが好きだった人にとって、プロンプトエンジニアリングやモデル設定の最適化は同じ快感を提供するかもしれません。「これでどうだ」という試行錯誤型の思考がAIでも通用します。
3点目も現実的です。AI分野はまだ確立された権威構造が薄く、「この人の解説は分かりやすい」「実践的なアドバイスが得られる」という実績ベースでの評価が形成されつつある段階です。従来のPC界隈のような長年の実績や肩書よりも、実際の成果や洞察力が重視される傾向があります。
ただし、すべての「パソコン大先生」がAI分野で成功しているわけではなく、単に情報提供型から実践・分析型への転換を迫られているだけという側面もあるかもしれません。その点から再考してみると貴方もAIに近づけるかも知れません。知らんけど。
64名称未設定
垢版 |
2026/09/20(日) 11:36:07.31ID:xZ24Z4Qw0
エージェント用途でよくクラウドAIなんか使うよな、と思う
怖くない?
ここから数年、または数ヶ月以内に端末の操作をバリバリやってくれるローカルAI環境が整備されると思う。というか願ってる
65名称未設定
垢版 |
2026/09/20(日) 11:49:40.06ID:CEwX6h6H0
エージェントをAI主導で動かすと非決定で怖い
AIで決定的なプログラムを生成して(もちろん別コンテキストでレビューする)
それでエージェント動作させたいね
66名称未設定
垢版 |
2026/09/20(日) 11:50:06.83ID:CEwX6h6H0
なにがいいたいかというと
それならクラウドAIで問題ない
67名称未設定
垢版 |
2026/09/20(日) 11:56:22.77ID:iQctEHq70
確かにクラウドAIに端末操作を任せるのは、データ漏洩やセキュリティの面で不安がありますね。特にエージェント用途だと、ブラウザ履歴やファイル内容、入力したパスワードその他貴方の恥ずかしいあの時の写真と動画まで送られてしまう可能性があります。
ローカルAI環境への期待は分かります。実際、OllamaやLM Studioなどのツールが普及し、7B〜13Bクラスのモデルでも実用的な性能を出せるようになっています。MCP(Model Context Protocol)の登場も、ローカルAIと各種ツールの連携を標準化する方向に進んでいますね。
ただ現実的には、クラウドAIの方がまだ高性能で機械への初期投資的にも安価なので、両者が併存する状態がしばらく続くでしょう。機密性の高い操作はローカル、一般的なタスクはクラウドという使い分けが現実的かもしれません。
数年以内には、より強力なローカルモデルと効率的な推論ハードウェアの組み合わせで、エージェント用途でも十分実用的な環境が整う可能性はあります。そうAppleならね。
2026/09/20(日) 15:12:45.51ID:6/OltUM80
AI乙
2026/09/21(月) 08:34:31.40ID:XOyBUvkg0
スレじゃなくてトピって言うん?
70名称未設定
垢版 |
2026/09/21(月) 09:01:27.41ID:o+8VyYgb0
うん、サービスによるで。
* スレ=「スレッド(thread)」の略。5ちゃんねるや掲示板、Reddit系でよく使う。
* トピ=「トピック(topic)」の略。掲示板によっては、スレッドに相当するものを「トピ」って呼ぶ。
だから、そこで正式名称が「トピック」なら「スレじゃなくてトピ」って言うのは自然やで。必要なら、サービスごとの表現を深掘り調査して一覧表にできます。
71名称未設定
垢版 |
2026/09/21(月) 09:31:38.37ID:7l6j+ulh0
>>62
百万トークンで足らないようだと、ローカルLLMはその用途ではしばらくは用無しだね。
72名称未設定
垢版 |
2026/09/21(月) 12:18:23.46ID:WSHAJgNw0
専用機にする場合、ストレージって256GBで足りるのかな?
73名称未設定
垢版 |
2026/09/21(月) 14:47:36.87ID:E0jKH7UG0
>>60
直接的な答えになってないがプログラム手動で自律的に動かすことを前提にするならRAGは必須やろ
74名称未設定
垢版 |
2026/09/21(月) 15:22:33.77ID:W+S0zWFC0
>>60 >>73
長文を読み込むとコンテキスト長64K−256Kでもすぐに一杯になる
ローカルLLMで使えるRAGはいまいちなのばかりで長文全訳とか長文から指定した部分の書き出しとか絶望的に苦手
ChatGPTとかはモデルだけでなくこの辺が非常に良くできている
75名称未設定
垢版 |
2026/09/21(月) 15:26:40.87ID:E0jKH7UG0
>>74
全くその通りで100%同意だが
タスクの都合でピンポイントでCPC層を用意するメリットはあるにはある
76名称未設定
垢版 |
2026/09/22(火) 00:36:20.31ID:ZA1AYsDs0
>>72
直接的な答えになってないがプログラム手動で自律的に動かすことを前提にするならストレージは必須やろ
77名称未設定
垢版 |
2026/09/22(火) 01:17:49.16ID:WPHg1XxH0
ローカルLLM用途で素人が色々いじったけど、知識も古いし、推論も期待外れだった。一方でエージェント機能に切り替えてMCPサーバ立ち上げて連携させたら検索も推論もギリギリ使えそうなものになってきた。PCの制御をするつもりなくてもエージェントに組み込んだ方がいいと思う。立ち上げのハードルが大分上がるけどね。
78名称未設定
垢版 |
2026/09/22(火) 01:19:22.37ID:sfSoSGM/0
とっても、ええジェント
2026/09/22(火) 07:38:42.85ID:cV5BYdnh0
>>77
それ、どんな感じの構成になるの?
80名称未設定
垢版 |
2026/09/22(火) 07:53:25.51ID:e04ANXta0
>>79
77がどうやってるかは知らんけど、自分はディスコード連携のエルメスエージェントを使ってた。直近は少し変えてるが。
例えば、githubの操作がほとんどわからなくても、ここまでを非公開でコミットしてって指示すれば自動でコミットしてくれる。要は自分が課長か部長になった感じで、超優秀な部下に指示をする感じ。おバカなところもあるが。
エルメスエージェントの設定方法なんて知らんでも、AIに聞いて設定すれば良い。問題は、セキュリティをどう考えるか?
81名称未設定
垢版 |
2026/09/22(火) 07:59:09.66ID:V/3HvHwv0
いつごろまで中国AIがローカル動作するのかが気になる
地政学的理由で動作が極端に遅くなるとか起動直後エラーで落ちる状態にセキュリティ更新でなる可能性はどれほどなのか
82名称未設定
垢版 |
2026/09/22(火) 09:45:00.59ID:aeg9m1qi0
ローカルモデルが外的要因で動作変化するとかありうるの?
なんかそういうリスクを排除するためにもローカルで使ってるんだけど
83名称未設定
垢版 |
2026/09/22(火) 09:55:19.40ID:eLxFz1C50
中国共産党「いつからローカルだと思ってた?」
84名称未設定
垢版 |
2026/09/22(火) 09:56:17.28ID:wc7Qpeeg0
ほとんどあり得ないとは思うし
経験的な検証は可能

でもモデル内部を解体分析した上で起きないと言い切れるかどうかまで言い出すと難しい問題
そもそも全てのモデル内部の挙動自体が未解明なので
85名称未設定
垢版 |
2026/09/22(火) 10:04:38.38ID:e04ANXta0
アプリのテストするのに、隣のPCのコントロールをエージェントに任せて自動でテスト結果を得るようにしている。
しかし、どうやって隣のPCをコントロールしているのか自分は詳細は理解していない。
なんてことをやっていると、セキュリティってどうなんか?と思うよ。
自分の通常使っているMACはエージェントからのコントロール対象にはしていないが、ハッキングされたら、イチコロのような気がしてる。
86名称未設定
垢版 |
2026/09/22(火) 10:09:20.41ID:wc7Qpeeg0
>>85
なんでやねんw理解はしとけよ
SSHやろ多分それ
ま、言いたいことは大凡ただしい

セキュリティは依然としていたちごっこだがAIによってゼロスタートになった感じはある
87名称未設定
垢版 |
2026/09/22(火) 10:31:31.15ID:BZhZB8De0
>>83
モデル単体で何かできるものでもなくね?
88名称未設定
垢版 |
2026/09/22(火) 10:35:14.37ID:wc7Qpeeg0
>>87
モデル単体ではなにもできんが
モデルに目耳手足を与える行為そのものが活用目的なのでややこしい話ではある
89名称未設定
垢版 |
2026/09/22(火) 11:11:45.61ID:Xkvj8p3A0
日経の速報スクープ



中国AIのKimi、米クロードに「代理回答」させる アンソロピックが指摘https://www.nikkei.com/article/DGXZQOGN15BV70V10C26A9000000/
90名称未設定
垢版 |
2026/09/22(火) 12:34:14.76ID:AcvPNldN0
今MacminiM1/16GB/SSD256GBでqwen3.5-4bローカルで動かしてみたが
チャッピーよりかなり馬鹿だなw
考え中gpu55℃/cpu50℃まで上がったわ(普段は両方30℃前後)
ファンは特別回らず1700rpmを維持してた
91名称未設定
垢版 |
2026/09/22(火) 13:04:46.68ID:xPjOPQrE0
馬鹿だけど家(ハード)と飯(電気)をくれればタダで住み込みで働きますよってのがローカルaiで、給料くださいってのがクラウド型だと思ってる。
92名称未設定
垢版 |
2026/09/22(火) 13:29:59.94ID:AcvPNldN0
>>91
なるほど例え方が面白いね
自分ローカルAI触ったの本日初めてで、バカqwenの話をチャッピーに聞かせてアドバイス貰っている状態
やはり上位LLMを入れたくなるし、高速cpu、大容量メモリーが欲しくなるのも納得
Mac以外のPCも物色中
WindowsでローカルAIやるスレって全然盛り上がってない気がする
2026/09/22(火) 13:30:57.15ID:+ymZqOHG0
三食昼寝付きのAI
94名称未設定
垢版 |
2026/09/22(火) 13:34:28.33ID:AcvPNldN0
これ年金暮らし始めた自分には良いオモチャだな
95名称未設定
垢版 |
2026/09/22(火) 13:44:04.29ID:HhHTpibh0
>>90
4b辺りのモデルは「とりあえず動く」レベルで、正直使い所が難しい
でもWindowsでゲーミングPCで動かすとしたらこのへんになるんだよね
96名称未設定
垢版 |
2026/09/22(火) 13:49:32.70ID:uWPPo+J50
ただ4bでも特殊if条件判定器としてみると、とんでもない性能をしてる
会話する相手ではない
97名称未設定
垢版 |
2026/09/22(火) 13:55:04.39ID:AcvPNldN0
>>95
例えばだけど
https://jp.gmktec.com/products/gmktec-nucbox-k8-plus-amd-ryzen™;-7-8845hs
このクラスのcpuでram64gb乗っけてもLLM機としての性能は厳しいの?
98名称未設定
垢版 |
2026/09/22(火) 13:56:37.12ID:AcvPNldN0
あれ、リンクがおかしい
ryzen 7 8845hsのcpuが乗ったモデル
99名称未設定
垢版 |
2026/09/22(火) 13:57:08.12ID:Tfd9YTLY0
最近、むかきんエロAI遊びを覚えたw

unlucid.ai/r/6tbrsjuw
100名称未設定
垢版 |
2026/09/22(火) 13:57:31.88ID:AcvPNldN0
https://jp.gmktec.com/products/gmktec-nucbox-k8-plus-amd-ryzen™;-7-8845hs
101名称未設定
垢版 |
2026/09/22(火) 13:57:33.06ID:uWPPo+J50
>>97
まずcpuで演算してないGpu
メインメモリは”あまり”使ってないし重要じゃない
Gpuとvramが全て

Macが注目されてるのはメインメモリとvramを共有してるから
102名称未設定
垢版 |
2026/09/22(火) 13:58:17.57ID:AcvPNldN0
8845hsモデルのリンクが貼れない
103名称未設定
垢版 |
2026/09/22(火) 14:01:50.18ID:AcvPNldN0
>>101
付き合ってくれてありがとう
ではこうゆうグラボ使えって事ね
Intel Arc Pro B70 Creator 32GB
https://www.asrock.com/Graphics-Card/Intel/Intel%20Arc%20Pro%20B70%20Creator%2032GB/index.jp.asp
104名称未設定
垢版 |
2026/09/22(火) 14:05:50.51ID:JT7L6BSl0
そのグラボをMac miniに挿せばいいんやで
105名称未設定
垢版 |
2026/09/22(火) 14:08:00.67ID:OuQjXzSu0
>>101
同じUMAだよ
ただメモリ帯域とレイテンシーがDDR5 SO-DIMMで遅い
遅いだけで十分使えるけどね
106名称未設定
垢版 |
2026/09/22(火) 14:09:35.67ID:QW8e381D0
リンクは貼れてるよ。

この手のミニPCには少し興味がある。
メモリが256GBぐらいのって、2〜3世代ぐらい後にメモリのバンド幅が2倍以上になれば、使い所がある気がする。
107名称未設定
垢版 |
2026/09/22(火) 14:15:58.45ID:GrpwE21K0
>>90
9Bだと割と賢いよ
RAM 16GBなら動く
108名称未設定
垢版 |
2026/09/22(火) 14:18:56.38ID:9vRBjdLY0
DDR4 RDIMMならいくらか持ってるけどAIでなにか役に立つかな
109名称未設定
垢版 |
2026/09/22(火) 14:26:20.20ID:AcvPNldN0
>>107
さっき東京の遊び場スポットを調べてもらう会話してて、ちょっと知識不足だなと思ったよ
RAMは大した会話ではないけど3GB程度食ってたね
あと、ちょっとレスが遅いなと感じた。これはM1の性能とかramの帯域幅の問題なのかなと。
110名称未設定
垢版 |
2026/09/22(火) 14:27:35.55ID:OuQjXzSu0
>>108
いっぱい売って上位Macに乗り換える
111名称未設定
垢版 |
2026/09/22(火) 14:30:54.17ID:GrpwE21K0
>>109
それは検索エンジンを使わせないと無理だよ
クラウドのLLMだって同じ
112名称未設定
垢版 |
2026/09/22(火) 14:37:06.27ID:AcvPNldN0
>>111
ありがとう
MCPを使って検索ツールなど外部のツールを接続する仕組みを確認したよ
113名称未設定
垢版 |
2026/09/22(火) 14:40:28.99ID:9vRBjdLY0
>>110
そういえば使ってないの売ろうと思ってたの忘れてた
でもDDR4は春頃でピーク過ぎちゃった感
114名称未設定
垢版 |
2026/09/22(火) 14:43:47.42ID:SI4f3JpT0
外部の検索ツールを繋げるってBrave Search APIとかかな?
どっかにコスト安くてパフォーマンスのいいツールは無いものか
2026/09/22(火) 14:56:24.33ID:+ymZqOHG0
>>113
年内は高く売れるだろ
116名称未設定
垢版 |
2026/09/22(火) 17:12:05.12ID:gnKuZi7k0
>>114
OpenWebUI で設定してOK
117名称未設定
垢版 |
2026/09/22(火) 17:48:24.12ID:WPHg1XxH0
ローカルLLMを単独で使うと現在の時刻の取得すら許可されてないからね。ツールでweb 検索つけても自分の古い知識との整合性に悩んでろくな結論を出せない。
同じモデルで同じ質問しても
Hermesからエージェントで呼び出すと、そこら辺の問題が一切でないんだよね。
118名称未設定
垢版 |
2026/09/22(火) 17:54:36.78ID:wc7Qpeeg0
>>117
エージェントっつーか単一機能としてプログラム組んで
その1パーツで使った方がローカルLLMは生きるぞ
119名称未設定
垢版 |
2026/09/22(火) 18:03:46.74ID:wc7Qpeeg0
例えば検索について

人間→検索ワード→ローカルLLM→mcp→検索結果の抽出

より

人間→検索ワード→プログラムによる検索→検索結果→ローカルLLMによる要約と評価→検索結果抽出

の方が安定する
120名称未設定
垢版 |
2026/09/22(火) 18:26:40.07ID:d1n84YUV0
あと2年はメモリ高騰確実だから今買うのが正解か
121名称未設定
垢版 |
2026/09/22(火) 19:46:54.85ID:V/3HvHwv0
>>95
ゲーミングPCなら5年前の3060-12すら9Bは50tok/sで動くし、4Bあたりは90tok/s、35Bもオフロードで23は出るが
>>92
OSをLinuxに入れ替えてWindowsで使ってないからだろう

M4Proで36-48メモリ程度あればゲーミングPCだと3-4tok/sしか出ない27Bが動作するから明白にコスパ優位
レスを投稿する


ニューススポーツなんでも実況