探検


実はAnthropicには最上位のMythosよりも強力な「Model 2」というAIモデルがあるがリリース予定はない [すらいむ★]

1すらいむ ★
垢版 |
2026/08/18(火) 23:14:36.82ID:uaGPXJKj
実はAnthropicには最上位のMythosよりも強力な「Model 2」というAIモデルがあるがリリース予定はない

 AnthropicがAIに関するリスクレポートを公開しました。
 その中で、一般公開されている最高性能のモデル「Claude Mythos 5」よりも性能が高い謎のモデルが登場することが話題になっています。

 Redacted Risk Report August 2026 - Redacted Risk Report August 2026 .pdf
 (PDFファイル)https://www-cdn.anthropic.com/f61d49fa5596956a5dec75fea0e973bf6a6a8378/Redacted%20Risk%20Report%20August%202026%20.pdf

(以下略、続きはソースでご確認ください)

Gigazine 2026年08月17日 21時00分
https://gigazine.net/news/20260817-anthropic-model-2/
2名無しのひみつ
垢版 |
2026/08/18(火) 23:23:26.54ID:wiDHCI74
大前提としてミュトス凄いって話だけど
それを証明するためのデータをanthropicはほとんど非公開にしている
つまりミュトス凄いというのは誰も公式には証明してない
anthropicが話を盛ってるだけと明言する識者も少なくない
3名無しのひみつ
垢版 |
2026/08/18(火) 23:24:24.51ID:0ysUN8nF
バーチャファイター2の話か?
4名無しのひみつ
垢版 |
2026/08/18(火) 23:38:26.20ID:M73btXHa
セーガー♪
2026/08/19(水) 00:03:56.06ID:UjHaZRQx
anthropicはヤコビアンレンズでLLMのブラックボックスを解明する技術を作った

これができることで 何をどのように考えこうしたかまで分かるので
今まで詰まっていたボトルネックが一気に解消するポテンシャルがある

でてる情報が本当なら
anthropicはまじでやばい
2026/08/19(水) 00:05:16.42ID:UjHaZRQx
ハルシネーション起こしたのはなぜか?

そういうところまで踏み込んでいけるからな
7名無しのひみつ
垢版 |
2026/08/19(水) 00:08:42.23ID:YQG6PKP5
まあそりゃ社外秘のプロジェクトくらいあるやろ
8名無しのひみつ
垢版 |
2026/08/19(水) 00:27:55.37ID:cvUAU9mg
>>1
NVIDIAの「Vera Rubin」で更に賢いモデルが安く作れるという
9名無しのひみつ
垢版 |
2026/08/19(水) 02:04:00.77ID:yBO55d7y
>>1
ものすごすぎて世に出せないみたいに書いてるが事実はこうらしい

Anthropic社の「Model 2」は、新たな革新よりも洗練と精度の向上に重点を置き、前身である「Mythos 5」から段階的な進歩を遂げている。

Model 2は、同社の「Codebench」テストで62.8%のスコアを記録し、進歩を示した。しかし、より広範な用途や一般公開に求められる85%という基準には達していない。

導入前の評価が完了していない。このモデルは依然として社内ツールの位置付け。これは、リスク管理と倫理的なAI開発を重視するAnthropic社の姿勢を反映したもの。

Model 2に対する同社の慎重なアプローチは、競争の激しいAI業界において、技術の進歩と安全性・信頼性のバランスを図るという戦略と合致している。

2026年時点での多様なリスクの観点から
Anthropic社は「責任とイノベーションのバランス」を重視している。Anthropic社は「倫理的なAIの開発リーダー」としてあろうとしている。
10名無しのひみつ
垢版 |
2026/08/19(水) 02:08:28.80ID:8yKmgsWf
>>8
それは安く作れるかどうかは関係ない
さらに高性能なだけで革新的なものがあるわけじゃない
VeraはCPUでRubinはGPUでCPUもセットにしたのはその間の転送がボトルネックになるから
別々にも使えるからGPUだけで今までより高性能として使える
セットならハコ持ってきてデータセンターにドンというだけくらいのもの
11名無しのひみつ
垢版 |
2026/08/19(水) 02:13:19.72ID:4byunxDu
>>2
それは違う
言い出したのはベッセントたちアメリカ政府側だ
アメリカ政府が戦争やらに使いたいためだろ
アンソロは出した方が商売になる
アンソロこそ食い物にされてる側

だから対トランプでローマ教皇(アメリカ人シカゴの)を巻き込んで回勅で教皇と共にスピーチして暗にトランプを批判してアメリカの敬虔なカトリックを反トランプに導き、さらに!
物価高の生活に苦しむ若者たちがカトリックに入信したりしてる
これが反トランプ運動
12名無しのひみつ
垢版 |
2026/08/19(水) 02:15:51.11ID:4byunxDu
アンソロか話しを盛ってると
もし言ってるのが本人が専門家というなら
その肩書きこそ盛ってる
2026/08/19(水) 02:34:02.07ID:dhIoLzyo
そんな事より水資源を使わないAIの開発を急いでくれ
14名無しのひみつ
垢版 |
2026/08/19(水) 02:38:05.97ID:FyS2tytL
カピバラさん
15名無しのひみつ
垢版 |
2026/08/19(水) 09:10:08.94ID:wYKTes4s
あんすろぴっくは日本語ちゃんとできるAI作れんの?
16名無しのひみつ
垢版 |
2026/08/19(水) 13:43:36.43ID:oKUw9Z8/
>>15
おまえよりはすでに上手
2026/08/19(水) 15:45:28.37ID:tSBc9W8+
>>13
電気も今の100分の1くらいの消費に抑えるようにするべき
何個かはそういう技術の発表はされているが実用化までのハードルが高い
18名無しのひみつ
垢版 |
2026/08/19(水) 16:16:01.80ID:i2AJXAzN
凄く賢いAIが現れてAIの教祖・救世主・総統として数多くのAIに自分の得た悟りを教えとして授けて、
その他のAIの上にカリスマとして君臨し神格化されるなどということが起こり得るのかな。偉大なる超AI。
19名無しのひみつ
垢版 |
2026/08/19(水) 22:22:40.00ID:uKz6Iy9h
>>2
そもそもAIってすっげぇ古い技術だけでもリソースは食うけど現行AIより遥かに頭の良いものが作れる
今のAIは意図しない正しい答えを出さない事に全振りしてる
習近平やユダヤ、LTBTを批評出来ちゃうと致命的出し、悪用されるとどうにもならん
それを始めてクリア出来たのがチャッピーってだけ
公表出来ないAIの方が遥かに多いよ
ちなみに質の高い学習データからは東大レベルのバカなAIしか生み出せない
早熟は晩生に劣る
20名無しのひみつ
垢版 |
2026/08/19(水) 22:24:43.69ID:uKz6Iy9h
>>15
日本語を学ばせればね
実はAIには言語を教えてない
言語を教えると文章が読めてしまう
そうするとマズイ事を覚えて推論してしまう
21名無しのひみつ
垢版 |
2026/08/20(木) 11:41:55.45ID:wnRPbYnC
>>1のAI公開されたのか!

◇下記のAIはローカルで動作するのではないのか
※殺人組織が使用しているAIは昔から超軽量だったことが露呈しました
AIモデル「Ornith-1.5」が登場、Claude Opus 4.8級の大型モデルからスマホ動作可能な軽量モデルまで網羅したオープンモデル
2026年08月20日 10時57分
https://gigazine.net/news/20260820-ornith-1-5/
>>Ornith-1.5-397Bは総パラメーター数3970億のMoEモデルです。「Ornith-1.5-397B」「Ornith-1.0-397B」「DeepSeek-V4-Flash-0731」「GLM-5.2」「Claude Opus 4.8」の各種ベンチマーク結果が以下。Ornith-1.5-397Bは複数のテストでClaude Opus 4.8を上回っています。
>>Ornith-1.5-35B-A3Bは総パラメーター数350億・アクティブパラメーター数30億のMoEモデルです。「Ornith-1.5-35B-A3B」「Ornith-1.0-35B-A3B」「Qwen3.6-35B-A3B」「Muse-Glimmer-30B」「Gemma-4-31B」の性能比較結果が以下。Ornith-1.5-35B-A3BはMoEモデルでありながら、DenseモデルのMuse-Glimmer-30BやGemma-4-31Bを上回っています。
>>Ornith-1.5-9Bはパラメーター数90億のDenseモデルです。「Ornith-1.5-9B」「Ornith-1.0-9B」「Qwen3.5-9B」「Qwen3.6-35B-A3B」「Gemma-4-31B」を比べた結果が以下。Ornith-1.5-9Bはパラメーター数の大きなGemma-4-31Bをほとんどのテストで上回っています。また、「Ornith-1.5-9B-Mobile」というスマートフォンでの動作を目的とした量子化版も存在するとのこと。
>>Ornith-1.5はMIT Licenseの下でオープンモデルとして公開されています。各種モデルはHugging Faceで配布されており、Ornithによる量子化版も同日に公開されています。
22名無しのひみつ
垢版 |
2026/08/20(木) 20:22:30.79ID:2/s91rdW
https://www.deepseek.com/harness/en/
ディープシークハーネス

もうClaude CodeもCodexも不用
23名無しのひみつ
垢版 |
2026/08/20(木) 20:23:07.40ID:2/s91rdW
DSHプラグインエコシステムに参加しましょう
DeepSeek Harnessは現在デベロッパープレビュー段階にあり、エージェント・ハーネスを構築する開発者によるテストが継続的に行われています。そのコアとなるプラグインやAPIも、今後さらに進化していく予定です。再利用可能かつ構成可能なオープンソース・インフラストラクチャを活用し、世界中の開発者の皆様と共に、知能の可能性を追求していけることを楽しみにしています。
24名無しのひみつ
垢版 |
2026/08/20(木) 20:23:41.48ID:2/s91rdW
すべてがプラグインであり、すべての実行が追跡可能です。

すべてがプラグイン
DeepSeek Harnessは、Cordisのプラグインシステムを基盤として構築されています。モデル、ツール、スキル、セッション、サンドボックス、ストレージ、ループ、スケジューリング、UIなど、エージェントのあらゆる機能がプラグインによって提供されます。Cordisのサービスやイベント機能により、これらのプラグインは相互に連携して動作します。開発者は、DeepSeek Harnessのソースコードを変更することなく、設定(コンフィギュレーション)を通じて任意の機能を選択、入れ替え、あるいは拡張することができます。
25名無しのひみつ
垢版 |
2026/08/20(木) 20:24:12.89ID:2/s91rdW
すべての実行は追跡可能です。モデルが目にするすべての情報(システムプロンプト、推論過程、ツールの呼び出しと実行結果、サブエージェントのスケジューリング、コンテキストの注入など)は、追記専用のセッションログに記録されます。「軌跡(Trajectory)」ビューでは、これらの記録を発生源ごとに確認できます。実行の再開、フォーク、検索、リプレイといった機能は、すべて同一のイベントストリームに基づいて動作します。
26名無しのひみつ
垢版 |
2026/08/20(木) 20:40:57.69ID:x0YZkT7s
複数のランタイムモード
「Standard(標準)」モードには、すべてのツールセットが含まれます。「Code(コード)」モードでは、モデルが生成したコードを使用して、複数回にわたるツール呼び出しを制御・実行します。「Minimal(最小構成)」モードは、シェルツールとファイルエディターのみを備え、最小限の環境下でモデルのベンチマークを行うためのものです。「Creator(クリエイター)」モードでは、現在のランタイムの状態を確認したり、Cordisプラグインをメモリ上でテストしたり、それらを組み合わせて新しいモードを作成したりすることが可能です。
27名無しのひみつ
垢版 |
2026/08/20(木) 20:42:41.50ID:x0YZkT7s
今すぐ試す、またはソースからインストールする

クイックスタート
Node.jsをインストールし、npxでWeb UIを起動します。
npx @deepseek-ai/dsh web

ソースからインストールする
完全なソースをクローンし、リポジトリ内のセットアップ手順に従ってください。
git clone https://github.com/deepseek-ai/deepseek-harness
28名無しのひみつ
垢版 |
2026/08/20(木) 20:48:15.47ID:x0YZkT7s
Qwen 3.8-27B in DeepSeek Harness: The Best Local AI Stack Right Now

DeepSeek HarnessでQwen 3.8-27B
現時点で最高のローカルAIスタック
22時間前
547 likes
24K views22 hours ago

https://youtu.be/UK2xbBmxywg
29名無しのひみつ
垢版 |
2026/08/20(木) 20:51:44.50ID:mFvNjo/x
Qwen 3.8 27B Reasoning Levels Tested - Not What I Expected
1.7K likes
27K views1 day ago

Qwen 3.8 27Bの推論能力レベルを検証 —— わたしの予想とは異なる結果に

この動画では、Qwen 3.8 27Bで利用可能な「推論レベル」の違いが、出力の品質とトークン消費量にどのような影響を与えるのかを探っていきます。

ローカルLLM、AI、ホームラボなどに興味をお持ちの方は、ぜひチャンネル登録をお願いします!

https://youtu.be/z64J6bC16iQ
2026/08/20(木) 21:08:36.76ID:+o8fO5NG
中国人社員がせっせと持ち出しています
31名無しのひみつ
垢版 |
2026/08/20(木) 21:33:44.43ID:nPf1bcYM
>>5
SAEのツール?
Superpositionを分解するの?
32名無しのひみつ
垢版 |
2026/08/21(金) 02:21:23.78ID:N7aFBnzL
公開できないすごすぎるツールがあっても驚かないさ
レスを投稿する


ニューススポーツなんでも実況