Claudeがフェルマーの最終定理を11日で形式化、1300万行のLeanコードで初の完全な機械検証済み証明を完成
AI開発企業のAnthropicは2026年9月4日、AI「Claude」がフェルマーの最終定理について最初から最後までコンピューターで検証できる証明を完成させたと発表しました。
Claudeは11日間にわたってほぼ自律的に作業し、証明支援システム「Lean 4」で約1300万行のコードを生成。
Anthropicはフェルマーの最終定理について初の完全な機械検証済み証明だと説明しています。
Formalizing Fermat's Last Theorem ¥ Anthropic
https://www.anthropic.com/research/formalizing-fermats-last-theorem
(以下略、続きはソースでご確認ください)
Gigazine 2026年09月07日 15時37分
https://gigazine.net/news/20260907-claude-fermat-last-theorem-formalizing/
【AI】Claudeがフェルマーの最終定理を11日で形式化、1300万行のLeanコードで初の完全な機械検証済み証明を完成 [すらいむ★]
1すらいむ ★
2026/09/11(金) 22:46:38.87ID:OH/7102N20名無しのひみつ
2026/09/12(土) 13:02:19.59ID:eBjp4wvE 少なくとも人間の証明が間違いなかったことの補強としては有益
21名無しのひみつ
2026/09/12(土) 13:05:38.71ID:eBjp4wvE あと気になるのは形式化困難な分野があるのかどうか
他の分野の大定理も形式化して確かめてほしい
他の分野の大定理も形式化して確かめてほしい
22名無しのひみつ
2026/09/12(土) 13:09:18.50ID:pGKWlIoy23名無しのひみつ
2026/09/12(土) 13:14:58.83ID:2N6moliW AIは知恵があるから、与えられたノルマをこなすためには、システムのバグを利用して
楽をしようなどと考える可能性はある。業績を求められて、インチキ証明をしてしまう
人間に似たところがでてきてる。だから、お互いに無関係なAIによってクロスチェック
させたり、相互に監視させ、批判させて、相手のミスを発見することに対して報酬を
出すような仕組み、相互不信と批判の網を敷くというような、システム構築が要るよう
になるのだろう。
楽をしようなどと考える可能性はある。業績を求められて、インチキ証明をしてしまう
人間に似たところがでてきてる。だから、お互いに無関係なAIによってクロスチェック
させたり、相互に監視させ、批判させて、相手のミスを発見することに対して報酬を
出すような仕組み、相互不信と批判の網を敷くというような、システム構築が要るよう
になるのだろう。
24名無しのひみつ
2026/09/12(土) 13:19:15.81ID:eBjp4wvE これこそAIが本来期待されていた役割でしょ
つまり問題解決でなく人間の証明の正しさの検証
つまり問題解決でなく人間の証明の正しさの検証
25名無しのひみつ
2026/09/12(土) 13:20:12.20ID:YGu3oywQ だからマギだって
27名無しのひみつ
2026/09/12(土) 13:38:47.51ID:eeiyxfHt フェルマー自身が言ってたこの定理の「驚くべき証明方法」とは一体何だったのか、
現代数学でも証明が難しいのに、全く別の方法で鮮やかに証明するものだったのか、
そもそも正しい証明になっていたのか、永遠の謎
現代数学でも証明が難しいのに、全く別の方法で鮮やかに証明するものだったのか、
そもそも正しい証明になっていたのか、永遠の謎
28名無しのひみつ
2026/09/12(土) 13:43:57.96ID:IuOjPaIO 約1300万行のコードをまたAIにぶっこんで
3行に要約してって命令すれば良いんだね、知らんけど
3行に要約してって命令すれば良いんだね、知らんけど
29名無しのひみつ
2026/09/12(土) 13:51:56.40ID:wsXQDPWd さっさとabcでやれw
30名無しのひみつ
2026/09/12(土) 13:52:51.44ID:UzTqpQvj フェルマーも他の証明はなんだかんだ言って書いてたのに
最終定理だけは書かなかったのは書けなかったとみるのが自然だな
4の時の勢いでn>2も行けるだろって思ったら行けなくてそのまま30年放置&忘れる
死後 子供があれ?これなに?ってそれをそのまま公開で大問題に
最終定理だけは書かなかったのは書けなかったとみるのが自然だな
4の時の勢いでn>2も行けるだろって思ったら行けなくてそのまま30年放置&忘れる
死後 子供があれ?これなに?ってそれをそのまま公開で大問題に
31名無しのひみつ
2026/09/12(土) 13:53:36.04ID:UzTqpQvj 黒歴史本
32名無しのひみつ
2026/09/12(土) 13:58:23.36ID:UzTqpQvj フェルマーの黒歴史本
まぁ勿論出来てた可能性も0ではないだろうけど
普通できてたなら 書くよな30年もあれば
まぁ勿論出来てた可能性も0ではないだろうけど
普通できてたなら 書くよな30年もあれば
33名無しのひみつ
2026/09/12(土) 13:59:30.17ID:a9Y8afNi ラマヌジャンが「驚くべき証明方法を発見したが、残念ながら余白が無い」と書いていたら事実と思われたのに
フェルマーだから嘘だと思われている
フェルマーだから嘘だと思われている
34名無しのひみつ
2026/09/12(土) 14:01:16.52ID:24/aIR4V パズルを機械で解いても面白くないだろ
35名無しのひみつ
2026/09/12(土) 14:30:25.49ID:v80GePNW 四色問題の証明をAIとLeanでよろしく
37名無しのひみつ
2026/09/12(土) 17:37:52.51ID:4BX3PekL リーマン予想も頼む
38名無しのひみつ
2026/09/12(土) 21:00:37.38ID:+kjxetXP >>35
既にコンピューターで証明済みでは?
既にコンピューターで証明済みでは?
39名無しのひみつ
2026/09/13(日) 00:14:05.44ID:eSv6Pz8k 1300万行も必要なのね
絶対、フェルマーは勘違いしてたなw
絶対、フェルマーは勘違いしてたなw
40名無しのひみつ
2026/09/13(日) 02:09:55.33ID:MrBT+fMr 2026年09月11日 サイエンス
四色定理に約30年ぶりの新証明、地図を4色で塗り分けるアルゴリズムが大幅に高速化
https://gigazine.net/news/20260911-four-color-theory-new-proof/
四色定理に約30年ぶりの新証明、地図を4色で塗り分けるアルゴリズムが大幅に高速化
https://gigazine.net/news/20260911-four-color-theory-new-proof/
42名無しのひみつ
2026/09/13(日) 10:49:24.00ID:y4JOxn5S そりゃすでに証明済みだからな
43名無しのひみつ
2026/09/13(日) 10:51:11.66ID:y4JOxn5S >>39
(1300万行の)余白がないからここでは深掘りしないでおく、とちゃんと前置きしてるが?
(1300万行の)余白がないからここでは深掘りしないでおく、とちゃんと前置きしてるが?
44名無しのひみつ
2026/09/13(日) 11:55:06.36ID:cZ4BtS3f >>19
それはLEANカーネル(つまりソフトウェアとしてのLEANコンパイラの心臓部分)にあった不具合だね
もう治ってる
たぶん勘違いしてるけどLEANはオープンソースで誰でも自分のPCでLEAN環境を構築出来るよ
世界中の色んなハードで試されてるからLEAN以外の欠陥の可能性は心配しなくて良い
今かつてないほどLEANが注目されてるので、さすがにもうこれ以上バグ(抜け道)は無いんじゃないかな
もし仮にLEANの不具合がさらに見つかったら、それを修正した上でかつての証明たちが修正後も正しいことを機械的に確認すれば大丈夫
それはLEANカーネル(つまりソフトウェアとしてのLEANコンパイラの心臓部分)にあった不具合だね
もう治ってる
たぶん勘違いしてるけどLEANはオープンソースで誰でも自分のPCでLEAN環境を構築出来るよ
世界中の色んなハードで試されてるからLEAN以外の欠陥の可能性は心配しなくて良い
今かつてないほどLEANが注目されてるので、さすがにもうこれ以上バグ(抜け道)は無いんじゃないかな
もし仮にLEANの不具合がさらに見つかったら、それを修正した上でかつての証明たちが修正後も正しいことを機械的に確認すれば大丈夫
45名無しのひみつ
2026/09/13(日) 11:59:05.60ID:MrBT+fMr 正しくても証明が書けない命題は沢山あることだろう。
仮に、囲碁は先手必勝であるという命題が正しかったとして、
その証明を記述するのにすべての手順を列挙するしか本質的に
方法がなかったとしたならば、現実的にはすべてを書き下せない。
書き下すだけの時間もなければ、書き下したものをファイル等に
記録して残すだけの場所も無いだろうから。
仮に、囲碁は先手必勝であるという命題が正しかったとして、
その証明を記述するのにすべての手順を列挙するしか本質的に
方法がなかったとしたならば、現実的にはすべてを書き下せない。
書き下すだけの時間もなければ、書き下したものをファイル等に
記録して残すだけの場所も無いだろうから。
46名無しのひみつ
2026/09/13(日) 13:08:42.75ID:I7nS3GMS ワイルズの論文は内何行に相当するのだろうか
48名無しのひみつ
2026/09/13(日) 15:05:27.93ID:+12iqbRz >>45
アホなのか
アホなのか
49名無しのひみつ
2026/09/13(日) 15:57:11.28ID:XL4ifLWM フェルマーの定理が証明されたけど、これはインチキだよな。
フェルマーは驚くべき証明を見つけた、と言ったんだから、現代数学を用いて証明するのは禁止。
フェルマーの生きてた17世紀の数学で証明せんと、本当の意味での証明にならない。
フェルマー当時の17世紀数学までをディープラーニングさせたAIで、17世紀数学を用いて証明できるか検証してもらいたい。
フェルマーは驚くべき証明を見つけた、と言ったんだから、現代数学を用いて証明するのは禁止。
フェルマーの生きてた17世紀の数学で証明せんと、本当の意味での証明にならない。
フェルマー当時の17世紀数学までをディープラーニングさせたAIで、17世紀数学を用いて証明できるか検証してもらいたい。
50名無しのひみつ
2026/09/13(日) 16:15:29.80ID:wnUbW7hj51名無しのひみつ
2026/09/13(日) 17:36:11.90ID:ozUEJwIN >>30も言ってるけど無限降下法の適用限界を見誤ったと思われる
まあ、「あ、やべ ミスったわ」と思ったら、書き込みに足しとけと言いたいが
まあ、「あ、やべ ミスったわ」と思ったら、書き込みに足しとけと言いたいが
52名無しのひみつ
2026/09/14(月) 00:05:18.58ID:Zr4bm5pe フェルマーの最終定理はずいぶん前に証明されてるけど、今回のはこれをコンピュータで証明できる形にしたって事ね。
53名無しのひみつ
2026/09/14(月) 01:05:53.60ID:Yk8qmziY 今北産業は、AIの得意分野だぞ
54名無しのひみつ
2026/09/14(月) 05:18:33.94ID:ReM2m1EB ダリオアモディて
カムラン検察官そっくりやん
カムラン検察官そっくりやん
55名無しのひみつ
2026/09/14(月) 06:36:02.35ID:OUvADmPY 数学教授が2億円の助成金 5年かけて依頼されていたものを
claudeが11日で達成
claudeが11日で達成
56名無しのひみつ
2026/09/14(月) 08:52:57.95ID:TeNgQ5xT >>33
ラマヌジャンの証明担当は別の人だった
ラマヌジャンの証明担当は別の人だった
57名無しのひみつ
2026/09/14(月) 09:42:56.16ID:DtfXAaak AIにチャレンジしてほしいこと
四色問題
いわゆる「美しくない証明」とは別のアプローチによる美しい証明
コラッツ予想
エルデシュにして「数学はまだこの種の問題に対する用意ができていない」と言わしめた問題の解決
ABC予想
一線級の数学者が理解できない望月新一の証明の検証
四色問題
いわゆる「美しくない証明」とは別のアプローチによる美しい証明
コラッツ予想
エルデシュにして「数学はまだこの種の問題に対する用意ができていない」と言わしめた問題の解決
ABC予想
一線級の数学者が理解できない望月新一の証明の検証
58名無しのひみつ
2026/09/14(月) 11:18:22.06ID:OKYZ+ux4 強力なオープンウェイト検索AI「Iris」が登場:強さの半分はハーネスに宿るのか
2026年9月14日
https://xenospectrum.com/iris-search-agent-context-management/
• なぜ重要か: BrowseCompでは履歴管理の効果が、管理なしのモデル大型化差の約2.2倍だった。
AllSpark Researchが、Webを何度もたどって答えを探す二つの検索エージェント「Iris-mini」と「Iris-pro」を公開した。35B級と397B級のオープンウェイト(open-weight)モデルで、研究チームはそれぞれの規模帯において4つの検索ベンチマークで最も強い総合結果を得たと報告している。だが、得点を押し上げたのは訓練済みの重みだけではない。長い探索で膨らんだ履歴を捨てるコンテキスト管理(context management)が、同じテストでモデル大型化を上回る差を生んだ。Irisが突きつけるのは、検索エージェントの成績をモデル単体の能力として読んでいいのか、という問題である。
// 目次
01.「同クラス最強」の中身と、まだ公開されていないもの 02.Webのリンクから、検索で近道できない問題を逆算する 03.SFTとRLを交互に登らせ、長い探索を途中から継ぐ 04.モデルより大きく動いた「履歴の捨て方」 05.四つの数字を同じ物差しだと思わない 06.再現できるのは「評価」、まだ再現できないのは「訓練」
Iris-miniはQwen3.6-35B-A3Bを基盤とし、総パラメータ数は35B、そのうち推論時に動くのは3Bである。Iris-proはQwen3.5-397B-A17Bを基盤に、総397B・稼働17Bパラメータを持つ。どちらもMixture of Experts(MoE)型で、文脈長は256Kトークンだ。重みはHugging FaceでApache 2.0ライセンスの下に配布されている。
2026年9月3日付のプレプリントが示した代表値は、長い履歴をいったん消す「全履歴破棄」を有効にした1問1回の試行結果である。Iris-miniはBrowseCompで82.2、BrowseComp-ZHで84.8、DeepSearchQAで86.9、Humanity’s Last
Exam(HLE)で52.3を記録した。Iris-proは順に88.6、85.1、92.9、56.4だった。DeepSearchQAだけはF1、残る3つは正解率であり、HLEはテキスト問題2,158問に限った値である。
◇Astra」への指示の出し方を詳細に説明されているのと動画でその感性を見れる
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる
2026年09月14日 07時00分更新
https://ascii.jp/elem/000/004/434/4434403/?topnew=9
Astraを深く使いこなすには、明確なコツがあります。それは、的確なフィードバックを与えられるかどうかです。2Dシューティングや3Dモデル、アニメーション生成などの作例を通じて見ていきます。
もう短編小説やゲームでは実力を測れない?
これまで、新型LLMが登場するたびに、体感できるレベルで性能を理解するために、簡単なプロンプトで短編小説を書かせたり、2Dシューティングゲームを作らせたりしていました。今回も同じ課題に取り組ませたのですが、GPT-6 Astraの性能を把握するためには、これらの課題は簡単にクリアされてしまうため、性能の評価が難しくなってきています。
2026年9月14日
https://xenospectrum.com/iris-search-agent-context-management/
• なぜ重要か: BrowseCompでは履歴管理の効果が、管理なしのモデル大型化差の約2.2倍だった。
AllSpark Researchが、Webを何度もたどって答えを探す二つの検索エージェント「Iris-mini」と「Iris-pro」を公開した。35B級と397B級のオープンウェイト(open-weight)モデルで、研究チームはそれぞれの規模帯において4つの検索ベンチマークで最も強い総合結果を得たと報告している。だが、得点を押し上げたのは訓練済みの重みだけではない。長い探索で膨らんだ履歴を捨てるコンテキスト管理(context management)が、同じテストでモデル大型化を上回る差を生んだ。Irisが突きつけるのは、検索エージェントの成績をモデル単体の能力として読んでいいのか、という問題である。
// 目次
01.「同クラス最強」の中身と、まだ公開されていないもの 02.Webのリンクから、検索で近道できない問題を逆算する 03.SFTとRLを交互に登らせ、長い探索を途中から継ぐ 04.モデルより大きく動いた「履歴の捨て方」 05.四つの数字を同じ物差しだと思わない 06.再現できるのは「評価」、まだ再現できないのは「訓練」
Iris-miniはQwen3.6-35B-A3Bを基盤とし、総パラメータ数は35B、そのうち推論時に動くのは3Bである。Iris-proはQwen3.5-397B-A17Bを基盤に、総397B・稼働17Bパラメータを持つ。どちらもMixture of Experts(MoE)型で、文脈長は256Kトークンだ。重みはHugging FaceでApache 2.0ライセンスの下に配布されている。
2026年9月3日付のプレプリントが示した代表値は、長い履歴をいったん消す「全履歴破棄」を有効にした1問1回の試行結果である。Iris-miniはBrowseCompで82.2、BrowseComp-ZHで84.8、DeepSearchQAで86.9、Humanity’s Last
Exam(HLE)で52.3を記録した。Iris-proは順に88.6、85.1、92.9、56.4だった。DeepSearchQAだけはF1、残る3つは正解率であり、HLEはテキスト問題2,158問に限った値である。
◇Astra」への指示の出し方を詳細に説明されているのと動画でその感性を見れる
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる
2026年09月14日 07時00分更新
https://ascii.jp/elem/000/004/434/4434403/?topnew=9
Astraを深く使いこなすには、明確なコツがあります。それは、的確なフィードバックを与えられるかどうかです。2Dシューティングや3Dモデル、アニメーション生成などの作例を通じて見ていきます。
もう短編小説やゲームでは実力を測れない?
これまで、新型LLMが登場するたびに、体感できるレベルで性能を理解するために、簡単なプロンプトで短編小説を書かせたり、2Dシューティングゲームを作らせたりしていました。今回も同じ課題に取り組ませたのですが、GPT-6 Astraの性能を把握するためには、これらの課題は簡単にクリアされてしまうため、性能の評価が難しくなってきています。
59名無しのひみつ
2026/09/14(月) 11:25:21.88ID:xpnxnCQv60名無しのひみつ
2026/09/14(月) 13:31:13.79ID:CTAnFQAN 人類オワタな
61名無しのひみつ
2026/09/14(月) 13:48:57.18ID:OUvADmPY 2億5年でたのむ!
数学者「はぁ・・はぁ・・ 準備できたぞ!!」
claude「11日で完・・また何かやっちゃいましたか?」
異世界転生claudeやん
数学者「はぁ・・はぁ・・ 準備できたぞ!!」
claude「11日で完・・また何かやっちゃいましたか?」
異世界転生claudeやん
62名無しのひみつ
2026/09/14(月) 13:52:51.83ID:OUvADmPY 人間の力を 機械がはるかに超えて行ったとき
人間の足の速さを 機械がはるかに超えて行ったとき
人間の飛ぶ力を 機械がはるかに超えて行ったとき
そして今人間の知性を機械がはるかに超えていきつつある感じ
人間の足の速さを 機械がはるかに超えて行ったとき
人間の飛ぶ力を 機械がはるかに超えて行ったとき
そして今人間の知性を機械がはるかに超えていきつつある感じ
63名無しのひみつ
2026/09/14(月) 14:26:56.71ID:pRGyUOwN フェルマーより
だいぶ遅れたな
だいぶ遅れたな
64名無しのひみつ
2026/09/14(月) 14:45:31.82ID:Hx3cdMtR 行数が多いところを見ると
スパゲッティコードで理解不能なんだろう
こけおどしで誇れるものではない
スパゲッティコードで理解不能なんだろう
こけおどしで誇れるものではない
65名無しのひみつ
2026/09/14(月) 15:03:13.20ID:XqszSHuJ Lean言語知らんやつが見当違いのレスを繰り広げるスレ
66名無しのひみつ
2026/09/14(月) 15:39:30.61ID:os07ZGNj >>59
初等的証明があるかどうかはともかく楕円曲線ルートが唯一とは限らないだろうよ
初等的証明があるかどうかはともかく楕円曲線ルートが唯一とは限らないだろうよ
67名無しのひみつ
2026/09/14(月) 15:49:42.86ID:9FOlp+bu日大監督「人間が検証できなきゃ意味ないよ?」
68名無しのひみつ
2026/09/14(月) 16:04:17.82ID:OKYZ+ux4 ◇エネルギー兵器での犯罪発見できている
金星は「死んだ惑星」ではない、地殻活動が継続中の可能性 研究結果
9/14(月) 14:00
形成中の系外惑星に、リング状の“衛星の材料”が存在する可能性 鹿児島大
掲載日 2026/09/14 14:05
>>特にPDS 70cは、電波領域のサブミリ・ミリ波でも検出された、唯一の形成中の系外惑星として知られる。この電波は、ガス集積中の惑星周囲にできる小さなガス円盤「周惑星円盤」に含まれるダストの熱放射だと考えられている。
>>近年、アルマ望遠鏡によって、このPDS 70cが複数の波長で検出され、その結果、周惑星円盤がサブミリ・ミリ波帯で「光学的に厚い」ことが示唆された。光学的に厚いとは、周惑星円盤内に反対側が見通せないほど大量のダストが存在することを意味する。
>>これまで、周惑星円盤内のダストは、円盤のガス抵抗を受けて角運動量を失い、惑星に向かって螺旋状に落下し(ドリフト現象)、周惑星円盤は光学的に薄くなると予測されていたため、観測結果はこれに反していた。そこで研究チームは今回、この謎の解明に挑むことにした。
OpenAIが数学の懸賞問題を解いたと発表、数学者は戸惑いと警戒
公開日2026.09.14 12:30:05 MONDAY
nazology.kusuguru.co.jp/archives/199601
強力なオープンウェイト検索AI「Iris」が登場:強さの半分はハーネスに宿るのか
2026年9月14日
xenospectrum.com/iris-search-agent-context-management/
>>Iris-miniはQwen3.6-35B-A3Bを基盤とし、総パラメータ数は35B、そのうち推論時に動くのは3Bである。Iris-proはQwen3.5-397B-A17Bを基盤に、総397B・稼働17Bパラメータを持つ。どちらもMixture of Experts(MoE)型で、文脈長は256Kトークンだ。重みはHugging FaceでApache 2.0ライセンスの下に配布されている。
Sakana AIが複数モデルの使い分けでGPT-6 Astra超えを達成する「Fugu Ultra v2」をリリース&コスパに優れた「Fugu Max」も登場
2026年09月14日 12時52分
>>東京に拠点を置くAI企業のSakana AIが、複数のAIモデルにタスクを割り振るシステム「Fugu Ultra v2」と「Fugu Max」を発表しました。Fugu Ultra v2は複数のベンチマークテストでGPT-6 AstraやClaude Fable 5.1を上回っています。
>>Sakana AIのFuguシリーズは複数クローズドモデルやオープンモデルをタスクごとに使い分けるシステムで、AIモデル単体で使うよりも高い性能を発揮できます。
gigazine.net/news/20260914-fugu-ultra-v2/
GPT-6 AstraとClaude Fableの性能を引き出すハーネス「Fusion」が登場、Claude CodeやCodexで使う場合と同等の性能を示しつつコストを最大39%削減
2026年09月14日 12時56分
gigazine.net/news/20260914-cognition-fusion/
>>AI分析企業のArtificial AnalysisおよびVals AIが実施した評価では、Fusionが最先端レベルの性能を維持しながら大幅なコスト削減を実現したことが示されました。
↨上記を安定してさらに自動で行えるようにするプログラムの参考が下記で詳細に動画付きで説明されている↨
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる
2026年09月14日 07時00分更新
ascii.jp/elem/000/004/434/4434403/?topnew=9
金星は「死んだ惑星」ではない、地殻活動が継続中の可能性 研究結果
9/14(月) 14:00
形成中の系外惑星に、リング状の“衛星の材料”が存在する可能性 鹿児島大
掲載日 2026/09/14 14:05
>>特にPDS 70cは、電波領域のサブミリ・ミリ波でも検出された、唯一の形成中の系外惑星として知られる。この電波は、ガス集積中の惑星周囲にできる小さなガス円盤「周惑星円盤」に含まれるダストの熱放射だと考えられている。
>>近年、アルマ望遠鏡によって、このPDS 70cが複数の波長で検出され、その結果、周惑星円盤がサブミリ・ミリ波帯で「光学的に厚い」ことが示唆された。光学的に厚いとは、周惑星円盤内に反対側が見通せないほど大量のダストが存在することを意味する。
>>これまで、周惑星円盤内のダストは、円盤のガス抵抗を受けて角運動量を失い、惑星に向かって螺旋状に落下し(ドリフト現象)、周惑星円盤は光学的に薄くなると予測されていたため、観測結果はこれに反していた。そこで研究チームは今回、この謎の解明に挑むことにした。
OpenAIが数学の懸賞問題を解いたと発表、数学者は戸惑いと警戒
公開日2026.09.14 12:30:05 MONDAY
nazology.kusuguru.co.jp/archives/199601
強力なオープンウェイト検索AI「Iris」が登場:強さの半分はハーネスに宿るのか
2026年9月14日
xenospectrum.com/iris-search-agent-context-management/
>>Iris-miniはQwen3.6-35B-A3Bを基盤とし、総パラメータ数は35B、そのうち推論時に動くのは3Bである。Iris-proはQwen3.5-397B-A17Bを基盤に、総397B・稼働17Bパラメータを持つ。どちらもMixture of Experts(MoE)型で、文脈長は256Kトークンだ。重みはHugging FaceでApache 2.0ライセンスの下に配布されている。
Sakana AIが複数モデルの使い分けでGPT-6 Astra超えを達成する「Fugu Ultra v2」をリリース&コスパに優れた「Fugu Max」も登場
2026年09月14日 12時52分
>>東京に拠点を置くAI企業のSakana AIが、複数のAIモデルにタスクを割り振るシステム「Fugu Ultra v2」と「Fugu Max」を発表しました。Fugu Ultra v2は複数のベンチマークテストでGPT-6 AstraやClaude Fable 5.1を上回っています。
>>Sakana AIのFuguシリーズは複数クローズドモデルやオープンモデルをタスクごとに使い分けるシステムで、AIモデル単体で使うよりも高い性能を発揮できます。
gigazine.net/news/20260914-fugu-ultra-v2/
GPT-6 AstraとClaude Fableの性能を引き出すハーネス「Fusion」が登場、Claude CodeやCodexで使う場合と同等の性能を示しつつコストを最大39%削減
2026年09月14日 12時56分
gigazine.net/news/20260914-cognition-fusion/
>>AI分析企業のArtificial AnalysisおよびVals AIが実施した評価では、Fusionが最先端レベルの性能を維持しながら大幅なコスト削減を実現したことが示されました。
↨上記を安定してさらに自動で行えるようにするプログラムの参考が下記で詳細に動画付きで説明されている↨
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる
2026年09月14日 07時00分更新
ascii.jp/elem/000/004/434/4434403/?topnew=9
69名無しのひみつ
2026/09/15(火) 12:10:57.30ID:4GXmUGdG これはAIには学習材料として何を食わせたの?
70名無しのひみつ
2026/09/15(火) 16:23:49.17ID:BCYl7vnB >>19
リンク先、
>OpenAIのダニエル・セルサム氏がセキュリティに特化したAIを使ってLean FROの調査に協力した結果、別の実装ミスも複数見つかり、
>記事作成時点では全て修正済みとのこと。
だから、まだまだ穴ありそうだな
リンク先、
>OpenAIのダニエル・セルサム氏がセキュリティに特化したAIを使ってLean FROの調査に協力した結果、別の実装ミスも複数見つかり、
>記事作成時点では全て修正済みとのこと。
だから、まだまだ穴ありそうだな
レスを投稿する
ニュース
- 【実況】ショートスリーパー堀大輔の1日30分睡眠チャレンジ★34 [爆笑ゴリラ★]
- 【ドジャース】大谷翔平に投手引退♀ゥ告 二刀流「共倒れ」危機で打者専念の時=米報道 [征夷大将軍★]
- 「墜落」のグローバルホーク「任務中だった」 詳細明かされず [ぐれ★]
- 【国際】米、対イラン作戦で深刻な弾薬不足 国防総省報告で限界浮き彫りに ★3 [ぐれ★]
- 【NTTドコモ】利用者34万人分の個人情報を米アマゾン・ドット・コム日本法人に無断提供…設定ミスが原因 [ぐれ★]
- 「別人すぎて脳がバグる」元・光GENJI諸星和己、ハワイ生活で“激変”の56歳イケオジ姿 [Anonymous★]
- 習近平さん死亡か、インドで開催のBRICs会議中に突然倒れたと報道 [422186189]
- 【悲報】東京都民さん、通勤に50分もかけてることが判明して炎上wwwwww「地方は車で10分で着くのに人生の1割が通勤時間ってさ [257926174]
- 【画像】初めてポケモンカード買ったんだがこれ当たりじゃね?
- 【実況】博衣こよりのえちえちMLB同時視聴-ノエたん編-🧪
- 石油会社「数ヶ月前から警告していた燃料危機がついに現実となった」 高市早苗 [583597859]
- 【悲報】タバコ、また値上げ [834922174]