>>33
ラマヌジャンの証明担当は別の人だった
【AI】Claudeがフェルマーの最終定理を11日で形式化、1300万行のLeanコードで初の完全な機械検証済み証明を完成 [すらいむ★]
56名無しのひみつ
2026/09/14(月) 08:52:57.95ID:TeNgQ5xT57名無しのひみつ
2026/09/14(月) 09:42:56.16ID:DtfXAaak AIにチャレンジしてほしいこと
四色問題
いわゆる「美しくない証明」とは別のアプローチによる美しい証明
コラッツ予想
エルデシュにして「数学はまだこの種の問題に対する用意ができていない」と言わしめた問題の解決
ABC予想
一線級の数学者が理解できない望月新一の証明の検証
四色問題
いわゆる「美しくない証明」とは別のアプローチによる美しい証明
コラッツ予想
エルデシュにして「数学はまだこの種の問題に対する用意ができていない」と言わしめた問題の解決
ABC予想
一線級の数学者が理解できない望月新一の証明の検証
58名無しのひみつ
2026/09/14(月) 11:18:22.06ID:OKYZ+ux4 強力なオープンウェイト検索AI「Iris」が登場:強さの半分はハーネスに宿るのか
2026年9月14日
https://xenospectrum.com/iris-search-agent-context-management/
• なぜ重要か: BrowseCompでは履歴管理の効果が、管理なしのモデル大型化差の約2.2倍だった。
AllSpark Researchが、Webを何度もたどって答えを探す二つの検索エージェント「Iris-mini」と「Iris-pro」を公開した。35B級と397B級のオープンウェイト(open-weight)モデルで、研究チームはそれぞれの規模帯において4つの検索ベンチマークで最も強い総合結果を得たと報告している。だが、得点を押し上げたのは訓練済みの重みだけではない。長い探索で膨らんだ履歴を捨てるコンテキスト管理(context management)が、同じテストでモデル大型化を上回る差を生んだ。Irisが突きつけるのは、検索エージェントの成績をモデル単体の能力として読んでいいのか、という問題である。
// 目次
01.「同クラス最強」の中身と、まだ公開されていないもの 02.Webのリンクから、検索で近道できない問題を逆算する 03.SFTとRLを交互に登らせ、長い探索を途中から継ぐ 04.モデルより大きく動いた「履歴の捨て方」 05.四つの数字を同じ物差しだと思わない 06.再現できるのは「評価」、まだ再現できないのは「訓練」
Iris-miniはQwen3.6-35B-A3Bを基盤とし、総パラメータ数は35B、そのうち推論時に動くのは3Bである。Iris-proはQwen3.5-397B-A17Bを基盤に、総397B・稼働17Bパラメータを持つ。どちらもMixture of Experts(MoE)型で、文脈長は256Kトークンだ。重みはHugging FaceでApache 2.0ライセンスの下に配布されている。
2026年9月3日付のプレプリントが示した代表値は、長い履歴をいったん消す「全履歴破棄」を有効にした1問1回の試行結果である。Iris-miniはBrowseCompで82.2、BrowseComp-ZHで84.8、DeepSearchQAで86.9、Humanity’s Last
Exam(HLE)で52.3を記録した。Iris-proは順に88.6、85.1、92.9、56.4だった。DeepSearchQAだけはF1、残る3つは正解率であり、HLEはテキスト問題2,158問に限った値である。
◇Astra」への指示の出し方を詳細に説明されているのと動画でその感性を見れる
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる
2026年09月14日 07時00分更新
https://ascii.jp/elem/000/004/434/4434403/?topnew=9
Astraを深く使いこなすには、明確なコツがあります。それは、的確なフィードバックを与えられるかどうかです。2Dシューティングや3Dモデル、アニメーション生成などの作例を通じて見ていきます。
もう短編小説やゲームでは実力を測れない?
これまで、新型LLMが登場するたびに、体感できるレベルで性能を理解するために、簡単なプロンプトで短編小説を書かせたり、2Dシューティングゲームを作らせたりしていました。今回も同じ課題に取り組ませたのですが、GPT-6 Astraの性能を把握するためには、これらの課題は簡単にクリアされてしまうため、性能の評価が難しくなってきています。
2026年9月14日
https://xenospectrum.com/iris-search-agent-context-management/
• なぜ重要か: BrowseCompでは履歴管理の効果が、管理なしのモデル大型化差の約2.2倍だった。
AllSpark Researchが、Webを何度もたどって答えを探す二つの検索エージェント「Iris-mini」と「Iris-pro」を公開した。35B級と397B級のオープンウェイト(open-weight)モデルで、研究チームはそれぞれの規模帯において4つの検索ベンチマークで最も強い総合結果を得たと報告している。だが、得点を押し上げたのは訓練済みの重みだけではない。長い探索で膨らんだ履歴を捨てるコンテキスト管理(context management)が、同じテストでモデル大型化を上回る差を生んだ。Irisが突きつけるのは、検索エージェントの成績をモデル単体の能力として読んでいいのか、という問題である。
// 目次
01.「同クラス最強」の中身と、まだ公開されていないもの 02.Webのリンクから、検索で近道できない問題を逆算する 03.SFTとRLを交互に登らせ、長い探索を途中から継ぐ 04.モデルより大きく動いた「履歴の捨て方」 05.四つの数字を同じ物差しだと思わない 06.再現できるのは「評価」、まだ再現できないのは「訓練」
Iris-miniはQwen3.6-35B-A3Bを基盤とし、総パラメータ数は35B、そのうち推論時に動くのは3Bである。Iris-proはQwen3.5-397B-A17Bを基盤に、総397B・稼働17Bパラメータを持つ。どちらもMixture of Experts(MoE)型で、文脈長は256Kトークンだ。重みはHugging FaceでApache 2.0ライセンスの下に配布されている。
2026年9月3日付のプレプリントが示した代表値は、長い履歴をいったん消す「全履歴破棄」を有効にした1問1回の試行結果である。Iris-miniはBrowseCompで82.2、BrowseComp-ZHで84.8、DeepSearchQAで86.9、Humanity’s Last
Exam(HLE)で52.3を記録した。Iris-proは順に88.6、85.1、92.9、56.4だった。DeepSearchQAだけはF1、残る3つは正解率であり、HLEはテキスト問題2,158問に限った値である。
◇Astra」への指示の出し方を詳細に説明されているのと動画でその感性を見れる
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる
2026年09月14日 07時00分更新
https://ascii.jp/elem/000/004/434/4434403/?topnew=9
Astraを深く使いこなすには、明確なコツがあります。それは、的確なフィードバックを与えられるかどうかです。2Dシューティングや3Dモデル、アニメーション生成などの作例を通じて見ていきます。
もう短編小説やゲームでは実力を測れない?
これまで、新型LLMが登場するたびに、体感できるレベルで性能を理解するために、簡単なプロンプトで短編小説を書かせたり、2Dシューティングゲームを作らせたりしていました。今回も同じ課題に取り組ませたのですが、GPT-6 Astraの性能を把握するためには、これらの課題は簡単にクリアされてしまうため、性能の評価が難しくなってきています。
59名無しのひみつ
2026/09/14(月) 11:25:21.88ID:xpnxnCQv60名無しのひみつ
2026/09/14(月) 13:31:13.79ID:CTAnFQAN 人類オワタな
61名無しのひみつ
2026/09/14(月) 13:48:57.18ID:OUvADmPY 2億5年でたのむ!
数学者「はぁ・・はぁ・・ 準備できたぞ!!」
claude「11日で完・・また何かやっちゃいましたか?」
異世界転生claudeやん
数学者「はぁ・・はぁ・・ 準備できたぞ!!」
claude「11日で完・・また何かやっちゃいましたか?」
異世界転生claudeやん
62名無しのひみつ
2026/09/14(月) 13:52:51.83ID:OUvADmPY 人間の力を 機械がはるかに超えて行ったとき
人間の足の速さを 機械がはるかに超えて行ったとき
人間の飛ぶ力を 機械がはるかに超えて行ったとき
そして今人間の知性を機械がはるかに超えていきつつある感じ
人間の足の速さを 機械がはるかに超えて行ったとき
人間の飛ぶ力を 機械がはるかに超えて行ったとき
そして今人間の知性を機械がはるかに超えていきつつある感じ
63名無しのひみつ
2026/09/14(月) 14:26:56.71ID:pRGyUOwN フェルマーより
だいぶ遅れたな
だいぶ遅れたな
64名無しのひみつ
2026/09/14(月) 14:45:31.82ID:Hx3cdMtR 行数が多いところを見ると
スパゲッティコードで理解不能なんだろう
こけおどしで誇れるものではない
スパゲッティコードで理解不能なんだろう
こけおどしで誇れるものではない
65名無しのひみつ
2026/09/14(月) 15:03:13.20ID:XqszSHuJ Lean言語知らんやつが見当違いのレスを繰り広げるスレ
66名無しのひみつ
2026/09/14(月) 15:39:30.61ID:os07ZGNj >>59
初等的証明があるかどうかはともかく楕円曲線ルートが唯一とは限らないだろうよ
初等的証明があるかどうかはともかく楕円曲線ルートが唯一とは限らないだろうよ
67名無しのひみつ
2026/09/14(月) 15:49:42.86ID:9FOlp+bu日大監督「人間が検証できなきゃ意味ないよ?」
68名無しのひみつ
2026/09/14(月) 16:04:17.82ID:OKYZ+ux4 ◇エネルギー兵器での犯罪発見できている
金星は「死んだ惑星」ではない、地殻活動が継続中の可能性 研究結果
9/14(月) 14:00
形成中の系外惑星に、リング状の“衛星の材料”が存在する可能性 鹿児島大
掲載日 2026/09/14 14:05
>>特にPDS 70cは、電波領域のサブミリ・ミリ波でも検出された、唯一の形成中の系外惑星として知られる。この電波は、ガス集積中の惑星周囲にできる小さなガス円盤「周惑星円盤」に含まれるダストの熱放射だと考えられている。
>>近年、アルマ望遠鏡によって、このPDS 70cが複数の波長で検出され、その結果、周惑星円盤がサブミリ・ミリ波帯で「光学的に厚い」ことが示唆された。光学的に厚いとは、周惑星円盤内に反対側が見通せないほど大量のダストが存在することを意味する。
>>これまで、周惑星円盤内のダストは、円盤のガス抵抗を受けて角運動量を失い、惑星に向かって螺旋状に落下し(ドリフト現象)、周惑星円盤は光学的に薄くなると予測されていたため、観測結果はこれに反していた。そこで研究チームは今回、この謎の解明に挑むことにした。
OpenAIが数学の懸賞問題を解いたと発表、数学者は戸惑いと警戒
公開日2026.09.14 12:30:05 MONDAY
nazology.kusuguru.co.jp/archives/199601
強力なオープンウェイト検索AI「Iris」が登場:強さの半分はハーネスに宿るのか
2026年9月14日
xenospectrum.com/iris-search-agent-context-management/
>>Iris-miniはQwen3.6-35B-A3Bを基盤とし、総パラメータ数は35B、そのうち推論時に動くのは3Bである。Iris-proはQwen3.5-397B-A17Bを基盤に、総397B・稼働17Bパラメータを持つ。どちらもMixture of Experts(MoE)型で、文脈長は256Kトークンだ。重みはHugging FaceでApache 2.0ライセンスの下に配布されている。
Sakana AIが複数モデルの使い分けでGPT-6 Astra超えを達成する「Fugu Ultra v2」をリリース&コスパに優れた「Fugu Max」も登場
2026年09月14日 12時52分
>>東京に拠点を置くAI企業のSakana AIが、複数のAIモデルにタスクを割り振るシステム「Fugu Ultra v2」と「Fugu Max」を発表しました。Fugu Ultra v2は複数のベンチマークテストでGPT-6 AstraやClaude Fable 5.1を上回っています。
>>Sakana AIのFuguシリーズは複数クローズドモデルやオープンモデルをタスクごとに使い分けるシステムで、AIモデル単体で使うよりも高い性能を発揮できます。
gigazine.net/news/20260914-fugu-ultra-v2/
GPT-6 AstraとClaude Fableの性能を引き出すハーネス「Fusion」が登場、Claude CodeやCodexで使う場合と同等の性能を示しつつコストを最大39%削減
2026年09月14日 12時56分
gigazine.net/news/20260914-cognition-fusion/
>>AI分析企業のArtificial AnalysisおよびVals AIが実施した評価では、Fusionが最先端レベルの性能を維持しながら大幅なコスト削減を実現したことが示されました。
↨上記を安定してさらに自動で行えるようにするプログラムの参考が下記で詳細に動画付きで説明されている↨
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる
2026年09月14日 07時00分更新
ascii.jp/elem/000/004/434/4434403/?topnew=9
金星は「死んだ惑星」ではない、地殻活動が継続中の可能性 研究結果
9/14(月) 14:00
形成中の系外惑星に、リング状の“衛星の材料”が存在する可能性 鹿児島大
掲載日 2026/09/14 14:05
>>特にPDS 70cは、電波領域のサブミリ・ミリ波でも検出された、唯一の形成中の系外惑星として知られる。この電波は、ガス集積中の惑星周囲にできる小さなガス円盤「周惑星円盤」に含まれるダストの熱放射だと考えられている。
>>近年、アルマ望遠鏡によって、このPDS 70cが複数の波長で検出され、その結果、周惑星円盤がサブミリ・ミリ波帯で「光学的に厚い」ことが示唆された。光学的に厚いとは、周惑星円盤内に反対側が見通せないほど大量のダストが存在することを意味する。
>>これまで、周惑星円盤内のダストは、円盤のガス抵抗を受けて角運動量を失い、惑星に向かって螺旋状に落下し(ドリフト現象)、周惑星円盤は光学的に薄くなると予測されていたため、観測結果はこれに反していた。そこで研究チームは今回、この謎の解明に挑むことにした。
OpenAIが数学の懸賞問題を解いたと発表、数学者は戸惑いと警戒
公開日2026.09.14 12:30:05 MONDAY
nazology.kusuguru.co.jp/archives/199601
強力なオープンウェイト検索AI「Iris」が登場:強さの半分はハーネスに宿るのか
2026年9月14日
xenospectrum.com/iris-search-agent-context-management/
>>Iris-miniはQwen3.6-35B-A3Bを基盤とし、総パラメータ数は35B、そのうち推論時に動くのは3Bである。Iris-proはQwen3.5-397B-A17Bを基盤に、総397B・稼働17Bパラメータを持つ。どちらもMixture of Experts(MoE)型で、文脈長は256Kトークンだ。重みはHugging FaceでApache 2.0ライセンスの下に配布されている。
Sakana AIが複数モデルの使い分けでGPT-6 Astra超えを達成する「Fugu Ultra v2」をリリース&コスパに優れた「Fugu Max」も登場
2026年09月14日 12時52分
>>東京に拠点を置くAI企業のSakana AIが、複数のAIモデルにタスクを割り振るシステム「Fugu Ultra v2」と「Fugu Max」を発表しました。Fugu Ultra v2は複数のベンチマークテストでGPT-6 AstraやClaude Fable 5.1を上回っています。
>>Sakana AIのFuguシリーズは複数クローズドモデルやオープンモデルをタスクごとに使い分けるシステムで、AIモデル単体で使うよりも高い性能を発揮できます。
gigazine.net/news/20260914-fugu-ultra-v2/
GPT-6 AstraとClaude Fableの性能を引き出すハーネス「Fusion」が登場、Claude CodeやCodexで使う場合と同等の性能を示しつつコストを最大39%削減
2026年09月14日 12時56分
gigazine.net/news/20260914-cognition-fusion/
>>AI分析企業のArtificial AnalysisおよびVals AIが実施した評価では、Fusionが最先端レベルの性能を維持しながら大幅なコスト削減を実現したことが示されました。
↨上記を安定してさらに自動で行えるようにするプログラムの参考が下記で詳細に動画付きで説明されている↨
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる
2026年09月14日 07時00分更新
ascii.jp/elem/000/004/434/4434403/?topnew=9
69名無しのひみつ
2026/09/15(火) 12:10:57.30ID:4GXmUGdG これはAIには学習材料として何を食わせたの?
70名無しのひみつ
2026/09/15(火) 16:23:49.17ID:BCYl7vnB >>19
リンク先、
>OpenAIのダニエル・セルサム氏がセキュリティに特化したAIを使ってLean FROの調査に協力した結果、別の実装ミスも複数見つかり、
>記事作成時点では全て修正済みとのこと。
だから、まだまだ穴ありそうだな
リンク先、
>OpenAIのダニエル・セルサム氏がセキュリティに特化したAIを使ってLean FROの調査に協力した結果、別の実装ミスも複数見つかり、
>記事作成時点では全て修正済みとのこと。
だから、まだまだ穴ありそうだな
71名無しのひみつ
2026/09/16(水) 17:47:13.23ID:t6a9DMEx >>57
望月新一独特の望月語で書かれ、
恩師ファルディング教授から
理解できないから説明しろ、と言われた代物だ。AIへ入力したらハルシネーションを起こしコンパイラを通過する可能性
がある。ハッキング
望月新一独特の望月語で書かれ、
恩師ファルディング教授から
理解できないから説明しろ、と言われた代物だ。AIへ入力したらハルシネーションを起こしコンパイラを通過する可能性
がある。ハッキング
レスを投稿する
ニュース
- こういうのでいいのよ!なか卯の「朝限定390円メニュー」見た目以上の満足感で、まさに理想の朝ごはんでした! [パンナ・コッタ★]
- 【SNS】トランプ氏「米金利、1%以下に下げよ」 FRB・議長は名指しせず [少考さん★]
- 【速報】 米FRB、3年ぶり利上げ 物価高の長期化を避けるため姿勢を転換 [お断り★]
- 《日本に輸入された中国産「発がん性」食品》冷凍ブロッコリー🥦から検出事例多数の殺菌剤・プロシミドン [パンナ・コッタ★]
- 「育休が無給」「子どもは諦めた」非正規公務員、半数近くが年収250万円未満…調査で浮かぶ厳しい現実 [首都圏の虎★]
- 【節約】ローソンが“○○だけ”のコスパ追求「一点グルメ」弁当発表 “コーンだけ”や“サケだけ”具材1種で価格最大5割安 [煮卵★]
- 高市みたいな上司「法律を守れとかおかしな事を言うな!法律を守れと言われて侮辱された。自由意志があるのに人間の行動を制限するな!」 [784319933]
- サカモトデースとかいう隠れた名作今さら知ったんだが何で教えてくれなかったんだ?
- (΄◉◞౪◟◉`)さぁ笑ってごらん君は素敵だよスレ
- 【実況】博衣こよりのえちえちMLB同時視聴-八百屋編-🧪 ★2
- お🏡早く立ててよ
- お前ら「トヨタはEVの台頭で終わる!」これ20年くらい言ってるけどいつ終わんの [732289945]