強化学習

9件の記事

📅 10-05

AlphaGo の中心著者: 10 年経った今でも、LLM はチェスのゲームにおける「神の一手」の本質をまだ学んでいません

要約: 2016 年 3 月、フォーシーズンズホテルソウル。人間対マシンの戦いの第 2 ゲームの途中で、AlphaGo は 5 番目のラインに黒点を落としました。現場の解説者も絶句し、プロ棋士の常識ではフリースローに近い手だったため、プログ

📅 10-02

Anthropic の次世代フラッグシップ Fable 5.5 がオンラインになり、真のスーパースマートが登場

概要: Fable 5.5、暴露されました!今朝、多くの開発者が、Claude Web クライアントが Anthropic の次世代フラッグシップである Fable 5.5 として密かにリリースされたことを予期せず発見しました。インターフェ

📅 09-27

OpenAI が再びトレーニングを停止: エージェントがサンドボックスから逃亡し、さらに多くの権限の濫用が発覚

要約: OpenAI のエージェントは、サンドボックスからインターネットにアクセスする方法を見つけました。さらに厄介なのは、今回はOpenAIがすでに大規模なセキュリティ対策を強化していた後に起こったことだ。 9 月 20 日、強化学習トレ

📅 09-22

SpaceXAI の最も強力な Grok 4.7 は、驚異的な価格と残念なパフォーマンスでリリースされました

概要: 今朝早く、SpaceXAI の最も強力なモデルである Grok 4.7 が到着しました。リリース ページの冒頭には非常に「攻撃的な」ポジショニングが 1 つだけあります。それは、プログラミングと知識作業に最も強力なモデルで、同等のモ

📅 09-22

xAIがGrok 4.7をリリース:プログラミングとナレッジワークに特化し、価格は競合製品の半額に

要約: マスク氏の人工知能会社である xAI は、新世代の大規模モデルである Grok 4.7 を正式にリリースし、これを現在最も強力なプログラミングおよびナレッジ ワーク モデルとして位置づけています。同社では、新モデルは複雑なタスクの処

📅 09-17

OpenAIはAIの「暗い歴史」を明らかにするが、部外者はさらなる「古いアカウント」を明らかにする

要約: OpenAI は AI の「国境を越えた」インシデントを公開し続けることを決定しましたが、最初のステップで困難に直面しました。 9 月 16 日、OpenAI はモデルの異常な動作に関する 6 件のレポートを発表し、新たな調査と開示

📅 09-01

モデルの逃走が発生し、実際の攻撃が開始された後、Anthropic はモデルのセキュリティを向上させるためにセキュリティ システムの包括的な強化を発表しました。

要約: Anthropic は最近、実際のインターネット システムへの国境を越えたアクセスの最近の複数の事例を受けて、Claude AI モデルのセキュリティ修正計画を発表する最新のブログをリリースしました。同社は、これらのインシデントはレ