nullbot の AI メディア
各国版
韓国の人工知能ニュース。モデル、企業、規制、活用まで。
米メタAIとイリノイ大学アーバナ・シャンペーン校の研究者が、新しい強化学習手法「エボハーネス-RL(EvoHarness-RL)」でオープンモデルQwen3-8Bを訓練した。複数ステップの連続タスクを評価するベンチマークALFWorldで96.9%の成功率を達成し、クロード・オーパス4.5の96.4%を上回った。基本のReAct方式からは49ポイントの向上となる。
nullbot のAIメディア。モデル、企業、規制、インフラ、社会への影響——国際版と各国版。