Synth Daily
2026年8月7日
一次ソース⚡ OpenAI が GPT-5.6 Sol を更新、無料ユーザーの既定を GPT-5.6 Luna に切り替えテキストチャット無制限化(8/6 公式発表)- 1Qwen3.8 MaxHN 369pt / 228 comments
Alibaba のフラッグシップが Artificial Analysis のエージェンティック指数で 58.4 を記録。首位 Claude Opus 5(max)の 59.2 に 1 点未満まで迫り、HN では「首位に立った」として議論に(指数は当日中も更新されるため首位主張は時点で揺れる。58.4 は本号照合時点の公開データ)
なぜ重要か: オープンウェイト勢がフロンティア最上位圏に実測で並んだことが議論の中心。ベンチのスナップショットで「首位」の主張が揺れること自体も、数字の出典と時点を確かめる論点として伸びた
- 2Prime AgentHN 238pt / 58 comments
Prime Intellect が公開した自己改善型コーディングハーネス。再帰言語モデル(RLM)でコンテキストを REPL 上の変数として扱い、プロンプト・スキル・記憶・サブエージェントをエージェント自身が実行中に作成・更新・削除する Continual Harness を組み合わせる
なぜ重要か: 固定のツールスキーマと手書きサブエージェントという現行ハーネス設計への正面からの異議。モデルでなくハーネス側の自己改変を主戦場に置いた設計が議論を呼んでいる
- 3人間の承認は脅威の 1/3 を見逃す(4 万プレイ実測)HN 230pt / 180 comments
AI エージェントのコマンド承認を人間が担うブラウザゲームの集計。4 万プレイ / 40.9 万判断で、平均プレイヤーは脅威コマンドの 1/3 を見逃した(平均正答率 66.3%)。全プレイヤーの 7% は全コマンドを無条件承認
なぜ重要か: 「最後の砦 = 人間の承認」の防御力を数字で示した実測として議論に。時間圧のあるゲーム設定という留保つきでも、承認 UI に人を置くだけでは防御にならないという示唆が刺さっている
選定基準: Hacker News の points と GitHub trending の stars/日の降順(AI・エージェント関連のみ、意見記事は除外)。数値は号の生成時点。