My Brain Wiki

标签: reinforcement-learning

此标签下有7条笔记。

  • 2026年7月27日

    HarnessX: A Composable, Adaptive, and Evolvable Agent Harness Foundry

    • harness-engineering
    • agent
    • self-evolution
    • reinforcement-learning
    • benchmark
  • 2026年7月06日

    Model Alignment

    • training
    • reinforcement-learning
    • llms
    • model-alignment
  • 2026年6月20日

    HarnessX

    • harness-engineering
    • self-evolution
    • agent
    • reinforcement-learning
    • multi-agent
    • benchmark
  • 2026年5月12日

    The Bitter Lesson

    • essay
    • optimization
    • training
    • reinforcement-learning
    • reasoning
  • 2026年5月12日

    Rich Sutton

    • person
    • ai-researcher
    • reinforcement-learning
  • 2026年4月10日

    Agentic RAG

    • rag
    • ai-agents
    • tool-use
    • reinforcement-learning
  • 2026年4月08日

    RAG 进化之路:传统 RAG 到工具与强化学习双轮驱动的 Agentic RAG

    • rag
    • agentic-rag
    • ai-agents
    • reinforcement-learning
    • tool-use

Created with Quartz v4.5.2 © 2026

  • GitHub
  • Discord Community