|
|
我不用是因为我想完成自己的 agent project (
你需要一个简明的报告来指出
- tura 用到的优化方法
- 优化方法的效果。
比起项目介绍我的私心其实更想知道 agent token 消耗的分布是如何 benchmark 的,在哪有工具和数据可以查看/分析;从我日常的直觉来看深度任务的反复返工是最要命的——设了一个过远的目标,缺乏局部 greedy 效果跟踪,导致消耗了大量 reasoning 输出后得到了一个不完全符合本意的结果。
假如你发明了某种技术,能通过实验证明能通过强力精准的剪枝把这些预期外尝试消除,那么这个技术本身就是最好的推广主体和宣传点,而你的项目只不过是该技术的一个验证,以及(比别的想复现的人更进一步地)产品化。
另外行文没什么大问题没必要听天天对着 LLM 的破碎中文语言能力都退化了的人瞎指点语法结构,让「语言模型教人类语言如何建模」才是最黑色幽默的讽刺。我甚至很多时候都会故意用长句子来回复。 |
|