20 / 23
Что такое reflection и self-refine в агентах: Reflexion, self-criticism loops, scoring agents — и когда они оправданы?
Reflection / self-refine — использовать LLM как критика собственных outputs. Iterate (generate → critique → refine) до convergence, чтобы улучшить качество за счёт extra inference. Подходы: self-refine (одна модель, sequential critique-refine), Reflexion (verbal self-feedback по failed attempts, эффективен для tool-use задач с external verifier), scoring loops (0-10 score → refine при score < threshold), multi-agent debate, LLM-as-judge для evaluation. Оправдано на high-stakes outputs (code, legal) с verifiable feedback. Не оправдано в real-time chat и tasks без objective criteria.