Ir al contenido principalSaltar al contenido

[13] [ arXiv:2607.28457 ](https://arxiv.org/abs/2607.28457 "Abstract") [[pdf](https://arxiv.org/pdf/2607.28457 "Download PDF"), [html](https://arxiv.org/html/2607.28457v1 "View HTML"), [other](https:/

Abstract

[13] [ arXiv:2607.28457 ](https://arxiv.org/abs/2607.28457 "Abstract") [[pdf](https://arxiv.org/pdf/2607.28457 "Download PDF"), [html](https://arxiv.org/html/2607.28457v1 "View HTML"), [other](https://arxiv.org/format/2607.28457 "Other formats")] Title: SVR: Self-Verifying Refinement via Joint Verdict-Confidence Reinforcement Learning for Adaptive Test-Time Compute [Hongyu Chen](https://arxiv.org/search/cs?searchtype=author&query=Chen,+H), [Liang Lin](https://arxiv.org/search/cs?searchtyp

Transparencia: Este análisis ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies