הצטרף ל-Nostr
2025-02-27 10:40:03 UTC

José A. Alonso on Nostr: CuDIP: Enhancing theorem proving in LLMs via curriculum learning-based direct ...

CuDIP: Enhancing theorem proving in LLMs via curriculum learning-based direct preference optimization. ~ Shuming Shi et als. https://arxiv.org/abs/2502.18532 #AI #LLMs #ATP #Logic #Math