📰00Training a 4B model to produce 81% faster query plans than PostgresHacker News·Training a 4B model to produce 81% faster query plans than Postgres·about 3 hours ago#ut6JOjZ2#rohanbansal#postgres#grpo#article#ama#englishlanguage🧰Tag tools✨Add tag...or how to make Qwen learn query optimization via agentic reinforcement learning15s0Read later0Read More
🖼️00RRCM Uses GRPO to Decide When to Retrieve for LLM RecommendationDEV Community·gentic news·4 months ago#kuoB6L8h#ai#machinelearning#research#deeplearning#rrcm#retrieval+6 more🧰Tag tools✨Add tagRRCM uses GRPO to learn when to retrieve evidence for LLM recommendation, outperforming fixed-context baselines.15s0Read later0Read More