FROM RLVR TO RLSVR: TASK TRANSFORMATION INDUCES SELF-VERIFIABLE REWARDS FOR OPEN-ENDED LLM SELF-IMPROVEMENT