{"as_of":"2026-08-14T20:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:775bba9ea57efee432241cb568d8811c358930f213bbf4c82ca63ad813f6a7ef","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:56:34.307355Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:47:26.547119Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.20083","snapshot_observed_at":"2026-07-30T18:33:28.626422Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26873","last_updated":"2026-07-31T13:09:25Z","snapshot_observed_at":"2026-08-13T19:56:21.477865Z","submitted_at":"2026-07-29T13:03:07Z","title":"SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-07-30T18:33:28.626422Z"},"links":{"cited_paper":"/paper/2607.20083","citing_paper":"/paper/2607.26873"},"observation_digest":"sha256:0cc2dd9bd72b463a8de26b3f3a9f1fb1efc69253a6da51039ba0c8b78bb8a34d","observation_id":"bb719a8c-8e89-4460-a15c-bea9083f22f8","resolution":{"observed_at":"2026-07-30T18:33:28.626422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.20083","snapshot_observed_at":"2026-08-03T01:47:26.547119Z","title":"Co-Evolving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26873","last_updated":"2026-07-31T13:09:25Z","snapshot_observed_at":"2026-08-13T19:56:21.477865Z","submitted_at":"2026-07-29T13:03:07Z","title":"SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-03T01:47:26.547119Z"},"links":{"cited_paper":"/paper/2607.20083","citing_paper":"/paper/2607.26873"},"observation_digest":"sha256:66ef4840468ca47db6f97a0a836ebef616d11d97e63e193d75a4773b9f1fb100","observation_id":"21b821a3-3c7d-4358-a698-565c5e7288cf","resolution":{"observed_at":"2026-08-03T01:47:26.547119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.20083/citation-record","integrity":"/paper/2607.20083/integrity","json":"/paper/2607.20083/citation-record.json","paper":"/paper/2607.20083"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.480780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.480780Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:9db887badfa6fcf56091cde79c4fbdbe7e165768aa80c244c24c366388c3d228","observation_id":"a8d8aa60-ec7b-4a30-90a0-67c7dbf52ec1","resolution":{"observed_at":"2026-08-01T10:56:32.480780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.495544Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.495544Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:05f8a69e4cd310e4ac54cfe2b770d686cdad498ea92660873b0d788ac2ab1d4a","observation_id":"83031ad0-550d-4292-90b0-91811c8c9331","resolution":{"observed_at":"2026-08-01T10:56:32.495544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T10:56:32.449691Z","title":"John Schulman, Filip Wolski, Prafulla Dhariwal, Alec Radford, and Oleg Klimov","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.449691Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:8f8566837fd0a7613d27e80dd2de1b31188225b14e4021838c71796d39748348","observation_id":"ae116cd6-260a-4f46-8f02-8817fccfe02a","resolution":{"observed_at":"2026-08-01T10:56:32.449691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.463461Z","title":"For pairwise benchmarks, the evaluator is asked to select the preferred response from a candidate pair","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.463461Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:f9643c5ef65cfa298b2b860299b84c08c34e6ed0f8c11cfcc710832aa6555c30","observation_id":"61eaae05-5774-4b82-ac19-b24a9dc0d220","resolution":{"observed_at":"2026-08-01T10:56:32.463461Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.651963Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.651963Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:e6392c78a1781a89269f6422aea16c3dabdc076304f357d12282fb4f8e7c9731","observation_id":"40036f04-eca8-45ed-add8-8d47aab23cdc","resolution":{"observed_at":"2026-08-01T10:56:32.651963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.669201Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.669201Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:6b41100356fa7c07bd3f396df0b454f19a12b970f1a085f4c2eb07b420a9e9a4","observation_id":"674cf09a-42fa-424a-ad98-25da2a65ec4c","resolution":{"observed_at":"2026-08-01T10:56:32.669201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.509963Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.509963Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:948a414ae5daf31bd333a961187825fa40726a43bcce328d7359061fc9d5f042","observation_id":"5d94e628-bcbe-4022-b4d0-ca8b2578f463","resolution":{"observed_at":"2026-08-01T10:56:32.509963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.533564Z","title":"Representative rubrics generated by DynamicRubric-trained generatorG 2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.533564Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:250ce7ce2d4c5f47329c05d9ac1a914c43127f6f8ed68f4b0de7af8f2ce7169c","observation_id":"dd9e2be7-bdbe-4962-a01d-35e30abf19d4","resolution":{"observed_at":"2026-08-01T10:56:32.533564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.556442Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.556442Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:a46f3acf9b8b279e52e3bd46112a25597437e6415b5714715d46f649d1b94e2c","observation_id":"b3ae5c26-333c-4119-b86a-ce0522346c70","resolution":{"observed_at":"2026-08-01T10:56:32.556442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.587179Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.587179Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:7ef384240740b7cda053a47cc8549b659a3465950b882c81ce0fe420cb9e1fc7","observation_id":"0fab1beb-846b-47e2-8ae2-0e4e42fa3a44","resolution":{"observed_at":"2026-08-01T10:56:32.587179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.608816Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.608816Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:e1d158fe6853b63d7834e00bf751ecae6cafc34e674359640160a078cfdd4d16","observation_id":"9d9f0158-6c72-42a3-8706-a8149e94e5aa","resolution":{"observed_at":"2026-08-01T10:56:32.608816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.631990Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.631990Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:356bf69c370a103b3c752c855f20ac75b55e2294699d39b0a7dc878a104a2f2f","observation_id":"9d55c289-432f-4a00-bec4-8bc2c71699c2","resolution":{"observed_at":"2026-08-01T10:56:32.631990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.727366Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.727366Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:85af266915add026009ad7ec87930418abb1625892da5404cad5954241d1259a","observation_id":"685bb0ca-502a-467d-b454-51b375b0309a","resolution":{"observed_at":"2026-08-01T10:56:32.727366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:32.843933Z","title":"yes\"/\"no","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.843933Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:7eccf3ea1428753c65c275df860db60c07a61375b7e9adc9aa79cc720bc892a2","observation_id":"949342b7-fb2b-488d-9e04-2c6795c93d80","resolution":{"observed_at":"2026-08-01T10:56:32.843933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.010319Z","title":"- Use the response pool to notice which qualities help a response satisfy the user's request better","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.010319Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:d5d4aef3f58eddd2e9fe2aaae8abc345b7b908b238f29b3746a76e63c80a1dc5","observation_id":"ab1dc735-e1cd-461d-8b1a-54f7e47ee628","resolution":{"observed_at":"2026-08-01T10:56:33.010319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.126580Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.126580Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:b809a4efe4d52cf1bc6f4f7123b6bb8d307fa4b7c9633f2c9788f854c7923688","observation_id":"2443284f-81b2-46e5-8233-276912424e50","resolution":{"observed_at":"2026-08-01T10:56:33.126580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.314271Z","title":"partially correct","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.314271Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:f29b9e0864826ebbed6f3a892c5fe653cb5ea9f1c6e1714b2171fec2164aba26","observation_id":"772eaccd-e7a7-4036-b6ae-5c7280cb4ff1","resolution":{"observed_at":"2026-08-01T10:56:33.314271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.577802Z","title":"yes\" or","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.577802Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:3909760f51e4e22d8a511235543edc8db929adf3b5662b9e46a3ff11ce31c5c8","observation_id":"0c7e89db-10c5-4459-b76b-3261c493673f","resolution":{"observed_at":"2026-08-01T10:56:33.577802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.704644Z","title":"- If the user did not ask for a specific format, a format-based rubric should usually be omitted","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.704644Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:5d0e09c0d129ad301c9bf0a7bcb2b20de89f2d8c1514128a7b8c59086d62bb5b","observation_id":"58b11219-2ee8-4038-b2b7-4ccd0ab5ab08","resolution":{"observed_at":"2026-08-01T10:56:33.704644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.808318Z","title":"yes\" = good): - Frame all rubrics so that a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.808318Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:13fa0d919f901607c52e160383313f7b2d45442b79005fd945f86308d646f586","observation_id":"e26436d9-03ca-4eb3-9f5b-db49853942ee","resolution":{"observed_at":"2026-08-01T10:56:33.808318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.865783Z","title":"- Each rubric should be written as a general standard that can be applied to evaluate any response independently","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.865783Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:86837437f79cd01a8ec30899b3c90bd11b07da4e08eb248716b7f7300b81938f","observation_id":"df0c962c-33b5-4527-a162-d499272cdea7","resolution":{"observed_at":"2026-08-01T10:56:33.865783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:33.975390Z","title":"- Each rubric should contain all the information needed to evaluate a response","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:33.975390Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:ce2e6dc0099d01f08f46029f334c1b051aa39ccf746f555e1fbbcc330a4bc234","observation_id":"40dfd21c-bf44-4be6-a583-10703580b7a5","resolution":{"observed_at":"2026-08-01T10:56:33.975390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:34.056772Z","title":"- Essential (Weight 5): Core task requirements, critical user constraints, or safety-related requirements; if missing, the response is seriously flawed or invalid","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:34.056772Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:9b6bd72c6ba02d995ea2762f20cbde4836f82cb60a5c43fb7f259f38c5628423","observation_id":"c0d5df32-fbbe-4e34-9364-b6d8314bd1b5","resolution":{"observed_at":"2026-08-01T10:56:34.056772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:34.112112Z","title":"rubric\":","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:34.112112Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:3e86e230d39170ed6bf6774392127f7b8a62ad7fbd7e4b14228b17173b64aadb","observation_id":"c9a5840d-97ee-4017-ab58-cdd6a6f06839","resolution":{"observed_at":"2026-08-01T10:56:34.112112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:34.196973Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:34.196973Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:25c1ea03653efc06f52be042585b0a6b1d5f939ac77da3214ed67ff1c8433ec0","observation_id":"b9d77d5e-85c9-4055-8dbf-3aa9f0873c86","resolution":{"observed_at":"2026-08-01T10:56:34.196973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:56:34.307355Z","title":"yes\" if the response clearly meets the rubric. - Answer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:34.307355Z"},"links":{"citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:51d831998360893e102c9ca0746df5e40289c2e9423bdecbd9e2b20f994f1d46","observation_id":"663b597e-bd1d-4333-a03d-73528e1b913d","resolution":{"observed_at":"2026-08-01T10:56:34.307355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-11T17:22:43.545531Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-01T10:56:32.444211Z","title":"Chris Yuhao Liu, Liang Zeng, Jiacai Liu, Rui Yan, Ju- jie He, Chaojie Wang, Shuicheng Yan, Yang Liu, and Yahui Zhou","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.444211Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:1261acfb3b40e5f49fd4827d3d5b634833bbc2494b2f2cad511a1566afc945ce","observation_id":"7b9870fc-4ef3-44fa-81d3-47ef19582268","resolution":{"observed_at":"2026-08-01T10:56:32.444211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-08-12T14:23:22.826603Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17746","snapshot_observed_at":"2026-08-01T10:56:32.437394Z","title":"Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Peiyi Wang, Qihao Zhu, Runxin Xu, Ruoyu Zhang, Shirong Ma, Xiao Bi, Xiaokang Zhang, Xingkai Yu, Yu Wu, Z","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T10:56:32.437394Z"},"links":{"cited_paper":"/paper/2507.17746","citing_paper":"/paper/2607.20083"},"observation_digest":"sha256:7c1fb74972856e8457ac9c5460090bc785d4bdf7f9fd0a507634d9a4e94e90c4","observation_id":"79bdba91-3b95-43c4-b9c8-c2a14b03e56c","resolution":{"observed_at":"2026-08-01T10:56:32.437394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20083","last_updated":"2026-07-23T06:34:29Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T03:26:51.317434Z","submitted_at":"2026-07-22T12:35:40Z","title":"Co-Evolving LLM Evaluators and Policies via DynamicRubric"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 2 inbound Pith citation observations for arXiv:2607.20083."}