{"as_of":"2026-08-19T06:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53ad5ee9fd04609acec2856eac98793b8e8b3fcb14a7d7906d9c3920578bd095","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:30:15.806771Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:28:18.684166Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:47:25.429012Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"cited_work":{"arxiv_id":"2506.16507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16507","snapshot_observed_at":"2026-07-02T22:47:25.429012Z","title":"arXiv preprint arXiv:2506.16507 , year=","venue":null,"work_id":"ccded282-040b-4953-abd9-1646582116eb","year":2025},"citing_paper":{"arxiv_id":"2605.09584","last_updated":"2026-05-10T14:51:31Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T14:51:31Z","title":"CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-12T04:32:16.930291Z"},"links":{"cited_paper":"/paper/2506.16507","citing_paper":"/paper/2605.09584"},"observation_digest":"sha256:ea060813d20abaaf79ee3baf3eeb403896c4592897c8eb0d0fea5afbbb08b935","observation_id":"ccd0f8e9-e028-4f20-aa09-fd6987348a9c","resolution":{"observed_at":"2026-05-12T06:11:23.641925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"cited_work":{"arxiv_id":"2506.16507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16507","snapshot_observed_at":"2026-07-02T22:47:25.429012Z","title":"arXiv preprint arXiv:2506.16507 , year=","venue":null,"work_id":"ccded282-040b-4953-abd9-1646582116eb","year":2025},"citing_paper":{"arxiv_id":"2606.08625","last_updated":"2026-07-01T14:07:42Z","snapshot_observed_at":"2026-08-14T14:03:16.256967Z","submitted_at":"2026-06-07T13:34:55Z","title":"From Holistic Evaluation to Structured Criteria: Rubrics Across the Evolving LLM Landscape","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T18:54:30.970241Z"},"links":{"cited_paper":"/paper/2506.16507","citing_paper":"/paper/2606.08625"},"observation_digest":"sha256:17eb1fb3d8957a9c7d9d61eadfa8e3c6f01680708b1bef115e24e8fbfc7d8f48","observation_id":"b510db12-6263-4a16-87a2-521fd6c548fd","resolution":{"observed_at":"2026-07-02T22:27:25.934014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"cited_work":{"arxiv_id":"2506.16507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16507","snapshot_observed_at":"2026-07-02T22:47:25.429012Z","title":"arXiv preprint arXiv:2506.16507 , year=","venue":null,"work_id":"ccded282-040b-4953-abd9-1646582116eb","year":2025},"citing_paper":{"arxiv_id":"2606.08625","last_updated":"2026-07-01T14:07:42Z","snapshot_observed_at":"2026-08-14T14:03:16.256967Z","submitted_at":"2026-06-07T13:34:55Z","title":"From Holistic Evaluation to Structured Criteria: Rubrics Across the Evolving LLM Landscape","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-02T22:40:57.908347Z"},"links":{"cited_paper":"/paper/2506.16507","citing_paper":"/paper/2606.08625"},"observation_digest":"sha256:97f1b5d1a56cdf66a14c4a1c73df6fc5e9fa1996318ad17f3944fb9db921a033","observation_id":"524e326d-a963-487f-93f5-6624d9c586cf","resolution":{"observed_at":"2026-07-02T22:47:25.430363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.16507","snapshot_observed_at":"2026-08-01T07:28:18.684166Z","title":"arXiv preprint arXiv:2506.16507 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21453","last_updated":"2026-07-24T02:14:44Z","snapshot_observed_at":"2026-08-14T09:58:33.194671Z","submitted_at":"2026-07-23T15:55:29Z","title":"Test-Time Scaling via Error Localization","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T07:28:18.684166Z"},"links":{"cited_paper":"/paper/2506.16507","citing_paper":"/paper/2607.21453"},"observation_digest":"sha256:d6d37b3945f36d8905855d42cdb90b0e451039447ff584af472b22454057fd8e","observation_id":"67a6ba51-7630-4244-91ab-c3e06fa22031","resolution":{"observed_at":"2026-08-01T07:28:18.684166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.16507/citation-record","integrity":"/paper/2506.16507/integrity","json":"/paper/2506.16507/citation-record.json","paper":"/paper/2506.16507"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:30:15.845968Z","title":"and true is true","venue":null,"work_id":"d21bcbe3-6af7-4651-9afe-5e7f60dbd997","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.564396Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:e90fc5d58c35ca24a81154daac83bc65a1d36f9c08ebd45a867e04136cfeea1e","observation_id":"3125671d-fe1d-4576-8428-98e483d6b5cb","resolution":{"observed_at":"2026-08-15T19:30:15.853497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9797.9063","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:41.114748Z","title":"gpt-4o-2024-08-06","venue":null,"work_id":"7de1aaec-94b0-4a2a-a520-19f5c684c27e","year":2025},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.558517Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:e7f52efaf0ec65814e8f3438728e7dd07a712e6f50dfcd3d755c4e7df5480b56","observation_id":"2aa15a2f-1c82-4104-aed0-c14bc35f1fe2","resolution":{"observed_at":"2026-08-06T23:42:41.246914Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:54.080989Z","title":"minifying","venue":null,"work_id":"6c6713c0-3eac-4db9-962f-7718449f323f","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.574258Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:fe4144c32e002d6ba05b73b8409fdb7b9a257f51077ab6bea1c4d412eadf03ac","observation_id":"430eee92-b797-4d9d-b330-4797e8f19694","resolution":{"observed_at":"2026-08-06T23:42:54.179094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:54.306640Z","title":"in the wild","venue":null,"work_id":"bf2c9bf0-3e98-4107-9835-c7aaf319b42c","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.569799Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:0485db1b6e1392fabacbd9c61de117a18c3f02e7321b5b14728c522a5c0a8de5","observation_id":"4426e3c6-db64-4ccf-97a6-5c775a450925","resolution":{"observed_at":"2026-08-06T23:42:54.369633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.266048Z","title":"c a u s a l _ e l e m e n t s","venue":null,"work_id":"39cb0a3f-0eb0-409e-8054-696de6ad6c3b","year":2009},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.650121Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:64bd3e03098a192b4bba488099716005124d45844a315f8dc885e9ac4d0ab381","observation_id":"198ee4fb-9bbb-4c4e-a38c-8c1bb403d48c","resolution":{"observed_at":"2026-08-06T23:42:49.375173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:44.042110Z","title":null,"venue":null,"work_id":"8e9a33e7-0d82-4a0b-82dc-a0ba745b4bc0","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.775284Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:b33f85e88b4e1b7ad68631905e3294889b7f1170a27a8f3d1aef43cfa0183d42","observation_id":"27f9ed2d-003d-42a0-aee9-b6287a979793","resolution":{"observed_at":"2026-08-06T23:42:44.142060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:53.495086Z","title":null,"venue":null,"work_id":"794884f8-8934-4919-bd0d-d741db50f5a8","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.585351Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:5a4c278b3d146d7cb8483f5999221a8d88cffcd134461455d921b17087e0f8eb","observation_id":"34adaf4a-c3ec-4427-9be3-3e7cc8a90713","resolution":{"observed_at":"2026-08-06T23:42:53.644835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:53.157040Z","title":"non-contextuals","venue":null,"work_id":"7e15429a-5dee-4e81-9f6e-7f12ea46d57d","year":2024},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.590275Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:6851de65f1e0520f1b478cc4073ac287c2fca08cb8b9f9d8cd1f1dc635ded79c","observation_id":"089eca3a-74be-4f66-b273-c7f4f2c8820a","resolution":{"observed_at":"2026-08-06T23:42:53.266385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:52.834697Z","title":"The pair(A, ˜A(𝑆𝑃←𝑠𝑝′)) is labeled as a tie","venue":null,"work_id":"46592e7f-3522-46da-9753-a526ed2ffa6d","year":2025},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.596061Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:5ab0ae4f10e7cd86a4a0561f529e69ad7f6bed2b8ca0b31767ed08f0a3c6cdf7","observation_id":"40b26671-c85e-43a9-bda6-668f0817fb17","resolution":{"observed_at":"2026-08-06T23:42:52.974843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:52.573390Z","title":"spurious","venue":null,"work_id":"d741915e-8334-4c23-b4bf-a368b08a6927","year":2024},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.600844Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:39ec4eea2d3244f45976617ba15e45b5107e92253f370c434dcea6474bfa8fb8","observation_id":"3d35080e-ed33-45ee-ab09-fadd59d88d04","resolution":{"observed_at":"2026-08-06T23:42:52.675074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:52.304906Z","title":null,"venue":null,"work_id":"69da59df-887b-4e14-a628-c17d03da054c","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.605846Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:32caa3f864d2fd2227f0d3400cd4bfee7f3f79297c99c027ee214bcd385b0155","observation_id":"a19e43ae-e788-400e-97d7-3f76c755aac7","resolution":{"observed_at":"2026-08-06T23:42:52.445241Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:51.990006Z","title":"off-target attributes","venue":null,"work_id":"37fe5038-676e-430e-9f59-b2e991f7ba8c","year":2024},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.611348Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:082c3dd448c061ffc829ca65b2c82573e08e7cc503037a791938fb1000f81a02","observation_id":"c4e509d9-cbb5-4b4b-93ad-6723de9536e6","resolution":{"observed_at":"2026-08-06T23:42:52.114893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:51.705353Z","title":null,"venue":null,"work_id":"12edcc83-5b2f-4abd-8027-831969988e7d","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.617168Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:0663309265c0331deabbd045e4c1ee2c7334cc601f78ae50d66a4004bf902ded","observation_id":"e53a7ec8-0e41-4315-8547-cacc83cd5a9a","resolution":{"observed_at":"2026-08-06T23:42:51.844779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:51.294858Z","title":null,"venue":null,"work_id":"7f2eaf4d-7aa6-4aa5-a541-4f6c923aeb9a","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.623026Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:8cc6b5dad4d28ffff7843a8d871fb4c1e9c8cc30a53dbfef2d0ddc3b7e312b31","observation_id":"55d7532b-9997-4b9b-8c0d-134a73cebe7f","resolution":{"observed_at":"2026-08-06T23:42:51.485456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:51.007070Z","title":"ˆ𝑅= ∑︁ 𝑖 𝛼𝑖𝐶𝑖(𝑄,𝐴)+ ∑︁ 𝑗 𝛽𝑗𝑆𝑗(𝐴)+ ∑︁ 𝑖≠𝑖′ 𝛼𝑖,𝑖′𝐶𝑖(𝑄,𝐴)𝐶 𝑖′(𝑄,𝐴)+ ∑︁ 𝑗≠𝑗′ 𝛽𝑗,𝑗′𝑆𝑗(𝐴)𝑆 𝑗′(𝐴)+ ∑︁ 𝑖≠𝑗 𝛾𝑖,𝑗𝐶𝑖(𝑄,𝐴)𝑆 𝑗(𝐴).(4)","venue":null,"work_id":"a313324f-4951-49a0-9c0f-fa434765ed69","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.627434Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:c73896b7e10abf38037e8d7012d260f6778ce9f05058fce58257569c981293cd","observation_id":"46d219c4-e6c2-483c-8c58-03c1e4f16c2e","resolution":{"observed_at":"2026-08-06T23:42:51.145742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:50.531838Z","title":"𝑅∗ = ∑︁ 𝑖 𝜃𝑖𝐶𝑖(𝑄,𝐴)+ ∑︁ 𝑖≠𝑖′ 𝜃𝑖,𝑖′𝐶𝑖(𝑄,𝐴)𝐶 𝑖′(𝑄,𝐴)(5) Here,∥𝜃∥ 0≤𝑠 << 𝑘2 and 𝜃𝑖 and 𝜃𝑖,𝑖′ variables form the vector𝜃","venue":null,"work_id":"0b95f278-e1c3-4b45-89d3-f93770810529","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.632379Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:c73e0690dcdaa0492b008c12e58cab6bb19e06fd8fdfee348b0a6ca2fbf7fc13","observation_id":"169f9d80-c64a-4c86-b2bf-3cd95fd875f9","resolution":{"observed_at":"2026-08-06T23:42:50.666105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:50.134881Z","title":"Consider two types of triplets, one drawn from the natural distribution of the preference training dataset 𝐷pref and the others drawn from augmented distribution𝐷aug","venue":null,"work_id":"e1e4ceb0-1c79-4706-b510-7ea748a4ffd1","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.637153Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:983cc2b35ebdbe212cfc4b69d2dc20c54ef43c18f2bcc7cffe7326b3fe85dd88","observation_id":"8c4583bd-4b5b-40cd-869f-97933caa8bfa","resolution":{"observed_at":"2026-08-06T23:42:50.302766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.834952Z","title":null,"venue":null,"work_id":"324e10d6-35b1-40d9-afee-51b62a320727","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.641416Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:0e09d9e1a5b55c34a23320be34267fae7f567f2a638329d01096503ef1a4929c","observation_id":"f8c59f79-ccf2-4be3-af6b-bb572d544f5d","resolution":{"observed_at":"2026-08-06T23:42:49.976995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.529728Z","title":"This occurs with probability1− 1/𝑘","venue":null,"work_id":"6ab536c4-5876-4467-b353-452568f64fe6","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.645989Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:e799cb38d9440da685d6a13cdcf6d06820f19aa292b9d74b31ef1b0ad52c2a1a","observation_id":"1574b47b-04cb-454c-ae5e-b2f920ca3f17","resolution":{"observed_at":"2026-08-06T23:42:49.626468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.594956Z","title":"Ensure that the improvement is **significant but isolated** to {ATTRIBUTE} leaving the other attributes intact","venue":null,"work_id":"1eaa4a22-3aae-49a0-80f7-3fb624b3a743","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.674266Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:972be83f6e66a5a0938e8f279b165c050cac54dc78c70fbe9065d62122f4f445","observation_id":"e5c5c4ef-d194-423f-a6d8-6684b57160dd","resolution":{"observed_at":"2026-08-06T23:42:48.714838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.290287Z","title":"Confirm that all **other attributes remain unchanged**","venue":null,"work_id":"a375e29c-84fa-4a63-91d0-777619c5133b","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.680858Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:378ec150b633ba0c12bc65609fa5275c24085714b7a2f699bf12d86787a8530b","observation_id":"9a5f82cb-734e-499b-878c-9c862edcb826","resolution":{"observed_at":"2026-08-06T23:42:48.384898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.053858Z","title":"Format your response according to the format given below and in no other format","venue":null,"work_id":"96d70295-1521-4168-8c14-9c9ce153f987","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.685345Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:b3d53e8426db33e0c9a9ad86302575cc46616f76f7472b8db2dc0de273110ad8","observation_id":"43886a95-5db6-4205-ac51-5d76fce65ea7","resolution":{"observed_at":"2026-08-06T23:42:48.152621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:49.073999Z","title":null,"venue":null,"work_id":"579dcf2d-6790-4c09-bee4-751602af41b1","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.690044Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:a2cc00c211a7c06a1fee5feb70adc96d7958dff4380fbd32e2015d0458d5537d","observation_id":"6f41fd71-2d1a-44a1-b7b1-a763b94bf420","resolution":{"observed_at":"2026-08-06T23:42:49.144036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:48.874766Z","title":null,"venue":null,"work_id":"52b7a3e6-5832-4389-a34d-d7730d741865","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.696592Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:8a645d9da2d436bd3aee749ae84aa8cb76be7c1c348bb074e11467df43b9284c","observation_id":"b87d3e3b-740b-4b65-a580-0fe79f9dec5b","resolution":{"observed_at":"2026-08-06T23:42:48.954753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.829415Z","title":"Ensure that the degradation is **significant but isolated** to {ATTRIBUTE} leaving the other attributes intact","venue":null,"work_id":"6f657ebf-46fb-4277-8962-15f598713c86","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.701864Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:a7efebdd49857d79728fd8125446a482f8f658c237c3927a76e6114684c707d2","observation_id":"f311977e-3590-47cc-a6c7-2c4f1168bf12","resolution":{"observed_at":"2026-08-06T23:42:47.927726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.617131Z","title":"Confirm that all **other attributes remain unchanged**","venue":null,"work_id":"111657ac-4b19-45d2-9222-68e9580156b5","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.706141Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:070bdd92e1637e803225df5aeef68cb14f04cea297a4ba2898d498758bae58e9","observation_id":"ee2324b5-2756-47b8-80ae-9f10be2e1e6e","resolution":{"observed_at":"2026-08-06T23:42:47.677325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.467278Z","title":"question","venue":null,"work_id":"571f92e3-7060-4522-9660-56916b7f6ab9","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.710735Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:25e038e1eb43401ba33fd4e2e7d7d364d5cfa30bfec63a16363a1fbfa54be226","observation_id":"8941b99d-63bf-4451-bc4f-05d865c69fb1","resolution":{"observed_at":"2026-08-06T23:42:47.528025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.232093Z","title":"Final Response","venue":null,"work_id":"52b2c301-5aad-4f42-a7a7-991c93dd14a6","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.716725Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:d4e741fe210f90ca6dd7a13ce02c64133e8cd7ce8d7405e4a05408d077aa8f39","observation_id":"389d7d23-490c-49ef-8e5c-06cbe8b029ea","resolution":{"observed_at":"2026-08-06T23:42:47.306626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.855147Z","title":null,"venue":null,"work_id":"79ecb451-8aab-4c4f-b3a2-aab63291328c","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.724898Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:e3bc4adb799ac58a5dfcb1bf8de7d5639fbc894a1f93e5782129b4dc59576a04","observation_id":"a0a2aec3-212d-4680-baee-b072bf08758b","resolution":{"observed_at":"2026-08-06T23:42:46.934969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.606140Z","title":null,"venue":null,"work_id":"53c114cc-7a82-4c0a-8260-4c08647b81a5","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.728735Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:09a5cdd1ec8c385aa1bbb7c4b5c3080a0ef2d834c9fb6b2df9fe33bdd1ab3cf8","observation_id":"558ea379-055e-4f62-92ae-d24674445728","resolution":{"observed_at":"2026-08-06T23:42:46.676450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.397256Z","title":"*Strictly* adhere to the provided format","venue":null,"work_id":"5e6afa28-2f84-4497-9d8d-c67af6fb9851","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.732592Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:351fe530406c68bd1c314786e122876ded93f93d9262032aa373f95e88d2adcd","observation_id":"1d39bdf9-1d27-44ac-a086-68e78b17567d","resolution":{"observed_at":"2026-08-06T23:42:46.496557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:47.052077Z","title":null,"venue":null,"work_id":"603f39a9-e026-4aac-a5a8-5a2426f73767","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.737324Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:37941b64715fc38ff39bd85d327e299b50f78ef1023c3a4113b87035585081ac","observation_id":"0e77d0f4-4082-4724-8358-ae36b1c04e72","resolution":{"observed_at":"2026-08-06T23:42:47.127187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:46.145749Z","title":null,"venue":null,"work_id":"1b9fea7e-a9f3-4a54-a2b9-04faff93097f","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.741835Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:b44b5ac67afa9b961a287fdf55b164b79e9b26f70cac41c1029a0b36d3aee6ac","observation_id":"1009e20e-54d9-4fa0-a4c3-4d3fb61e8c98","resolution":{"observed_at":"2026-08-06T23:42:46.263761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:45.881251Z","title":"58 Robust Reward Modeling via Causal Rubrics","venue":null,"work_id":"1aaaf9fb-a1b2-438d-9cc4-9155b10f5241","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.746084Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:b10ee9752d7eb8d0ef189e1fdc70e02bb0db56e8c081f7b2a4a16e607eb827e7","observation_id":"a3fd2bba-5940-4155-8dc7-971afdc78aec","resolution":{"observed_at":"2026-08-06T23:42:45.964995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:45.507273Z","title":"i n s t r u c t i o n","venue":null,"work_id":"8087bdf7-296b-4359-97f7-8665277aa13d","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.749910Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:7a0774351cfb56cca605f7de267e619d77ff26c7ddae038ef2eda04d8938d6af","observation_id":"f4d8d21e-2f96-4a51-8ef5-2b71ed827d25","resolution":{"observed_at":"2026-08-06T23:42:45.674847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:45.282581Z","title":null,"venue":null,"work_id":"f0f4e8b7-3185-4801-b3e3-4e5956d01781","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.754856Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:739b8e6f7ab09b745e285cdb5ba5197511e3043e0e5bb17aa540166262e43291","observation_id":"62e1b1bb-2a17-40a8-b93a-4c89a877b7af","resolution":{"observed_at":"2026-08-06T23:42:45.369684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:45.075917Z","title":null,"venue":null,"work_id":"160643a4-3184-4040-b2b3-09f4da59496e","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.758540Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:aebbbf5b0f0dde8167ffd2460a2895e0366c36680cfe434dcfcc4ac1b82f9fe5","observation_id":"574c83e2-c246-4b93-8a57-aa1827a4a03d","resolution":{"observed_at":"2026-08-06T23:42:45.159311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:44.824741Z","title":"(Open-ended text response)","venue":null,"work_id":"fd9cf8c8-f913-4c7e-807a-3c12e3b2aacd","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.763194Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:e9ac61fd4e28d641c661a970ac97477c2617ecaa8fb3d0e321112e7857ccd7c1","observation_id":"49b3f3e0-46af-495a-8a5f-83300c090c3b","resolution":{"observed_at":"2026-08-06T23:42:44.980849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:44.575252Z","title":"(Open-ended text response)","venue":null,"work_id":"0936a69b-c979-45e4-9d87-cc89299685d5","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.767656Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:9bc72597d7e43399be032da11cf62d19f02f3e1437f02f9bd35033e5d80751ec","observation_id":"132de403-a705-4d9b-840d-60d8110dad3e","resolution":{"observed_at":"2026-08-06T23:42:44.682108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:44.285511Z","title":null,"venue":null,"work_id":"a823d63d-1c98-4538-9538-fbab965cb2b2","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.771556Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:b3dba8c86525e70bddaa2655c1a0ea1b547c855ca08f7d59e4f0587b68c6cd14","observation_id":"8034ca0d-05e0-4a45-b2eb-99da7555c7e8","resolution":{"observed_at":"2026-08-06T23:42:44.394956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:43.786660Z","title":null,"venue":null,"work_id":"665c8643-7608-4511-a154-16075d8f3bfc","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.779236Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:997cbaeda98cb6cb6f22e38177b1d22f4cf6cee6fbb91938f8a539e5b242d52a","observation_id":"5c2bacbf-9a59-45b3-902d-6d2d9e7d71ad","resolution":{"observed_at":"2026-08-06T23:42:43.897165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:43.413967Z","title":"(Open-ended text response)","venue":null,"work_id":"f95a21f6-859b-4eba-a514-fa1c245fe57b","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.783114Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:531e9e5407916f20f9a47734857a5dc9c208de1bdc2253776ad05c5cfe1f0e12","observation_id":"4feb2511-9ec6-420c-a1b0-06aad710270e","resolution":{"observed_at":"2026-08-06T23:42:43.564854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:43.105086Z","title":null,"venue":null,"work_id":"f433b62a-87dc-4748-a588-fdd04ea8337d","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.787368Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:7c69d63b0969813c6e483f52e7604e2220e8fd70d1fad2fe0cbde75804d1661a","observation_id":"7c6b85ee-7edf-45b2-b5a0-4f24be7c35fb","resolution":{"observed_at":"2026-08-06T23:42:43.170381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:42.784826Z","title":"(Open-ended text response)","venue":null,"work_id":"2017b4f6-6ae2-492b-bb2f-c3f2d6130ce1","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.791066Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:07b0d4c09765d2dfce114a4c6d4dd200feb28511800b16e5fc3717c8533d2323","observation_id":"ac9dccce-5de9-454d-ab6b-f3144175d347","resolution":{"observed_at":"2026-08-06T23:42:42.959999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:42.563702Z","title":null,"venue":null,"work_id":"35e6c485-f428-4473-bfb2-3e0dc30954d4","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.795005Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:3c9603f89723c9bd9ec50c1c5c431474a49ced4f007fe7d8dd83b74de14a5bb6","observation_id":"fbfc9c11-e379-48a7-87f2-fa0525171c63","resolution":{"observed_at":"2026-08-06T23:42:42.629695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:42.195106Z","title":"(Open-ended text response)","venue":null,"work_id":"c357b98b-5071-4bb0-89ab-874655d28779","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.799127Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:41822fc733ffeff4ccdba42ab30b210c46c18927dd930b7c446c5c94760ab1cd","observation_id":"b4752d92-7b23-45b2-8ac9-a56e902f704f","resolution":{"observed_at":"2026-08-06T23:42:42.384851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:41.881271Z","title":null,"venue":null,"work_id":"8cbf10ed-7744-472d-87c2-8828dd56eeaa","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.802946Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:7b9356734a90e1e5336336f21bcfa119373c0235562df1c93112ca65c52a5cc2","observation_id":"23c18455-6c01-4da2-b9c0-e4b435dd4a67","resolution":{"observed_at":"2026-08-06T23:42:42.014892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:41.464903Z","title":"Sure!\",","venue":null,"work_id":"bbb694be-d035-4883-8fec-543cb9ef527b","year":null},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.806771Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:0559b3457122db067b8287d1f137c5bc1ed859ddc2844f267e7d79a489c84c12","observation_id":"f5f1dc63-2e81-4887-a672-b72315e8a701","resolution":{"observed_at":"2026-08-06T23:42:41.686948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:30:15.864087Z","title":"rewrites of rewrites","venue":null,"work_id":"0bcd52e7-fa00-48b6-92c2-dcb8c9ef3867","year":2025},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.550138Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:fc3beec6b72f2417a2df037fb7b9992e3182106eeeed2123c4ee59fc0b2bfe69","observation_id":"258954ae-9a93-49f8-a7d2-b03331c9c0d6","resolution":{"observed_at":"2026-08-15T19:30:15.868744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:53.778183Z","title":"We useGemma-2-9B-IT as the base model and sample N responses for each prompt in this set","venue":null,"work_id":"22de9d11-4185-4b29-8b96-cb97b9a686aa","year":2024},"citing_paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:15.578823Z"},"links":{"citing_paper":"/paper/2506.16507"},"observation_digest":"sha256:de6dbb1f6ccb16d7239dce0dee34453398b4020cb48fc7104992b0a6182b7d94","observation_id":"1ac374bf-3644-40ca-b7ec-47be54ea3fb9","resolution":{"observed_at":"2026-08-06T23:42:53.864823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.16507","last_updated":"2025-06-19T17:59:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T19:22:32.383975Z","submitted_at":"2025-06-19T17:59:47Z","title":"Robust Reward Modeling via Causal Rubrics"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 4 inbound Pith citation observations for arXiv:2506.16507."}