{"as_of":"2026-08-11T01:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a15d8ac2a968029bce9c0793c541fe5d76d7ba3f0cec80adb5a89d6ede12734","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:49:58.910725Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:22:06.635622Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T12:23:24.240761Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"cited_work":{"arxiv_id":"2508.04216","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04216","snapshot_observed_at":"2026-06-29T12:23:24.240761Z","title":"Causal re- ward adjustment: Mitigating reward hacking in exter- nal reasoning via backdoor correction.arXiv preprint arXiv:2508.04216, 2025a","venue":null,"work_id":"3f87b71a-25df-4b73-a0ca-53d553c3094b","year":2025},"citing_paper":{"arxiv_id":"2601.21350","last_updated":"2026-05-16T02:45:10Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T07:18:45Z","title":"Factored Causal Representation Learning for Robust Reward Modeling in RLHF","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T14:18:33.768962Z"},"links":{"cited_paper":"/paper/2508.04216","citing_paper":"/paper/2601.21350"},"observation_digest":"sha256:6257b21c9fb6b637caedde97bbed36a364e4a6fc6196a987794febb950824e09","observation_id":"74308e21-8960-496a-9d51-81d753f7543e","resolution":{"observed_at":"2026-05-21T14:20:13.564528Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"cited_work":{"arxiv_id":"2508.04216","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04216","snapshot_observed_at":"2026-06-29T12:23:24.240761Z","title":"Causal re- ward adjustment: Mitigating reward hacking in exter- nal reasoning via backdoor correction.arXiv preprint arXiv:2508.04216, 2025a","venue":null,"work_id":"3f87b71a-25df-4b73-a0ca-53d553c3094b","year":2025},"citing_paper":{"arxiv_id":"2605.27996","last_updated":"2026-05-29T02:24:56Z","snapshot_observed_at":"2026-07-06T23:37:36.244456Z","submitted_at":"2026-05-27T05:40:22Z","title":"Reward Bias Substitution: Single-Axis Bias Mitigations Redirect Optimization Pressure","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-29T12:22:06.635622Z"},"links":{"cited_paper":"/paper/2508.04216","citing_paper":"/paper/2605.27996"},"observation_digest":"sha256:572e5b4b81899bbd29bd2283982197cea8752eabcae05509cc6de5696c27e649","observation_id":"90bf14c4-aaac-4d72-a5a3-94d7926aa0ef","resolution":{"observed_at":"2026-06-29T12:23:24.242250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.04216/citation-record","integrity":"/paper/2508.04216/integrity","json":"/paper/2508.04216/citation-record.json","paper":"/paper/2508.04216"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:55.195733Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.195733Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:e531c5aefef8bade8948a22e720dd3915a5d3aafbb9c72994299370fd1bbdce5","observation_id":"53475a56-da37-4582-bb18-dfc7b62a9ad8","resolution":{"observed_at":"2026-08-06T00:49:55.195733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:55.287688Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.287688Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:a22032be77c2b469797ac8ff397318071c244075ab509ea4acf41903a7d8bbf7","observation_id":"a21285f0-4606-462a-8b62-e26e1c89cb44","resolution":{"observed_at":"2026-08-06T00:49:55.287688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-06T00:49:55.417778Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.417778Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:78ea230c9e0d82ee22b75acd841f2d2c11de660548fb62b2a868d6dae89980a1","observation_id":"7953bb5a-bb0d-4a5f-bbc0-e78ea0e11043","resolution":{"observed_at":"2026-08-06T00:49:55.417778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:02.074880Z","title":null,"venue":null,"work_id":"eabbc369-6385-4558-9862-19eea0db1a40","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.552626Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:389a7e70c76bf65e9f246e6d506731160b08111c742c669ede3ff50ed5c3e814","observation_id":"426f3b28-a921-476d-88da-4a3fe872c68c","resolution":{"observed_at":"2026-08-06T00:50:02.140984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:55.665028Z","title":"E.; Hume, T.; Carter, S.; Henighan, T.; and Olah, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.665028Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:0371da877592b3cdcced61763313a204c5f8d06d31c18a6d7519cf0289861dbc","observation_id":"870055df-2744-4273-8716-6b2db294e08f","resolution":{"observed_at":"2026-08-06T00:49:55.665028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-06T00:49:55.743365Z","title":"V.; R \\'e , C.; and Mirhoseini, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.743365Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:bd784fdf02e929e4a1aec7cbcfb105d12f8bc018795b3b3f478f2503713a3823","observation_id":"d56d4c56-8dea-4b89-a9fe-5ff1ff83ac11","resolution":{"observed_at":"2026-08-06T00:49:55.743365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T00:49:55.811698Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.811698Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:1903d30f81f4179264edfc2edce2ba98cb0eae0e164367889623524a1c2ef07f","observation_id":"7532f3ab-76f8-46a2-9748-bac3186db987","resolution":{"observed_at":"2026-08-06T00:49:55.811698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-06T00:49:55.891955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.891955Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:385d825b96a978aa39e868c20dccf720360f3a6884ec33a9b628fb7a702e9bca","observation_id":"f4fed5e4-9b22-432b-9197-85b9a818c276","resolution":{"observed_at":"2026-08-06T00:49:55.891955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T00:49:55.975299Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.975299Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:0b45854e434fd66c6ece370a0fff18ae5b0cfa8fdf07b00b86ab547c29e271cc","observation_id":"48843abe-3a9f-443d-aca0-0ce19980c0d0","resolution":{"observed_at":"2026-08-06T00:49:55.975299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.916729Z","title":null,"venue":null,"work_id":"ce522cd0-f5e7-4677-9864-b628b7a2e6d2","year":2015},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.047481Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:f479a6210c1b744d9b48acef1f4fb037683c80413e7f6a37392a5d37581c3861","observation_id":"c175fe98-219e-43b5-be7c-dcaddc4ccf1d","resolution":{"observed_at":"2026-08-06T00:50:01.974682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T00:49:56.114202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.114202Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:3b49f0fda03e5096c01b6a71a866794e0a0c914a6350af8b4c4776b95535a869","observation_id":"6b720003-3c15-4315-87ef-c01af2f16297","resolution":{"observed_at":"2026-08-06T00:49:56.114202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02827","last_updated":"2020-10-07T15:41:58Z","snapshot_observed_at":"2026-07-06T06:08:19.420105Z","submitted_at":"2017-11-08T04:44:32Z","title":"Inverse Reward Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02827","snapshot_observed_at":"2026-08-06T00:49:56.182077Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.182077Z"},"links":{"cited_paper":"/paper/1711.02827","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:5b819d0347c13fb8ba4feac2e56dfcc0d4b7ba63d9437cb7b59aaf3944561716","observation_id":"ff348be9-27de-427a-8ce6-a0f67c93a558","resolution":{"observed_at":"2026-08-06T00:49:56.182077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.729318Z","title":null,"venue":null,"work_id":"e91a85ae-cb9b-41d1-97bf-6278a3f162e4","year":2021},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.235762Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:d0a67cf4d9fc551e836501640a51a3cf1d767bd4aaae7695e214d35b57e7de2a","observation_id":"993c3d33-30a8-4051-9fcd-da0bce7e8267","resolution":{"observed_at":"2026-08-06T00:50:01.825837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-06T00:49:56.306521Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.306521Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:5e274e302b1422df77acb222dfdf3256cea183820f53993901c3a0c38c99ea04","observation_id":"02c988b7-9dd4-47ae-bba3-607f415acebc","resolution":{"observed_at":"2026-08-06T00:49:56.306521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-08T18:40:06.157350Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-06T00:49:56.372971Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.372971Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:015804cc7ee6b43a6af3015598ecd5e1569edf935dcef5076792f030a0b4aa31","observation_id":"9c1a11d3-de30-4c11-9006-604f787b15e8","resolution":{"observed_at":"2026-08-06T00:49:56.372971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13156","last_updated":"2025-02-27T16:30:42Z","snapshot_observed_at":"2026-07-06T19:18:27.644746Z","submitted_at":"2024-09-20T01:46:07Z","title":"RRM: Robust Reward Model Training Mitigates Reward Hacking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13156","snapshot_observed_at":"2026-08-06T00:49:56.466791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.466791Z"},"links":{"cited_paper":"/paper/2409.13156","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:be281687036de396dcb13eb161ef8cdf1fbb0d1a01f0acb47ed27e57545244fb","observation_id":"151a3599-716c-4f98-ad09-f762cebc36b2","resolution":{"observed_at":"2026-08-06T00:49:56.466791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.537581Z","title":"P.; Hermann, K.; Welleck, S.; Yazdanbakhsh, A.; and Clark, P","venue":null,"work_id":"9b782865-d691-4c69-814e-ab3cd59defd1","year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.543973Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:b368bc83382c66584c0a6cc4ff0dd6896592bf2771b8a1ff5d29fcbede3c1c26","observation_id":"d2786640-1018-43ad-8f4e-99a900c9a45c","resolution":{"observed_at":"2026-08-06T00:50:01.604360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08366","last_updated":"2024-05-20T17:46:14Z","snapshot_observed_at":"2026-08-09T21:06:45.027308Z","submitted_at":"2024-05-14T07:07:13Z","title":"Towards Principled Evaluations of Sparse Autoencoders for Interpretability and Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08366","snapshot_observed_at":"2026-08-06T00:49:56.667273Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.667273Z"},"links":{"cited_paper":"/paper/2405.08366","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:efa03f4924db240e45799280589e08cef9e30ab7a186185db9f588ab2c4c83a5","observation_id":"41967675-9e22-4ff0-9d31-615883143be6","resolution":{"observed_at":"2026-08-06T00:49:56.667273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.365977Z","title":null,"venue":null,"work_id":"57856b14-5939-463f-984a-d51bf944d4c6","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.757497Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:7fbe69a005c1fdf06b8aaba29c77dad0b01b2844e08394cc272fed32b73568bb","observation_id":"f01d6fc3-fd5d-46be-9266-4d1dc61a95e1","resolution":{"observed_at":"2026-08-06T00:50:01.465055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06627","last_updated":"2024-06-06T21:39:09Z","snapshot_observed_at":"2026-08-10T08:42:26.735412Z","submitted_at":"2024-02-09T18:59:29Z","title":"Feedback Loops With Language Models Drive In-Context Reward Hacking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06627","snapshot_observed_at":"2026-08-06T00:49:56.840261Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.840261Z"},"links":{"cited_paper":"/paper/2402.06627","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:72590defb0fd2a2d1ae6bab5d88c8aebd708588696d7bb4bd18bfd2f31bf5746","observation_id":"5fc8f8d2-3bc5-4065-acc1-1db253b092fd","resolution":{"observed_at":"2026-08-06T00:49:56.840261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:56.900164Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.900164Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:e1aedad340e735423752a66689d5909eac05e27e95b347438f0a52bb74bc2b67","observation_id":"a8c35825-02bd-434b-9fd9-eacef2c06611","resolution":{"observed_at":"2026-08-06T00:49:56.900164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.166131Z","title":null,"venue":null,"work_id":"cb5b960c-264d-45b4-82bd-ae9ec93c8d54","year":2016},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.989041Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:bac03bf374ae6305dc4eb2fc362fcc2ac107621d9301a5a25624b85638b9dcee","observation_id":"b599c292-0fe5-4857-8b69-41716d6dfa30","resolution":{"observed_at":"2026-08-06T00:50:01.243287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.968037Z","title":null,"venue":null,"work_id":"727f9a89-566a-45bc-ae1a-c962c4346070","year":2017},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.073629Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:da328f45b80ec7659c4e04056a9a5681bd5f228f92289bb12c51a2f52aa799b1","observation_id":"11feddce-4347-4d37-8522-ca4ea2a71324","resolution":{"observed_at":"2026-08-06T00:50:01.071894Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05802","last_updated":"2022-06-14T01:16:24Z","snapshot_observed_at":"2026-07-06T13:19:58.934755Z","submitted_at":"2022-06-12T17:40:53Z","title":"Self-critiquing models for assisting human evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05802","snapshot_observed_at":"2026-08-06T00:49:57.156128Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.156128Z"},"links":{"cited_paper":"/paper/2206.05802","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:672851b9e464598f6ddf028a906e8b0bd57b46035f2099a49c4dd10919d6a416","observation_id":"c81a857b-41ce-4035-aa10-4432d0b99b1f","resolution":{"observed_at":"2026-08-06T00:49:57.156128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.672558Z","title":null,"venue":null,"work_id":"c01a5069-4fb9-4e05-a9c6-83c525d69b16","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.244923Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:92c40a7a24847ae1742136d218a0d875118d76f1aa7fcf6f020d3e3ec1f19a02","observation_id":"1aef55fa-a437-473b-bcd4-c93e13044071","resolution":{"observed_at":"2026-08-06T00:50:00.812569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.491817Z","title":null,"venue":null,"work_id":"d9995263-0583-495a-998b-a4880236ecea","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.313769Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:d3a46998871df18ecf431ad7fe49d13382d212f74101f9d3394fd566691f0775","observation_id":"3abde802-218f-44d7-ba48-e00c9527e919","resolution":{"observed_at":"2026-08-06T00:50:00.557972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T00:49:57.391495Z","title":"K.; Wu, Y.; and Guo, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.391495Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:1ae80360be344163618ded9f7b8d8912afb04b779d212e39b7885c6d2b92d9c2","observation_id":"d45b03e4-3e88-475d-a03f-6465fd3d4c36","resolution":{"observed_at":"2026-08-06T00:49:57.391495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:57.500199Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.500199Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:d4fe842c8bde7d30f77fefceb39d7e8be48b88372b5a333793f016f4d176dfcc","observation_id":"8ca4aa02-c030-4f7d-9025-fd91360e5b06","resolution":{"observed_at":"2026-08-06T00:49:57.500199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-06T00:49:57.585878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.585878Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:158a271eaf176a488d9bffa426d77038d38860da0cd30713a2ae05a3a7318e95","observation_id":"c4bf3754-bb08-44c9-8096-667569423794","resolution":{"observed_at":"2026-08-06T00:49:57.585878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.226153Z","title":"V.; Lee, J.; Xu, K.; and Kumar, A","venue":null,"work_id":"f859fdf0-36a6-4553-8907-e32165dc9750","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.685133Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:8c57836ae45c581a1f1b61fc9cf1fb158a151e0324d2c0e8197a64252862581b","observation_id":"f8048e73-95ee-4f11-8082-d620ed4e4900","resolution":{"observed_at":"2026-08-06T00:50:00.332444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.037970Z","title":null,"venue":null,"work_id":"8419a55e-a0ef-4225-8c76-b154910cd6e1","year":2016},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.794179Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:8114611bbd3011a1ebfcf928006bab0839a46091e4a115855022407e15139e48","observation_id":"94254e3b-f5aa-4a07-87f9-b90e7bc10d02","resolution":{"observed_at":"2026-08-06T00:50:00.119426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:57.868476Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.868476Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:80f029e9b714c440ee089c3fe568b980f2726710fd81802c6e61c5480bdbe15e","observation_id":"06cff769-dda9-49ac-877f-d6f01645f5de","resolution":{"observed_at":"2026-08-06T00:49:57.868476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:57.951694Z","title":"L.; McDougall, C.; MacDiarmid, M.; Freeman, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.951694Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:179e740861bff7f0a2556c0c93dbcfbde9013ae44964e33291b8178560a7f1d5","observation_id":"ea48494e-966a-4450-9252-0561cecf8267","resolution":{"observed_at":"2026-08-06T00:49:57.951694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-06T00:49:58.030203Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.030203Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:5a0f15246535deacbeda65a0c4eb8e351c535292ec4c40f2f6b81eecd431c4b1","observation_id":"3fa39720-4336-4778-996c-69b162fd43dc","resolution":{"observed_at":"2026-08-06T00:49:58.030203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-06T00:49:58.128960Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.128960Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:b42846a95e248df0d695db6b0939596ea8cb3bf880e25d4882760e5978215df1","observation_id":"20e4ba43-a24d-4141-b814-b64088f259ae","resolution":{"observed_at":"2026-08-06T00:49:58.128960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:59.829870Z","title":"V.; and Zhou, D","venue":null,"work_id":"de93bb86-1938-418e-9c52-7ba5850a37b9","year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.223409Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:d70174e26b4d1e4a6e1841d93aaf6004c1c0820e0350b949364c39b803c50cb8","observation_id":"5210ed7d-8a0c-4e7d-8e2e-8a4285517db3","resolution":{"observed_at":"2026-08-06T00:49:59.909412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:59.624983Z","title":null,"venue":null,"work_id":"3a590a82-30c4-4e53-9a5e-0e1a1681e536","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.324287Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:5b28c0ba259916da22ea135f47c584e7ee22d8f80b369a20c9cd11f4254e04c9","observation_id":"bac4398b-b0d7-4bdf-9178-1545702fd1ef","resolution":{"observed_at":"2026-08-06T00:49:59.733765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:59.418937Z","title":null,"venue":null,"work_id":"169acb0d-5413-400e-b692-664b7322e5a2","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.417699Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:ab0fd9152c453d43e283fb44d0eacd70167b57eec0bf8b26078ece7fb176bd5e","observation_id":"a68159bb-9a83-431f-834f-94b0921806ab","resolution":{"observed_at":"2026-08-06T00:49:59.525941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T00:49:58.564042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.564042Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:95b5b3f4e51afd87f8388aa76aa0cb4938c2c0aa4d0a8d597b86477f406cd656","observation_id":"99f1c65a-14e5-4d15-8569-c13c054177e4","resolution":{"observed_at":"2026-08-06T00:49:58.564042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:59.230279Z","title":"L.; Cao, Y.; and Narasimhan, K","venue":null,"work_id":"6501c345-2726-4f55-9670-a0b98e3db331","year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.645366Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:d32cac6c58a1a1d31e75df1477ef844610b6ea1cfc3bf1b749bb67c830e0ac44","observation_id":"941c3b9b-e322-4766-ac12-5d0c6c6af4b9","resolution":{"observed_at":"2026-08-06T00:49:59.304045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-06T00:49:58.718193Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.718193Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:d7895fc3a9f71e8f00395e220841509b6cef080f18692cf92bb1312cffd3a22c","observation_id":"87d5d540-9d51-4cb6-85c3-5b5292754f9a","resolution":{"observed_at":"2026-08-06T00:49:58.718193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07301","last_updated":"2025-06-05T16:34:24Z","snapshot_observed_at":"2026-08-03T11:11:25.359494Z","submitted_at":"2025-01-13T13:10:16Z","title":"The Lessons of Developing Process Reward Models in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07301","snapshot_observed_at":"2026-08-06T00:49:58.821187Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.821187Z"},"links":{"cited_paper":"/paper/2501.07301","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:08c642790af76d472d8727e38546b5b18434503981ac08da9f97d73842cddbe3","observation_id":"7bb593af-902e-48f0-b2d3-c34250c53f0b","resolution":{"observed_at":"2026-08-06T00:49:58.821187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-06T00:49:58.910725Z","title":"X.; Zhou, K.; Li, J.; Tang, T.; Wang, X.; Hou, Y.; Min, Y.; Zhang, B.; Zhang, J.; Dong, Z.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.910725Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:eb8edb27756a7303daf69207cb1d3ef72c67ef87a2c7656afd9f2f51d9bfb49b","observation_id":"23122d00-eb26-4d5e-92d0-df77482177dd","resolution":{"observed_at":"2026-08-06T00:49:58.910725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T15:44:03.341166Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 2 inbound Pith citation observations for arXiv:2508.04216."}