{"as_of":"2026-08-18T02:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37e9824d0ccbfe59093820ab6e7c6860f0fee8c3a59122c39260db16cdf6289c","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:06:49.755721Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T13:58:53.430492Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:00:28.509134Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"cited_work":{"arxiv_id":"2508.06026","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.06026","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Temporal self-rewarding language models: Decoupling chosen-rejected via past-future","venue":null,"work_id":"ac5c7972-f5b3-42df-9432-4c5f4586e010","year":2025},"citing_paper":{"arxiv_id":"2604.13602","last_updated":"2026-04-15T08:11:34Z","snapshot_observed_at":"2026-08-15T05:29:27.850072Z","submitted_at":"2026-04-15T08:11:34Z","title":"Reward Hacking in the Era of Large Models: Mechanisms, Emergent Misalignment, Challenges","version":1},"reference_index":165,"source":"pdf_text","source_observed_at":"2026-05-10T13:58:53.430492Z"},"links":{"cited_paper":"/paper/2508.06026","citing_paper":"/paper/2604.13602"},"observation_digest":"sha256:0ddb1ff96f2ffb758b33bab1a66573e0dee8ac5ff08b4bf246c00bde74af7937","observation_id":"be78f0cd-54ad-4ce9-9b6a-dfeb43182ab9","resolution":{"observed_at":"2026-05-10T14:00:28.511587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.06026/citation-record","integrity":"/paper/2508.06026/integrity","json":"/paper/2508.06026/citation-record.json","paper":"/paper/2508.06026"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:50.755699Z","title":"Y.; Rajbhandari, S.; Awan, A","venue":null,"work_id":"b36c4805-e040-4dc3-93a3-66bf049d01cd","year":2022},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.265162Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:4a1ad5be925164bbac912fa8603a58a447202af1f0dc011a934cec590658aee5","observation_id":"6e2097c0-2f18-4025-83f8-884c8e571991","resolution":{"observed_at":"2026-08-05T23:06:50.761472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-05T23:06:49.384616Z","title":"M.; Firat, O.; Johnson, M.; Lepikhin, D.; Passos, A.; Shakeri, S.; Taropa, E.; Bailey, P.; Chen, Z.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.384616Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:6d9ba2f8073c07827d2b8316a6a9247432a7e3236e274111846d1d775cf36d47","observation_id":"3acfe968-e085-46da-a75d-1714196f7471","resolution":{"observed_at":"2026-08-05T23:06:49.384616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T23:06:49.499308Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.499308Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:f0d8f0c71904d54402d01a8758eba625a326cd0e14b4bd3762e2eae34f0eb91e","observation_id":"5fee6bf4-7908-49a4-9541-4fcfcb5529af","resolution":{"observed_at":"2026-08-05T23:06:49.499308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.550152Z","title":"D.; Dhariwal, P.; Neelakantan, A.; Shyam, P.; Sastry, G.; Askell, A.; et al","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.550152Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:7db9efb417f8ae25658cbdd907ff2f0a45054c883cd41aa703a70d349900f7ed","observation_id":"bbfa7b49-95de-4eed-9f27-e478b0537b14","resolution":{"observed_at":"2026-08-05T23:06:49.550152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-08-15T08:59:30.302596Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-05T23:06:49.556074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.556074Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:51fddd4cb0a630b789d35b6bebe13a9193ab11cc1dbdf7e18f6ba3a3c88f9ae9","observation_id":"d71f2658-3540-4f16-be15-29d0564b1ef0","resolution":{"observed_at":"2026-08-05T23:06:49.556074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-05T23:06:49.561919Z","title":"W.; Sutton, C.; Gehrmann, S.; et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.561919Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:b8a6d142fd6550d74e635930a756cb44b7eaadb5a2c2ebc1df45d15ccb261c42","observation_id":"c3546670-28f0-428a-a813-b2636864ef32","resolution":{"observed_at":"2026-08-05T23:06:49.561919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-14T00:28:11.851309Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-05T23:06:49.568769Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.568769Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:763746c0703f4a52b7a71c9fb8ca0e43df169b69d32689c6fd7a4f26a673670c","observation_id":"17403456-8f5d-45bb-b58a-84c21c0c5e2d","resolution":{"observed_at":"2026-08-05T23:06:49.568769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:50.724744Z","title":"D.; and Chatzoglou, P","venue":null,"work_id":"d4867b45-a364-4ede-a440-2319cc3ed1ee","year":2014},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.574803Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:f315220a7695cb870160cbf92cd9f29eaf8b754fb5c3e4086b3f4866b810bc08","observation_id":"999e88b1-31ff-4cfb-a966-595b267ba0bc","resolution":{"observed_at":"2026-08-05T23:06:50.729693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01951","last_updated":"2024-12-04T14:20:21Z","snapshot_observed_at":"2026-08-18T01:49:25.380130Z","submitted_at":"2024-12-02T20:24:17Z","title":"Self-Improvement in Language Models: The Sharpening Mechanism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01951","snapshot_observed_at":"2026-08-05T23:06:49.580054Z","title":"J.; Rohatgi, D.; Zhang, C.; Simchowitz, M.; Ash, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.580054Z"},"links":{"cited_paper":"/paper/2412.01951","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:08f6c2da8f8b47fef86beb475da9e6e5553f072f942f596f7f22180ba09bd3b0","observation_id":"c99e57b6-dc00-4d09-b4a1-c0c4d0d6ae38","resolution":{"observed_at":"2026-08-05T23:06:49.580054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11610","last_updated":"2022-10-25T17:45:17Z","snapshot_observed_at":"2026-08-09T02:27:34.152063Z","submitted_at":"2022-10-20T21:53:54Z","title":"Large Language Models Can Self-Improve","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11610","snapshot_observed_at":"2026-08-05T23:06:49.586132Z","title":"S.; Hou, L.; Wu, Y.; Wang, X.; Yu, H.; and Han, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.586132Z"},"links":{"cited_paper":"/paper/2210.11610","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:8c10957bb622ce96995b6c9bc155e56bb9b767a02052a35ad07cbc1e611ca339","observation_id":"a32b81c5-329a-439f-92a4-83d5b77c13e4","resolution":{"observed_at":"2026-08-05T23:06:49.586132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T23:06:49.591455Z","title":"Q.; Sablayrolles, A.; Mensch, A.; Bamford, C.; Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.591455Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:ba6016261c74c9a2d09ae1b05ea00c8bf9769e77dcb453f97c594f409d8ca5c2","observation_id":"4f747ef8-1b49-4793-a342-84c2e7d649cb","resolution":{"observed_at":"2026-08-05T23:06:49.591455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06452","last_updated":"2024-02-19T14:39:07Z","snapshot_observed_at":"2026-08-14T15:51:49.712613Z","submitted_at":"2023-10-10T09:25:44Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06452","snapshot_observed_at":"2026-08-05T23:06:49.596674Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.596674Z"},"links":{"cited_paper":"/paper/2310.06452","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:125d9df8f8eb6819b4c8794d6beb9e1ff124a3157223d6e823008b36295f491f","observation_id":"31ba34a6-ad6a-4d61-9c6c-372f29c13ac3","resolution":{"observed_at":"2026-08-05T23:06:49.596674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:50.708499Z","title":"o pf, A.; Kilcher, Y.; Von R \\","venue":null,"work_id":"f9c08ef8-7aba-465f-acdf-82b512a15479","year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.601469Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:dfab4056e048805ff85fab2a95ffc72dccf81d47f1d0287d60d52a9ae6a82c5c","observation_id":"66377ed1-f64a-4ec4-8053-682d072536f6","resolution":{"observed_at":"2026-08-05T23:06:50.713051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:50.692152Z","title":"H.; Gonzalez, J","venue":null,"work_id":"5f0ae6de-f6b4-40f2-87ee-22db7a0f44db","year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.606111Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:fb378f58897389cd479bd89b3cf8cb33f80431111440b493a69aab65ade465b2","observation_id":"292e2e37-2247-4dfa-a57e-561bb553f050","resolution":{"observed_at":"2026-08-05T23:06:50.697208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18101","last_updated":"2025-05-22T17:50:19Z","snapshot_observed_at":"2026-08-18T01:46:20.305603Z","submitted_at":"2025-01-30T02:47:41Z","title":"Diverse Preference Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18101","snapshot_observed_at":"2026-08-05T23:06:49.610348Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.610348Z"},"links":{"cited_paper":"/paper/2501.18101","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:0ffa454abc0d8d1f0fcf96b24a5f663f76ea70bdf689424361f5c01af3df3396","observation_id":"8b83f706-b805-4cad-9357-506fc9a9a37f","resolution":{"observed_at":"2026-08-05T23:06:49.610348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05470","last_updated":"2023-12-07T08:48:36Z","snapshot_observed_at":"2026-08-16T14:53:56.793203Z","submitted_at":"2023-10-09T07:27:15Z","title":"Generative Judge for Evaluating Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05470","snapshot_observed_at":"2026-08-05T23:06:49.615131Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.615131Z"},"links":{"cited_paper":"/paper/2310.05470","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:230f17305f5fe8f5501eb3d2984dc41d526bbaec36dd3c93e7a355eca2df2c66","observation_id":"a12c86bd-478d-4814-947b-c2d2814803e3","resolution":{"observed_at":"2026-08-05T23:06:49.615131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-11T09:34:38.920981Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-05T23:06:49.619937Z","title":"E.; and Stoica, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.619937Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:1ef36dfb231f47a2f794e14545fdb34d041580c764602a7e93c8c37ddbc2be31","observation_id":"2e30402c-ed2e-40f9-9e2c-01d45a429b1c","resolution":{"observed_at":"2026-08-05T23:06:49.619937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06259","last_updated":"2024-03-12T05:22:46Z","snapshot_observed_at":"2026-08-16T15:09:03.366337Z","submitted_at":"2023-08-11T17:47:54Z","title":"Self-Alignment with Instruction Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06259","snapshot_observed_at":"2026-08-05T23:06:49.624787Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.624787Z"},"links":{"cited_paper":"/paper/2308.06259","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:ac9515e80613a43e0264ba8c6c4ab4572aa2c1b9d60cc94b39afca2b9358c368","observation_id":"57b48448-a52a-4f71-b12e-4937390791ac","resolution":{"observed_at":"2026-08-05T23:06:49.624787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:50.675753Z","title":null,"venue":null,"work_id":"e0fb0da1-cf20-48e4-8cfb-4844256d9b3d","year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.630133Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:1b986515361b2906fc0d6849e35947442622a38d50ac96055fb309ef85ce959b","observation_id":"9ef6c809-ae6b-413c-b9af-9d701bc46b00","resolution":{"observed_at":"2026-08-05T23:06:50.680334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12895","last_updated":"2025-01-22T14:15:46Z","snapshot_observed_at":"2026-08-16T10:01:11.090552Z","submitted_at":"2025-01-22T14:15:46Z","title":"Test-Time Preference Optimization: On-the-Fly Alignment via Iterative Textual Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12895","snapshot_observed_at":"2026-08-05T23:06:49.634866Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.634866Z"},"links":{"cited_paper":"/paper/2501.12895","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:70630d89870f28aa5a1e18a3314abbbf51763b0219b66d660e3f1d964bcdb52e","observation_id":"27ce3375-f590-421a-ae23-8a0be3fc2df3","resolution":{"observed_at":"2026-08-05T23:06:49.634866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11877","last_updated":"2025-01-21T04:11:59Z","snapshot_observed_at":"2026-08-16T18:43:35.840096Z","submitted_at":"2025-01-21T04:11:59Z","title":"From Drafts to Answers: Unlocking LLM Potential via Aggregation Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2501.11877","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11877","snapshot_observed_at":"2026-08-05T23:06:50.253288Z","title":"From Drafts to Answers: Unlocking LLM Potential via Aggregation Fine-Tuning","venue":"cs.CL","work_id":"66f41e98-5ff7-41a5-9d28-bfad88b3519b","year":2025},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.639546Z"},"links":{"cited_paper":"/paper/2501.11877","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:a6d6a1adb421d8384c925e8ca19bcc8de6dc2ee484f21b7b4a771b55def9388e","observation_id":"ac02ce60-fad8-4221-a813-a20db1a9a42d","resolution":{"observed_at":"2026-08-05T23:06:50.259087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06657","last_updated":"2024-01-23T23:16:11Z","snapshot_observed_at":"2026-08-16T15:01:11.681309Z","submitted_at":"2023-09-13T01:07:25Z","title":"Statistical Rejection Sampling Improves Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06657","snapshot_observed_at":"2026-08-05T23:06:49.645169Z","title":"J.; and Liu, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.645169Z"},"links":{"cited_paper":"/paper/2309.06657","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:fe4110b78bdbe27c3d4c06d4f6f15a7cddd9a3cd8315a07e34444e40557d3458","observation_id":"092382b6-2b8c-42d5-9650-e3796259d9ac","resolution":{"observed_at":"2026-08-05T23:06:49.645169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.649837Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.649837Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:4f88984b31db7674559b18a3d74423b181d205defba3bc5b76ba33996c8131f0","observation_id":"8d08cd5a-6a5d-4a26-b6d3-1e817c31283b","resolution":{"observed_at":"2026-08-05T23:06:49.649837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.654847Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.654847Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:e4a11a12406d75bd73d8f65dc5c91fe5702227ad46e8bfcc1f7711d2dd05aa8b","observation_id":"27153f03-a1cb-4a4b-aeea-4333db13b026","resolution":{"observed_at":"2026-08-05T23:06:49.654847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:50.637016Z","title":null,"venue":null,"work_id":"e9daf777-41a3-46c2-b1ff-1f0ea9efd996","year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.659754Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:c06f0f0244f6723f37f1aa59a038b2d70ec62e93d9ca1b8ef0d4e130c534e7f9","observation_id":"4a4b7da3-019c-4df1-8e25-37eb52b1eecd","resolution":{"observed_at":"2026-08-05T23:06:50.641870Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.665152Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.665152Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:4328cbc5dd23177bce9874d7fefc83b8358706b8a9c1b3feda45edf0bfae4116","observation_id":"c7bb6c53-4d80-4d3f-9489-cb20d2990fa9","resolution":{"observed_at":"2026-08-05T23:06:49.665152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.669976Z","title":"D.; and Arora, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.669976Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:3c212c2f5cc6fdf2f1fa5a0a6ecc3979d7a7456e5ee57bb8f8cfea17a6de685b","observation_id":"972df6f0-fd7c-42db-bcdb-8dd0c67eac67","resolution":{"observed_at":"2026-08-05T23:06:49.669976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.674585Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.674585Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:eab3781d6706adb5feeba1d1c0c3fc3d8a11bcd904500016dc59224408543ad8","observation_id":"cef979ca-8cf6-4927-9d87-3c4045b782f1","resolution":{"observed_at":"2026-08-05T23:06:49.674585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T23:06:49.678965Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.678965Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:08bad0ef9aa434b9a41eb9be8bbba1668b6eed35e035424e116b4ec0cf946c7e","observation_id":"1dd4722a-e41b-4475-af7e-ca396a61768c","resolution":{"observed_at":"2026-08-05T23:06:49.678965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:50.596049Z","title":null,"venue":null,"work_id":"80abbfa8-662a-4431-96a5-5b28be392693","year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.683965Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:4d2dae2d12771bfd1709d469022ce7ce9c4bed88fbadf2731b064980019e41b9","observation_id":"ca0106e4-d14d-464d-8503-afc5bcdd59eb","resolution":{"observed_at":"2026-08-05T23:06:50.600958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12735","last_updated":"2025-04-26T15:42:47Z","snapshot_observed_at":"2026-08-16T13:08:43.921510Z","submitted_at":"2024-10-16T16:51:01Z","title":"CREAM: Consistency Regularized Self-Rewarding Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12735","snapshot_observed_at":"2026-08-05T23:06:49.688537Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.688537Z"},"links":{"cited_paper":"/paper/2410.12735","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:796f36ce519a1e0452d09ecb43b4a9473a0a5a84db9f2d4d143281412a73ba7d","observation_id":"19a68efa-94f5-40ea-a1fb-beae266ab74a","resolution":{"observed_at":"2026-08-05T23:06:49.688537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00898","last_updated":"2024-09-12T22:09:25Z","snapshot_observed_at":"2026-08-16T14:56:00.747412Z","submitted_at":"2023-10-02T04:29:40Z","title":"Enabling Language Models to Implicitly Learn Self-Improvement","version":4},"cited_work":{"arxiv_id":"2310.00898","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.00898","snapshot_observed_at":"2026-08-05T23:06:50.008244Z","title":"Enabling Language Models to Implicitly Learn Self-Improvement","venue":"cs.CL","work_id":"8a07dca6-71c3-4f55-8d6c-40eaad617228","year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.693409Z"},"links":{"cited_paper":"/paper/2310.00898","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:3ee665d0706be99d703e99e400f711b3375b5526c7d955540d2c8f1f112d7c2e","observation_id":"e60045f1-012f-4a39-93aa-e7081a442b2c","resolution":{"observed_at":"2026-08-05T23:06:50.013159Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-08-16T13:30:25.003501Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T23:06:49.698152Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.698152Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:4a0746b4ef21a2057417fb8958b6a18550f35aaad6532654af639e63755c4284","observation_id":"71b2bf67-f471-482f-ba00-5427082fa2ee","resolution":{"observed_at":"2026-08-05T23:06:49.698152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T23:06:49.702813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.702813Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:21bc12bcb2bd5679f58cac5835669567cab8fa0560e9c113e4be32384005ef2f","observation_id":"2dbbf387-75a1-4980-98ba-75c7278a89f1","resolution":{"observed_at":"2026-08-05T23:06:49.702813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13522","last_updated":"2024-03-31T18:12:16Z","snapshot_observed_at":"2026-08-16T20:39:55.522783Z","submitted_at":"2023-10-20T14:11:04Z","title":"Teaching Language Models to Self-Improve through Interactive Demonstrations","version":2},"cited_work":{"arxiv_id":"2310.13522","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.13522","snapshot_observed_at":"2026-08-05T23:06:49.947240Z","title":"Teaching Language Models to Self-Improve through Interactive Demonstrations","venue":"cs.CL","work_id":"029b70dc-3165-4f90-94d8-7bf97c670ec8","year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.707883Z"},"links":{"cited_paper":"/paper/2310.13522","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:bd84e1a65e9a93f0fdfab3d80a3ebd5654e0d67c58f1078b214a7b83d0e4034c","observation_id":"5f206878-43d7-44dd-b0a8-1b6e50f83983","resolution":{"observed_at":"2026-08-05T23:06:49.952745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-15T01:20:08.134494Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-05T23:06:49.712423Z","title":"Y.; Cho , K.; Li , X.; Sukhbaatar , S.; Xu , J.; and Weston , J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.712423Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:d287f4913719f77b74d0580ca91c917e6b19155168da5c410b54c3b018d87f2d","observation_id":"596f078d-45fb-46bf-a7ad-bcc89012defb","resolution":{"observed_at":"2026-08-05T23:06:49.712423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02414","last_updated":"2023-10-25T05:22:43Z","snapshot_observed_at":"2026-08-17T15:43:31.970425Z","submitted_at":"2022-10-05T17:34:44Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02414","snapshot_observed_at":"2026-08-05T23:06:49.717415Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.717415Z"},"links":{"cited_paper":"/paper/2210.02414","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:cbe0ec903c6034ec4f352b7a1b54e372350f00e385955d31138b4204039e200a","observation_id":"3111235b-0f77-4cf0-8a98-0f23c4a51f66","resolution":{"observed_at":"2026-08-05T23:06:49.717415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13723","last_updated":"2025-02-19T13:51:05Z","snapshot_observed_at":"2026-08-16T12:56:59.419347Z","submitted_at":"2025-02-19T13:51:05Z","title":"Direct Value Optimization: Improving Chain-of-Thought Reasoning in LLMs with Refined Values","version":1},"cited_work":{"arxiv_id":"2502.13723","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.13723","snapshot_observed_at":"2026-08-05T23:06:49.879378Z","title":"Direct Value Optimization: Improving Chain-of-Thought Reasoning in LLMs with Refined Values","venue":"cs.CL","work_id":"b974315d-b4ea-4c85-82a5-1668938bff10","year":2025},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.722299Z"},"links":{"cited_paper":"/paper/2502.13723","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:131758fc34e366cb12bc216e92e4c3abccd64b10a239f3d1f6231080d4a08d6c","observation_id":"a92bd15e-a55f-47c6-9899-d9fa0b7ae95a","resolution":{"observed_at":"2026-08-05T23:06:49.887791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03746","last_updated":"2025-03-05T18:58:44Z","snapshot_observed_at":"2026-08-16T12:52:45.422454Z","submitted_at":"2025-03-05T18:58:44Z","title":"Process-based Self-Rewarding Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.03746","snapshot_observed_at":"2026-08-05T23:06:49.727005Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.727005Z"},"links":{"cited_paper":"/paper/2503.03746","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:bb5b73d6dbe5d1088af480e48edcbfe8afc4504e7b9d6d50b09c99f643637a3a","observation_id":"cefe01cc-2bf6-412e-9050-1c1a2d005fcc","resolution":{"observed_at":"2026-08-05T23:06:49.727005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08232","last_updated":"2025-05-22T08:54:14Z","snapshot_observed_at":"2026-08-17T03:21:20.321406Z","submitted_at":"2023-10-12T11:25:46Z","title":"Language Models are Universal Embedders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08232","snapshot_observed_at":"2026-08-05T23:06:49.731775Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.731775Z"},"links":{"cited_paper":"/paper/2310.08232","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:e0f563ff3038a60acd63be66ec4044959b73dd10926fb1c5aa129ca6eed79b99","observation_id":"15701eec-a68a-4602-bb80-7ceeb2824b31","resolution":{"observed_at":"2026-08-05T23:06:49.731775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10859","last_updated":"2024-08-07T21:57:20Z","snapshot_observed_at":"2026-08-16T14:00:21.267196Z","submitted_at":"2024-04-16T19:17:23Z","title":"Forcing Diffuse Distributions out of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10859","snapshot_observed_at":"2026-08-05T23:06:49.736635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.736635Z"},"links":{"cited_paper":"/paper/2404.10859","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:172d217db9694771ee12e6c2206ea09e9ab5a0d07ae7296e5e68484edcc87d87","observation_id":"db368bf3-22c8-401f-b634-de41099e2368","resolution":{"observed_at":"2026-08-05T23:06:49.736635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.741440Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.741440Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:97e5f1b011d36a13b2872e42a45bdfdee54183ba656800867aeb88db799f8a33","observation_id":"2ee15eaf-15d6-45bf-9c0d-29fae194ec06","resolution":{"observed_at":"2026-08-05T23:06:49.741440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08922","last_updated":"2025-02-13T03:15:31Z","snapshot_observed_at":"2026-08-17T03:26:10.203526Z","submitted_at":"2025-02-13T03:15:31Z","title":"Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08922","snapshot_observed_at":"2026-08-05T23:06:49.746071Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.746071Z"},"links":{"cited_paper":"/paper/2502.08922","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:964d37baca10dcfdb41f067023f7e14cdb6ddc8f6667ee5294290a2846e661de","observation_id":"18db4afd-80b6-4da9-b0f4-c8e5b09750d9","resolution":{"observed_at":"2026-08-05T23:06:49.746071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.750641Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.750641Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:ae3f96cee1f3be2eeb6204aafbf99d733156f6fd5ef3e15e26e0d02931c44ecf","observation_id":"eb64a4ed-7654-425f-94c7-47c635f5722a","resolution":{"observed_at":"2026-08-05T23:06:49.750641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:06:49.755721Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.755721Z"},"links":{"citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:2d37425806ca401bb2c636b44e59c0635eefa945571d81b8f82e59e1fa71ef97","observation_id":"6f03bad6-0778-437a-8257-e1538fe59399","resolution":{"observed_at":"2026-08-05T23:06:49.755721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T04:45:14.014270Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":4,"verified_fuzzy":4},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2508.06026."}