{"as_of":"2026-08-10T12:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93ec25784d15201522b7d6c326a422620d9ad21b1966c9d25d2122f1205f55c4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:02:49.235474Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":27,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T20:39:15.388881Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2302.12192"},"observation_digest":"sha256:57724bec574676afe5a805314c6fb0def4a580d2154102d05b80d2030dcdd513","observation_id":"b45d4549-9528-4c2c-affd-c1858f77b22e","resolution":{"observed_at":"2026-05-14T20:39:15.486004Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2304.05128","last_updated":"2023-10-05T09:12:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-11T10:43:43Z","title":"Teaching Large Language Models to Self-Debug","version":2},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-12T06:24:24.607354Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2304.05128"},"observation_digest":"sha256:8e583ae1d64ce636b1b88fb141c800a680a5c6c0e3fab5fce113745b7ea087e4","observation_id":"df7e02a7-8c44-4344-a897-c31194eb80f5","resolution":{"observed_at":"2026-05-12T06:24:24.960444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":172,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:120fa5dcb67f9d80a43a727aea91722153d45720720eb32cfddedf0ca748470d","observation_id":"21d65289-9823-4462-98ee-d142f83cceea","resolution":{"observed_at":"2026-05-19T20:28:39.552064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-09T18:54:02.679174Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"reference_index":127,"source":"pdf_text","source_observed_at":"2026-05-11T10:47:44.152066Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2309.07864"},"observation_digest":"sha256:cea56bc229a43952f5bf761e1dc64d7d23fe3f40521e9a7a1535dfa04c355dbe","observation_id":"888cf924-ce4e-4e37-a18d-8028d9859137","resolution":{"observed_at":"2026-05-11T10:47:47.954838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-07-06T16:30:46.321160Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T22:00:51.487120Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2310.06987"},"observation_digest":"sha256:fe2ba0f66a57fa19a6a2c964dc50506d5e4c10014335b719c9e35292be1555cc","observation_id":"78fe38be-df0c-4001-aa54-18a1e7f11068","resolution":{"observed_at":"2026-05-16T22:00:51.564458Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-18T11:17:08.108565Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2401.05561"},"observation_digest":"sha256:55fee7eec106dc427a146877a7e978cd847e6843454f729cd37925dac78d08cd","observation_id":"51f31bb9-f395-427e-8558-ebef725cee31","resolution":{"observed_at":"2026-05-18T11:17:08.494101Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-10T03:07:35.408836Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"reference_index":142,"source":"arxiv_source","source_observed_at":"2026-05-10T17:34:42.565806Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2403.07974"},"observation_digest":"sha256:d785a5ce926abebc84ca0d488486449f908ba370e62d40685134d4032bf34ad8","observation_id":"f059d631-c20d-490d-bdab-2df8213cf7b3","resolution":{"observed_at":"2026-05-10T17:34:42.717565Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-07-06T19:22:58.341345Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:7f906e2e621f621e68bc96ff984733d712cc483d8d18cd58c834b63455b45239","observation_id":"b82aee17-ec1b-44d3-96ce-91fa6d62a8f4","resolution":{"observed_at":"2026-05-23T20:58:26.442731Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-23T17:33:13.394338Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2411.15594"},"observation_digest":"sha256:805069302f4c873c0677976f12c11c0268ded3e694817d2ec7310bf61ae8e6de","observation_id":"b34c4e40-7eed-4521-8663-53c83a10bd00","resolution":{"observed_at":"2026-05-23T17:35:44.001994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2412.13171","last_updated":"2024-12-17T18:50:33Z","snapshot_observed_at":"2026-08-09T18:44:01.140163Z","submitted_at":"2024-12-17T18:50:33Z","title":"Compressed Chain of Thought: Efficient Reasoning Through Dense Representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T04:47:40.335477Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2412.13171"},"observation_digest":"sha256:0f38af1060a3648e275ff39e2521db54751c9c7b7e2320eea71e17a5b83a21f6","observation_id":"0ff99883-5672-4257-aa20-22714700c191","resolution":{"observed_at":"2026-05-17T04:47:40.422808Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2501.16150","last_updated":"2026-03-27T07:41:10Z","snapshot_observed_at":"2026-08-02T22:37:46.736145Z","submitted_at":"2025-01-27T15:44:02Z","title":"A Comprehensive Survey of Agents for Computer Use: Foundations, Challenges, and Future Directions","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-23T04:59:36.994758Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2501.16150"},"observation_digest":"sha256:33251377c715dfc2a0daacc409bc3a8df38b96df7a1ad482d906ee6c59efb0ef","observation_id":"baa0cbb8-ab8a-4928-9b07-4f8f16043630","resolution":{"observed_at":"2026-05-23T05:02:35.944176Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-07T12:44:20.272639Z","title":"Chain of hindsight aligns language models with feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.272639Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:5e62735de59aa9112dea900a9a59dc344eb0dd0fd452cd568472b16d8ac6b791","observation_id":"e7c2b313-9bb8-48d7-872c-9e44e93999a4","resolution":{"observed_at":"2026-08-07T12:44:20.272639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-07T13:02:49.235474Z","title":"Chain of hindsight aligns language models with feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23852","last_updated":"2025-05-29T01:31:55Z","snapshot_observed_at":"2026-08-09T23:12:20.195127Z","submitted_at":"2025-05-29T01:31:55Z","title":"Large Language Model-Based Agents for Automated Research Reproducibility: An Exploratory Study in Alzheimer's Disease","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:02:49.235474Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2505.23852"},"observation_digest":"sha256:d7a1d7eb3cb8cebb2f7dd5a32ca7fb01dd64546f3a03fa1efcb568c4a59cd655","observation_id":"1fc1ce79-7efe-4436-8321-0ee83f34fb0f","resolution":{"observed_at":"2026-08-07T13:02:49.235474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-07T04:46:04.446080Z","title":"Chain of hindsight aligns language models with feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09656","last_updated":"2025-08-07T08:42:17Z","snapshot_observed_at":"2026-08-08T06:47:05.646052Z","submitted_at":"2025-06-11T12:25:38Z","title":"Multi-level Value Alignment in Agentic AI Systems: Survey and Perspectives","version":2},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-08-07T04:46:04.446080Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2506.09656"},"observation_digest":"sha256:fcd4b3e7f5bc13f97872be4c8ab0ae4b769442b147bac46f7863e07494ad1115","observation_id":"3b9a7e87-1844-403c-9371-9a48e56b292e","resolution":{"observed_at":"2026-08-07T04:46:04.446080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-07T00:57:56.730028Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12446","last_updated":"2025-06-28T14:16:58Z","snapshot_observed_at":"2026-08-10T01:13:57.356873Z","submitted_at":"2025-06-14T10:58:38Z","title":"From Outcomes to Processes: Guiding PRM Learning from ORM for Inference-Time Alignment","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T00:57:56.730028Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2506.12446"},"observation_digest":"sha256:6cb8ab67ece664e7464678b1f60e4f74da9120ed4a17cd7c97d89fc70bfcc1d1","observation_id":"63beea3b-8356-4f0c-96e8-868abdd8ef81","resolution":{"observed_at":"2026-08-07T00:57:56.730028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-06T18:33:07.896741Z","title":"Languages are rewards: Hindsight finetuning using human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08288","last_updated":"2025-07-11T03:24:47Z","snapshot_observed_at":"2026-08-09T00:25:43.056231Z","submitted_at":"2025-07-11T03:24:47Z","title":"Invariant-based Robust Weights Watermark for Large Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T18:33:07.896741Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2507.08288"},"observation_digest":"sha256:76e214ceddf82b0973c6854190fc903b4e7a40076c9914e5bab9d575cacd57b1","observation_id":"c9492d50-6ce5-4b04-bdcf-c9d856e340f1","resolution":{"observed_at":"2026-08-06T18:33:07.896741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2604.15136","last_updated":"2026-04-16T15:15:58Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:15:58Z","title":"Feedback-Driven Execution for LLM-Based Binary Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T10:40:32.133423Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2604.15136"},"observation_digest":"sha256:d202fe4ff6e6c9a15b3e76641817629b59016a19d6558bcfdb484f228582d086","observation_id":"84a467ab-def9-44bc-904a-b457e82c56f9","resolution":{"observed_at":"2026-05-10T10:44:37.914449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2605.15113","last_updated":"2026-05-18T19:19:17Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:27:34Z","title":"Learning from Language Feedback via Variational Policy Distillation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T20:34:36.764090Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2605.15113"},"observation_digest":"sha256:d7e07a83e14cac22ac713fd0d0eb057d9651993552b9057abdf03b0f89b14f9c","observation_id":"9dd5bbb0-c187-4884-a236-952f529115b9","resolution":{"observed_at":"2026-05-20T20:39:00.296891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2605.20506","last_updated":"2026-05-19T21:23:24Z","snapshot_observed_at":"2026-08-03T04:27:59.284440Z","submitted_at":"2026-05-19T21:23:24Z","title":"Reinforcing Human Behavior Simulation via Verbal Feedback","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-21T07:21:48.649289Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2605.20506"},"observation_digest":"sha256:2368c40d519453d3788a3624cc34160e8cb152d160add7ef7e02c9ce7fe2700e","observation_id":"4c312351-8c69-4ad3-a390-d8dfa220f5ac","resolution":{"observed_at":"2026-05-21T07:24:02.456916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":"2302.02676","doi":"10.48550/arxiv.2302.02676","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of hindsight aligns language models with feedback","venue":"arXiv (Cornell University)","work_id":"8053b3a1-afba-4849-91eb-092ec57797b1","year":2023},"citing_paper":{"arxiv_id":"2606.02293","last_updated":"2026-06-01T14:16:13Z","snapshot_observed_at":"2026-07-06T23:42:44.661608Z","submitted_at":"2026-06-01T14:16:13Z","title":"AI as a Tool for Simulation-Based Experiments in Literary Studies","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-28T14:54:14.909995Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2606.02293"},"observation_digest":"sha256:f50491e0c51c7a48bf1a44d2955647dad37564f7a8edd86fed046202469386a2","observation_id":"007cf121-c003-41fe-861a-e03429beac57","resolution":{"observed_at":"2026-06-28T15:02:19.091390Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-01T06:32:20.842111Z","title":"Chain of hindsight aligns language mod- els with feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21856","last_updated":"2026-07-23T22:50:23Z","snapshot_observed_at":"2026-08-07T15:15:19.846490Z","submitted_at":"2026-07-23T22:50:23Z","title":"LeAct: Learning to Reason from Expert Actions","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:20.842111Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2607.21856"},"observation_digest":"sha256:723e4a587c13fc98303de61ae0599a2979c3cec88f3528ecab40d3959fbda8a3","observation_id":"6c2bb689-008d-4bad-8790-6691437e2c51","resolution":{"observed_at":"2026-08-01T06:32:20.842111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-07-31T23:51:58.137701Z","title":"arXiv preprint arXiv:2302.02676 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23333","last_updated":"2026-07-25T19:11:15Z","snapshot_observed_at":"2026-08-03T00:37:21.399146Z","submitted_at":"2026-07-25T19:11:15Z","title":"Training with (Swap) Regret Loss in a Single-Layer Self-Attention Model: A Case Study on the Probability Simplex","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-07-31T23:51:58.137701Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2607.23333"},"observation_digest":"sha256:de45ff6be0fc8788309ba73d4cffd5f59e3ac1078b3887891e387874bbdaaa44","observation_id":"85eac940-cd36-4287-b81c-573dad37b8fa","resolution":{"observed_at":"2026-07-31T23:51:58.137701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.02676/citation-record","integrity":"/paper/2302.02676/integrity","json":"/paper/2302.02676/citation-record.json","paper":"/paper/2302.02676"},"outbound":[],"paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","latest_version":8,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2302.02676."}