{"as_of":"2026-08-15T02:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c0d27e44fa2cbb814b00d24fd098fb7f1cef4379161336c3526a52099ebace68","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:13:39.996854Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T12:44:40.086070Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-12T13:06:27.839076Z","title":"Rlhf deciphered: A critical analysis of reinforcement learning from human feedback for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16502","last_updated":"2025-02-26T16:46:25Z","snapshot_observed_at":"2026-08-12T16:06:09.957131Z","submitted_at":"2024-11-25T15:37:27Z","title":"Interpreting Language Reward Models via Contrastive Explanations","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T13:06:27.839076Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2411.16502"},"observation_digest":"sha256:f5ec04a4264d453663751e82890f41b9ecf825374563ea06cfc31e798419e7f4","observation_id":"1581f68e-0b0f-4f49-9b4a-763df987c986","resolution":{"observed_at":"2026-08-12T13:06:27.839076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-11T14:48:54.284020Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11625","last_updated":"2024-12-16T10:10:27Z","snapshot_observed_at":"2026-08-14T03:12:47.009310Z","submitted_at":"2024-12-16T10:10:27Z","title":"Fool Me, Fool Me: User Attitudes Toward LLM Falsehoods","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T14:48:54.284020Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2412.11625"},"observation_digest":"sha256:bd013f1b678aa146f69fb8853db12aa564f367e83470e80c1dd21bf0eca802b6","observation_id":"5e5d688a-533a-445b-9567-f53eafde36db","resolution":{"observed_at":"2026-08-11T14:48:54.284020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-10T13:10:07.848420Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16461","last_updated":"2025-01-27T19:43:09Z","snapshot_observed_at":"2026-08-13T00:58:58.355984Z","submitted_at":"2025-01-27T19:43:09Z","title":"Trustworthiness in Stochastic Systems: Towards Opening the Black Box","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-10T13:10:07.848420Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2501.16461"},"observation_digest":"sha256:8ac2652c6512a280fe16944c6dad228c15a5d5bfb8c5a4e621995340280ed3b4","observation_id":"c3c3c93d-8bc0-4f27-adae-ac19b8f2b12a","resolution":{"observed_at":"2026-08-10T13:10:07.848420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":"2404.08555","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-06-30T12:44:40.086070Z","title":"Chaudhari, P","venue":null,"work_id":"8cc9739a-1059-4390-9b64-133e6763f9bf","year":2024},"citing_paper":{"arxiv_id":"2504.13048","last_updated":"2025-04-17T16:05:24Z","snapshot_observed_at":"2026-08-13T08:48:09.232755Z","submitted_at":"2025-04-17T16:05:24Z","title":"Design Topological Materials by Reinforcement Fine-Tuned Generative Model","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T19:15:26.493687Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2504.13048"},"observation_digest":"sha256:644bf1e490eab1cfb5b533399447a0224a0c237ecedc702bec08166e3ecda95e","observation_id":"0192f92d-4e8b-48a5-83a3-8b4552c38577","resolution":{"observed_at":"2026-05-22T19:16:58.673929Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-07T14:46:13.968664Z","title":"Rlhf deciphered: A critical analysis of reinforcement learning from human feedback for llms.arXiv preprint arXiv:2404.08555, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.968664Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:cc482ee75da45617012802012e0efa9e51f44975a0321f49e86f1f9b880cf196","observation_id":"6778c7a6-ea67-44ee-9d54-63587336a030","resolution":{"observed_at":"2026-08-07T14:46:13.968664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-06T22:03:11.362036Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22698","last_updated":"2025-07-01T15:26:29Z","snapshot_observed_at":"2026-08-14T16:00:26.494350Z","submitted_at":"2025-06-28T00:31:14Z","title":"Text Production and Comprehension by Human and Artificial Intelligence: Interdisciplinary Workshop Report","version":2},"reference_index":991,"source":"pdf_text","source_observed_at":"2026-08-06T22:03:11.362036Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2506.22698"},"observation_digest":"sha256:7ed34d61b1e0f11c2883048f7c7e2a825153fc6abd6f6516113c5273d5727476","observation_id":"d500896f-b713-4ad7-a960-4a10bc6c76de","resolution":{"observed_at":"2026-08-06T22:03:11.362036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-05T15:08:48.201481Z","title":"Rlhf de- ciphered: A critical analysis of reinforcement learning from human feedback for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21101","last_updated":"2025-08-28T07:05:24Z","snapshot_observed_at":"2026-08-07T09:02:43.747811Z","submitted_at":"2025-08-28T07:05:24Z","title":"Beyond Prediction: Reinforcement Learning as the Defining Leap in Healthcare AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T15:08:48.201481Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2508.21101"},"observation_digest":"sha256:a4584f69de794174397215a1de1e6fc0eb8447faa94f1cf1e8786a4bd1c78dfb","observation_id":"fb30ccd4-5103-4e0e-9e52-32b2ea97598a","resolution":{"observed_at":"2026-08-05T15:08:48.201481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":"2404.08555","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-06-30T12:44:40.086070Z","title":"Chaudhari, P","venue":null,"work_id":"8cc9739a-1059-4390-9b64-133e6763f9bf","year":2024},"citing_paper":{"arxiv_id":"2604.19260","last_updated":"2026-04-21T09:21:14Z","snapshot_observed_at":"2026-08-15T02:14:33.765960Z","submitted_at":"2026-04-21T09:21:14Z","title":"Understanding the Mechanism of Altruism in Large Language Models","version":1},"reference_index":220,"source":"arxiv_source","source_observed_at":"2026-05-10T01:36:50.329664Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2604.19260"},"observation_digest":"sha256:7c42128f58ca8245cc90adf8effcdddaddbfcb31e2cf69f998fca8ebc3d7a4eb","observation_id":"3397599e-aa4d-4948-a852-e4b7820fc315","resolution":{"observed_at":"2026-05-11T13:31:02.095160Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":"2404.08555","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-06-30T12:44:40.086070Z","title":"Chaudhari, P","venue":null,"work_id":"8cc9739a-1059-4390-9b64-133e6763f9bf","year":2024},"citing_paper":{"arxiv_id":"2604.22089","last_updated":"2026-04-23T21:41:09Z","snapshot_observed_at":"2026-07-06T23:08:33.204647Z","submitted_at":"2026-04-23T21:41:09Z","title":"Ethics Testing: Proactive Identification of Generative AI System Harms","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T20:49:22.147548Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2604.22089"},"observation_digest":"sha256:d0380a5cc3bbfccb4073fc0f029c95c95250299399abf7d2c0bd431fa85d9594","observation_id":"9b4d72fe-7bac-4803-b262-a665d07aaed0","resolution":{"observed_at":"2026-05-11T14:56:08.134959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":"2404.08555","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-06-30T12:44:40.086070Z","title":"Chaudhari, P","venue":null,"work_id":"8cc9739a-1059-4390-9b64-133e6763f9bf","year":2024},"citing_paper":{"arxiv_id":"2605.00155","last_updated":"2026-08-09T20:29:32Z","snapshot_observed_at":"2026-08-15T00:17:04.398984Z","submitted_at":"2026-04-30T19:22:56Z","title":"Wasserstein Distributionally Robust Regret Optimization for Reinforcement Learning from Human Feedback","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T21:03:53.045304Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2605.00155"},"observation_digest":"sha256:a63d07ef8ba5f2511275e29d86d42288dc58bc67c4c62fe5672bfcc1bb2b57cd","observation_id":"a8e39a83-0311-4f70-a9ea-4457ffbeae58","resolution":{"observed_at":"2026-05-11T14:46:46.289373Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":"2404.08555","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-06-30T12:44:40.086070Z","title":"Chaudhari, P","venue":null,"work_id":"8cc9739a-1059-4390-9b64-133e6763f9bf","year":2024},"citing_paper":{"arxiv_id":"2606.28707","last_updated":"2026-06-27T03:25:53Z","snapshot_observed_at":"2026-07-07T00:02:47.924620Z","submitted_at":"2026-06-27T03:25:53Z","title":"BV-Blend: Uncertainty-Weighted Historical Baselines for Stable Critic-Free RL with Verifiable Rewards","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-30T10:07:39.554999Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2606.28707"},"observation_digest":"sha256:99d5dac23264b2d4a95242fddae8dd9ec4146e514257bcf8cae760ce9cc3a988","observation_id":"d1c5aa97-5a8e-4280-9ba1-b7fc5cff08b5","resolution":{"observed_at":"2026-06-30T12:44:40.087477Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-14T04:13:39.996854Z","title":"arXiv preprint arXiv:2404.08555 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10327","last_updated":"2026-08-10T23:57:02Z","snapshot_observed_at":"2026-08-14T23:10:30.786772Z","submitted_at":"2026-08-10T23:57:02Z","title":"Toward a Theory of Value in AI Alignment","version":1},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-08-14T04:13:39.996854Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2608.10327"},"observation_digest":"sha256:63aa2150ec658a6d870dad0768e1a2cffed6cf8d52275bf56a23f89e9ca2701b","observation_id":"d950b6bc-40cd-466c-96ee-d6f213bda43c","resolution":{"observed_at":"2026-08-14T04:13:39.996854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.08555/citation-record","integrity":"/paper/2404.08555/integrity","json":"/paper/2404.08555/citation-record.json","paper":"/paper/2404.08555"},"outbound":[],"paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T00:31:12.611527Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2404.08555."}