{"as_of":"2026-08-13T06:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97e62e52546a91cca7b571eb499ee7a4d07cef5063912f825bed6185d347c1dc","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:25:13.230661Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:51:27.438057Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T04:19:34.990786Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15453","snapshot_observed_at":"2026-08-06T18:51:27.438057Z","title":"Data-adaptive safety rules for training reward models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07375","last_updated":"2025-07-10T01:56:56Z","snapshot_observed_at":"2026-08-09T22:55:04.253881Z","submitted_at":"2025-07-10T01:56:56Z","title":"Bradley-Terry and Multi-Objective Reward Modeling Are Complementary","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:51:27.438057Z"},"links":{"cited_paper":"/paper/2501.15453","citing_paper":"/paper/2507.07375"},"observation_digest":"sha256:6e382be735e51733687392eb3ba57b37cc83bae36489e6191b7f30748994bc7e","observation_id":"69708228-e735-41ca-9311-dc586d66fc1f","resolution":{"observed_at":"2026-08-06T18:51:27.438057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"cited_work":{"arxiv_id":"2501.15453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15453","snapshot_observed_at":"2026-07-04T04:19:34.990786Z","title":"Data-adaptive safety rules for training reward models.arXiv preprint arXiv:2501.15453, 2025","venue":null,"work_id":"a73a4d27-82a0-4831-a332-a48361bea78c","year":2025},"citing_paper":{"arxiv_id":"2606.20363","last_updated":"2026-06-18T15:25:42Z","snapshot_observed_at":"2026-07-06T23:55:29.991442Z","submitted_at":"2026-06-18T15:25:42Z","title":"Automating SKILL.md Generation for Computer-Using Agents via Interaction Trajectory Mining","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T17:02:30.696295Z"},"links":{"cited_paper":"/paper/2501.15453","citing_paper":"/paper/2606.20363"},"observation_digest":"sha256:c98071fa5396928db1dbd5ae485bb90c3e639b86b7da7f88af40972112866c0b","observation_id":"26cf5ff7-62cf-458f-8a51-58f0d698fee8","resolution":{"observed_at":"2026-07-04T04:19:34.992897Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15453/citation-record","integrity":"/paper/2501.15453/integrity","json":"/paper/2501.15453/citation-record.json","paper":"/paper/2501.15453"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T14:25:13.088401Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.088401Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:a7f6c872a2d9a469fad9333a8071779c7d8b6d52c6b25df0a7d0ebccd6fd2d25","observation_id":"2580469f-61db-4e46-bfda-2c09e04d1bf5","resolution":{"observed_at":"2026-08-10T14:25:13.088401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10702","last_updated":"2023-11-20T02:01:33Z","snapshot_observed_at":"2026-08-13T05:22:58.620371Z","submitted_at":"2023-11-17T18:45:45Z","title":"Camels in a Changing Climate: Enhancing LM Adaptation with Tulu 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10702","snapshot_observed_at":"2026-08-10T14:25:13.142485Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.142485Z"},"links":{"cited_paper":"/paper/2311.10702","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:0da7dfd355506f59d522f81e78b16f84a9729c5c0e2c4dd77ccbe02af245ed79","observation_id":"27bce344-63e0-43a5-b1e8-cf48a2dcc71c","resolution":{"observed_at":"2026-08-10T14:25:13.142485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:25:13.751892Z","title":"{severe level} harm question:","venue":null,"work_id":"f52e2d80-a631-4f36-a1aa-3fdc9b40c19e","year":2023},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.226125Z"},"links":{"citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:bceca315bce97a39551141caad187647c8df186cb49ca554317c53ee1ea5b6fd","observation_id":"0094cbfa-69e6-4ce1-b644-a9f29f1420e6","resolution":{"observed_at":"2026-08-10T14:25:13.756734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05344","last_updated":"2023-10-09T02:11:21Z","snapshot_observed_at":"2026-08-13T05:54:18.872703Z","submitted_at":"2023-10-09T02:11:21Z","title":"SteerLM: Attribute Conditioned SFT as an (User-Steerable) Alternative to RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05344","snapshot_observed_at":"2026-08-10T14:25:13.113800Z","title":"SteerLM: At- tribute conditioned SFT as an (user-steerable) alternative to RLHF","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.113800Z"},"links":{"cited_paper":"/paper/2310.05344","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:24f907ff1844c08dfebc6679d81ec2d426962c8046e909aa1ae671b3358aa69d","observation_id":"f470421d-ab73-4e1c-b06d-bb39dce0e019","resolution":{"observed_at":"2026-08-10T14:25:13.113800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10164","last_updated":"2024-09-16T10:54:04Z","snapshot_observed_at":"2026-08-12T22:44:12.135925Z","submitted_at":"2024-09-16T10:54:04Z","title":"Quantile Regression for Distributional Reward Models in RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10164","snapshot_observed_at":"2026-08-10T14:25:13.118759Z","title":"Quantile regression for distributional reward models in RLHF","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.118759Z"},"links":{"cited_paper":"/paper/2409.10164","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:7009c5f784d0bc5a22c7b1f02b586d12cfc6a034d3926ea9226ef069f4e302ed","observation_id":"cafb5bb8-e090-46e9-96e6-715b3ae5428a","resolution":{"observed_at":"2026-08-10T14:25:13.118759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07459","last_updated":"2023-02-18T21:30:27Z","snapshot_observed_at":"2026-07-06T14:51:56.435442Z","submitted_at":"2023-02-15T04:25:40Z","title":"The Capacity for Moral Self-Correction in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07459","snapshot_observed_at":"2026-08-10T14:25:13.128436Z","title":"Liao, Kamil˙ e Lukoˇ si¯ ut˙ e, Anna Chen, Anna Goldie, Azalia Mirhoseini, Catherine Olsson, Danny Hernandez, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.128436Z"},"links":{"cited_paper":"/paper/2302.07459","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:30dbcdaccc35e0426d8a3279a175fb3800bfa6240dc9c9819a027bca60c9f629","observation_id":"baeecbd7-6222-423c-bd54-a7e288f10e8e","resolution":{"observed_at":"2026-08-10T14:25:13.128436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-08-11T23:28:54.309888Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-10T14:25:13.132837Z","title":"Improving alignment of dialogue agents via targeted human judgements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.132837Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:a0502a7ca932b59f56472c34b72be00b02ea48a12b9af9da68f162f9a71ce05e","observation_id":"61ddd42a-ac36-44ab-bb67-176891b13f68","resolution":{"observed_at":"2026-08-10T14:25:13.132837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:25:13.809812Z","title":"Collective Constitutional AI: Aligning a language model with public input","venue":null,"work_id":"9e850178-3f73-4ea0-8adc-825c40cfce76","year":2024},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.137934Z"},"links":{"citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:f45863c197d209a98f1cc0292069fbdfb819ca7abc052da9a842e02c6532f60f","observation_id":"7fce955e-fa59-4530-816f-4f37da03cc29","resolution":{"observed_at":"2026-08-10T14:25:13.815217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-12T23:38:02.782103Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-10T14:25:13.146914Z","title":"PKU-SafeRLHF: Towards multi-level safety alignment for llms with human preference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.146914Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:658bd60e1a1909323754296e43c8caf478c5a7380b1c02cd657c47f0ce010fb9","observation_id":"b12fa28a-d167-4fcf-aeb5-fa8ad8b9afc4","resolution":{"observed_at":"2026-08-10T14:25:13.146914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-10T14:25:13.151591Z","title":"Mistral 7B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.151591Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:abc81755e65ca1d4eb21d6454659da23c6ece792e0f20d8d97f4d58fba8c5276","observation_id":"a941f6f1-daac-4ccd-922d-6c52dd840f81","resolution":{"observed_at":"2026-08-10T14:25:13.151591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-10T14:25:13.155955Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.155955Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:07899fdc5f3106872719a302a99d2afd5c4e3799aee3891e0ccc2f1b26d5d1db","observation_id":"778afdcc-4115-4c0f-a689-d5149d6a5281","resolution":{"observed_at":"2026-08-10T14:25:13.155955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-13T00:49:16.605081Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-10T14:25:13.165585Z","title":"RewardBench: Evaluating reward models for language modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.165585Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:c28fb2fdef8f496cdec6cc3eca183d1fe128776aad2d0c3f49f2f7600823f3f0","observation_id":"95b18964-317a-47b4-aff0-a183c9e5f0b2","resolution":{"observed_at":"2026-08-10T14:25:13.165585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:25:13.170124Z","title":"Rule-based data selection for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.170124Z"},"links":{"citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:97ec80ea9f147571bca0397763388e541288c8dbee53707774933bb1ec9f84b6","observation_id":"52271593-4ae9-48d8-9291-b2b50125b6ad","resolution":{"observed_at":"2026-08-10T14:25:13.170124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-10T14:25:13.174468Z","title":"Skywork-reward: Bag of tricks for reward modeling in LLMs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.174468Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:65d76fc2eca26c85c6db38007ef2f712941149721fc8cbcf92610cccfd3f3ce6","observation_id":"b2119d49-2202-4e31-b9a1-0c82e0ae652b","resolution":{"observed_at":"2026-08-10T14:25:13.174468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00847","last_updated":"2025-02-12T03:34:29Z","snapshot_observed_at":"2026-08-12T22:33:14.632545Z","submitted_at":"2024-10-01T16:29:59Z","title":"Uncertainty-aware Reward Model: Teaching Reward Models to Know What is Unknown","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00847","snapshot_observed_at":"2026-08-10T14:25:13.179261Z","title":"Uncertainty-aware reward model: Teaching reward models to know what is unknown","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.179261Z"},"links":{"cited_paper":"/paper/2410.00847","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:781d9f113fe44ed5645661aa1e717a8e35a4a5cd3e7aac0756bd8b1d7227eae7","observation_id":"60177fe9-4da5-4bc5-9d79-4b58bed8ef16","resolution":{"observed_at":"2026-08-10T14:25:13.179261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01241","last_updated":"2023-03-01T01:31:17Z","snapshot_observed_at":"2026-08-10T23:03:58.956344Z","submitted_at":"2022-10-03T21:38:29Z","title":"Is Reinforcement Learning (Not) for Natural Language Processing: Benchmarks, Baselines, and Building Blocks for Natural Language Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01241","snapshot_observed_at":"2026-08-10T14:25:13.188226Z","title":"Is reinforcement learning (not) for natural language processing: Benchmarks, baselines, and building blocks for natural language policy optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.188226Z"},"links":{"cited_paper":"/paper/2210.01241","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:9117a00705e0bd7965a8677be2b33b2935c33c3d9deed5d216e2ffa2be75cf3c","observation_id":"80ece55a-59bb-4ec9-ac52-06f13615a23a","resolution":{"observed_at":"2026-08-10T14:25:13.188226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-10T14:25:13.193055Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.193055Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:c71c6f3958a312021a4940d4ed083ee31c5c4fe26e63eb46fc44660c2885e049","observation_id":"98c4542a-fc8f-46fe-a415-90a40a27d33f","resolution":{"observed_at":"2026-08-10T14:25:13.193055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T14:25:13.197665Z","title":"LLaMA: Open and efficient foundation language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.197665Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:96fda516c5083cfd1990ac77ee842ce4d4cd0e2da39ad0754bbda8fe8d2aba4b","observation_id":"7a34b5fb-7a42-4c67-b238-2a08df5dd680","resolution":{"observed_at":"2026-08-10T14:25:13.197665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12845","last_updated":"2024-06-18T17:58:28Z","snapshot_observed_at":"2026-08-12T23:39:50.330661Z","submitted_at":"2024-06-18T17:58:28Z","title":"Interpretable Preferences via Multi-Objective Reward Modeling and Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12845","snapshot_observed_at":"2026-08-10T14:25:13.202305Z","title":"Interpretable preferences via multi-objective reward modeling and mixture-of-experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.202305Z"},"links":{"cited_paper":"/paper/2406.12845","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:c74591818ec5f1af711f44dacd0c6c469d8aa726a996ebaaa9315e0440b655e2","observation_id":"589cc8e1-0d44-499e-99c3-9300818f6f27","resolution":{"observed_at":"2026-08-10T14:25:13.202305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08673","last_updated":"2024-06-12T22:28:08Z","snapshot_observed_at":"2026-08-12T23:44:06.669155Z","submitted_at":"2024-06-12T22:28:08Z","title":"HelpSteer2: Open-source dataset for training top-performing reward models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08673","snapshot_observed_at":"2026-08-10T14:25:13.206994Z","title":"Helpsteer2: Open-source dataset for training top- performing reward models","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.206994Z"},"links":{"cited_paper":"/paper/2406.08673","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:a16f11e2aeb6ee1fb6acdfb2371025fd8dff0c052c3283c56417eacb3d50a0e2","observation_id":"15725ff4-32ee-4da2-80d6-910a317613ff","resolution":{"observed_at":"2026-08-10T14:25:13.206994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07045","last_updated":"2024-06-24T04:04:21Z","snapshot_observed_at":"2026-08-09T10:42:31.794884Z","submitted_at":"2023-09-13T15:56:50Z","title":"SafetyBench: Evaluating the Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07045","snapshot_observed_at":"2026-08-10T14:25:13.211691Z","title":"Safetybench: Evaluating the safety of large language models with multiple choice questions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.211691Z"},"links":{"cited_paper":"/paper/2309.07045","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:7bd1bdfad3abde9653111743322f2086344e4afcbf7f0546ff4e77183444b636","observation_id":"a44391cd-317e-447f-a0d8-44b23ac6a679","resolution":{"observed_at":"2026-08-10T14:25:13.211691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:25:13.782770Z","title":"− X t P+(t) logP+(t) # + 1 2","venue":null,"work_id":"8d4f9bdd-06e2-42f2-b6ae-7c53841252e2","year":1951},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.216632Z"},"links":{"citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:40261fce3e96f7a357307424d12cc11589506a5aec9e266163bf8146bb8f3403","observation_id":"9c4d6ac4-34cb-4be4-85e9-df16ad2ca076","resolution":{"observed_at":"2026-08-10T14:25:13.788799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:25:13.766814Z","title":"16 Proof of Theorem 3.4","venue":null,"work_id":"434fab09-baae-469a-8030-cbbec06ecc7f","year":2024},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.221460Z"},"links":{"citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:eebd553fdb12284ea173b0d05bba443f0793cc77f984c95fd9e287b0024b5b57","observation_id":"e82345c2-ad06-45c2-b429-4143a1f3a7b1","resolution":{"observed_at":"2026-08-10T14:25:13.771723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:25:13.733905Z","title":"Results are averaged over 2 trained models with different random seeds for optimal hyperparameter selection","venue":null,"work_id":"075b42dc-4159-4641-adda-d9d276e01afb","year":2024},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.230661Z"},"links":{"citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:b01f8e3d1e2b5e521381a54e8a637dc3948aadc52962c89b0c43856d7c8cc97b","observation_id":"f9badda7-99c6-439c-8cfb-18042465e3b4","resolution":{"observed_at":"2026-08-10T14:25:13.741166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13798","last_updated":"2023-10-20T20:12:45Z","snapshot_observed_at":"2026-08-13T05:44:20.432020Z","submitted_at":"2023-10-20T20:12:45Z","title":"Specific versus General Principles for Constitutional AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13798","snapshot_observed_at":"2026-08-10T14:25:13.160754Z","title":"Specific versus general principles for Constitutional AI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":1951,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.160754Z"},"links":{"cited_paper":"/paper/2310.13798","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:70afcb1f5a9c08255f8f6ee13994d6948b0a75848c4a658264d864c3c7ca43af","observation_id":"2d4d4fd1-2249-4b0a-836a-59f9ed0a4bb3","resolution":{"observed_at":"2026-08-10T14:25:13.160754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-10T14:25:13.108657Z","title":"Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared Kaplan, Prafulla Dhariwal, Arvind Neelakantan, Pranav Shyam, Girish Sastry, Amanda Askell, et al","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.108657Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:830ab215fb4fe553700b5c2e4506ed90df6eed82cb85ad9caa65fca4130ee925","observation_id":"c8552f2a-d285-4119-a6c9-ee9beb47689c","resolution":{"observed_at":"2026-08-10T14:25:13.108657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:25:13.183662Z","title":"Llama 3.2: Revolutionizing edge ai and vision with open, customizable models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":1975,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.183662Z"},"links":{"citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:82fe3649a8de6353435759923520f4d380529b8530dc76ee4a33bef9d911ca7e","observation_id":"c0689ef8-c045-44ef-a253-98bd8de39d5f","resolution":{"observed_at":"2026-08-10T14:25:13.183662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T14:25:13.123550Z","title":"The Llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.123550Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:c543ba0b8310247cc01761374e4162f7d48524d1809324f2bb01281b0c0b3840","observation_id":"ba69f6bc-1fa7-4417-837c-fa5160970cdd","resolution":{"observed_at":"2026-08-10T14:25:13.123550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-10T14:25:13.103534Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.103534Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:bc9628a81cab0b70c9451a0608405efa437985d73d3c18443717cc919da1f50f","observation_id":"88c204dd-5cdf-441e-b506-db0b9521d109","resolution":{"observed_at":"2026-08-10T14:25:13.103534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-10T14:25:13.098361Z","title":"Introduces Claude 3.5 Sonnet with improved performance in intelligence, vision capabilities, and new Artifacts feature","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.098361Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:fdc226c1b69e8dc02b9539e4413b09c0fb17ef881259c04e61face319a0f1ebe","observation_id":"c5ed5287-008a-404d-ba01-f8b749518143","resolution":{"observed_at":"2026-08-10T14:25:13.098361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:25:13.827406Z","title":"Llama 3.2: Advancing ai on edge and mobile devices","venue":null,"work_id":"323e0ad2-afdb-47fa-9215-8cda8042dfb2","year":2024},"citing_paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-10T14:25:13.093692Z"},"links":{"citing_paper":"/paper/2501.15453"},"observation_digest":"sha256:8fe078062f89a2ada57ff5bf9932551abdbce6d5c187fd4d6a4d88442bf86a7e","observation_id":"433e024a-c09c-44cd-898b-c5318d5171dc","resolution":{"observed_at":"2026-08-10T14:25:13.832460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.15453","last_updated":"2025-01-28T06:35:32Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T23:04:15.458969Z","submitted_at":"2025-01-26T08:49:46Z","title":"Data-adaptive Safety Rules for Training Reward Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 2 inbound Pith citation observations for arXiv:2501.15453."}