{"as_of":"2026-08-22T15:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3766174103c952376ef4aeb4efc31bac4ba8c94d0b2fe014414597977764568d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T00:29:02.016876Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T18:11:05.475844Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.15694","last_updated":"2024-03-26T11:52:59Z","snapshot_observed_at":"2026-08-16T14:49:24.931815Z","submitted_at":"2023-10-24T10:05:32Z","title":"COPR: Continual Learning Human Preference through Optimal Policy Regularization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15694","snapshot_observed_at":"2026-08-10T00:29:02.016876Z","title":"Copf: Continual learning human preference through optimal policy fitting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18170","last_updated":"2025-02-01T03:19:00Z","snapshot_observed_at":"2026-08-13T09:25:21.364460Z","submitted_at":"2025-01-30T06:49:57Z","title":"Continually Evolved Multimodal Foundation Models for Cancer Prognosis","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T00:29:02.016876Z"},"links":{"cited_paper":"/paper/2310.15694","citing_paper":"/paper/2501.18170"},"observation_digest":"sha256:55d26508568fca81da0a434f8702e162296b8cefb0602864c1b927f5ebf90668","observation_id":"43a710c3-0197-4642-b6e5-a348367b437b","resolution":{"observed_at":"2026-08-10T00:29:02.016876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15694","last_updated":"2024-03-26T11:52:59Z","snapshot_observed_at":"2026-08-16T14:49:24.931815Z","submitted_at":"2023-10-24T10:05:32Z","title":"COPR: Continual Learning Human Preference through Optimal Policy Regularization","version":5},"cited_work":{"arxiv_id":"2310.15694","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.15694","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Copr: Continual learn- ing human preference through optimal policy regularization","venue":null,"work_id":"85036034-da5c-463a-9447-e9360f3a22a3","year":2023},"citing_paper":{"arxiv_id":"2605.05285","last_updated":"2026-07-13T13:01:55Z","snapshot_observed_at":"2026-08-15T01:02:12.444527Z","submitted_at":"2026-05-06T17:38:13Z","title":"Attribution-Guided Continual Learning for Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T16:31:15.098964Z"},"links":{"cited_paper":"/paper/2310.15694","citing_paper":"/paper/2605.05285"},"observation_digest":"sha256:4c18950325684f7bc626b9e2f2553e4f51f287196c051956d3c3e98f3791be87","observation_id":"40f49efb-ba06-4203-a51d-dda69f0998e1","resolution":{"observed_at":"2026-05-11T18:11:05.478339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15694","last_updated":"2024-03-26T11:52:59Z","snapshot_observed_at":"2026-08-16T14:49:24.931815Z","submitted_at":"2023-10-24T10:05:32Z","title":"COPR: Continual Learning Human Preference through Optimal Policy Regularization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15694","snapshot_observed_at":"2026-07-14T19:12:02.449224Z","title":"Copr: Continual learn- ing human preference through optimal policy regularization.arXiv preprint arXiv:2310.15694, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.05285","last_updated":"2026-07-13T13:01:55Z","snapshot_observed_at":"2026-08-15T01:02:12.444527Z","submitted_at":"2026-05-06T17:38:13Z","title":"Attribution-Guided Continual Learning for Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T19:12:02.449224Z"},"links":{"cited_paper":"/paper/2310.15694","citing_paper":"/paper/2605.05285"},"observation_digest":"sha256:f04cf1236d27d64caf8993faef22d10c41168534bee90f1607cda32f18f5a6b8","observation_id":"0ca3d32b-173b-4975-8b84-007e9af21442","resolution":{"observed_at":"2026-07-14T19:12:02.449224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15694","last_updated":"2024-03-26T11:52:59Z","snapshot_observed_at":"2026-08-16T14:49:24.931815Z","submitted_at":"2023-10-24T10:05:32Z","title":"COPR: Continual Learning Human Preference through Optimal Policy Regularization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15694","snapshot_observed_at":"2026-08-02T09:51:03.637728Z","title":"arXiv:2310.15694 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16252","last_updated":"2026-06-27T03:25:36Z","snapshot_observed_at":"2026-08-16T23:14:00.224337Z","submitted_at":"2026-06-27T03:25:36Z","title":"SOS-LoRA: Static Orthogonal-Subspace Low-Rank Adaptation with Fixed Multi-Scale Scaling","version":1},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-08-02T09:51:03.637728Z"},"links":{"cited_paper":"/paper/2310.15694","citing_paper":"/paper/2607.16252"},"observation_digest":"sha256:88c3c752018784d936032b9ff5262aa7381c4e76f61a2d1498c3ba8bdc0d7f25","observation_id":"dffe5c82-10e8-4ff5-8124-e96ad1918bcb","resolution":{"observed_at":"2026-08-02T09:51:03.637728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.15694/citation-record","integrity":"/paper/2310.15694/integrity","json":"/paper/2310.15694/citation-record.json","paper":"/paper/2310.15694"},"outbound":[],"paper":{"arxiv_id":"2310.15694","last_updated":"2024-03-26T11:52:59Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T14:49:24.931815Z","submitted_at":"2023-10-24T10:05:32Z","title":"COPR: Continual Learning Human Preference through Optimal Policy Regularization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:2310.15694."}