{"as_of":"2026-08-11T14:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6afcf82e8256d3ee437c9d932bc9d2cecea8356b12018710d638043dd6745ec2","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:54:13.607657Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T16:49:14.243931Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T01:07:30.215801Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"cited_work":{"arxiv_id":"2509.03672","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.03672","snapshot_observed_at":"2026-07-03T01:07:30.215801Z","title":"https://arxiv.org/ abs/2509.03672","venue":null,"work_id":"527cb55e-43cf-472c-85c4-5635f743acbc","year":2025},"citing_paper":{"arxiv_id":"2606.09038","last_updated":"2026-06-08T05:10:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-08T05:10:05Z","title":"Personalization Meets Safety:Mechanisms,Risks,and Mitigations in Personalized LLMs","version":1},"reference_index":171,"source":"pdf_text","source_observed_at":"2026-06-27T16:49:14.243931Z"},"links":{"cited_paper":"/paper/2509.03672","citing_paper":"/paper/2606.09038"},"observation_digest":"sha256:92572206c140a94d4d39572c6381dfb3ade35352dc05170380b9832575dc6519","observation_id":"d01e6178-4e4e-4035-9ad6-0c8a4e3310de","resolution":{"observed_at":"2026-07-03T01:07:30.217449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.03672/citation-record","integrity":"/paper/2509.03672/integrity","json":"/paper/2509.03672/citation-record.json","paper":"/paper/2509.03672"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-05T10:54:10.716053Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.716053Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:5048da6d96d62379a42be05b0b5a2b7cf23005b7e262bd849fa2c89fbf1a8397","observation_id":"fe8cde69-a40f-4ab0-9ee2-9c163d20786b","resolution":{"observed_at":"2026-08-05T10:54:10.716053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"quant-ph/0610146","last_updated":"2006-10-18T13:49:39Z","snapshot_observed_at":"2026-08-06T00:46:28.844372Z","submitted_at":"2006-10-18T13:49:39Z","title":"A Sharp Fannes-type Inequality for the von Neumann Entropy","version":1},"cited_work":{"arxiv_id":"quant-ph/0610146","doi":null,"metadata_source":"pith","pith_arxiv_id":"quant-ph/0610146","snapshot_observed_at":"2026-08-05T10:54:14.118658Z","title":"A Sharp Fannes-type Inequality for the von Neumann Entropy","venue":"quant-ph","work_id":"fa9b8dbf-9ebe-4739-8a76-0856a3b36b0c","year":2006},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.769694Z"},"links":{"cited_paper":"/paper/quant-ph/0610146","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:b59e88373e9c3e7523fad91e758032772a5873b059a523bcdbd25804418c2e3e","observation_id":"de8ce66d-7c79-458c-a04b-ec831e7f9bdb","resolution":{"observed_at":"2026-08-05T10:54:14.125679Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T10:54:10.832231Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.832231Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:032c5d7772c51c50a8888aa3f64cf29b68fb060d1d1b20e07bf56642a815d093","observation_id":"98653cfa-3c35-42ff-94b9-eda507bd7ace","resolution":{"observed_at":"2026-08-05T10:54:10.832231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:10.891723Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.891723Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:ee205c38552a5cebe40274c5b5c8b520e0ef313613f99ef12e4cf9fead931481","observation_id":"e687d5f9-1a48-4b56-acfc-308db9130456","resolution":{"observed_at":"2026-08-05T10:54:10.891723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15217","last_updated":"2023-09-11T17:25:24Z","snapshot_observed_at":"2026-08-03T19:11:09.671782Z","submitted_at":"2023-07-27T22:29:25Z","title":"Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15217","snapshot_observed_at":"2026-08-05T10:54:10.974544Z","title":"Open problems and fundamental limitations of reinforcement learning from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:10.974544Z"},"links":{"cited_paper":"/paper/2307.15217","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:c17aa655bb3b8770ab83ca690363d031008440015dcd1324d6fdd83ee028b0a0","observation_id":"97bb6238-1d2c-4042-b3e8-2ea3e4dddebe","resolution":{"observed_at":"2026-08-05T10:54:10.974544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19320","last_updated":"2025-02-19T00:51:58Z","snapshot_observed_at":"2026-07-06T18:22:10.094519Z","submitted_at":"2024-05-29T17:51:42Z","title":"Value-Incentivized Preference Optimization: A Unified Approach to Online and Offline RLHF","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19320","snapshot_observed_at":"2026-08-05T10:54:11.055317Z","title":"Value-incentivized preference optimization: A unified approach to online and offline rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.055317Z"},"links":{"cited_paper":"/paper/2405.19320","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:da2177b4fdca0e3c2f0e8929dabd7f1f7561b330696d7ce056e962dd1c439a4e","observation_id":"d5241516-3b74-46d1-9351-296611749a36","resolution":{"observed_at":"2026-08-05T10:54:11.055317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08925","last_updated":"2024-12-26T00:15:20Z","snapshot_observed_at":"2026-08-09T15:45:13.646720Z","submitted_at":"2024-02-14T03:56:27Z","title":"MaxMin-RLHF: Alignment with Diverse Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08925","snapshot_observed_at":"2026-08-05T10:54:11.144244Z","title":"Maxmin- RLHF : Alignment with diverse human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.144244Z"},"links":{"cited_paper":"/paper/2402.08925","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:c8f9b5207b82711bb7604dd58c1f190d5aaeaa3c226cf1764b2e4af7bb2ee3aa","observation_id":"1fb46bd4-3130-4a4c-8d0c-9357b37ad186","resolution":{"observed_at":"2026-08-05T10:54:11.144244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08469","last_updated":"2024-06-12T17:54:54Z","snapshot_observed_at":"2026-08-07T19:56:45.521787Z","submitted_at":"2024-06-12T17:54:54Z","title":"PAL: Pluralistic Alignment Framework for Learning from Heterogeneous Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08469","snapshot_observed_at":"2026-08-05T10:54:11.230380Z","title":"PAL : Pluralistic alignment framework for learning from heterogeneous preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.230380Z"},"links":{"cited_paper":"/paper/2406.08469","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:e4f1a350b490d4e5bc838b053a1ce47aae23006b75abb70364c6b2688a9a3b2d","observation_id":"f4181020-b7af-400b-acc7-19cf002d6b28","resolution":{"observed_at":"2026-08-05T10:54:11.230380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.334387Z","title":"The alignment problem: How can machines learn human values? Atlantic Books, 2021","venue":null,"work_id":"f13b1601-a64b-4ce7-8e33-c3b4ef048cbc","year":2021},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.305666Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:d75d839dab698bfdaf4da3191146d8dd6834241cc09e2094503a627c7b82f73b","observation_id":"60305593-17c6-4416-83df-aa8d0c54f42d","resolution":{"observed_at":"2026-08-05T10:54:14.339079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T10:54:11.358214Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.358214Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:afabfb0d1683c2ab486d9f81d3bddef333c5c0bf79f1ae3865f96bffda98d351","observation_id":"936afcaa-c91e-4cd2-89f3-fb19b297db57","resolution":{"observed_at":"2026-08-05T10:54:11.358214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:11.424298Z","title":"Active preference optimization for sample efficient rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.424298Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:dddd4d7a84a228c9d43fc1d6e350b90f0d29f887442f73377a83821798ab4348","observation_id":"41632b7a-2b4f-4813-bf37-6d0ee4a79b09","resolution":{"observed_at":"2026-08-05T10:54:11.424298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:11.466795Z","title":"When personalization meets reality: A multi-faceted analysis of personalized preference learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.466795Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:012c5a640a785332c125e928620e83c2172b023a5566ad2427d45662460367a3","observation_id":"88ca93d6-092d-48ca-af65-522c391164de","resolution":{"observed_at":"2026-08-05T10:54:11.466795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07453","last_updated":"2025-03-13T23:15:55Z","snapshot_observed_at":"2026-08-07T17:16:22.945358Z","submitted_at":"2025-03-10T15:31:42Z","title":"Is a Good Foundation Necessary for Efficient Reinforcement Learning? The Computational Role of the Base Model in Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07453","snapshot_observed_at":"2026-08-05T10:54:11.555391Z","title":"Is a good foundation necessary for efficient reinforcement learning? the computational role of the base model in exploration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.555391Z"},"links":{"cited_paper":"/paper/2503.07453","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:79ced30c770c1227d133ba2464cb55972e14e8a3bb5317cfcc3c60c05e4b8f25","observation_id":"1accefff-7cf8-4e75-a659-1d2262aba6fc","resolution":{"observed_at":"2026-08-05T10:54:11.555391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11564","last_updated":"2023-10-17T20:22:13Z","snapshot_observed_at":"2026-07-06T16:34:42.650324Z","submitted_at":"2023-10-17T20:22:13Z","title":"Personalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11564","snapshot_observed_at":"2026-08-05T10:54:11.639883Z","title":"Personalized soups: Personalized large language model alignment via post-hoc parameter merging","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.639883Z"},"links":{"cited_paper":"/paper/2310.11564","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:79e9739dd0dc5e6e21f057d461ed2f9800b8fabf08cad037eb16a4fb53e2180e","observation_id":"678c3fde-147b-4386-a1d5-01868278dfe5","resolution":{"observed_at":"2026-08-05T10:54:11.639883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.310326Z","title":"Provably feedback-efficient reinforcement learning via active reward learning","venue":null,"work_id":"c65490f1-7291-4404-8ecf-8dca24f3ecef","year":2022},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.724453Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:54b7dc56fb1617e2df9c32a43f5832d981e076db7c47c44d0dac39f045b97026","observation_id":"4b01892f-6150-4dd1-aecd-dc5de55d79c3","resolution":{"observed_at":"2026-08-05T10:54:14.314729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:11.778287Z","title":"Bandit algorithms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.778287Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:60a05b36960da8f6b7ca1c59c1f67f02b1e39fc124a48338ce9e294e0c1e6edd","observation_id":"9e840360-9f7b-424c-835f-e8e8a47a2a0b","resolution":{"observed_at":"2026-08-05T10:54:11.778287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02205","last_updated":"2025-02-09T17:13:51Z","snapshot_observed_at":"2026-08-10T01:47:53.455107Z","submitted_at":"2024-10-03T04:34:04Z","title":"Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02205","snapshot_observed_at":"2026-08-05T10:54:11.835948Z","title":"Aligning with logic: Measuring, evaluating and improving logical consistency in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.835948Z"},"links":{"cited_paper":"/paper/2410.02205","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:5e14fb6e147cc89967235fd96fdd1a59e3f508341fa61a261a2dcb54f628be94","observation_id":"68bd6346-be17-4508-aee6-fc743a492faa","resolution":{"observed_at":"2026-08-05T10:54:11.835948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.284395Z","title":"Learning word vectors for sentiment analysis","venue":null,"work_id":"40020feb-4f3d-4997-96af-6457e0294256","year":2011},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.925172Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:f4a116065b8c0d792753ccb077fa00c6a2660aaba42ad3da60256efa93650557","observation_id":"ddb95464-f354-4e29-985d-ce7d3544a8a2","resolution":{"observed_at":"2026-08-05T10:54:14.288750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:11.989754Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:11.989754Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:a9233cccbef70b3dc994c683d79a27efa644dca988682c10bb868a1634cfb82c","observation_id":"6de299e3-5109-4788-9121-e654899f0bed","resolution":{"observed_at":"2026-08-05T10:54:11.989754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.258158Z","title":"Iterative reasoning preference optimization","venue":null,"work_id":"0004dadf-fca8-483e-aaf1-ce80b6bc7ca2","year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.079907Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:1a7b9f62d4f9f4e6d371f663ef979d835bd2f819f55d66154c3eef48b4ad0a4f","observation_id":"20c57c66-534a-42b9-a12b-fb52ed52ceae","resolution":{"observed_at":"2026-08-05T10:54:14.263709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10075","last_updated":"2024-08-19T15:18:30Z","snapshot_observed_at":"2026-08-09T20:26:15.885759Z","submitted_at":"2024-08-19T15:18:30Z","title":"Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10075","snapshot_observed_at":"2026-08-05T10:54:12.137540Z","title":"Personalizing reinforcement learning from human feedback with variational preference learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.137540Z"},"links":{"cited_paper":"/paper/2408.10075","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:6db18e0ee4e45c5cc5415f057a005b36be9e36172dd2b94bf616dac3e6212a9f","observation_id":"170584b6-cd83-4933-b97a-d3ddcbacea7a","resolution":{"observed_at":"2026-08-05T10:54:12.137540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:12.237589Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.237589Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:9cdc90dde561e93c5c06873f77f692f033fd54d57cf98462eba94900fb51c438","observation_id":"0d3e55d7-8115-4545-83da-7e1eaffe14c7","resolution":{"observed_at":"2026-08-05T10:54:12.237589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.230674Z","title":"Group robust preference optimization in reward-free rlhf","venue":null,"work_id":"6e45c072-8982-465c-b33f-09936d0907d7","year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.320047Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:4e1f41e7d905296626a0d84f0cc3815e82bcbd89bd71a1530f36b07181c5f446","observation_id":"ca89941e-85a1-443f-afb1-22990b46f596","resolution":{"observed_at":"2026-08-05T10:54:14.235770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.214829Z","title":"Dueling rl: Reinforcement learning with trajectory preferences","venue":null,"work_id":"90a15a20-5ab5-4685-b885-7864bb87a084","year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.412731Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:49a61acfdc3d1255f937a94c8e7159fae9248bf9a2543f16b4df0301734bc94b","observation_id":"3b9ce4ec-c2af-4127-ae71-2169cf9c2400","resolution":{"observed_at":"2026-08-05T10:54:14.219234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.199287Z","title":"Whose opinions do language models reflect? In International Conference on Machine Learning, pages 29971--30004","venue":null,"work_id":"03f7f36f-b2b9-4a1f-a353-577f9111bc5a","year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.495223Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:39391d0cdcb53e409b8207231e0637dd8938e0ae4475d66d9c83b6f564ef6385","observation_id":"ef35e711-f3b8-44ef-951b-25f36f72e3b4","resolution":{"observed_at":"2026-08-05T10:54:14.204135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T10:54:12.534185Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.534185Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:fe63bb3becbfd23df31c17f5f1fdc8790a09e25bc994ad727d09cefd9879628a","observation_id":"fa21e778-d9e4-4fdd-9cc0-0aafdad75656","resolution":{"observed_at":"2026-08-05T10:54:12.534185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:12.626549Z","title":"Collective Choice and Social Welfare: An Expanded Edition","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.626549Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:e05f8c7336d8c954b721323a2717fc53d87984366f4feb268df52fdf9b4d558d","observation_id":"452cded4-fff2-4aa3-98aa-e5c967bb6dc6","resolution":{"observed_at":"2026-08-05T10:54:12.626549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T10:54:12.794995Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.794995Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:cd5d6cee2c3ddc6a473ae67cb959b75b25fecd697cf0032456830ffe246e1a35","observation_id":"ab95073d-b7e5-4df8-95de-abd0a5a34da5","resolution":{"observed_at":"2026-08-05T10:54:12.794995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:12.873574Z","title":"Robust multi-objective controlled decoding of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.873574Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:084bcb2f60ee22ee34ad36d61607f748e79b98266c9909880703c14a10a62b40","observation_id":"7d07935c-e1dc-40c4-8720-48d0455f98e3","resolution":{"observed_at":"2026-08-05T10:54:12.873574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-06T19:18:51.065158Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-05T10:54:12.976902Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:12.976902Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:347b8164b8cc513ac5e9e9534d58a046cbbde1dc576919d6b3038995464b091f","observation_id":"1e85c555-f779-4e4c-bcd1-16de7045dfa7","resolution":{"observed_at":"2026-08-05T10:54:12.976902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-07-06T15:57:57.167169Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-05T10:54:13.130765Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.130765Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:4250eb5dde1ddb95c037204029324c9a2e869f68c13bf70924adfd87be8fdbb2","observation_id":"57da1d23-91bb-4077-aafa-9c65c0328894","resolution":{"observed_at":"2026-08-05T10:54:13.130765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21046","last_updated":"2024-05-31T17:39:06Z","snapshot_observed_at":"2026-07-31T03:29:04.443362Z","submitted_at":"2024-05-31T17:39:06Z","title":"Exploratory Preference Optimization: Harnessing Implicit Q*-Approximation for Sample-Efficient RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21046","snapshot_observed_at":"2026-08-05T10:54:13.249178Z","title":"Exploratory preference optimization: Harnessing implicit q*-approximation for sample-efficient rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.249178Z"},"links":{"cited_paper":"/paper/2405.21046","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:3684e534db465299efcc476476588ce0eb95d6daa09cacedbf86cf7908789607","observation_id":"456bd312-3c97-43e2-bcc5-7cff9de0513a","resolution":{"observed_at":"2026-08-05T10:54:13.249178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.182719Z","title":"Iterative preference learning from human feedback: Bridging theory and practice for RLHF under KL -constraint","venue":null,"work_id":"60591098-046c-486b-9ed2-c4ed42bdb576","year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.373392Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:f44a2808ace118cbfc2ca88ab6e63f486ed0bec6108e216d1cfc38a652b3cfbf","observation_id":"50b4bcdc-9e2e-4605-a69f-c186ffb3f573","resolution":{"observed_at":"2026-08-05T10:54:14.188631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.168630Z","title":"Impact of representation learning in linear bandits","venue":null,"work_id":"9f94ba29-db9e-4dc6-ba8f-ea27b9e325fe","year":2020},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.481709Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:3fadec8ebba2fe5b3e5534de95186dca07fc120eac18a5d1f32ad1a19a60da5b","observation_id":"96b151ef-cf89-42e9-823b-18e4492e0c01","resolution":{"observed_at":"2026-08-05T10:54:14.173019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19332","last_updated":"2024-11-05T07:21:18Z","snapshot_observed_at":"2026-07-06T18:22:10.094519Z","submitted_at":"2024-05-29T17:59:07Z","title":"Self-Exploring Language Models: Active Preference Elicitation for Online Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19332","snapshot_observed_at":"2026-08-05T10:54:13.592468Z","title":"Self-exploring language models: Active preference elicitation for online alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.592468Z"},"links":{"cited_paper":"/paper/2405.19332","citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:ccaa3707235c02b6702f43a6d7d948dc735eabc011874a3e4532c01c9134b145","observation_id":"243ea628-e798-41c4-acb3-3fda90368e0b","resolution":{"observed_at":"2026-08-05T10:54:13.592468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:54:14.153544Z","title":"Principled reinforcement learning with human feedback from pairwise or k-wise comparisons","venue":null,"work_id":"bb1e8d31-07ad-4d81-a49b-591091e19430","year":2023},"citing_paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T10:54:13.607657Z"},"links":{"citing_paper":"/paper/2509.03672"},"observation_digest":"sha256:2b0d1f04615d55cb99b1b1860d46f7b8f2431bde9c158c66a07c764bc165ac7a","observation_id":"77f38854-3e60-4eee-9a0c-ac68f7e0abe5","resolution":{"observed_at":"2026-08-05T10:54:14.158270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03672","last_updated":"2025-09-03T19:42:50Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T09:32:45.744670Z","submitted_at":"2025-09-03T19:42:50Z","title":"SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2509.03672."}