{"as_of":"2026-08-13T07:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:927dc2a78e2776669b84bdedf07d642e47ba3b622925ecf52996e99610aa4809","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:06:51.356046Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T01:32:04.660400Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"cited_work":{"arxiv_id":"2412.03822","doi":"10.48550/arxiv.2412.03822","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"arXiv (Cornell University)","work_id":"e9ceab4a-5d44-43c3-b08e-a01ba77caa88","year":2024},"citing_paper":{"arxiv_id":"2606.06674","last_updated":"2026-06-04T19:47:29Z","snapshot_observed_at":"2026-07-06T23:46:28.942186Z","submitted_at":"2026-06-04T19:47:29Z","title":"What Do People Actually Want From AI? Mapping Preference Plurality","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T01:32:04.660400Z"},"links":{"cited_paper":"/paper/2412.03822","citing_paper":"/paper/2606.06674"},"observation_digest":"sha256:272db6aaebaadf82f94ed5e3be318e739595ab88a8b16a40d23f5b02b10a43d1","observation_id":"7bad1392-2f41-4fc1-94b2-27e6f266a4c2","resolution":{"observed_at":"2026-06-28T01:41:29.823462Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03822/citation-record","integrity":"/paper/2412.03822/integrity","json":"/paper/2412.03822/citation-record.json","paper":"/paper/2412.03822"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.044240Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.044240Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:a2d7d675710ad82a0dee8929e4c4bce09229a19bcc5404cb05fe0403ebc27c3c","observation_id":"99e1cee2-2870-4e1b-8b6b-e677a898dcd2","resolution":{"observed_at":"2026-08-11T22:06:51.044240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-11T22:06:51.050083Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.050083Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:bb02a2c4e5d27033d37a81f855b654150a80034acd31ffa0bcf676e7997b6396","observation_id":"cfa3e659-91c5-40bb-8b5b-5b9a6682aea9","resolution":{"observed_at":"2026-08-11T22:06:51.050083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T22:06:51.056099Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.056099Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:8c848470646c176599d39f23f74a44e473949fe8e5a636cb1ade09877f1fe286","observation_id":"db57cba3-db7b-466e-b44f-8a45c1b5ce2f","resolution":{"observed_at":"2026-08-11T22:06:51.056099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T22:06:51.061791Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.061791Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:bd42daab6c16325338d1df449482f9fd45cda8fe56b963b8d422ce349aee07f0","observation_id":"2d6f3939-1a8e-41c5-941e-743146953699","resolution":{"observed_at":"2026-08-11T22:06:51.061791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10313","last_updated":"2024-11-24T18:44:27Z","snapshot_observed_at":"2026-08-13T00:05:35.512552Z","submitted_at":"2024-05-16T17:59:02Z","title":"How Far Are We From AGI: Are LLMs All We Need?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10313","snapshot_observed_at":"2026-08-11T22:06:51.067338Z","title":"How far are we from agi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.067338Z"},"links":{"cited_paper":"/paper/2405.10313","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:8c80fd0790ae6d4b1f03c8eeb684e0539ef1acc0d647425f595bff7138833a25","observation_id":"22760f65-963c-4a7c-98d9-e29b8cac525e","resolution":{"observed_at":"2026-08-11T22:06:51.067338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.073149Z","title":"Learning to summarize with human feedback","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.073149Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:32a20079eb1d57bd3c153888f8fd18c61f25204358a7d8aa10f71838b8f24890","observation_id":"97a45ed3-b108-43d3-b22c-bbd68b0d9935","resolution":{"observed_at":"2026-08-11T22:06:51.073149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.079176Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.079176Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:4fe5fa9ce6e2fde60d271415cf6fdd3430ee52332d3f4eeacab19b5bf8602cee","observation_id":"b2752897-a48e-4fcd-8676-bd76aaf0634e","resolution":{"observed_at":"2026-08-11T22:06:51.079176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-12T23:59:40.308872Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-11T22:06:51.083942Z","title":"Simpo: Simple preference optimization with a reference-free reward","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.083942Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:a59d059dd35fe267c9c525dbdbf9294117fca367b734f300451be29eea80bc10","observation_id":"802c7432-bfa4-4aa4-bf4b-795b6f5085a5","resolution":{"observed_at":"2026-08-11T22:06:51.083942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13595","last_updated":"2023-11-28T18:16:11Z","snapshot_observed_at":"2026-08-13T05:44:32.405737Z","submitted_at":"2023-10-20T15:45:16Z","title":"The History and Risks of Reinforcement Learning and Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13595","snapshot_observed_at":"2026-08-11T22:06:51.089208Z","title":"The History and Risks of Reinforce- ment Learning and Human Feedback, November 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.089208Z"},"links":{"cited_paper":"/paper/2310.13595","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:6d86c6170b4097e9fd1d6f93657bf01ee6e60308981c48d681463d8b35dcf981","observation_id":"21b18e6a-5855-4e9d-8e84-92dcd08b8b93","resolution":{"observed_at":"2026-08-11T22:06:51.089208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.372246Z","title":"The past, present and better future of feedback learning in large language models for subjective human preferences and values","venue":null,"work_id":"ccf48339-a885-4ab2-bcfc-e295c027cd66","year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.094552Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:59207362c254a5cbffddf7829ba7d417c2ca79c1932f6291a13aae6d00170d32","observation_id":"b79f6e8f-9af0-405d-870f-bf3606118fb6","resolution":{"observed_at":"2026-08-11T22:06:52.377687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.099490Z","title":"Artificial Intelligence, Values and Alignment","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.099490Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:f33f2d7f2c77c57dae3aa8aa0eeadd7121ed6ccbc0cd82c015bee9b55e5d3266","observation_id":"388ff225-b08c-4b3a-8bcf-c0d955670635","resolution":{"observed_at":"2026-08-11T22:06:51.099490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.353617Z","title":"Artificial Intelligence, Humanistic Ethics","venue":null,"work_id":"33c5977a-3f1f-4499-93e7-9e1fbdac37a2","year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.105715Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:b80c7547c1104ee5383eb8c7fcbff99f698e5d4bf4f3c511736b8e2953dac279","observation_id":"028d699f-485d-4526-867a-7036adcfa59f","resolution":{"observed_at":"2026-08-11T22:06:52.359427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16984","last_updated":"2024-11-06T20:34:14Z","snapshot_observed_at":"2026-08-12T22:54:46.950572Z","submitted_at":"2024-08-30T03:14:20Z","title":"Beyond Preferences in AI Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16984","snapshot_observed_at":"2026-08-11T22:06:51.116195Z","title":"Beyond preferences in ai alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.116195Z"},"links":{"cited_paper":"/paper/2408.16984","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:fe1cda4e6ea3f8ab3860175308120f960afbc633b6aba7783f79eb6d1898fc31","observation_id":"721b89fe-31a3-4c83-a215-fb417b6944ce","resolution":{"observed_at":"2026-08-11T22:06:51.116195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.336321Z","title":"Meta Community Forum: Re- sults Analysis","venue":null,"work_id":"415ada92-7f7a-402e-8768-d03856e0e58b","year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.121237Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:ccb62fb9c262aa29243f8e04235107230b30d5404b31312b68a3e094c685c9cb","observation_id":"80e5b85b-db90-48d5-af76-5386352a2606","resolution":{"observed_at":"2026-08-11T22:06:52.341743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.125962Z","title":"STELA: a community-centred approach to norm elicitation for AI alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.125962Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:a5df9e57600d42be1abe0e2f2a25165e8fd2abcae3e2dd3993f64c26986979b6","observation_id":"e15e84d2-04ba-4681-b23e-f62263bc02dc","resolution":{"observed_at":"2026-08-11T22:06:51.125962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-11T22:06:51.130971Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.130971Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:adfbe6041b8dbecd2a608f15ec31876477dc15b5e5d329c372a28f875586db04","observation_id":"59936292-d71c-4b0e-b898-45c3c8c5b2e2","resolution":{"observed_at":"2026-08-11T22:06:51.130971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-08-11T23:28:54.309888Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-11T22:06:51.136182Z","title":"Improving alignment of dialogue agents via targeted human judgements","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.136182Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:f19b1a87c99a3218b88f2115aff3ab5c18435a95f286389924bb61ff861e07ba","observation_id":"db993abc-2c68-4cd6-8ce3-5b35f2fc6b72","resolution":{"observed_at":"2026-08-11T22:06:51.136182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.141942Z","title":"Collective constitutional ai: Aligning a language model with public input","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.141942Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:d1d80f427acdaf406647378465c623974986be5df323ef7c935341a3464f37d4","observation_id":"99f768e8-7b04-482e-aa2b-8ad5b81e2964","resolution":{"observed_at":"2026-08-11T22:06:51.141942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.305956Z","title":"Introducing Meta Llama 3: The most capable openly available LLM to date, April","venue":null,"work_id":"d3045b2f-66c5-4b37-8544-1e5b5a839796","year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.147147Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:fdf7f0e59e660ef433110c45b0d2e11d410215b7fda0643704112936132bc732","observation_id":"433669fe-1be5-4bf8-8e0f-5eb8d9ca4342","resolution":{"observed_at":"2026-08-11T22:06:52.311965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08743","last_updated":"2024-06-15T10:13:14Z","snapshot_observed_at":"2026-08-13T04:41:47.733000Z","submitted_at":"2024-01-16T18:59:24Z","title":"MMToM-QA: Multimodal Theory of Mind Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08743","snapshot_observed_at":"2026-08-11T22:06:51.157581Z","title":"Mmtom-qa: Multimodal theory of mind question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.157581Z"},"links":{"cited_paper":"/paper/2401.08743","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:82da499691ea680a2f8fb9f2d284f1ea3d31236ef75d0977e3b86887ef2176e1","observation_id":"14a7b8f0-b84a-4342-aa2d-8adb9e2c6fb8","resolution":{"observed_at":"2026-08-11T22:06:51.157581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.272197Z","title":"ChatGPT’s weekly users have doubled in less than a year","venue":null,"work_id":"468fb1dc-3063-44cb-8c0b-1d5880d08666","year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.162693Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:d5971b16f0611495ec8e6a54ceb8ebc9636e860697f0f126f179313ce8e3c87a","observation_id":"fdf7d294-b607-472a-bee8-ccc13d0ce288","resolution":{"observed_at":"2026-08-11T22:06:52.277815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-11T22:06:51.167430Z","title":"Lamda: Language models for dialog applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.167430Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:dc8d1e8fe8dc3d98f794926b4cacd61616d8be1c9e1bf5560fc1e8d34fffa7ab","observation_id":"3bf9c8eb-cb4a-4d79-9527-d85eb53a5e0e","resolution":{"observed_at":"2026-08-11T22:06:51.167430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11247","last_updated":"2023-06-20T03:00:12Z","snapshot_observed_at":"2026-07-06T15:44:23.779912Z","submitted_at":"2023-06-20T03:00:12Z","title":"DICES Dataset: Diversity in Conversational AI Evaluation for Safety","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11247","snapshot_observed_at":"2026-08-11T22:06:51.172816Z","title":"Taylor, Mark Diaz, Christopher M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.172816Z"},"links":{"cited_paper":"/paper/2306.11247","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:45d41ddd013f1f0ba92a692dda964de22b79c66260971037fe69c6a9a1876523","observation_id":"afd6c360-f8af-41b0-aee8-fa567431ebfd","resolution":{"observed_at":"2026-08-11T22:06:51.172816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.177999Z","title":"Pretraining language models with human preferences","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.177999Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:18e9f6c582a417bb4507d68ea21c266d28de2d4eee82fc56f8c9cd93189711f3","observation_id":"77e596d9-6cbc-4ec4-8aa7-bcae2448e9e5","resolution":{"observed_at":"2026-08-11T22:06:51.177999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.243919Z","title":"alignment","venue":null,"work_id":"cd340776-c237-4ec5-9da4-264d14cc0c14","year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.182842Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:ad91b8b6d3869308c04a56093affbc0d94f7995a2cd694df803ad770ac29bd4f","observation_id":"a78eb4c6-df25-4f00-80ef-efc87adc010b","resolution":{"observed_at":"2026-08-11T22:06:52.249075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.10474","last_updated":"2022-01-26T18:46:26Z","snapshot_observed_at":"2026-08-09T19:44:08.440987Z","submitted_at":"2022-01-25T17:20:04Z","title":"Whose Language Counts as High Quality? Measuring Language Ideologies in Text Data Selection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.10474","snapshot_observed_at":"2026-08-11T22:06:51.187916Z","title":"Dreier, Emily K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.187916Z"},"links":{"cited_paper":"/paper/2201.10474","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:1c435b844e1d6a7e5512acbfe381c2b2b92a3c7b7ee75ebc18c7f1ea13f0dc38","observation_id":"8686eea0-48ae-458c-86a8-cf66d1761691","resolution":{"observed_at":"2026-08-11T22:06:51.187916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16019","last_updated":"2024-12-03T16:18:10Z","snapshot_observed_at":"2026-08-13T00:22:53.103037Z","submitted_at":"2024-04-24T17:51:36Z","title":"The PRISM Alignment Dataset: What Participatory, Representative and Individualised Human Feedback Reveals About the Subjective and Multicultural Alignment of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16019","snapshot_observed_at":"2026-08-11T22:06:51.192853Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.192853Z"},"links":{"cited_paper":"/paper/2404.16019","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:96855f14fb1f513dab87a5ce1f2e7b78601ee5574853f620b19900646fb3c52f","observation_id":"8e117d74-1c97-478c-af8f-2e7605ad7c3f","resolution":{"observed_at":"2026-08-11T22:06:51.192853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14242","last_updated":"2023-08-28T01:05:18Z","snapshot_observed_at":"2026-08-07T00:11:26.398441Z","submitted_at":"2023-08-28T01:05:18Z","title":"The Cultural Psychology of Large Language Models: Is ChatGPT a Holistic or Analytic Thinker?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14242","snapshot_observed_at":"2026-08-11T22:06:51.198392Z","title":"The cultural psychol- ogy of large language models: Is chatgpt a holistic or analytic thinker? arXiv preprint arXiv:2308.14242, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.198392Z"},"links":{"cited_paper":"/paper/2308.14242","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:f6a0820476cc72c0c70f28c378d700c5f8a1964b6e1bf2950c66d488281d9764","observation_id":"a28e7541-daf6-4fef-8bc8-079c0e99f380","resolution":{"observed_at":"2026-08-11T22:06:51.198392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.203705Z","title":"Diverging preferences: When do annotators disagree and do models know? arXiv preprint arXiv:2410.14632, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.203705Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:a6f9472c6ce9114033ed19461140917827bbe9442726bfb7ef71eff6c6289bd4","observation_id":"da0a89d7-7cf0-4605-8415-302fdd4ef571","resolution":{"observed_at":"2026-08-11T22:06:51.203705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11564","last_updated":"2023-10-17T20:22:13Z","snapshot_observed_at":"2026-08-13T05:47:18.618773Z","submitted_at":"2023-10-17T20:22:13Z","title":"Personalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11564","snapshot_observed_at":"2026-08-11T22:06:51.209034Z","title":"Personalized soups: Per- sonalized large language model alignment via post-hoc parameter merging","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.209034Z"},"links":{"cited_paper":"/paper/2310.11564","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:518841a02df43a1cb354afbe32f2ea67d879d264415edb45969e017a93753bf6","observation_id":"381a39c0-e688-4706-86aa-ce211ba081a8","resolution":{"observed_at":"2026-08-11T22:06:51.209034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05133","last_updated":"2024-12-09T04:21:08Z","snapshot_observed_at":"2026-08-13T04:25:30.919897Z","submitted_at":"2024-02-06T04:18:58Z","title":"Personalized Language Modeling from Personalized Human Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05133","snapshot_observed_at":"2026-08-11T22:06:51.214914Z","title":"Lipton, and Liu Leqi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.214914Z"},"links":{"cited_paper":"/paper/2402.05133","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:7e9c85194c84c3af0e658451d6941effea5ec7cb35fb669b979a7cb3a3c1dc25","observation_id":"f071d434-42d9-4bc0-85d9-6610397831de","resolution":{"observed_at":"2026-08-11T22:06:51.214914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10075","last_updated":"2024-08-19T15:18:30Z","snapshot_observed_at":"2026-08-12T23:01:21.775751Z","submitted_at":"2024-08-19T15:18:30Z","title":"Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10075","snapshot_observed_at":"2026-08-11T22:06:51.220449Z","title":"Personal- izing reinforcement learning from human feedback with variational preference learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.220449Z"},"links":{"cited_paper":"/paper/2408.10075","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:55b7b04f956b11b48682041c923b55bfe866ae54a523a202d86935127e3c08fa","observation_id":"1fed5acb-3a7c-47bd-853b-55d90103f283","resolution":{"observed_at":"2026-08-11T22:06:51.220449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.227025Z","title":"Rewarded soups: towards pareto-optimal alignment by interpolating weights fine-tuned on diverse rewards.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"c3bc72a6-5e79-4543-99fb-d852a93a100f","year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.225923Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:68ca070032720d728aa6e789544d1635439452e28528726516a0736f36a66c31","observation_id":"3b78df44-c63b-4647-8235-1d4c0525780a","resolution":{"observed_at":"2026-08-11T22:06:52.232281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.230994Z","title":"Fine-tuning language models to find agreement among humans with diverse preferences","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.230994Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:cf39d61d8631ad854ac37c176015b85c4f96166781be9888f2b3031a222b4be2","observation_id":"ecf77a7b-1b82-40c2-9009-138632ef1698","resolution":{"observed_at":"2026-08-11T22:06:51.230994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08925","last_updated":"2024-12-26T00:15:20Z","snapshot_observed_at":"2026-08-13T04:19:22.554159Z","submitted_at":"2024-02-14T03:56:27Z","title":"MaxMin-RLHF: Alignment with Diverse Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08925","snapshot_observed_at":"2026-08-11T22:06:51.235932Z","title":"Maxmin-rlhf: Towards equitable alignment of large language models with diverse human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.235932Z"},"links":{"cited_paper":"/paper/2402.08925","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:6aa5d56ae5da9faf4f907298c4f12a2757578cb25e56e56ea886ab1f65102e00","observation_id":"2d01beb3-7a78-4607-acee-3dd57276c533","resolution":{"observed_at":"2026-08-11T22:06:51.235932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10271","last_updated":"2024-06-04T14:34:38Z","snapshot_observed_at":"2026-08-13T00:29:25.167949Z","submitted_at":"2024-04-16T03:59:33Z","title":"Social Choice Should Guide AI Alignment in Dealing with Diverse Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10271","snapshot_observed_at":"2026-08-11T22:06:51.241253Z","title":"Holliday, Bob M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.241253Z"},"links":{"cited_paper":"/paper/2404.10271","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:b481df83751b1ac52afe3b167f6ea4261fd25551639b0b3ae5537e90307277a5","observation_id":"340b4c90-159c-45f6-87e5-8086a3184a9c","resolution":{"observed_at":"2026-08-11T22:06:51.241253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08358","last_updated":"2024-04-17T01:58:09Z","snapshot_observed_at":"2026-08-13T05:03:03.153876Z","submitted_at":"2023-12-13T18:51:34Z","title":"Distributional Preference Learning: Understanding and Accounting for Hidden Context in RLHF","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08358","snapshot_observed_at":"2026-08-11T22:06:51.247150Z","title":"Distributional Preference Learning: Understanding and Accounting for Hidden Context in RLHF, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.247150Z"},"links":{"cited_paper":"/paper/2312.08358","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:c64e6b8d1ff3d4dcd6dae125a7a37a7a6e25a6eaded21feb77c7cc4204936987","observation_id":"23783648-074d-49db-887b-bd1fdb950640","resolution":{"observed_at":"2026-08-11T22:06:51.247150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09764","last_updated":"2024-05-30T15:39:17Z","snapshot_observed_at":"2026-08-13T04:18:33.437181Z","submitted_at":"2024-02-15T07:29:43Z","title":"Aligning Crowd Feedback via Distributional Preference Reward Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09764","snapshot_observed_at":"2026-08-11T22:06:51.252782Z","title":"Aligning Crowd Feedback via Distributional Preference Reward Modeling, February 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.252782Z"},"links":{"cited_paper":"/paper/2402.09764","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:2f532a370f5ae45df6877dc31398a69d8de27e5be6a329c5b890fdc941c72935","observation_id":"08fcd4e1-cc17-4c7d-a100-2797d16e8a90","resolution":{"observed_at":"2026-08-11T22:06:51.252782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00847","last_updated":"2025-02-12T03:34:29Z","snapshot_observed_at":"2026-08-12T22:33:14.632545Z","submitted_at":"2024-10-01T16:29:59Z","title":"Uncertainty-aware Reward Model: Teaching Reward Models to Know What is Unknown","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00847","snapshot_observed_at":"2026-08-11T22:06:51.258372Z","title":"Uncertainty- aware reward model: Teaching reward models to know what is unknown","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.258372Z"},"links":{"cited_paper":"/paper/2410.00847","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:92fa808266f46f27a2f5027641a9bc90a00353d8460ccc190bdd19bc6dbde21c","observation_id":"76c581c7-7fd2-4bd6-9bfb-61de741da16d","resolution":{"observed_at":"2026-08-11T22:06:51.258372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-07T17:14:39.278754Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-11T22:06:51.264538Z","title":"Webgpt: Browser-assisted question-answering with human feedback","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.264538Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:b89acc2a61304560625f36cc556289d8ccaba3cd772a5c9aa20539bc944ca691","observation_id":"dc4ed378-108a-4b3d-b1da-7c481dec6011","resolution":{"observed_at":"2026-08-11T22:06:51.264538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.198109Z","title":"synthetic-instruct-gptj-pairwise (revision cc92d8d),","venue":null,"work_id":"8d166e29-e70f-407c-85cb-bbcf4dc77b02","year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.271386Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:0d3282a7acbef5489978f58f2718008077434a848d29a406a78780724e5ec2fc","observation_id":"27d43019-d72c-437d-bd35-d10a9dc4b073","resolution":{"observed_at":"2026-08-11T22:06:52.203555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.285345Z","title":"Ultrafeedback: Boosting language models with high-quality feedback, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.285345Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:e2adede38384c9dc1fa7194b0346d2dfd807c92b2d7a6e76f3f8a5f652716be5","observation_id":"2ade0842-68ab-4012-b155-8a9a76cbb5d4","resolution":{"observed_at":"2026-08-11T22:06:51.285345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T22:06:51.291078Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.291078Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:bea55be52c09df9b2d5224d380f198c57c0831facf459be2074203f32910107a","observation_id":"06542e24-3659-4559-ab7f-0bd9add0c4b6","resolution":{"observed_at":"2026-08-11T22:06:51.291078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.149979Z","title":"Transformers: State- of-the-art natural language processing","venue":null,"work_id":"cf626ad8-e664-47d0-84a6-e008a7ef111d","year":2020},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.296646Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:03bd6d3a4997267f97d970419ab46fd18e3427a73ef8b9c626262c3416aa04f1","observation_id":"ac75e5fa-82e2-4ce3-ae80-ffa97cef70bc","resolution":{"observed_at":"2026-08-11T22:06:52.156056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-11T22:06:51.303089Z","title":"Holistic evaluation of language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.303089Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:6c6dfd10be285891a992b0df4532f0fd91752317765ad28323b5f2c2775a8ba8","observation_id":"396228b2-8607-415e-a327-5bec2dd767af","resolution":{"observed_at":"2026-08-11T22:06:51.303089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.132645Z","title":"Argyle, Ethan C","venue":null,"work_id":"281850c5-dc9b-4426-a705-cf8c3a4258cc","year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.308510Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:c9039b178a94d7a642f062c252273496fa4869dad198ac935abd7ae6922bba80","observation_id":"d7bab6bc-55b5-4a19-87c5-021f937b027b","resolution":{"observed_at":"2026-08-11T22:06:52.137895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.113640Z","title":"Are large language models good annotators? In Proceedings on, pages 38–48","venue":null,"work_id":"9642d2d8-87b1-4eff-ad0a-1d583662bf98","year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.322035Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:562f3df3462e161409e697919b1644950a53a2a83c6c49e5b0e8045556e05858","observation_id":"06bdd5c2-9118-4f2d-9ee2-a7dbd851d771","resolution":{"observed_at":"2026-08-11T22:06:52.120199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.327536Z","title":"Automated social science: Language models as scientist and subjects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.327536Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:af56ebaacd60733146416b1f9f81cc30c77ff15078eae5486a106afc041b16ba","observation_id":"ff1e3223-68a9-40a2-bd97-2f351a502601","resolution":{"observed_at":"2026-08-11T22:06:51.327536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01908","last_updated":"2025-02-03T16:28:59Z","snapshot_observed_at":"2026-08-13T04:28:02.623162Z","submitted_at":"2024-02-02T21:21:06Z","title":"Large language models that replace human participants can harmfully misportray and flatten identity groups","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01908","snapshot_observed_at":"2026-08-11T22:06:51.333381Z","title":"Large language models can- not replace human participants because they cannot portray identity groups","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.333381Z"},"links":{"cited_paper":"/paper/2402.01908","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:21833760b3d536a18367a61fb81518ead7923348f779a157adfaeca657ce0910","observation_id":"7bf040e1-683c-4a15-8c3e-9923cb3bf3b1","resolution":{"observed_at":"2026-08-11T22:06:51.333381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06899","last_updated":"2022-09-14T19:53:32Z","snapshot_observed_at":"2026-08-09T01:54:09.989232Z","submitted_at":"2022-09-14T19:53:32Z","title":"Out of One, Many: Using Language Models to Simulate Human Samples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.06899","snapshot_observed_at":"2026-08-11T22:06:51.315201Z","title":"arXiv:2209.06899 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.315201Z"},"links":{"cited_paper":"/paper/2209.06899","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:40c195f5f8796386dfeb0d638e4f5fc2a72367e929ab3e767441f149468dd3be","observation_id":"a1068a39-73d5-4815-8761-172725cef2d9","resolution":{"observed_at":"2026-08-11T22:06:51.315201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.070757Z","title":"Stevie Bergman, Jennifer Chien, Mark Díaz, Seliem El-Sayed, Jaylen Pittman, Shakir Mohamed, and Kevin R","venue":null,"work_id":"06c7e9d5-3153-4aeb-bfaa-c8460962b33e","year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.344513Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:e65faf0e8faa3391e78ea140052d57bc8da84b444bee6af1514ef07da2f2fbbc","observation_id":"6da6ab26-ac28-4126-945e-024afc033184","resolution":{"observed_at":"2026-08-11T22:06:52.077496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05070","last_updated":"2024-08-20T19:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-07T18:21:17Z","title":"A Roadmap to Pluralistic Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05070","snapshot_observed_at":"2026-08-11T22:06:51.356046Z","title":"A Roadmap to Pluralistic Alignment, February 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.356046Z"},"links":{"cited_paper":"/paper/2402.05070","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:a86f768432b732b03fc3d6b6201005d9cf0cdbe9468e3fe8fab7ce8438b0d54d","observation_id":"39f114fe-2bd6-4ba9-9612-161e00d9ce6a","resolution":{"observed_at":"2026-08-11T22:06:51.356046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.339375Z","title":"Whose opinions do language models reflect? In International Conference on Machine Learning, pages 29971–30004","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.339375Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:6cab823bb0e993e2dd3785c11751ce8bea07c53ef08c536196ee59e41f1f1cc0","observation_id":"c3760899-b7e0-433e-b121-187ef371e613","resolution":{"observed_at":"2026-08-11T22:06:51.339375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08572","last_updated":"2024-02-05T12:36:01Z","snapshot_observed_at":"2026-08-13T04:41:47.901970Z","submitted_at":"2024-01-16T18:58:02Z","title":"The illusion of artificial inclusion","version":3},"cited_work":{"arxiv_id":"2401.08572","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.08572","snapshot_observed_at":"2026-08-11T22:06:51.455062Z","title":"The illusion of artificial inclusion","venue":"cs.CY","work_id":"7c42185f-928c-4ea9-8d94-e1f4e0746c04","year":2024},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.350182Z"},"links":{"cited_paper":"/paper/2401.08572","citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:dad489a6d3a22e1be4bf9179b297d2798819454855effda13d883a03fafa7e0c","observation_id":"91f673de-6b3d-4e78-b56a-ffc829469bca","resolution":{"observed_at":"2026-08-11T22:06:51.462091Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:51.110809Z","title":"doi: 10.1162/daed_a_01912","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.110809Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:70b56c5c510c20d95ffc4bf44da70b667b39e24e595f7cd7aa5cf793f7513fa1","observation_id":"8d6231ee-7d13-4e0b-b006-28e9bb0d1b04","resolution":{"observed_at":"2026-08-11T22:06:51.110809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.180355Z","title":null,"venue":null,"work_id":"acb7b78c-c235-40d2-ba87-f7489924b086","year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.277039Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:62d6bf708068504254d1ace7d9c152b34d47c8e81fdef6a7f01cb618cc97a016","observation_id":"6de0a1df-d639-40e3-bb12-c5a52b5baf6e","resolution":{"observed_at":"2026-08-11T22:06:52.185515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:06:52.289126Z","title":null,"venue":null,"work_id":"4ac2a520-1aec-4fb9-8207-89fffcceb500","year":null},"citing_paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T22:06:51.152203Z"},"links":{"citing_paper":"/paper/2412.03822"},"observation_digest":"sha256:c47c7e25271ea64242e249c976210f180095786148d6818751424f0206468fc1","observation_id":"14ef19e5-51d4-4da7-abc4-c3fa5effd67b","resolution":{"observed_at":"2026-08-11T22:06:52.294454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.03822","last_updated":"2024-12-05T02:35:46Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T06:33:00.926239Z","submitted_at":"2024-12-05T02:35:46Z","title":"Beyond the Binary: Capturing Diverse Preferences With Reward Regularization"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 1 inbound Pith citation observation for arXiv:2412.03822."}