{"as_of":"2026-08-23T21:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17be42f9f3dbc21e2bb3ec7142038359eabe5d31686e87cd735c56d234f1cfb9","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:08:56.977697Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T08:52:34.039089Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"cited_work":{"arxiv_id":"2505.10892","doi":"10.48550/arxiv.2505.10892","metadata_source":"pith","pith_arxiv_id":"2505.10892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.LG","work_id":"5c97b487-2eb5-439c-b4de-cffbe4dc1f1d","year":2025},"citing_paper":{"arxiv_id":"2604.20685","last_updated":"2026-04-22T15:33:45Z","snapshot_observed_at":"2026-08-15T09:20:37.303455Z","submitted_at":"2026-04-22T15:33:45Z","title":"MGDA-Decoupled: Geometry-Aware Multi-Objective Optimisation for DPO-based LLM Alignment","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-10T01:38:49.892824Z"},"links":{"cited_paper":"/paper/2505.10892","citing_paper":"/paper/2604.20685"},"observation_digest":"sha256:f225bc790592917704c26090b5ee5b409d4c33056f5eec1455410cf8ecf38403","observation_id":"2d5844c4-8adb-4f7a-8a6c-5936bd1060f1","resolution":{"observed_at":"2026-06-08T02:03:42.868631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"cited_work":{"arxiv_id":"2505.10892","doi":"10.48550/arxiv.2505.10892","metadata_source":"pith","pith_arxiv_id":"2505.10892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.LG","work_id":"5c97b487-2eb5-439c-b4de-cffbe4dc1f1d","year":2025},"citing_paper":{"arxiv_id":"2607.01392","last_updated":"2026-07-03T09:34:52Z","snapshot_observed_at":"2026-08-02T06:05:05.007648Z","submitted_at":"2026-07-01T18:50:14Z","title":"Multi-Objective Exploration and Preference Optimization via Mutual Information","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-07-03T21:17:46.551850Z"},"links":{"cited_paper":"/paper/2505.10892","citing_paper":"/paper/2607.01392"},"observation_digest":"sha256:8f3564c308db0261f50ef08b61a5fc94efb16f5263424f7aeffa813aac875c94","observation_id":"eccd3dea-1ffc-4b32-947f-b1be0bdb3176","resolution":{"observed_at":"2026-07-03T21:18:57.948481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10892","snapshot_observed_at":"2026-07-12T08:52:34.039089Z","title":"arXiv preprint arXiv:2505.10892 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.01392","last_updated":"2026-07-03T09:34:52Z","snapshot_observed_at":"2026-08-02T06:05:05.007648Z","submitted_at":"2026-07-01T18:50:14Z","title":"Multi-Objective Exploration and Preference Optimization via Mutual Information","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T08:52:34.039089Z"},"links":{"cited_paper":"/paper/2505.10892","citing_paper":"/paper/2607.01392"},"observation_digest":"sha256:4f7fd16648102a6264be7c640bd6894e92236ff65f981261cedc4de4ff7a3f45","observation_id":"ff0edeb1-b97d-4968-97f2-3708657bd0e7","resolution":{"observed_at":"2026-07-12T08:52:34.039089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.10892/citation-record","integrity":"/paper/2505.10892/integrity","json":"/paper/2505.10892/citation-record.json","paper":"/paper/2505.10892"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T21:08:56.695415Z","title":"Achiam, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.695415Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:9f5fb17cdcc7904ec9a32f386b768fa34816ec0779d0075c7a2ec92271ddc71b","observation_id":"105f9312-5888-4084-a3d8-a1e01985d193","resolution":{"observed_at":"2026-08-15T21:08:56.695415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.845771Z","title":"Agnihotri, R","venue":null,"work_id":"75b46fbd-029b-4f0b-a056-ff0d150833d9","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.700924Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:af7ba1dbc8b6288a82894f1ad26d63f988a79b439b1c0fdbf7a4a7cace9cd1c9","observation_id":"83c854ab-e810-460a-9b1b-59be6dc88438","resolution":{"observed_at":"2026-08-15T21:08:57.849923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.831115Z","title":"Agnihotri, R","venue":null,"work_id":"7477cd27-aae8-4f25-80aa-db9a86fbd444","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.705282Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:e1b453f88978596410e054f9012ec3adc3164289c55a3f36c00984791dec4180","observation_id":"e8de9cd9-9b15-4cce-8d72-2b7cc90129f4","resolution":{"observed_at":"2026-08-15T21:08:57.836979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.817645Z","title":null,"venue":null,"work_id":"687701ba-d61d-47ba-b4e9-18a40122046c","year":1966},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.708943Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:84b58fde053a731728fa1a9c3d5a48953ded36d8dd42266d60ef8b608376b5d9","observation_id":"78ffbc57-53dc-4415-a587-4c2f3dd468d9","resolution":{"observed_at":"2026-08-15T21:08:57.822286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-15T21:08:56.713803Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.713803Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:f2be1dee1127991fcce747f6efd15091aa235221e3ceb265f51e3eb9be61b6ba","observation_id":"3926a990-920f-41bc-91c1-fcda019f91bd","resolution":{"observed_at":"2026-08-15T21:08:56.713803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.717922Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.717922Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:f0375b419ff537dffbc69464f2641605e8ebb9f55f9016b7ccd295c6602c0039","observation_id":"7e23d1bb-d8a5-431c-881c-0952b41b01e1","resolution":{"observed_at":"2026-08-15T21:08:56.717922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-08-19T08:48:56.371619Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-15T21:08:56.721917Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.721917Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:0b3a5f412cd5874d3bdef4cc250013c4ea8c30cb890ccaeeca209c0985215ee9","observation_id":"2b2e651f-988d-4485-b9d1-b048739ab88b","resolution":{"observed_at":"2026-08-15T21:08:56.721917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.726366Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.726366Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:feff1177219798085b7944764f795397274431cdff2f936bff5e382343c43798","observation_id":"06055c03-1ca4-4c4b-acf6-91ef81907a33","resolution":{"observed_at":"2026-08-15T21:08:56.726366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.779339Z","title":null,"venue":null,"work_id":"38af2559-e4cf-43c5-b03f-b58712fe9375","year":1964},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.730063Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:64243f28c6820b3dd2d42e4cbaba4945c355a76a28b7a4deed4061249363fdcf","observation_id":"9c5ce716-0b9e-4e6d-a9ba-75bc9456c04e","resolution":{"observed_at":"2026-08-15T21:08:57.784676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.760237Z","title":null,"venue":null,"work_id":"1ba886ec-b3c8-4568-8a9a-4d65bcd69677","year":1967},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.733853Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:1087f835270be8d851c21861c59b167a144225c8dbb38666ec39c3e3c0051b77","observation_id":"fb1562da-c785-4105-9329-f3f2b0623316","resolution":{"observed_at":"2026-08-15T21:08:57.766504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.744244Z","title":null,"venue":null,"work_id":"bd91161f-c7a9-4c31-88dd-623f3437d068","year":2010},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.738966Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:51e7f076b87c2c143156f409d810b3e89f7204838fb5341894feaf68a6d00a9c","observation_id":"0b2bd1b1-6df3-413d-a873-b1808da60bbd","resolution":{"observed_at":"2026-08-15T21:08:57.749022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.730567Z","title":"Efron and R","venue":null,"work_id":"6b340dbf-aaa3-46c1-915f-39cb4b858e02","year":1994},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.743148Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:b05ba8ebc8d6f4859de4be9aa43386315a1f7b4064217ec33e7bd64145af7144","observation_id":"58d45108-64b3-4cce-8227-6193b3d3e271","resolution":{"observed_at":"2026-08-15T21:08:57.736085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.718146Z","title":"Gheshlaghi Azar, Z","venue":null,"work_id":"597b48f6-d67e-43f8-8cd8-24bf53e23fa2","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.746931Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:307bdad610f014e44832163f223ff173c3b610b3ee25a113cf7e679784056664","observation_id":"28faa723-bfc5-4951-84b7-726389ab41d3","resolution":{"observed_at":"2026-08-15T21:08:57.722260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T21:08:56.751323Z","title":"Grattafiori, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.751323Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:acbb1c9a9e3e4565acc8c2d814200998075b29852e580f23c8c9f66c1ae41e2c","observation_id":"766d6ed0-76c0-4859-aade-e7ab2841a7e4","resolution":{"observed_at":"2026-08-15T21:08:56.751323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.755215Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.755215Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:6c47c71889877cb177f0cd9343dbe818fc95d2db0b0f0bba1719bf97f1a727e2","observation_id":"bdbb9e00-543d-4ec9-ac7b-2017fbd23f8e","resolution":{"observed_at":"2026-08-15T21:08:56.755215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19085","last_updated":"2024-10-11T08:21:50Z","snapshot_observed_at":"2026-08-21T21:35:03.128247Z","submitted_at":"2024-02-29T12:12:30Z","title":"Controllable Preference Optimization: Toward Controllable Multi-Objective Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19085","snapshot_observed_at":"2026-08-15T21:08:56.759061Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.759061Z"},"links":{"cited_paper":"/paper/2402.19085","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:b7eb735764848ccad1829eb078b25ac1845ae9849227feee1cefebfa541da3c6","observation_id":"2a0676ce-b45c-4989-bd44-a8b01b82fddc","resolution":{"observed_at":"2026-08-15T21:08:56.759061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.696291Z","title":null,"venue":null,"work_id":"0b7f1ec9-e235-444d-8fad-805995e0e37d","year":2022},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.763800Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:bf4df5836fc61c37589b40f827ec63b58930079fb5fd5131d1a744e5c9c17922","observation_id":"fc99bbc1-4db5-44f1-8a80-f7d11356335a","resolution":{"observed_at":"2026-08-15T21:08:57.701031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.682047Z","title":null,"venue":null,"work_id":"66730506-0898-4ee0-92fb-7e0b100b3e75","year":2022},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.767733Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:29fa561e679e97da09a7091bc9aefda21071f1f54673cfb4fba3719eea68d0b9","observation_id":"8cd5aaee-f7ae-4d6e-943e-4f70dbc71bb2","resolution":{"observed_at":"2026-08-15T21:08:57.686860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12050","last_updated":"2023-12-10T03:27:10Z","snapshot_observed_at":"2026-08-16T15:06:25.208027Z","submitted_at":"2023-08-23T10:41:07Z","title":"Aligning Language Models with Offline Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12050","snapshot_observed_at":"2026-08-15T21:08:56.773942Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.773942Z"},"links":{"cited_paper":"/paper/2308.12050","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:931a175241b120179ed5aef2b71874a6310e7509bcd762099187c88d217b291b","observation_id":"f27c4b67-d78f-46d7-aca5-8187db0c70a6","resolution":{"observed_at":"2026-08-15T21:08:56.773942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.668481Z","title":"Huang, A","venue":null,"work_id":"11654469-f3d3-47bb-9cd1-1964e3bbf981","year":2022},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.779255Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:9ecc6684dec10de51ec73629e84c5f4c748bfa4451c83d8d07c578f2e9d75e73","observation_id":"580db4c9-4cb3-4d74-831b-9c2edd48f800","resolution":{"observed_at":"2026-08-15T21:08:57.673694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11564","last_updated":"2023-10-17T20:22:13Z","snapshot_observed_at":"2026-08-19T17:50:35.007786Z","submitted_at":"2023-10-17T20:22:13Z","title":"Personalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11564","snapshot_observed_at":"2026-08-15T21:08:56.784337Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.784337Z"},"links":{"cited_paper":"/paper/2310.11564","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:7296e6b4825236aac637bbd9a840460445b3cd06afcc51d8d3aeadc6496d44e3","observation_id":"ac85fcf5-3744-4e26-89a1-59bb0f23865e","resolution":{"observed_at":"2026-08-15T21:08:56.784337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.654373Z","title":null,"venue":null,"work_id":"e501f749-c0a3-4e10-9c6a-33cef4e169ca","year":1993},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.788896Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:6daaf96a610a1820df3b4c4b16edb3af68140fc9e1ad6a37802c35e6476fdc7c","observation_id":"cad7586f-a052-4093-af39-af5e3c51c5ac","resolution":{"observed_at":"2026-08-15T21:08:57.659469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T21:08:56.793145Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.793145Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:1c0581eebf9f238bdebc182dff9abf93c734bf81bf1acedb5a56d466320c3d42","observation_id":"00a2dd24-dc43-498f-84ca-0a124e823fa5","resolution":{"observed_at":"2026-08-15T21:08:56.793145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.797792Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.797792Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:05f4cf34d5a77e575e5cdd61c1b2f61b3af0b2e580059ac1e8483a54b42c2e10","observation_id":"5f76ffc1-0cc8-4b63-bcff-535e3fd580ac","resolution":{"observed_at":"2026-08-15T21:08:56.797792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.641565Z","title":null,"venue":null,"work_id":"d2f66361-f0b4-4128-8c03-009e2efbedab","year":2020},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.801762Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:5c6cef1ef4f6b85afa66cbf423fe79fb6608265496a15c1f335fefb9f95cb369","observation_id":"f839d209-68a9-4d12-bd70-3086b445ef82","resolution":{"observed_at":"2026-08-15T21:08:57.646083Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.806276Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.806276Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:7de586e35a84c0c2062e7c92afc0ead85976083b2b773e052ac0155db8c6481d","observation_id":"8dae53ae-623d-4beb-8510-8949d7117130","resolution":{"observed_at":"2026-08-15T21:08:56.806276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-15T21:08:56.811426Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.811426Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:3f9f6beb1bda1a09b4f8f02a292cb4a2a1da20e86be0f34443308a7817520250","observation_id":"73a526ea-6440-4f5c-9389-5392865a2fa3","resolution":{"observed_at":"2026-08-15T21:08:56.811426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02236","last_updated":"2025-05-07T21:54:34Z","snapshot_observed_at":"2026-08-16T13:13:04.844335Z","submitted_at":"2024-10-03T06:13:56Z","title":"C-MORL: Multi-Objective Reinforcement Learning through Efficient Discovery of Pareto Front","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02236","snapshot_observed_at":"2026-08-15T21:08:56.817094Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.817094Z"},"links":{"cited_paper":"/paper/2410.02236","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:1d50bc1f556f3c193fc0063347459cfa8a6cf2be196fb09c5825d0a11c477061","observation_id":"9219ab43-7c5e-4305-969b-4431df926d3b","resolution":{"observed_at":"2026-08-15T21:08:56.817094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11531","last_updated":"2024-04-17T16:24:07Z","snapshot_observed_at":"2026-08-17T01:35:32.780237Z","submitted_at":"2024-04-17T16:24:07Z","title":"Pack of LLMs: Model Fusion at Test-Time via Perplexity Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11531","snapshot_observed_at":"2026-08-15T21:08:56.821866Z","title":"Mavromatis, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.821866Z"},"links":{"cited_paper":"/paper/2404.11531","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:646ed0a6ba7402dfb13800fbcd15794bb3db14e7f3e6fc13768f1a25877906f7","observation_id":"8f537bb4-cba6-4aae-aa08-89f635c58bf8","resolution":{"observed_at":"2026-08-15T21:08:56.821866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.826965Z","title":"Miettinen","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.826965Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:86cb6f604a2992b5565b9a1e759a33bc777fcbc8a2df3893b0ebeb45dbf700d9","observation_id":"5b424fa6-521f-40bd-8ebd-71fd51511d39","resolution":{"observed_at":"2026-08-15T21:08:56.826965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-15T21:08:56.831351Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.831351Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:fe64be928828571182e6a8b72a59086384157f8ef74c2276572254d1a7d8e7e2","observation_id":"b3dd2f31-c10e-454a-80d8-943543c47e6b","resolution":{"observed_at":"2026-08-15T21:08:56.831351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05469","last_updated":"2024-12-06T23:51:47Z","snapshot_observed_at":"2026-08-20T00:41:34.203546Z","submitted_at":"2024-12-06T23:51:47Z","title":"Multi-Objective Alignment of Large Language Models Through Hypervolume Maximization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05469","snapshot_observed_at":"2026-08-15T21:08:56.835885Z","title":"Mukherjee, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.835885Z"},"links":{"cited_paper":"/paper/2412.05469","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:e092a332fc0bba86638a578621f4d8fdbc00c2ef84ae91bd6eb0a8e8c01aa306","observation_id":"f5bbc9b6-96cf-43ae-bbab-10479171ff50","resolution":{"observed_at":"2026-08-15T21:08:56.835885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00886","last_updated":"2024-06-11T16:25:52Z","snapshot_observed_at":"2026-08-20T23:26:50.938895Z","submitted_at":"2023-12-01T19:26:23Z","title":"Nash Learning from Human Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00886","snapshot_observed_at":"2026-08-15T21:08:56.842003Z","title":"Munos, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.842003Z"},"links":{"cited_paper":"/paper/2312.00886","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:36473182b38275f231462fe06d9efb7a67aa3211c25c707401131ea82c3770d6","observation_id":"4a02459c-9a13-4c0b-bd04-d4fe2ce87cc6","resolution":{"observed_at":"2026-08-15T21:08:56.842003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.618239Z","title":"Nesterov.Lectures on Convex Optimization","venue":null,"work_id":"f43031ed-9930-4bca-a819-66eacac8c8f4","year":2018},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.846442Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:5b8e8da28efb1b98faebf59d6a72e398709df6a6f340379bf55c9058f3b2b966","observation_id":"fac20a13-0c40-406d-a9b7-4a1e03449bed","resolution":{"observed_at":"2026-08-15T21:08:57.623299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.850761Z","title":"Ouyang, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.850761Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:339d6a7fc39031ede29539a076dfffca0b3c9af6c5432b912988e3f2d714b97f","observation_id":"c2e6e737-dd3e-4f36-8a1f-4b68a7768097","resolution":{"observed_at":"2026-08-15T21:08:56.850761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.595202Z","title":null,"venue":null,"work_id":"1d23a2c6-a3aa-47f8-a1c4-65ce66b073b9","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.856185Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:6ca1797cd4e908b2e0981b23b908f4b6f5cc480b7aad24041d147bb8eaa8aea4","observation_id":"105e4be2-4440-4070-a3b7-8e5af5cf5807","resolution":{"observed_at":"2026-08-15T21:08:57.600262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-08-16T13:26:40.822276Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-15T21:08:56.861883Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.861883Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:824a682cebfbc96a56c18f3b73128e0301ec2c2d13052930399f72bf4ad44b32","observation_id":"f6a8772d-65a1-4d8c-b3b7-20b6c374bccb","resolution":{"observed_at":"2026-08-15T21:08:56.861883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.581171Z","title":"Rafailov, A","venue":null,"work_id":"da34be4c-6f5c-4ae9-b245-65642b23d385","year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.867351Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:a69fbe0b58aecf876314230c2066fb135f188bfa1f3a5410eeb42e470fc66f62","observation_id":"3967cbdb-e400-4cc1-ba9c-428c0dc91d7f","resolution":{"observed_at":"2026-08-15T21:08:57.585329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.567776Z","title":null,"venue":null,"work_id":"8b4f2102-8307-47ac-9380-24419ebe7eaa","year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.871803Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:7184d7d1257f27bf50a247ab311f1d98f1542f897eb8d49690a616351a11c5e4","observation_id":"2291ff78-929f-4d2e-8784-b2e19075bac4","resolution":{"observed_at":"2026-08-15T21:08:57.572840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.554038Z","title":null,"venue":null,"work_id":"037f2f9e-32e6-4ac5-adf5-1aa0b74379f0","year":2013},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.876996Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:950312a4b14ac950aed7add631b90f4bb928cbdfdfc225133afee16b6f192d0e","observation_id":"6be56b49-96bb-4a5f-8214-c123907126df","resolution":{"observed_at":"2026-08-15T21:08:57.558779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T21:08:56.881623Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.881623Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:cd3cadb32ae178f477b7f0a33bc1265fa0a51b62272539d1b047fe288be1d73d","observation_id":"e5cda545-9fa3-4340-b923-cc82302bcf30","resolution":{"observed_at":"2026-08-15T21:08:56.881623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.541954Z","title":null,"venue":null,"work_id":"9353926f-82a0-49f6-8295-01df95584d80","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.886824Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:64cf55c5b40c7b3ffc6764e1fc42e75829122eda3217f4b2ac9a93b7720aa5f7","observation_id":"afd30265-c73c-4dce-989c-88dd644cec04","resolution":{"observed_at":"2026-08-15T21:08:57.546219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.893071Z","title":"Stiennon, L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.893071Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:aa3859bf1512137acfb541b748ff85cfa0ebdc1e41e80dbf4c01a5c8b774fd8b","observation_id":"51222244-0ed7-4f36-8d8c-ce489914eb3b","resolution":{"observed_at":"2026-08-15T21:08:56.893071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-15T21:08:56.896996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.896996Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:a1a7bc3c0bcc85305a56b44cd69cf71c472bc229409a1c4cd5cd9a8039b16f22","observation_id":"c2a6a508-17ed-428c-8f7d-aed6243c3c26","resolution":{"observed_at":"2026-08-15T21:08:56.896996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.520486Z","title":"Van Moffaert and A","venue":null,"work_id":"c081d552-1580-4077-86f0-3c9f5196dbd9","year":2014},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.901994Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:d6c4fac6a5a0c0884edf51a0d22dc6284174bd7b482d73bddfe634381d09a045","observation_id":"94072b2a-6de9-48cb-b716-30cbd0683cb7","resolution":{"observed_at":"2026-08-15T21:08:57.524477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.507396Z","title":"von Werra, Y","venue":null,"work_id":"4be876f8-93af-4070-a279-bfcc51f5713c","year":2020},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.906906Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:247ae783f3226830ce60513e3102ed1563e60aafcd539cc46a5ffcb53933a3b5","observation_id":"6b764e25-b99b-4bd2-8694-1900509d9bc4","resolution":{"observed_at":"2026-08-15T21:08:57.511798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.495436Z","title":"von Werra, Y","venue":null,"work_id":"99f62e1e-87ff-4ff2-ac7c-eb1cf944725c","year":2020},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.910695Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:ef58525667f00e4be59e2e08b0fd6878de6d0b2e43cc4108550d6c886d52123b","observation_id":"042a9d0a-0f3c-4566-a3e3-91228f7fd0a9","resolution":{"observed_at":"2026-08-15T21:08:57.499491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.484357Z","title":null,"venue":null,"work_id":"76847a90-d871-4a86-879a-82fd0f3103f5","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.914460Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:c0bc554a05f422ca78cf139c728db828b32cb8d6734c4377101e6f176c2c2f1c","observation_id":"31b027a1-7302-4f0f-9d53-6502de4fb9bd","resolution":{"observed_at":"2026-08-15T21:08:57.488356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.471836Z","title":null,"venue":null,"work_id":"20bc8616-5187-4a3c-8296-3137d8987b81","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.919179Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:2e28404907b5a6819ec807e879394e05b6f1c6eda54b2bf2316f81bf18332efa","observation_id":"3aee28d5-a3a3-47f9-bc4f-ad5443d8e10b","resolution":{"observed_at":"2026-08-15T21:08:57.475939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18571","last_updated":"2024-03-06T08:07:02Z","snapshot_observed_at":"2026-08-23T17:44:31.147366Z","submitted_at":"2024-02-28T18:58:25Z","title":"Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18571","snapshot_observed_at":"2026-08-15T21:08:56.923655Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.923655Z"},"links":{"cited_paper":"/paper/2402.18571","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:0a1d825cf37f8fb9dfad28c7ce41ac37a10fe88168a3ca0faa8efc39671d5052","observation_id":"63933835-d9dd-44a5-b42f-57788a1a3070","resolution":{"observed_at":"2026-08-15T21:08:56.923655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-15T21:08:56.928698Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.928698Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:f180d30b51d36785b6a3d0cc2e7cad1eed9fac3fc8c311ade9a500e80b5fe747","observation_id":"b4da37b9-4d56-488c-8df6-daeba4423801","resolution":{"observed_at":"2026-08-15T21:08:56.928698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.459333Z","title":"Wortsman, G","venue":null,"work_id":"ce3c5f33-2b65-44d6-bc1c-a88285097e4a","year":2022},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.932835Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:62606df5fa741b149557d176d5692e867016951b3a16431e6c6e80e9c2d4b706","observation_id":"35c71cd1-2d5f-4f56-8bd6-3f102cdcf0ec","resolution":{"observed_at":"2026-08-15T21:08:57.463254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:56.937018Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.937018Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:8738ace37a3cbf6d5ee10b7cf704d827df136078f708d4ad24d573c2117f7d6d","observation_id":"4a7fa947-b0db-4897-8338-4ba6e0f838a1","resolution":{"observed_at":"2026-08-15T21:08:56.937018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.440339Z","title":null,"venue":null,"work_id":"732b0f85-7060-4905-bc31-5cc5fd539807","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.941580Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:8a2e5edf260b7263035e447cb6b2ac7560843beff4b920ec613a89c928f31d79","observation_id":"33380517-f687-4950-98ab-c8daa1119659","resolution":{"observed_at":"2026-08-15T21:08:57.443958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-20T10:53:35.388400Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-15T21:08:56.946275Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.946275Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:53864d09b8702506de69bdfb4052d694ec652202f722eda53952707e7287e454","observation_id":"8a0f6e7d-2ea4-48ed-8701-b3a5af2080f3","resolution":{"observed_at":"2026-08-15T21:08:56.946275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16199","last_updated":"2024-09-18T23:54:36Z","snapshot_observed_at":"2026-08-13T10:46:50.834601Z","submitted_at":"2023-03-28T17:59:12Z","title":"LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16199","snapshot_observed_at":"2026-08-15T21:08:56.950817Z","title":"Zhang, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.950817Z"},"links":{"cited_paper":"/paper/2303.16199","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:e8d606a0e4fc09e814d0b9f5736e2baa46b46c4f4eeb0f8aa36b961154c5080c","observation_id":"9974e1cf-4a27-4df4-9986-444f91439db5","resolution":{"observed_at":"2026-08-15T21:08:56.950817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.427899Z","title":"Zhang, S","venue":null,"work_id":"fd3e3fc7-b377-42f9-9c26-b6ad0aad5427","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.955070Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:ea450e575169fd82cb61f62347b0a0d877bc4272b143686d94535440b5a0e7d2","observation_id":"da7eb7c4-a63a-408c-972c-234aaa23fa80","resolution":{"observed_at":"2026-08-15T21:08:57.432643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.416026Z","title":"Zhong, C","venue":null,"work_id":"bae8f3da-8d83-4148-920a-07fa058825ce","year":2024},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.958865Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:31359892f519443c9bd02415faefa991b0a45a0e7a56232c5f705973f5f969cb","observation_id":"f60cd730-7c06-47ff-ba87-002bce33f06b","resolution":{"observed_at":"2026-08-15T21:08:57.419888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03708","last_updated":"2024-08-17T13:39:13Z","snapshot_observed_at":"2026-08-19T09:52:24.920763Z","submitted_at":"2023-10-05T17:35:26Z","title":"Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03708","snapshot_observed_at":"2026-08-15T21:08:56.964024Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.964024Z"},"links":{"cited_paper":"/paper/2310.03708","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:c050053447ff7ec3c526a07fd2747da687bf740f14328616fcce213591e97816","observation_id":"5c9d276b-a7b8-433e-ae9b-1d89198140ca","resolution":{"observed_at":"2026-08-15T21:08:56.964024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-21T16:54:14.450108Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-15T21:08:56.968309Z","title":"KX i=1 wiRi(y) # ≤ E y∼π′","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.968309Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:60ef595c3304091d39c16037a116fdc583c12489b876f96e9742c5dc8425b92c","observation_id":"a712e480-ee0c-4e85-a4b2-1c3ea06ad12f","resolution":{"observed_at":"2026-08-15T21:08:56.968309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.402414Z","title":"KX i=1 wiRi(y) # =p +q +r +s. (18) While by the selection ofk, we have E y∼πA,w","venue":null,"work_id":"7c44ff28-1aa7-46c6-ab12-b69f1b82a665","year":null},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.973004Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:569116a8deb5a6547f4e5a2a807b610d25bb43fd0daa5d6ed87e5f16042bc0f2","observation_id":"faa9016d-dcc0-421d-a4e5-f2b6e5e7d29c","resolution":{"observed_at":"2026-08-15T21:08:57.407048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:08:57.389904Z","title":"reverse_kld","venue":null,"work_id":"dedc6709-1ffc-4ff6-ab20-f079616bd90e","year":null},"citing_paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T21:08:56.977697Z"},"links":{"citing_paper":"/paper/2505.10892"},"observation_digest":"sha256:a0c5776713d7fea9284b4d88c3042e1cce94cbb4eff8f1b68195be41a64dae2e","observation_id":"d1343081-3ca8-4c45-8cf3-e47cb7e7f967","resolution":{"observed_at":"2026-08-15T21:08:57.394592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10892","last_updated":"2026-06-05T07:57:09Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-20T10:55:10.469429Z","submitted_at":"2025-05-16T05:58:26Z","title":"Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 3 inbound Pith citation observations for arXiv:2505.10892."}