{"as_of":"2026-08-09T16:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2f596fa7a4a9b95627e02338298c33a8a0d1f9b3d713dafe1172364f56af2df","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:24.396122Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01556/citation-record","integrity":"/paper/2608.01556/integrity","json":"/paper/2608.01556/citation-record.json","paper":"/paper/2608.01556"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T00:14:19.305458Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.305458Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:4368847b6e972cbd26505b068b1b7b55b6cecd5bcccc4f3845390fdfcac62055","observation_id":"cf1aef8b-b797-40a8-9455-2a7773913c5c","resolution":{"observed_at":"2026-08-07T00:14:19.305458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T00:14:19.420535Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.420535Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:ace653e93546977277cc4db5e5629d8c707ed9aee56bb673556b43a52098eff3","observation_id":"fc26ea47-8f9e-4aa8-aa04-341129c2f729","resolution":{"observed_at":"2026-08-07T00:14:19.420535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:33.598112Z","title":null,"venue":null,"work_id":"be7195fb-81b2-42eb-ac79-c52a175bd7ca","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.484960Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:66543cce877a1f01d1a3ba6f3416fedcffd78a4b424902ac9503b21f85fe94d8","observation_id":"3c045e10-ed19-42c8-ab96-5786153c51bc","resolution":{"observed_at":"2026-08-07T00:14:33.661882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:33.410411Z","title":null,"venue":null,"work_id":"ff9955e5-d16d-41ec-8377-2eeba67c8acd","year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.572097Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:3bdd30ef5055290a71501313f7dbe93062a800262cf9b8124e0d98a908ffea0d","observation_id":"5ef32673-e7ed-4f87-9d25-02cb03312aae","resolution":{"observed_at":"2026-08-07T00:14:33.496567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:33.195566Z","title":null,"venue":null,"work_id":"b036eeca-813b-40c8-970c-511e174bd121","year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.646153Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:c58535ef6bec2c4cb2b15ffe7fecb0601aa203dc195761854b31c62611c61812","observation_id":"4ef74a50-59e9-4f21-89e9-615ae3e334aa","resolution":{"observed_at":"2026-08-07T00:14:33.272821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:33.028518Z","title":null,"venue":null,"work_id":"d59ff8fc-d35d-47b2-85a4-8c5812ca2576","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.766575Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:b842b079ff9f3651b56fb0582dff6a4453660e34f35aafd05dfc93b2c9852c7a","observation_id":"736d5350-a397-4a15-8dfe-8ba0c79dbbf4","resolution":{"observed_at":"2026-08-07T00:14:33.093799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.700727Z","title":null,"venue":null,"work_id":"a8be796c-a5c6-4167-9843-1dcce7383fa9","year":2019},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.923314Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:cf517dab3bda46afaf69a0ed24eeeaac53a51a3e241d83ea38a8e21664574a5c","observation_id":"72e99b7f-9f38-41fd-8376-342c13b8b15c","resolution":{"observed_at":"2026-08-07T00:14:32.782221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.484615Z","title":null,"venue":null,"work_id":"00c26ed7-c09c-4650-ac41-ee9fbdf20fb9","year":1977},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.000449Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:2b8cca63edae54a88a2ed919abe8332d25baf7c3471ae640e35e450b82c015cf","observation_id":"0bac03e2-a3b5-4c6a-b1e6-c87eaa5f9378","resolution":{"observed_at":"2026-08-07T00:14:32.597636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.298363Z","title":"Dinh, Nguyen H","venue":null,"work_id":"2ac1ae34-0af9-467b-a2b0-8051ffa2f606","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.094945Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:d2d6ead933c22589e0abd257c260829457a277fcfa050cbd8019dadc6dd90a1f","observation_id":"4b13ea09-0741-408a-8647-629317b8fc87","resolution":{"observed_at":"2026-08-07T00:14:32.376593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.195400Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.195400Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:7eebf5013f1e9979d37b25291317456a295825eae4221f2368d5b7fe523138eb","observation_id":"9a3d4a59-c960-4513-9bf5-64caa8615a3c","resolution":{"observed_at":"2026-08-07T00:14:20.195400Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.110790Z","title":null,"venue":null,"work_id":"b7c1d148-e94e-40da-97a8-096d5c7c3b45","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.281645Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:107dd82bb78ebb2ae327557159b0fa85a20041ae03a7b38d18ab1b9611ea5819","observation_id":"caa99421-ff7d-4586-8b49-aaa8c68b944b","resolution":{"observed_at":"2026-08-07T00:14:32.187735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.932138Z","title":null,"venue":null,"work_id":"56bf3f63-a13c-454c-a2ce-1440ec447193","year":2025},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.367647Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:0e05e998d83066a7d1a0472a2f85691e8688ac58551ec098e5c3f161e237261e","observation_id":"e787a441-dde1-4c66-908a-035bd80af166","resolution":{"observed_at":"2026-08-07T00:14:32.007190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.734967Z","title":null,"venue":null,"work_id":"5be314fe-a465-485e-8f0b-5e3f47d58ef6","year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.460250Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:835db8781403fd18e3f272465610ce886c8fd0315b5c0c5f4b1d2695e86f0be4","observation_id":"83ac5525-4b7e-45d1-a812-40c5b669644d","resolution":{"observed_at":"2026-08-07T00:14:31.815356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.583327Z","title":null,"venue":null,"work_id":"c1810a0e-a349-4969-8558-7eb1a10f6dd5","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.535624Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:93109c4bfeb0a09b987d7ff3b48ec0a6f59e4ccb88e1e31a53e97964e275f8ff","observation_id":"846f8697-f880-44c2-99a2-954f8391d3b1","resolution":{"observed_at":"2026-08-07T00:14:31.643112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.424421Z","title":null,"venue":null,"work_id":"4210f952-b5d2-4099-8c1d-852c7dc3857c","year":2019},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.611042Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:8dcb0ff8cc9c83ac359ff0bbca0efb05805841b38e9081af515c9a78533543b0","observation_id":"d23c7476-c50d-4cf3-96b7-cbf8df6b7a42","resolution":{"observed_at":"2026-08-07T00:14:31.490776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.705806Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.705806Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:f4ed881d7d717264ee34ed5ed0ce7a86e0bc742e5775d6b8d16f7bf22e68d47b","observation_id":"5036ce68-6c07-4b62-8f95-1bdc6abd0f54","resolution":{"observed_at":"2026-08-07T00:14:20.705806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.262601Z","title":null,"venue":null,"work_id":"76fe3326-fb38-40c3-9ad8-0357d0205cc1","year":2019},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.806784Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:c8dd891d116598317ea117282cb317c1a2928b642f09e0b876098a755964abc9","observation_id":"8854bc2f-6744-4b9b-a550-a10c2e7c5ec2","resolution":{"observed_at":"2026-08-07T00:14:31.330369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.900940Z","title":"Jacobs, Michael I","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.900940Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:e39755b8b1b97590cbe78250b9c710afa95f3618542948ef68c32879b9717802","observation_id":"6e3b2312-967d-406a-a74c-59b5e99b40da","resolution":{"observed_at":"2026-08-07T00:14:20.900940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:31.098748Z","title":null,"venue":null,"work_id":"2d242d2f-1d7c-4b2e-a259-088466000edd","year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.087444Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:6969cbc05eda8267f4e2de271238ccb4bebee394b81cf8d3a7b7deb81cefa1a7","observation_id":"3a48046a-bc36-41cc-8e80-cb89e13cf849","resolution":{"observed_at":"2026-08-07T00:14:31.176257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:21.183161Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.183161Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:9dbd5bc2b52390cce8022577826a571f23dc7991de3288204ddefbbc012593b2","observation_id":"7f25f88f-1454-47b6-a312-1178986b59d2","resolution":{"observed_at":"2026-08-07T00:14:21.183161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:30.774603Z","title":null,"venue":null,"work_id":"a1e70850-8c21-42c8-a3a4-34007428db7c","year":2025},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.283503Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:0f61b047a55459a0a3d5a2a16b9f5af4df3c24e6d8cd93c601a108f5a7a943c0","observation_id":"960ca0cb-1350-4071-9dcc-6181f5a7548e","resolution":{"observed_at":"2026-08-07T00:14:30.930130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:30.433670Z","title":null,"venue":null,"work_id":"98e1db3d-ef4b-4d0b-953d-9be1d6b2a8fa","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.372676Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:d506d600ec937c0080d8f0fa1aace73fd35ecd10d684b270a1038d39f77b966d","observation_id":"ac93f555-a645-452d-89a2-0714e2f13398","resolution":{"observed_at":"2026-08-07T00:14:30.569719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:30.062127Z","title":null,"venue":null,"work_id":"d155910d-65e9-45ac-981f-aac804d32db7","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.439522Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:1d34cb39136c03dcfe4f8f795ddf679fb879def4482f5120d139c9f3347a6c1c","observation_id":"22af8759-a386-4588-89da-c8b1648cff0a","resolution":{"observed_at":"2026-08-07T00:14:30.207601Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:29.719104Z","title":null,"venue":null,"work_id":"093545b5-6bb9-489f-88e9-da3182722200","year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.528982Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:c247700774bf72aadaabe08008d43ca5bfa8d91a958b4f5001a0d306efb952db","observation_id":"5ac89ffa-f289-4285-b451-cf45bde3c213","resolution":{"observed_at":"2026-08-07T00:14:29.864106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:29.343663Z","title":null,"venue":null,"work_id":"a3a00287-163f-4bb6-b404-52353e7fd8ca","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.617719Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:e857a07f1fb06bfc76f996e1d0e97b2b764fb4928e3a2b5eaf57af319c4ebab9","observation_id":"4f29cf24-383a-4aca-82f9-a60cc22510f2","resolution":{"observed_at":"2026-08-07T00:14:29.516348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:29.007123Z","title":null,"venue":null,"work_id":"3cf20682-c58e-482c-bea6-d9002348a925","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.715971Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:4b1babf98c74a42e7fa79c6810df959d90fb7a64dcb3d944f38355d74a5836a3","observation_id":"24f03e98-3dcf-4b8e-a5d4-f643db16aa24","resolution":{"observed_at":"2026-08-07T00:14:29.141546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:28.678959Z","title":null,"venue":null,"work_id":"9d5fa225-1d34-4111-92e5-d74e670c8dc1","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.802949Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:267784e643c1d4dd2dd7eb80f06b4d9beb21f63080ed07e15b0d33445a1153cf","observation_id":"d388dd37-642f-4a1a-b558-86b9d705ed9b","resolution":{"observed_at":"2026-08-07T00:14:28.835492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:28.105442Z","title":null,"venue":null,"work_id":"bb5e6e8f-8fa8-426d-af1b-e1e2b85e18e8","year":2019},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.951726Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:f5b0f193155d72f081939f26524906e0343ab5bccff521f372cde03024ff391f","observation_id":"db20fb0d-3af5-4544-8e88-3a8b49ffc6af","resolution":{"observed_at":"2026-08-07T00:14:28.239691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.045150Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.045150Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:ca6ec20c7fbd1b8e441691c8fc4abbff5d05bb19f980a963df61eefa135a6d85","observation_id":"4fff5aff-1ead-463e-bf7e-42a407d9c586","resolution":{"observed_at":"2026-08-07T00:14:22.045150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.772634Z","title":null,"venue":null,"work_id":"e28f049f-0e55-43f5-ba65-2b7946e9d506","year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.105556Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:2e96244bf8c743b21bd8418c0d24f6c7cdce4fc0c8b302569a8a46e11658c0d6","observation_id":"b7b646b9-99b7-49c2-a781-f24e320c33ee","resolution":{"observed_at":"2026-08-07T00:14:27.888051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.513045Z","title":null,"venue":null,"work_id":"ba2a9b02-4b42-43cd-b635-e1a4c8fa8a60","year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.195954Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:a876a1ac5cfde0fc4d8fcdb90766d1925ecca2f2e1e3fd63bf7d3db07e9ae245","observation_id":"89de2c65-11d2-4a20-b5f8-d3b35e57920e","resolution":{"observed_at":"2026-08-07T00:14:27.643852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.325939Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.325939Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:7c71614c917788d114ed17283d059b5fe6550eb3b7c7410cad1c6dce3603945b","observation_id":"9bb0b866-ae30-4bbd-83cd-13cb1eb3939a","resolution":{"observed_at":"2026-08-07T00:14:22.325939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.426540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.426540Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:433fb0781de3bf677023b59e95ca337409206a39c26acbf5c3a993377cca02e3","observation_id":"d4985e96-f6f4-4cc8-96bb-ba8e1eb1e426","resolution":{"observed_at":"2026-08-07T00:14:22.426540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.520193Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.520193Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:b28d7d7d1a40aebf72837a82c8dd383071f2b983194996a02463484931d4e8d0","observation_id":"c83241df-2035-4864-9054-ca3c3711f560","resolution":{"observed_at":"2026-08-07T00:14:22.520193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.609658Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.609658Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:27c441eb26ff9550c08e38ea8b617837c69500da14f3f2123b4f030d8d068db4","observation_id":"69a77d1e-4108-4daa-be96-37583a4398f2","resolution":{"observed_at":"2026-08-07T00:14:22.609658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.112180Z","title":null,"venue":null,"work_id":"276d2fbc-89e4-499a-9440-87ee4fda7ff5","year":2016},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.710869Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:d154dc84c13f8fc72cc0296ccb41124e884524b1e18df21898cfe60a3cf2e9b3","observation_id":"45b5feaa-b854-4b08-808e-5b7a24c5166f","resolution":{"observed_at":"2026-08-07T00:14:27.322257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.806966Z","title":null,"venue":null,"work_id":"82ed0b78-2829-4d0b-b620-981de2461cb1","year":2022},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.792003Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:468f509067b7e09819caff0919527060bbc42d18a200db9d96765f85061be712","observation_id":"b4b1af53-f5e1-474c-a56f-f49c80523a35","resolution":{"observed_at":"2026-08-07T00:14:26.973612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.858229Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.858229Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:21d0d5b8872574f257dec59f71fc17a92c07b3eb2f69a6563a36419fe00e7c1f","observation_id":"fb865749-a448-4a9e-9e4f-c6a956c1e154","resolution":{"observed_at":"2026-08-07T00:14:22.858229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.930723Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.930723Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:261922ffc1b738e4df1fee6003c34d1396a8a9e30860684af9f23d41906c5ce3","observation_id":"6ffccef8-d3cb-4a5d-bd0d-7e1238127457","resolution":{"observed_at":"2026-08-07T00:14:22.930723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.565130Z","title":null,"venue":null,"work_id":"00294463-3a96-46d9-a515-f39803130217","year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.046235Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:6d700b1d8e69a78525c6dc4be333072d668b34149fa56dbd1da41fd16ea523e0","observation_id":"4837939f-8341-487a-aaad-301caba4150d","resolution":{"observed_at":"2026-08-07T00:14:26.664060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.120403Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.120403Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:5ed56b7611dd9403bc0cedfb55e4378da6731dac29e594e6042accaa390b3455","observation_id":"714d177a-2bc3-43b3-9821-f31a1ca0fa38","resolution":{"observed_at":"2026-08-07T00:14:23.120403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.315262Z","title":null,"venue":null,"work_id":"7519df79-8a67-4f7c-9fd1-e9b631906b1a","year":2025},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.190952Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:0c5e0307169c5354c342bc2ab7d1c037d818ddfd38a289e3d4bef759431404be","observation_id":"354f73e2-459c-483f-a295-ba7d0d285bd3","resolution":{"observed_at":"2026-08-07T00:14:26.432073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.057410Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul Christiano","venue":null,"work_id":"742cc3b7-95a9-4690-8b73-0e325171c9d0","year":2020},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.277274Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:da026fb8fa536aa4b25b05638c8b1b8e927769fcb7fa700260fd3a1f0051e25d","observation_id":"2edde84a-17f6-4b85-a922-5e7974fc5426","resolution":{"observed_at":"2026-08-07T00:14:26.177464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T00:14:23.365584Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.365584Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:5a3be82081c915d81e7e3e830d7a130e09913ad589a58efd83e1f55dcb2f35bb","observation_id":"6e438b75-39d2-409d-9bcc-64072944a16d","resolution":{"observed_at":"2026-08-07T00:14:23.365584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.492828Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.492828Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:66903fe3020fc1ded00bc5cc430dda0c54e08b5ceed00d5d9b7848676d7abd02","observation_id":"0a4c3f18-c5a7-4fd4-a5e9-843e0a8ba8a0","resolution":{"observed_at":"2026-08-07T00:14:23.492828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.577501Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.577501Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:ee51c1095e95dc170b7761cd88fb422688e4f6e7995feeac3ae505b64f5eb970","observation_id":"7906010b-5727-49ed-b766-ec8188371fbc","resolution":{"observed_at":"2026-08-07T00:14:23.577501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.ac","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.526008Z","title":null,"venue":null,"work_id":"6dff554a-8e0d-4c80-932f-2445dd21f438","year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.702583Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:18475aaafcb6a0d471e87efbe9b1c70c877a32b943ce959724053995399f8383","observation_id":"171aa33a-5e26-4760-b54d-ed3cbcfd75f9","resolution":{"observed_at":"2026-08-07T00:14:24.570218Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.756148Z","title":null,"venue":null,"work_id":"9a5d8a87-dc23-4908-bfdb-3b4d2a63e381","year":2025},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.766617Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:dded13de4b5e110104ce5d552dfba0857b398b8358ce4da9e4abfafc5865135e","observation_id":"6bb763f3-2d0a-4d05-aee1-6f14ebc3afa8","resolution":{"observed_at":"2026-08-07T00:14:25.900133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.566791Z","title":null,"venue":null,"work_id":"d535d70f-5597-4a67-8576-aacdd9de5adb","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.885977Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:42b941b3887b2468d25fde7e69ff8bca712dccc59faf72eccd841e20a8b9bb08","observation_id":"1dc4770b-e6a9-4290-8d50-fa397cd8c037","resolution":{"observed_at":"2026-08-07T00:14:25.636037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T00:14:24.075701Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.075701Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:2a313fbe40e2a1d5fee381aed449937f0330d070ac66f6c49dfc9a24e373e45c","observation_id":"6b3a84d7-0384-4687-9b47-ae6b68275150","resolution":{"observed_at":"2026-08-07T00:14:24.075701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.143376Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.143376Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:f56e54e4d1827a9c12903f4eed43f137fc2d1f031f6be0707743b591c3b9937c","observation_id":"23d91c6c-3d4c-4627-8a1a-5e96edcb2de7","resolution":{"observed_at":"2026-08-07T00:14:24.143376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.36561","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.819531Z","title":null,"venue":null,"work_id":"a9469302-ba02-45dc-9ca2-a927ca26f6eb","year":2026},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.244169Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:1c19d87f3eb60a96b189fb8072bf6ebf4c6606d511d25d282871951dec7954bd","observation_id":"8f7da4ec-83f7-4523-908f-72aca85d2272","resolution":{"observed_at":"2026-08-07T00:14:24.869531Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13283","last_updated":"2024-02-11T11:38:38Z","snapshot_observed_at":"2026-08-09T14:54:38.526340Z","submitted_at":"2023-10-20T05:24:28Z","title":"pFedLoRA: Model-Heterogeneous Personalized Federated Learning with LoRA Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13283","snapshot_observed_at":"2026-08-07T00:14:24.328798Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.328798Z"},"links":{"cited_paper":"/paper/2310.13283","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:442aa6b71aec7158c9ee63a0ebd55dd45a6e8c151bc998faa05400f391420b83","observation_id":"acef721a-b04a-48af-bee3-934db06a1a94","resolution":{"observed_at":"2026-08-07T00:14:24.328798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.218518Z","title":null,"venue":null,"work_id":"aa52badc-7dee-4a00-a9fc-c20c9d3cbd26","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:24.396122Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:4bd835717446f07b6ed31e4dabea8efe6da8a0760723f51dbab7a3ff8e88c5a2","observation_id":"80a2e355-2909-4345-ad73-3fd71090e0d9","resolution":{"observed_at":"2026-08-07T00:14:25.311081Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.984530Z","title":"https://doi.org/10.1162/neco.1991.3.1.79","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:20.984530Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:8cb3b692f189b99e18c4ad087bc35c4596301b3d33d12ca3a32c3238e7eca42c","observation_id":"d7940a4e-f10d-4a9d-931e-dee8c859266f","resolution":{"observed_at":"2026-08-07T00:14:20.984530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T00:14:22.999214Z","title":"arXiv:1707.06347 [cs.LG] https://arxiv.org/abs/1707.06347","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:22.999214Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:164a48426fbd79dc1c136597abb9cc15c888b37c9a124f4c8f99c700bbc4d182","observation_id":"94c466e1-1c4f-48f4-9a52-cba77d919762","resolution":{"observed_at":"2026-08-07T00:14:22.999214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:28.410283Z","title":"World Wide Web26, 1 (2023), 481–500","venue":null,"work_id":"a93b4c87-d95b-479b-a43e-d3ce82dad026","year":2023},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:21.876066Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:a8534f712bd1fd476f655b14b0bed7fd3b23e9f4874c5026e737b641f0480a80","observation_id":"9e3671e0-2607-4c15-8bfa-110907e9de8e","resolution":{"observed_at":"2026-08-07T00:14:28.496672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:32.854736Z","title":"InProceedings of the 41st International Conference on Machine Learning(Vienna, Austria)(ICML’24)","venue":null,"work_id":"d1122502-871d-46ca-85b7-c310ec29feaa","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:19.836791Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:af745c35bb6e6000c86614b6169db1ffa9a3d7de064e00edb4ff31eee0a91c11","observation_id":"ea765af3-31c5-4ecb-b278-7907b7213bd8","resolution":{"observed_at":"2026-08-07T00:14:32.945096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.402003Z","title":"InThe Thirteenth International Conference on Learning Representations","venue":null,"work_id":"78aa5bcc-c343-4cd9-b597-871ba0105243","year":null},"citing_paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:23.967304Z"},"links":{"citing_paper":"/paper/2608.01556"},"observation_digest":"sha256:165ef4c77ea26c09f67fffe890aa2ccac8ebe7ed619c51058d9f2c8833dee45e","observation_id":"d413438f-d692-47fd-b292-7c65b93f67bd","resolution":{"observed_at":"2026-08-07T00:14:25.476774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01556","last_updated":"2026-08-03T00:25:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T16:08:52.418297Z","submitted_at":"2026-08-03T00:25:52Z","title":"Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":50,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2608.01556."}