{"as_of":"2026-08-15T11:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83bb7b96b7e00a872750455db7523d2fb09bd31b7060d48e4f4f2f7eab83dfef","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:20:54.562259Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09507/citation-record","integrity":"/paper/2608.09507/integrity","json":"/paper/2608.09507/citation-record.json","paper":"/paper/2608.09507"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.224787Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.224787Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:d5892f872f3a7f95a354ec4d48619637a2d53490ed101c80be0bcc3fb50a93f6","observation_id":"ae82675b-e238-4162-b92d-5cdf0a56ff94","resolution":{"observed_at":"2026-08-14T04:20:54.224787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.232418Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.232418Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:478bf510856cea886e45600a9ee93c31b8b589b085f5a1314466d65969eaaa30","observation_id":"39f9f91b-623f-4a7c-a01e-e8a0273c1f07","resolution":{"observed_at":"2026-08-14T04:20:54.232418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.238370Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.238370Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:d192439e1108a38c76359fe9dfb7398796282fdec21227fa7697725c5ec14cb3","observation_id":"026823ba-e51a-43fc-bc84-62f34b641006","resolution":{"observed_at":"2026-08-14T04:20:54.238370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.12078","last_updated":"2026-04-22T03:09:46Z","snapshot_observed_at":"2026-08-07T16:51:35.491007Z","submitted_at":"2026-01-17T15:05:36Z","title":"Optimizing User Profiles via Contextual Bandits for Retrieval-Augmented LLM Personalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.12078","snapshot_observed_at":"2026-08-14T04:20:54.243621Z","title":"Optimizing User Profiles via Contextual Bandits for Retrieval-Augmented","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.243621Z"},"links":{"cited_paper":"/paper/2601.12078","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:8323bba98f786739aa7b40109b2c727e4f74ed096d13faa5e170dbb91c4789cd","observation_id":"24d3e69d-80f8-4cd7-8ae0-8fb14b9cc38b","resolution":{"observed_at":"2026-08-14T04:20:54.243621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.250331Z","title":"Persona-","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.250331Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:2682b96377886c2284b18ac8dbc62706addb372b0c498791142499c2953ab991","observation_id":"18a3f310-a064-415e-868c-23eb8c2273d9","resolution":{"observed_at":"2026-08-14T04:20:54.250331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.255594Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.255594Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:96c1b9bfd532c055de762fe28721b1236b1391fd8ddbd8740a9397c0b5eea364","observation_id":"9480197e-2490-41bd-a1f7-c3f7a39ca38a","resolution":{"observed_at":"2026-08-14T04:20:54.255594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05731","last_updated":"2025-04-08T07:03:36Z","snapshot_observed_at":"2026-08-07T16:07:39.728870Z","submitted_at":"2025-04-08T07:03:36Z","title":"Retrieval Augmented Generation with Collaborative Filtering for Personalized Text Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05731","snapshot_observed_at":"2026-08-14T04:20:54.260314Z","title":"arXiv preprint arXiv:2504.05731 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.260314Z"},"links":{"cited_paper":"/paper/2504.05731","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:f841fe5ddb7af7509c04dd505e344245adf0f2a548b44ec7e7d32bf5607a0308","observation_id":"5b2ed914-b6c6-4578-97d6-3cbdb622b41f","resolution":{"observed_at":"2026-08-14T04:20:54.260314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04401","last_updated":"2025-02-08T20:01:56Z","snapshot_observed_at":"2026-08-13T04:24:47.213975Z","submitted_at":"2024-02-06T21:03:52Z","title":"Democratizing Large Language Models via Personalized Parameter-Efficient Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04401","snapshot_observed_at":"2026-08-14T04:20:54.265392Z","title":"arXiv preprint arXiv:2402.04401 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.265392Z"},"links":{"cited_paper":"/paper/2402.04401","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:d811aa368436aa165ca88b02e10f657dcba4cb86aa273d6e35c538a2e0a650dd","observation_id":"320b4752-14ac-4892-81c5-d47968e78b6d","resolution":{"observed_at":"2026-08-14T04:20:54.265392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.270445Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.270445Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:8f443c7b810afb0d844297ed608226d6eabc1d4ed6141991d6797b891ce7c943","observation_id":"153e08dc-fac5-4ba5-8673-13989f4fa870","resolution":{"observed_at":"2026-08-14T04:20:54.270445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.276499Z","title":"ACM Transactions on Information Systems , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.276499Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:8e2c9c514bae22960926c8972a6adfba78a8db485ed7db58d7564e698fcc4c22","observation_id":"be97fe2b-dc40-4a0b-8871-5d5920a27ef5","resolution":{"observed_at":"2026-08-14T04:20:54.276499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.281254Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.281254Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:52ab818e429d593027793feed2631b8d2b8052cf2ee256311a025f2353e87bf0","observation_id":"f7d1e735-bc66-45f3-a473-bde7620b331c","resolution":{"observed_at":"2026-08-14T04:20:54.281254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11564","last_updated":"2023-10-17T20:22:13Z","snapshot_observed_at":"2026-08-14T09:42:02.630726Z","submitted_at":"2023-10-17T20:22:13Z","title":"Personalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11564","snapshot_observed_at":"2026-08-14T04:20:54.286992Z","title":"arXiv preprint arXiv:2310.11564 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.286992Z"},"links":{"cited_paper":"/paper/2310.11564","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:4e22ad632e996e21fba5218abc0c5384e1481b2acefced3ba51f52b70d1eead7","observation_id":"64625d7a-b7aa-4152-8c50-a10eeb4cb6f9","resolution":{"observed_at":"2026-08-14T04:20:54.286992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.292501Z","title":"2024 , note =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.292501Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:781e75243d122475504a43ba00cfa3276e586ce97eef95b4482c707391e40339","observation_id":"88f85b19-4c63-4c7b-924d-41198c3dc9b5","resolution":{"observed_at":"2026-08-14T04:20:54.292501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20081","last_updated":"2023-10-30T23:40:41Z","snapshot_observed_at":"2026-08-13T05:37:03.334954Z","submitted_at":"2023-10-30T23:40:41Z","title":"Integrating Summarization and Retrieval for Enhanced Personalization via Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20081","snapshot_observed_at":"2026-08-14T04:20:54.297753Z","title":"arXiv preprint arXiv:2310.20081 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.297753Z"},"links":{"cited_paper":"/paper/2310.20081","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:a626d03dd6731b7d5dc2c8b15a2c59df02368788f301ce2055a41fe224c6d3de","observation_id":"62c67ef1-a70c-44ee-9e2c-99037d1620dd","resolution":{"observed_at":"2026-08-14T04:20:54.297753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.303176Z","title":"Proceedings of the 1st Workshop on Customizable NLP: Progress and Challenges in Customizing NLP for a Domain, Application, Group, or Individual (CustomNLP4U) , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.303176Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:8eda0fd26a397a1abeae6a69c9365cd66638f05ca53e538f7be58ac18f690c33","observation_id":"2debc7b9-0f3f-4960-8d30-e20482b33f80","resolution":{"observed_at":"2026-08-14T04:20:54.303176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.308080Z","title":"arXiv preprint arXiv:2601.04963 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.308080Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:c5ca00c36ccb06df97cee3b2ab016fb0574ee6535d19437e3418d08faa972a13","observation_id":"c1b9c427-574e-4bc3-8145-1b51167d1b64","resolution":{"observed_at":"2026-08-14T04:20:54.308080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.313613Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.313613Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:d0148433b101d031e9154dae60ff1ad6c8824893dab92afc514a8a775c7a7691","observation_id":"003d1eae-dd1f-413e-a607-e01a16c5d69f","resolution":{"observed_at":"2026-08-14T04:20:54.313613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.319100Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.319100Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:4ec1dc63da0afa6136c30a7e6bfc230d15b19f483aa4f99f9ec1148b82cac9a5","observation_id":"bca672d5-3904-42a6-a9c2-7ad5296deba1","resolution":{"observed_at":"2026-08-14T04:20:54.319100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.323577Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.323577Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:da5f01f0c505267bd8be07dbeb9e1931ab48d64c797bafa8e8388aa78285f46d","observation_id":"e8d4f5aa-5b6c-4986-84cc-b8a4e1a78b91","resolution":{"observed_at":"2026-08-14T04:20:54.323577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.327979Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.327979Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:6144d2b6a8b4203aeabc8c96414a1a7d26b40e32cd071e124e9b1b4d5f3a4383","observation_id":"c99fa9db-4093-4c82-8a09-40d16ee88f6f","resolution":{"observed_at":"2026-08-14T04:20:54.327979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.332553Z","title":"and Stoica, Ion and Gonzalez, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.332553Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:5d6b828933c2f8c0c93aa905d437cf59863d84ef792e04fdce0f22296823e3bf","observation_id":"4836f9bb-6b98-4bae-9c22-988a7b7250b3","resolution":{"observed_at":"2026-08-14T04:20:54.332553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.337451Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.337451Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:cb370c0cb16117db3ad782a6f5f8560311beb115fe3a04447ae2cf161cdc7d88","observation_id":"cae205b1-dfa2-4d1b-8977-66bca40fe932","resolution":{"observed_at":"2026-08-14T04:20:54.337451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.342651Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.342651Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:17dd0739c14a7dc94f2c0553aa1f061720cfddffada977208a2633c7f67aeed9","observation_id":"817c7abc-8062-45bf-a596-1df3785895b5","resolution":{"observed_at":"2026-08-14T04:20:54.342651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.347138Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.347138Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:b55d45e1e7f51a79571f441dccb077e004a005bbc9127ab9d0aacdfc72684aa9","observation_id":"9f8056a1-8615-4807-8055-dd4402e6930e","resolution":{"observed_at":"2026-08-14T04:20:54.347138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.352017Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.352017Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:72bce0a43dd86a1d1d701f38ac1d483eb14a15df2533e6f91c3a15a63cf7600e","observation_id":"156dbdaf-87e3-4ece-a776-357c83a40e79","resolution":{"observed_at":"2026-08-14T04:20:54.352017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.358114Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.358114Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:a0b9f193e3cb5db6c41e81072a69b22a0e2f34b0a9e777b69faa816e9cd904bc","observation_id":"e34a18c8-23a8-416b-8efa-1d8c21feb82a","resolution":{"observed_at":"2026-08-14T04:20:54.358114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.364604Z","title":"International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.364604Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:82ffb1ffeeafa55d8a4ac26a10b6d14b5c324c917174467a5c9722c605009604","observation_id":"f837fcaa-535e-4c40-a4c2-1fea889e2d1c","resolution":{"observed_at":"2026-08-14T04:20:54.364604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.369511Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.369511Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:8840db7dc729afba9d52d5c861df427051602884841dd3d3d36e54a43a0c4581","observation_id":"88c55ad9-3583-450f-b56a-e9a957a5ac58","resolution":{"observed_at":"2026-08-14T04:20:54.369511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.373808Z","title":"2026 , month = feb, howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.373808Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:ffed9866a46549f11cb5547a74664bdd3d90b0a1ac5e598e99e9825d0d742bec","observation_id":"4fac8e80-6c29-4383-8a68-2ff079a9582a","resolution":{"observed_at":"2026-08-14T04:20:54.373808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.378310Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.378310Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:f16e50169db09e4acef6d2234ca46711070fc15258935ec426f0947f0b598d82","observation_id":"fd017266-f053-4a27-b598-2124c60ba001","resolution":{"observed_at":"2026-08-14T04:20:54.378310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-14T04:20:54.383505Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.383505Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:7363eab5695c5aaae21308fa84dc7b510c1e406c9bfa40eefbab4da564b3dd04","observation_id":"002250e1-3403-40d5-a64f-1557d93ab6b3","resolution":{"observed_at":"2026-08-14T04:20:54.383505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.399636Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.399636Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:1004ccb405ed82e1154562e8fc2d82769f343d785d9accfc4fb9761df9393491","observation_id":"db907c52-e4f9-444f-8789-5f5c849feb01","resolution":{"observed_at":"2026-08-14T04:20:54.399636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.405937Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.405937Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:9eefdf5f90c327253ffd801ad9c299ccb58358ab1438daf087c0f48cbcaca1c0","observation_id":"c97964e3-e829-4a56-90ed-246d48c2a753","resolution":{"observed_at":"2026-08-14T04:20:54.405937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.412309Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.412309Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:e3b97cdb0a00d75806ee215836376bcf3a62250651605374c83c806e8c2a81fb","observation_id":"5f08a450-3df1-4e1d-a64b-51a39d969642","resolution":{"observed_at":"2026-08-14T04:20:54.412309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.418138Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing (EMNLP) , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.418138Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:567f4e5212ddc2977d859b150552be7a09149228173adf88ea7f4705934e0e05","observation_id":"53911f4e-2d67-474d-bf9f-706751177e7a","resolution":{"observed_at":"2026-08-14T04:20:54.418138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.423506Z","title":"Transactions of the Association for Computational Linguistics , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.423506Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:cdd0c37d7e94ddbaedb13948c71f51daa9125255cfbc4a5a7f9a82f6f6ebc84c","observation_id":"460022c5-43af-4052-a44b-d60a3ebf5828","resolution":{"observed_at":"2026-08-14T04:20:54.423506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.428777Z","title":"Training language models to follow instructions with human feedback , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.428777Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:1c4d59e5c13cd688f338d323bd34081dff0a21ce849db2e17e30931dfe1c79ae","observation_id":"63fee2e0-b204-41fe-add0-0c285345669c","resolution":{"observed_at":"2026-08-14T04:20:54.428777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.433416Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.433416Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:61d2ade60484dd7854e5fd5a360ec36ef8471a4a5cdc0eecdb63a0ea8d1c36a0","observation_id":"4edbd32c-8642-49a8-9d42-5d7a18f03594","resolution":{"observed_at":"2026-08-14T04:20:54.433416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.438783Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.438783Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:7f4fe9c5b14635ab4534b479ee80a91e87cc7e344726bdca2938f9dd963e9a9e","observation_id":"c195d0b6-4e2d-42f6-8f8c-28652830f166","resolution":{"observed_at":"2026-08-14T04:20:54.438783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.443255Z","title":"Proceedings of the ACM Web Conference 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.443255Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:116674cb8b63d5ad21cc1442e0ba1cdb29a432e4728c192cb2e295a0fb14d2d9","observation_id":"05a189b1-8b41-4f15-b58a-35ca5e0f119f","resolution":{"observed_at":"2026-08-14T04:20:54.443255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.447799Z","title":"Recommendation as Language Processing (","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.447799Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:5a4474f0604f19bed041c7d207bced0b00a4b706f37af86dd55a2642b1a26787","observation_id":"bfc3c5bb-add7-4554-9e47-743807865343","resolution":{"observed_at":"2026-08-14T04:20:54.447799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.453108Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.453108Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:7cc89d1a15c629597bd5a74969a097091643310df30088d7ccde22aa930c6399","observation_id":"e96c8d95-5928-44e5-af39-e3458ab69c6a","resolution":{"observed_at":"2026-08-14T04:20:54.453108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.459138Z","title":"2024 , publisher =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.459138Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:950cb1bf2688b345004a1f00e53240c0da6378feb8c53b0fc8069e51887cfbd5","observation_id":"f301ccb2-91ac-492a-b361-7d08736e47eb","resolution":{"observed_at":"2026-08-14T04:20:54.459138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00887","last_updated":"2024-09-02T01:30:40Z","snapshot_observed_at":"2026-08-14T09:13:46.943121Z","submitted_at":"2024-09-02T01:30:40Z","title":"User-Specific Dialogue Generation with User Profile-Aware Pre-Training Model and Parameter-Efficient Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00887","snapshot_observed_at":"2026-08-14T04:20:54.465098Z","title":"arXiv preprint arXiv:2409.00887 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.465098Z"},"links":{"cited_paper":"/paper/2409.00887","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:97acbec74772327f48a2717ca04225624614e55577ced432868441cfb7f1a794","observation_id":"82f0fc42-0dc4-47c6-97dd-88e6bf3d9d1c","resolution":{"observed_at":"2026-08-14T04:20:54.465098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.471041Z","title":"2025 , doi =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.471041Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:afda25cae9517b31eec1523f1cf28e54d105bf89dc9b53d52203933d2ecb7987","observation_id":"5a19cf73-f598-4091-a234-74ed9fac0e8a","resolution":{"observed_at":"2026-08-14T04:20:54.471041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.477081Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.477081Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:660d542aa7b3e86854bf76f7aadc8c725d275b186a2b4954320b22e48b22cdb6","observation_id":"6f810578-554f-49ab-8670-1630a31e0c3a","resolution":{"observed_at":"2026-08-14T04:20:54.477081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05970","last_updated":"2024-04-09T02:58:05Z","snapshot_observed_at":"2026-08-13T00:34:32.954749Z","submitted_at":"2024-04-09T02:58:05Z","title":"Optimization Methods for Personalizing Large Language Models through Retrieval Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05970","snapshot_observed_at":"2026-08-14T04:20:54.482148Z","title":"arXiv preprint arXiv:2404.05970 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.482148Z"},"links":{"cited_paper":"/paper/2404.05970","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:79a83235db856010bde677f1c876c7f5bf4c2dbdd39753ad28fe29e5ed3f6ed0","observation_id":"a4211d96-7bf3-4b26-bb04-5c51ad00d0da","resolution":{"observed_at":"2026-08-14T04:20:54.482148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.487135Z","title":"arXiv preprint arXiv:2507.13579 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.487135Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:b9fa6e096e3868207045acc5ce39c154799e51c2d4700ce33af7b4fad8deecf8","observation_id":"a909d038-0674-4f6b-a339-a60562909258","resolution":{"observed_at":"2026-08-14T04:20:54.487135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.491550Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.491550Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:01596ac169621230eba8a751b9a0ef2650229fd39ab6224b0851d00bde116726","observation_id":"fa996684-2315-4430-a87a-5d24ff0af2ce","resolution":{"observed_at":"2026-08-14T04:20:54.491550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.496529Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.496529Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:6b6880ad2b96246dd52e007b4c6c4b5384191c8b103559fd549d38f6e48f917e","observation_id":"ce8361b2-7509-4a4b-864f-a83d416df745","resolution":{"observed_at":"2026-08-14T04:20:54.496529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.501666Z","title":"Computer , volume =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.501666Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:7f5d01bdd64428a1386da783d84e67d9586b6c745c63a488c7bf40bf16663c7f","observation_id":"1a3beb4d-455f-45ef-a9df-b8e9b6903d96","resolution":{"observed_at":"2026-08-14T04:20:54.501666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.506403Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.506403Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:b89011e4323f297553f9ad481fb9a0b509ea0bb6680e3dc12fca7f62f7b2b4fc","observation_id":"d642d4e2-91a8-430e-9f34-79f7304e2fb1","resolution":{"observed_at":"2026-08-14T04:20:54.506403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.514162Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.514162Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:473af658db75c4496b11a983ee1f3b15df1b6641b196e3dedd81463852bea8fe","observation_id":"c09f0f08-5bae-4f2d-8468-5144845ee513","resolution":{"observed_at":"2026-08-14T04:20:54.514162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-14T23:23:31.683130Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-14T04:20:54.520361Z","title":"arXiv preprint arXiv:2504.19413 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.520361Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:162b2c895dfbe989f8026152b554a56463585e7659f94c2994f288f5a4366eae","observation_id":"4991e912-469b-485f-b7ff-b930ebbc2cdf","resolution":{"observed_at":"2026-08-14T04:20:54.520361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-13T13:14:28.835248Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02259","snapshot_observed_at":"2026-08-14T04:20:54.525842Z","title":"arXiv preprint arXiv:2507.02259 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.525842Z"},"links":{"cited_paper":"/paper/2507.02259","citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:4b382daebc0b0937195aed7e5fe692ad53a7fa7b0625837358ec348dadcb1b60","observation_id":"015d8e13-d63c-4f2c-a6fb-46c1b23a7f8d","resolution":{"observed_at":"2026-08-14T04:20:54.525842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.530953Z","title":"2023 , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.530953Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:cadf63bfd768c455c7bd333d489d4e2df3d026d580e08756f51f48db9225d8ad","observation_id":"94e6d47b-0d01-4fdc-9997-b350606b5fe2","resolution":{"observed_at":"2026-08-14T04:20:54.530953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.537265Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.537265Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:db86f6d12a78e730823fa6a39c76e3066754665bdb53ac609365c9a4ce906c73","observation_id":"f999b699-0ade-4e85-8b9a-975f49990e83","resolution":{"observed_at":"2026-08-14T04:20:54.537265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.542639Z","title":"``In-Dialogues We Learn'': Towards Personalized Dialogue Without Pre-defined Profiles through In-Dialogue Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.542639Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:fcee96eca6db664c48cd5f1516c0f7aa04c0d5c0f97fe33d7b2729b19cb59686","observation_id":"8c6e6f33-0ad3-47a4-9854-6ce618d21324","resolution":{"observed_at":"2026-08-14T04:20:54.542639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.548139Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.548139Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:7a63e5358da02a36204cdccfddd82df002b25e624fcc829c24fc77ae3d2f9124","observation_id":"124cd6a0-43bc-4d5b-a78d-19bb23873811","resolution":{"observed_at":"2026-08-14T04:20:54.548139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.552629Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.552629Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:f604dd90edca537a507f5b4e7fc511548826d34674485983bc4170bb752e85b0","observation_id":"776b781b-648d-41c4-8465-fe3e8f4e16d8","resolution":{"observed_at":"2026-08-14T04:20:54.552629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.557234Z","title":"arXiv preprint arXiv:2603.25973 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.557234Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:75a9e4e65de6f30ee3b4bf756f73fc31a8132ee0da4d68aa009faa4a37ec1f1f","observation_id":"e1b129b9-814b-4ea4-97c8-112fa0f93a8f","resolution":{"observed_at":"2026-08-14T04:20:54.557234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:20:54.562259Z","title":"2009 , journal =","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-14T04:20:54.562259Z"},"links":{"citing_paper":"/paper/2608.09507"},"observation_digest":"sha256:5d957ccc35b2e42615198a8d0f8a54baafab367968efc3199dab738c665bc26b","observation_id":"75e39b32-0311-4ce8-b631-3db3ffb090d5","resolution":{"observed_at":"2026-08-14T04:20:54.562259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09507","last_updated":"2026-08-12T10:18:53Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T10:09:37.164137Z","submitted_at":"2026-08-10T12:11:47Z","title":"Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2608.09507."}