{"as_of":"2026-08-10T17:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9909ff72f2a2cbeff479c53a9d59788fc5a590c34ea2bdc7bcb52b66915022bc","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:06:57.869871Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00215/citation-record","integrity":"/paper/2608.00215/integrity","json":"/paper/2608.00215/citation-record.json","paper":"/paper/2608.00215"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:52.534468Z","title":"2023 , note =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.534468Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:133efc24b50c9fca40e3dbb1a1e8878ebb9ad2e13e1a98b0aaad64020d2e9956","observation_id":"828f4b68-468d-48df-84aa-e29f7250fe13","resolution":{"observed_at":"2026-08-04T01:06:52.534468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-04T01:06:52.700355Z","title":"arXiv preprint arXiv:2302.04761 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.700355Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:077e7cc609164320bd21bc7b55bdda83f9a24973d5db37ec89347a4c1147ed08","observation_id":"0a697e5c-6f1f-492a-b11c-4633b6f1b25a","resolution":{"observed_at":"2026-08-04T01:06:52.700355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:52.775773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.775773Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f0395c5ae0ec0c416d3a631c4830d3194184b00c4e08c0159747e2c3ba79cbb0","observation_id":"4939fb93-c8a9-43d5-93db-5b56235b5c9c","resolution":{"observed_at":"2026-08-04T01:06:52.775773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:52.884355Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.884355Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:111b1d77db615dac72b09338c426a1961c9e5732c803c457cf452e41e98ddc02","observation_id":"9c257a27-ad83-4293-837d-8bb00acbd482","resolution":{"observed_at":"2026-08-04T01:06:52.884355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:52.957799Z","title":"and Song, Yufan and Li, Boxuan and Tang, Yuxuan and Jain, Kritanjali and Bao, Mengxue and Wang, Zora Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.957799Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f7e9557b36bdf6cfe175f85d10437f00e737699e73d46a6ff4d76df2e31645de","observation_id":"189b4f02-31bb-45ad-90d1-12d785027d8b","resolution":{"observed_at":"2026-08-04T01:06:52.957799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.020908Z","title":"Transactions on Machine Learning Research (TMLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.020908Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:9a88ae113e4bfadceb8a86b07cdda13352484c97d94729a1a3aac37256b211c0","observation_id":"b714580a-710f-470f-975c-29ec11d9babd","resolution":{"observed_at":"2026-08-04T01:06:53.020908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.084425Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.084425Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:771d7e0d57ad52283039ada88bfc7f796cf28cfbf53e47b0912fe77454cb7e70","observation_id":"58a9955e-e768-4837-b600-cbb1b9e428c3","resolution":{"observed_at":"2026-08-04T01:06:53.084425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.147715Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.147715Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:108b744cddeb6f78355e9c7835ffb0b3280deeeb383eefc32b3d269f5c39592d","observation_id":"2e328b3a-3734-4d1a-aedb-2c4a67bc5896","resolution":{"observed_at":"2026-08-04T01:06:53.147715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.208648Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.208648Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:5d87291f50e376d9c55fa48bfcd4e46a28ed7a15ae9b94df85cc4d2fe84905cb","observation_id":"3c605b53-ba1a-4547-9312-035acb23962b","resolution":{"observed_at":"2026-08-04T01:06:53.208648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.275947Z","title":"and Li, Xian , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.275947Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:4db2b9bd96af1ee3a7b7727bf5cfd77822e0705dc28e26d348fe6bcff69db204","observation_id":"a264c3df-96e0-4993-bef8-c72d118f79a5","resolution":{"observed_at":"2026-08-04T01:06:53.275947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.334662Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.334662Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:2ce1ca662b2e27cc26f8c9837febac833a8f83429a65ec5fb2757aa15c01eded","observation_id":"2be3b790-6bfe-415e-9928-197298eb25f7","resolution":{"observed_at":"2026-08-04T01:06:53.334662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.413036Z","title":"Memory as a Controlled Process: Learned Adaptive Memory Management for","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.413036Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:5e1c0157a857a4447dd3434e51d95dbd870ae87fd8d0373a01d5795deb7b6fff","observation_id":"229ce206-e978-429d-860c-02bf72ef0c68","resolution":{"observed_at":"2026-08-04T01:06:53.413036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.464442Z","title":"User Preference Modeling for Conversational","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.464442Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:97d0575071d4fcf7084b43894856fc0351b13a2634bb53ef77fc9d301c69b27b","observation_id":"0935c429-8fe6-4877-9b62-9f89298be0f4","resolution":{"observed_at":"2026-08-04T01:06:53.464442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.524190Z","title":"Optimizing User Profiles via Contextual Bandits for Retrieval-Augmented","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.524190Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:4a0f12f859b982a92034246f31ba8e52cda733607132d7c0f043ca38d4637fe1","observation_id":"72c446c8-9640-49a1-b713-56987c2bb2aa","resolution":{"observed_at":"2026-08-04T01:06:53.524190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.623160Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.623160Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:1085da88fd249b9e4e3d088e83b37a06b88bb11643e21a057bfdd1424e8a759f","observation_id":"201351c4-27fe-4771-9d07-6508d7d33a54","resolution":{"observed_at":"2026-08-04T01:06:53.623160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.686781Z","title":"Training Proactive and Personalized","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.686781Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:5c6c5d0bf041270ddbef7290c4f98cf169f619e24dbb9e55b108806ffff7a17f","observation_id":"b2ef6971-4361-469a-b5f0-6418f1f6c918","resolution":{"observed_at":"2026-08-04T01:06:53.686781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.754524Z","title":"Proceedings of the ACM Web Conference 2025 , year =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.754524Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f1ddc6fdcd9d8eba68bb439bd9b7af515bfb8b29d69927787c452313f9a8466b","observation_id":"dbdf4a99-f94a-4520-b1df-611b1b349e92","resolution":{"observed_at":"2026-08-04T01:06:53.754524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.799456Z","title":"2025 , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.799456Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:2adf331e3e6ad5c6f8e4c4fbf2bfb7867dc98d29becd714364ab781e7efc4d73","observation_id":"db68ad26-cf53-4daa-942a-933feff75719","resolution":{"observed_at":"2026-08-04T01:06:53.799456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.900607Z","title":"Findings of the Association for Computational Linguistics: ACL 2026 , pages =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.900607Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:83434b53db9a4c469e83eda5d3135cbf8dd3ca6c14816c0a411983e49792e313","observation_id":"f5b57a1b-7630-44b9-9777-26a8f2ccec47","resolution":{"observed_at":"2026-08-04T01:06:53.900607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.964393Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.964393Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:e53646fcac11f9e71cef1e8975c27aacaa51443c95befa94604d0e4a8e00bafc","observation_id":"fa255062-b5af-4498-860c-95f15c77df54","resolution":{"observed_at":"2026-08-04T01:06:53.964393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.057049Z","title":"Online Personalizing White-box","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.057049Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:66a9b2acc5d1d3358d3589cf97acb42418d5d3b5d1c87ed37ca93ea907e270af","observation_id":"00ada0fe-f02b-4974-9ab3-33179748cbe1","resolution":{"observed_at":"2026-08-04T01:06:54.057049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.154404Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.154404Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:e3acd40513b8767c60400c5313a039fb0853f4964075583e0d6cd15ace4c3be7","observation_id":"c0d8d334-f894-45b2-bee5-3645efacc1b2","resolution":{"observed_at":"2026-08-04T01:06:54.154404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.221140Z","title":"Learning to Control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.221140Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:fce8894715c2581ff81f2d28fb4c5a2216bd388ce708d8b5208c3df5f02787de","observation_id":"4742454c-98c5-4a2c-8539-1fbc6a8b6f6c","resolution":{"observed_at":"2026-08-04T01:06:54.221140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.316300Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.316300Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:2db90b8bbb96f3da507c72f0891a4f36f637a63606e08145189488706e0d03ba","observation_id":"3fb2e3b5-2f0c-4d98-b1f1-233df9ed345e","resolution":{"observed_at":"2026-08-04T01:06:54.316300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.387181Z","title":"2024 , note =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.387181Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:1f1d732521ff76f6a8edb0ee48dd75e2f328129bc09f21924f37d47c09e2a76b","observation_id":"e8d54210-1094-42df-9866-c3ce4b149d6a","resolution":{"observed_at":"2026-08-04T01:06:54.387181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.451553Z","title":"Two Tales of Persona in","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.451553Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:8e17112ca04cd115bdb38afff189f68645b10a96b7c616c1f0938e9582b57e23","observation_id":"54217a13-2285-49c6-8d18-1b34a26c0bca","resolution":{"observed_at":"2026-08-04T01:06:54.451553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.552236Z","title":"Personalized Reasoning: Just-In-Time Personalization and Why","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.552236Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f848768b02a28d203b5e3948a593e49d819bf28adb714e4177f2b7c82983840f","observation_id":"f0b52858-3ff9-44da-8508-b24d51cf9bdf","resolution":{"observed_at":"2026-08-04T01:06:54.552236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.647765Z","title":"arXiv preprint arXiv:2602.16173 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.647765Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b954ccbba08ed279c68b7d3948e744dc2054d87e7cc3ae8d1aa9892901f68598","observation_id":"c949b5bb-2c3a-4f19-be72-80f50b004925","resolution":{"observed_at":"2026-08-04T01:06:54.647765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.730897Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.730897Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:8a3cc22b89afcd64d6c3ba45887bbecf849703d827c13f39b0a1a0fe209ae287","observation_id":"a0c918d9-ecf5-49f6-907b-a8eb3e8057aa","resolution":{"observed_at":"2026-08-04T01:06:54.730897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.785864Z","title":"Clarify When Necessary: Resolving Ambiguity Through Interaction with","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.785864Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b8fcf1a5c2da72f697b6eb492790cf9a69c70b984c7957d829834b2efecfad95","observation_id":"a027c521-77dd-40e4-ab6f-fba1d96590a6","resolution":{"observed_at":"2026-08-04T01:06:54.785864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.859816Z","title":"2025 , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.859816Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:827b7702d36aa7fcbe54de2067339dfc9f9305f6711d8c1b17059e32980de0cf","observation_id":"35c1266c-0650-43df-9986-927e8f158bba","resolution":{"observed_at":"2026-08-04T01:06:54.859816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.925630Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.925630Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a68d54e4cb2a99df15727608cbc3fcace8db3763604693d64e8dae452c6fd46b","observation_id":"67d97c1b-9eac-4fad-b426-6cb2d7a369fb","resolution":{"observed_at":"2026-08-04T01:06:54.925630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.988828Z","title":"Measuring Mathematical Problem Solving with the","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.988828Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:4f56b63a669320b3bf15308addf8cc07a09b71dc0c4dc3256a57aed01ab7603c","observation_id":"1796b0b5-a8b1-43bc-8015-b2be1123e865","resolution":{"observed_at":"2026-08-04T01:06:54.988828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-04T01:06:55.047035Z","title":"arXiv preprint arXiv:2305.20050 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.047035Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:cffb9ee9352d6abd4bb0888ddb61c16a20bb0f3f32b2069c2eae0478d9dbdd1f","observation_id":"4ffc41f5-b55e-46f9-ae78-f198e97a2668","resolution":{"observed_at":"2026-08-04T01:06:55.047035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.120577Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.120577Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:c8b7aff86cce5ee45d7916feb1a9870163818e0d745201f36415c1a9b976cd8d","observation_id":"f51e124d-5f56-4024-8d98-5e50f9a25fff","resolution":{"observed_at":"2026-08-04T01:06:55.120577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.181318Z","title":"arXiv preprint arXiv:2601.02702 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.181318Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:afbd2646fbf5de630023aac636ea337f1dac3838387babcf9239346eb5670aee","observation_id":"90475b80-fa79-4686-b834-7711aaee6df5","resolution":{"observed_at":"2026-08-04T01:06:55.181318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.17886","last_updated":"2026-04-20T06:57:50Z","snapshot_observed_at":"2026-08-02T05:37:30.648992Z","submitted_at":"2026-04-20T06:57:50Z","title":"Latent Preference Modeling for Cross-Session Personalized Tool Calling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.17886","snapshot_observed_at":"2026-08-04T01:06:55.247493Z","title":"arXiv preprint arXiv:2604.17886 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.247493Z"},"links":{"cited_paper":"/paper/2604.17886","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:38b36a6a5ea5fd44da41da755f7ee8b92a24310bd2f331ca0ea1b590b3d2a9a4","observation_id":"4923894f-455a-466b-9552-2d3452bfac9d","resolution":{"observed_at":"2026-08-04T01:06:55.247493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.313620Z","title":"and Stoica, Ion and Gonzalez, Joseph E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.313620Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:dad2278ed731cbef11796127f58d98b90b876cb4f2a8e4a0334fdd6b1fa05f1a","observation_id":"5a94adb8-30cd-40cb-bcd4-550068a6d8e1","resolution":{"observed_at":"2026-08-04T01:06:55.313620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.360498Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.360498Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:beabd2600f7abbd2236a5f4f6bc7e5e1f00dc8d1ed03cacee40dda1bd7a8f609","observation_id":"ae67b765-3092-4616-b314-66d8ab5acd1f","resolution":{"observed_at":"2026-08-04T01:06:55.360498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.437828Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.437828Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:1894a37ca66a8f901770bf7e5d5ee2410459100e0639bcc1bee33bd9e9ee99df","observation_id":"4b4e6ecf-4d78-4d6c-964b-cba444220c78","resolution":{"observed_at":"2026-08-04T01:06:55.437828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.483793Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.483793Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a088fcc5f16ebac61d3aa89435db9609def2f25227a1d3a929717240ab8824fe","observation_id":"2e06a672-723f-4081-b4e6-15283f0df48a","resolution":{"observed_at":"2026-08-04T01:06:55.483793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.553820Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.553820Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:e1d1cea96d3dfac0df2202760670560201916ac343a2a970e80bb9283a5a2c0f","observation_id":"73d42ab3-ebed-46d1-96f2-8860e79d3ed9","resolution":{"observed_at":"2026-08-04T01:06:55.553820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.617594Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.617594Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:302d60b0d823b17701e7b29dfd77b5ed57eca8702bd744860580f54d2047c957","observation_id":"e348c941-d1e3-4cfb-b7de-95013af46cd9","resolution":{"observed_at":"2026-08-04T01:06:55.617594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.661295Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.661295Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:3ee1f62c34568e70fa40453410faa5ffbade45525219f5e6245681b213705076","observation_id":"604d4eff-99c6-4133-83ec-1f59c1ffa31a","resolution":{"observed_at":"2026-08-04T01:06:55.661295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10075","last_updated":"2024-08-19T15:18:30Z","snapshot_observed_at":"2026-08-09T20:26:15.885759Z","submitted_at":"2024-08-19T15:18:30Z","title":"Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10075","snapshot_observed_at":"2026-08-04T01:06:55.741495Z","title":"arXiv preprint arXiv:2408.10075 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.741495Z"},"links":{"cited_paper":"/paper/2408.10075","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:9ca45b37592cd5289ffa069acdd4729713f325cc9399a31b622e10aa398d4c8c","observation_id":"6541a1d8-99be-4956-8599-770a848228d5","resolution":{"observed_at":"2026-08-04T01:06:55.741495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.800844Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.800844Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f392d2be3ef2290f7f00c3c6ab2bb650b54e3e958fbec7049b3dabc15b33abf1","observation_id":"88cda4d4-0fab-4849-a077-4e4563fb25bd","resolution":{"observed_at":"2026-08-04T01:06:55.800844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.869399Z","title":", journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.869399Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b6aa29b9520e1b802813d6c7d31c50ec14f351c19e3a30c9a4626c723d2e8621","observation_id":"1e4a5041-a7ff-4559-964f-4341e2e6dbee","resolution":{"observed_at":"2026-08-04T01:06:55.869399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.963928Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.963928Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:eb955003cc886dae77b03722be0b26d1944b11f2156b6f7249be28853a7e48c0","observation_id":"d4c7a684-110a-4602-a85a-5f7ddab142b8","resolution":{"observed_at":"2026-08-04T01:06:55.963928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.044993Z","title":"Active Preference Optimization for Sample Efficient","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.044993Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:e877b0c4be4a74d2643ad9f0996c0eb23f6ae8926b5536bd39e99dc641490784","observation_id":"6bc595cc-29df-4b4c-8104-31324ecd2e6a","resolution":{"observed_at":"2026-08-04T01:06:56.044993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09401","last_updated":"2025-02-11T18:18:59Z","snapshot_observed_at":"2026-08-09T10:20:56.103315Z","submitted_at":"2024-02-14T18:58:40Z","title":"Reinforcement Learning from Human Feedback with Active Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09401","snapshot_observed_at":"2026-08-04T01:06:56.090015Z","title":"arXiv preprint arXiv:2402.09401 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.090015Z"},"links":{"cited_paper":"/paper/2402.09401","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:ca23251d38b4d0d003e1764560fa90af85e52e75c96d313b295e7ab42a176313","observation_id":"755b9f24-0268-4a2b-9487-2d017ca150c1","resolution":{"observed_at":"2026-08-04T01:06:56.090015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.163488Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.163488Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:8a27df3f55e5e229192a386f388ef6a90bb33fdff897a893290ca6db9f364ffb","observation_id":"53e80c3e-b6e4-4297-9baa-77c835e05044","resolution":{"observed_at":"2026-08-04T01:06:56.163488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.223953Z","title":"Proceedings of the 19th International Conference on World Wide Web (WWW) , pages =","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.223953Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:7f7713158363476f735dc58735b92ced9759979b759a331a139912870badd49b","observation_id":"00e9c827-4e42-4572-8460-9fb9d175886a","resolution":{"observed_at":"2026-08-04T01:06:56.223953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.264361Z","title":"Proceedings of the 26th International Conference on Artificial Intelligence and Statistics , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.264361Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:664bea44312a6e96838407fd48e043f562bab6f9e2f17749fc589cf2b96d9425","observation_id":"c810884e-96d2-467e-a7df-c85c6954e659","resolution":{"observed_at":"2026-08-04T01:06:56.264361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.341306Z","title":"and Murphy, Susan A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.341306Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:94757b472dc4fa6d5d584760a9d1764211010d3e0a115ee7ee3cd9cb383d0849","observation_id":"16761947-b99f-47e3-8ccb-1a6189ceb2cd","resolution":{"observed_at":"2026-08-04T01:06:56.341306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.424208Z","title":"Proceedings of the 37th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.424208Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:9f2bb36fb90b3738585367fc0a946bf893cd9c4e5bd7dc551038405662000c5b","observation_id":"384c7a6b-09c8-4197-8791-d0823252d957","resolution":{"observed_at":"2026-08-04T01:06:56.424208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.491811Z","title":"Advances in Neural Information Processing Systems , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.491811Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:aae68355ce2112a077dfe79540d599c396f9c2b52da09a4319b4169469166354","observation_id":"2f8534b5-66fd-4620-9a18-40204b71879f","resolution":{"observed_at":"2026-08-04T01:06:56.491811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.576356Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.576356Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:813fb47fdb77f4ca371240c552bd38e234cb29c34c04d081ec54c77caef881d2","observation_id":"26c92e7c-fe14-4383-8c5c-cd8abd5c0a3d","resolution":{"observed_at":"2026-08-04T01:06:56.576356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.644753Z","title":"Proceedings of the 35th International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.644753Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:39ce5594ddae131509bd524d2869002ffc3c91a01c182a9182e4d8cc6b111519","observation_id":"60a7a705-7cf8-498b-98ed-8c374bde6f03","resolution":{"observed_at":"2026-08-04T01:06:56.644753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.687019Z","title":"Proceedings of the 36th International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.687019Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:e192b62b82bc8a544f5145b8bf015cabdf7bab073a579379a6be95138927b705","observation_id":"1544815c-3bda-49ed-a1ef-3a147b23bce0","resolution":{"observed_at":"2026-08-04T01:06:56.687019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.777541Z","title":"Proceedings of the 39th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.777541Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:d8ce6f6392fc853ec4245d04d0e0f7831e6fcf5fd3123dc36cf39c92e4f7f90a","observation_id":"53bb0003-cbb0-4bc7-9e93-521db8398135","resolution":{"observed_at":"2026-08-04T01:06:56.777541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.838854Z","title":"Proceedings of the 26th International Conference on Artificial Intelligence and Statistics (AISTATS) , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.838854Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:80e85be1f7a081443a45f411a270100521289152978c0b2f555c02c828889018","observation_id":"1a0eca40-4040-4240-8cf2-ecba5b95b374","resolution":{"observed_at":"2026-08-04T01:06:56.838854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.883229Z","title":"Machine Learning , volume =","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.883229Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:980e3897713102e5a37cfec4370f510070b934ccd805d74c33a44146de5d3f3b","observation_id":"7620e837-da4c-4c72-9478-e6cf7e423be1","resolution":{"observed_at":"2026-08-04T01:06:56.883229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.937537Z","title":"arXiv preprint arXiv:2410.05362 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.937537Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:dbad6595d770c3517ae1d4b0126371071caf8dcdb22051db58c758bc7a26aa56","observation_id":"f0808da7-43ed-43aa-9798-72cc25d5ab8d","resolution":{"observed_at":"2026-08-04T01:06:56.937537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.985067Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.985067Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:8250146c56475d6965806cbfa46d240f120a6ce9bcb9358b6ac5f534cd7bc18a","observation_id":"b6552889-478a-4d14-bed7-10c84ebf258f","resolution":{"observed_at":"2026-08-04T01:06:56.985067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.096189Z","title":"Proceedings of the 30th International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.096189Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:7a0f5c7aaaa81b700676b7dfc1a64bd1c584b35c611de08b700818b54674f670","observation_id":"1faae8fe-8908-4419-a941-be439cfa19e9","resolution":{"observed_at":"2026-08-04T01:06:57.096189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.157059Z","title":"Proceedings of the 20th International Conference on Artificial Intelligence and Statistics (AISTATS) , pages =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.157059Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:6e62118ef1b51ae7d9bc79d31e920266f814b7e7d69e52cb2df35a11ea25346b","observation_id":"daa66893-1556-4d5b-a45b-5d2166ed4759","resolution":{"observed_at":"2026-08-04T01:06:57.157059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.193572Z","title":"Journal of Computational and Graphical Statistics , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.193572Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:cfc75e5ba4790cf60a4d4b904631265079df645eb585bf5b41d2d3642defee2d","observation_id":"605aa653-db09-4c8e-92e7-ee32f40bbd3e","resolution":{"observed_at":"2026-08-04T01:06:57.193572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.249778Z","title":"and Lanckriet, Gert R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.249778Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:883910fd7b3bbefe645fbb21c0d3f35fc6a0d07c34a3eaf3674bed3809ed6948","observation_id":"20cce504-814f-4231-a371-51ab5571773b","resolution":{"observed_at":"2026-08-04T01:06:57.249778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.301575Z","title":"Foundations and Trends in Machine Learning , volume =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.301575Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:2f7495f6d552e326f8e00739df92d53bbb2da5d790c0bfef76e01d85c97f7d77","observation_id":"c7e68f1c-da43-411b-8560-6b0c8cf7d415","resolution":{"observed_at":"2026-08-04T01:06:57.301575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.370676Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.370676Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:0cab137cf15cbb4be511c9258af5d46f420c8e2e8991e0c9832a30ecf07ce52d","observation_id":"40ae25fc-65c5-4c21-99bf-cc52851a93e9","resolution":{"observed_at":"2026-08-04T01:06:57.370676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.436451Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.436451Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:7236b5b81a0e55ced4c60a9cd20cf7526168d307f4ff458deedc8358a1c77914","observation_id":"94f8f073-60bd-46b4-b076-7a98e6bdf9d9","resolution":{"observed_at":"2026-08-04T01:06:57.436451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.486907Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.486907Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f0d1dbaff7eb1b5b71335a1b6a9ab5056374eb8a8d538204dad221b7e729dfb3","observation_id":"9fc7f19b-9ea8-4b04-a40d-20ceeaf0e32a","resolution":{"observed_at":"2026-08-04T01:06:57.486907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.552420Z","title":"Annals of Statistics , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.552420Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:4c1dbb938f4f8d48a0ce0499c11825876c811a3abb468e02ccc33f2686e770a5","observation_id":"48e3d454-eca7-436f-8c07-05a4c2bb9d5f","resolution":{"observed_at":"2026-08-04T01:06:57.552420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.594881Z","title":"Proceedings of the 37th International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.594881Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:0f6aa08043017745a0fa349fd4edabd247ec8eb65c2698c9fdf7dc7e988cb19e","observation_id":"14b41daf-a712-4661-9fa6-1e3be9c70607","resolution":{"observed_at":"2026-08-04T01:06:57.594881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.657991Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.657991Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:1fd908adf71faa22aa32ed3f3c6b146b1bad91922aa3f18a2fbc3b6fddc084b3","observation_id":"49e994a0-8efe-42cb-9ad4-efcf5d52ce25","resolution":{"observed_at":"2026-08-04T01:06:57.657991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.696621Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.696621Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b6856e7e9eb3707cd27998265b42b886583b92e0810bf79defc3c1bdb63f36f5","observation_id":"05b34efc-231d-4cf4-8507-5e423be2c152","resolution":{"observed_at":"2026-08-04T01:06:57.696621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.763081Z","title":"IEEE Transactions on Signal Processing , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.763081Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b7482d1977d74e1584226aeead07fb7eaf39ffcd1648dd75e90a703f99cf694e","observation_id":"b5c859e9-85ff-4fe2-8885-8e8a86ea4849","resolution":{"observed_at":"2026-08-04T01:06:57.763081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.807502Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.807502Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:651586833ac2dddbc3fe6f3485ca367ad773937f81e78c6e1fff59fc2f18ca7f","observation_id":"ada481aa-9360-47e7-b8a9-7d2739fbb04a","resolution":{"observed_at":"2026-08-04T01:06:57.807502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.869871Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.869871Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:8f2f7bb67e79f44b07b2090ef3e807eb62aa8eb49342af791c02639556762deb","observation_id":"ac82b3be-0969-4964-bcd7-c0136937385f","resolution":{"observed_at":"2026-08-04T01:06:57.869871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T10:21:11.238593Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":79,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 0 inbound Pith citation observations for arXiv:2608.00215."}