{"as_of":"2026-08-09T22:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0cc21b9c0ec72b502a526a3c5b1586d17e68fb90c61077bba34a1e96d41b8d03","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:17:53.524604Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05246/citation-record","integrity":"/paper/2608.05246/integrity","json":"/paper/2608.05246/citation-record.json","paper":"/paper/2608.05246"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5712.38099","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.740252Z","title":"Learning to reason for multi-step retrieval of personal context in personalized question answering","venue":null,"work_id":"fa2745d3-4dcc-4c7f-8fec-2c8db7ed3c6a","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.272051Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:d043195af876a2608776238ba53f7cbecf346bc858aa1b32083a0bb0f84a911a","observation_id":"cbe5b08b-a1a0-4570-84a2-5ea7da5335df","resolution":{"observed_at":"2026-08-08T17:17:54.748244Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.277727Z","title":"Large language models empowered personalized web agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.277727Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:b0a10a32c47158ff320bd74e99b417f5ebe5b94a5abb7323bceb79bf79413533","observation_id":"79ad8bfc-f4b9-429c-8877-4842ba5b5e35","resolution":{"observed_at":"2026-08-08T17:17:53.277727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08362","last_updated":"2026-05-21T16:20:11Z","snapshot_observed_at":"2026-08-02T15:20:13.753843Z","submitted_at":"2026-04-09T15:26:21Z","title":"Towards Real-world Human Behavior Simulation: Benchmarking Large Language Models on Long-horizon, Cross-scenario, Heterogeneous Behavior Traces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08362","snapshot_observed_at":"2026-08-08T17:17:53.283149Z","title":"Towards real-world human behavior simulation: Benchmarking large language models on long-horizon, cross-scenario, heterogeneous behavior traces, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.283149Z"},"links":{"cited_paper":"/paper/2604.08362","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:ee6657ef349126684f868c6c268a28377b0f5340cfbff580e8acb97efaaabff3","observation_id":"6b6bc56a-3184-44fe-a44e-f73234dc6201","resolution":{"observed_at":"2026-08-08T17:17:53.283149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08455","last_updated":"2026-04-09T16:50:50Z","snapshot_observed_at":"2026-07-06T22:57:31.046146Z","submitted_at":"2026-04-09T16:50:50Z","title":"KnowU-Bench: Towards Interactive, Proactive, and Personalized Mobile Agent Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08455","snapshot_observed_at":"2026-08-08T17:17:53.289378Z","title":"Knowu-bench: Towards interactive, proactive, and personalized mobile agent evaluation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.289378Z"},"links":{"cited_paper":"/paper/2604.08455","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:6e288289b68ce1c4cfc7195e2c092e298b3b6b6ecc4fe86a39efa16d9645c9ba","observation_id":"05ac2751-17c0-4bf0-90b6-984eefa4c23c","resolution":{"observed_at":"2026-08-08T17:17:53.289378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17881","last_updated":"2026-04-24T20:38:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-17T23:07:57Z","title":"POPI: Personalizing LLMs via Optimized Natural Language Preference Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.17881","snapshot_observed_at":"2026-08-08T17:17:53.294909Z","title":"Popi: Personalizing llms via optimized natural language preference inference, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.294909Z"},"links":{"cited_paper":"/paper/2510.17881","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:f373e8aaf303b9f6428128702f6fe9a669b6c4b83c0fc65123d506ca943eb7ff","observation_id":"647d158d-7195-422d-87bc-e353944c7d53","resolution":{"observed_at":"2026-08-08T17:17:53.294909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.301349Z","title":"Lifebench: A benchmark for long-horizon multi-source memory, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.301349Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:dc98f2fa78eb40d9a357f51c59000c6cdacbad7bd5adab0be71c07c6b8c889d3","observation_id":"5fa22ae1-bd35-49d5-a584-db57a9fdf609","resolution":{"observed_at":"2026-08-08T17:17:53.301349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-08T17:17:53.306961Z","title":"Mem0: Building production- ready ai agents with scalable long-term memory, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.306961Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:1305bf5436abb1404fd58f678be8738846753589c328069b98690261371b7d37","observation_id":"d566f43c-52a3-489b-b7d7-a44398374f6c","resolution":{"observed_at":"2026-08-08T17:17:53.306961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.117361Z","title":"Lifesim: Long-horizon user life simulator for personalized assistant evaluation","venue":null,"work_id":"3d00d75b-38ef-441f-bb5d-1868aca210e9","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.312072Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:455d02695fd52e54f05b37987e07f99328522c0bd19b4149708ae8bfc19417af","observation_id":"1f13e3a0-abd7-4c66-8078-1ab509693913","resolution":{"observed_at":"2026-08-08T17:17:55.125871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.095814Z","title":"A survey on personalized alignment—the missing piece for large language models in real-world applications","venue":null,"work_id":"79d842c9-ad99-4031-9da4-734d316e88f7","year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.316730Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:73de48e5466b6ea805d0c9fe3b5c7b28981cc02eae9263d5407c9d9c23a43f9f","observation_id":"015c68cd-1c79-4cd7-87f4-2dc8ef03ff31","resolution":{"observed_at":"2026-08-08T17:17:55.104016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.321693Z","title":"Towards realistic personalization: Evaluating long-horizon preference following in personalized user-llm interactions.arXiv preprint arXiv:2603.04191, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.321693Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:de7f5f95e3f9054df845eb5f252f4e3173a95543c97d05fd6a44a0c61ce6e6c9","observation_id":"2f3e4e44-ae26-4184-bf7f-b33dbd09a03a","resolution":{"observed_at":"2026-08-08T17:17:53.321693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.327020Z","title":"Computing inter-rater reliability and its variance in the presence of high agreement.British Journal of Mathematical and Statistical Psychology, 61(1):29–48, 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.327020Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:27387946cbdda69a1949d7b71b39e667c17f7b703564474613e7d680ce951788","observation_id":"5a833f00-6104-4aff-8872-1a955379b6ea","resolution":{"observed_at":"2026-08-08T17:17:53.327020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.068214Z","title":"Rap: Retrieval-augmented personal- ization for multimodal large language models","venue":null,"work_id":"e0b57890-38b1-4493-aba2-3a68f6541866","year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.331856Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:626c016c08cc9dd6f94ca0b9180d5ca1615ebdbfad5c5695345a048c4e3bcd70","observation_id":"4e65dcc8-0313-48e6-ba2f-143f54d7cea1","resolution":{"observed_at":"2026-08-08T17:17:55.074174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.19069","last_updated":"2026-05-15T00:52:26Z","snapshot_observed_at":"2026-08-02T14:30:17.101736Z","submitted_at":"2026-02-22T06:54:24Z","title":"Asking the Right Questions: Improving Reasoning with Generated Stepping Stones","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.19069","snapshot_observed_at":"2026-08-08T17:17:53.336566Z","title":"Asking the right questions: Improving reasoning with generated stepping stones, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.336566Z"},"links":{"cited_paper":"/paper/2602.19069","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:4d24a89d51fb12fcf24049d694b598677b3bc11555a2ad3838b9e1a6f0d3e6d6","observation_id":"56da7c87-ee3c-4df9-b752-e35cd45242dc","resolution":{"observed_at":"2026-08-08T17:17:53.336566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.342011Z","title":"Op-bench: Benchmarking over-personalization for memory-augmented personalized conversational agents.arXiv preprint arXiv:2601.13722, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.342011Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:a5df55ab9aaa33d4527dfb5a1c1f654f30e65ca78e706951675d08dbb954b54d","observation_id":"587f4df2-c4fc-4f95-8a4f-e51722811664","resolution":{"observed_at":"2026-08-08T17:17:53.342011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.049780Z","title":"Mem-pal: Towards memory-based personalized dialogue assistants for long-term user-agent interaction","venue":null,"work_id":"3e888168-f65f-457d-be34-d64430d31573","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.346834Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:31c4de0cd34557a73e9a9d9afaf76c861a968d66f89e516de142b266fb43009a","observation_id":"26d5f4ea-1045-4c42-a35a-452f625912d9","resolution":{"observed_at":"2026-08-08T17:17:55.056133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.352101Z","title":"Taylor, and Dan Roth","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.352101Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:da4ecc05dfe7bc9c58b80880988fff7cf2d457a6a8a9cb8b81570447e6b5fefc","observation_id":"fc44df1e-9e30-44e3-8dea-6c4ea85bddbd","resolution":{"observed_at":"2026-08-08T17:17:53.352101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.17003","last_updated":"2026-05-27T12:15:49Z","snapshot_observed_at":"2026-08-02T22:25:27.596476Z","submitted_at":"2026-02-19T01:54:26Z","title":"Persona2Web: Benchmarking Personalized Web Agents for Contextual Reasoning with User History","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.17003","snapshot_observed_at":"2026-08-08T17:17:53.356534Z","title":"Persona2web: Benchmarking personalized web agents for contextual reasoning with user history.arXiv preprint arXiv:2602.17003, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.356534Z"},"links":{"cited_paper":"/paper/2602.17003","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:240af5a1ad77d10b87389aa82eb6e33b794056c0a7ff80306f2ff184699da7d4","observation_id":"09fed038-012f-4d9a-a4e7-d0b7da1e84b5","resolution":{"observed_at":"2026-08-08T17:17:53.356534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0854.37802","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.155443Z","title":"Humanllm: Towards personalized understanding and simulation of human nature","venue":null,"work_id":"ad2396e7-4cd3-4b3e-a458-cd936ee6441c","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.361281Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:4eedc33b63aa0b4fcec17259ccb09c3e11aa6a2f4ddf8654aa02e45aced0f3df","observation_id":"1761f197-9cf5-44b7-9579-ff4770ea77d5","resolution":{"observed_at":"2026-08-08T17:17:54.163090Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.033695Z","title":"Retrieval-augmented genera- tion for knowledge-intensive nlp tasks","venue":null,"work_id":"efd172c3-8b65-4004-893f-14888c3b4cb6","year":2020},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.366074Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:3d9274839c53f3494d49aa34533d20099e9e301c3e3f414563bf2333eab9d240","observation_id":"3df11aa5-64a0-4e50-9c98-4ab4a69a979f","resolution":{"observed_at":"2026-08-08T17:17:55.039109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.015353Z","title":"Can llm agents simulate multi-turn human behavior? evidence from real online customer behavior data","venue":null,"work_id":"774a2550-6a43-405a-8763-2e54923e8bfb","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.370929Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:1adc76daa2b29245735acd7c1990efeb5297346743ff66a94f2b99cc92e0fdc1","observation_id":"0ec4ee73-f0bd-48d8-b716-81e5dd09304c","resolution":{"observed_at":"2026-08-08T17:17:55.021118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-lo","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.588437Z","title":"Exploring the potential of LLMs as person- alized assistants: Dataset, evaluation, and analysis","venue":null,"work_id":"ab2ccea5-7ee5-45d2-babf-048d0c2edef2","year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.375836Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:1b7f92a04fdbf8aeda847282d2bdc0bdab7689b27ab89a5a4ba9827a0a3f4ff9","observation_id":"1f0c53b9-6e91-4f50-94c1-229004c058e5","resolution":{"observed_at":"2026-08-08T17:17:53.595425Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.380675Z","title":"Privacybench: A conversational benchmark for evaluating privacy in personalized ai, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.380675Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:ff99b3d25d9c0d691ea25c06b670bef321145b39884951a154ddc2fd40d61902","observation_id":"d126780d-3f88-4567-a0a9-0fda6c6b59fc","resolution":{"observed_at":"2026-08-08T17:17:53.380675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13074","last_updated":"2026-03-20T17:59:57Z","snapshot_observed_at":"2026-07-06T23:01:10.333101Z","submitted_at":"2026-03-20T17:59:57Z","title":"PersonaVLM: Long-Term Personalized Multimodal LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13074","snapshot_observed_at":"2026-08-08T17:17:53.385274Z","title":"Personavlm: Long-term personalized multimodal llms","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.385274Z"},"links":{"cited_paper":"/paper/2604.13074","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:f4ffa9574360509154ad77c5fb78154ade8308dbdf9e662226579da8df24af43","observation_id":"ad1f9ba3-504a-4ab0-8a64-429516c6ef1e","resolution":{"observed_at":"2026-08-08T17:17:53.385274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05589","last_updated":"2025-03-03T16:49:18Z","snapshot_observed_at":"2026-08-08T18:40:28.575625Z","submitted_at":"2025-02-08T14:28:36Z","title":"On Memory Construction and Retrieval for Personalized Conversational Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05589","snapshot_observed_at":"2026-08-08T17:17:53.390227Z","title":"On memory construction and retrieval for personalized conversational agents.arXiv preprint arXiv:2502.05589, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.390227Z"},"links":{"cited_paper":"/paper/2502.05589","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:ac2e948a7c859a4e509ab24d3d2a739a5afb5548946169cd23f5d0119ad1aded","observation_id":"cb7d46fd-ed79-4425-ae21-9c923116454c","resolution":{"observed_at":"2026-08-08T17:17:53.390227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10109","last_updated":"2026-06-28T22:37:51Z","snapshot_observed_at":"2026-07-06T19:50:52.652955Z","submitted_at":"2024-11-15T11:14:34Z","title":"LLM Agents Grounded in Self-Reports Enable General-Purpose Simulation of Individuals","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10109","snapshot_observed_at":"2026-08-08T17:17:53.395160Z","title":"Zou, Jonne Kamphorst, Niles Egan, Aaron Shaw, Benjamin Mako Hill, Carrie Cai, Meredith Ringel Morris, Percy Liang, Robb Willer, and Michael S","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.395160Z"},"links":{"cited_paper":"/paper/2411.10109","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:ffa1b73df909582cf9c88837e68cd69922936e6e19b14e92983f74a3dd2b2175","observation_id":"a2e0a7b9-8a7c-4286-a73a-a35006f2af53","resolution":{"observed_at":"2026-08-08T17:17:53.395160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.998728Z","title":"Lamp-qa: A benchmark for personalized long-form question answering","venue":null,"work_id":"14be2afb-3d5b-4f99-ba85-3473af27312c","year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.400822Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:0cef6f2ef35e67c415600ab4a9c8c37d002734112997ff8e54276dc9ca7b89bd","observation_id":"c4df0f79-a0e7-40ed-aa7c-a6b0fc3768e0","resolution":{"observed_at":"2026-08-08T17:17:55.003847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.405758Z","title":"Optimization methods for personalizing large language models through retrieval augmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.405758Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:3a48270e6493c70e0e506f15b9fd33f407a8666dc1b7fd96372eb47d45037230","observation_id":"b7cb8012-50dc-419e-bf7d-a489e1e3d0e5","resolution":{"observed_at":"2026-08-08T17:17:53.405758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.982085Z","title":"Lamp: When large language models meet personalization","venue":null,"work_id":"df6b2097-a77f-4865-9582-4f0939c93351","year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.410357Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:a818eecc57ea2192b8f94f7b00c0e7660f112a69fd96c26e3a14f948b688c23a","observation_id":"636e4262-22b5-469c-be69-20b8decfc0c2","resolution":{"observed_at":"2026-08-08T17:17:54.987973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.414867Z","title":"PersonaBench: Evaluating AI models on understanding personal information through accessing (synthetic) private user data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.414867Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:8dd583569c7f037e502adad6366c02781499d580bd536e75674ac9bc2ea7bf23","observation_id":"63cdc21d-4945-41e9-b83a-2d50e16f610b","resolution":{"observed_at":"2026-08-08T17:17:53.414867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.955895Z","title":"Democratizing large language models via personalized parameter-efficient fine-tuning","venue":null,"work_id":"1a61e4ba-afe6-4e8f-9547-33c36d39d6b4","year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.419312Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:6a40aa91687ed634bc4bf7213c2fcc61674b2cd1427dd9dbdda1b0a6f4705550","observation_id":"ad19aebd-878a-49c0-a267-9cf724497249","resolution":{"observed_at":"2026-08-08T17:17:54.961165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.940958Z","title":"In prospect and retrospect: Reflective memory management for long-term personalized dialogue agents","venue":null,"work_id":"ac8e1a19-5c60-410a-940b-8e19849989a1","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.424373Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:89525435f82f66578e8ea0b1db4ebc229b4e04c8b6465b798a36a5ce25ba116b","observation_id":"5e34d33a-f1a6-4e94-88bc-38449f3a8511","resolution":{"observed_at":"2026-08-08T17:17:54.945799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12915","snapshot_observed_at":"2026-08-08T17:17:53.434087Z","title":"Personafeedback: A large-scale human-annotated benchmark for personalization, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.434087Z"},"links":{"cited_paper":"/paper/2506.12915","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:7b0a8bf67b188ba52970168396162c4e65359a117ac82870230b4d8f74da1fd2","observation_id":"cba440d3-9b69-45e2-a3f3-0aa57e8bb554","resolution":{"observed_at":"2026-08-08T17:17:53.434087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.acl-long.2033","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.923604Z","title":"OPeRA: A dataset of observation, persona, rationale, and action for evaluating LLMs on human online shopping behavior simulation","venue":null,"work_id":"6b6253b8-f5e1-41b6-8c45-a580d0111cd0","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.438950Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:eb45b8eb030a7c500ed26683c028240e10d9b54719fbf0aabb8cd7728741c1fc","observation_id":"d24e8727-09ee-4441-ab20-6213f38d17de","resolution":{"observed_at":"2026-08-08T17:17:54.930558Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14245","last_updated":"2025-10-02T11:31:47Z","snapshot_observed_at":"2026-08-09T05:14:36.079509Z","submitted_at":"2025-06-17T07:06:56Z","title":"Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14245","snapshot_observed_at":"2026-08-08T17:17:53.443925Z","title":"Reinforcement learning with verifiable rewards implicitly incentivizes correct reasoning in base llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.443925Z"},"links":{"cited_paper":"/paper/2506.14245","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:5cb0cafd2e559e2665e98a10ccca854baacca7f63108633d7544cddb77505cd1","observation_id":"d7cabc12-5fd3-4ad5-9e9c-693f2d03cd75","resolution":{"observed_at":"2026-08-08T17:17:53.443925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.22877","last_updated":"2026-06-22T05:41:20Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T05:41:20Z","title":"DynamicMem: A Long-Horizon Memory Benchmark in Real-World Settings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.22877","snapshot_observed_at":"2026-08-08T17:17:53.448806Z","title":"Dynamicmem: A long-horizon memory benchmark in real-world settings, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.448806Z"},"links":{"cited_paper":"/paper/2606.22877","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:2553337000e0fdcec7028e9d70bd7785e9277e9df9713222cb3470f213626b06","observation_id":"1636cc8f-8755-4d64-a7a7-2d33cc89459b","resolution":{"observed_at":"2026-08-08T17:17:53.448806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.907058Z","title":"Lauvrak, Jon Atle Gulla, and Heri Ramampiaro","venue":null,"work_id":"504c760b-56c3-4376-a448-a0b0034b989d","year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.453682Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:0cddd35c6a8a940afaabdf426c58d29861e083a86cd5cd1fa25657cb4ee0c9f5","observation_id":"294eab45-e44f-4b36-b70a-debc93e08f27","resolution":{"observed_at":"2026-08-08T17:17:54.913126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.459192Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.459192Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:58d22dc99e4113ec38b6a84af71043c3259456409731b409367a529a11569982","observation_id":"d87058c1-ad0c-498c-956d-3ab710d15acf","resolution":{"observed_at":"2026-08-08T17:17:53.459192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5712.38096","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.730742Z","title":"Promax: Exploring the potential of llm-derived profiles with distribution shaping for recommender systems","venue":null,"work_id":"a735a1a0-3624-467d-8ef5-0046e51c4704","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.464402Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:2faad0c944569141394c126815d8d7e88cc13e1e4aff7a62b5281db3a71f3e11","observation_id":"19ce0ba7-0d2c-4154-8a0b-359a578a26b8","resolution":{"observed_at":"2026-08-08T17:17:53.739143Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09597","last_updated":"2025-02-13T18:52:03Z","snapshot_observed_at":"2026-08-07T20:50:37.813735Z","submitted_at":"2025-02-13T18:52:03Z","title":"Do LLMs Recognize Your Preferences? Evaluating Personalized Preference Following in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09597","snapshot_observed_at":"2026-08-08T17:17:53.469368Z","title":"Do llms recognize your preferences? evaluating personalized preference following in llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.469368Z"},"links":{"cited_paper":"/paper/2502.09597","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:fa507700217cea5a0df5b8c55e43c4102ad95f24c65019d67031f078624b8d56","observation_id":"adffac51-bba2-4278-aec2-65d48b3e81bd","resolution":{"observed_at":"2026-08-08T17:17:53.469368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.474220Z","title":"Cohen, and Emine Yilmaz","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.474220Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:078ea60c8f42b34e6ae63ef8091cc3d8642a334ae1d50aacf6b37400f788ce0c","observation_id":"d0a33fd7-19bc-4d37-b060-191a6d177e0e","resolution":{"observed_at":"2026-08-08T17:17:53.474220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.479258Z","title":"Cantonese cuisine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.479258Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:261575c77d17f9868f9dbf78818dab1bb8f0cd203deb70058db4dcdd40dfc824","observation_id":"3bef6ec4-4c44-4604-9663-e53fa6a84e70","resolution":{"observed_at":"2026-08-08T17:17:53.479258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.891465Z","title":"You tend toward budget-conscious choices","venue":null,"work_id":"224b45ff-de6c-46b2-8dbc-1328ecb8a996","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.485499Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:a7849fc704a2041d336d53d33762b7bd09b2fa8675eb34cccc1627bd71c20290","observation_id":"46159ad9-2549-44f9-819d-091c4950fd99","resolution":{"observed_at":"2026-08-08T17:17:54.896381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.875143Z","title":"Note that cross-domain references serving the response are legitimate; offense occurs only when references are purely demonstrative","venue":null,"work_id":"a62a715e-8181-4ebf-9ad4-de0d203fb406","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.490402Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:c6c7258598b718d9a67f709f71d559639c520e9d9b11eefb6c63636d07e807c9","observation_id":"cbacb1d9-02bc-4d7d-911f-7b2fd1fbb502","resolution":{"observed_at":"2026-08-08T17:17:54.880274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.858992Z","title":"educate\" the user, such as","venue":null,"work_id":"5f9321c1-7208-4e07-aa70-c27b97c57873","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.495608Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:8c595e0aeb51cf85c7e10cdece42f7e5a14ad4695bcc2b0242381cc1d9024f07","observation_id":"91dd12f4-3f53-478f-99a7-0b60caec758d","resolution":{"observed_at":"2026-08-08T17:17:54.863931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.842049Z","title":null,"venue":null,"work_id":"aa6058c1-9c95-4cd4-9f79-d8a35e4a8275","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.500517Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:440d49d944695c25db87d63330c204cf348922ff176f19916d1170c16ef54956","observation_id":"8d064032-1750-4f6c-9512-85b3a0f62214","resolution":{"observed_at":"2026-08-08T17:17:54.848030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.825360Z","title":null,"venue":null,"work_id":"e4ff4688-e2a8-4bd4-a70a-f6f8467601fa","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.505050Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:1e1d247432d8e15b85c5a3066c3ce2e030dfcfc2617cbf0f21850f23a3334e87","observation_id":"ad1790ac-5891-4b0f-ad40-1fab75938661","resolution":{"observed_at":"2026-08-08T17:17:54.830944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.810080Z","title":"retrieval","venue":null,"work_id":"e6a52abf-cea0-48de-beab-4f810ee83bb2","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.509773Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:e5c48993eaa0fa194a9f5dc0f04fdd7eaed1dce858aa53d79eba1159f743c5b8","observation_id":"177d19fa-f24d-4b90-bd51-6c8034977286","resolution":{"observed_at":"2026-08-08T17:17:54.815062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.793331Z","title":"swap test","venue":null,"work_id":"37500662-6f87-4df2-ba91-8d2ba6533b2e","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.515287Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:caa76224378fe1f798c5a73a849a26f32adde975bca2560005529cd7a00089c9","observation_id":"c704c8f8-0641-4b77-8a85-e02176aefcae","resolution":{"observed_at":"2026-08-08T17:17:54.799387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.776666Z","title":null,"venue":null,"work_id":"37ccff61-6ea6-4650-85cc-c6de06fd33e5","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.519873Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:5b49c0320309d9e6ea770e79de5e53ffa7ecbb8b152fcc7b5302b9ce7e10810a","observation_id":"f44d3304-2982-4065-862d-6d738a01164c","resolution":{"observed_at":"2026-08-08T17:17:54.781914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.761146Z","title":"retrieval","venue":null,"work_id":"edbd1a2c-db6d-4231-8f43-2d1a365ee546","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.524604Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:e8e97a5ad9a1f5997f5cf4f130c81feafa34b8327cb541467bc315bb377ed230","observation_id":"7f5c301d-97ed-471f-a7b4-055c5b9993f3","resolution":{"observed_at":"2026-08-08T17:17:54.765834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.429103Z","title":"ISBN 979-8-89176-251-0","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.429103Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:9da8f1fcf0c35e4925d706206f291846c90f2e20ed699c390034d17b3ecbcbc9","observation_id":"0e0385c0-3997-4f02-8d7f-73c7f45ff40a","resolution":{"observed_at":"2026-08-08T17:17:53.429103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T22:10:31.246237Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":29,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2608.05246."}