{"as_of":"2026-08-16T16:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bba327f7618bdc2cac696dcfbc4fc778e5f45d4c0b41f404b165a959f032eb82","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:43:23.733585Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:13:26.701496Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T09:54:34.994786Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-08-03T00:13:26.701496Z","title":"A., Dernoncourt, F., Kveton, B., Wu, J., Yu, T., Song, L., Yang, T., Qin, Y ., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11351","last_updated":"2026-06-28T23:49:44Z","snapshot_observed_at":"2026-08-13T00:03:13.729408Z","submitted_at":"2026-02-11T20:40:43Z","title":"Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T00:13:26.701496Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2602.11351"},"observation_digest":"sha256:9f9b16ef3901d2aae6b868611a3dddd9308c8b6f9daf9365f36948d203d70e0d","observation_id":"bd3124c4-1797-4d42-9b63-7bc0125cb811","resolution":{"observed_at":"2026-08-03T00:13:26.701496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2604.17299","last_updated":"2026-08-13T07:58:00Z","snapshot_observed_at":"2026-08-16T16:09:41.674746Z","submitted_at":"2026-04-19T07:29:37Z","title":"Cat-DPO: Category-Adaptive Safety Alignment","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T05:33:32.642379Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2604.17299"},"observation_digest":"sha256:b28c343081c6800843f7a1641da4ae87699d543a743c3b04dce72ab980d8742d","observation_id":"84a226cc-6e86-4bcb-af97-65ad555a9fe3","resolution":{"observed_at":"2026-05-10T05:36:01.741205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2604.24977","last_updated":"2026-04-27T20:22:42Z","snapshot_observed_at":"2026-08-14T09:15:57.722099Z","submitted_at":"2026-04-27T20:22:42Z","title":"A Survey on LLM-based Conversational User Simulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T03:21:09.118243Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2604.24977"},"observation_digest":"sha256:1c3927dad82cd4e0e2fd62ff1877b727603bff3862ae54c9fb1fe922a18c6150","observation_id":"e0113f25-a5ff-4824-a94c-1ed1365b7eda","resolution":{"observed_at":"2026-05-11T22:11:12.091734Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2604.26247","last_updated":"2026-04-29T03:04:43Z","snapshot_observed_at":"2026-08-15T22:14:18.914291Z","submitted_at":"2026-04-29T03:04:43Z","title":"TimeMM: Time-as-Operator Spectral Filtering for Dynamic Multimodal Recommendation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-07T12:54:56.401350Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2604.26247"},"observation_digest":"sha256:859d895741a367b7216c0943f0b128414b3b588ec0f8064ae0b5dd3dd5954e80","observation_id":"18109681-da7c-4dc8-9741-66ce23d3569d","resolution":{"observed_at":"2026-05-12T09:06:26.182424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2605.12995","last_updated":"2026-05-13T04:52:33Z","snapshot_observed_at":"2026-08-08T23:50:01.801764Z","submitted_at":"2026-05-13T04:52:33Z","title":"F-GRPO: Factorized Group-Relative Policy Optimization for Unified Candidate Generation and Ranking","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-14T19:51:45.657658Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2605.12995"},"observation_digest":"sha256:a7d6fe0242695689c64a5cc8d6f6f7f44844d5b98d06decd06cc0ee24c912433","observation_id":"7364afbf-13de-463a-8464-87a822720ec4","resolution":{"observed_at":"2026-05-14T19:52:52.347650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":"2505.14106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-06-30T09:54:34.994786Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":"e22ac993-3402-485d-9e4a-4bdbe3806480","year":2025},"citing_paper":{"arxiv_id":"2606.28739","last_updated":"2026-06-27T05:26:43Z","snapshot_observed_at":"2026-08-08T08:45:01.144647Z","submitted_at":"2026-06-27T05:26:43Z","title":"Agent Safety Is Action Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T09:50:45.759936Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2606.28739"},"observation_digest":"sha256:de0e928528b7b1e2471f293993f3be28943220679027c4b66ea736f5b5518ef6","observation_id":"bfa57893-7f3d-4d52-96d5-3d73151bf6d4","resolution":{"observed_at":"2026-06-30T09:54:34.996301Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14106","snapshot_observed_at":"2026-08-02T13:17:09.892437Z","title":"A personalized conversational benchmark: Towards simulating personalized conversations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20471","last_updated":"2026-05-23T18:16:54Z","snapshot_observed_at":"2026-08-08T12:05:38.339472Z","submitted_at":"2026-05-23T18:16:54Z","title":"Benchmarking the Personalization Capabilities of Large Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T13:17:09.892437Z"},"links":{"cited_paper":"/paper/2505.14106","citing_paper":"/paper/2607.20471"},"observation_digest":"sha256:7bb60cc5883a6d58e3511489cbd4a6fcd30a63faaeda3275a895a97ef5834c70","observation_id":"b7a42867-3b8e-4f87-b3a1-afb6ee7d0ab8","resolution":{"observed_at":"2026-08-02T13:17:09.892437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14106/citation-record","integrity":"/paper/2505.14106/integrity","json":"/paper/2505.14106/citation-record.json","paper":"/paper/2505.14106"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.02374","last_updated":"2024-09-25T04:50:38Z","snapshot_observed_at":"2026-08-16T14:55:21.683104Z","submitted_at":"2023-10-03T18:54:10Z","title":"Conversational Health Agents: A Personalized LLM-Powered Agent Framework","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02374","snapshot_observed_at":"2026-08-07T15:43:18.519445Z","title":"Conversational health agents: A personalized llm-powered agent framework.arXiv preprint arXiv:2310.02374, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.519445Z"},"links":{"cited_paper":"/paper/2310.02374","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:7109910044e20b9ba0c5c750e7debc99b37a44fbb98e6baccdc2de8833fa56bf","observation_id":"e9861fdb-99de-45c2-8df0-515c31a77adb","resolution":{"observed_at":"2026-08-07T15:43:18.519445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.970634Z","title":"Persobench: Benchmarking personalized response generation in large language models, 2024","venue":null,"work_id":"98387acb-cf0a-4f8d-a1be-1d1de909783b","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.625291Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:2980aaaa362485eac8efcb1d63db53188c69de945e648d87a02da6ea592afdcc","observation_id":"e00bf5c9-bc0c-47b8-b2f7-cd2eb10dc9d3","resolution":{"observed_at":"2026-08-07T15:43:35.054834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.853636Z","title":"Claude 3.5 sonnet","venue":null,"work_id":"f3a89ee0-da79-4235-b5e0-3fbdb5a09d26","year":null},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.729628Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:144997244e132e39add4a81757783ce9790a63c4e80e812288b3923cf3a49304","observation_id":"03167942-a7e7-48c2-bf1e-e6ae533ea020","resolution":{"observed_at":"2026-08-07T15:43:34.909324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13098","last_updated":"2025-08-20T01:59:58Z","snapshot_observed_at":"2026-08-16T13:08:36.779811Z","submitted_at":"2024-10-17T00:04:02Z","title":"A Little Human Data Goes A Long Way","version":3},"cited_work":{"arxiv_id":"2410.13098","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.13098","snapshot_observed_at":"2026-08-07T15:43:25.050204Z","title":"A Little Human Data Goes A Long Way","venue":"cs.CL","work_id":"0ae1a525-0d3c-4cb2-b17c-bcb92f477433","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.993776Z"},"links":{"cited_paper":"/paper/2410.13098","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:727ce7f51e4a03068aca07025ec173fdcfb2f9899468341fbedeef475433149b","observation_id":"237bf522-348b-4651-a528-b532151c0119","resolution":{"observed_at":"2026-08-07T15:43:25.276669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02157","last_updated":"2025-05-31T06:33:39Z","snapshot_observed_at":"2026-08-15T05:50:25.652046Z","submitted_at":"2025-01-04T01:46:49Z","title":"Personalized Graph-Based Retrieval for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02157","snapshot_observed_at":"2026-08-07T15:43:19.113061Z","title":"Personalized graph-based retrieval for large language models.arXiv preprint arXiv:2501.02157, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.113061Z"},"links":{"cited_paper":"/paper/2501.02157","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:983be11d190b352f3859d86a4db834767a1988a4e40a3e8dba28cd2e5d9b1b6c","observation_id":"c3e01726-ba8e-4cf9-b027-26cfc2176d36","resolution":{"observed_at":"2026-08-07T15:43:19.113061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:19.244719Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with human judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.244719Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:6b33e9b42761f3800add7b19cbc9f772cd68dca1e3eaf6f9a63fbe7a15a86e57","observation_id":"03232c27-8236-4033-b7d8-f3d2f54d19af","resolution":{"observed_at":"2026-08-07T15:43:19.244719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14439","last_updated":"2025-04-20T01:16:24Z","snapshot_observed_at":"2026-08-16T11:46:45.122909Z","submitted_at":"2025-04-20T01:16:24Z","title":"LoRe: Personalizing LLMs via Low-Rank Reward Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14439","snapshot_observed_at":"2026-08-07T15:43:19.367275Z","title":"Lore: Personalizing llms via low-rank reward modeling.arXiv preprint arXiv:2504.14439, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.367275Z"},"links":{"cited_paper":"/paper/2504.14439","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:7dac0d794ca5057d52e70131f9e78b8869dcd816faf9be8de62df35a42cfcbb7","observation_id":"a903f797-26e0-48dc-b27f-1e35298c32d9","resolution":{"observed_at":"2026-08-07T15:43:19.367275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.374501Z","title":"Optimal classifier for imbalanced data using matthews correlation coefficient metric.PloS one, 12(6):e0177678, 2017","venue":null,"work_id":"a07af7bd-b88e-47ff-bb89-a15f4c6973ff","year":2017},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.513223Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:dd84c6df4802ae8731e95802957e8cb942fde670f85979c7408653e12e02db97","observation_id":"a8722fdf-21c2-468e-b36a-a02ebb7c345c","resolution":{"observed_at":"2026-08-07T15:43:34.490084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.163786Z","title":"Beyond prompts: Dy- namic conversational benchmarking of large language models","venue":null,"work_id":"06bafede-54a0-43f1-afb9-db77e1998b6d","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.655393Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:2c435f17fbea21a72fb2c98540681decd6b94a25987ecbca9f3d3c70b2f050fe","observation_id":"74b080f6-b2ed-42c0-a046-72636d8e93b4","resolution":{"observed_at":"2026-08-07T15:43:34.268054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.037013Z","title":"Root mean square error (rmse) or mean absolute error (mae).Geoscientific model development discussions, 7(1):1525–1534, 2014","venue":null,"work_id":"9491670d-cc52-4841-89a7-85604ea46eea","year":2014},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.807578Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:3861f67e6ba146e7f76e3056eafe90de838617277e140bcb662188d1290c3a04","observation_id":"f3e6934d-15cb-4155-9c60-ad8fd8a2b49f","resolution":{"observed_at":"2026-08-07T15:43:34.075713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:19.894818Z","title":"When large language models meet personalization: Perspectives of challenges and opportunities.World Wide Web, 27(4):42, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:19.894818Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:899c4392f7260acc20bc00e5b2c8e6ca8ec8b291372f4114b3af9b404ea74692","observation_id":"2ef064e0-e58f-4565-9410-fc52a2f1045c","resolution":{"observed_at":"2026-08-07T15:43:19.894818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18792","last_updated":"2025-06-01T02:21:49Z","snapshot_observed_at":"2026-08-16T12:47:19.142867Z","submitted_at":"2025-03-24T15:39:25Z","title":"REALM: A Dataset of Real-World LLM Use Cases","version":2},"cited_work":{"arxiv_id":"2503.18792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18792","snapshot_observed_at":"2026-08-07T15:43:24.714360Z","title":"REALM: A Dataset of Real-World LLM Use Cases","venue":"cs.HC","work_id":"cd4b7a0e-78ad-400f-b87f-35295911301b","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.033370Z"},"links":{"cited_paper":"/paper/2503.18792","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:7a3ba306ce3c3a731d8bdf3b8ed6ea299227e21abe9b1fe932dc5ed2a378838e","observation_id":"3cc7d673-0b61-4547-aa25-30019abbd5a8","resolution":{"observed_at":"2026-08-07T15:43:24.811302Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.840320Z","title":"The advantages of the matthews correlation coefficient (mcc) over f1 score and accuracy in binary classification evaluation.BMC genomics, 21:1–13, 2020","venue":null,"work_id":"630a9c18-e5c4-46a1-aad9-ee318520cc70","year":2020},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.144923Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:640deff4ece4a55c0a4ff56eb2843ca911c580e9800bb83e7d8a978d69d151aa","observation_id":"4e070871-557d-43a0-adea-d59997ee4ab3","resolution":{"observed_at":"2026-08-07T15:43:33.909265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.694875Z","title":"The matthews correlation coefficient (mcc) is more informative than cohen’s kappa and brier score in binary classification assessment","venue":null,"work_id":"1f1c8f5d-1996-4d9e-b620-61b5a600e809","year":2021},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.324986Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:c75159ac2f47a27ba9851920edbe2f6b1fd53a2bf2fe39406db2bdde5c4df3a6","observation_id":"b06db013-27d0-4816-9cb6-68ce7003e4d0","resolution":{"observed_at":"2026-08-07T15:43:33.761772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.501745Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":"48788f1e-fe12-4087-9e51-798b7636b4ba","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.465431Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:7dba2d3d0df56b3a2055b04b6846844dead04bc21b4cc90895397f9ca943306b","observation_id":"88126155-e729-4f8f-8fc5-f140559fa286","resolution":{"observed_at":"2026-08-07T15:43:33.595175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11431","last_updated":"2021-11-22T18:59:34Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:34Z","title":"RedCaps: web-curated image-text data created by the people, for the people","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11431","snapshot_observed_at":"2026-08-07T15:43:20.580260Z","title":"Redcaps: Web-curated image-text data created by the people, for the people.arXiv preprint arXiv:2111.11431, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.580260Z"},"links":{"cited_paper":"/paper/2111.11431","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:bfae73427b05a9f927ffd1804cd1e5711ed274b15b24e551933d4b4c9f9ee17d","observation_id":"c48a18f2-6a9e-40d5-b11d-dd9a31c50a36","resolution":{"observed_at":"2026-08-07T15:43:20.580260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:20.662819Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.662819Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:4f451a0792e37613ef9df7e8a13f932d16f87c92f8b1187b2194eaea74525ce5","observation_id":"9a06c4d6-7fac-4a12-a0aa-9fc9e604ac27","resolution":{"observed_at":"2026-08-07T15:43:20.662819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05664","last_updated":"2022-01-25T14:25:42Z","snapshot_observed_at":"2026-08-14T17:27:03.425851Z","submitted_at":"2021-06-10T11:27:47Z","title":"Ruddit: Norms of Offensiveness for English Reddit Comments","version":3},"cited_work":{"arxiv_id":"2106.05664","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.05664","snapshot_observed_at":"2026-08-07T15:43:24.381644Z","title":"Ruddit: Norms of Offensiveness for English Reddit Comments","venue":"cs.CL","work_id":"f25e3287-2148-4841-9f3c-ee29076350d2","year":2021},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.731343Z"},"links":{"cited_paper":"/paper/2106.05664","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:765c91a9465e14864c0d3d77df7ba73388572d469564871457a08c19e4f318fa","observation_id":"850ceb35-110c-4dc9-9b9a-a27a373e84d2","resolution":{"observed_at":"2026-08-07T15:43:24.552148Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.299446Z","title":"Root mean square error (rmse) or mean absolute error (mae): When to use them or not.Geoscientific Model Development Discussions, 2022:1–10, 2022","venue":null,"work_id":"f2edf890-0336-47fd-930e-6f3e5f7edfb1","year":2022},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.867591Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:67daca150104b2cc0021c7cc491692dc21a3685dbb8b63dc319f39024c11fb3a","observation_id":"194d8e5f-4214-4e7e-bfc7-0a4e1ee518eb","resolution":{"observed_at":"2026-08-07T15:43:33.382963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:33.053190Z","title":"Rossi, Franck Dernoncourt, Hanieh Deilamsalehy, Xiang Chen, Ruiyi Zhang, Shubham Agarwal, Nedim Lipka, Chien Van Nguyen, Thien Huu Nguyen, and Hamed Zamani","venue":null,"work_id":"8bad4310-e576-4005-928b-e8ac213acaf3","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:20.984363Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:1f34f85552d66d4efb8244f2097da7d0628eb07d401b1b82c536d7db27316dd9","observation_id":"e4f4b3bd-d184-45bd-9946-d970bf281d4c","resolution":{"observed_at":"2026-08-07T15:43:33.165335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.783249Z","title":"Mt-eval: A multi-turn capabilities evaluation benchmark for large language models, 2024","venue":null,"work_id":"7a52fe2e-5c5e-4fbd-8158-42d46be81aa6","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.117526Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:1e95f4527be2ce37912af6f82e933629317892c077ffa4ffff7fd87b1e618531","observation_id":"570f0968-3ae8-4466-8fbe-45f11d61adc4","resolution":{"observed_at":"2026-08-07T15:43:32.936888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.556378Z","title":"A framework for building adaptive intelligent virtual assistants","venue":null,"work_id":"3e8b8e55-bc28-49fe-b5ee-e45a483c951a","year":2014},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.243210Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:d46e4f488928d51b26e32e62d67054774681c149ea6df7662b335ab6a717e362","observation_id":"b6daae78-9455-4ebb-ac01-1c48db55eb46","resolution":{"observed_at":"2026-08-07T15:43:32.672196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07968","last_updated":"2023-08-15T18:06:23Z","snapshot_observed_at":"2026-08-16T15:08:17.088300Z","submitted_at":"2023-08-15T18:06:23Z","title":"Teach LLMs to Personalize -- An Approach inspired by Writing Education","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07968","snapshot_observed_at":"2026-08-07T15:43:21.349336Z","title":"Teach llms to personalize–an approach inspired by writing education","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.349336Z"},"links":{"cited_paper":"/paper/2308.07968","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:7374e10382a483688009168e14661774a42605b27ac5b80bf700d595aae85e88","observation_id":"77ecc1ea-0684-4054-b46c-9b666cf43b3c","resolution":{"observed_at":"2026-08-07T15:43:21.349336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.353520Z","title":"Panoptic scene graph generation with semantics-prototype learning.Proceedings of the AAAI Conference on Artificial Intelligence, 38(4):3145–3153, Mar","venue":null,"work_id":"d1834181-2410-44c3-9537-49883fe17556","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.487031Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:044bf5b57938bd0ac64ee80457c61d9e41eaeda8e825a2ba9316efe82a4cdd08","observation_id":"1945642b-fd5f-49bf-a9bd-77d49420dab2","resolution":{"observed_at":"2026-08-07T15:43:32.437751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:32.122265Z","title":"Artificial intelligence in intelligent tutor- ing systems toward sustainable education: a systematic review.Smart Learning Environments, 10(1):41, 2023","venue":null,"work_id":"5f77079c-2170-42b1-a287-cc420060a954","year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.584797Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:d139b9614062408a480c492c1d2fa64c0a3100e8b35135db7e804b26dea7d495","observation_id":"62133eab-494d-409c-9d3b-59c8a7b733aa","resolution":{"observed_at":"2026-08-07T15:43:32.240242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:21.651056Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.651056Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:9fd4dbae98b9bd191933eae02814cffac4b7e8b9a84f58e8ac1b400ec72c11b2","observation_id":"955fdb45-569b-4517-b7be-6a5169debecc","resolution":{"observed_at":"2026-08-07T15:43:21.651056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.902701Z","title":"Persona-sq: A personalized suggested question generation framework for real-world documents, 2024","venue":null,"work_id":"4b10660b-b50e-4b80-a9f5-9a594bee6f62","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.760648Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:8cdfaece869eae4800725b6888c5fd8baf7358606a548c272bcf11c92da11b48","observation_id":"646fc09e-b860-47e2-a683-92459fac4bb5","resolution":{"observed_at":"2026-08-07T15:43:31.971000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.748810Z","title":"Soda-eval: Open-domain dialogue evaluation in the age of llms, 2024","venue":null,"work_id":"a3bb60a4-334c-491c-be0d-dad640383b3f","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.906459Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:91966d504b8bc371e7b17b71919f0d293dd36b79e1a5c62bd2f7d981a5ffdbe4","observation_id":"9533affa-216e-4632-8ac6-64befd694cc9","resolution":{"observed_at":"2026-08-07T15:43:31.829533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.583833Z","title":"Gpt-4o mini: advancing cost-efficient intelligence","venue":null,"work_id":"44409d9e-8870-4d9e-a534-62ceb4fd3148","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:21.975869Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:fec6b37929a4e72f47fec49359f89023787ed13d16f7ffa76351de54d5dd1ab8","observation_id":"a054c5ee-571e-44a1-bd79-40f20b53da15","resolution":{"observed_at":"2026-08-07T15:43:31.643229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.383539Z","title":"Introducing gpt-4.1 in the api","venue":null,"work_id":"da882a89-cccd-44c0-b546-0dc4ba952db8","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.043964Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:0ba2624a19c78a667245f6850ed8af35492846c69ba3a9d2924dbc729a23e276","observation_id":"6ac76a55-64bc-42c0-96ca-c0cfd0f0339c","resolution":{"observed_at":"2026-08-07T15:43:31.480886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.172514Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.172514Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:e0c278fc3603b9427a71673e19db6433be2d76184fb82985d5ed4eddeefa3229","observation_id":"9d69a277-3a48-4798-855c-a90eab1feb4e","resolution":{"observed_at":"2026-08-07T15:43:22.172514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:31.142986Z","title":null,"venue":null,"work_id":"ea79e02b-c664-483f-bae2-34112022af53","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.264169Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:d1f6827697f977c777116c779d78013348d6b631e57c04e9896b91c6ab5c8c31","observation_id":"65e016f6-564b-4426-8085-d6a390ff8535","resolution":{"observed_at":"2026-08-07T15:43:31.250804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.895312Z","title":null,"venue":null,"work_id":"534f6126-2ffb-4538-b2e3-3e528c3374d1","year":2020},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.394518Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:632e5cedae976ec380522fce0843d9fb81a431e533952544a7a0985d8b3be913","observation_id":"0fed4877-ccbd-4a02-9aee-37490e77aec9","resolution":{"observed_at":"2026-08-07T15:43:30.988064Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.486570Z","title":"Sentence-bert: Sentence embeddings using siamese bert- networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.486570Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:c5273e51de0c3fb930e03a357e7bb916e39d0fedda1881665d5f43ba80aabe18","observation_id":"e44488dd-ecf2-4aaa-83fb-0f4bdac730a5","resolution":{"observed_at":"2026-08-07T15:43:22.486570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.726359Z","title":"Lamp: When large language models meet personalization, 2024","venue":null,"work_id":"a21de298-4990-4bd5-94ad-1ad561b8c9b6","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.581458Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:ef2b253d941f616d8135d0e0dd7b92819cf5671f9838408ba8e726b88e4cb237","observation_id":"e08ac11f-6f2a-4ef2-bcd4-b722c05ab059","resolution":{"observed_at":"2026-08-07T15:43:30.780537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.649086Z","title":"Ai models collapse when trained on recursively generated data.Nature, 631(8022):755– 759, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.649086Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:6548d6fa278f58e882904301e7ea69cf452185a4bd5ee6c4aabdf9fe76dc52d2","observation_id":"639f9236-0fca-4285-9c56-1765c052d4e5","resolution":{"observed_at":"2026-08-07T15:43:22.649086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.514740Z","title":"Democra- tizing large language models via personalized parameter-efficient fine-tuning","venue":null,"work_id":"af83564c-900a-406b-b0df-ac6a6383992f","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.762396Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:dee5cc833e0e9050b7fa013486fb9010af789a4c4b9c1ac5d4789d0092528304","observation_id":"dbf2d392-76b7-4210-bacf-45ab18e9a5db","resolution":{"observed_at":"2026-08-07T15:43:30.623584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:30.335216Z","title":"An ai-based decision support system for predicting mental health disorders.Information Systems Frontiers, 25(3):1261–1276, 2023","venue":null,"work_id":"8601aedb-ff0d-45de-a411-af2c96d7a61f","year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.887964Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:05a93f829a5b9d33abe1a6d35d95d96af0dcd3deed2a4fcbc88847f7e098e166","observation_id":"2d87413e-c6d6-43ab-9c83-59a6cddc2c4e","resolution":{"observed_at":"2026-08-07T15:43:30.404821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:22.943347Z","title":"Position: Will we run out of data? limits of llm scaling based on human-generated data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.943347Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:de219cdd104536446910168f230dea5baacf2c726c7f30411832ae7a2fb59c5e","observation_id":"6b15c0d2-b97b-46a3-abd4-7495a23729a5","resolution":{"observed_at":"2026-08-07T15:43:22.943347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02142","last_updated":"2024-12-03T03:59:03Z","snapshot_observed_at":"2026-08-14T13:39:20.157476Z","submitted_at":"2024-12-03T03:59:03Z","title":"Personalized Multimodal Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02142","snapshot_observed_at":"2026-08-07T15:43:23.001354Z","title":"Personalized multimodal large language models: A survey.arXiv preprint arXiv:2412.02142, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.001354Z"},"links":{"cited_paper":"/paper/2412.02142","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:9ae201b8d354bc6820963f1d5a95df77175017cc6cae6af4b848492008f42e68","observation_id":"2d03cefe-d484-4bf3-8557-0007abc5c064","resolution":{"observed_at":"2026-08-07T15:43:23.001354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18013","last_updated":"2025-08-15T03:28:39Z","snapshot_observed_at":"2026-08-16T14:14:41.393057Z","submitted_at":"2024-02-28T03:16:44Z","title":"A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18013","snapshot_observed_at":"2026-08-07T15:43:23.118282Z","title":"A survey on recent advances in llm-based multi-turn dialogue systems.arXiv preprint arXiv:2402.18013, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.118282Z"},"links":{"cited_paper":"/paper/2402.18013","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:34c7434b0e58a8298c806debcafe9c22ab8ad4c57c63d1ccc3fb1b760faae5a8","observation_id":"0c64fbc1-cfc5-4224-ba00-99c35c647e1c","resolution":{"observed_at":"2026-08-07T15:43:23.118282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:27.053843Z","title":"xdial-eval: A multilingual open-domain dialogue evaluation benchmark","venue":null,"work_id":"93bf4352-1104-4f98-8b98-624cd4520ff8","year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.196806Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:061eac6aa733ded07fec6203cf6b007a3be9fbf3040849c99c22c46e3952227b","observation_id":"f5e06eb9-0d06-48ae-bf85-deb4ba1386b5","resolution":{"observed_at":"2026-08-07T15:43:30.185319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.855441Z","title":null,"venue":null,"work_id":"799782dd-e60e-4d44-9fe7-d1443fe49de4","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.314664Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:f994698cde407a81bfc0a817c107edd6e2e4af9511d06ae8644e3ec7e47f7cb6","observation_id":"ca8f1e77-8842-440d-a565-21323465c189","resolution":{"observed_at":"2026-08-07T15:43:25.986776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00027","last_updated":"2025-07-13T02:13:14Z","snapshot_observed_at":"2026-08-16T13:05:07.476703Z","submitted_at":"2024-10-29T04:01:11Z","title":"Personalization of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00027","snapshot_observed_at":"2026-08-07T15:43:23.443293Z","title":"Personalization of large language models: A survey.arXiv preprint arXiv:2411.00027, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.443293Z"},"links":{"cited_paper":"/paper/2411.00027","citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:ecdc0f6062fad9f864afd3867d7612ade3ef950c9ab708f0fffb7f2ef6543cfe","observation_id":"e23151f7-29ff-40fe-9dbb-d849f8ae67e2","resolution":{"observed_at":"2026-08-07T15:43:23.443293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.627736Z","title":"DiQAD: A benchmark dataset for open-domain dialogue quality assessment","venue":null,"work_id":"5c0672d7-22c7-48ba-a750-85bc1b910789","year":2023},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.527996Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:8ab30947f09ad10e01dfeae68311405c38055e4e46e7c03e91df03ea71ead10c","observation_id":"a9e526ef-fff8-4464-832b-32f5844900cb","resolution":{"observed_at":"2026-08-07T15:43:25.739429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:25.470253Z","title":"Zollo, Andrew Wei Tung Siah, Naimeng Ye, Ang Li, and Hongseok Namkoong","venue":null,"work_id":"4d77e4c7-f48c-4743-a1e0-2dc662ee21c1","year":2025},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.662353Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:4629a52184be54c20caa492ee57f5c6bc27fbf757294b67b8370b4741124ea72","observation_id":"791e650c-e121-426e-87d2-3373f14446e5","resolution":{"observed_at":"2026-08-07T15:43:25.537365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8620.9109","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:23.946434Z","title":"Best Response","venue":null,"work_id":"c1779647-88a7-4285-97a7-bad2ce372728","year":2021},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:23.733585Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:b2d89833aee73f7b367c00e4a9a2abf4a5afe740ce1062de27b4f536937fc3c3","observation_id":"7c921583-99e9-4d70-8560-649b95daa7cc","resolution":{"observed_at":"2026-08-07T15:43:24.106045Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:43:34.623036Z","title":null,"venue":null,"work_id":"6f8fc73f-d93c-4572-bb85-6a12b7885769","year":2024},"citing_paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:18.862204Z"},"links":{"citing_paper":"/paper/2505.14106"},"observation_digest":"sha256:7da59c21dc6ba7f9d9e08be2274a047b2567329aed86c56050c019cc04972661","observation_id":"3c5c23a3-3e7f-4e88-9235-16ffc7f9185b","resolution":{"observed_at":"2026-08-07T15:43:34.736747Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14106","last_updated":"2025-05-25T18:28:20Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T03:46:31.257528Z","submitted_at":"2025-05-20T09:13:22Z","title":"A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":19,"verified_exact":3,"verified_fuzzy":24},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 7 inbound Pith citation observations for arXiv:2505.14106."}