{"as_of":"2026-08-14T11:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d904c5c6a5f9a88f47a90845029590671d53377d50c9c96934f61999d1ccb87c","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:15:05.313014Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:43:16.241588Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T14:43:16.748149Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"cited_work":{"arxiv_id":"2502.04349","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04349","snapshot_observed_at":"2026-08-05T14:43:16.748149Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","venue":"cs.CL","work_id":"47f498e8-1920-4c4c-9b37-6fb141a65eb8","year":2025},"citing_paper":{"arxiv_id":"2508.20973","last_updated":"2025-08-28T16:26:44Z","snapshot_observed_at":"2026-08-13T05:24:27.929985Z","submitted_at":"2025-08-28T16:26:44Z","title":"ProactiveEval: A Unified Evaluation Framework for Proactive Dialogue Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T14:43:16.241588Z"},"links":{"cited_paper":"/paper/2502.04349","citing_paper":"/paper/2508.20973"},"observation_digest":"sha256:472055650b9e8ed69dc77549e7856ec483f02dacd88598b5f4f1fbd26776bc9d","observation_id":"46c991f9-9705-47d4-bc29-d02ccb290896","resolution":{"observed_at":"2026-08-05T14:43:16.752900Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04349/citation-record","integrity":"/paper/2502.04349/integrity","json":"/paper/2502.04349/citation-record.json","paper":"/paper/2502.04349"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.20222","last_updated":"2024-10-11T11:32:16Z","snapshot_observed_at":"2026-08-12T22:34:33.816081Z","submitted_at":"2024-09-30T12:01:29Z","title":"Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20222","snapshot_observed_at":"2026-08-09T12:15:05.232557Z","title":"https://doi.org/10.48550/arXiv.2409.20222 arXiv:2409.20222 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.232557Z"},"links":{"cited_paper":"/paper/2409.20222","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:3581265ea323799a7cdef44bb53596b9960136361c268fdabfca54b9d8c6f6d1","observation_id":"f3d79fd6-07d1-4ed1-ba0a-6dc6fd0c52f0","resolution":{"observed_at":"2026-08-09T12:15:05.232557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08758","last_updated":"2021-09-30T17:20:01Z","snapshot_observed_at":"2026-08-11T11:33:47.725577Z","submitted_at":"2021-04-18T07:42:52Z","title":"Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08758","snapshot_observed_at":"2026-08-09T12:15:05.244587Z","title":"https://doi.org/10.48550/arXiv.2104.08758 arXiv:2104.08758 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.244587Z"},"links":{"cited_paper":"/paper/2104.08758","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:65b8bb11db0037309b79980525d310f5fb4d33a051241037f66b75eecc74e443","observation_id":"46aa19f4-babb-48ad-8329-088b7f2e7d6a","resolution":{"observed_at":"2026-08-09T12:15:05.244587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15723","last_updated":"2021-06-02T12:41:36Z","snapshot_observed_at":"2026-08-10T05:00:18.764813Z","submitted_at":"2020-12-31T17:21:26Z","title":"Making Pre-trained Language Models Better Few-shot Learners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15723","snapshot_observed_at":"2026-08-09T12:15:05.255887Z","title":"https://doi.org/10.48550/arXiv.2012.15723 arXiv:2012.15723 [cs]","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.255887Z"},"links":{"cited_paper":"/paper/2012.15723","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:c7d6574e2d64084322146af4c7bcdb75c810428bb96e9c481f1d59cb11b80994","observation_id":"0de8e0f8-411f-44ab-8d66-ee52e1785173","resolution":{"observed_at":"2026-08-09T12:15:05.255887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w18-5704","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"c4b7d8c8-75a8-4589-b82e-b517bbf5447c","year":2018},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.259451Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:26cc5fd12da9d4c6b6409a85a943000735ce01cb129b02c2ee457ebf1dc4dad3","observation_id":"44c35fb5-b18c-4166-9b13-e5f582701fdd","resolution":{"observed_at":"2026-08-09T12:15:05.446056Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:15:05.614534Z","title":null,"venue":null,"work_id":"0c602e48-8239-46eb-bed1-f5ab94296347","year":2021},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.262498Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:25dd0778a73d03eafbf3fbf8ad37925a264b14dba0421f1ef86ed13d41731d01","observation_id":"b346bbd0-3f7f-4506-adca-1e69265dabf0","resolution":{"observed_at":"2026-08-09T12:15:05.622562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09135","last_updated":"2024-04-14T03:54:00Z","snapshot_observed_at":"2026-08-13T00:30:38.873048Z","submitted_at":"2024-04-14T03:54:00Z","title":"Unveiling LLM Evaluation Focused on Metrics: Challenges and Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09135","snapshot_observed_at":"2026-08-09T12:15:05.270152Z","title":"https://doi.org/10.48550/arXiv.2404.09135 arXiv:2404.09135 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.270152Z"},"links":{"cited_paper":"/paper/2404.09135","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:d9e62cfd4c076062decfbd767dbfc5b2dfc2b2f574f62ff9755a3ee325bc737c","observation_id":"40472905-a9fa-40a1-86a5-d8872f4790a1","resolution":{"observed_at":"2026-08-09T12:15:05.270152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10169","last_updated":"2023-07-19T17:55:13Z","snapshot_observed_at":"2026-08-13T10:52:25.097969Z","submitted_at":"2023-07-19T17:55:13Z","title":"Challenges and Applications of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10169","snapshot_observed_at":"2026-08-09T12:15:05.274234Z","title":"https://doi.org/10.48550/arXiv.2307.10169 arXiv:2307.10169 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.274234Z"},"links":{"cited_paper":"/paper/2307.10169","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:818400eb66a6166d6aae513bc7f23b2ebbe391c6e62099e23f0d407271c02b69","observation_id":"21c9d41a-c017-4551-9245-53e35e6eb829","resolution":{"observed_at":"2026-08-09T12:15:05.274234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:15:05.278228Z","title":"In Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing, Yaser Al-Onaizan, Mohit Bansal, and Yun-Nung Chen (Eds.)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.278228Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:f5e8863ff4334e3889d69c152fa971b8fb081f80ec118ce9c45711759f8e216c","observation_id":"289baa1b-57dd-4d0f-b70a-abf23f01faa7","resolution":{"observed_at":"2026-08-09T12:15:05.278228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01951","last_updated":"2021-10-26T15:47:43Z","snapshot_observed_at":"2026-08-14T00:08:22.377876Z","submitted_at":"2021-02-03T09:01:49Z","title":"Mind the Gap: Assessing Temporal Generalization in Neural Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01951","snapshot_observed_at":"2026-08-09T12:15:05.281624Z","title":"https://doi.org/10.48550/arXiv.2102.01951 arXiv:2102.01951 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.281624Z"},"links":{"cited_paper":"/paper/2102.01951","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:2a4f57b8e0ba63e8636f93526544342579a449fc9242077c987ffdd79f677854","observation_id":"59bd7b06-6dc2-40d8-b27a-b60826f6dcdf","resolution":{"observed_at":"2026-08-09T12:15:05.281624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:15:05.603503Z","title":null,"venue":null,"work_id":"376544dc-b6da-47d5-a43c-c5858280895b","year":2023},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.285508Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:0b1b310900413e6669a71b864ee132b314d2bb660fb7dfaff2f4487d10872ae5","observation_id":"f84393a5-0c02-40ba-9418-dedb87497952","resolution":{"observed_at":"2026-08-09T12:15:05.607361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-09T12:15:05.289325Z","title":"https://doi.org/10.48550/arXiv.2410.21276 arXiv:2410.21276 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.289325Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:cd2436aafa12197a8d027abf8b84705f9114da9a62fa1b9c6add557533b486d2","observation_id":"a9d1dcf6-68e8-4fb4-9123-3b82a2aeb128","resolution":{"observed_at":"2026-08-09T12:15:05.289325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03442","last_updated":"2023-08-06T00:21:19Z","snapshot_observed_at":"2026-08-14T04:44:13.552688Z","submitted_at":"2023-04-07T01:55:19Z","title":"Generative Agents: Interactive Simulacra of Human Behavior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03442","snapshot_observed_at":"2026-08-09T12:15:05.297478Z","title":"https://doi.org/10.48550/arXiv.2304.03442 arXiv:2304.03442 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.297478Z"},"links":{"cited_paper":"/paper/2304.03442","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:c17d6eae46aae4b299382217ad9438cb17da94959a67122290f63d8bac043d00","observation_id":"05360c84-1bbe-48b5-80f3-edc63783cf52","resolution":{"observed_at":"2026-08-09T12:15:05.297478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.07042","last_updated":"2019-03-29T20:50:21Z","snapshot_observed_at":"2026-07-31T11:57:30.697867Z","submitted_at":"2018-08-21T17:52:02Z","title":"CoQA: A Conversational Question Answering Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.07042","snapshot_observed_at":"2026-08-09T12:15:05.301435Z","title":"https://doi.org/10.48550/arXiv.1808.07042 arXiv:1808.07042 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.301435Z"},"links":{"cited_paper":"/paper/1808.07042","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:04aac79d630893a7435eec4853f0187173bd1e67df7cf6ea5c1519f2c2eaa464","observation_id":"1e623876-1f18-41f0-a666-c5a59816843e","resolution":{"observed_at":"2026-08-09T12:15:05.301435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.06411","last_updated":"2018-06-17T16:38:48Z","snapshot_observed_at":"2026-08-03T20:57:18.745592Z","submitted_at":"2018-06-17T16:38:48Z","title":"Measuring Semantic Coherence of a Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.06411","snapshot_observed_at":"2026-08-09T12:15:05.305901Z","title":"https: //doi.org/10.48550/arXiv.1806.06411 arXiv:1806.06411 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.305901Z"},"links":{"cited_paper":"/paper/1806.06411","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:807e63154f637b4178ec8ab7253690489641327bda39f0ae4bcb3d97248206cd","observation_id":"6be2bb4f-c70a-4819-a5ac-86be86f64291","resolution":{"observed_at":"2026-08-09T12:15:05.305901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:15:05.592305Z","title":null,"venue":null,"work_id":"ef48b979-b9a5-4cdc-afab-bf7f6cbc434d","year":2024},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.309715Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:0da69cf0a5e0f714a1fa5a9935af9319876b69b09726313991fa5d1f773adbf0","observation_id":"492fdea4-bdbb-4a8f-ae12-473b1ae492b1","resolution":{"observed_at":"2026-08-09T12:15:05.596053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13601","last_updated":"2024-05-28T05:36:23Z","snapshot_observed_at":"2026-08-13T04:35:22.207759Z","submitted_at":"2024-01-24T17:10:45Z","title":"MM-LLMs: Recent Advances in MultiModal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13601","snapshot_observed_at":"2026-08-09T12:15:05.313014Z","title":"https://doi.org/10.48550/arXiv.2401.13601 arXiv:2401.13601 [cs] version:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.313014Z"},"links":{"cited_paper":"/paper/2401.13601","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:86193e8af2e198eb54bbcfbe5f94d445b062bc2e0fdf2f4f32fda9559197e0db","observation_id":"e1d9affa-e025-4fc4-b69e-e0e77831ee06","resolution":{"observed_at":"2026-08-09T12:15:05.313014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:15:05.580128Z","title":"O’Brien, Carrie J","venue":null,"work_id":"3913ef07-12b1-4da0-ac3a-6323043cf38b","year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":311,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.294056Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:4eb2f83d122343039eaf25ee68f34c80c4cf948814cb6f725dcddd8a196754fc","observation_id":"c25b8169-3d8b-46b9-8fb2-a2c4448a6d66","resolution":{"observed_at":"2026-08-09T12:15:05.584572Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.chb.2016.03.051","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"2016), Dynamic benchmarking framework for LLM-based conversational data capture 463–471","venue":"Computers in Human Behavior","work_id":"1a71ab9e-8a38-4192-9fce-9c6be7ff340d","year":2016},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.265740Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:a44cf535b69e26d95cb87d4c7035f8ec74a53f0144c5483b0dd7d9fd2108193e","observation_id":"0e5577cb-cea9-4079-8fcc-20d986778bfb","resolution":{"observed_at":"2026-08-09T12:15:05.434085Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:15:05.248502Z","title":"InDesign, User Experience, and Usability: The- ory and Practice, Aaron Marcus and Wentao Wang (Eds.)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.248502Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:519453e5e7d049e4e348221732de3304747a0c86f26101d81ccb7b19bd49e730","observation_id":"1adef826-c6b8-403a-b8b2-a6bd28e12e0e","resolution":{"observed_at":"2026-08-09T12:15:05.248502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1381","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"InProceedings of the 2019 Conference of the North","venue":null,"work_id":"55cdfd29-9ee0-40fd-90f5-5bcc4d7cce30","year":2019},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.252276Z"},"links":{"citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:9cb18c468291693afdcf55693554c9068197e82fc03959f6ef6d5fe116f64eef","observation_id":"2062522c-b1e0-44fc-89c4-0e1fe47183b9","resolution":{"observed_at":"2026-08-09T12:15:05.468244Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T12:15:05.240659Z","title":"https://doi.org/10.48550/arXiv.2107.03374 arXiv:2107.03374 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.240659Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:7a74d00ba2b314fee3a357ff03d26d3d18f94717a3e2f5740bc0127b13f1518c","observation_id":"ecb8f8d7-c038-4436-8854-55dddb595b61","resolution":{"observed_at":"2026-08-09T12:15:05.240659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-09T12:15:05.223946Z","title":"https://doi.org/10.48550/arXiv.2108.07258 arXiv:2108.07258 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.223946Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:6a0270aac1787b5ac1c88a292c2fb2c4ad2804479cb6fd2a4871d0e4595ba1f2","observation_id":"c7fd95b5-b416-45a6-8129-07d2b8adb15f","resolution":{"observed_at":"2026-08-09T12:15:05.223946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13455","last_updated":"2023-11-23T15:47:52Z","snapshot_observed_at":"2026-08-13T11:36:52.298013Z","submitted_at":"2023-05-22T19:56:10Z","title":"Clembench: Using Game Play to Evaluate Chat-Optimized Language Models as Conversational Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13455","snapshot_observed_at":"2026-08-09T12:15:05.236457Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.236457Z"},"links":{"cited_paper":"/paper/2305.13455","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:30405e2e6bdd746e04d8d8f3023923f4b71486581c22503ef99c78730802e56e","observation_id":"3ebbb4c2-02b4-4766-b7bb-fddb2c6c9ff2","resolution":{"observed_at":"2026-08-09T12:15:05.236457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06808","last_updated":"2024-07-10T13:31:59Z","snapshot_observed_at":"2026-08-13T00:09:58.823419Z","submitted_at":"2024-05-10T20:45:40Z","title":"Large Language Model in Financial Regulatory Interpretation","version":2},"cited_work":{"arxiv_id":"2405.06808","doi":"10.48550/arxiv.2405.06808","metadata_source":"pith","pith_arxiv_id":"2405.06808","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Large Language Model in Financial Regulatory Interpretation","venue":"q-fin.RM","work_id":"64d0b815-ff89-4aee-9ee2-d7e42f02796f","year":2024},"citing_paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T12:15:05.228752Z"},"links":{"cited_paper":"/paper/2405.06808","citing_paper":"/paper/2502.04349"},"observation_digest":"sha256:e36c785b676d4652a312758b41fddad3b93beb4281c2d10e81838232dc5bc355","observation_id":"cf4d25b3-a630-4b69-af9d-0d1c66112866","resolution":{"observed_at":"2026-08-09T12:15:05.533006Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.04349","last_updated":"2025-02-04T15:47:47Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T09:10:26.660963Z","submitted_at":"2025-02-04T15:47:47Z","title":"Dynamic benchmarking framework for LLM-based conversational data capture"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":19,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2502.04349."}