{"as_of":"2026-08-10T14:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c74957d9427d1d2745626387d4d2ca111e5595cc40090fdc368a1aa762cc0808","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T22:21:52.487178Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T05:05:54.821162Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-07T22:21:52.487178Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09192","last_updated":"2025-05-27T17:24:38Z","snapshot_observed_at":"2026-08-08T23:01:32.478617Z","submitted_at":"2025-02-13T11:32:09Z","title":"Thinking beyond the anthropomorphic paradigm benefits LLM research","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T22:21:52.487178Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2502.09192"},"observation_digest":"sha256:f1ae0f41f1cf34932873c278ad77a6a989c35abf1cffecaca499783b23a210cb","observation_id":"526e8617-104d-40f6-ab93-e9d62e1244be","resolution":{"observed_at":"2026-08-07T22:21:52.487178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":"2504.07114","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2504.07114","venue":null,"work_id":"7bde547f-b27b-46c5-aebe-07c965260367","year":2024},"citing_paper":{"arxiv_id":"2505.06120","last_updated":"2025-05-09T15:21:44Z","snapshot_observed_at":"2026-08-08T19:35:51.229758Z","submitted_at":"2025-05-09T15:21:44Z","title":"LLMs Get Lost In Multi-Turn Conversation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T00:57:10.262350Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2505.06120"},"observation_digest":"sha256:df32d6430374462eb9a37755804a5d4773e63f409666b5a736bfd68a57f29af4","observation_id":"2790fd59-30e4-41f4-81cc-bf53fcf0615d","resolution":{"observed_at":"2026-05-14T01:11:09.390293Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-07T00:23:38.646723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14200","last_updated":"2025-06-17T05:36:39Z","snapshot_observed_at":"2026-08-09T06:10:41.197138Z","submitted_at":"2025-06-17T05:36:39Z","title":"ELI-Why: Evaluating the Pedagogical Utility of Language Model Explanations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T00:23:38.646723Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2506.14200"},"observation_digest":"sha256:c0fa5a4c4b52234deaa20681101a387d9689be6f991461c6af75eb7b67ff039e","observation_id":"5989d867-c302-43ac-a69b-f03d7820edff","resolution":{"observed_at":"2026-08-07T00:23:38.646723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-06T22:30:29.181666Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.21521","last_updated":"2025-06-29T18:12:45Z","snapshot_observed_at":"2026-08-09T04:44:37.252637Z","submitted_at":"2025-06-26T17:41:35Z","title":"Potemkin Understanding in Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T22:30:29.181666Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2506.21521"},"observation_digest":"sha256:530428d6c35acdfc9aafbc1240a7a34ded7f9aa557648420841ebea16d2a1ac4","observation_id":"570370e0-e76e-4430-9284-c1068694b47e","resolution":{"observed_at":"2026-08-06T22:30:29.181666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-06T18:16:07.543314Z","title":"Chang, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08983","last_updated":"2025-07-11T19:35:29Z","snapshot_observed_at":"2026-08-09T18:47:59.331824Z","submitted_at":"2025-07-11T19:35:29Z","title":"Exploiting Leaderboards for Large-Scale Distribution of Malicious Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:07.543314Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2507.08983"},"observation_digest":"sha256:07b5f8bcf1eebd6fc50c20f5d54cb4ee13a59a7b59aa19bb30d8c605273e0a4f","observation_id":"e4479443-39dc-4cf1-96c9-f96965848b79","resolution":{"observed_at":"2026-08-06T18:16:07.543314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":"2504.07114","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2504.07114","venue":null,"work_id":"7bde547f-b27b-46c5-aebe-07c965260367","year":2024},"citing_paper":{"arxiv_id":"2510.18731","last_updated":"2026-04-29T19:05:29Z","snapshot_observed_at":"2026-07-06T22:33:43.999976Z","submitted_at":"2025-10-21T15:32:26Z","title":"Mitigating Lost in Multi-turn Conversation via Curriculum RL with Verifiable Accuracy and Abstention Rewards","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T05:04:10.226166Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2510.18731"},"observation_digest":"sha256:7faa7f5dc483e55893860387377c48e598a10465db180309c26079fbc97b11f5","observation_id":"f6526d21-e822-4690-ae2d-1722ca13d9c4","resolution":{"observed_at":"2026-05-18T05:05:54.829589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-07-14T11:49:31.595873Z","title":"arXiv preprint arXiv:2504.07114 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10428","last_updated":"2026-07-24T14:32:58Z","snapshot_observed_at":"2026-08-06T10:45:46.606756Z","submitted_at":"2026-07-11T18:22:49Z","title":"Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-14T11:49:31.595873Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2607.10428"},"observation_digest":"sha256:b830adf9dafaf9a083f3ff6b8207f294f03c9b60a749fc4c27b23a94d9639ce6","observation_id":"37b2e37a-518e-46b9-b839-f64d1398afe8","resolution":{"observed_at":"2026-07-14T11:49:31.595873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07114","snapshot_observed_at":"2026-08-02T07:20:34.591235Z","title":"arXiv preprint arXiv:2504.07114 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10428","last_updated":"2026-07-24T14:32:58Z","snapshot_observed_at":"2026-08-06T10:45:46.606756Z","submitted_at":"2026-07-11T18:22:49Z","title":"Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T07:20:34.591235Z"},"links":{"cited_paper":"/paper/2504.07114","citing_paper":"/paper/2607.10428"},"observation_digest":"sha256:c9d10d9cd2edbb8008db21a1ca24bf980f18261461350f3e2a9048306d444a99","observation_id":"52ea65f1-f84f-45ff-b0fc-ca81773892be","resolution":{"observed_at":"2026-08-02T07:20:34.591235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.07114/citation-record","integrity":"/paper/2504.07114/integrity","json":"/paper/2504.07114/citation-record.json","paper":"/paper/2504.07114"},"outbound":[],"paper":{"arxiv_id":"2504.07114","last_updated":"2025-08-12T01:53:40Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:44:44.128963Z","submitted_at":"2025-03-22T01:21:40Z","title":"ChatBench: From Static Benchmarks to Human-AI Evaluation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2504.07114."}