{"as_of":"2026-08-10T09:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:de6e71c25de44424fff6895064a0ca3da1ce109a693ab1a2af18b8d2e8dfa5db","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":29,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:11:58.311715Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":198,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2308.07201","last_updated":"2023-08-14T15:13:04Z","snapshot_observed_at":"2026-08-02T01:34:38.978920Z","submitted_at":"2023-08-14T15:13:04Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T13:03:18.765496Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2308.07201"},"observation_digest":"sha256:9ec9b92bbd9e1a01839c83992253ef290df9664d62945e2144fdcea8ea94860e","observation_id":"a2a8a936-2901-4bf7-aed2-d32891c2bd79","resolution":{"observed_at":"2026-05-13T13:03:18.831146Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2405.19088","last_updated":"2026-04-15T02:26:56Z","snapshot_observed_at":"2026-07-06T18:21:57.091728Z","submitted_at":"2024-05-29T13:51:43Z","title":"Cracking the Code of Juxtaposition: Can AI Models Understand the Humorous Contradictions","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-24T00:52:52.056076Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2405.19088"},"observation_digest":"sha256:925b4fccda1ecd8c3d18b8eb997a2d46473595307730651a0abebadfd970e46f","observation_id":"efb345bd-5e0a-46eb-a688-8598dcdaefd9","resolution":{"observed_at":"2026-05-24T00:53:40.707687Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2503.23137","last_updated":"2026-04-15T02:38:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-29T16:08:51Z","title":"When 'YES' Meets 'BUT': Can Large Models Comprehend Contradictory Humor Through Comparative Reasoning?","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-22T22:38:35.969273Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2503.23137"},"observation_digest":"sha256:e8af0b8a55b804d34d03089e4f63fa2ad9f881af6a13e1670377ff4746c37bd6","observation_id":"9cec52b8-d6d1-4973-9769-01f4e119bf6b","resolution":{"observed_at":"2026-05-22T22:42:13.667706Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-07T11:11:58.311715Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03310","last_updated":"2025-06-03T18:50:22Z","snapshot_observed_at":"2026-08-09T13:29:47.612489Z","submitted_at":"2025-06-03T18:50:22Z","title":"The Reader is the Metric: How Textual Features and Reader Profiles Explain Conflicting Evaluations of AI Creative Writing","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:11:58.311715Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2506.03310"},"observation_digest":"sha256:9fcdeddce93bf9f3684c5c4235b7e34ced7bdafba5901a04551a463d0b501359","observation_id":"143a904f-2d5f-4f5a-9e60-0ef3fc36568d","resolution":{"observed_at":"2026-08-07T11:11:58.311715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-07T04:56:45.220857Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09367","last_updated":"2025-06-11T03:27:50Z","snapshot_observed_at":"2026-08-09T00:54:46.611217Z","submitted_at":"2025-06-11T03:27:50Z","title":"COGENT: A Curriculum-oriented Framework for Generating Grade-appropriate Educational Content","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:56:45.220857Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2506.09367"},"observation_digest":"sha256:468b1ad2f7f43cd57abca5f8b010cd98971757adc9776d290a058b2d9436c60f","observation_id":"ce75d046-338e-4a26-8104-92b995978220","resolution":{"observed_at":"2026-08-07T04:56:45.220857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-07T00:23:21.956909Z","title":"ArXiv, abs/2006.14799","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.17294","last_updated":"2026-06-30T08:31:07Z","snapshot_observed_at":"2026-08-07T00:15:53.880399Z","submitted_at":"2025-06-17T07:04:51Z","title":"From Multimodal Perception to Strategic Reasoning: A Survey on AI-Generated Game Commentary","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:21.956909Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2506.17294"},"observation_digest":"sha256:e11ff6e8aa309c60ac1eb6cdd20c275f0f37cd6da30e2c7ab09b7e9bbed1f131","observation_id":"c300e68f-6016-4616-baa5-125b9b337477","resolution":{"observed_at":"2026-08-07T00:23:21.956909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2510.27106","last_updated":"2025-10-31T02:06:37Z","snapshot_observed_at":"2026-08-04T23:39:36.848150Z","submitted_at":"2025-10-31T02:06:37Z","title":"Rating Roulette: Self-Inconsistency in LLM-As-A-Judge Frameworks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T03:32:53.109030Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2510.27106"},"observation_digest":"sha256:8552dc03a7edc77916bc7547cc8f07b526cb6c5586c17b40494387cf6cfd5410","observation_id":"50479774-0e37-4d24-9f6f-4533ae249535","resolution":{"observed_at":"2026-05-18T03:35:50.545027Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-03T11:07:09.410983Z","title":"DeepSeek-AI, Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Ruoyu Zhang, Runxin Xu, Qihao Zhu, Shirong Ma, Peiyi Wang, Xiao Bi, Xiaokang Zhang, Xingkai Yu, Yu Wu, Z","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2601.07648","last_updated":"2026-05-27T13:07:42Z","snapshot_observed_at":"2026-08-03T11:07:08.279581Z","submitted_at":"2026-01-12T15:27:58Z","title":"What Are We Measuring in NLG? A Meta-Analysis of Evaluation Trends 2020-2025","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T11:07:09.410983Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2601.07648"},"observation_digest":"sha256:ba59c8747f0c42a700e6cd961eada9ee653a263bfede23cc0753d3ea47e06ee8","observation_id":"007b65bd-009e-47b0-a59b-d46d02cf808c","resolution":{"observed_at":"2026-08-03T11:07:09.410983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-03T03:55:51.714813Z","title":"arXiv preprint arXiv:2006.14799","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2602.06625","last_updated":"2026-06-30T17:47:27Z","snapshot_observed_at":"2026-08-06T12:42:37.363282Z","submitted_at":"2026-02-06T11:35:32Z","title":"FairJudge: An Adaptive, Debiased, and Consistent LLM-as-a-Judge","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T03:55:51.714813Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2602.06625"},"observation_digest":"sha256:1e9adf70b953fe0942bf639540ae25fca365727affa6ac6bc72226a27baa705c","observation_id":"0e5a751a-a9a4-46ff-b9e6-e283b33d1e13","resolution":{"observed_at":"2026-08-03T03:55:51.714813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2602.09299","last_updated":"2026-04-15T23:56:38Z","snapshot_observed_at":"2026-08-08T05:40:45.883733Z","submitted_at":"2026-02-10T00:38:04Z","title":"Synthetic Reflections on Resource Extraction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T03:54:55.533944Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2602.09299"},"observation_digest":"sha256:18410a3a6c82d4bd2605cdfc70d2c6e607f84b35281f504aab25d5c927e43482","observation_id":"88c2bb92-11a6-43dc-9004-87cb3914fba4","resolution":{"observed_at":"2026-05-16T03:57:15.853158Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2603.13683","last_updated":"2026-07-31T13:23:46Z","snapshot_observed_at":"2026-08-06T08:27:28.683771Z","submitted_at":"2026-03-14T01:37:23Z","title":"Preconditioned Test-Time Adaptation for Out-of-Distribution Debiasing in Narrative Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T12:13:24.420641Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2603.13683"},"observation_digest":"sha256:73c9770cb55ba7af42365669af2d1832df9f09520148a585a0a30a4cf9e193fc","observation_id":"617c7367-66b1-45de-9ff0-84e8271b4aa0","resolution":{"observed_at":"2026-05-15T12:15:34.545671Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-03T02:35:45.191487Z","title":"Sumanth Dathathri, Andrea Madotto, Janice Lan, Jane Hung, Eric Frank, Piero Molino, Jason Yosinski, and Rosanne Liu","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2603.13683","last_updated":"2026-07-31T13:23:46Z","snapshot_observed_at":"2026-08-06T08:27:28.683771Z","submitted_at":"2026-03-14T01:37:23Z","title":"Preconditioned Test-Time Adaptation for Out-of-Distribution Debiasing in Narrative Generation","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T02:35:45.191487Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2603.13683"},"observation_digest":"sha256:8389d2002f5c6b3bb63462bf246eb45ecbbe4b0afb1601fc3f8a3465753f9c17","observation_id":"a7868629-76f9-46c2-b2f2-abefed8d414a","resolution":{"observed_at":"2026-08-03T02:35:45.191487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2604.05900","last_updated":"2026-04-07T14:05:17Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:05:17Z","title":"AICA-Bench: Holistically Examining the Capabilities of VLMs in Affective Image Content Analysis","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-10T19:22:08.306946Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2604.05900"},"observation_digest":"sha256:dfe7a5e94eaea72c3da8c8f56dcbd66a96e5bfca8b5476a9bd22a2a03332de09","observation_id":"7cba6b9d-5c4e-493e-bfd5-284663c2206d","resolution":{"observed_at":"2026-05-10T23:05:48.300289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2604.10741","last_updated":"2026-04-19T17:04:51Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T17:30:44Z","title":"Deep-Reporter: Deep Research for Grounded Multimodal Long-Form Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:42:35.824427Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2604.10741"},"observation_digest":"sha256:d176b7b2a319f3310a37e1fbb958f58b3fe6c0b555d22c396cc780942ce28744","observation_id":"773ab666-1d23-4a4b-97ab-a14db984d069","resolution":{"observed_at":"2026-05-11T10:01:00.374583Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2604.18955","last_updated":"2026-04-21T01:05:52Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T01:05:52Z","title":"Assessing Capabilities of Large Language Models in Social Media Analytics: A Multi-task Quest","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-10T03:20:12.777878Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2604.18955"},"observation_digest":"sha256:7f061f88f4178120678759e16b62689db0cdaf06dd8153fc59b21db6819f5dca","observation_id":"859b8115-85cd-4cde-98e8-3dd14d3159fd","resolution":{"observed_at":"2026-05-11T12:41:01.810530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2604.25482","last_updated":"2026-04-28T10:39:17Z","snapshot_observed_at":"2026-08-07T22:24:17.819786Z","submitted_at":"2026-04-28T10:39:17Z","title":"From World-Gen to Quest-Line: A Dependency-Driven Prompt Pipeline for Coherent RPG Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T16:22:33.542081Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2604.25482"},"observation_digest":"sha256:cd8d004685d65ef2bd62d1bd6212f2651b96de96cecea780493bdee2846691e3","observation_id":"3d0da929-fb2c-439d-8cba-fe3d48bdc309","resolution":{"observed_at":"2026-05-11T23:46:23.304340Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2605.04665","last_updated":"2026-05-09T22:09:59Z","snapshot_observed_at":"2026-07-06T23:17:23.641984Z","submitted_at":"2026-05-06T09:11:10Z","title":"Paraphrase-Induced Output-Mode Collapse: When LLMs Break Character Under Semantically Equivalent Inputs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T16:26:54.068997Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2605.04665"},"observation_digest":"sha256:5f3891927ce1ff7a46de9942820d08aeb0b371334f20ca6fb1112ae13257ff48","observation_id":"015d2145-0090-4c70-8c2a-e1b952ffb4b4","resolution":{"observed_at":"2026-05-11T18:16:07.273886Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2605.04665","last_updated":"2026-05-09T22:09:59Z","snapshot_observed_at":"2026-07-06T23:17:23.641984Z","submitted_at":"2026-05-06T09:11:10Z","title":"Paraphrase-Induced Output-Mode Collapse: When LLMs Break Character Under Semantically Equivalent Inputs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T02:13:48.672711Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2605.04665"},"observation_digest":"sha256:262a9a16e65d3a6f75405162adca19d19484c3cf03502cfc842b21dce31115de","observation_id":"f9c2670c-78e1-4163-ab12-bf5469935630","resolution":{"observed_at":"2026-05-12T02:16:16.112644Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2605.23244","last_updated":"2026-05-22T05:25:00Z","snapshot_observed_at":"2026-08-01T14:10:27.190441Z","submitted_at":"2026-05-22T05:25:00Z","title":"Convex Optimization for Alignment and Preference Learning on a Single GPU","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-25T05:01:31.560963Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2605.23244"},"observation_digest":"sha256:0657dc5bd2a71d908b70b6db3000b67b15005fd90b77dbe8362621b5cc07b938","observation_id":"b47a783a-d4fc-442d-b115-fc96af605418","resolution":{"observed_at":"2026-05-25T05:05:23.148540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2605.29897","last_updated":"2026-05-28T13:21:36Z","snapshot_observed_at":"2026-08-07T16:01:17.484753Z","submitted_at":"2026-05-28T13:21:36Z","title":"ExCAM: Explainable Cultural Awareness Metrics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T07:42:43.805674Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2605.29897"},"observation_digest":"sha256:1b45097c1287a227c51a4a53b24bb8412b5bc6fd6d957a1804293cf1fc43018b","observation_id":"e88dd9d5-af7c-4532-8131-fb9a56f46150","resolution":{"observed_at":"2026-06-29T07:43:13.260618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.07936","last_updated":"2026-06-09T12:36:24Z","snapshot_observed_at":"2026-08-07T22:03:51.528110Z","submitted_at":"2026-06-06T01:55:56Z","title":"Illusions of the Gold Standard: A Large-scale Analysis of Human Evaluation Protocols for Long-form Text Generation","version":2},"reference_index":132,"source":"arxiv_source","source_observed_at":"2026-06-27T20:20:08.996005Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.07936"},"observation_digest":"sha256:86f77328263f10d7fa586cf576b9ce0a18800c7779e2005bc4148aed19e5db63","observation_id":"bbd39bfd-7cfe-46dc-b98d-a3dd669da1f9","resolution":{"observed_at":"2026-07-02T20:37:22.704121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":226,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:6274c99c2dad31a6c67ca17b8a802bb9dc0b646da5052f8eec4a7cc8c28e8fde","observation_id":"24c20b2b-7a21-4c61-8d33-96d4d2031529","resolution":{"observed_at":"2026-06-30T22:15:05.717285Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.19057","last_updated":"2026-06-17T13:26:04Z","snapshot_observed_at":"2026-08-07T01:21:32.666151Z","submitted_at":"2026-06-17T13:26:04Z","title":"Quantifying and Auditing LLM Evaluation via Positive--Unlabeled Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T19:04:45.062426Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.19057"},"observation_digest":"sha256:f8e7745448bac4d151aa11d99a44feaa65b68e9ed403c9011f3bd783a7701ac2","observation_id":"7692ee91-fc88-446a-b53a-8d491efa1769","resolution":{"observed_at":"2026-07-04T02:49:24.839875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":2},"reference_index":198,"source":"arxiv_source","source_observed_at":"2026-06-26T09:19:50.623741Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:1fd42ebf88bb84102e51b56d61ac23546a84b8e948eb911575b771c6922df460","observation_id":"f1743dbb-a58a-4bba-a85e-423bbb92f935","resolution":{"observed_at":"2026-07-04T09:59:44.750686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":3},"reference_index":197,"source":"arxiv_source","source_observed_at":"2026-06-29T01:18:19.195007Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:8e319a2e4f5d7bd6ee4d9735a5591afefc420e40d102eb9336b01908895a5381","observation_id":"b4d60861-c9df-42a0-8558-524570f03689","resolution":{"observed_at":"2026-07-01T18:55:59.679519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":"2006.14799","doi":"10.48550/arxiv.2006.14799","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2006.14799 , year=","venue":"arXiv (Cornell University)","work_id":"f175ef7c-8a20-4a91-8715-75954d637015","year":2006},"citing_paper":{"arxiv_id":"2607.00274","last_updated":"2026-06-30T23:48:15Z","snapshot_observed_at":"2026-07-07T00:05:59.073754Z","submitted_at":"2026-06-30T23:48:15Z","title":"SEFORA: Student Essays with Feedback Corpus and LLM Feedback Evaluation Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-02T18:48:09.531329Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2607.00274"},"observation_digest":"sha256:f37d86d5429e15446d984e54cfa16dfc5554f1d15f8d64c674638a24511525c8","observation_id":"aea004cf-30af-4fc3-9326-98ba3f2ff614","resolution":{"observed_at":"2026-07-02T18:57:16.346686Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-07-11T17:13:44.985215Z","title":"Celikyilmaz, E","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.04563","last_updated":"2026-07-06T00:31:31Z","snapshot_observed_at":"2026-08-10T00:28:30.687831Z","submitted_at":"2026-07-06T00:31:31Z","title":"Fidelity-Diversity Metrics for Text","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T17:13:44.985215Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2607.04563"},"observation_digest":"sha256:9fd9f6d03646056bc76aa7e1484c385d4b60ae209f6b2fdc6f4012599122ed80","observation_id":"0c3d5759-7a87-45ce-a85c-37d305a1e334","resolution":{"observed_at":"2026-07-11T17:13:44.985215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-01T04:46:36.501877Z","title":"Preprint, arXiv:2006.14799","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.22456","last_updated":"2026-07-24T16:14:37Z","snapshot_observed_at":"2026-08-07T06:02:40.664351Z","submitted_at":"2026-07-24T16:14:37Z","title":"grapheme-kit: Grapheme-Level Metrics and Text Processing for Multilingual NLP","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T04:46:36.501877Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2607.22456"},"observation_digest":"sha256:ba61c08ed15a3142b03bf10511921e1cd5c71bfc1c302a97968bac486fb4745d","observation_id":"ca7c4a61-66e9-4aad-b528-250fd0392090","resolution":{"observed_at":"2026-08-01T04:46:36.501877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14799","snapshot_observed_at":"2026-08-01T01:52:41.469277Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25640","last_updated":"2026-07-28T12:26:55Z","snapshot_observed_at":"2026-08-08T02:49:45.524688Z","submitted_at":"2026-07-28T12:26:55Z","title":"LLM-as-a-Judge for Evaluating System Responses in Conversational Music Recommendation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T01:52:41.469277Z"},"links":{"cited_paper":"/paper/2006.14799","citing_paper":"/paper/2607.25640"},"observation_digest":"sha256:8b25099e1c63b8fe89997b19cc06cf45cf585cb216d89fd01b44ea3fb9f2c9d0","observation_id":"d0aa5349-6573-4528-84e6-c435d6897b56","resolution":{"observed_at":"2026-08-01T01:52:41.469277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2006.14799/citation-record","integrity":"/paper/2006.14799/integrity","json":"/paper/2006.14799/citation-record.json","paper":"/paper/2006.14799"},"outbound":[],"paper":{"arxiv_id":"2006.14799","last_updated":"2021-05-18T07:04:41Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T09:32:55.288150Z","submitted_at":"2020-06-26T04:52:48Z","title":"Evaluation of Text Generation: A Survey"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 29 inbound Pith citation observations for arXiv:2006.14799."}