{"as_of":"2026-08-15T05:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80df893c6a37ce556317a812a77ea8c226e0f76bc0794f450cd8dd5df14f2330","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:59:32.351325Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":12,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T22:55:50.014540Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2303.16634"},"observation_digest":"sha256:52cafbca45ffe0251ea1a79e1dbb6a61cacc0e86bebe753c6bb5b9e5722fd541","observation_id":"0cd08ba4-c0c0-4b19-97d5-f78d227a9fff","resolution":{"observed_at":"2026-05-12T22:55:50.901173Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2308.07201","last_updated":"2023-08-14T15:13:04Z","snapshot_observed_at":"2026-08-02T01:34:38.978920Z","submitted_at":"2023-08-14T15:13:04Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T13:03:18.765496Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2308.07201"},"observation_digest":"sha256:2a774e83e3a2e5ab474760398b292c68683589d633f69f283d20625050fb762d","observation_id":"2a945c7e-7d2a-48b2-bcd2-39f3bffba0e4","resolution":{"observed_at":"2026-05-13T13:03:18.849944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T06:25:20.966510Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2309.10253"},"observation_digest":"sha256:dcd3aeb8c5aa0177e54821236801f7f8c120410c1bf9d211f389d3840b81d8ed","observation_id":"da3b69b4-b1ad-43a3-a649-ca760b30037e","resolution":{"observed_at":"2026-05-15T06:25:21.097589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-11T05:10:57.816312Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2404.16130"},"observation_digest":"sha256:a8086718dfff5f32d8953bac7a8ff7ec41c20df911c24263e075198b1dc82aba","observation_id":"d53759e9-017d-4afd-a1b8-aa63f2e7c5af","resolution":{"observed_at":"2026-05-11T05:10:58.035351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2411.01141","last_updated":"2026-05-20T04:50:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-02T05:10:50Z","title":"Dictionary Insertion Prompting for Multilingual Reasoning on Multilingual Large Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-23T18:03:19.212619Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2411.01141"},"observation_digest":"sha256:8e491c34195162b382d89bc6b3d476ba4d5205569e9393890694b4d6770948b7","observation_id":"bc4e9816-f1ee-4c3e-8b68-81dca979c415","resolution":{"observed_at":"2026-05-23T18:05:44.746639Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-12T10:59:32.351325Z","title":"Is chatgpt a good nlg evaluator? a preliminary study","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18731","last_updated":"2024-11-27T20:18:36Z","snapshot_observed_at":"2026-08-12T10:54:14.663410Z","submitted_at":"2024-11-27T20:18:36Z","title":"The Performance of the LSTM-based Code Generated by Large Language Models (LLMs) in Forecasting Time Series Data","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:59:32.351325Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2411.18731"},"observation_digest":"sha256:297ce9d5061f2eb1224881bfcf31155620d6643c0ce66843dfc2302a65b1b88f","observation_id":"bbf426cf-9d02-4344-b980-43b4eedce01e","resolution":{"observed_at":"2026-08-12T10:59:32.351325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-12T04:32:03.114529Z","title":"Is chatgpt a good nlg evaluator? a preliminary study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01333","last_updated":"2024-12-02T09:56:18Z","snapshot_observed_at":"2026-08-13T14:04:07.660512Z","submitted_at":"2024-12-02T09:56:18Z","title":"Can Large Language Models Serve as Evaluators for Code Summarization?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T04:32:03.114529Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2412.01333"},"observation_digest":"sha256:457d291203f20c07d9d54a7e4e35d4641252cec0cb2f8c0c5821091513e0f9bb","observation_id":"ac43f845-a8d3-4563-997b-b3718a9a75be","resolution":{"observed_at":"2026-08-12T04:32:03.114529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-10T23:53:12.345574Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19906","last_updated":"2024-12-27T19:42:25Z","snapshot_observed_at":"2026-08-11T19:53:23.785038Z","submitted_at":"2024-12-27T19:42:25Z","title":"Evaluate Summarization in Fine-Granularity: Auto Evaluation with LLM","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T23:53:12.345574Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2412.19906"},"observation_digest":"sha256:5a17fb3732a0eec770e3dc531e0f2a2d9ba69411047681cb296dc15ac5518bf2","observation_id":"eeea721b-332f-47bd-b9a5-6a3963aa821d","resolution":{"observed_at":"2026-08-10T23:53:12.345574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-10T21:57:33.156333Z","title":"Is chatgpt a good nlg evaluator? a preliminary study","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03491","last_updated":"2025-06-17T18:44:37Z","snapshot_observed_at":"2026-08-13T16:22:57.799819Z","submitted_at":"2025-01-07T03:21:17Z","title":"Can LLMs Ask Good Questions?","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T21:57:33.156333Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2501.03491"},"observation_digest":"sha256:ae1a59ac91e2dd6f74f9eb7115ba4adcaad78343cd2ff17f5fbb8e60ced78ad5","observation_id":"ff2479d4-4955-448a-ac03-c54cf16ba38a","resolution":{"observed_at":"2026-08-10T21:57:33.156333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-10T19:41:51.246209Z","title":"arXiv preprint arXiv:2303.04048 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09861","last_updated":"2025-01-16T22:20:04Z","snapshot_observed_at":"2026-08-13T23:45:26.390077Z","submitted_at":"2025-01-16T22:20:04Z","title":"Optimization is Better than Generation: Optimizing Commit Message Leveraging Human-written Commit Message","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T19:41:51.246209Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2501.09861"},"observation_digest":"sha256:c231f3bbb2381722640010dbbb837fc7f9c3c283f92a14906be6f78aa57accf3","observation_id":"1f0cc3fd-c942-477f-9192-509c990e79c5","resolution":{"observed_at":"2026-08-10T19:41:51.246209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-09T18:17:21.169401Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00641","last_updated":"2025-02-11T13:12:16Z","snapshot_observed_at":"2026-08-14T13:03:47.760526Z","submitted_at":"2025-02-02T03:07:45Z","title":"Evaluating Small Language Models for News Summarization: Implications and Factors Influencing Performance","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T18:17:21.169401Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2502.00641"},"observation_digest":"sha256:9586a727c9da598e9306bf3a6720a2650d9fae066f684e33abe2a5e3141e3272","observation_id":"d12a5834-776f-4c48-a43c-de0aa7f17bf7","resolution":{"observed_at":"2026-08-09T18:17:21.169401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-09T13:33:57.670287Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02061","last_updated":"2026-07-28T04:34:05Z","snapshot_observed_at":"2026-08-09T23:45:11.620615Z","submitted_at":"2025-02-04T07:17:54Z","title":"Reason4Rec: Deliberative User Preference Alignment of Large Language Models for Recommendation","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T13:33:57.670287Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2502.02061"},"observation_digest":"sha256:de886b74fdd862531a7a524e60a8c7bd2b5807da1eb1271f199be26e02cb377a","observation_id":"65f07b96-8cf7-42db-8261-40ad4f42a36c","resolution":{"observed_at":"2026-08-09T13:33:57.670287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-08T23:35:38.452575Z","title":"Is chatgpt a good nlg evaluator? a preliminary study","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04095","last_updated":"2025-02-06T14:12:41Z","snapshot_observed_at":"2026-08-12T13:17:11.612965Z","submitted_at":"2025-02-06T14:12:41Z","title":"LLMs to Support a Domain Specific Knowledge Assistant","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T23:35:38.452575Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2502.04095"},"observation_digest":"sha256:be0576745aec130b91e62e16b3721d951dc279c6636d3def5dc286b9372a9407","observation_id":"3b2abbf5-d459-4bd4-aa41-eda814481ab7","resolution":{"observed_at":"2026-08-08T23:35:38.452575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2503.04338","last_updated":"2026-04-27T08:04:44Z","snapshot_observed_at":"2026-08-03T03:43:27.981758Z","submitted_at":"2025-03-06T11:34:49Z","title":"In-depth Analysis of Graph-based RAG in a Unified Framework","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-23T01:36:25.057478Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2503.04338"},"observation_digest":"sha256:453faff0a38869550de9dc1f0c8d7467d2faba143d2b650784fe982307deeb7f","observation_id":"fb4babe8-2286-4312-9de9-f81bf65a5075","resolution":{"observed_at":"2026-05-23T01:37:22.326507Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-07T15:26:10.122394Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15214","last_updated":"2025-05-27T07:37:47Z","snapshot_observed_at":"2026-08-08T08:35:13.565692Z","submitted_at":"2025-05-21T07:44:30Z","title":"R-TOFU: Unlearning in Large Reasoning Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:26:10.122394Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2505.15214"},"observation_digest":"sha256:5991d86d47b17fc7fb7cab9c6c7c591841c9841097f8cdb64b7157cb3d9e899d","observation_id":"0aec59ac-933b-45c0-97a9-90d788933f67","resolution":{"observed_at":"2026-08-07T15:26:10.122394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-07T15:28:10.352664Z","title":"Is chatgpt a good nlg evaluator? a preliminary study","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15240","last_updated":"2025-05-21T08:16:18Z","snapshot_observed_at":"2026-08-14T04:01:55.895222Z","submitted_at":"2025-05-21T08:16:18Z","title":"Generalised Probabilistic Modelling and Improved Uncertainty Estimation in Comparative LLM-as-a-judge","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:28:10.352664Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2505.15240"},"observation_digest":"sha256:e279cbcb939dc7c6a084d5ae5077eab1e6ea48b2785ea667e58b2ece70480ab4","observation_id":"9ef6c73d-62fc-4021-b73b-af03aada0b01","resolution":{"observed_at":"2026-08-07T15:28:10.352664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-07T15:03:41.497625Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16425","last_updated":"2025-05-22T09:10:09Z","snapshot_observed_at":"2026-08-09T16:14:10.026741Z","submitted_at":"2025-05-22T09:10:09Z","title":"$I^2G$: Generating Instructional Illustrations via Text-Conditioned Diffusion","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:03:41.497625Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2505.16425"},"observation_digest":"sha256:9ff06e120f02670ab827d67bafd3c0c734bec6d96399d6b18f44ce573056c050","observation_id":"e384682d-fe63-4e4f-81c2-40d84d611c53","resolution":{"observed_at":"2026-08-07T15:03:41.497625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-07T10:58:27.365332Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03785","last_updated":"2025-07-09T10:58:38Z","snapshot_observed_at":"2026-08-10T16:08:13.569998Z","submitted_at":"2025-06-04T09:46:43Z","title":"Knockout LLM Assessment: Using Large Language Models for Evaluations through Iterative Pairwise Comparisons","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:27.365332Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2506.03785"},"observation_digest":"sha256:0fbf9c4a27cca17bca349ba9eb7491d19d644b4c28673fb49c27bdb6888c1bdd","observation_id":"d54c5bac-9273-48d6-b8c2-88b91f717d13","resolution":{"observed_at":"2026-08-07T10:58:27.365332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-06T18:07:37.408102Z","title":"Is chatgpt a good NLG evaluator? A preliminary study","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09188","last_updated":"2025-07-12T08:15:05Z","snapshot_observed_at":"2026-08-15T04:15:48.624174Z","submitted_at":"2025-07-12T08:15:05Z","title":"Retrieval-Augmented Recommendation Explanation Generation with Hierarchical Aggregation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:07:37.408102Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2507.09188"},"observation_digest":"sha256:1aec9c2f6d564b2b17de394b08f2302e4fd4ed695ce80d1ce79622105eb77ba5","observation_id":"61ca4b3c-b906-4721-b1d8-51e7392ce5bf","resolution":{"observed_at":"2026-08-06T18:07:37.408102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2507.18902","last_updated":"2026-05-19T13:38:06Z","snapshot_observed_at":"2026-08-14T02:18:13.281481Z","submitted_at":"2025-07-25T02:51:14Z","title":"SLoW: Select Low-frequency Words! Automatic Dictionary Selection for Translation on Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-21T23:31:58.225436Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2507.18902"},"observation_digest":"sha256:0a56c70e586b9bcdd8076b5d452200925cf8ea438c13b7e3f9905c148181f83b","observation_id":"7074985d-727f-467a-9264-d029930fb6de","resolution":{"observed_at":"2026-05-21T23:34:26.392442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T15:44:21.334991Z","title":"arXiv preprint arXiv:2303.04048","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19578","last_updated":"2025-08-27T05:23:22Z","snapshot_observed_at":"2026-08-13T21:37:20.160856Z","submitted_at":"2025-08-27T05:23:22Z","title":"Towards a Holistic and Automated Evaluation Framework for Multi-Level Comprehension of LLMs in Book-Length Contexts","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T15:44:21.334991Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2508.19578"},"observation_digest":"sha256:73cf73f0d4f85e6e4e093c7d526a2c7f8774c8051d1cefb92d64e9901a046854","observation_id":"6b9d5de5-5b61-4411-aa16-363f63b34525","resolution":{"observed_at":"2026-08-05T15:44:21.334991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-04T22:33:31.375425Z","title":"Is chatgpt a good nlg evaluator? a preliminary study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-12T10:04:00.966804Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:31.375425Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:94674415991c893ec9fc1b02157c3829d21d052053605f807d426283a861ea08","observation_id":"0a3412f4-d392-46eb-9f58-4b818546cf79","resolution":{"observed_at":"2026-08-04T22:33:31.375425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-04T11:32:03.720711Z","title":"Is chatgpt a good nlg evaluator? a preliminary study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04281","last_updated":"2026-07-30T05:20:33Z","snapshot_observed_at":"2026-08-12T18:24:47.911417Z","submitted_at":"2025-10-05T16:46:29Z","title":"RetiBridge: Bridging Quantitative Retinal Biomarkers and Qualitative Diagnosis with a Knowledge-Guided Multimodal Large Language Model","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T11:32:03.720711Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2510.04281"},"observation_digest":"sha256:d0dcc5de4b8b1e3c2268633e2676b8c5638e310ab3bb6db257b1725f087c6a69","observation_id":"37094538-b6cc-4d56-a730-73334d089f0a","resolution":{"observed_at":"2026-08-04T11:32:03.720711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-03T10:43:49.943824Z","title":"Is chatgpt a good nlg evaluator? a preliminary study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09118","last_updated":"2026-07-16T14:44:01Z","snapshot_observed_at":"2026-08-12T20:18:45.547153Z","submitted_at":"2026-01-14T03:35:09Z","title":"LPCAN: Lightweight Pyramid Cross-Attention Network for Rail Surface Defect Detection Using RGB-D Data","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T10:43:49.943824Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2601.09118"},"observation_digest":"sha256:b967fe3bc4658426d8995d5937ae6b66906f56ef6cc56d6abb98dccbaee18846","observation_id":"0c864c14-98df-4288-ae5e-7a1bfb264827","resolution":{"observed_at":"2026-08-03T10:43:49.943824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-03T10:43:42.132070Z","title":"Is chatgpt a good nlg evaluator? a preliminary study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.09238","last_updated":"2026-07-16T14:45:17Z","snapshot_observed_at":"2026-08-10T07:54:29.987163Z","submitted_at":"2026-01-14T07:21:57Z","title":"Knowledge-Embedded and Hypernetwork-Guided Few-Shot Substation Meter Defect Image Generation Method","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T10:43:42.132070Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2601.09238"},"observation_digest":"sha256:076f3a687b5d33e8809e2c31b03f1e31222baa914015238cefc43d6dc2fff4b5","observation_id":"d11aba2e-8ed6-4286-91e1-cc67ff93c667","resolution":{"observed_at":"2026-08-03T10:43:42.132070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2603.10477","last_updated":"2026-04-08T07:03:59Z","snapshot_observed_at":"2026-08-13T07:07:01.960634Z","submitted_at":"2026-03-11T07:00:59Z","title":"PEEM: Prompt Engineering Evaluation Metrics for Interpretable Joint Evaluation of Prompts and Responses","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T13:57:41.428695Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2603.10477"},"observation_digest":"sha256:46a7e585c6d727cadabcf749105af635bdab3b485b8f5231c72de6c187ec6d4f","observation_id":"f1f30f70-58da-4bda-9248-7d40dbb60e40","resolution":{"observed_at":"2026-05-15T14:00:03.058822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2604.03666","last_updated":"2026-04-04T09:35:05Z","snapshot_observed_at":"2026-08-11T17:43:17.264759Z","submitted_at":"2026-04-04T09:35:05Z","title":"MMP-Refer: Multimodal Path Retrieval-augmented LLMs For Explainable Recommendation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T17:28:28.480792Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2604.03666"},"observation_digest":"sha256:9bb89ab9959bdcdd1d14f4973b3ad5f0d7efa5dbe8f0d4c515c685be26e83ec5","observation_id":"5d918467-b1be-45b2-9bde-d2798909e7d0","resolution":{"observed_at":"2026-05-13T17:33:02.616446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2605.19180","last_updated":"2026-05-18T23:05:21Z","snapshot_observed_at":"2026-08-13T18:50:17.644747Z","submitted_at":"2026-05-18T23:05:21Z","title":"Supporting System Testing with a Multi-Agent LLM-based Framework for Knowledge Graph Extraction: A Case Study with Ethernet Switch Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T08:32:39.748993Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2605.19180"},"observation_digest":"sha256:dbc614df362993da0d4564b27924e2354712c7c7f5f9ed331cd9c2b3f7d64680","observation_id":"30b93ae1-88e9-4b1c-9097-577eed10007a","resolution":{"observed_at":"2026-05-20T08:33:08.873287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":"2303.04048","doi":"10.48550/arxiv.2303.04048","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is ChatGPT a good NLG evaluator? A preliminary study","venue":"arXiv (Cornell University)","work_id":"fb65527e-1600-4548-bf98-88e9143f5868","year":2023},"citing_paper":{"arxiv_id":"2605.31080","last_updated":"2026-05-29T09:47:45Z","snapshot_observed_at":"2026-08-13T08:10:55.898540Z","submitted_at":"2026-05-29T09:47:45Z","title":"A Pilot Study on Curator-Guided Multilingual Art Description for Blind and Low-Vision Audiences with Small Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T19:53:36.990878Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2605.31080"},"observation_digest":"sha256:a9c51a6c1224b56845e60525c2f07f5341764c631fd5281f9f14fc16e0d64c80","observation_id":"cf66b034-f40b-41cb-a939-c61f338d46b9","resolution":{"observed_at":"2026-06-28T20:22:37.605994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04048","snapshot_observed_at":"2026-08-08T04:27:34.073545Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02975","last_updated":"2026-08-04T00:24:06Z","snapshot_observed_at":"2026-08-14T09:07:11.191961Z","submitted_at":"2026-08-04T00:24:06Z","title":"TQLite: Multi-LLM Jury Guided Distillation for Real-time MQM Translation Quality Evaluation","version":1},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-08-08T04:27:34.073545Z"},"links":{"cited_paper":"/paper/2303.04048","citing_paper":"/paper/2608.02975"},"observation_digest":"sha256:ecd2aed557d394a919f097fcad4f7e58fa01c27a8c70ae8dcd48b53ceb1ffb80","observation_id":"13a13b4e-1704-49b8-bffb-1735d23d7305","resolution":{"observed_at":"2026-08-08T04:27:34.073545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.04048/citation-record","integrity":"/paper/2303.04048/integrity","json":"/paper/2303.04048/citation-record.json","paper":"/paper/2303.04048"},"outbound":[],"paper":{"arxiv_id":"2303.04048","last_updated":"2023-10-24T14:56:51Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T11:06:12.407244Z","submitted_at":"2023-03-07T16:57:20Z","title":"Is ChatGPT a Good NLG Evaluator? A Preliminary Study"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2303.04048."}