{"as_of":"2026-08-08T19:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7af155f929dfe4217eb9516e742f6e3514bf37abc2877c9ba2d360047ed2079f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":29,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:24:13.119093Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T13:28:18.568194Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2308.07201","last_updated":"2023-08-14T15:13:04Z","snapshot_observed_at":"2026-08-02T01:34:38.978920Z","submitted_at":"2023-08-14T15:13:04Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T13:03:18.765496Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2308.07201"},"observation_digest":"sha256:3e242fb17b1e8c9c6657eb1b2370bc35e2feaeec28c4f3573f5d05edf4758788","observation_id":"4748c6e0-df3c-4d25-a780-8acaf550ed37","resolution":{"observed_at":"2026-05-13T13:03:18.843161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-08T17:24:13.119093Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05933","last_updated":"2025-02-14T23:09:11Z","snapshot_observed_at":"2026-08-08T18:00:08.154766Z","submitted_at":"2025-02-09T15:26:32Z","title":"Learning to Substitute Words with Model-based Score Ranking","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T17:24:13.119093Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2502.05933"},"observation_digest":"sha256:13df55840dbd653b9da4e3a02e495b23eac206a8c7a5ec5e5c82523e7941de3f","observation_id":"553b8061-9c76-4f4c-97d7-80890ab36607","resolution":{"observed_at":"2026-08-08T17:24:13.119093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2505.16737","last_updated":"2026-04-23T08:31:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T14:52:10Z","title":"Secure LLM Fine-Tuning via Safety-Aware Probing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T13:07:09.402763Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2505.16737"},"observation_digest":"sha256:6beb30bb02c773b8a9851cadc4a8ab11a27d8db81c551c34ab9cba5532f89abd","observation_id":"e641fbff-8315-4057-81d6-d7b574e2e94e","resolution":{"observed_at":"2026-05-22T13:11:35.885855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T14:50:39.845311Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17558","last_updated":"2025-05-23T07:05:09Z","snapshot_observed_at":"2026-08-07T21:43:16.805139Z","submitted_at":"2025-05-23T07:05:09Z","title":"Teaching with Lies: Curriculum DPO on Synthetic Negatives for Hallucination Detection","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:50:39.845311Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2505.17558"},"observation_digest":"sha256:26279f25cc66507cbea84ad4e28db2602d981f63e98e910c5ac89e5b5d5480eb","observation_id":"c1d45d57-7267-4b9a-9917-1c0c43ed79b8","resolution":{"observed_at":"2026-08-07T14:50:39.845311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T14:35:03.812275Z","title":", Das, D","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18464","last_updated":"2025-05-24T02:07:32Z","snapshot_observed_at":"2026-08-07T18:04:52.579875Z","submitted_at":"2025-05-24T02:07:32Z","title":"From Reddit to Generative AI: Evaluating Large Language Models for Anxiety Support Fine-tuned on Social Media Data","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:35:03.812275Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2505.18464"},"observation_digest":"sha256:0139328d0529e06fecdb66f3ff4c61d17b96c016ab61cea5c1c926e389933643","observation_id":"8abaae69-2244-44d3-836c-e249d9e61625","resolution":{"observed_at":"2026-08-07T14:35:03.812275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T11:23:43.738463Z","title":"Bleurt: Learning robust metrics for text generation,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.02696","last_updated":"2025-06-03T09:44:28Z","snapshot_observed_at":"2026-08-07T11:15:44.312106Z","submitted_at":"2025-06-03T09:44:28Z","title":"Shaking to Reveal: Perturbation-Based Detection of LLM Hallucinations","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:23:43.738463Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.02696"},"observation_digest":"sha256:a6842e5862e072a0d266fafa9814f61eab77ecf829f41f640cc66c6a909e8db3","observation_id":"cc69d0a9-6165-46c7-a44f-931163779e6d","resolution":{"observed_at":"2026-08-07T11:23:43.738463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T10:31:58.726456Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05070","last_updated":"2025-08-05T04:45:24Z","snapshot_observed_at":"2026-08-08T08:47:53.025574Z","submitted_at":"2025-06-05T14:18:21Z","title":"RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:31:58.726456Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.05070"},"observation_digest":"sha256:d7a7d7dbe44996cf18ac15ec1b2b7aa8f90a8a96fd9d933197ff5cd2ad9db88b","observation_id":"7146a338-e57b-45a4-b569-ff02429e57e1","resolution":{"observed_at":"2026-08-07T10:31:58.726456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T05:42:38.740034Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.07440","last_updated":"2025-06-09T05:33:28Z","snapshot_observed_at":"2026-08-07T21:40:46.271523Z","submitted_at":"2025-06-09T05:33:28Z","title":"Federated In-Context Learning: Iterative Refinement for Improved Answer Quality","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:42:38.740034Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.07440"},"observation_digest":"sha256:1223bb4292b649d912f4a6dcfd86b008a698307e8fd3756d626b366f77c0493c","observation_id":"15cac342-1ad2-4f07-87aa-8ba3e0230c58","resolution":{"observed_at":"2026-08-07T05:42:38.740034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T04:42:02.689211Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09958","last_updated":"2025-06-11T17:31:38Z","snapshot_observed_at":"2026-08-08T12:16:45.655003Z","submitted_at":"2025-06-11T17:31:38Z","title":"Kvasir-VQA-x1: A Multimodal Dataset for Medical Reasoning and Robust MedVQA in Gastrointestinal Endoscopy","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:02.689211Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.09958"},"observation_digest":"sha256:477690add4ba4112f3f9a7f24ab574434a620493eefdfe1f64e541ec28b727e1","observation_id":"3d5da4d0-b840-4da3-a59f-969e4b5f2476","resolution":{"observed_at":"2026-08-07T04:42:02.689211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-07T04:29:46.327486Z","title":"& Parikh, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.21567","last_updated":"2025-07-01T19:14:32Z","snapshot_observed_at":"2026-08-07T21:43:51.478008Z","submitted_at":"2025-06-12T09:11:26Z","title":"BioPars: A Pretrained Biomedical Large Language Model for Persian Biomedical Text Mining","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:46.327486Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2506.21567"},"observation_digest":"sha256:5f135988324107b3c0414ab08744e0e3cd3cd4fd8a893aaaa9dba9d0c97b8b95","observation_id":"c7b411a6-e578-450d-9441-c3438dc892d6","resolution":{"observed_at":"2026-08-07T04:29:46.327486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T20:39:09.350124Z","title":"BLEURT: Learning robust metrics for text generation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03033","last_updated":"2025-07-03T01:51:49Z","snapshot_observed_at":"2026-08-07T21:42:47.073261Z","submitted_at":"2025-07-03T01:51:49Z","title":"Preserving Privacy, Increasing Accessibility, and Reducing Cost: An On-Device Artificial Intelligence Model for Medical Transcription and Note Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:39:09.350124Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.03033"},"observation_digest":"sha256:be8cb8b00340b6f1c85c6c1d0b9fcf906816cce75426fb3191dbee355a05ec11","observation_id":"531449bd-5594-4489-b6d9-a368e974c07b","resolution":{"observed_at":"2026-08-06T20:39:09.350124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T18:23:31.866770Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08459","last_updated":"2025-07-11T10:02:21Z","snapshot_observed_at":"2026-08-07T21:41:40.177971Z","submitted_at":"2025-07-11T10:02:21Z","title":"Diagnosing Failures in Large Language Models' Answers: Integrating Error Attribution into Evaluation Framework","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T18:23:31.866770Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.08459"},"observation_digest":"sha256:fcd10a8bc28ea195f3a560be2b379b22ef426ef3b937547529274f13ac830e17","observation_id":"cf087154-cc14-41c2-9010-7e91381fee32","resolution":{"observed_at":"2026-08-06T18:23:31.866770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T17:38:26.260688Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10306","last_updated":"2025-07-14T14:09:36Z","snapshot_observed_at":"2026-08-08T04:42:24.582662Z","submitted_at":"2025-07-14T14:09:36Z","title":"Contrastive Pretraining with Dual Visual Encoders for Gloss-Free Sign Language Translation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:26.260688Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.10306"},"observation_digest":"sha256:71978c97a252f621e09549402a78f48c1aa42ec4e37c9636a102c349d936e2c1","observation_id":"96b25d36-b084-4fa1-b2d8-fd095ae79f24","resolution":{"observed_at":"2026-08-06T17:38:26.260688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T14:52:43.086257Z","title":"Bleurt: Learning robust metrics for text generation.arXiv preprint arXiv:2004.04696, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.086257Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:5e62b7afcd8ada1ab60ea8849a0587c444fa4793873ace99abd433a30d42a44d","observation_id":"f2ea7918-8e3f-4ba1-b3bb-08b825cf6a36","resolution":{"observed_at":"2026-08-06T14:52:43.086257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-05T16:25:19.860298Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.18636","last_updated":"2026-06-10T06:33:48Z","snapshot_observed_at":"2026-08-08T12:22:18.093779Z","submitted_at":"2025-08-26T03:25:49Z","title":"LaQual: An Automated Framework for LLM App Quality Evaluation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T16:25:19.860298Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2508.18636"},"observation_digest":"sha256:ec0504adf5f7eb8aca0fe1fe251fdf0778abcbac0e750f2c83126f72ccffa454","observation_id":"a60ece5c-845a-4e46-bbb4-36f0a2e19cf3","resolution":{"observed_at":"2026-08-05T16:25:19.860298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-05T15:43:40.909985Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19580","last_updated":"2025-08-27T05:26:36Z","snapshot_observed_at":"2026-08-08T12:07:28.293788Z","submitted_at":"2025-08-27T05:26:36Z","title":"ArgCMV: An Argument Summarization Benchmark for the LLM-era","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T15:43:40.909985Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2508.19580"},"observation_digest":"sha256:c824511c2c307b0adb80c2c58b999b9e79501852ed2149209a826318510e675a","observation_id":"ad36b03d-27b5-4a72-a015-b029487b2161","resolution":{"observed_at":"2026-08-05T15:43:40.909985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-04T23:35:04.226541Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09714","last_updated":"2025-09-08T11:00:18Z","snapshot_observed_at":"2026-08-08T07:55:38.486913Z","submitted_at":"2025-09-08T11:00:18Z","title":"How Small Transformation Expose the Weakness of Semantic Similarity Measures","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T23:35:04.226541Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2509.09714"},"observation_digest":"sha256:90b868a92a64e1c0e9b89e9eea88c3318f98643c613d439613b68158d9754adb","observation_id":"74ae44ef-0794-4b9c-ae4a-fddaf8dfc278","resolution":{"observed_at":"2026-08-04T23:35:04.226541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2512.15907","last_updated":"2026-04-21T01:06:33Z","snapshot_observed_at":"2026-07-06T22:39:23.633419Z","submitted_at":"2025-12-17T19:20:20Z","title":"TabReX : Tabular Referenceless eXplainable Evaluation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T21:24:44.941536Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2512.15907"},"observation_digest":"sha256:7b5b050af3914418f53a21c1ede5c73f662fc4f6e667be198769278f3a203ac8","observation_id":"eaf1a47d-1aab-4f24-9415-c1ccb5c31bf4","resolution":{"observed_at":"2026-05-16T21:28:34.066805Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2512.24366","last_updated":"2026-05-15T13:16:52Z","snapshot_observed_at":"2026-07-06T22:40:23.205898Z","submitted_at":"2025-12-30T17:25:15Z","title":"On the Factual Consistency of Text-based Explainable Recommendation Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T15:45:20.394551Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2512.24366"},"observation_digest":"sha256:606249f08d50934f3dbd36c2abb5161b14b9ca95a4f6ddf6c25e81b7cd1eca7e","observation_id":"cea93c32-3842-4d25-ac0c-82dba72e5fe8","resolution":{"observed_at":"2026-05-21T15:50:19.414438Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-03T06:46:26.342276Z","title":"Bleurt: Learning robust metrics for text generation.arXiv preprint arXiv:2004.04696, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2601.22025","last_updated":"2026-06-09T23:57:32Z","snapshot_observed_at":"2026-08-07T21:40:38.906811Z","submitted_at":"2026-01-29T17:32:34Z","title":"When Generic Prompt Improvements Hurt: Evaluation-Driven Iteration for LLM Applications","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T06:46:26.342276Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2601.22025"},"observation_digest":"sha256:8c0b7cc3c1937a16d08c099e5ffd422931b262c98ea95bf84a08affe44daf06f","observation_id":"c8b1f316-d9e5-45ad-af54-0cc5541e8488","resolution":{"observed_at":"2026-08-03T06:46:26.342276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.03666","last_updated":"2026-04-04T09:35:05Z","snapshot_observed_at":"2026-08-02T16:25:21.146703Z","submitted_at":"2026-04-04T09:35:05Z","title":"MMP-Refer: Multimodal Path Retrieval-augmented LLMs For Explainable Recommendation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T17:28:28.480792Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.03666"},"observation_digest":"sha256:613d8e1c2be552a0b3905a965edb33fdbbce90f3ae8989c14349173576773340","observation_id":"b8193dd6-cd75-4ed3-bd60-ec4bec786bcd","resolution":{"observed_at":"2026-05-13T17:33:02.624066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.03724","last_updated":"2026-06-25T13:28:29Z","snapshot_observed_at":"2026-07-13T12:26:55.346804Z","submitted_at":"2026-04-04T13:01:45Z","title":"Rank, Don't Generate: Statement-level Ranking for Explainable Recommendation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T17:28:37.922342Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.03724"},"observation_digest":"sha256:6c101eb555af0b1d059a0171a3ce87cdfbac708e925dcae8b7eac7dd1deabfb5","observation_id":"d7e2c477-f15d-4e71-b780-edce5a8353b2","resolution":{"observed_at":"2026-05-13T17:33:02.593278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.10470","last_updated":"2026-04-12T05:49:37Z","snapshot_observed_at":"2026-07-06T22:59:05.519456Z","submitted_at":"2026-04-12T05:49:37Z","title":"From Query to Counsel: Structured Reasoning with a Multi-Agent Framework and Dataset for Legal Consultation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:54:53.603591Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.10470"},"observation_digest":"sha256:fd26eabd0755123f032a3059e5fa944c5c0980d737977debe189b19b2574692a","observation_id":"b0f3b587-3df3-47b9-9161-e0bebb062aa6","resolution":{"observed_at":"2026-05-11T09:36:12.965564Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.17200","last_updated":"2026-04-19T02:04:14Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T02:04:14Z","title":"Calibrating Model-Based Evaluation Metrics for Summarization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-10T06:36:55.334742Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.17200"},"observation_digest":"sha256:d9a843d1213d1c25ef6ca793d97df0b1513bc90b119b0606c9940fb3b81ea20d","observation_id":"4be422e9-e4ab-4220-9a0c-38f850a9f6ab","resolution":{"observed_at":"2026-05-10T06:41:36.937721Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2604.20334","last_updated":"2026-04-22T08:30:15Z","snapshot_observed_at":"2026-07-06T23:06:49.210284Z","submitted_at":"2026-04-22T08:30:15Z","title":"An Explainable Approach to Document-level Translation Evaluation with Topic Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-09T23:11:59.716468Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2604.20334"},"observation_digest":"sha256:fc9e7d0911d397e1736b282f2a3d41265d1b8739a461d4c1d3b86f3136ba4085","observation_id":"2cfb4fc8-9479-4ca2-945f-003181474048","resolution":{"observed_at":"2026-05-11T14:11:06.101358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2605.05902","last_updated":"2026-05-07T09:14:46Z","snapshot_observed_at":"2026-08-02T04:28:51.680521Z","submitted_at":"2026-05-07T09:14:46Z","title":"Evaluating Non-English Developer Support in Machine Learning for Software Engineering","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-08T09:13:24.365852Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2605.05902"},"observation_digest":"sha256:0401903e2bb80bade970b51d31d764912b44fbdd926d9a25ec7b1e71730caf62","observation_id":"73d497f4-c305-4a16-b118-66c0be8c6b3f","resolution":{"observed_at":"2026-05-11T20:26:09.484138Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":"2004.04696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-07-03T13:28:18.568194Z","title":"Bleurt: Learning robust metrics for text generation","venue":null,"work_id":"55ab59c9-b06b-48c6-829e-64343cc28679","year":2020},"citing_paper":{"arxiv_id":"2606.12198","last_updated":"2026-07-15T16:08:17Z","snapshot_observed_at":"2026-08-08T14:14:58.387252Z","submitted_at":"2026-06-10T15:18:32Z","title":"LLM-Based User Personas for Recommendations at Scale","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T08:07:27.059673Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2606.12198"},"observation_digest":"sha256:e15800d38d3fd675879caf0ca8dcbfc7c301a69587af779c30d9ced4c6f30405","observation_id":"2199a87b-f254-4d2d-8ad9-0e1e54d1157e","resolution":{"observed_at":"2026-07-03T13:28:18.569695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-02T11:48:20.628483Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.12198","last_updated":"2026-07-15T16:08:17Z","snapshot_observed_at":"2026-08-08T14:14:58.387252Z","submitted_at":"2026-06-10T15:18:32Z","title":"LLM-Based User Personas for Recommendations at Scale","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:48:20.628483Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2606.12198"},"observation_digest":"sha256:95418bf7cb12befde3fa1cf518b290ca4ade32d4c460d16195065c538233b59a","observation_id":"be8025a3-ef3f-4b10-90b5-46bfdb523378","resolution":{"observed_at":"2026-08-02T11:48:20.628483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-08T04:27:34.047055Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02975","last_updated":"2026-08-04T00:24:06Z","snapshot_observed_at":"2026-08-08T14:42:46.438121Z","submitted_at":"2026-08-04T00:24:06Z","title":"TQLite: Multi-LLM Jury Guided Distillation for Real-time MQM Translation Quality Evaluation","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-08-08T04:27:34.047055Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2608.02975"},"observation_digest":"sha256:4f2decb90fe4fa5a68aecf281abdc5a5c3fc3b3320c5e24df9ca7132dfbb2cd3","observation_id":"a3d58939-6ea6-4f89-91f3-e7be978f9b63","resolution":{"observed_at":"2026-08-08T04:27:34.047055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2004.04696/citation-record","integrity":"/paper/2004.04696/integrity","json":"/paper/2004.04696/citation-record.json","paper":"/paper/2004.04696"},"outbound":[],"paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T18:39:53.307653Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 29 inbound Pith citation observations for arXiv:2004.04696."}