{"as_of":"2026-08-09T18:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3839c80db044e0e543cfb21277db706c38ccaa2cae61e0c15f6b3c4204163412","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:35:00.351522Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T14:57:03.744199Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"reference_index":168,"source":"arxiv_source","source_observed_at":"2026-05-12T15:46:03.247029Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2311.12983"},"observation_digest":"sha256:c0a7a82856b028f8399171dabbba9990735f063e396eb3d4b8596a0663c9d45a","observation_id":"f3b4525a-3f97-4bed-9eb8-9dd8ca0791b8","resolution":{"observed_at":"2026-05-12T15:46:03.602428Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2404.12390","last_updated":"2024-07-03T08:44:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-18T17:59:54Z","title":"BLINK: Multimodal Large Language Models Can See but Not Perceive","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T20:18:15.439163Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2404.12390"},"observation_digest":"sha256:00181de3ddba203e888e613706b08ffbc61ca9f7ee00dc8a5aee096232d6d977","observation_id":"532dd131-098b-434e-a28d-6f80c7074153","resolution":{"observed_at":"2026-05-15T20:18:15.689615Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-07T14:35:00.351522Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18434","last_updated":"2025-05-24T00:02:48Z","snapshot_observed_at":"2026-08-09T11:23:24.160028Z","submitted_at":"2025-05-24T00:02:48Z","title":"TNG-CLIP:Training-Time Negation Data Generation for Negation Awareness of CLIP","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:35:00.351522Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2505.18434"},"observation_digest":"sha256:9f20fd8c4b193177c96021740c3033f3ee4bc0bea3effe1c1ded4e270c55e30a","observation_id":"338c2a94-95c9-43ff-94cb-622dd6a851e1","resolution":{"observed_at":"2026-08-07T14:35:00.351522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-07T14:25:26.101775Z","title":"Tifa: Accurate and interpretable text-to-image faithfulness evaluation with question answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19196","last_updated":"2025-05-25T15:43:54Z","snapshot_observed_at":"2026-08-08T17:20:26.690914Z","submitted_at":"2025-05-25T15:43:54Z","title":"Step-level Reward for Free in RL-based T2I Diffusion Model Fine-tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:26.101775Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2505.19196"},"observation_digest":"sha256:ff545a321e2d8567e031a2524bc881a094e1dee5c069ee5c8c300059d338b7ec","observation_id":"ac972a64-6cde-41a2-b6f0-db927337c602","resolution":{"observed_at":"2026-08-07T14:25:26.101775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-07T10:30:27.996361Z","title":"Yushi Hu, Benlin Liu, Jungo Kasai, Yizhong Wang, Mari Ostendorf, Ranjay Krishna, and Noah A Smith","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05108","last_updated":"2025-06-05T14:53:34Z","snapshot_observed_at":"2026-08-08T05:58:57.473835Z","submitted_at":"2025-06-05T14:53:34Z","title":"DIMCIM: A Quantitative Evaluation Framework for Default-mode Diversity and Generalization in Text-to-Image Generative Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:27.996361Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2506.05108"},"observation_digest":"sha256:ddd8b5d5e1cfb630848f864a18affc5126c74739182d2f050a6e9527884ea04c","observation_id":"ca6781f0-1d25-4fe7-b785-4916d580ee93","resolution":{"observed_at":"2026-08-07T10:30:27.996361Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-06T21:03:00.879353Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01255","last_updated":"2025-07-02T00:20:06Z","snapshot_observed_at":"2026-08-08T11:19:06.223993Z","submitted_at":"2025-07-02T00:20:06Z","title":"AIGVE-MACS: Unified Multi-Aspect Commenting and Scoring Model for AI-Generated Video Evaluation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T21:03:00.879353Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2507.01255"},"observation_digest":"sha256:0fda62c40e28f12256e4ec7ac0948aaeb5e9535884982b614f87d4cc2603994a","observation_id":"ea392ca7-4baf-476d-9aa9-5cd84cd6d310","resolution":{"observed_at":"2026-08-06T21:03:00.879353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-06T18:50:42.666253Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answer- ing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-09T16:00:35.383984Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:42.666253Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:ae00d598a4e5d9ca67ea356b732a61fedddffd204b1b2432da20d233e9611ea0","observation_id":"676ddf00-af40-400e-bdb1-fad7f263a898","resolution":{"observed_at":"2026-08-06T18:50:42.666253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-05T18:41:32.084239Z","title":"Tifa: Accurate and interpretable text-to-image faithfulness evaluation with question answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.14413","last_updated":"2025-08-20T04:21:26Z","snapshot_observed_at":"2026-08-09T07:57:34.176288Z","submitted_at":"2025-08-20T04:21:26Z","title":"Disentanglement in T-space for Faster and Distributed Training of Diffusion Models with Fewer Latent-states","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T18:41:32.084239Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2508.14413"},"observation_digest":"sha256:6c4236e09c57029f199eca346b1c07beaa0d1018e9de6dd7c9617f14f9135ad7","observation_id":"67850597-ba20-4148-bcdb-b7fd79c80a67","resolution":{"observed_at":"2026-08-05T18:41:32.084239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-05T14:49:31.846334Z","title":"Tifa: Accurate and interpretable text-to-image faithfulness evaluation with question answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20881","last_updated":"2025-08-28T15:11:49Z","snapshot_observed_at":"2026-08-09T11:42:42.616763Z","submitted_at":"2025-08-28T15:11:49Z","title":"Understanding and evaluating computer vision models through the lens of counterfactuals","version":1},"reference_index":208,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:31.846334Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2508.20881"},"observation_digest":"sha256:eedc71d259fe79524b7d4458c1db2899576836d07c66845fc69731d69f36ffef","observation_id":"5fa3a9d5-e248-4f60-a87a-216b5424476f","resolution":{"observed_at":"2026-08-05T14:49:31.846334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-04T19:59:32.044233Z","title":"Tifa: Accurate and interpretable text-to-image faithfulness evaluation with question answering.arXiv preprint arXiv:2303.11897, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08940","last_updated":"2025-09-10T19:07:55Z","snapshot_observed_at":"2026-08-08T03:23:34.403562Z","submitted_at":"2025-09-10T19:07:55Z","title":"Discovering Divergent Representations between Text-to-Image Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T19:59:32.044233Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2509.08940"},"observation_digest":"sha256:f0f57223470700cf012a7277bc03f0c3fcefa9d3d57206df927b97529df33652","observation_id":"e75287e3-5e9d-47c4-a4c7-88e450328cb7","resolution":{"observed_at":"2026-08-04T19:59:32.044233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2511.08409","last_updated":"2026-04-08T09:02:44Z","snapshot_observed_at":"2026-08-09T10:59:00.816250Z","submitted_at":"2025-11-11T16:22:49Z","title":"Faithful-First Reasoning, Planning, and Acting for Multimodal LLMs","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T23:43:43.201888Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2511.08409"},"observation_digest":"sha256:03b6b63083d32edb1c81c5b60871fedf1ec0cf0cc86f1bcf3651ea32fd30486f","observation_id":"58469a3f-45db-4005-a7a3-ef05c61946c9","resolution":{"observed_at":"2026-05-17T23:45:30.714518Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2604.02406","last_updated":"2026-05-16T00:42:12Z","snapshot_observed_at":"2026-08-02T21:03:26.031924Z","submitted_at":"2026-04-02T17:17:12Z","title":"Evaluating AI-Generated Images of Cultural Artifacts with Community-Informed Rubrics","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-13T20:59:52.448832Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2604.02406"},"observation_digest":"sha256:7b14bb3dd7651507b40268c05c7bdb0436bed75923c8b4a515ca61355c99a323","observation_id":"63356f5d-cb41-4586-97de-a4ed4b9b54bd","resolution":{"observed_at":"2026-05-13T21:03:19.982943Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2604.02406","last_updated":"2026-05-16T00:42:12Z","snapshot_observed_at":"2026-08-02T21:03:26.031924Z","submitted_at":"2026-04-02T17:17:12Z","title":"Evaluating AI-Generated Images of Cultural Artifacts with Community-Informed Rubrics","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-21T10:35:39.269869Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2604.02406"},"observation_digest":"sha256:3751d15a960f91a9d0d64bbd1a1b676c0dad5cef001b23d7d16e3893020aaeb9","observation_id":"737195c3-2cc8-435c-bc32-5f5e19954836","resolution":{"observed_at":"2026-05-21T10:40:00.755494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2604.24052","last_updated":"2026-04-27T05:18:21Z","snapshot_observed_at":"2026-08-05T12:15:37.250141Z","submitted_at":"2026-04-27T05:18:21Z","title":"QEVA: A Reference-Free Evaluation Metric for Narrative Video Summarization with Multimodal Question Answering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T04:51:18.203826Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2604.24052"},"observation_digest":"sha256:1e0adae45841742b67d4603470292ff922d3508927ecb118fcab7b3727bc8aa1","observation_id":"71710eff-027c-49da-8616-035590152c32","resolution":{"observed_at":"2026-05-11T21:36:16.404118Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2605.17602","last_updated":"2026-05-20T20:58:48Z","snapshot_observed_at":"2026-08-02T06:34:30.012151Z","submitted_at":"2026-05-17T19:00:44Z","title":"AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T12:11:23.775843Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2605.17602"},"observation_digest":"sha256:990dd837ddfaaa773dfaa69f9143c8277a7d62691372df847153bc0dc957de77","observation_id":"89b589b9-67e5-432f-b3c4-ee3559a019dc","resolution":{"observed_at":"2026-05-20T12:13:16.092852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2605.17602","last_updated":"2026-05-20T20:58:48Z","snapshot_observed_at":"2026-08-02T06:34:30.012151Z","submitted_at":"2026-05-17T19:00:44Z","title":"AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T09:19:39.848194Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2605.17602"},"observation_digest":"sha256:add6696b264c4f66479fc3bd7253bfbf3f0d2bffae045a715e8519601447706b","observation_id":"7b2dff6e-02cf-4253-90af-4f3cb4d3f9a3","resolution":{"observed_at":"2026-05-22T09:21:21.500312Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":"2303.11897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-07-02T14:57:03.744199Z","title":"Alon Jacovi and Yoav Goldberg","venue":null,"work_id":"ade0051f-b36b-47a8-bacd-8151eb9d4b37","year":2023},"citing_paper":{"arxiv_id":"2607.00402","last_updated":"2026-07-01T04:00:27Z","snapshot_observed_at":"2026-08-07T02:31:41.165567Z","submitted_at":"2026-07-01T04:00:27Z","title":"The Illusion of High Utility in Safety Alignment of Text-to-Image Diffusion Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-02T14:56:40.860766Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2607.00402"},"observation_digest":"sha256:e684d42405acd15215cc833cdad676e6fc25c3ad6bc88a9858dbc729232d4011","observation_id":"fd596e6c-e198-4a01-b9fb-ad3df36462e8","resolution":{"observed_at":"2026-07-02T14:57:03.745541Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-01T00:03:54.867139Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23235","last_updated":"2026-07-25T14:41:34Z","snapshot_observed_at":"2026-08-09T11:40:38.564244Z","submitted_at":"2026-07-25T14:41:34Z","title":"A Reconstruction-Based Framework for Caption Evaluation Beyond Reference Captions","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T00:03:54.867139Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2607.23235"},"observation_digest":"sha256:f3d86fe0529d7452e02553b58175c4773f75b7bdef261a3f5e604b1377bc3a30","observation_id":"b557d234-f48b-4829-8f35-10d73131098d","resolution":{"observed_at":"2026-08-01T00:03:54.867139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11897","snapshot_observed_at":"2026-08-05T01:00:04.666098Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00440","last_updated":"2026-08-01T04:39:59Z","snapshot_observed_at":"2026-08-09T01:26:58.815611Z","submitted_at":"2026-08-01T04:39:59Z","title":"Poplar: A Scalable Pipeline for Human-Centric Image Dataset Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T01:00:04.666098Z"},"links":{"cited_paper":"/paper/2303.11897","citing_paper":"/paper/2608.00440"},"observation_digest":"sha256:e01f4884a81fe53426baad56e72fec63ffdc51f1f53a73e359a7d91ff4179e92","observation_id":"6dee82f8-7c2c-4f64-8a3c-7490ed143fdd","resolution":{"observed_at":"2026-08-05T01:00:04.666098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.11897/citation-record","integrity":"/paper/2303.11897/integrity","json":"/paper/2303.11897/citation-record.json","paper":"/paper/2303.11897"},"outbound":[],"paper":{"arxiv_id":"2303.11897","last_updated":"2023-08-17T21:45:52Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T15:06:11.896701Z","submitted_at":"2023-03-21T14:41:02Z","title":"TIFA: Accurate and Interpretable Text-to-Image Faithfulness Evaluation with Question Answering"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2303.11897."}