{"as_of":"2026-08-06T08:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7556c967a1fc687047f0486e19329ec3549f24235ff0c18e1a2566766e36b030","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T12:26:21.580418Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:38:14.202168Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T00:38:18.190959Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2603.11698","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.11698","snapshot_observed_at":"2026-08-05T00:38:18.190959Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","venue":"cs.CV","work_id":"0bd94274-de47-433a-b7e1-c22b50aca291","year":2026},"citing_paper":{"arxiv_id":"2608.00617","last_updated":"2026-08-01T12:16:22Z","snapshot_observed_at":"2026-08-06T07:11:16.469435Z","submitted_at":"2026-08-01T12:16:22Z","title":"Diagnosing Under-Development of Irreversible Processes in Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T00:38:14.202168Z"},"links":{"cited_paper":"/paper/2603.11698","citing_paper":"/paper/2608.00617"},"observation_digest":"sha256:66d6e60faad92aa6b94cfb6d5049483ad7ce4b7c4cc29914c95d10c0cabcaea1","observation_id":"b99516b5-90f2-4f9e-a68f-e5b2a9f35b09","resolution":{"observed_at":"2026-08-05T00:38:18.279057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.11698/citation-record","integrity":"/paper/2603.11698/integrity","json":"/paper/2603.11698/citation-record.json","paper":"/paper/2603.11698"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.13428","last_updated":"2026-05-26T08:34:24Z","snapshot_observed_at":"2026-07-06T21:58:56.405149Z","submitted_at":"2025-07-17T17:54:09Z","title":"\"PhyWorldBench\": A Comprehensive Evaluation of Physical Realism in Text-to-Video Models","version":3},"cited_work":{"arxiv_id":"2507.13428","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.13428","snapshot_observed_at":"2026-07-08T07:14:45.185207Z","title":"InThe Thirteenth International Conference on Learning Representations","venue":"cs.CV","work_id":"7c164e09-5340-4f56-b63d-0e810f24f851","year":2025},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"cited_paper":"/paper/2507.13428","citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:3ae9f34de6e0f5ce80ed396f9600fee7c8f6ebaa4b0ebce41b06be1d3f558e27","observation_id":"6027a098-797a-4a30-9c13-b325f427c12c","resolution":{"observed_at":"2026-05-27T02:05:04.304229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09038","last_updated":"2025-02-27T15:10:51Z","snapshot_observed_at":"2026-08-02T17:18:33.867969Z","submitted_at":"2025-01-14T20:59:37Z","title":"Do generative video models understand physical principles?","version":3},"cited_work":{"arxiv_id":"2501.09038","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09038","snapshot_observed_at":"2026-07-07T15:43:53.802817Z","title":"Do generative video models understand physical principles?","venue":"cs.CV","work_id":"d9132ccf-02ed-4700-bf79-4e874794600d","year":2025},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"cited_paper":"/paper/2501.09038","citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:94420e419830f640850f2847421ae2dc20f57fc3f6ccf361aa84d5ee9e1a6a6d","observation_id":"732d2208-55bf-4a36-968e-6c311a204dd8","resolution":{"observed_at":"2026-05-20T12:47:06.031259Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9060.9980","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"the lemon largely remains undeformed","venue":null,"work_id":"4fd7ecc1-47db-4ef8-bc2a-45546ce57d2e","year":2025},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:95b17429bc5b85b2b5648dadb7b2455c8ca54dd062ed60e085f15185105b5a1b","observation_id":"de417312-d423-4740-8153-4a8633386d0f","resolution":{"observed_at":"2026-05-15T12:30:00.385118Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2613d32e-c715-4e06-9f49-5b62ff5be4bc","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:f642e7a34859dc06148001720b2addd8985510ce79abe53212ed893e5eb6cdc5","observation_id":"a5337345-5da1-46b0-879b-044be162c464","resolution":{"observed_at":"2026-05-15T12:30:01.298441Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Example: when scoring Action Alignment, focus only on the correctness of the action, independent of the object and other attr ibutes","venue":null,"work_id":"b4023262-d821-49ab-b03b-6b8c730b453b","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:6424d6df9bb393dbcc9b15a86f55cae9f2d18b91cefdf1310598e267d2316d76","observation_id":"5330a732-ec5b-43cc-91d1-40348e1792be","resolution":{"observed_at":"2026-05-15T12:30:01.304214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluation Criteria","venue":null,"work_id":"b78f11e5-4cb2-4d4f-9f6d-1225048dd3e7","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:afe90b74ee5717f3eb8a7cb4a9e4a0d2c6b14d5f922ba0cc6896cba7addf8eb4","observation_id":"2e2b97b5-20b8-4aa6-8913-e0ee25608e46","resolution":{"observed_at":"2026-05-15T12:30:01.295277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Please select \"NA\" if the prompt does not specify a subject.)","venue":null,"work_id":"e06e35a6-3609-4b0e-8cb3-7c8675ec0d1a","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:56acc1b532a2c6fc429e8a744a35fa645a6231f90110ebc3503f61742ac3f6da","observation_id":"7520434f-4cc4-4ac7-aa41-1645cd6015fa","resolution":{"observed_at":"2026-05-15T12:30:01.301437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d5feefb1-d7af-4023-9763-981463fb92ed","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:59cc23f6d73f07caa51a8a1f7945e16bfcf5154488613c9291c068101ce715be","observation_id":"70db3ec2-43b2-4d53-9488-97cf2ec32645","resolution":{"observed_at":"2026-05-15T12:30:01.283795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a36c3b84-62f7-4099-b4fe-6fe37564b813","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:496a5eb9a3a46e053cce9f38b1e07749568d700ffc218966e66ff29ab73a78a3","observation_id":"fcc2bf99-bcd5-44c9-b492-f09cadb57274","resolution":{"observed_at":"2026-05-15T12:30:01.292416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c79f9d09-8389-40cf-ad1c-ca57acbb513f","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:03b9b728790897c34a45d0ca58541eacb364f249e58bac37b7c2e38e774b0e8e","observation_id":"3f3f4717-a277-462b-a38c-18984e98aa54","resolution":{"observed_at":"2026-05-15T12:30:01.307298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d254fc7f-9cc5-462d-9b87-daa1a1ddad79","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:9e3186c6f8c0c0333aff08974df43ca9e1c3774bfc6067f65cdc90d7b1d8dfe6","observation_id":"cadf9bdf-1795-478e-873e-eb8a82334a84","resolution":{"observed_at":"2026-05-15T12:30:01.278521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1b Manipulated Object Alignment Is the manipulated object present and correct (e.g., carrots or tomatoes)?","venue":null,"work_id":"46248bc6-9e63-4c83-a271-1c70cb43bbf2","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:9e0e5c9d91087c18e0d341f366a8843039bb3357c51948175c546e89554f5c3b","observation_id":"2953029f-c0ac-4a29-bb87-4ae310800694","resolution":{"observed_at":"2026-05-15T12:30:01.286978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"02803430-b599-4800-9cbb-ed42c9e211ef","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:fd6fa72965f2ab6e8b706aacc76fe1dacbbf4215e97eb46233a51b31a606f7c4","observation_id":"f9d760b3-72af-44d5-af16-ce2f8c3baa4b","resolution":{"observed_at":"2026-05-15T12:30:01.289524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"21d979c5-2f47-49e7-a02b-79f04facd5c9","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:0b3265d35d73df919383e51b502aab21afa1f428a061a117ae5a9e30c8d5e0ed","observation_id":"c698a246-0858-4b32-b93f-041307fcd0e4","resolution":{"observed_at":"2026-05-15T12:30:01.281121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e80478b2-806e-4ea6-a403-79a72dc75541","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:48d5a4e847268289b82b9f5c29d0ecfab531a144aebbec886629f55ac79a618d","observation_id":"e7980733-4332-4737-a016-f5d37477841d","resolution":{"observed_at":"2026-05-15T12:30:01.183073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"042632ad-7dc1-4a56-be39-8c5413c89ebc","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:016a48092308efce1d1ff221138ac9d732de1c9d3622d3b08982443e0155ad1a","observation_id":"f7d7f69f-dde1-46a5-8036-0d106c78a986","resolution":{"observed_at":"2026-05-15T12:30:01.232481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1c Action Alignment Does the performed action match the action in the prompt (e.g., slicing or roasting)?","venue":null,"work_id":"55a8b329-60b7-4749-bee6-df08d8896fe3","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:b4b13f340ffbc602756daadf9ccf89884b1ce88b3dba58605756f82ddb2d4e68","observation_id":"4551eb50-6574-4b9a-bb2b-72fdfa383515","resolution":{"observed_at":"2026-05-15T12:30:01.171966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2c28e228-2f95-4073-9bde-710106c6945e","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:8cab42e6aca9643a0b0809305cf045c596e95886ad4fb159067d332d6d06b3e2","observation_id":"f48f9ade-bedf-4117-a6de-0f49a6c92941","resolution":{"observed_at":"2026-05-15T12:30:01.174977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b16a4f6a-fee0-463c-a315-0a4a2aa238d1","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:10b82667f56c16ef3232b954186f4f64fc73855dce99bfe835fd07affd9e5473","observation_id":"fd51a389-92be-400a-a1d4-0a4ed8da19ed","resolution":{"observed_at":"2026-05-15T12:30:01.180396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c93a8cfa-1811-4d6a-9235-76216fefdba0","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:b9fb7e3640f9368a7ee3818e3bae46e97ad47be78f2a630bedfd5815a449e57f","observation_id":"1372da02-582d-44f0-bb00-ff782f59ff41","resolution":{"observed_at":"2026-05-15T12:30:01.168228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"38e9a42a-ee19-4b78-91ec-bb9429d68b5c","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:9c6cacc3097eb4bee5b167818d054f882323acfdc67249d1f586ce529d039fa7","observation_id":"20c80ad3-cd97-4ec8-a92e-2a06904e70ff","resolution":{"observed_at":"2026-05-15T12:30:01.164466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e077433e-b2d9-46c2-b358-ea234372842a","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:16c96fe32308cebd32ee8674d5f447b109ad3c4de0c5a88a3c2a3e02c51fa07d","observation_id":"79cde6e7-4b4b-421b-b63e-0a98643bff9b","resolution":{"observed_at":"2026-05-15T12:30:01.177714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fba26849-9583-447c-ad68-0852086bbd5c","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:21f4ff29dcb64a457b0e124477fb5ab167bfab539db23bf4fdc8c7f340300c5b","observation_id":"c106d10d-6869-450f-9b51-fe9773f855a8","resolution":{"observed_at":"2026-05-15T12:30:01.215815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9419d80b-350d-4587-9a45-64f18ce57210","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:a48941e3bb373d719a0c64b2b87c9a08bceb799996a9fc77fedde9fc6dbbd68a","observation_id":"81fb2fc9-5748-419c-bfb9-133488ae8bf3","resolution":{"observed_at":"2026-05-15T12:30:01.238371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fc4deb69-52c7-4a9a-9e44-bcde91e4e477","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:05940cdbf5fd0b536f9e94590315b5e81201b08685da5a8d2e6a728e94ee059e","observation_id":"eb12bb9b-e0a7-4287-bed9-6ea2fcb3912a","resolution":{"observed_at":"2026-05-15T12:30:01.200387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"17da9941-32b5-4a1a-bfe3-45aa218a98ea","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:bc41f3adc9e0c9e5c8e0452878da12098841de62c59aebc167c3fb434bf78492","observation_id":"850f5dfd-e679-4379-9345-f2ce9ddfa8b1","resolution":{"observed_at":"2026-05-15T12:30:01.260086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7fcad701-ddb1-4761-8f9e-785d513c575a","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:ae915469c4a33ca5bbd635d552af47f31e7f52575a9131db6e74c50851cdd5dc","observation_id":"723ec3c7-e062-4734-910c-dd37d35df61e","resolution":{"observed_at":"2026-05-15T12:30:01.252067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2b Object Change Continuity & Consistency Is the object state change continuous and natural, without any unnatural object appearances or disappearances?","venue":null,"work_id":"6d7a1a9e-64ef-4c41-ae17-38a57e41f440","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:c647be2b2d3edbd397512c3e12d42aa9fb1322a0cd405b0f3acc66ec97ae4685","observation_id":"a8695ff3-1036-4cf9-876c-5a91637ebfee","resolution":{"observed_at":"2026-05-15T12:30:01.256723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a33cbf4-c218-4318-8fb9-fcd7b1f0df01","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:da1a26a4b022f105e71adbbb50390cf9e9273363eb907ffe742ead4e6f12c26e","observation_id":"8643faa8-155e-42e6-a0ed-a4ac504f5c07","resolution":{"observed_at":"2026-05-15T12:30:01.262919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"62ab7ac9-5ab7-4da1-8e68-c06d12241413","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:b5e1dc49d754623fcdbecae34efc336c5981aa263c52aa857ff5b9cc21cf4f7a","observation_id":"0d0f1b8c-57e5-4fd9-a48d-0239a903b29f","resolution":{"observed_at":"2026-05-15T12:30:01.272022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f9170ab-3989-4777-8b4b-a6566798f6eb","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:60f0fec55855006b221093d0e654988bf80159d6290b48501e3feafc7815ecb4","observation_id":"30b41169-e24f-43e1-9222-ef3536dc6a65","resolution":{"observed_at":"2026-05-15T12:30:01.248709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7742ba0f-1a56-4e13-bcd1-163c2f9e841f","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:687673af9032c24fb900734a87b663ed62de677ba637665bead68aa8abe53d47","observation_id":"0e630db7-03dc-4f2a-8ff3-8ad837e4d586","resolution":{"observed_at":"2026-05-15T12:30:01.245185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3.SCENE 3a Scene Alignment Does the background and environment match the prompt (e.g., a kitchen or a market)? (Please focus only on the scene and environment","venue":null,"work_id":"c57a9841-f026-46a8-ad49-c3418917f4f6","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:bb9c678e42743abd901017184487210e21ec75dde17d5636319e2b8d026dd7d6","observation_id":"528092cd-4822-4b4a-9797-3c89a36641d2","resolution":{"observed_at":"2026-05-15T12:30:01.275556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1c428ff8-3cab-4911-9687-facba7cab7fe","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:1921ba4a6db13b91b7148a743702062c6c7d130d8e88dd524fc9a9df680ca65b","observation_id":"37527e4e-0ed5-48d6-8b82-0689a081a449","resolution":{"observed_at":"2026-05-15T12:30:01.238142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8930c68b-4749-4bdc-8603-01ec0892259a","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:2ec957663e1a24ed9248b9c6ca9fc5e3800e858a60de9a00c65e204fcf11d6e1","observation_id":"c03688af-eb86-4178-af7f-d709d135e95e","resolution":{"observed_at":"2026-05-15T12:30:01.225165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6824921d-e17a-4373-ba17-5fdcc71a4010","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:386dce8349076d7a800b4616909f98a74d588ec2fd2025f27c2e07f45b3b4404","observation_id":"3b86778e-a7e1-4298-9222-823d44929ad4","resolution":{"observed_at":"2026-05-15T12:30:01.222328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"451bb348-a9a7-4bb3-aeb8-79e54ef2f8ff","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:0e619d867fb92b58a7d9f6015642c7d45af616f5ca5f925d45ab7eb3468e6129","observation_id":"cf08ba01-9c02-4289-ba75-5fcfbe0f13b2","resolution":{"observed_at":"2026-05-15T12:30:01.241508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a056c940-199e-484f-8272-8d4e84e224e1","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:4abfb53813da550244244dbaea59b3d38efaa9f131210ec7d732b89b62cafadc","observation_id":"fffc1aea-9067-4203-8759-50fd9c84d5f3","resolution":{"observed_at":"2026-05-15T12:30:01.268989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9cc76cd4-e14d-4856-b0b8-39ce86e122cc","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:7feb9d0b852f7e770bfca570a7ba4937c09ce3422f2f4a71f3e144cdbab57368","observation_id":"62981f41-ef3c-472d-8d02-ce28c4a40194","resolution":{"observed_at":"2026-05-15T12:30:01.228397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"12012391-87a0-4d1f-9f5f-f9267c501a0c","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:d3443f5132e282ddc7d641e183da2ee2873d6729e1739e7f1d6ca5a700b4a2db","observation_id":"13aafbcc-cf25-4577-b495-10e356e1b4a1","resolution":{"observed_at":"2026-05-15T12:30:01.205075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ceee1c0-91b2-4cf2-a509-1b26df45c5a3","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:a5c220f181078b81c977c16f1d7794d5dc4b4a09bc3da2077c643abc02a18f9c","observation_id":"3080e791-799f-4a51-a5cf-893a00ff33f6","resolution":{"observed_at":"2026-05-15T12:30:01.193616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"162ac1e2-e82f-44b4-94f6-b7fc370b406f","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:39dfeb305c6fb97d9c48e295064baaf11a0684d2d6f13a6ed6bc6d8dbb820ed9","observation_id":"a41c6363-7990-494f-bd5f-685d5f835d37","resolution":{"observed_at":"2026-05-15T12:30:01.221092Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2bfdd8f2-0a5b-4520-8a8d-cade23e34035","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:bf0d0c4f1aceab227a2f48cef324eadc0be0cebc8b4fcacb85091c81ab79e8b1","observation_id":"cbc0e15e-ed3e-4e90-9c09-65c2828c40ac","resolution":{"observed_at":"2026-05-15T12:30:01.265709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4b Aesthetic Is the video visually appealing? Are the colors harmonious and is the content rich?","venue":null,"work_id":"f9369013-9d31-49d0-ba0f-d2c3d420c0a4","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:4f1a3bb467b305fba9245f3302471dec8f472188ef83c55817747f973a2caa16","observation_id":"02c4404b-844b-4291-b680-269016a9126f","resolution":{"observed_at":"2026-05-15T12:30:01.208377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c4c7e967-0441-4465-85da-84a63cd9b045","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:d10c81089a802eedfd46b1624f2701b617d6388bd3351e6ecb904c7a4c982291","observation_id":"1f59d184-b356-403a-9b96-d95519fe5d47","resolution":{"observed_at":"2026-05-15T12:30:01.202615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"138c3212-e2c0-45e2-b3d6-6ef444263fb7","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:05a32e6047c454d8fd4371c7a269cc7be9cf5eb6d1d4e2f7da3348a660e79e9f","observation_id":"5f5c2569-eed1-4683-a78e-0f1ffd496e07","resolution":{"observed_at":"2026-05-15T12:30:01.219591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"44f686c7-9c35-4d59-9139-c081b3788944","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:1eacc6dcefe92902765cd406ed4fd189138f75291e5c8edd49b4bbfb1a295a0a","observation_id":"059dc08e-7698-4a42-92e6-032cd5188768","resolution":{"observed_at":"2026-05-15T12:30:01.234484Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eda71c7b-62b4-4c82-acc1-cf22d70ab41d","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:8baa1a86e3e65ffd761e7575c97b29786bb8519ee7bf52b102a145977a67b41c","observation_id":"24c9338e-a241-4673-988c-1f52c191b863","resolution":{"observed_at":"2026-05-15T12:30:01.232044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Figure 8: Task instructions and evaluation criteria in the human evaluation interface","venue":null,"work_id":"fb61d1c8-8f43-4905-83f3-3db9f6badcdf","year":null},"citing_paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:21.580418Z"},"links":{"citing_paper":"/paper/2603.11698"},"observation_digest":"sha256:c6bef0431460a9375ecabaf38a6ab5d974c90c1cf69aba37f031959ac590d4eb","observation_id":"352512ab-9d33-4604-91cb-18ca62fc90a6","resolution":{"observed_at":"2026-05-15T12:30:01.244607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.11698","last_updated":"2026-04-17T09:18:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:48:48.873215Z","submitted_at":"2026-03-12T09:08:01Z","title":"OSCBench: Benchmarking Object State Change in Text-to-Video Generation"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":37,"verified_exact":2,"verified_fuzzy":9},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2603.11698."}