{"as_of":"2026-08-20T18:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f52a5398be4b825ebf7dfd8dafd8a4492ec81efe35d87408f3c8c67545c2905d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":31,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:46:46.835013Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:49:58.344114Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":"2407.08683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-07-04T16:49:58.344114Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":"40f90931-94b7-494c-947d-938994dd303b","year":2024},"citing_paper":{"arxiv_id":"2410.10781","last_updated":"2025-03-02T14:37:53Z","snapshot_observed_at":"2026-08-17T16:25:55.906179Z","submitted_at":"2024-10-14T17:50:28Z","title":"When Attention Sink Emerges in Language Models: An Empirical View","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-16T17:41:03.674759Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2410.10781"},"observation_digest":"sha256:bca8c504c5a88ea69ca527ce8cac32096c5cbd2058f8150ed6813ba60ed7b60b","observation_id":"a1f203de-ad29-49b0-afba-206648d31de8","resolution":{"observed_at":"2026-05-16T17:41:03.772015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-12T18:32:12.134723Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11496","last_updated":"2024-11-28T02:07:46Z","snapshot_observed_at":"2026-08-14T06:21:41.085599Z","submitted_at":"2024-11-18T11:58:07Z","title":"Safe + Safe = Unsafe? Exploring How Safe Images Can Be Exploited to Jailbreak Large Vision-Language Models","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T18:32:12.134723Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2411.11496"},"observation_digest":"sha256:9b155fca62df889b06b740c547899883a294877197dbb43657f11c0e9dc00784","observation_id":"e1af66a8-8689-4657-acb1-efc641385222","resolution":{"observed_at":"2026-08-12T18:32:12.134723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-12T14:56:52.702184Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14794","last_updated":"2024-11-22T08:33:36Z","snapshot_observed_at":"2026-08-14T11:20:48.477344Z","submitted_at":"2024-11-22T08:33:36Z","title":"VideoEspresso: A Large-Scale Chain-of-Thought Dataset for Fine-Grained Video Reasoning via Core Frame Selection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:56:52.702184Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2411.14794"},"observation_digest":"sha256:d8cf280bd04f73a30a7311b44f8e738d763c4b4ed337a08eae8020b2e6cfe9ac","observation_id":"b20491cf-043c-4fd9-8ce2-7f055c0f8b0a","resolution":{"observed_at":"2026-08-12T14:56:52.702184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-12T11:10:54.868302Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18499","last_updated":"2025-03-30T07:22:46Z","snapshot_observed_at":"2026-08-17T14:00:00.020812Z","submitted_at":"2024-11-27T16:39:04Z","title":"OpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T11:10:54.868302Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2411.18499"},"observation_digest":"sha256:be0d6a8ce5ed24ea48ff447c9c42f61b16ed34ccb0c6a343bca75ec82b888615","observation_id":"aee6e05b-faa5-45b5-b5ff-64917286e43d","resolution":{"observed_at":"2026-08-12T11:10:54.868302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-11T21:30:08.593471Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04432","last_updated":"2024-12-05T18:53:04Z","snapshot_observed_at":"2026-08-14T13:59:34.648701Z","submitted_at":"2024-12-05T18:53:04Z","title":"Divot: Diffusion Powers Video Tokenizer for Comprehension and Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T21:30:08.593471Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2412.04432"},"observation_digest":"sha256:ef1d0118b1e762656446cf18485b71e67c6633317833a03927ddf66e6d0a30ed","observation_id":"d6d15063-c71c-42ca-afbd-4471e4f63b73","resolution":{"observed_at":"2026-08-11T21:30:08.593471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-11T18:45:41.323022Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07589","last_updated":"2025-03-13T06:23:03Z","snapshot_observed_at":"2026-08-19T15:29:24.610685Z","submitted_at":"2024-12-10T15:24:12Z","title":"DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T18:45:41.323022Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2412.07589"},"observation_digest":"sha256:0f6d0b2da82964b80900a6095a934cba58ceb53fec89e550412dc29f05594630","observation_id":"5c8e3fd8-4ab9-4867-a02e-6da472943178","resolution":{"observed_at":"2026-08-11T18:45:41.323022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-11T16:57:06.647447Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09612","last_updated":"2025-04-01T21:08:07Z","snapshot_observed_at":"2026-08-18T01:48:53.175172Z","submitted_at":"2024-12-12T18:59:40Z","title":"Olympus: A Universal Task Router for Computer Vision Tasks","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T16:57:06.647447Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2412.09612"},"observation_digest":"sha256:a832ee26a062a4eaed5047f5737c49ad16000d2792d2cd8b9821d4e30163b28b","observation_id":"1c9b2f8d-ec45-4230-8951-73f294e3a390","resolution":{"observed_at":"2026-08-11T16:57:06.647447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-11T15:21:48.443272Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11109","last_updated":"2024-12-15T08:13:12Z","snapshot_observed_at":"2026-08-16T17:14:19.885187Z","submitted_at":"2024-12-15T08:13:12Z","title":"SpearBot: Leveraging Large Language Models in a Generative-Critique Framework for Spear-Phishing Email Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T15:21:48.443272Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2412.11109"},"observation_digest":"sha256:cb75eceaa9622f1d38c21e0cce5e8aafa9b0b7293572cf9899291fcc18c468ab","observation_id":"894f27ee-f34b-4f90-a4cb-36c856540de2","resolution":{"observed_at":"2026-08-11T15:21:48.443272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-11T14:39:28.407921Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11767","last_updated":"2024-12-16T13:39:32Z","snapshot_observed_at":"2026-08-18T22:47:43.208620Z","submitted_at":"2024-12-16T13:39:32Z","title":"IDEA-Bench: How Far are Generative Models from Professional Designing?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:39:28.407921Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2412.11767"},"observation_digest":"sha256:ad7c5ae30585cb051c66ce5390cdb53c01e4d4e5e0ea162706a9dcd1d9b45e2e","observation_id":"8a22b6f7-d150-430c-a479-7813c71dccbe","resolution":{"observed_at":"2026-08-11T14:39:28.407921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":"2407.08683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-07-04T16:49:58.344114Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":"40f90931-94b7-494c-947d-938994dd303b","year":2024},"citing_paper":{"arxiv_id":"2501.04001","last_updated":"2025-11-03T17:35:29Z","snapshot_observed_at":"2026-08-16T10:23:40.545862Z","submitted_at":"2025-01-07T18:58:54Z","title":"Sa2VA: Marrying SAM2 with LLaVA for Dense Grounded Understanding of Images and Videos","version":3},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-05-16T11:39:22.340737Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2501.04001"},"observation_digest":"sha256:a3c8ec6b54c76bd7a151db81e34e73d4313e99abc1772f55c61cde97f0f90273","observation_id":"18d34d83-48a0-498f-a4b9-08d055b977c7","resolution":{"observed_at":"2026-05-16T11:39:22.485683Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-10T21:08:51.263917Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.06173","last_updated":"2025-06-07T09:44:59Z","snapshot_observed_at":"2026-08-20T04:50:42.641013Z","submitted_at":"2025-01-10T18:52:11Z","title":"VideoAuteur: Towards Long Narrative Video Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T21:08:51.263917Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2501.06173"},"observation_digest":"sha256:15c0bf4456f1fc71d0b9664458095c4264390e5d680dc3e0793929853e0270e7","observation_id":"14abd264-1d5d-4849-bf56-5785657f131a","resolution":{"observed_at":"2026-08-10T21:08:51.263917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-10T18:21:37.455009Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11463","last_updated":"2025-05-31T16:08:55Z","snapshot_observed_at":"2026-08-11T00:07:17.195166Z","submitted_at":"2025-01-20T12:51:40Z","title":"Curiosity-Driven Reinforcement Learning from Human Feedback","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T18:21:37.455009Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2501.11463"},"observation_digest":"sha256:b87e45e07ace139e97ebbe38043de93200d4eccc39584b4686c0a635ae74fe6d","observation_id":"2f8f7139-3aad-4d1e-916c-170fa4030d46","resolution":{"observed_at":"2026-08-10T18:21:37.455009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-10T15:53:51.274934Z","title":"Hu Ye, Jun Zhang, Sibo Liu, Xiao Han, and Wei Yang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.13554","last_updated":"2025-02-05T10:32:22Z","snapshot_observed_at":"2026-08-17T17:58:35.312920Z","submitted_at":"2025-01-23T10:57:22Z","title":"One-Prompt-One-Story: Free-Lunch Consistent Text-to-Image Generation Using a Single Prompt","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T15:53:51.274934Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2501.13554"},"observation_digest":"sha256:2ef8f1eb6e242593fcb1bba78dc44c7fa9905607b863feac6c27c2cee981048f","observation_id":"a0e16d60-5f0d-4563-b1fa-a0d19c91b1f6","resolution":{"observed_at":"2026-08-10T15:53:51.274934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-08T15:24:46.456245Z","title":"Openmoe: An early effort on open mixture- of-experts language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06474","last_updated":"2025-02-10T13:52:52Z","snapshot_observed_at":"2026-08-17T23:54:49.013871Z","submitted_at":"2025-02-10T13:52:52Z","title":"UniMoD: Efficient Unified Multimodal Transformers with Mixture-of-Depths","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T15:24:46.456245Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2502.06474"},"observation_digest":"sha256:9e297c35f6c69ca62261d06c95735634299b53a3175593c7b7f2dc5acecbc6ba","observation_id":"b003c0d9-950a-40cd-b724-cc0b7cff4dba","resolution":{"observed_at":"2026-08-08T15:24:46.456245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-16T05:46:46.835013Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19894","last_updated":"2025-04-28T15:28:14Z","snapshot_observed_at":"2026-08-18T01:50:51.373925Z","submitted_at":"2025-04-28T15:28:14Z","title":"CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:46:46.835013Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2504.19894"},"observation_digest":"sha256:dc80fd2fa0145a54d569075fbb003f64b83712eb98f3ea3f954dcc17be8e46c0","observation_id":"1b6bf300-0782-4bd2-a95d-d118452250fe","resolution":{"observed_at":"2026-08-16T05:46:46.835013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":"2407.08683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-07-04T16:49:58.344114Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":"40f90931-94b7-494c-947d-938994dd303b","year":2024},"citing_paper":{"arxiv_id":"2505.16819","last_updated":"2026-05-19T15:22:52Z","snapshot_observed_at":"2026-08-01T07:12:14.758494Z","submitted_at":"2025-05-22T15:54:42Z","title":"Character-Centered Dialogue Generation from Scene-Level Prompts","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T13:31:43.083678Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2505.16819"},"observation_digest":"sha256:aa26280eaf1735610155ef4cd287d29457e601ac6ffd3aef58c66868d2982743","observation_id":"0a291368-bccf-4c33-95d8-25e55937bc4e","resolution":{"observed_at":"2026-05-22T13:34:53.671351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-07T14:33:32.799948Z","title":"Seed-story: Multimodal long story generation with large language model.arXiv preprint arXiv:2407.08683, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18605","last_updated":"2025-05-24T08:59:28Z","snapshot_observed_at":"2026-08-19T03:00:05.603591Z","submitted_at":"2025-05-24T08:59:28Z","title":"Rethinking Causal Mask Attention for Vision-Language Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:32.799948Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2505.18605"},"observation_digest":"sha256:53bdf64980289f28b7d30a981e72f49da91b38349ce9986e8f6ef7692bd00074","observation_id":"70b007af-864d-4a5a-9857-76c8a9245cb5","resolution":{"observed_at":"2026-08-07T14:33:32.799948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-07T11:12:11.474850Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03126","last_updated":"2025-06-03T17:55:18Z","snapshot_observed_at":"2026-08-17T18:41:17.729750Z","submitted_at":"2025-06-03T17:55:18Z","title":"AnimeShooter: A Multi-Shot Animation Dataset for Reference-Guided Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:12:11.474850Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2506.03126"},"observation_digest":"sha256:0a98736fd141b561f72382986b49dc2e3d7206022c5f27d5930bf1e8e48a39f0","observation_id":"bc59aa92-dab7-4113-ae87-2e9112b87892","resolution":{"observed_at":"2026-08-07T11:12:11.474850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-15T18:47:33.059856Z","title":"arXiv preprint arXiv:2407.08683 (2024), https://arxiv.org/ abs/2407.086832","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18900","last_updated":"2025-06-23T17:59:29Z","snapshot_observed_at":"2026-08-17T15:19:00.413169Z","submitted_at":"2025-06-23T17:59:29Z","title":"Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:33.059856Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2506.18900"},"observation_digest":"sha256:85f849166eeed9d3e60a88a2774544f01f57c1244806fc5975c5e5ef5c63205c","observation_id":"32a27c34-22c9-4719-b64f-79592ae3d8ca","resolution":{"observed_at":"2026-08-15T18:47:33.059856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-06T22:35:00.968329Z","title":"International Journal of Computer Vision (2024), 1–22","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21272","last_updated":"2025-06-27T01:04:39Z","snapshot_observed_at":"2026-08-18T14:05:15.357033Z","submitted_at":"2025-06-26T13:58:16Z","title":"FairyGen: Storied Cartoon Video from a Single Child-Drawn Character","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:35:00.968329Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2506.21272"},"observation_digest":"sha256:bfe0df889ce7b01c3b149b6e25457f16d038f9613fddcb7ba87dbbbc6f8e1a56","observation_id":"cc1ed02f-1786-4f0c-b0e8-d83496e3c337","resolution":{"observed_at":"2026-08-06T22:35:00.968329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-06T14:37:19.553823Z","title":"Seed-story: Multimodal long story generation with large language model.arXiv preprint arXiv:2407.08683, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18634","last_updated":"2025-07-24T17:59:56Z","snapshot_observed_at":"2026-08-20T04:50:48.955008Z","submitted_at":"2025-07-24T17:59:56Z","title":"Captain Cinema: Towards Short Movie Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:37:19.553823Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2507.18634"},"observation_digest":"sha256:f2bb3156933e47c4cd95ea4d7aaf4fb683cd14357280f78f68212441b2aa2dc1","observation_id":"e0ff973f-9df2-4bfb-b8b7-588ae49f19f2","resolution":{"observed_at":"2026-08-06T14:37:19.553823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-06T12:19:01.972919Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21893","last_updated":"2025-08-05T14:01:48Z","snapshot_observed_at":"2026-08-14T06:04:51.975013Z","submitted_at":"2025-07-29T15:01:31Z","title":"Aether Weaver: Multimodal Affective Narrative Co-Generation with Dynamic Scene Graphs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:19:01.972919Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2507.21893"},"observation_digest":"sha256:bd9918dccef8c53c9ccc14cbff7374295f032aaf84506ec6e8a737c9489e7f0c","observation_id":"7c844ef5-0779-4b9f-8dfc-83be9bb08477","resolution":{"observed_at":"2026-08-06T12:19:01.972919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-06T10:47:00.754074Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03735","last_updated":"2025-07-31T11:24:40Z","snapshot_observed_at":"2026-08-16T08:34:30.237318Z","submitted_at":"2025-07-31T11:24:40Z","title":"StorySync: Training-Free Subject Consistency in Text-to-Image Generation via Region Harmonization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T10:47:00.754074Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2508.03735"},"observation_digest":"sha256:b0a2b0883d49834d5453ca7a3d26f8416b961148463619cae1e9152a499ad3f2","observation_id":"f698b1de-2d72-4ff7-af37-a1589c6f4d32","resolution":{"observed_at":"2026-08-06T10:47:00.754074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-15T17:32:40.194630Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08943","last_updated":"2025-08-12T13:55:17Z","snapshot_observed_at":"2026-08-18T20:09:00.694277Z","submitted_at":"2025-08-12T13:55:17Z","title":"Numerical Study of Oblique Detonation Initiation Assisted by Local Energy Deposition","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T17:32:40.194630Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2508.08943"},"observation_digest":"sha256:25a5f9366c7c63b847f9baa1e3717662cc755b62b86f1f0081920e5c6cf6e343","observation_id":"3a6adcfe-357c-4ea9-b545-c1d4cb8846ca","resolution":{"observed_at":"2026-08-15T17:32:40.194630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-15T17:33:24.931590Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08949","last_updated":"2025-08-12T14:04:56Z","snapshot_observed_at":"2026-08-18T20:09:02.459583Z","submitted_at":"2025-08-12T14:04:56Z","title":"Lay2Story: Extending Diffusion Transformers for Layout-Togglable Story Generation","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-15T17:33:24.931590Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2508.08949"},"observation_digest":"sha256:3f08fdfccee7493dc39f18641d69de16703d362718c86095acd8592a079e5901","observation_id":"026d94fe-7633-4f3e-b69e-6c4944e7ad2c","resolution":{"observed_at":"2026-08-15T17:33:24.931590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-05T20:44:09.401643Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09983","last_updated":"2025-08-13T17:56:26Z","snapshot_observed_at":"2026-08-18T12:16:51.328318Z","submitted_at":"2025-08-13T17:56:26Z","title":"Story2Board: A Training-Free Approach for Expressive Storyboard Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T20:44:09.401643Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2508.09983"},"observation_digest":"sha256:e1a36a640de5cbf9e0a409f87132ca29d649fd37935c1e6e2df4c1e59a4a494b","observation_id":"385f0895-f073-4f56-95f5-e73eaf925da7","resolution":{"observed_at":"2026-08-05T20:44:09.401643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-08-15T16:32:15.429255Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04446","last_updated":"2025-09-04T17:59:34Z","snapshot_observed_at":"2026-08-18T20:52:51.140144Z","submitted_at":"2025-09-04T17:59:34Z","title":"Plot'n Polish: Zero-shot Story Visualization and Disentangled Editing with Text-to-Image Diffusion Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T16:32:15.429255Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2509.04446"},"observation_digest":"sha256:c858df27601bc88783ca20a45461cd5de874477f9903f08326329774f181c675","observation_id":"d6ca206d-e27c-4a3d-9ecc-e3e62a9f4729","resolution":{"observed_at":"2026-08-15T16:32:15.429255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":"2407.08683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-07-04T16:49:58.344114Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":"40f90931-94b7-494c-947d-938994dd303b","year":2024},"citing_paper":{"arxiv_id":"2509.22622","last_updated":"2025-10-13T22:41:26Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-26T17:48:24Z","title":"LongLive: Real-time Interactive Long Video Generation","version":2},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-05-15T03:52:59.287555Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2509.22622"},"observation_digest":"sha256:8b9387491982fc8377700741946342717e24cf2c9ede3ee3e962fbb09f2d4aac","observation_id":"f37382bd-6040-4149-a3d0-81b46c1fd6be","resolution":{"observed_at":"2026-05-15T03:52:59.507936Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":"2407.08683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-07-04T16:49:58.344114Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":"40f90931-94b7-494c-947d-938994dd303b","year":2024},"citing_paper":{"arxiv_id":"2511.15408","last_updated":"2026-05-14T06:10:01Z","snapshot_observed_at":"2026-08-15T18:11:39.612145Z","submitted_at":"2025-11-19T13:05:25Z","title":"Chinese Short-Form Creative Content Generation via Explanation-Oriented Multi-Objective Optimization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-17T20:50:53.673037Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2511.15408"},"observation_digest":"sha256:9de2109e9f3e6ad1d39b7474ab4a534a74c0f95610ceb8ff6659c62864be3ace","observation_id":"d7fca0e8-a08a-4c49-b5a8-96b303c0cdd7","resolution":{"observed_at":"2026-05-17T20:52:06.073559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":"2407.08683","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-07-04T16:49:58.344114Z","title":"Seed-story: Multimodal long story generation with large language model","venue":null,"work_id":"40f90931-94b7-494c-947d-938994dd303b","year":2024},"citing_paper":{"arxiv_id":"2606.25079","last_updated":"2026-07-02T23:24:53Z","snapshot_observed_at":"2026-08-04T14:11:01.444742Z","submitted_at":"2026-06-23T18:37:31Z","title":"FreeStory: Training-Free Character Consistency for Free-Form Visual Storytelling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T00:10:35.009818Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2606.25079"},"observation_digest":"sha256:532384796543a531d0cb2dade71cb7a58af61f692289e21263cd912216b9986a","observation_id":"0ba59551-5d98-4bd8-84b4-a83972c1a104","resolution":{"observed_at":"2026-07-04T16:49:58.345540Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08683","snapshot_observed_at":"2026-07-12T12:23:07.999687Z","title":"Seed-story: Multimodal long story generation with large language model.arXiv preprint arXiv:2407.08683, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25079","last_updated":"2026-07-02T23:24:53Z","snapshot_observed_at":"2026-08-04T14:11:01.444742Z","submitted_at":"2026-06-23T18:37:31Z","title":"FreeStory: Training-Free Character Consistency for Free-Form Visual Storytelling","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-12T12:23:07.999687Z"},"links":{"cited_paper":"/paper/2407.08683","citing_paper":"/paper/2606.25079"},"observation_digest":"sha256:4aaed14192039b419ff7d8b8c5275f424fd2ea29c9a8ac5f76709e0e34c360b4","observation_id":"540310c3-fd74-4837-aed5-84e2f6369bff","resolution":{"observed_at":"2026-07-12T12:23:07.999687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.08683/citation-record","integrity":"/paper/2407.08683/integrity","json":"/paper/2407.08683/citation-record.json","paper":"/paper/2407.08683"},"outbound":[],"paper":{"arxiv_id":"2407.08683","last_updated":"2024-10-11T08:39:28Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T13:35:00.531280Z","submitted_at":"2024-07-11T17:21:03Z","title":"SEED-Story: Multimodal Long Story Generation with Large Language Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 31 inbound Pith citation observations for arXiv:2407.08683."}