{"as_of":"2026-08-13T07:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:357357af8669edb727005813d17967e35454498b3189bf6fa072a80116554239","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:29:39.770200Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10639/citation-record","integrity":"/paper/2506.10639/integrity","json":"/paper/2506.10639/citation-record.json","paper":"/paper/2506.10639"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:34.683768Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:34.683768Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:2d624675bf732401dee6b0ba4c2b2ae37c610efe22b220cdf98000758d3f7dcd","observation_id":"b84bcf57-58d0-462d-952d-866492ac9364","resolution":{"observed_at":"2026-08-07T04:29:34.683768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07667","last_updated":"2024-07-10T13:46:08Z","snapshot_observed_at":"2026-08-12T23:25:00.691492Z","submitted_at":"2024-07-10T13:46:08Z","title":"VEnhancer: Generative Space-Time Enhancement for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07667","snapshot_observed_at":"2026-08-07T04:29:34.726688Z","title":"Venhancer: Generative space-time enhancement for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:34.726688Z"},"links":{"cited_paper":"/paper/2407.07667","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:d263025974586376a8f1a23fde7e494835dac9eff2ec8842ab679274d4220db5","observation_id":"54a87cbf-5f78-4e5b-ac5a-2c797a55eedc","resolution":{"observed_at":"2026-08-07T04:29:34.726688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-10T01:52:30.999213Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-07T04:29:34.788118Z","title":"Modelscope text-to-video technical report.arXiv preprint arXiv:2308.06571, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:34.788118Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:2352513f8fa4a71df70bcaa641f28a6f67137ebc5b0c7678fd9e4417d160d1aa","observation_id":"61837416-4c48-4d40-a1ea-744561dedfb4","resolution":{"observed_at":"2026-08-07T04:29:34.788118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:34.871711Z","title":"Videocomposer: Compositional video synthesis with motion controllability.Advances in Neural Information Processing Systems, 36:7594–7611, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:34.871711Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:99102889637f3928854e58c14ddba70cc8c8ce62be593c2c33cac35097c3544b","observation_id":"030c8769-eb0a-4444-a42b-0c9c94934cf0","resolution":{"observed_at":"2026-08-07T04:29:34.871711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T04:29:34.950538Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:34.950538Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:a5eda2a5bc8fbb004e7a6b4ddb6066d5febd8826bc7cccec6f1a80c6f644c201","observation_id":"cea318d0-78ef-4cac-b84e-9d63aeffe3ff","resolution":{"observed_at":"2026-08-07T04:29:34.950538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T04:29:35.068376Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:35.068376Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:7f877286d2f2d0461b90687c41604fbf76595ad7965c160e9a3f7d18255b55b9","observation_id":"df4c2c65-6821-48b3-baf5-bbc242c71f17","resolution":{"observed_at":"2026-08-07T04:29:35.068376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T04:29:35.164284Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:35.164284Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:3ab369de316ebd812a557a7b72369f55f02db4641b8e09f21aaa3189c0c8298b","observation_id":"45c4edba-a8a0-4f6d-b90f-8d2bd5484fdc","resolution":{"observed_at":"2026-08-07T04:29:35.164284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13918","last_updated":"2025-10-27T08:22:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-23T18:55:41Z","title":"Improving Video Generation with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13918","snapshot_observed_at":"2026-08-07T04:29:35.300572Z","title":"Improving video generation with human feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:35.300572Z"},"links":{"cited_paper":"/paper/2501.13918","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:f246eeb7bb0adef9136e6948f301add554c854ac079116c489b555693151100b","observation_id":"0e670b5d-ee0f-4db5-8991-267f4fa16c44","resolution":{"observed_at":"2026-08-07T04:29:35.300572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04814","last_updated":"2025-03-05T02:43:42Z","snapshot_observed_at":"2026-08-11T21:12:44.768205Z","submitted_at":"2024-12-06T07:16:14Z","title":"LiFT: Leveraging Human Feedback for Text-to-Video Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04814","snapshot_observed_at":"2026-08-07T04:29:35.464597Z","title":"Lift: Leveraging human feedback for text-to-video model alignment.arXiv preprint arXiv:2412.04814, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:35.464597Z"},"links":{"cited_paper":"/paper/2412.04814","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:0df3db5e231da6e9fec8e0b6e02d061f64188812c50e0398b066709772498c85","observation_id":"3a0ac913-9b07-423f-aaf0-9bc2807e32a9","resolution":{"observed_at":"2026-08-07T04:29:35.464597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14167","last_updated":"2024-12-18T18:59:49Z","snapshot_observed_at":"2026-08-11T12:22:39.635800Z","submitted_at":"2024-12-18T18:59:49Z","title":"VideoDPO: Omni-Preference Alignment for Video Diffusion Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14167","snapshot_observed_at":"2026-08-07T04:29:35.557881Z","title":"Videodpo: Omni-preference alignment for video diffusion generation.arXiv preprint arXiv:2412.14167, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:35.557881Z"},"links":{"cited_paper":"/paper/2412.14167","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:d2d56973024fe0698ff8b82845c802a1900c5e6cc2baca710f1dce41fdad645a","observation_id":"16fa84b6-39c8-44b6-8b70-bf336ecbad5c","resolution":{"observed_at":"2026-08-07T04:29:35.557881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21059","last_updated":"2026-01-05T02:39:01Z","snapshot_observed_at":"2026-08-12T07:31:23.124121Z","submitted_at":"2024-12-30T16:24:09Z","title":"VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21059","snapshot_observed_at":"2026-08-07T04:29:35.673428Z","title":"Visionreward: Fine-grained multi-dimensional human preference learning for image and video generation.arXiv preprint arXiv:2412.21059, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:35.673428Z"},"links":{"cited_paper":"/paper/2412.21059","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:d513e4094c62b952cbf372bc2f07c09784c3bdc88d318fa1c32109a52f1cf768","observation_id":"01fcccbf-f24b-4a32-81c2-f44da00ed37e","resolution":{"observed_at":"2026-08-07T04:29:35.673428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T04:29:35.783078Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:35.783078Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:f822e1513637cfaca4d5898149294a65bf193589e9570597518a54cd64318f06","observation_id":"2f457a2f-0147-49f8-9192-12bba4d1b7f8","resolution":{"observed_at":"2026-08-07T04:29:35.783078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-13T01:39:12.659510Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-07T04:29:35.918527Z","title":"Videocrafter1: Open diffusion models for high-quality video generation.arXiv preprint arXiv:2310.19512, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:35.918527Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:fb70c468ba6411eebfd45f94cef0efc440a655626e12acd9fa0ad070a2d76a1a","observation_id":"c82352ea-09b6-430a-810b-e87296faf42d","resolution":{"observed_at":"2026-08-07T04:29:35.918527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:41.292504Z","title":"Flexible diffusion modeling of long videos.Advances in Neural Information Processing Systems, 35:27953–27965, 2022","venue":null,"work_id":"042fee3c-f4a0-42fa-99e7-9fde5c403259","year":2022},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.012341Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:cfe6120bc7aa17f937187808a48294a291f163e5cbc7ca7573891f4917caa58a","observation_id":"8f7beaeb-07e6-409a-b314-67ff6692abd5","resolution":{"observed_at":"2026-08-07T04:29:41.422461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-07T04:29:36.113916Z","title":"Latte: Latent diffusion transformer for video generation.arXiv preprint arXiv:2401.03048, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.113916Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:43e3d4163e26a96f900f082e3af778ae3260d96628aedccf75bdeba63bdd1bd4","observation_id":"02ec4496-333c-4358-8659-b1e21813a7f7","resolution":{"observed_at":"2026-08-07T04:29:36.113916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-07T04:29:36.205019Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.205019Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:460fadb32738031c27aa4cf9af4fc3082760996540b9754812f5514f270e5afa","observation_id":"646db30b-0295-441b-bbe5-cc9f92d1ea79","resolution":{"observed_at":"2026-08-07T04:29:36.205019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:41.073437Z","title":"Vidm: Video implicit diffusion models","venue":null,"work_id":"1775c19b-9143-4707-bff7-b6f93d12589f","year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.363308Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:7e797eaa105a865448b1b2c171955b92d54a4679621aae8d640931cf6e2d2d7d","observation_id":"d6d7c495-716f-4ad0-a45e-60a43486762a","resolution":{"observed_at":"2026-08-07T04:29:41.191534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-07T04:29:36.463830Z","title":"Make-a-video: Text-to-video generation without text-video data.arXiv preprint arXiv:2209.14792, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.463830Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:eaff935351eb4c7af675fd0571b0bd8e8135abeb617e953d98b0d0d74c5f8b9c","observation_id":"15ee06df-264b-4605-9721-94e82cb64c0e","resolution":{"observed_at":"2026-08-07T04:29:36.463830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:40.877271Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation.International Journal of Computer Vision, pages 1–15, 2024","venue":null,"work_id":"dc05425a-1ba3-4757-b16d-532600cc216b","year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.611929Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:1aae1be9a6446e6d488db12416585f4f1ca30a933bb8fe67904eac48d5d2376e","observation_id":"42f65169-a2fb-4f95-8349-ff02e0bbf80b","resolution":{"observed_at":"2026-08-07T04:29:40.957619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15458","last_updated":"2024-10-20T17:51:35Z","snapshot_observed_at":"2026-08-12T22:19:09.109938Z","submitted_at":"2024-10-20T17:51:35Z","title":"Allegro: Open the Black Box of Commercial-Level Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15458","snapshot_observed_at":"2026-08-07T04:29:36.769463Z","title":"Allegro: Open the black box of commercial-level video generation model.arXiv preprint arXiv:2410.15458, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.769463Z"},"links":{"cited_paper":"/paper/2410.15458","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:c5dce7f5e0b66ae58ee51e2da5ec35c864f712808aeab0f9bbfe53d841e867eb","observation_id":"3b9c747b-fcd6-4b46-99e3-3dd3ab03be97","resolution":{"observed_at":"2026-08-07T04:29:36.769463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:36.858137Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.858137Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:246c18e7c1a1425f7d11130ebeafa9e76c5ce25694122dee21c086e08ebe7851","observation_id":"5f4ac0bd-6c98-4bf0-81ba-564eb4ca4945","resolution":{"observed_at":"2026-08-07T04:29:36.858137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:36.936888Z","title":"Elucidating the design space of diffusion-based generative models.Advances in neural information processing systems, 35:26565–26577, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:36.936888Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:9c7376392d4eeaf208ad256c01c88da35cc8b4cf54e4ef4de99d7a8774940a31","observation_id":"b354a7ef-9b20-40eb-917b-c3b8cc792555","resolution":{"observed_at":"2026-08-07T04:29:36.936888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:37.047405Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.047405Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:fed9f58c78de43f266443f01d90a9230ec6e37a6c317ae4a8d8e202fd9a94819","observation_id":"ca030abf-da3c-4abc-b9c7-c5165272cde5","resolution":{"observed_at":"2026-08-07T04:29:37.047405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-08-12T17:56:21.544451Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21755","snapshot_observed_at":"2026-08-07T04:29:37.188560Z","title":"Vbench-2.0: Advancing video generation benchmark suite for intrinsic faithfulness.arXiv preprint arXiv:2503.21755, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.188560Z"},"links":{"cited_paper":"/paper/2503.21755","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:b5e2ca03f582bdd39489ca13ee39c519e014d08951297e2263f46812bc0bbff1","observation_id":"25f6955b-fcf0-426c-976e-59c15c8e099f","resolution":{"observed_at":"2026-08-07T04:29:37.188560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20694","last_updated":"2025-02-28T03:58:23Z","snapshot_observed_at":"2026-08-07T17:41:02.221324Z","submitted_at":"2025-02-28T03:58:23Z","title":"WorldModelBench: Judging Video Generation Models As World Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20694","snapshot_observed_at":"2026-08-07T04:29:37.277478Z","title":"Worldmodelbench: Judging video generation models as world models.arXiv preprint arXiv:2502.20694, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.277478Z"},"links":{"cited_paper":"/paper/2502.20694","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:b301b11615a449bacfafef1cef452e861a2a1d01a9483990bc662494ffc5c049","observation_id":"2bf2fd3b-c7b2-448f-b47f-37f961e3d7f8","resolution":{"observed_at":"2026-08-07T04:29:37.277478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:40.679349Z","title":"Advantage-weighted regression: Simple and scalable off-policy reinforcement learning, 2019","venue":null,"work_id":"3f528f60-a3eb-476e-8e40-8fa2f008d6ab","year":2019},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.415979Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:216bc51eea6db38da0489a771e76fda74c48d19b870e55ca0782c36885afd3d0","observation_id":"98a0a420-08a3-4f6c-919e-0bf4d2afc50f","resolution":{"observed_at":"2026-08-07T04:29:40.739996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-07T04:29:37.530489Z","title":"Aligning text-to-image models using human feedback.arXiv preprint arXiv:2302.12192, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.530489Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:aaa82966e455b1fcd7632645c5d784cf8ae5bbd874470be1faf16e8d5c1949e7","observation_id":"c503522c-07ea-432d-b02c-7c13facee579","resolution":{"observed_at":"2026-08-07T04:29:37.530489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02617","last_updated":"2026-04-17T21:00:45Z","snapshot_observed_at":"2026-07-30T10:05:05.279382Z","submitted_at":"2024-12-03T17:44:23Z","title":"Improving Dynamic Object Interactions in Text-to-Video Generation with AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02617","snapshot_observed_at":"2026-08-07T04:29:37.670705Z","title":"Improving dynamic object interactions in text-to-video generation with ai feedback.arXiv preprint arXiv:2412.02617, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.670705Z"},"links":{"cited_paper":"/paper/2412.02617","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:36961f9bc9988a03da244b2e28155c9d84f5763e611d082afb35e43da7e0d03f","observation_id":"df2d7333-c8cc-4b69-90b2-6e06dc04ab51","resolution":{"observed_at":"2026-08-07T04:29:37.670705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-12T12:48:31.714281Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-07T04:29:37.767663Z","title":"Latent video diffusion models for high-fidelity long video generation.arXiv preprint arXiv:2211.13221, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.767663Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:f651b494287577bb2a7b557459d3a7248026567c75fa10991f01535c3a76754a","observation_id":"0ae9246b-95e5-4b64-8af1-497f8d50859c","resolution":{"observed_at":"2026-08-07T04:29:37.767663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:37.880698Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.880698Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:c8b4e01ce1585aaf822e061ef7e767ee61ccc6838f73f02b14debefb3cf62a48","observation_id":"51e41cf4-c842-4f87-92c1-65ee836e1363","resolution":{"observed_at":"2026-08-07T04:29:37.880698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:37.991042Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:37.991042Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:8f911a466487edaea697c274804f08e06583da0d6a547546a8c39eff9f46603a","observation_id":"f85c2159-b5f2-4342-9289-d78fc463aa0b","resolution":{"observed_at":"2026-08-07T04:29:37.991042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-07T04:29:38.135404Z","title":"Raft: Reward ranked finetuning for generative foundation model alignment.arXiv preprint arXiv:2304.06767, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.135404Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:6bdffde8ff511142a013522e99e9739f310bab98f8d869a7dffed4e64ff28fb3","observation_id":"dccc29e0-216f-4101-955f-9675bc0c0288","resolution":{"observed_at":"2026-08-07T04:29:38.135404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:38.313805Z","title":"Using human feedback to fine-tune diffusion models without any reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.313805Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:4ab6ea6fc8a0d8bf3648ac464b488f9b6b885b30e469d3f99386e8af51c93c77","observation_id":"f1120756-8f57-4e87-87d8-26b565c7a88d","resolution":{"observed_at":"2026-08-07T04:29:38.313805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-12T23:48:30.414248Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T04:29:38.396893Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step.arXiv preprint arXiv:2406.04314, 2(3), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.396893Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:83107a7699e943ef81cc73366587cf430f39b95492aaa4d5feb98b59e8e6f778","observation_id":"7b4eefa4-3d83-4a02-bd26-529ca2228b3a","resolution":{"observed_at":"2026-08-07T04:29:38.396893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22304","last_updated":"2024-10-29T17:50:31Z","snapshot_observed_at":"2026-08-12T22:12:31.489768Z","submitted_at":"2024-10-29T17:50:31Z","title":"Flow-DPO: Improving LLM Mathematical Reasoning through Online Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22304","snapshot_observed_at":"2026-08-07T04:29:38.509910Z","title":"Flow-dpo: Improving llm mathematical reasoning through online multi-agent learning.arXiv preprint arXiv:2410.22304, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.509910Z"},"links":{"cited_paper":"/paper/2410.22304","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:05b9b11677c69af685cb0a1b655f0de69cb6b248ed1ab871e20b17ef2c424a38","observation_id":"3c3b4cdf-c412-446d-8908-961cc6afba05","resolution":{"observed_at":"2026-08-07T04:29:38.509910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20194","last_updated":"2025-03-26T03:37:52Z","snapshot_observed_at":"2026-08-07T16:36:46.066394Z","submitted_at":"2025-03-26T03:37:52Z","title":"GAPO: Learning Preferential Prompt through Generative Adversarial Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20194","snapshot_observed_at":"2026-08-07T04:29:38.537856Z","title":"Gapo: Learning preferential prompt through generative adversarial policy optimization.arXiv preprint arXiv:2503.20194, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.537856Z"},"links":{"cited_paper":"/paper/2503.20194","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:5c01acc33048689355a9be7d4f2458076b771b4a50ab45c87103dfb1939a92c9","observation_id":"02ad75a6-c0ce-472d-bfb6-7746a0a3eab8","resolution":{"observed_at":"2026-08-07T04:29:38.537856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T04:29:38.585815Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.585815Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:d89e7b90292f9bb03d6aa13e1ef5de6219a7994510facf4a4cef67b5e1b4fa36","observation_id":"8ec20fa5-d281-453b-a4d9-ae0d45104786","resolution":{"observed_at":"2026-08-07T04:29:38.585815Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-07T04:29:38.635088Z","title":"Training diffusion models with reinforcement learning.arXiv preprint arXiv:2305.13301, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.635088Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:3ff88d2706aa967177c4c13f0604da734fb21547d555ac47df17402f6189ecf4","observation_id":"d04ec081-92e6-4d52-94e4-50207e25cac3","resolution":{"observed_at":"2026-08-07T04:29:38.635088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:40.462901Z","title":"Reinforcement learning for fine- tuning text-to-image diffusion models","venue":null,"work_id":"b02eccbd-8731-4c87-bb8a-0c514fa75597","year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.722553Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:6da86ccd7ca1990a9db419dd509c3524de74de3d30ac2fa0696dd90c8a47a850","observation_id":"3a51d4ba-008c-4158-a518-bddc22a7c095","resolution":{"observed_at":"2026-08-07T04:29:40.534519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:38.809581Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.809581Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:0297b8f53c6c860af28ddde6b56378693b7ab5390c93e053b2720006d9bd04cc","observation_id":"43407ae1-ff48-4df2-ac02-5355ae1e2834","resolution":{"observed_at":"2026-08-07T04:29:38.809581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:38.937918Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.937918Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:a5856a9cc96b0fe38b050aabe8cb3ea67c57718a1970d1ca5eb8ba89146c3af9","observation_id":"677b00e3-e171-4d88-b6b8-1faa3eb467ad","resolution":{"observed_at":"2026-08-07T04:29:38.937918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:39.045278Z","title":"Cotracker: It is better to track together","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:39.045278Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:509171f9b7763474ead25b192540281fe226b25d7ca8a45ddf767ce496e61d0a","observation_id":"502f77ae-30b4-4e8d-bb6f-98d28247526f","resolution":{"observed_at":"2026-08-07T04:29:39.045278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:39.144940Z","title":"Video generation models as world simulators, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:39.144940Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:71f0f2fb94417feabe85cf8a1f4958b221e0df78d417568fad0e2e721da4fb60","observation_id":"4965863d-13f6-46cf-b683-aba510ec6ae5","resolution":{"observed_at":"2026-08-07T04:29:39.144940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:29:39.266036Z","title":"Kling ai.https://klingai.kuaishou.com/, 2024.06","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:39.266036Z"},"links":{"citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:4f1709e080f87107686e927d97d3159ceef3f39b93d5d1702bf8637d9bce4549","observation_id":"3684ae8c-c882-4b4f-9e96-83db357a0df9","resolution":{"observed_at":"2026-08-07T04:29:39.266036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08260","last_updated":"2025-04-26T17:58:24Z","snapshot_observed_at":"2026-08-12T22:26:02.939381Z","submitted_at":"2024-10-10T17:57:49Z","title":"Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08260","snapshot_observed_at":"2026-08-07T04:29:39.411751Z","title":"Koala-36m: A large-scale video dataset improving con- sistency between fine-grained conditions and video content.arXiv preprint arXiv:2410.08260, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:39.411751Z"},"links":{"cited_paper":"/paper/2410.08260","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:7b37e8793fe9955783fb5d160582b1c0faa8f878e3cdacf07de5be30fe19d715","observation_id":"ac7eec90-e1c1-429f-9411-f21d674beb6f","resolution":{"observed_at":"2026-08-07T04:29:39.411751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15252","last_updated":"2024-10-14T04:08:53Z","snapshot_observed_at":"2026-08-12T23:37:24.872455Z","submitted_at":"2024-06-21T15:43:46Z","title":"VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15252","snapshot_observed_at":"2026-08-07T04:29:39.531704Z","title":"Videoscore: Building automatic metrics to simulate fine-grained human feedback for video generation.arXiv preprint arXiv:2406.15252, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:39.531704Z"},"links":{"cited_paper":"/paper/2406.15252","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:64e9dfa86a7d5aa25e9a2b37ce52237bdf986912d9947f4a66f9fcb77c8d4b72","observation_id":"be29dfc3-72d3-426d-bcdf-c9f4e5149870","resolution":{"observed_at":"2026-08-07T04:29:39.531704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:29:39.658035Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:39.658035Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:8644beb44f55486622889ca01d9b678aab6280fba1210447d6d12f486144e785","observation_id":"0b02af15-157f-4dd9-aae1-4c1d4d0dc9f4","resolution":{"observed_at":"2026-08-07T04:29:39.658035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-07T04:29:39.770200Z","title":"Camera zoom in, Disneyland","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:39.770200Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:145fbda017dea0b59c0ae4ad822f720bc1c17cb23d6afb5dda599a591cb9f12d","observation_id":"28c45976-fa18-49ff-ad2e-50198112175c","resolution":{"observed_at":"2026-08-07T04:29:39.770200Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T20:33:18.780493Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2506.10639."}