{"as_of":"2026-08-10T08:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:987e2984851af127417e37de5ac15eb79e1ea280589c1535878318efef791889","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:53:37.628619Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.02890/citation-record","integrity":"/paper/2508.02890/integrity","json":"/paper/2508.02890/citation-record.json","paper":"/paper/2508.02890"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:34.894169Z","title":"A survey on large language model (LLM) security and privacy: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:34.894169Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:fe1fa39762c86add1e0e4f8e94a82bedb16935e5da113ea3afc0c03fc0b5c157","observation_id":"eacd1369-8811-4dcd-9407-3544730b7617","resolution":{"observed_at":"2026-08-06T04:53:34.894169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:34.986182Z","title":"Visual in-context learning for large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:34.986182Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:734d28feecabed00dd31c8e0eab9bf2f8acb391f8e0d09c26398bbf811a9a719","observation_id":"67d1f37a-008c-42ba-b9c5-debfddbbffd3","resolution":{"observed_at":"2026-08-06T04:53:34.986182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19732","last_updated":"2024-12-20T16:19:17Z","snapshot_observed_at":"2026-08-03T16:04:58.991344Z","submitted_at":"2024-10-25T17:59:09Z","title":"Rethinking Visual Dependency in Long-Context Reasoning for Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19732","snapshot_observed_at":"2026-08-06T04:53:35.120481Z","title":"Rethinking visual dependency in long-context reasoning for large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.120481Z"},"links":{"cited_paper":"/paper/2410.19732","citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:e0e3e42d95e87e2724e4194710a79c0ff5bbf565adb559756639962f753e784e","observation_id":"0962754c-97cf-4730-b35d-56094bab93e2","resolution":{"observed_at":"2026-08-06T04:53:35.120481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:35.196450Z","title":"Lvlm-ehub: A comprehensive evaluation bench- mark for large vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.196450Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:bc37714bc6dda1d3c507a46a5ab8d41a1d9e45e5eab60a6b344510892488fb8a","observation_id":"4cd8ca6d-60f0-4e0d-b59e-1ceb8e04ed31","resolution":{"observed_at":"2026-08-06T04:53:35.196450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:41.461480Z","title":"COVID-19 detection in chest x-ray images using swin-transformer and transformer in transformer,","venue":null,"work_id":"c146984c-6d2c-48c1-9ae6-e683d22f1f7d","year":2021},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.291408Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:b2056831ab021dcaf4bfd99e85a910dab1665fa044d577ef2d725d11d99e18d7","observation_id":"0a48374c-605f-402b-b0db-dd7b6f8c2224","resolution":{"observed_at":"2026-08-06T04:53:41.530111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07398","last_updated":"2024-06-20T14:44:14Z","snapshot_observed_at":"2026-07-06T17:28:43.842260Z","submitted_at":"2024-02-12T04:13:16Z","title":"VisLingInstruct: Elevating Zero-Shot Learning in Multi-Modal Language Models with Autonomous Instruction Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07398","snapshot_observed_at":"2026-08-06T04:53:35.394791Z","title":"Vislinginstruct: Elevating zero-shot learning in multi-modal lan- guage models with autonomous instruction optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.394791Z"},"links":{"cited_paper":"/paper/2402.07398","citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:a8d4bbf7ccafe121df38e94151701b0d04e6ff5c0b75920af1e9899c595b1976","observation_id":"7b4fd9af-f854-4bd5-94be-b70a285af3c1","resolution":{"observed_at":"2026-08-06T04:53:35.394791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:41.311097Z","title":"Video-llava: Learning united visual representation by alignment before projection,","venue":null,"work_id":"2825af68-0d9b-4cc9-81ce-f6a147bbe286","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.485118Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:152ca7402c1c10566292dbdc66174055d8677515e866f76dafcda976ffdf2c8e","observation_id":"de0e6c6d-196f-41f6-aa53-35a691c99a37","resolution":{"observed_at":"2026-08-06T04:53:41.380749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:35.663480Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.663480Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:052f569684eeb71b4bcf54b0b3b3c8fc36f69838b0528531692e9d83b94e6d21","observation_id":"88c032e3-ca13-4403-b252-b3389c4eb7f7","resolution":{"observed_at":"2026-08-06T04:53:35.663480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:41.004443Z","title":"Microsoft COCO: common objects in context,","venue":null,"work_id":"5eff56d6-67c3-416d-b230-9304276391f0","year":2014},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.751725Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:c44fafb92c89dc1f1d158639217000fdc7055d3e55bf37bb250d868ac41d4b7d","observation_id":"1e874e69-2cb8-41cb-ab70-51f0da3545d7","resolution":{"observed_at":"2026-08-06T04:53:41.056036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.851051Z","title":"The open images dataset V4: unified image classification, object detection, and visual relationship detection at scale,","venue":null,"work_id":"df223433-4a51-49ce-98f8-6ab7bbbc0b46","year":2018},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.818007Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:ddc6623a80be656f550ba1d3629401860f5d021f287a14d7e4b5634bd8acca75","observation_id":"d3527ab6-69f5-41b4-8ea9-d2a5892f8941","resolution":{"observed_at":"2026-08-06T04:53:40.924173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.686508Z","title":"A comprehensive survey and guide to multimodal large language models in vision-language tasks,","venue":null,"work_id":"651f9cff-e14f-47e7-9350-5ce3f3524499","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.919605Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:21ce74257b693bd2ae291cb8d9037c97fcc7edb7a7860dd0f4632260e150b405","observation_id":"ed814613-5818-414f-8dc3-01fb428d10bc","resolution":{"observed_at":"2026-08-06T04:53:40.761105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.556249Z","title":"Foundational models defining a new era in vision: A survey and outlook,","venue":null,"work_id":"d52a692a-3319-49b6-8da4-a64253e0fd67","year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.016111Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:a1c4276176067affa2f120ab97852542a59e3a392788a3d832879b6e3b2a0e9d","observation_id":"2f090265-cc99-4813-873d-a288cb0f037b","resolution":{"observed_at":"2026-08-06T04:53:40.613474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.387564Z","title":"Lmfusion: Adapting pretrained language models for multimodal generation,","venue":null,"work_id":"5a3d56fc-af71-48ac-886a-a0ac524dceb9","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.100031Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:8d0a57a290555b6e12f2c43b15f42ec4ef24dff42c008d619047d6d24efb89e6","observation_id":"7df7c4f8-10e2-4c8d-9c6e-b4b1bbf24111","resolution":{"observed_at":"2026-08-06T04:53:40.466056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.211089Z","title":"Multi-modal generation via cross-modal in-context learn- ing,","venue":null,"work_id":"011c1351-bfa9-43bc-95ef-a2267f6b827e","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.176805Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:3d7644db4c78fe1d52e878a0bd5ef1f8fa60de40f90f020bd2bf4ab1ff144126","observation_id":"96dc4790-67af-47b5-8520-c34e922def86","resolution":{"observed_at":"2026-08-06T04:53:40.292168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.046300Z","title":"Improving cross-modal alignment for text- guided image inpainting,","venue":null,"work_id":"d10db253-5b7d-4ce8-8b02-95fe684d571d","year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.239263Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:81252ffb414625accafe0e4945c62092bedb51103cd345c622491d19b446f927","observation_id":"43505e43-816e-43cf-8d63-0c3a2c3d29f2","resolution":{"observed_at":"2026-08-06T04:53:40.111178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.900313Z","title":"Fine-grained distillation for long document retrieval,","venue":null,"work_id":"76d1123c-ebca-4422-b855-87a5972f70af","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.348068Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:40e2e8c668c7cf3343046b592f1daa253f2eb25577140cd650ea97a75544f12e","observation_id":"2c8f32f5-25d1-4cb1-bf8d-433aa69b0d48","resolution":{"observed_at":"2026-08-06T04:53:39.975428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:36.418581Z","title":"Towards robust ranker for text retrieval,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.418581Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:b5d9ccba4c3db771182283a0b1dc1711c25b6c3dad691ec87d90f59a4bf08b9e","observation_id":"eaf2c7e2-1e71-43ef-b43e-d69726e675b8","resolution":{"observed_at":"2026-08-06T04:53:36.418581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03963","last_updated":"2024-06-14T03:42:17Z","snapshot_observed_at":"2026-07-06T14:02:32.637793Z","submitted_at":"2022-10-08T08:07:47Z","title":"SDA: Simple Discrete Augmentation for Contrastive Sentence Representation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03963","snapshot_observed_at":"2026-08-06T04:53:36.479833Z","title":"Sda: simple discrete augmentation for contrastive sentence representation learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.479833Z"},"links":{"cited_paper":"/paper/2210.03963","citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:58d385566e232a8038325db1e16dca36fe626c10a4f1e426c86093e0ae039524","observation_id":"157f1484-fb01-4970-b7fb-ebe9fd6d1c6c","resolution":{"observed_at":"2026-08-06T04:53:36.479833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.762683Z","title":"Improving zero-shot cross-lingual transfer for multilingual question answering over knowledge graph,","venue":null,"work_id":"3f8219b7-74f1-47d3-b471-46cfc33e8418","year":2021},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.567007Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:224db4f32f39d3182bc9ec144bb9c4f1d1ab32e8938c290f8982c442acedd47a","observation_id":"2c442728-c6d9-4b40-b4ba-5f6ba05ec8d5","resolution":{"observed_at":"2026-08-06T04:53:39.805684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12432","last_updated":"2025-05-25T13:59:04Z","snapshot_observed_at":"2026-08-07T08:09:08.223198Z","submitted_at":"2025-01-21T16:49:08Z","title":"Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12432","snapshot_observed_at":"2026-08-06T04:53:36.649064Z","title":"Divide-then-aggregate: An efficient tool learning method via parallel tool invocation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.649064Z"},"links":{"cited_paper":"/paper/2501.12432","citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:e060f0ea0cc9c7ebf1fc40d7ab671e1172c305b30a73d0928f796e10a444599f","observation_id":"15d4985d-36e9-49fe-b527-f69dcf189b0d","resolution":{"observed_at":"2026-08-06T04:53:36.649064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.605238Z","title":"Grounding multimodal large language models to the world,","venue":null,"work_id":"3c99afc7-64e6-4519-88da-a13c56a65f3a","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.730915Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:8d7c5c419355f30a690a54fdebcc5dbfb0150dc12a0d3c82a7381dd3cae4a04d","observation_id":"35d856bd-9541-4a29-a7be-9bec52a82681","resolution":{"observed_at":"2026-08-06T04:53:39.665546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.479497Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models,","venue":null,"work_id":"3d1f8e3f-ecc2-4263-a4de-33772055505c","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.795493Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:33c534927aca31103627ab966a7f02e2e58e471892e6fd47c1d1426338c8d9e0","observation_id":"d25c2a3b-aec9-4e7a-8f5d-ce7211e50d19","resolution":{"observed_at":"2026-08-06T04:53:39.527048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.265414Z","title":"Personalizing multimodal large language models for image captioning: An experimental analysis,","venue":null,"work_id":"d00df759-0332-402e-b09b-67d532d4a240","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.863690Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:7a6103e7731db04fd0d0bfeeff76eea957015e33c07dd1747510e6ad70375d34","observation_id":"2c0cf87d-4925-469f-8c93-220b39786aeb","resolution":{"observed_at":"2026-08-06T04:53:39.374295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.136038Z","title":"Prompting AI art: An investigation into the creative skill of prompt engineering,","venue":null,"work_id":"750b550f-495c-425a-9129-5d7078b5c079","year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.947563Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:824548747095355649ffd3f6c3508bd93993b2aac90fc70e7a952f29d059b1b6","observation_id":"0a4e951c-3083-40e4-b0ed-14cf3a463498","resolution":{"observed_at":"2026-08-06T04:53:39.194005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.959425Z","title":"Crafting effective prompts: A guideline for successful image generation,","venue":null,"work_id":"6ab7a216-5aef-45df-bbb4-b33d06b12ced","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.001337Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:ad4020a46ca523912719488e83b000b71b5b60d515b86a9b715cb119a8b4d1f6","observation_id":"5be41d56-15ec-4a8e-8b71-ebdecd01334d","resolution":{"observed_at":"2026-08-06T04:53:39.051718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.787989Z","title":"Prompt engineering for chatgpt: a quick guide to techniques, tips, and best practices,","venue":null,"work_id":"b02e3035-deb5-4bff-8fac-fa06735e4469","year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.090897Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:8d8ca4d4bbb889a749b98d1de31f3f77c2d53a72d15753a93762ef3844069143","observation_id":"4da03b30-da04-492c-92d0-56dafddc885c","resolution":{"observed_at":"2026-08-06T04:53:38.862316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.647269Z","title":"Automatic generation of multimedia teaching materials based on generative AI: taking tang poetry as an example,","venue":null,"work_id":"1d617ba0-a724-4301-adfd-22f0823bd071","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.162301Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:1cda56b2924ce2829f8850c2a00321aa1cec41b3f38739bdeafcd3e29e4727fe","observation_id":"b0f82731-b673-48d1-8076-3bd13711f884","resolution":{"observed_at":"2026-08-06T04:53:38.707168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.464066Z","title":"STAR: boosting low-resource information extraction by structure-to- text data generation with large language models,","venue":null,"work_id":"7547def1-da9c-4394-9a47-3ad50310991c","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.260659Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:71a26892db9ea1a3ebd3d94734dc4b264ec7ad9950a7d792354a579e17a1c265","observation_id":"4b7686c2-fd57-44f0-8a0c-fdeda47ec520","resolution":{"observed_at":"2026-08-06T04:53:38.527884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.262005Z","title":"Knowgpt: Knowledge graph based prompting for large language models,","venue":null,"work_id":"a7c2f499-9d14-4022-8119-860cf6af7b93","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.342722Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:391569e602ca5c79cafdac13e636ddb3dca7f6aff104822e2a5cb048954c334e","observation_id":"501bffed-3bc6-43bb-b02f-37ee09846a26","resolution":{"observed_at":"2026-08-06T04:53:38.353597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.052178Z","title":"Prompt-based length controlled generation with multiple control types,","venue":null,"work_id":"268ae5d0-18ab-45b9-8609-4592d8580b15","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.436839Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:686a0cedde8c8a7ebe4b96c114d2c9039029f06701e4dd8dd22c0ef514396f8d","observation_id":"12028a21-3dbe-4017-930c-a6ebd22d8b7f","resolution":{"observed_at":"2026-08-06T04:53:38.120165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:37.522270Z","title":"Weak to strong generalization for large language models with multi-capabilities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.522270Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:8c615866df75f204f7575649691a39e2e522afc3c30a96b8b9aaeae6eec35a68","observation_id":"60015dd5-5ff8-4881-a4a5-363548c3badb","resolution":{"observed_at":"2026-08-06T04:53:37.522270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:37.858961Z","title":"Prompting creativity: Tiered approach to copyright protection for ai-generated content in the digital age,","venue":null,"work_id":"0234f0d2-fa18-47fe-843c-595692985b05","year":2025},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.628619Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:6e2798e14f92cb6017b662232d4c150133febf2e5cc9fb67c021870396348cae","observation_id":"22b31d61-1b61-4853-ae7a-8350d205eb85","resolution":{"observed_at":"2026-08-06T04:53:37.911106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:41.154821Z","title":"5971–5984","venue":null,"work_id":"30cc2342-9694-42dc-bfcf-bdd40e65548b","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.584616Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:336f82e572f73e3ba223c4ee0541e125e54b289e69a5f559463995d31e48f29a","observation_id":"1ba425d5-e40a-462b-99a1-f7f7ed80204e","resolution":{"observed_at":"2026-08-06T04:53:41.232114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T05:07:17.520664Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2508.02890."}