{"as_of":"2026-08-22T18:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f02fe3b9412183bcb55eec04e7ba4e910d02d1a54a617665d0a7023d00cb519d","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:04:46.282592Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T14:55:22.057166Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T15:03:31.569140Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"cited_work":{"arxiv_id":"2505.10921","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.10921","snapshot_observed_at":"2026-06-29T15:03:31.569140Z","title":null,"venue":null,"work_id":"bb6fafd8-6fca-4086-b7dc-55919f61a46d","year":2025},"citing_paper":{"arxiv_id":"2606.09855","last_updated":"2026-06-11T10:24:30Z","snapshot_observed_at":"2026-08-10T23:03:17.987825Z","submitted_at":"2026-05-26T05:05:44Z","title":"MinhwaNet: Faithful but Insufficient Object Grounding in Korean Folk Painting","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T14:55:22.057166Z"},"links":{"cited_paper":"/paper/2505.10921","citing_paper":"/paper/2606.09855"},"observation_digest":"sha256:601e4dcbaa8f644cf0b6d44809219d8a44c0823e11140dfe05f6c50c1b75a196","observation_id":"a8e703d7-3471-4fb5-9b8d-4d68a8fbdd5d","resolution":{"observed_at":"2026-06-29T15:03:31.570418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.10921/citation-record","integrity":"/paper/2505.10921/integrity","json":"/paper/2505.10921/citation-record.json","paper":"/paper/2505.10921"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.174700Z","title":"In: Proceedings of the IEEE international confer- ence on computer vision","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.174700Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:414c3d29f162b04e9520aa5b6fd9731429e2c1e6a064ea86db485e4951ad91fc","observation_id":"ed1fdcbe-0717-44a3-bff5-911cbcc95db2","resolution":{"observed_at":"2026-08-15T21:04:46.174700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.713846Z","title":"ACM Journal on Computing and Cultural Heritage17(1), 1–20 (2024)","venue":null,"work_id":"fc0fdbf6-6c53-4654-99bf-43b189c55cb4","year":2024},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.181205Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:2de9a5c931904cd9618e1fc44c4b25caa44e41c725d577e3c1da589f7d63aa69","observation_id":"c568d6a4-687d-43a5-a764-8d3378579d01","resolution":{"observed_at":"2026-08-15T21:04:46.719915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.698913Z","title":"In: Proceedings of the 46th International ACM SIGIR Conference on Research and Development in Information Retrieval","venue":null,"work_id":"e2a68fdd-c699-412a-a76d-72b996bad63c","year":2023},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.187517Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:0874c69985c8710b716bd6c5cef1f4267df1f62dd73b75f29b57ee401ec337b2","observation_id":"d2ceae6d-4425-4b9f-a81b-91a5b6d656dd","resolution":{"observed_at":"2026-08-15T21:04:46.703613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.06679","last_updated":"2022-11-21T15:39:52Z","snapshot_observed_at":"2026-08-18T03:53:31.226818Z","submitted_at":"2022-11-12T14:48:55Z","title":"AltCLIP: Altering the Language Encoder in CLIP for Extended Language Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.06679","snapshot_observed_at":"2026-08-15T21:04:46.192504Z","title":"arXiv preprint arXiv:2211.06679 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.192504Z"},"links":{"cited_paper":"/paper/2211.06679","citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:5df999bd2c6f924113d68ce27736dcb69469ad1ef08ca26179d6abde3f691122","observation_id":"b004b617-831b-42dd-ae05-4b021818db7d","resolution":{"observed_at":"2026-08-15T21:04:46.192504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-15T21:04:46.197820Z","title":"arXiv preprint arXiv:2010.11929 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.197820Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:122e564598630b993f4fa08ffd57117e7ee3e7b613cdd56d2f57988cf7c399ef","observation_id":"5461cb29-daaf-4d55-98c1-88cca2c35658","resolution":{"observed_at":"2026-08-15T21:04:46.197820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.679263Z","title":"Advances in Neural Information Processing Systems35, 26418–26431 (2022)","venue":null,"work_id":"da1552a5-f196-4c71-8155-699974386dc7","year":2022},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.203373Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:2817d29f7c280c2dd60d7981e11e7f86e43e8a9bf3019eac4f3a1fca45edd705","observation_id":"1d66c9d2-d027-4738-8302-cb93984e3664","resolution":{"observed_at":"2026-08-15T21:04:46.686136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-15T21:04:46.209026Z","title":"arXiv preprint arXiv:2410.21276 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.209026Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:c7eb193d55b34f85134595904df1d07ef73f41c828664311df707327b4e19737","observation_id":"503c4793-71eb-47e1-8424-5e1147d58485","resolution":{"observed_at":"2026-08-15T21:04:46.209026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.661533Z","title":"In: International conference on document analysis and recognition","venue":null,"work_id":"4d35ab4d-f8a1-416e-a7ee-1cbee7a973db","year":2021},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.214233Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:b7399d3d32b81246c8240143d1bbeef5c42295b46eea038bf4985fa05b8b1a56","observation_id":"ce23eee7-3b19-4225-a78f-a1bc5e230b4a","resolution":{"observed_at":"2026-08-15T21:04:46.666776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.645043Z","title":"In: Pro- ceedings of the 25th ACM international conference on Multimedia","venue":null,"work_id":"3b1c5421-776b-4cbb-aa41-b134b1f1b3f1","year":2017},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.218560Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:65a0ce62d2e7a8580341efb698c4253a15c2570b91accb636b98dc04cdeb06e4","observation_id":"20fb0435-3751-4ec4-8c65-e6cb8b70773d","resolution":{"observed_at":"2026-08-15T21:04:46.650239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.628675Z","title":"IEEE Transactions on Multimedia 21(9), 2347–2360 (2019)","venue":null,"work_id":"dda33a10-8fc4-4db9-afa0-6ceb84b6a8c5","year":2019},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.222332Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:2ea837e4874f11da3eb01db7a7aeef2d5b7c5b3bec5bb9c58734db5ffef6c76d","observation_id":"21974551-5459-4aca-aaa7-1ed61b4f807f","resolution":{"observed_at":"2026-08-15T21:04:46.633889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.609465Z","title":"Advances in Neural Information Processing Systems 37, 1141–1161 (2024)","venue":null,"work_id":"abf66b34-5ab7-4e4f-a276-7939ad4647ed","year":2024},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.226150Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:7b765b91ae24abda6048a2bf228e16723c26fb2f7115723bc7345af074225bf9","observation_id":"e21b32e2-0300-45ff-a60c-1410e23b82ef","resolution":{"observed_at":"2026-08-15T21:04:46.615142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.593310Z","title":"International Circular of Graphic Education and Research pp","venue":null,"work_id":"b55d1d95-4dd1-4f73-b2fd-8cc63dc233a0","year":2018},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.230092Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:8a7679c584bd937a2c63b86b4e577cf31bebe39b7e5a44c38e9a5899d181c0f0","observation_id":"bd7dc1dd-7867-4a2e-bd95-1a42d5f66fed","resolution":{"observed_at":"2026-08-15T21:04:46.598743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-15T21:04:46.234254Z","title":"arXiv preprint arXiv:1907.11692 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.234254Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:873becdd45c977815dfd0778c60d8bdea974a195de02df123ae769667861c611","observation_id":"14795443-05a6-4931-9f2d-9363148f4639","resolution":{"observed_at":"2026-08-15T21:04:46.234254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.579130Z","title":"ACM Computing Surveys (CSUR)54(6), 1–37 (2021)","venue":null,"work_id":"d9665ec5-fb90-46fa-ae36-f0dfbe7e2ccd","year":2021},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.238729Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:a00509167531311d00560fc3768cef6efb08e53f4d657cbad611a3b713326b21","observation_id":"49062ea1-062f-45a8-b2e4-c80f0e117ad8","resolution":{"observed_at":"2026-08-15T21:04:46.584172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.564591Z","title":"Halmstad University Press (2018)","venue":null,"work_id":"5bc27509-b166-4336-9998-ce53303d79c5","year":2018},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.242518Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:75743ae7d1f8531ed435c7eeed647b089679e01690b364963b32c633a1b9e936","observation_id":"853eb5ce-1ae3-4e96-8f9b-caf8a3dea925","resolution":{"observed_at":"2026-08-15T21:04:46.569987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.548583Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"cd991dbc-cd1e-429f-b910-1472e03fff88","year":2023},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.246407Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:d7568f2ec912201ac55d5de8f9351dc4ffb608ce2769282366e5973cf9840aed","observation_id":"cba4acab-9bf2-4b85-8d57-c4f6e20912cc","resolution":{"observed_at":"2026-08-15T21:04:46.554606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.531677Z","title":"Gondwana Research26(3-4), 1216–1221 (2014)","venue":null,"work_id":"d3cb28f5-3851-4c62-afe7-11a49a837b6a","year":2014},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.250137Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:43422c61d6a229ed821553ecab3d80599975e8b4c4b819a8838acbb1de582120","observation_id":"d3758079-26d9-4508-b9f5-67a0b04aa978","resolution":{"observed_at":"2026-08-15T21:04:46.537010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.253799Z","title":"In: International conference on machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.253799Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:3b76b0ef9a662033d11a1a8ad79e98d7b57ab1cf03e756b3a79345da099c5a39","observation_id":"7d3fd0fb-cd45-4fc5-a23d-4b5cbd52440a","resolution":{"observed_at":"2026-08-15T21:04:46.253799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.494877Z","title":"Expert Systems with Applications255, 124811 (2024)","venue":null,"work_id":"ab7de8d8-193d-41cf-92e3-cbd0c1cabb6e","year":2024},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.257621Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:dd186eaf8e1763cc60e91030ae6bf60beb78bae167b27fa1f5398a650f7cbac6","observation_id":"1a9044bd-6ae0-4eae-ab6a-ebd733fe9e25","resolution":{"observed_at":"2026-08-15T21:04:46.500634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.475629Z","title":"In: Proceedings of the 31st ACM International Conference on Multimedia","venue":null,"work_id":"1fb09ef5-1b68-47bb-a148-fe4d6c5b2590","year":2023},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.261426Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:a01e05c7e646cc8cf3627e862f51c49da978289654a82b3ad49d201d452a013e","observation_id":"e169781d-40ff-4310-9888-f0caa0281bb7","resolution":{"observed_at":"2026-08-15T21:04:46.481278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01335","last_updated":"2023-05-23T01:28:21Z","snapshot_observed_at":"2026-08-20T00:23:40.229447Z","submitted_at":"2022-11-02T17:47:23Z","title":"Chinese CLIP: Contrastive Vision-Language Pretraining in Chinese","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01335","snapshot_observed_at":"2026-08-15T21:04:46.265412Z","title":"arXiv preprint arXiv:2211.01335 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.265412Z"},"links":{"cited_paper":"/paper/2211.01335","citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:d1d47968e00a75d3a244788302a6bc7b8091c9735d24f27c5ccffc8de41cc37a","observation_id":"810a1e1e-88ba-404a-8d59-e2005a2c0637","resolution":{"observed_at":"2026-08-15T21:04:46.265412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11813","last_updated":"2025-09-05T07:15:34Z","snapshot_observed_at":"2026-08-18T00:33:52.656288Z","submitted_at":"2024-08-21T17:58:02Z","title":"SEA: Supervised Embedding Alignment for Token-Level Visual-Textual Integration in MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11813","snapshot_observed_at":"2026-08-15T21:04:46.269774Z","title":"arXiv preprint arXiv:2408.11813 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.269774Z"},"links":{"cited_paper":"/paper/2408.11813","citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:503672a137c56c9c1bbc226524081eb73e1d44b14b030ff8f754246aad23c488","observation_id":"fa666afd-4efd-4822-8234-b45c11ee35b8","resolution":{"observed_at":"2026-08-15T21:04:46.269774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.04589","last_updated":"2019-07-11T06:46:18Z","snapshot_observed_at":"2026-08-19T06:30:26.708907Z","submitted_at":"2019-07-10T09:35:08Z","title":"Dunhuang Grottoes Painting Dataset and Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.04589","snapshot_observed_at":"2026-08-15T21:04:46.274045Z","title":"arXiv preprint arXiv:1907.04589 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.274045Z"},"links":{"cited_paper":"/paper/1907.04589","citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:8485bed1d2537a00c9da8fb6424832599d26efd26d11705243e0c31b881eab58","observation_id":"d82c41a2-b1e2-458c-b523-4123c738f925","resolution":{"observed_at":"2026-08-15T21:04:46.274045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.278282Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.278282Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:cad31351b1140a62b321c60ffae102e9a666dafb549d04dce97a641543d0df66","observation_id":"44ae1fe7-a01c-4f03-b1fb-1c9875004e01","resolution":{"observed_at":"2026-08-15T21:04:46.278282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:04:46.448665Z","title":"Światowit11(52), 42–57 (2013)","venue":null,"work_id":"d7f67de9-ccd0-4514-86ce-33aead5685cb","year":2013},"citing_paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:04:46.282592Z"},"links":{"citing_paper":"/paper/2505.10921"},"observation_digest":"sha256:21625fab0ef8525fdd2ea89f451e81229cfffa7d018bbdff5321117924d17229","observation_id":"1a77e20e-5edd-4fd7-9140-1843d143022f","resolution":{"observed_at":"2026-08-15T21:04:46.454747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10921","last_updated":"2025-07-19T04:40:24Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T00:24:07.868870Z","submitted_at":"2025-05-16T06:52:46Z","title":"Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2505.10921."}