{"as_of":"2026-08-14T02:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b544918138b66ba9bbd22df7efb16dcd47506a87e0eb9e341859796e9941cfc","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:51:44.999434Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T03:33:57.334363Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23365","snapshot_observed_at":"2026-08-02T03:33:57.334363Z","title":"MCFNet: A multimodal collaborative fusion network for fine-grained semantic classification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16327","last_updated":"2026-07-15T14:06:17Z","snapshot_observed_at":"2026-08-13T20:10:23.989870Z","submitted_at":"2026-07-15T14:06:17Z","title":"Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T03:33:57.334363Z"},"links":{"cited_paper":"/paper/2505.23365","citing_paper":"/paper/2607.16327"},"observation_digest":"sha256:4a028fdaed8b80b474d915b44e77c45d15db197767b0b09422422a5ee0e98a0b","observation_id":"523a052e-91f2-4382-b937-9961366a4c32","resolution":{"observed_at":"2026-08-02T03:33:57.334363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23365/citation-record","integrity":"/paper/2505.23365/integrity","json":"/paper/2505.23365/citation-record.json","paper":"/paper/2505.23365"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.660542Z","title":"Tuia , author B","venue":null,"work_id":"bca52fe0-deba-4405-a8d3-4ff82795a796","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.382845Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:b99fe4c87ef6fcf2ecfc34708a13e2d232c16e1f0c17d488738212fbf57e7d5b","observation_id":"5f3562d6-c148-4b9b-8efc-d9109c0587a1","resolution":{"observed_at":"2026-08-07T12:51:56.745814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.518687Z","title":"Fu , author A","venue":null,"work_id":"4856b65c-fa22-4d03-bf74-24d754ac0ea2","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.473784Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:699a813b9b8a928dfa72a68efb688fb271e7ba6c11d4092574501efc572f3ee3","observation_id":"c413af52-a73e-4e38-a25d-0dfab3a3715a","resolution":{"observed_at":"2026-08-07T12:51:56.581762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.312863Z","title":"Rubin , author O","venue":null,"work_id":"b1c70396-8821-4760-b2ff-9d5411c515e3","year":2019},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.604738Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d0d64c7e47df49bb5c49b7cacfdf73c275224838777d2db4833db7e3d62f6c63","observation_id":"b65098a0-e40b-4606-9340-dac4b2143bd5","resolution":{"observed_at":"2026-08-07T12:51:56.400322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.186061Z","title":null,"venue":null,"work_id":"6f861f99-4bd9-4bde-a48d-4a653dc183e5","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.782627Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:0093cac406f4e63e6d607ea5f0786973b0b553402a416cf7af0d02eabc301331","observation_id":"c73256aa-34b7-45bc-9bad-239cb60c4592","resolution":{"observed_at":"2026-08-07T12:51:56.235356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:56.007433Z","title":"Prakash , author K","venue":null,"work_id":"7acb861a-2e87-4505-bd07-483f25836768","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:38.952498Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:4813adab4fe13d12b91ccd8c8f993a79e299dcb3af7c953ee6940982dcd9639d","observation_id":"cd63dd5b-2c4d-455f-81a7-851f5c28b2f6","resolution":{"observed_at":"2026-08-07T12:51:56.095660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.850272Z","title":"Xu , author Y","venue":null,"work_id":"f75a3ca7-e566-49c7-8ab1-8a2ebac17c2e","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.087761Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:43f16923ed284efd76d6682d7598b15f882e04d0ae02d2a694756ceb20950232","observation_id":"24713c7e-8cc5-491a-a94f-1d168d3c2854","resolution":{"observed_at":"2026-08-07T12:51:55.928765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.625163Z","title":null,"venue":null,"work_id":"ecdc36df-5773-4d8d-83c6-60fd14d6cd17","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.239526Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c721b2ff7ecbce3a4647d27eabba62225ba067773b6054d7c072bdda2310a857","observation_id":"9617db87-240d-4a6f-ac0a-1c5e60d01ee4","resolution":{"observed_at":"2026-08-07T12:51:55.744482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.433225Z","title":null,"venue":null,"work_id":"0a68f716-b35a-4ecc-a727-845718b23bf4","year":2004},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.415984Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:b36a3d6d11c60fae07881ec06b1108701fedb3244a972245389bc1cc1970df3a","observation_id":"9a72dca9-d13d-487b-860c-8f64445b604b","resolution":{"observed_at":"2026-08-07T12:51:55.523200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.240393Z","title":"He , author J","venue":null,"work_id":"e033a40f-7fe8-4888-acc1-e34ab1af5c78","year":2008},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.539554Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:e5296425dddbced152387ea1ae77dd8eaa39ed38d56fc74fa38cf5079e1014a5","observation_id":"cbc73eba-7667-49df-befb-8766e1d18259","resolution":{"observed_at":"2026-08-07T12:51:55.330833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:55.053863Z","title":"Xu , author X","venue":null,"work_id":"d75f7b51-5a76-4086-bbd4-d8b1d51f8b1f","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.680222Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:988a77a0a777c0ec286c76eee631187bb329b1424aa97aff537d01879d8d322a","observation_id":"e569d3a0-9135-4907-808f-00f851860d64","resolution":{"observed_at":"2026-08-07T12:51:55.142068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:54.865552Z","title":"Li , author M","venue":null,"work_id":"492b0b37-6dbd-4a6a-8b17-b4133ae6330c","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.787387Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:6c35c8990673ec1d9b226343f6c3baac9036d7b681855297ebd62d2c141cfb30","observation_id":"f4a117e7-fee4-4d99-bbf3-4690db3a07aa","resolution":{"observed_at":"2026-08-07T12:51:54.948483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:54.632753Z","title":null,"venue":null,"work_id":"ae1ee38c-d0ea-44bf-95ef-73f01afd0d0a","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.893776Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:7c1f21e10f53be4ea3168eef18c8370d9da1d1695924be9704f4082ae7b40c00","observation_id":"900cce49-3eb4-47a3-b666-84ef6c49c78e","resolution":{"observed_at":"2026-08-07T12:51:54.739704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:54.388702Z","title":"Huang , author S","venue":null,"work_id":"28e2f05d-86ee-4a26-a051-91b7869f802f","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:39.992768Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:56dd1f08e89fc59d5947af6b53a2ac6b16ef24659f3443e8c62f4b2b794ea174","observation_id":"f02fadbc-1019-4788-972d-8b183b4440d1","resolution":{"observed_at":"2026-08-07T12:51:54.530143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:54.203835Z","title":"Zhou , author G","venue":null,"work_id":"e8108386-c472-4418-99de-0b52ee6ffe19","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.097547Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:3ef5573911cd29e32817a991e4f5c2e1dbcbbc81d48d465d1d06d92cd0a0623f","observation_id":"88fa1da3-25cf-4557-849b-c0ba7f850b4a","resolution":{"observed_at":"2026-08-07T12:51:54.278618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.971105Z","title":"Huang , author Z","venue":null,"work_id":"e4711cc5-4598-4516-99dc-59392e51c2eb","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.178292Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:36782b3bc9b7b544aab9a88cecf2482c5e3e4171c1e758ce329d6b4fa44f71b1","observation_id":"217e6e0c-7173-4f64-925a-ebd976923d03","resolution":{"observed_at":"2026-08-07T12:51:54.082892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.757226Z","title":null,"venue":null,"work_id":"a6edb65d-5ee5-4cdf-8d1f-bab847fd5ec4","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.265989Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:3de4a219bbb2bb63d58523f6bc9ac96c5297b864e5bb6536fbc93ce2ca63fc21","observation_id":"66badfa4-9860-46e9-a1da-62cf3d8cc8ad","resolution":{"observed_at":"2026-08-07T12:51:53.857281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.499644Z","title":null,"venue":null,"work_id":"6e34b19b-d244-4581-91b3-76a2ff233a80","year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.338258Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d61c533fa8ab58525148bce937ccbab1cf7a789d2b55ce41798ee1d0132c9b0f","observation_id":"aabeab9f-7129-46a1-9c48-3ad2b875da01","resolution":{"observed_at":"2026-08-07T12:51:53.601849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.306318Z","title":null,"venue":null,"work_id":"b22ddbb4-cb0a-4772-a1a1-49bd036d505b","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.433625Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:cd624754b697087e81ef4864ca307bfed8f47815cb92a232ff11f4da71bd1d1e","observation_id":"d24ae614-4ddf-4257-b8ad-8c4e92781aff","resolution":{"observed_at":"2026-08-07T12:51:53.412085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:53.034447Z","title":"Sun , author Y","venue":null,"work_id":"addaf72a-e7b4-4e1b-9ac0-1eed2c7839d9","year":2018},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.544749Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:90eab7449f1bbfc3862d966deb7814295ca63b58c4145e75e45711bebe983c62","observation_id":"6abbc151-9740-4e75-a619-c53cbcebfac0","resolution":{"observed_at":"2026-08-07T12:51:53.142624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.831566Z","title":null,"venue":null,"work_id":"6da3aef0-bcbb-42db-8db1-2fd7a1e80f75","year":2019},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.606759Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:99cbe61b092a6447e1acfc83d7b3bd7a21c09bbdef2c5e5f954ee5a236f3d5a9","observation_id":"20a00d9b-a07e-4c38-be05-dc549b97d9c5","resolution":{"observed_at":"2026-08-07T12:51:52.919209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.642896Z","title":null,"venue":null,"work_id":"3ca2b3cb-1a09-40bf-b303-048edd93a172","year":2015},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.680364Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:5ee0623f88ebfa4490f02025f789429fcb5df24324150b6e436c939ecc57d2f8","observation_id":"226a53c3-e7cc-434a-8906-557fc7a92ced","resolution":{"observed_at":"2026-08-07T12:51:52.747306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.439493Z","title":"Gao , author O","venue":null,"work_id":"e3091ad3-bd57-41d7-a93e-a8e561aba63a","year":2016},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.746641Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:f2ddb3763e06edf29921181f7823706b1390ec733e1924ddbad2d2a4462e264e","observation_id":"2f06e7c3-c11c-45e5-8503-7dc112a2a099","resolution":{"observed_at":"2026-08-07T12:51:52.516909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.240970Z","title":"Kong , author C","venue":null,"work_id":"87325d38-b2a9-4c15-9073-25a424cd1f3b","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.840466Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c4895be2ecf28bca52e177c30d230ad0039733981cb66e4f3a6d25d1a26b956d","observation_id":"797f9875-6655-49b9-bc40-3ce53ed9551b","resolution":{"observed_at":"2026-08-07T12:51:52.350023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:52.014781Z","title":"Cui , author F","venue":null,"work_id":"54e6deb0-b101-4137-aab5-1f4ad2051837","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.915892Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:23449093f17670f3eefcd2308ef6488742feb0234893dd0221a76fa32ff17d8c","observation_id":"448e3641-290a-4aed-bac0-0a121380cb90","resolution":{"observed_at":"2026-08-07T12:51:52.109654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:51.806758Z","title":null,"venue":null,"work_id":"a7afbfc4-4a70-4010-b08d-cd994c3a84ee","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:40.994617Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:ebe9a694803853d71d1ff3432df66254974fe190f28f304817ea4b3a28c0475a","observation_id":"a1de50f9-dece-4b48-87c9-e75c40143bff","resolution":{"observed_at":"2026-08-07T12:51:51.887698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:51.608733Z","title":null,"venue":null,"work_id":"d71a99fa-2f89-4ef7-a921-d7c76bae5850","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.063857Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:30a8f1498ca999d4efad3bfb226cc54b445249db58d5da1f3114e43fd3350bad","observation_id":"c1cb6817-2f85-48f3-9991-4447405e33bb","resolution":{"observed_at":"2026-08-07T12:51:51.724283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13176","last_updated":"2025-09-08T12:05:58Z","snapshot_observed_at":"2026-08-13T21:22:52.504881Z","submitted_at":"2025-04-17T17:59:47Z","title":"IMAGGarment: Fine-Grained Garment Generation for Controllable Fashion Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13176","snapshot_observed_at":"2026-08-07T12:51:41.175305Z","title":"Shen , author J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.175305Z"},"links":{"cited_paper":"/paper/2504.13176","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:1554345ea6addd02e97294da637c82ea8074cc8bbf3559561527930b45b70070","observation_id":"c42fa6c2-776f-4a11-9f81-f9ae0f18b413","resolution":{"observed_at":"2026-08-07T12:51:41.175305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:51.414023Z","title":"Dosovitskiy , author L","venue":null,"work_id":"d01e003b-7369-4318-9412-d4ba1a879237","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.272079Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:40d34d2206ea30d2c02089815951b56f2aae5f2e3f0d0c5c8a4adbb2bfeb8c12","observation_id":"ca487f4f-24bb-4e80-a52b-a4bf3c0f196f","resolution":{"observed_at":"2026-08-07T12:51:51.514506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:51.114771Z","title":"Liu , author Y","venue":null,"work_id":"d1d62862-0299-463d-ac29-270297266902","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.384136Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:79785deb84fbc40876e0db164b5acd4d3555590ab22cdcd4f5551261a64a9e2d","observation_id":"98e807a5-7758-4132-a9c3-24b33b974458","resolution":{"observed_at":"2026-08-07T12:51:51.232037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.883003Z","title":"He , author J","venue":null,"work_id":"09b9623d-1c1f-4fec-855b-1241c8714c8a","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.477463Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:03049aac5371c685cd71d0c58914793bede2cd11f4dead90e4deabc6d7c1d1d8","observation_id":"4106d4fd-f164-486e-a65f-937dc8806137","resolution":{"observed_at":"2026-08-07T12:51:50.965667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.721544Z","title":null,"venue":null,"work_id":"8f2cde69-75b9-412d-abfd-4cf9655d24b6","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.571402Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:748c46c478222e71bbdff23af2777a387abd0022513b2f12fcb7a2e24f520245","observation_id":"cdf776c8-9329-4876-a11c-e5dd8845f362","resolution":{"observed_at":"2026-08-07T12:51:50.803101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.561550Z","title":null,"venue":null,"work_id":"c9ac73e9-3eb9-4e8f-81fe-86b7450bfed0","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.747076Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c639df729d234af592afebfd152f25cabf29de80c17953a91d0f8e5a3bb5ae11","observation_id":"fe79565d-e4bf-46a9-a0bc-9d25e81b1594","resolution":{"observed_at":"2026-08-07T12:51:50.612309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.320393Z","title":"Shen , author J","venue":null,"work_id":"65c6aa65-fa74-4ad2-826c-b165cb0fcbff","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.820686Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:aee59418dc98b4c9bf9cdadc4b090d806fda072153bdbc114113bc16d71c3d0e","observation_id":"3c9f8722-9253-4b69-ae7c-86eb97dee8cd","resolution":{"observed_at":"2026-08-07T12:51:50.437141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:50.092218Z","title":null,"venue":null,"work_id":"5cbe3b36-a565-4c2c-9ae1-239a56d4036a","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.890697Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:403f99d230de7c78b0795e7455106c70a794551c3e9284f651e35b1ad808be1e","observation_id":"3ca8e372-8763-4191-93b1-d9f0a9cd2086","resolution":{"observed_at":"2026-08-07T12:51:50.215958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:49.845954Z","title":"Wang , author J","venue":null,"work_id":"0617f918-f005-408d-bad8-4f56c7db944e","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:41.985294Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:44e182cc3ad0829614ee5a3e743ea627aba4f60beb4ab594a3c1956b69a80018","observation_id":"8bd2d9a1-7301-466e-bbb0-abd5f802a213","resolution":{"observed_at":"2026-08-07T12:51:49.958392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:49.642650Z","title":"Jiang , author M","venue":null,"work_id":"7db822d1-cf3f-421e-ae27-303cc7279cee","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.096292Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:52c0b4d882d8b93dfbc58bb40cb2e459bc321c19c8609e337e597ad748d88479","observation_id":"c6605c02-9e5b-406f-85ff-3bd42048b2b1","resolution":{"observed_at":"2026-08-07T12:51:49.745036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:49.419498Z","title":null,"venue":null,"work_id":"2190baea-f64c-4c71-9085-465fa21c2d8e","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.169987Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c8e3c4220266eeb7fcb5be904be4b907ebb87c8e8bb58e595e620ce2db8d3f0a","observation_id":"efc18924-5c7e-4530-a01a-c2f0639fdc3e","resolution":{"observed_at":"2026-08-07T12:51:49.522450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15140","last_updated":"2025-03-30T13:12:34Z","snapshot_observed_at":"2026-08-10T14:32:57.416372Z","submitted_at":"2025-01-25T08:52:43Z","title":"Analyzing and Boosting the Power of Fine-Grained Visual Recognition for Multi-modal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15140","snapshot_observed_at":"2026-08-07T12:51:42.318376Z","title":"He , author G","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.318376Z"},"links":{"cited_paper":"/paper/2501.15140","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:5e1c1e2071db56ce5218781571500c33a3ce211524aacb933e1801e386f76ffd","observation_id":"19fea118-45d9-4fe5-9c13-0b0e861f7fef","resolution":{"observed_at":"2026-08-07T12:51:42.318376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:49.161638Z","title":"Shen , author X","venue":null,"work_id":"86516345-abbc-4039-ba2b-6160e848a9f2","year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.402329Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d202f5e47c2d255090ef2c58ca7865834a77770d8b7e55ae86ff3092edc5e231","observation_id":"df5576b9-98e7-44db-9cb6-28e1d01c911b","resolution":{"observed_at":"2026-08-07T12:51:49.302322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-10T12:41:22.906234Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T12:51:42.530709Z","title":"Shen , author C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.530709Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:60a302ba32b0c7f659ddf065129855d9fa84debee06dc17eb4c3cc1f6ca25138","observation_id":"c5f665c0-e78c-4f46-91ee-eb4b089377e3","resolution":{"observed_at":"2026-08-07T12:51:42.530709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.975393Z","title":"Shen , author H","venue":null,"work_id":"6cae3f2c-d656-4a0e-8615-d7af7a281fd3","year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.625596Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:79f4315475e2530968b4e25860e733c70bcb3f7f89b6345310a27c9fb51f79f4","observation_id":"1e5fdad1-f810-46cf-87bb-3e03005a0f68","resolution":{"observed_at":"2026-08-07T12:51:49.061861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06313","last_updated":"2024-11-21T12:06:59Z","snapshot_observed_at":"2026-08-13T05:53:21.154401Z","submitted_at":"2023-10-10T05:13:17Z","title":"Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06313","snapshot_observed_at":"2026-08-07T12:51:42.702251Z","title":"Shen , author H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.702251Z"},"links":{"cited_paper":"/paper/2310.06313","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:ae7de9bbae1fde059f0c097c95e7eed92a05c6d51ddafff3d3532979a3a112e8","observation_id":"3a4149ff-8cf7-4d1c-9d1f-c12cc95e7970","resolution":{"observed_at":"2026-08-07T12:51:42.702251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.714276Z","title":null,"venue":null,"work_id":"61e69112-e45f-4512-9c28-b8f1b0aa399c","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.820361Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:3f278b78e5f1fcb72ce3254a0644f91d834a8d2849bfb4c15ba3a96f8336859f","observation_id":"59951c63-5b10-49da-bb61-93aaab916198","resolution":{"observed_at":"2026-08-07T12:51:48.832738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.491557Z","title":null,"venue":null,"work_id":"3db5ab1a-074e-4742-8a88-89acb072d1a4","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.913397Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d3cae5a58ef8101bf144cef123b0aeacac50d62bf4456195172bfa96abb22f30","observation_id":"c82361c6-6e8e-46f8-bf1c-b1265b8ab8e4","resolution":{"observed_at":"2026-08-07T12:51:48.587217Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.257738Z","title":"Karaoglu , author R","venue":null,"work_id":"00bdbb2c-8012-44fe-87c4-6dff19f87242","year":2017},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.025872Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:5c30436d68bef86c5c17988d4edb3a7659ae8e21455d479185253d49e4e197a4","observation_id":"395d6eb2-58e6-4156-8e66-f49403b29126","resolution":{"observed_at":"2026-08-07T12:51:48.361725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:48.022161Z","title":"Bai , author M","venue":null,"work_id":"81a08ecc-157b-4309-8b2e-dbbe778a4377","year":2018},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.200716Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:5d8ef354e0c2d0ebe1a429bbac815e016e6447b693b17969f36001b8bf0334ab","observation_id":"43a71217-79f7-485e-94ff-e9eaf93ae837","resolution":{"observed_at":"2026-08-07T12:51:48.138148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:47.808981Z","title":"Howard , author S","venue":null,"work_id":"75197e0f-9049-4224-8b72-ccf4defcbd18","year":2018},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.391835Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:17eae7ad7ce7fc3bd6a2215d789c8a0001024263e8b88e7b994e2f832503f473","observation_id":"cb608dc9-c4e6-4213-9977-44bafd01cf33","resolution":{"observed_at":"2026-08-07T12:51:47.919151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:47.571500Z","title":null,"venue":null,"work_id":"b9bea126-eab2-4f1b-be2c-b9b4bcb48173","year":2016},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.574843Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:1974486714717b1735f1f60eeed933aa7efe0aadc2fa0b91a69c233d28c769a5","observation_id":"a39b8cf6-5577-4072-9e5a-41df8e4978d3","resolution":{"observed_at":"2026-08-07T12:51:47.674127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:47.363396Z","title":"Pi , author W","venue":null,"work_id":"8d45f189-f0f3-4861-8bc2-71874ec3d940","year":2019},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.703366Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c00d7ec5960c7b2d629d521a07444ef8a2846be5cbb148cbfb5cfc5b04fadb4a","observation_id":"bc111156-dbd4-4259-9676-c51f3bc2bb00","resolution":{"observed_at":"2026-08-07T12:51:47.483249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:47.143964Z","title":null,"venue":null,"work_id":"bd1f40ea-0574-43f9-b79f-a4776c178e79","year":2019},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.813455Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:45c4d4dbfdc6fab39dede70c65cba109cfff6410c7a2d825efe6125250c0cf89","observation_id":"2c802312-c4b8-484a-82d1-679db2afa5dc","resolution":{"observed_at":"2026-08-07T12:51:47.237834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.07074","last_updated":"2021-12-14T00:20:55Z","snapshot_observed_at":"2026-08-13T17:15:56.592417Z","submitted_at":"2021-12-14T00:20:55Z","title":"Towards a Unified Foundation Model: Jointly Pre-Training Transformers on Unpaired Images and Text","version":1},"cited_work":{"arxiv_id":"2112.07074","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.07074","snapshot_observed_at":"2026-08-07T12:51:45.160996Z","title":"Towards a Unified Foundation Model: Jointly Pre-Training Transformers on Unpaired Images and Text","venue":"cs.CV","work_id":"f0c70487-bbb2-485d-a0c4-449e2442b2ac","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:43.918255Z"},"links":{"cited_paper":"/paper/2112.07074","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:7b2051830ae4fd6f8e5d34f3131c9f77ccd63694a197d5266e04de582df13185","observation_id":"1f905f67-e07a-4dbd-a8b2-c223ac3f5698","resolution":{"observed_at":"2026-08-07T12:51:45.236897Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:46.924960Z","title":null,"venue":null,"work_id":"4f811ed2-bf7f-48a5-afb0-f90654a766fb","year":2022},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.022961Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:faec20375fdd0218ccfa1cbef9d2c63a10b2b8c3bd8ff5fc6daef9ed91519270","observation_id":"cf5dbd97-3c2e-4c3f-af13-53fa04874b80","resolution":{"observed_at":"2026-08-07T12:51:47.031634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:46.679886Z","title":null,"venue":null,"work_id":"4404449b-df5f-4ac6-b1b9-1cac7129194f","year":2023},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.147214Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:08f291355c3bbdd3647964b788141ad56c23ca81e2489f8a2e3394526e17fa7c","observation_id":"9ebf1166-87bd-4369-9f43-1a730cd1be23","resolution":{"observed_at":"2026-08-07T12:51:46.778455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T12:51:44.253334Z","title":"Wang , author S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.253334Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:c46dc9e4c74c95b4c22d59b3d43150afd08fa7f20485ea96c0cff708ada8be7e","observation_id":"4e0b64b6-7f17-4f89-922d-e94da7d7d355","resolution":{"observed_at":"2026-08-07T12:51:44.253334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:46.442402Z","title":"Zhang , author D","venue":null,"work_id":"04b4a6a9-8b61-4820-964c-d0263fbd76f3","year":2015},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.358554Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:fc3a538d1627afd713eb8b7e7389992855c0fa6c0f95e5f88cb13325abca0fcc","observation_id":"4f0e90e3-6bdc-41d6-99f0-d0689560c67b","resolution":{"observed_at":"2026-08-07T12:51:46.549473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:46.213604Z","title":"Tay , author L","venue":null,"work_id":"3bb950c8-6ac2-441a-8ec7-b3361ff5c844","year":2018},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.452037Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:d5d26e97917df0ff4ab53ff3f8855e6db3460773c3d501626b44321ede945263","observation_id":"52fe89e2-d368-4966-9fe8-4d3c34c878fd","resolution":{"observed_at":"2026-08-07T12:51:46.343060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:45.950183Z","title":null,"venue":null,"work_id":"a0b41635-d2f5-480a-bfa3-b81ad81d54c0","year":2024},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.546004Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:046e989d59969c728d04d37b0ec58246bf90331f9becd391de79d56560603dc3","observation_id":"d3a60ce2-c63c-4a55-a64a-705d48989b7f","resolution":{"observed_at":"2026-08-07T12:51:46.071608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:45.763251Z","title":null,"venue":null,"work_id":"f86271ab-fe7d-451b-aa68-acdacfe802cf","year":2020},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.673326Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:4b39542b2d4981d99acf2125e00e4809cc333cbcf02472a1ac4dfb34203a67a1","observation_id":"0c1642f3-cd1c-4416-b28f-0ccf87153e3d","resolution":{"observed_at":"2026-08-07T12:51:45.831220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:45.544991Z","title":"Brock , author S","venue":null,"work_id":"c7275740-745e-4f3f-af7a-e7382885d9a7","year":2021},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.776891Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:1a87626af1d6cb097360546838b98686f69d07421a5658b61b36080a078881e2","observation_id":"f70fff46-3c0c-40a4-8323-91255c9b317d","resolution":{"observed_at":"2026-08-07T12:51:45.647570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:45.392336Z","title":"Schifanella , author P","venue":null,"work_id":"eb6c454c-f62b-4407-8094-b77c0a52848f","year":2016},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.880759Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:e90548a97221b0bf4f4f17a4ae688150829a464696ca2787c8766c040e498135","observation_id":"08a00fad-adf8-43fd-a88c-23be6983fa3f","resolution":{"observed_at":"2026-08-07T12:51:45.442384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:51:44.999434Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:44.999434Z"},"links":{"citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:b11a3247c4dc96a22092d2638ac00634182b6c36166c5f107c63a206d46f530e","observation_id":"22fd90a4-c300-455a-8f2b-d2951b72cda7","resolution":{"observed_at":"2026-08-07T12:51:44.999434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 1 inbound Pith citation observation for arXiv:2505.23365."}