{"as_of":"2026-08-10T21:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:79444b0b7721e90304b3d16a63878437ba46250a492a9d7fd66fb20cbb738a21","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T18:30:14.608010Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06060/citation-record","integrity":"/paper/2608.06060/integrity","json":"/paper/2608.06060/citation-record.json","paper":"/paper/2608.06060"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23115","last_updated":"2025-06-29T06:41:00Z","snapshot_observed_at":"2026-08-07T01:05:19.522559Z","submitted_at":"2025-06-29T06:41:00Z","title":"MoCa: Modality-aware Continual Pre-training Makes Better Bidirectional Multimodal Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23115","snapshot_observed_at":"2026-08-07T18:30:14.527131Z","title":"Moca: Modality-aware continual pre-training makes better bidirectional multimodal embeddings.arXiv preprint arXiv:2506.23115,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.527131Z"},"links":{"cited_paper":"/paper/2506.23115","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:246fb7dd15e29fd6aa58ab408393bec64f00a098a6cbc0db56102a16cf0b8c83","observation_id":"7f1dddab-eb44-4019-8c3f-db21b1a3070f","resolution":{"observed_at":"2026-08-07T18:30:14.527131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.550576Z","title":"Embed-rl: Reinforcement learning for reasoning-driven multimodal embeddings.arXiv preprint arXiv:2602.13823,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.550576Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:0a584a804181acc33c7c238270a237c8a459726b75db22ce99f1d544834d5e97","observation_id":"742b9810-5892-4143-b4ab-5b95769784c3","resolution":{"observed_at":"2026-08-07T18:30:14.550576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05160","last_updated":"2025-01-02T05:26:47Z","snapshot_observed_at":"2026-07-06T19:29:05.492290Z","submitted_at":"2024-10-07T16:14:05Z","title":"VLM2Vec: Training Vision-Language Models for Massive Multimodal Embedding Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05160","snapshot_observed_at":"2026-08-07T18:30:14.554873Z","title":"Vlm2vec: Training vision-language models for massive multimodal embedding tasks.arXiv preprint arXiv:2410.05160,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.554873Z"},"links":{"cited_paper":"/paper/2410.05160","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:7cd8bd9bb7856e979a73fa68d8af37a2e7927cbf384f0cb7fcccf2ccb000b3e1","observation_id":"40c57ff9-17ae-4ee2-a47f-c7cc6957cb82","resolution":{"observed_at":"2026-08-07T18:30:14.554873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19650","last_updated":"2025-05-27T11:57:17Z","snapshot_observed_at":"2026-08-09T09:30:25.697403Z","submitted_at":"2025-05-26T08:09:44Z","title":"Modality Curation: Building Universal Embeddings for Advanced Multimodal Information Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19650","snapshot_observed_at":"2026-08-07T18:30:14.559722Z","title":"Glint Lab Fanheng Kong, Jingyuan Zhang, Yahui Liu, Hongzhi Zhang, Shi Feng, Xiaocui Yang, Daling Wang, Yu Tian, Fuzheng Zhang, Guorui Zhou, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.559722Z"},"links":{"cited_paper":"/paper/2505.19650","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:77a4e630b7acf67d418125f6e498e41424b8c3f45e4f19b61ae9b0329de6a011","observation_id":"8ba9a618-5492-42cf-be31-7c0106c94e0c","resolution":{"observed_at":"2026-08-07T18:30:14.559722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.564287Z","title":"Ume-r1: Exploring reasoning- driven generative multimodal embeddings.arXiv preprint arXiv:2511.00405,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.564287Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:b2de6dce6746c607a7c24c1e0e97a2c715cd55d192a39b984f78b3dfb05ec63d","observation_id":"2d6f7373-29c3-4b45-b6a1-990da47f48b2","resolution":{"observed_at":"2026-08-07T18:30:14.564287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04590","last_updated":"2025-07-07T00:51:57Z","snapshot_observed_at":"2026-08-08T15:48:31.665148Z","submitted_at":"2025-07-07T00:51:57Z","title":"VLM2Vec-V2: Advancing Multimodal Embedding for Videos, Images, and Visual Documents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.04590","snapshot_observed_at":"2026-08-07T18:30:14.572507Z","title":"Vlm2vec-v2: Advancing multimodal embedding for videos, images, and visual documents.arXiv preprint arXiv:2507.04590,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.572507Z"},"links":{"cited_paper":"/paper/2507.04590","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:912f570d8279f0055b4d745088bdd0aa3668a33e87042f8c0bf1a3dd5233e1e1","observation_id":"ab78b92b-216d-47a3-bc02-d8a657440da9","resolution":{"observed_at":"2026-08-07T18:30:14.572507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00741","last_updated":"2024-10-04T16:10:38Z","snapshot_observed_at":"2026-07-06T19:25:19.661028Z","submitted_at":"2024-10-01T14:33:22Z","title":"VideoCLIP-XL: Advancing Long Description Understanding for Video CLIP Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00741","snapshot_observed_at":"2026-08-07T18:30:14.584902Z","title":"Videoclip-xl: Ad- vancing long description understanding for video clip models.arXiv preprint arXiv:2410.00741, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.584902Z"},"links":{"cited_paper":"/paper/2410.00741","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:ca5b749e63aebf2933bef0fb2e5f94e5391acdc47ee4437f61547a6f883660e5","observation_id":"85f421ea-4091-4a7b-82a6-397c160dea31","resolution":{"observed_at":"2026-08-07T18:30:14.584902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12364","last_updated":"2025-06-22T13:42:54Z","snapshot_observed_at":"2026-08-07T00:49:22.617336Z","submitted_at":"2025-06-14T05:55:00Z","title":"MM-R5: MultiModal Reasoning-Enhanced ReRanker via Reinforcement Learning for Document Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12364","snapshot_observed_at":"2026-08-07T18:30:14.590920Z","title":"Internvideo2: Scaling foundation models for multimodal video understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.590920Z"},"links":{"cited_paper":"/paper/2506.12364","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:bfa85556f551e27e4406e56ab6981bf9f0b8d00d6fafe1b64f0e3d78e2047a97","observation_id":"6135702c-b638-46ac-b88a-cda1b3231667","resolution":{"observed_at":"2026-08-07T18:30:14.590920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T18:30:14.598702Z","title":"Glint Lab An Yang, Anfeng Li, Baosong Yang, Beichen Zhang, Binyuan Hui, Bo Zheng, Bowen Yu, Chang Gao, Chengen Huang, Chenxu Lv, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.598702Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:9365379976b6415eddecaf48822183671e7d6fe7ef7a25263486ce7f629394b9","observation_id":"ad2330b3-fa39-44ba-99bb-fd0df4870258","resolution":{"observed_at":"2026-08-07T18:30:14.598702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16855","last_updated":"2025-04-01T08:48:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-22T04:40:24Z","title":"GME: Improving Universal Multimodal Retrieval by Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16855","snapshot_observed_at":"2026-08-07T18:30:14.603232Z","title":"thinking with images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.603232Z"},"links":{"cited_paper":"/paper/2412.16855","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:0d6e82730a9a739adfd9c8095746694130e19962fee8fff769cd4f0521a40db6","observation_id":"a5ffab50-e40f-431a-a8d9-172804f68d5a","resolution":{"observed_at":"2026-08-07T18:30:14.603232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14475","last_updated":"2024-12-19T02:49:55Z","snapshot_observed_at":"2026-08-06T11:46:20.152196Z","submitted_at":"2024-12-19T02:49:55Z","title":"MegaPairs: Massive Data Synthesis For Universal Multimodal Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14475","snapshot_observed_at":"2026-08-07T18:30:14.608010Z","title":"Megapairs: Massive data synthesis for universal multimodal retrieval.arXiv preprint arXiv:2412.14475,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.608010Z"},"links":{"cited_paper":"/paper/2412.14475","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:b46e3fa76f98046db070b485ecd0a6da603528c417c312818fe1f37b9c15d61d","observation_id":"a7f1fb02-e0e9-475e-aa65-791472167c6d","resolution":{"observed_at":"2026-08-07T18:30:14.608010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T18:30:14.577817Z","title":"Deepseekmath: Pushing the limits of mathemati- cal reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.577817Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:7e799eaef0b2c50a8d36718bf2076bae48760373d09196fa37a2cccb9800cc10","observation_id":"6efd0bf0-e9c2-4c1d-9862-307840b2d3d5","resolution":{"observed_at":"2026-08-07T18:30:14.577817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.545936Z","title":"Rzenembed: Towards comprehensive multimodal retrieval.arXiv preprint arXiv:2510.27350,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.545936Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:e93fd8dfde26b717717e4da42ae27fb22100d87ed57412ea54dfac649431a6ed","observation_id":"422daba4-f477-4d6d-80ae-2107f7d2da6a","resolution":{"observed_at":"2026-08-07T18:30:14.545936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.568558Z","title":"Rematch: Boosting representation through matching for multimodal retrieval.arXiv preprint arXiv:2511.19278, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.568558Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:3435d87e973eb31ddfafd0c2f55acbb1ad54d78e92d3c164528f2843031d9b26","observation_id":"285969cf-af0f-4145-9132-eb5211656639","resolution":{"observed_at":"2026-08-07T18:30:14.568558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.532201Z","title":"Think then embed: Generative context improves multimodal embedding.arXiv preprint arXiv:2510.05014,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.532201Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:7d099c2852344db0ef0408763f269b778e8b9ea090f0097b7c05e15ce7e46fd1","observation_id":"2baeb1c9-e4c8-4cba-a3e4-4d3d9e67e6e8","resolution":{"observed_at":"2026-08-07T18:30:14.532201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01449","last_updated":"2025-02-28T08:51:57Z","snapshot_observed_at":"2026-07-06T18:39:43.472708Z","submitted_at":"2024-06-27T15:45:29Z","title":"ColPali: Efficient Document Retrieval with Vision Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01449","snapshot_observed_at":"2026-08-07T18:30:14.536725Z","title":"Colpali: Efficient document retrieval with vision language models, 2024.URL https://arxiv","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.536725Z"},"links":{"cited_paper":"/paper/2407.01449","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:a865302f5a47d980f20741bf57f97d53d08457cf351b78bb5b481700695b54be","observation_id":"2d898673-6972-4693-bf25-bfa801d33b80","resolution":{"observed_at":"2026-08-07T18:30:14.536725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T18:30:14.541475Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.541475Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:1349d830034acb8fcac4b0013ace099180eba02d9b76cb2a22a8ec2d9c04f570","observation_id":"ea4e211a-a7be-4b94-afdd-2a8fbb05409f","resolution":{"observed_at":"2026-08-07T18:30:14.541475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T17:55:38.447779Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2608.06060."}