{"as_of":"2026-08-18T12:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7fbcfef321480445ae143f9910116bbf632ff5986a367b05bc4098886e6514cd","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:19:42.977063Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02984/citation-record","integrity":"/paper/2507.02984/integrity","json":"/paper/2507.02984/citation-record.json","paper":"/paper/2507.02984"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-17T13:04:04.064087Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-06T21:19:33.852245Z","title":"arXiv preprint arXiv:2310.09478 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:33.852245Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e70d3e22522b88249b8ab9997236e5c7e65525149b752019e7ebda0cbfcb0edc","observation_id":"f416be21-c02a-4b9b-af2c-fcf74533376d","resolution":{"observed_at":"2026-08-06T21:19:33.852245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-08-13T14:42:26.982679Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-06T21:19:33.912791Z","title":"arXiv preprint arXiv:2306.15195 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:33.912791Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:1b2a061ca04f38324b3393f840f9711b8cd41519e67c910e8ce3026202cd6df1","observation_id":"6b577f96-c747-4113-88ce-7e575130aeed","resolution":{"observed_at":"2026-08-06T21:19:33.912791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-08-12T12:24:23.815073Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-06T21:19:34.013688Z","title":"arXiv preprint arXiv:2306.14824 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.013688Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:955e2ae9a039e39866716a57a90d1a1c66be5a448354df8b59beed2c19e7dc29","observation_id":"13ec6268-f581-4eb7-a91e-dd40699eb75b","resolution":{"observed_at":"2026-08-06T21:19:34.013688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16500","last_updated":"2024-08-29T12:59:12Z","snapshot_observed_at":"2026-08-18T00:01:15.410179Z","submitted_at":"2024-08-29T12:59:12Z","title":"CogVLM2: Visual Language Models for Image and Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16500","snapshot_observed_at":"2026-08-06T21:19:34.077710Z","title":"arXiv preprint arXiv:2408.16500 (2024) 14","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.077710Z"},"links":{"cited_paper":"/paper/2408.16500","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:88c9a23ce7c463bc08ca0b7965151320631a265be46219d3af3624c33bf59223","observation_id":"fe18d58a-759a-4aeb-a4ab-e676cca4ece0","resolution":{"observed_at":"2026-08-06T21:19:34.077710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.177966Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.177966Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:04aa12797f17fb7243f338a684cb520cdbc5af5f7d60da05ba941b4592c94869","observation_id":"9f277b7f-a5e5-4af2-999b-fbd7e98ae66f","resolution":{"observed_at":"2026-08-06T21:19:34.177966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.243662Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.243662Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3c247ab7119cbcb64615fab3deef5c338710a103031ddcd9d029e3f4e6327b75","observation_id":"1f93425b-bfc9-47e1-a7d1-4d58c7ce2b8d","resolution":{"observed_at":"2026-08-06T21:19:34.243662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.353123Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.353123Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f8b077a986a3851b63958d04c2aba70b1781dcd67fd9d19a8bc1f330a9a527e3","observation_id":"9a18fa4d-9cd2-47c2-b3ad-e2f59471e96d","resolution":{"observed_at":"2026-08-06T21:19:34.353123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-08-13T14:59:44.917623Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07575","snapshot_observed_at":"2026-08-06T21:19:34.422630Z","title":"arXiv:2311.07575 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.422630Z"},"links":{"cited_paper":"/paper/2311.07575","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:261432fac38c3e415dd732c7383b1c6519c86064cc054485521fc090f71bfb7c","observation_id":"927fd270-58f6-46c2-ade2-ded5b8f8ed54","resolution":{"observed_at":"2026-08-06T21:19:34.422630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-08-17T14:16:52.244007Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-06T21:19:34.505690Z","title":"arXiv preprint arXiv:2404.16821 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.505690Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:d80a63ecaba6213d04478465fe1d138bc72ffe5fbec36712531e4af649357c93","observation_id":"3d524dfb-0e36-4805-ba3e-b1bbf50ed920","resolution":{"observed_at":"2026-08-06T21:19:34.505690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-11T01:38:59.827005Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-06T21:19:34.629464Z","title":"arXiv preprint arXiv:2403.05525 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.629464Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e1e919d788a8d1a45c263040bc6635a6bb85ad8a16e48c89ee74ca04199380c0","observation_id":"6c9756ba-a469-4149-b741-3c25008706bd","resolution":{"observed_at":"2026-08-06T21:19:34.629464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-08-17T20:16:19.173618Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-06T21:19:34.703051Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.703051Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:c861319646ceca47902cb0e0b82485225cd52731a22c58a802c034c3e92def39","observation_id":"e3ec2494-dc05-4060-ae76-a6cb5f1f5a56","resolution":{"observed_at":"2026-08-06T21:19:34.703051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.772600Z","title":"https://llava-vl.github","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.772600Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6408ad9c5428428db8d708e413ca67b3b21ad0b176a543a6a4ddb35b628b19a2","observation_id":"cc9022a1-7334-4aff-8f1d-9af90499af99","resolution":{"observed_at":"2026-08-06T21:19:34.772600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-06T21:19:34.859505Z","title":"arXiv preprint arXiv:2408.01800 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.859505Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:d6cc0ad225dd1ffe88d73ba9c1469476684016d3b60cb584af1593f17cc96d63","observation_id":"055f57a2-4f6f-4f21-b0e6-8ab138540039","resolution":{"observed_at":"2026-08-06T21:19:34.859505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T21:19:34.937712Z","title":"arXiv preprint arXiv:2409.12191 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:34.937712Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:b224f13be7badccdbc8a641865dc557465ef9a5decc6ceeab1493bcfb22fc203","observation_id":"2422e848-f067-473f-bb2f-4a07fd237b05","resolution":{"observed_at":"2026-08-06T21:19:34.937712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07397","last_updated":"2024-02-23T07:54:11Z","snapshot_observed_at":"2026-08-14T15:48:28.214119Z","submitted_at":"2023-11-13T15:25:42Z","title":"AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07397","snapshot_observed_at":"2026-08-06T21:19:35.022823Z","title":"arXiv preprint arXiv:2311.07397 (2023) 15","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.022823Z"},"links":{"cited_paper":"/paper/2311.07397","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:18b61cc1bcfcf64973cf6329203102ae5c8d5d4253381fe2ede076961e61f4d9","observation_id":"4708ab48-5e6b-485b-9155-412f188f8d23","resolution":{"observed_at":"2026-08-06T21:19:35.022823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.110223Z","title":"NeurIPS (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.110223Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:29f220dc938c1968f664923dcb0fb597185f406fe7e39ec4f8e7df2295de40b6","observation_id":"7900ed98-6e53-4bac-8741-2e33725432fe","resolution":{"observed_at":"2026-08-06T21:19:35.110223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-06T21:19:35.203253Z","title":"arXiv:2306.13394 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.203253Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:edc5611d5b001bf978c14bf66778ad892903f32ec91aeabc2070d64d61142af1","observation_id":"b2ad41e5-2682-428e-b7ab-be0596cb1577","resolution":{"observed_at":"2026-08-06T21:19:35.203253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.260301Z","title":"In: Proceedings of the IEEE International Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.260301Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:7df51494734d6427aaad332c04e8cc55897dfa3d43669d366a59444ced60e1a0","observation_id":"e4225a55-a0a2-487c-9e2e-1be11a7eea43","resolution":{"observed_at":"2026-08-06T21:19:35.260301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.355158Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.355158Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e60f324a623f6e211ec78650d026f1a4073c5254e405dc012d3051bd2b5d9ab6","observation_id":"26b4a820-0ff1-4e90-b6c6-3dfd42f199ec","resolution":{"observed_at":"2026-08-06T21:19:35.355158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-18T03:16:44.825874Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-06T21:19:35.419588Z","title":"arXiv preprint arXiv:2308.02490 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.419588Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:ece502a5c92e9f2bbac6caaa186da00dbf4082d3e5717acc4efda483a4735699","observation_id":"04819b31-00e6-4373-a1cb-084c8649815d","resolution":{"observed_at":"2026-08-06T21:19:35.419588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.492421Z","title":"In: International Conference on Learning Representations (ICLR) (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.492421Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:9f228b2dabd77bba95e3713af8bf87aba05cbafe7286cf34dc849b2115fb3cd2","observation_id":"89997c7a-e103-4a9d-ad83-bba8518244d1","resolution":{"observed_at":"2026-08-06T21:19:35.492421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.556816Z","title":"ACL (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.556816Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e27d546735d5c2a23f79e47ff72443bdb701dcad22053a0c0eca7bdfca77e2a7","observation_id":"284e0a8b-399e-456d-b674-0fcf5fb39f21","resolution":{"observed_at":"2026-08-06T21:19:35.556816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.650695Z","title":"NeurIPS (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.650695Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:d9c4985acbcf4851da2ed5261fcb710c704b298501f7f7ab39466d427a2dce65","observation_id":"f07419c3-9f53-422c-82e6-d0314e8f14f2","resolution":{"observed_at":"2026-08-06T21:19:35.650695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-08-11T00:52:12.225793Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-06T21:19:35.695869Z","title":"arXiv preprint arXiv:2302.00923 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.695869Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:ed32aa2b65972b9f1d65ec4896ee7069978c3f8abccceadea34a93bfc3ed8117","observation_id":"d64192ec-5a48-479b-98c3-4c1ae57b6b90","resolution":{"observed_at":"2026-08-06T21:19:35.695869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.779999Z","title":"NeurIPS (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.779999Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:57d0511cbdb97214d1fc7e2378d9cfb5f2423eac8ce25a410b927a3220e045f4","observation_id":"5dd3c81e-b9b3-49bf-8400-c58b711e5f56","resolution":{"observed_at":"2026-08-06T21:19:35.779999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.846251Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence, vol","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.846251Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3c65fcb15733808d4a75c92c09d7131480a78a746a571f1aa4b6ae9497c0389a","observation_id":"089aa579-19a6-41ed-875b-9525f7e724b3","resolution":{"observed_at":"2026-08-06T21:19:35.846251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.912123Z","title":"ACM MM (2024) 16","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.912123Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:cfffe4e68e2a9f4d149142d48eb0acf57d347939d556ecfa4e24a234e53d43f2","observation_id":"9fe9cbd2-4458-4d38-98ff-8964cf14f0fc","resolution":{"observed_at":"2026-08-06T21:19:35.912123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.992476Z","title":"In: CVPR (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:35.992476Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3b548f9378e8dcf9fb9cf09c70ab59b69558ff62d28c920155a9b5e56693b908","observation_id":"207edfa8-d3a2-4a54-a274-d4ba0697749a","resolution":{"observed_at":"2026-08-06T21:19:35.992476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09193","last_updated":"2023-11-15T18:39:21Z","snapshot_observed_at":"2026-08-16T14:42:58.434518Z","submitted_at":"2023-11-15T18:39:21Z","title":"The Role of Chain-of-Thought in Complex Vision-Language Reasoning Task","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09193","snapshot_observed_at":"2026-08-06T21:19:36.092686Z","title":"arXiv preprint arXiv:2311.09193 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.092686Z"},"links":{"cited_paper":"/paper/2311.09193","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:2b719d300280188862c7773ff2ca8bd29547fea36facdba9b7149898c20f6079","observation_id":"518bea90-bf82-478e-9b14-1bafb206c194","resolution":{"observed_at":"2026-08-06T21:19:36.092686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19716","last_updated":"2024-11-24T03:47:38Z","snapshot_observed_at":"2026-08-18T05:23:45.464155Z","submitted_at":"2024-05-30T05:53:49Z","title":"Enhancing Large Vision Language Models with Self-Training on Image Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19716","snapshot_observed_at":"2026-08-06T21:19:36.169281Z","title":"arXiv preprint arXiv:2405.19716 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.169281Z"},"links":{"cited_paper":"/paper/2405.19716","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4416e43172cdb8f9cd5125c1b9452e5a6b2913a3948e35338a0af971a6acc9e7","observation_id":"5b546750-8f74-4020-b4b0-484e32544102","resolution":{"observed_at":"2026-08-06T21:19:36.169281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11280","last_updated":"2025-01-08T03:18:23Z","snapshot_observed_at":"2026-08-16T13:42:24.952749Z","submitted_at":"2024-06-17T07:33:30Z","title":"ISR-DPO: Aligning Large Multimodal Models for Videos by Iterative Self-Retrospective DPO","version":2},"cited_work":{"arxiv_id":"2406.11280","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.11280","snapshot_observed_at":"2026-08-06T21:19:43.326409Z","title":"ISR-DPO: Aligning Large Multimodal Models for Videos by Iterative Self-Retrospective DPO","venue":"cs.CV","work_id":"60ff8cbe-089a-4dc1-8665-d4ff0bfb410e","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.242869Z"},"links":{"cited_paper":"/paper/2406.11280","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4e42635a408cc6a83003276c6a52070534a067bfd3b3bdb33a74b4220b840e67","observation_id":"dcc6de35-d0ab-40e1-9116-b0127168f179","resolution":{"observed_at":"2026-08-06T21:19:43.391954Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15973","last_updated":"2025-02-08T21:50:41Z","snapshot_observed_at":"2026-08-16T13:49:35.405713Z","submitted_at":"2024-05-24T23:09:27Z","title":"Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15973","snapshot_observed_at":"2026-08-06T21:19:36.307866Z","title":"arXiv preprint arXiv:2405.15973 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.307866Z"},"links":{"cited_paper":"/paper/2405.15973","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:5de9e09b2f0df514d9f1122cc5222dcdfc3adeba61b16ca96a0f8eb49d53c87e","observation_id":"898c1883-d398-4829-a80a-277d07070c79","resolution":{"observed_at":"2026-08-06T21:19:36.307866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15650","last_updated":"2024-12-20T08:06:00Z","snapshot_observed_at":"2026-08-14T00:54:00.785640Z","submitted_at":"2024-12-20T08:06:00Z","title":"Beyond Human Data: Aligning Multimodal Large Language Models by Iterative Self-Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15650","snapshot_observed_at":"2026-08-06T21:19:36.373666Z","title":"arXiv preprint arXiv:2412.15650 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.373666Z"},"links":{"cited_paper":"/paper/2412.15650","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:d036b47e21531abec68af5144ce4ecec11bc00a29961535e0faae17f012ce11f","observation_id":"f00da12f-f109-47a1-9460-1bdec9af2d54","resolution":{"observed_at":"2026-08-06T21:19:36.373666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.451178Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.451178Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:8a2dff2aa87f3fe134d2eae9cdd3b42fcf7694b8062809d4e5f8af11a41614b5","observation_id":"c9fb9dea-dadb-44bc-9070-4029abaf468e","resolution":{"observed_at":"2026-08-06T21:19:36.451178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.528716Z","title":"In: Computer Vision–ECCV 2016: 14th European Conference, Amsterdam, The Netherlands, October 11–14, 2016, Proceedings, Part IV 14, pp","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.528716Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3e3f707d32e2dcf84ed8f263f58515572195e67304bb01211d97c13c1576a387","observation_id":"56362f2f-5a59-4b3c-83fc-daa77b6a2a8b","resolution":{"observed_at":"2026-08-06T21:19:36.528716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.608901Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.608901Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:998e54658c6b3ed955afa4bd69af68b26f47a8e379781dcb03ed14274cd4a75e","observation_id":"18401eb3-51b1-4d45-bc32-17a14552b1ca","resolution":{"observed_at":"2026-08-06T21:19:36.608901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T21:19:36.653815Z","title":"arXiv preprint arXiv:2103.03874 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.653815Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:76358642a7398815d2838aeb6eecbe169c43f8ba57b4fc820a796f2b3b081144","observation_id":"e0aec378-e836-4353-a392-163c639c9984","resolution":{"observed_at":"2026-08-06T21:19:36.653815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.720980Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.720980Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:7f6d496bd18a488b723139ae1c40dee733aeabe01de2e04e8f179cc04521cc51","observation_id":"b1d80a42-65fc-418e-a042-88622768a4dd","resolution":{"observed_at":"2026-08-06T21:19:36.720980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02582","last_updated":"2024-01-05T00:26:07Z","snapshot_observed_at":"2026-08-16T14:29:43.688786Z","submitted_at":"2024-01-05T00:26:07Z","title":"CoCoT: Contrastive Chain-of-Thought Prompting for Large Multimodal Models with Multiple Image Inputs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02582","snapshot_observed_at":"2026-08-06T21:19:36.765868Z","title":"arXiv preprint arXiv:2401.02582 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.765868Z"},"links":{"cited_paper":"/paper/2401.02582","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:88650d91d5eb10b6f71ed4d288246dc613d422ca398b7a5bd5245ddecda2e469","observation_id":"90347a6c-eb5a-4ac5-9b91-3134c0d0cba6","resolution":{"observed_at":"2026-08-06T21:19:36.765868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16999","last_updated":"2024-11-04T05:50:56Z","snapshot_observed_at":"2026-08-16T14:06:34.438455Z","submitted_at":"2024-03-25T17:59:23Z","title":"Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16999","snapshot_observed_at":"2026-08-06T21:19:36.818352Z","title":"arXiv preprint arXiv:2403.16999 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.818352Z"},"links":{"cited_paper":"/paper/2403.16999","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:84c5194c105c8e83596c716227654df436f71f6a16e6ec14717601c4ec6cdcae","observation_id":"ce0619b4-d8bf-4350-9aa7-441eacbc1a92","resolution":{"observed_at":"2026-08-06T21:19:36.818352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.276048Z","title":"Journal of machine learning research 21(140), 1–67 (2020)","venue":null,"work_id":"5126cdf0-b4ee-4f54-8170-b8bc1326f013","year":2020},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.869481Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:a0d4e732d96fcb4df85e11457e4c26b58c3b494d87137842ed509a1d875155ff","observation_id":"488629da-b6f5-4919-b848-b543690d8c37","resolution":{"observed_at":"2026-08-06T21:19:45.279871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.264472Z","title":": Training language models to follow instructions with human feedback","venue":null,"work_id":"51ab8689-ba39-4344-9ba4-2fe2209882cb","year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.945519Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:5bc3e99ea7d350e3391af49aedecfa1e3808e69d5c24ab2b7f0c761f67f2a44d","observation_id":"a9ac94fc-c90b-4f57-b292-963270d15c1e","resolution":{"observed_at":"2026-08-06T21:19:45.268677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-08-13T00:09:23.835117Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-06T21:19:36.992645Z","title":"arXiv preprint arXiv:2407.07895 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:36.992645Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:003148807949ba6fa46e4efbff8cfcb5e48f5c5a50345cbcb469c3534d8d64b6","observation_id":"8ad19dd6-f942-4ace-90d9-dab0c91f6bc5","resolution":{"observed_at":"2026-08-06T21:19:36.992645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.253511Z","title":"In: Proceedings of the 37th International Conference on Neural Information Processing Systems (2024)","venue":null,"work_id":"22e4bb04-8868-4013-963d-e2e66b517de0","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.046109Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:8eac604550706340f86509dfc10ed7920f87aa8d05f1c94049a3c44b39591fc0","observation_id":"009094eb-d556-4465-a87d-d4e5bc3d9846","resolution":{"observed_at":"2026-08-06T21:19:45.257314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.242173Z","title":"https://openai.com/research/ gpt-4v-system-card","venue":null,"work_id":"c080aaae-6600-49fc-9df7-76f08400ab5c","year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.124103Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6cb4b21a7b806584ed807dd3af9430a0fa18a304624b4d83167a90de897ef9b2","observation_id":"a56f1546-e8ca-4dee-91e8-64d5b58d6023","resolution":{"observed_at":"2026-08-06T21:19:45.245815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04792","last_updated":"2024-02-29T20:59:17Z","snapshot_observed_at":"2026-08-16T14:20:38.839188Z","submitted_at":"2024-02-07T12:31:13Z","title":"Direct Language Model Alignment from Online AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04792","snapshot_observed_at":"2026-08-06T21:19:37.182865Z","title":"arXiv preprint arXiv:2402.04792 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.182865Z"},"links":{"cited_paper":"/paper/2402.04792","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e3c9a5a13381e9e4578c84ebc7e856fd3f8ec1640e6c1f9c4a116be9be798bb0","observation_id":"1f54acb1-611e-49c7-ba95-7ebfe0a7f823","resolution":{"observed_at":"2026-08-06T21:19:37.182865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-15T01:20:08.134494Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-06T21:19:37.231697Z","title":"arXiv preprint arXiv:2401.10020 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.231697Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:aeb92d5fd15cabef5e8b532da358b1af9bda04d64d11812320ed64b312ca3beb","observation_id":"7c78759c-5123-4548-b72a-5f8e56dc45c4","resolution":{"observed_at":"2026-08-06T21:19:37.231697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08635","last_updated":"2024-03-13T15:47:26Z","snapshot_observed_at":"2026-08-16T14:10:08.531391Z","submitted_at":"2024-03-13T15:47:26Z","title":"Human Alignment of Large Language Models through Online Preference Optimisation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08635","snapshot_observed_at":"2026-08-06T21:19:37.284453Z","title":"arXiv preprint arXiv:2403.08635 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.284453Z"},"links":{"cited_paper":"/paper/2403.08635","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3681159341312b8525c398328c88acc1e67f67f6e1f5f6a3482e17f39e13cbdf","observation_id":"15b86385-82d0-4368-b077-1c142b2587e1","resolution":{"observed_at":"2026-08-06T21:19:37.284453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-15T18:13:42.319653Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-06T21:19:37.331130Z","title":"arXiv preprint arXiv:2405.07863 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.331130Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:455184591a2e42e741071553615a3931f2188463303067e3624ba7115f0bdf78","observation_id":"67e203a4-c003-42bd-a4d7-b46b6906879b","resolution":{"observed_at":"2026-08-06T21:19:37.331130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-08-15T08:59:30.302596Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-06T21:19:37.398160Z","title":"arXiv preprint arXiv:2401.01335 18 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.398160Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6f48673b7c40c6415753332f8b2e044fec866bf05026dee150559277e52057aa","observation_id":"884b4a97-d57d-43a0-98d2-87d6e9ac026f","resolution":{"observed_at":"2026-08-06T21:19:37.398160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.230225Z","title":"Advances in Neural Information Processing Systems 35, 15476–15488 (2022)","venue":null,"work_id":"1b8e63d3-6a17-4240-9154-aaf65f6988c7","year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.456187Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e9ea73181af2d11e3402ca65b02ab2dbd995a015d13a6f30bc613a36c3138648","observation_id":"07f27bc1-2ecd-417a-b148-5556b19f72db","resolution":{"observed_at":"2026-08-06T21:19:45.234825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19733","last_updated":"2024-06-26T01:28:35Z","snapshot_observed_at":"2026-08-16T13:56:31.553308Z","submitted_at":"2024-04-30T17:28:05Z","title":"Iterative Reasoning Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19733","snapshot_observed_at":"2026-08-06T21:19:37.514013Z","title":"arXiv preprint arXiv:2404.19733 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.514013Z"},"links":{"cited_paper":"/paper/2404.19733","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e44bb2ffbac4006f4f10104eafa92b7cc076df612d393f8b051974ba8b3b1502","observation_id":"d2bfe77f-6232-485e-94f8-8b69dbbaa289","resolution":{"observed_at":"2026-08-06T21:19:37.514013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.569087Z","title":"arXiv preprint arXiv:2405.17220 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.569087Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:83e92bfdeeab1b254b3a2482682a92a81fcc7129c4c19ebfe374db98392bd937","observation_id":"1160b51d-4ce0-42a1-a8d0-d48d17eccc78","resolution":{"observed_at":"2026-08-06T21:19:37.569087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14622","last_updated":"2024-11-02T02:51:51Z","snapshot_observed_at":"2026-08-16T13:50:10.927560Z","submitted_at":"2024-05-23T14:30:33Z","title":"Calibrated Self-Rewarding Vision Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14622","snapshot_observed_at":"2026-08-06T21:19:37.631397Z","title":"arXiv preprint arXiv:2405.14622 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.631397Z"},"links":{"cited_paper":"/paper/2405.14622","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:bb08233ec2bdc2775b65ae8e23764aa3347129cf6e987b294a46dc4ed5f98ce6","observation_id":"064b4759-aea7-4fb9-ab43-37bc3456dccd","resolution":{"observed_at":"2026-08-06T21:19:37.631397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.219236Z","title":"ACM MM (2024)","venue":null,"work_id":"0212aa2d-59bb-4e41-82ea-de01e7f543ea","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.684578Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:966a87eec44ac01498f03337ea5fe92a4df4378b9bfadff1a11134ac125508e8","observation_id":"38fbfaff-8ca6-4452-b784-652d4f837eca","resolution":{"observed_at":"2026-08-06T21:19:45.222385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17294","last_updated":"2024-10-08T06:58:27Z","snapshot_observed_at":"2026-08-16T13:39:53.511689Z","submitted_at":"2024-06-25T05:43:21Z","title":"Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17294","snapshot_observed_at":"2026-08-06T21:19:37.737245Z","title":"arXiv preprint arXiv:2406.17294 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.737245Z"},"links":{"cited_paper":"/paper/2406.17294","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:8672b82a1c52af02d634551829eefc3b226bd9d9ea727cb134dd1abc58123a2d","observation_id":"7c2861a9-00e8-44db-8dbe-f02ff5886416","resolution":{"observed_at":"2026-08-06T21:19:37.737245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.208311Z","title":"In: Findings of the Association for Computational Linguistics: ACL 2022, pp","venue":null,"work_id":"84f0ea08-1553-43e2-b732-99c01f372dae","year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.787387Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:63853652aff1bf8469db7f8e346512c68835734c5e85127fb123ddff0cd05e2c","observation_id":"df92a167-3d00-4554-abbe-a401f8be36b3","resolution":{"observed_at":"2026-08-06T21:19:45.212095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.196028Z","title":null,"venue":null,"work_id":"1564a5d9-bc84-4f6c-b883-216f25f3c156","year":2021},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.847899Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:273c8ac6dddfd5023491bdfc28e5a8c815d9a568f92b24746c7b6f0cd1bd829b","observation_id":"a6837e4b-3184-4146-8a75-ec98fa7cac91","resolution":{"observed_at":"2026-08-06T21:19:45.200325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.183832Z","title":"NeurIPS (2022)","venue":null,"work_id":"288f5928-2b68-46d9-a6a9-3bd122ed204d","year":2022},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.904281Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:500dfadce6392aa94466afb30286f2ccf393c3aa5fc4025437e29947464d77fc","observation_id":"76c29561-5953-47e2-9bd0-8e5a3f1e83af","resolution":{"observed_at":"2026-08-06T21:19:45.187971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.978169Z","title":"Advances in neural information processing systems 33, 6840–6851 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:37.978169Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:4f234f550f2858f2bc8a5bafb653bab3ee645eacc31337268c3fbe2710d5fcd0","observation_id":"506ad1ae-9ee1-4c99-bd5d-de37afc5029a","resolution":{"observed_at":"2026-08-06T21:19:37.978169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.165906Z","title":"In: Findings of the Association for Computational Linguistics: EMNLP 2024, pp","venue":null,"work_id":"e0e715b5-095f-486f-a1a9-0c7a2f6b6423","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.078828Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:896579c0d8a402c6ac215271ce7067f1650112e5f721a5cabdd3e33309f00f42","observation_id":"902e720f-9e47-4ccb-9474-628f406e1f2c","resolution":{"observed_at":"2026-08-06T21:19:45.169529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.154130Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern 19 Recognition, pp","venue":null,"work_id":"1ab71aab-2d7e-40a3-9f05-7669fc796be1","year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.187584Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:275b11d2c2ee29ca66dd3fd4bd34334493e0b148fdec6e36faf08513c811e235","observation_id":"b62d63ba-ff73-417d-8a51-463c0431f0e5","resolution":{"observed_at":"2026-08-06T21:19:45.159105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T21:19:38.241871Z","title":"CoRR abs/2308.12966 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.241871Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:51210492746d2c6046d77e2fcbd39c50a0bd05135944a94967b23b29b02ce834","observation_id":"b747dfa7-a7fa-4294-97d0-637d11820d2a","resolution":{"observed_at":"2026-08-06T21:19:38.241871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T21:19:38.244912Z","title":"arXiv preprint arXiv:2312.11805 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.244912Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:98f2f8ba2735fe118795931def30d28690fa4b606998c3646b53eb3e2e2074ce","observation_id":"363b3e55-d3a6-48f2-a8fb-aa67c8c7ff9f","resolution":{"observed_at":"2026-08-06T21:19:38.244912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19443","last_updated":"2025-01-22T08:25:25Z","snapshot_observed_at":"2026-08-16T14:05:30.804626Z","submitted_at":"2024-03-28T14:15:10Z","title":"Mixed Preference Optimization: Reinforcement Learning with Data Selection and Better Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19443","snapshot_observed_at":"2026-08-06T21:19:38.248448Z","title":"arXiv preprint arXiv:2403.19443 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.248448Z"},"links":{"cited_paper":"/paper/2403.19443","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f11715efe92e676a155df0eed7325324b7a5bc778281ed1aaf1c9a0c88f04478","observation_id":"e61e0aa2-a79c-49ca-a8a6-0e3d3924ef27","resolution":{"observed_at":"2026-08-06T21:19:38.248448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T21:19:38.285085Z","title":"arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.285085Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:02999557736eccc2dd1272a0a74130b75311e218725945aa98a0f39d71fbdee1","observation_id":"27597d7a-d8a5-40f7-a23d-2c0e71ada57e","resolution":{"observed_at":"2026-08-06T21:19:38.285085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T21:19:38.412010Z","title":"generate-train","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.412010Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:40fdffdbedd565cb39d22c11683c05ad49c7fdc88194430619a1359c00875119","observation_id":"d137d441-3785-40b9-8f92-a61768b12a98","resolution":{"observed_at":"2026-08-06T21:19:38.412010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.142624Z","title":"Sub-answers:","venue":null,"work_id":"b65020a5-fda3-4e1f-b634-28351c787d69","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.524221Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:e097d6e51991e360950e276f8de8d2d4eb3c85bb24bf5e94a96a143e6b5be5b6","observation_id":"b7f589be-bd18-4eec-babf-f731bf6cb5c3","resolution":{"observed_at":"2026-08-06T21:19:45.146448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.130766Z","title":null,"venue":null,"work_id":"21f90ca8-7363-4984-9c77-a482235969f9","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.640246Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:304c9c281a17d339f93a07dd2836026db0560222e42fb3a7f316e05fc2b8deff","observation_id":"30d283c8-525d-4455-9304-d74c5c41f5a0","resolution":{"observed_at":"2026-08-06T21:19:45.134735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.119230Z","title":"Uncertain","venue":null,"work_id":"d126e7fb-34e5-4f61-b16d-32cc27357150","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.712756Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:072d8c47bc9fd1d40dad66f42b624eb27397f47559c498f42ed9cba3a5253b8b","observation_id":"e81b333b-9878-4b08-9774-621548c8a829","resolution":{"observed_at":"2026-08-06T21:19:45.123412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.107961Z","title":null,"venue":null,"work_id":"dfff6b02-56f4-467e-871e-ddd6eb81a3b5","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.821657Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:89acff1c1763d38ae46838f45f06dc9e68774f2137583845f39229778ba8edf0","observation_id":"ff08c9b2-35bd-46ab-aee7-14311f515173","resolution":{"observed_at":"2026-08-06T21:19:45.111855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.097568Z","title":null,"venue":null,"work_id":"e3c535bc-37d0-481d-8236-4197c8342601","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:38.986073Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:b9347026ab9e20553fce8b3f8907c14a842a0d7a01b3b8037a0b7cc3350c4980","observation_id":"28c47846-b7a7-4869-bd4c-9f3c93f91451","resolution":{"observed_at":"2026-08-06T21:19:45.101612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.086271Z","title":"The formula for the circumference C of a circle is given by: C = 2πr, where r is the radius of the circle","venue":null,"work_id":"d5d89391-77ed-4e69-8a7a-cca744b690b2","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.149496Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:de0cfc3627abfc71453a46f0b27398c1cde2106ce175b051a0edb6bdde232418","observation_id":"0934a1a5-231d-4d5a-84a4-3258eaca149e","resolution":{"observed_at":"2026-08-06T21:19:45.090837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.074071Z","title":"- Each side of the square is equal to the height of the rectangle, which is given as 32 units","venue":null,"work_id":"2b257e45-b8aa-47ba-b9d0-433e1da20d08","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.353941Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:362fea8b858f428a419f93bf97c376047f297433f6cf4282f8be567eb794b74c","observation_id":"21841584-672d-4710-bfc0-f5a8b1dbf116","resolution":{"observed_at":"2026-08-06T21:19:45.078402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.061648Z","title":"- The diagonal of a square with side length s is given by s\\sqrt{2}","venue":null,"work_id":"df4d260b-603e-4854-bc5f-3d8c220ed59b","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.555704Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:2a89671d4da6c7b6f7b03fc3a23db79ecdd0ab3f4416afe0f3f025a8d0c9d36e","observation_id":"fe9dc88b-a511-49e8-b5a3-7bb538349296","resolution":{"observed_at":"2026-08-06T21:19:45.066148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.051943Z","title":"objects\": [ {","venue":null,"work_id":"74d3faa9-9b4b-4617-b096-c23b084bca6a","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.697546Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:cc70e1bab0e7565697fcfa8266828466723b7dc363f540c925cccc86878928f3","observation_id":"75072758-ec69-4e69-ae37-13309c87ea6b","resolution":{"observed_at":"2026-08-06T21:19:45.055324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.042205Z","title":null,"venue":null,"work_id":"ca1d07a0-03c7-4d61-9757-3353a01e0d83","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:39.904367Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:a48afe3c5cba64e05b7472f7941379b4df15abd73051c72b584bfb6635d065a5","observation_id":"ce7acc8a-7b65-4e0e-a640-cca607d7fb03","resolution":{"observed_at":"2026-08-06T21:19:45.045568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.032407Z","title":"objects\": [ {","venue":null,"work_id":"e825adf1-045f-42db-93eb-a1429111ee2d","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.066958Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6d42552f8ba5775f2f1d26ac2c1e27ce05931ec2a01eb1cc23ee55a187a1ce7c","observation_id":"7b657692-e593-4303-be7e-ab141c48ca68","resolution":{"observed_at":"2026-08-06T21:19:45.036316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.021884Z","title":null,"venue":null,"work_id":"e1ae715c-b847-4bfa-bcad-050e557844ee","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.197225Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:7f25ffe82f5f3bc877ef9de8fdf0a0a8e4df8f24788ca79f8efddd2f6b646ce7","observation_id":"ee271c14-4e87-4c91-bd70-311482409aea","resolution":{"observed_at":"2026-08-06T21:19:45.026104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.012697Z","title":null,"venue":null,"work_id":"80c793f1-3c21-44db-a19a-28b1e8436e4a","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.353407Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:9cac24ae895cee397079540fcdbc32de8f739c07910c4a225e6df9baa03add3f","observation_id":"f88a98fc-b701-4a4d-bfd9-f731d866947b","resolution":{"observed_at":"2026-08-06T21:19:45.016416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:45.003436Z","title":null,"venue":null,"work_id":"41c3f8ed-a8ea-4d54-9e05-8b260db04c04","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.505961Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6438878de5382436927c703edc16392d29badbdbeb20f31aaae39b39897d5456","observation_id":"1883a4f1-7c59-4490-bf2f-b2cf1a354f1c","resolution":{"observed_at":"2026-08-06T21:19:45.007140Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.994502Z","title":null,"venue":null,"work_id":"b58efc1c-55c5-42b0-aa2d-bb85c3b5f7d5","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.674246Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:6816061abdc0f5425f4b664c5ad264017e4b71b74883632d8369fc4a17f82cfb","observation_id":"2ad79d24-12a9-441e-91b7-affaaf63f698","resolution":{"observed_at":"2026-08-06T21:19:44.997450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.986204Z","title":null,"venue":null,"work_id":"ee93b5e1-e425-4129-aa3c-7e283ff4cbbc","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:40.913540Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:cd3202245c64e5d5da61a700f90594fc1088cd400482098788f11f2e60122d3c","observation_id":"d0b55959-a5ab-490a-98d2-0e3beca719df","resolution":{"observed_at":"2026-08-06T21:19:44.988969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.978154Z","title":null,"venue":null,"work_id":"6dab8268-44f3-4d24-b154-2adbcc6a84a4","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.053299Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:7a156f4a159fe7773955f1a676698426b071db99ac0b0f3f8ae1c50c6531b2be","observation_id":"c222e408-bde4-4718-89c1-13c4082e2752","resolution":{"observed_at":"2026-08-06T21:19:44.981093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.969907Z","title":null,"venue":null,"work_id":"c6d3037b-8215-4b0b-8a85-400e07a1e3e3","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.231965Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:51b7252b640e283886006f510ba5b1515fadcd830f1183606211682ad8cce685","observation_id":"e7512077-b686-4bd8-a9b3-5cea7199c551","resolution":{"observed_at":"2026-08-06T21:19:44.972431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.962527Z","title":"objects\": [{","venue":null,"work_id":"37d4780f-1c5d-4811-8b85-162812fd8517","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.411657Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:2631f14e7064046d3a92f86d3721989ccfa447f9af7b55510cdb6b2aad8f7ca2","observation_id":"56bc3bf0-545e-492a-9f06-abd4b9e3ffb5","resolution":{"observed_at":"2026-08-06T21:19:44.964871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.954251Z","title":"**E** - Early blastocyst 3","venue":null,"work_id":"802e7550-8cf2-471d-abe3-46e00f616b8d","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.562213Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:8f61a46ce401dc64d66b2d55858074d24eb5437cb7432d029abefbf825e3e3a8","observation_id":"f684a584-5991-4a67-a1aa-b443994bcc49","resolution":{"observed_at":"2026-08-06T21:19:44.957213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.945947Z","title":"(D) No","venue":null,"work_id":"230b7fc9-b1b8-4b45-88a4-0f392284f6da","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.753763Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:f59e4af74f278d61a707f69eb31566e40cb6c359071ac7766fc8813cd4306a18","observation_id":"11dbcc7f-07d4-4bfd-9fd0-89dcdfd5d89f","resolution":{"observed_at":"2026-08-06T21:19:44.948916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.936772Z","title":null,"venue":null,"work_id":"fc96639c-b25f-42fe-b6cb-d055f6e8b50a","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:41.888306Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:25ac5abcc6d51de240a4873c3dfc6b5688ec74eefbbe7859ae615777e7c8072c","observation_id":"7448bd87-3e1f-46a6-9bd6-fc8b96006fee","resolution":{"observed_at":"2026-08-06T21:19:44.939965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.927040Z","title":null,"venue":null,"work_id":"c39a3972-f038-4609-bd58-b1b8314a0756","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.048251Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:b4b9d75604e09886dbc290779963f1b63b42e2d0d4836df02973c77b662efe24","observation_id":"fc7a62d8-836e-4b9c-85a4-3c8aa8f6a1cd","resolution":{"observed_at":"2026-08-06T21:19:44.930051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.898597Z","title":null,"venue":null,"work_id":"d08470e2-d343-4131-803d-e89a3cc3a010","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.250601Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:bc8ddfe5e307f617994b210dd79f9029af43d09a6873401561708b3ba68ba033","observation_id":"e6b28067-6d4a-4129-a304-bffe378bbf2b","resolution":{"observed_at":"2026-08-06T21:19:44.920005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.773153Z","title":null,"venue":null,"work_id":"c8d9cb9c-07fc-46e8-b400-3252571dbdf0","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.419828Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:a1c3584194197a9439046d75c8188424bd2e037878a2ef887d2ce0a8f2d99888","observation_id":"52c84aee-7ee7-4961-a5b7-29a97ddc5936","resolution":{"observed_at":"2026-08-06T21:19:44.850249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.538528Z","title":null,"venue":null,"work_id":"721f9198-ad13-4200-a329-f50280659dd1","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.629321Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:ce981d60b5dd7e3a0da262a3c775960a2b56aeddddde1b618976202cab79a40a","observation_id":"ab215d8c-386d-424d-8cac-6d20dfabc0da","resolution":{"observed_at":"2026-08-06T21:19:44.638857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.325061Z","title":"objects\": [ {","venue":null,"work_id":"7021d8f6-7593-4e51-b598-886836568428","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.743404Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:703793ddf121e330af86d22799cbdb6606fcfeaa30b0fe295cdc3a8f864f7ab5","observation_id":"bdeacc47-2d6a-4866-ae5d-8a665d175dc6","resolution":{"observed_at":"2026-08-06T21:19:44.429933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:44.160372Z","title":null,"venue":null,"work_id":"592eff81-840a-480e-b60c-ed656000d359","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.783517Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:177d65e3f7b95c52f3136505ddfd43759b670270d7aafb7bbdca207fdc8d6d46","observation_id":"35053a44-ae4e-4854-9b81-98b7c152a411","resolution":{"observed_at":"2026-08-06T21:19:44.238427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:43.988283Z","title":null,"venue":null,"work_id":"556f6007-5872-40cf-b80a-26a3d49bf859","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.836296Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:cc5304531beca62a67c9de2a2c7b6f41b7610344db9f163ff13a2a6d34e73938","observation_id":"5b2c26af-e05c-445d-ad92-00dc4fc1c7ec","resolution":{"observed_at":"2026-08-06T21:19:44.075489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:43.646477Z","title":null,"venue":null,"work_id":"00580a8a-50cb-4dcf-b04c-9dd0b461c57b","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.927117Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:3ccf0371ea3c90e51bcbc4282341efed76b04457ffe4aedebfcc660584426abe","observation_id":"0700ebef-9854-4246-8fec-40276333546d","resolution":{"observed_at":"2026-08-06T21:19:43.777934Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:43.613818Z","title":"The correct answer is: (C) smaller than Qwen-VL-7B + SMART ： The derivative of the function y = log_2(x) is \\frac{1}{x ln(2)}","venue":null,"work_id":"b976852f-759c-4882-9b41-32f7eec17898","year":null},"citing_paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:42.977063Z"},"links":{"citing_paper":"/paper/2507.02984"},"observation_digest":"sha256:1030147492ffd0553ed3f5f254d0c030b7fd3d96d3cbbb4cc67b1b7bd5804321","observation_id":"5da17c2f-9656-45aa-af6a-8b064383b604","resolution":{"observed_at":"2026-08-06T21:19:43.630021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02984","last_updated":"2025-07-28T05:53:50Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T09:07:04.558000Z","submitted_at":"2025-07-01T08:24:51Z","title":"From Answers to Rationales: Self-Aligning Multimodal Reasoning with Answer-Oriented Chain-of-Thought"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":75,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 0 inbound Pith citation observations for arXiv:2507.02984."}