{"as_of":"2026-08-09T16:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e30e9003f0520bb619ac0a24727cb000912ebf478b7b393a40ef9038fd5d61dc","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T13:51:32.380423Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:35:23.601142Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T09:54:34.549499Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"cited_work":{"arxiv_id":"2512.22867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.22867","snapshot_observed_at":"2026-07-07T02:16:01.187339Z","title":"arXiv preprint arXiv:2512.22867 (2025)","venue":null,"work_id":"0a2b23ec-db04-4150-be14-1954d1b9daaa","year":2025},"citing_paper":{"arxiv_id":"2606.28760","last_updated":"2026-06-27T06:32:47Z","snapshot_observed_at":"2026-08-02T05:23:21.716610Z","submitted_at":"2026-06-27T06:32:47Z","title":"Vision-Language Models for Deployable Social Robot Navigation: Bridging Semantic Reasoning and Low-Level Control","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-30T09:52:51.549135Z"},"links":{"cited_paper":"/paper/2512.22867","citing_paper":"/paper/2606.28760"},"observation_digest":"sha256:4f696ba6adb3e9131ee2a602052d3e72bb8819ef0ecc4f9926f41e7643cafde7","observation_id":"fdc0003c-d531-4097-acb9-bd38bad31e52","resolution":{"observed_at":"2026-07-07T02:16:01.187339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.22867","snapshot_observed_at":"2026-07-14T07:49:44.998466Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10991","last_updated":"2026-07-13T01:27:27Z","snapshot_observed_at":"2026-08-08T17:04:40.004104Z","submitted_at":"2026-07-13T01:27:27Z","title":"Think When It Matters: Conditional VLM Reasoning for Social Navigation with RL Policies","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T07:49:44.998466Z"},"links":{"cited_paper":"/paper/2512.22867","citing_paper":"/paper/2607.10991"},"observation_digest":"sha256:91213c2cc813f191cf566500d0f6640724c615c23ea388d8f1c6b679f31a2eaa","observation_id":"8324a4ef-d3ea-43d2-a594-449e0300e270","resolution":{"observed_at":"2026-07-14T07:49:44.998466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.22867","snapshot_observed_at":"2026-08-01T11:35:23.601142Z","title":"Mu- son: A reasoning-oriented multimodal dataset for socially compliant navigation in urban environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19850","last_updated":"2026-07-22T07:35:35Z","snapshot_observed_at":"2026-08-08T08:52:05.723948Z","submitted_at":"2026-07-22T07:35:35Z","title":"SOPD-SocialNav: Selective On-Policy Distillation for Vision-Language Social Navigation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T11:35:23.601142Z"},"links":{"cited_paper":"/paper/2512.22867","citing_paper":"/paper/2607.19850"},"observation_digest":"sha256:ef9d465c7139d574fb987a3248ac2010644d2e3bfa55ec8961f67588036b66af","observation_id":"6d255444-3b3f-4a19-a7eb-379489622ae3","resolution":{"observed_at":"2026-08-01T11:35:23.601142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.22867/citation-record","integrity":"/paper/2512.22867/integrity","json":"/paper/2512.22867/citation-record.json","paper":"/paper/2512.22867"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.291421Z","title":"Vision-and-language navigation: Interpreting visually-grounded navigation instructions in real environments,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.291421Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:8e413f7011974771da7703c22567d9d1f2e296492b59c4f51d54239d2a066ce1","observation_id":"0751cb8a-3d79-492d-a10a-374abc7cc7d2","resolution":{"observed_at":"2026-08-03T13:51:32.291421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.295357Z","title":"Room-across- room: Multilingual vision-and-language navigation with dense spa- tiotemporal grounding,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.295357Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:2bbb88082b3ddae1f46f921691e172036c819dd7872364fa07542f3574e871f7","observation_id":"534d3aa7-7206-4abc-82ba-7bd51e681ebd","resolution":{"observed_at":"2026-08-03T13:51:32.295357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.298463Z","title":"Convoi: Context-aware naviga- tion using vision language models in outdoor and indoor environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.298463Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:53ca3d8906513fa50c49e58a9081aa3c978b9134191921acf24cbfbf7b2e31e7","observation_id":"b161f1fe-4210-45df-aa7a-63a14c4d4cd7","resolution":{"observed_at":"2026-08-03T13:51:32.298463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.301492Z","title":"Gson: A group-based social navigation framework with large multimodal model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.301492Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:4419a17effa8f4891db9df4d1375437fd080bc26beae953733cc50ac24c8125f","observation_id":"36d49b38-bac8-4753-8e4b-736d6ef18d82","resolution":{"observed_at":"2026-08-03T13:51:32.301492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.304693Z","title":"Socialnav-moe: A mixture-of- experts vision language model for socially compliant navigation with reinforcement fine-tuning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.304693Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:fae51267ce28c4cfdac8f40214a9baa28d266b721f881d26e862c1cdbec92b03","observation_id":"f31491ea-7ea3-47a9-a4ba-6b4c0f0ee9e2","resolution":{"observed_at":"2026-08-03T13:51:32.304693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09024","last_updated":"2024-12-30T23:59:30Z","snapshot_observed_at":"2026-07-06T20:21:37.540432Z","submitted_at":"2024-12-30T23:59:30Z","title":"Social-LLaVA: Enhancing Robot Navigation through Human-Language Reasoning in Social Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09024","snapshot_observed_at":"2026-08-03T13:51:32.307397Z","title":"Social-llava: Enhancing robot navigation through human-language reasoning in social spaces,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.307397Z"},"links":{"cited_paper":"/paper/2501.09024","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:7d2acd5ad4c2d4d417bb248b52a3948a73b4eb79c930c6786699ee8b22a6c0f1","observation_id":"e1cd809c-a776-4a25-8902-e60e3e343cdd","resolution":{"observed_at":"2026-08-03T13:51:32.307397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.311431Z","title":"Beyond the nav-graph: Vision-and-language navigation in continuous environ- ments,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.311431Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:5a62cdf90efbf4a6b0bdaf3a2126b72f5f3839772d41e71207e3af4c25b59153","observation_id":"36d96b44-de6b-4e9d-8317-351aed0719b8","resolution":{"observed_at":"2026-08-03T13:51:32.311431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.313939Z","title":"Gnm: A general navigation model to drive any robot,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.313939Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:282e410d34c0919e1b632f0266dfb03c10d983943bd697a538d994d5471c98e6","observation_id":"d126a16b-d599-4538-af73-ff0dde54b774","resolution":{"observed_at":"2026-08-03T13:51:32.313939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-07-06T17:34:57.509162Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15852","snapshot_observed_at":"2026-08-03T13:51:32.316319Z","title":"Navid: Video-based vlm plans the next step for vision- and-language navigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.316319Z"},"links":{"cited_paper":"/paper/2402.15852","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:2dc671d1a8911606a8e61bc34c8870d1fc5c735d41357f9a5a0ef1f35bc7448c","observation_id":"4927c3c6-9865-4e09-b7e4-2363fe29251e","resolution":{"observed_at":"2026-08-03T13:51:32.316319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.319019Z","title":"Jrdb: A dataset and benchmark of egocentric robot visual perception of humans in built environments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.319019Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:edb703d8de65093d7cfc4470c3c54b7073510428b99e72f692e9d04591f43f47","observation_id":"6d22be34-194d-414b-b697-c728265d039b","resolution":{"observed_at":"2026-08-03T13:51:32.319019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.321427Z","title":"Socially compliant navigation dataset (scand): A large-scale dataset of demonstrations for social navigation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.321427Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:49c42faa7df1a89aa37b62d0070c96860ca2557f44c0f8f2bffabe9e2f0e2ce6","observation_id":"dc8246d4-7a42-4aad-b1ce-234dfba8b414","resolution":{"observed_at":"2026-08-03T13:51:32.321427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.323942Z","title":"End- to-end driving via conditional imitation learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.323942Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:7d9c2925041a6c6603c58fc02ac6fcaea0eeb86bbb2c6621d6f4ecc16c7693ae","observation_id":"a7152e4b-5010-437e-8ea6-22225ef8f12f","resolution":{"observed_at":"2026-08-03T13:51:32.323942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03079","last_updated":"2018-12-07T16:04:00Z","snapshot_observed_at":"2026-07-06T07:19:51.356709Z","submitted_at":"2018-12-07T16:04:00Z","title":"ChauffeurNet: Learning to Drive by Imitating the Best and Synthesizing the Worst","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03079","snapshot_observed_at":"2026-08-03T13:51:32.326526Z","title":"Chauffeurnet: Learning to drive by imitating the best and synthesizing the worst,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.326526Z"},"links":{"cited_paper":"/paper/1812.03079","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:4eccdaeb07879a5faefcedf304c6cd95845b502fe44f7d454542ad7f57cdc352","observation_id":"3e0bd58e-e87c-44c1-b2c8-2871f4aa2d0f","resolution":{"observed_at":"2026-08-03T13:51:32.326526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.329436Z","title":"Exploring the limitations of behavior cloning for autonomous driving,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.329436Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:e18348fb6ce3aaf325b53a3a9787148e011f6ef31cc404d84b6f4bc3b2aacde8","observation_id":"b05a0135-3c1a-4e24-a945-8d99952eb9f2","resolution":{"observed_at":"2026-08-03T13:51:32.329436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.332368Z","title":"Palm-e: an embodied multimodal language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.332368Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:1896b542cbc42ac404e00ecb0503deabea3731d9893715298b19f7ccc99c8385","observation_id":"5b7d78e7-34fe-457b-9c6d-f916eaa2f9b8","resolution":{"observed_at":"2026-08-03T13:51:32.332368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.334735Z","title":"Rt-2: Vision-language-action models trans- fer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.334735Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:a049acc80009298b579d0d2296d4ac7544079e2e7a029c3a58b682a5e919fe5d","observation_id":"d84da13c-9919-4bda-b63b-3dc31cd0cbab","resolution":{"observed_at":"2026-08-03T13:51:32.334735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.337191Z","title":"Inner monologue: Embodied reasoning through planning with language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.337191Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:477e6f410eba8e6857f152926fae9dfd337c929726cc7c1e27b301a37fd5ae0f","observation_id":"9a76807e-1f7f-4479-ae68-5cef98d8e2b3","resolution":{"observed_at":"2026-08-03T13:51:32.337191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.339649Z","title":"React: Synergizing reasoning and acting in language mod- els,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.339649Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:a2f63f8796d556f84e7445b7871901b2006ad0647d13221b2df4c0837c61df36","observation_id":"77a54205-bb42-42d5-84d8-e23f4bbbb4a0","resolution":{"observed_at":"2026-08-03T13:51:32.339649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.342034Z","title":"V oxposer: Composable 3d value maps for robotic manipulation with language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.342034Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:2106b852466c625b76a5a29911da82788f801df5fa2934e060d0c8eb143625f1","observation_id":"98160e96-7aba-4851-baf8-65234ef5e2a8","resolution":{"observed_at":"2026-08-03T13:51:32.342034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.344453Z","title":"Chatgpt for robotics: Design principles and model abilities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.344453Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:8ee0728ca62f897352c530e3125e9a1f05ba388eb38adf7e2e10020441328971","observation_id":"ef0df78e-8480-4156-b182-6315feb1a1df","resolution":{"observed_at":"2026-08-03T13:51:32.344453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.347027Z","title":"Chatgpt empowered long-step robot control in various environments: A case application,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.347027Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:32fd1bf75dd523c0fdbf2881872b635e1ef99591409ea70165f2c61806ab14d0","observation_id":"d9b207f5-39e9-4157-9522-cd05d1a6083e","resolution":{"observed_at":"2026-08-03T13:51:32.347027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.349434Z","title":"Llm-advisor: An llm benchmark for cost-efficient path planning across multiple terrains,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.349434Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:e8c6e9802ff8e6d3a2a9bdbc68664f2e736913162caea09f15869364e662597e","observation_id":"3382bf6f-0e42-4ac5-bf10-18037159e5d4","resolution":{"observed_at":"2026-08-03T13:51:32.349434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-03T13:51:32.352044Z","title":"Tinyllama: An open-source small language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.352044Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:01ed91e94b09ec2bb37d7ba53ccb1d56f02767ec0f6f6814e580dd4a223c1cd5","observation_id":"b9593e1a-7e8c-43ed-973b-b3f0628e20bb","resolution":{"observed_at":"2026-08-03T13:51:32.352044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-03T13:51:32.354806Z","title":"Mobilevlm: A fast, strong and open vision language assistant for mobile devices,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.354806Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:42b93ff73703ce4ab382a7ef6217aaa8d634bf7168a3ca9d668a99e6e2a6e319","observation_id":"107c6774-e443-4879-901a-287cba4a438a","resolution":{"observed_at":"2026-08-03T13:51:32.354806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14289","last_updated":"2024-02-22T05:05:30Z","snapshot_observed_at":"2026-08-03T05:27:32.394774Z","submitted_at":"2024-02-22T05:05:30Z","title":"TinyLLaVA: A Framework of Small-scale Large Multimodal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14289","snapshot_observed_at":"2026-08-03T13:51:32.357586Z","title":"Tinyllava: A framework of small-scale large multimodal models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.357586Z"},"links":{"cited_paper":"/paper/2402.14289","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:6cc19c1d83201bee0003b4f64f0b6d1c74d7eba5b2c224f2194fa9b9c31095c3","observation_id":"c22b5713-4212-4f15-b3e1-a12b41779879","resolution":{"observed_at":"2026-08-03T13:51:32.357586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15947","last_updated":"2024-12-23T08:05:14Z","snapshot_observed_at":"2026-08-06T02:31:58.372974Z","submitted_at":"2024-01-29T08:13:40Z","title":"MoE-LLaVA: Mixture of Experts for Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15947","snapshot_observed_at":"2026-08-03T13:51:32.360383Z","title":"Moe-llava: Mixture of experts for large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.360383Z"},"links":{"cited_paper":"/paper/2401.15947","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:5b173da52597e3a426fdf0cd9c618c3d6bfcfc8b3adb15e68980e967d9894c1f","observation_id":"8e6f0a0c-3710-4158-b3aa-5845ed18d7df","resolution":{"observed_at":"2026-08-03T13:51:32.360383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-03T13:51:32.363032Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.363032Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:ebf6173ded7a93f7f85b71d21a2406444761bf740095795e0d029acaebd7fb70","observation_id":"207b1035-3f2d-43fb-8775-59cfc81877cb","resolution":{"observed_at":"2026-08-03T13:51:32.363032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.365673Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.365673Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:5e46981a8b63675c28ade5702e94464ec0c01738cce4bec3ee6f3f60c93c521c","observation_id":"276276cc-624e-4d20-b62c-0ac0b82647b0","resolution":{"observed_at":"2026-08-03T13:51:32.365673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.368187Z","title":"Toward human-like social robot navigation: A large-scale, multi-modal, social human navigation dataset,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.368187Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:d46932a58fbe7a745242a994f7c8c55e882d740297100eb25e4c456419ba7b07","observation_id":"80da2383-c8f4-4940-a8e3-153fcbb8dc2e","resolution":{"observed_at":"2026-08-03T13:51:32.368187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20216","last_updated":"2026-07-06T07:24:30Z","snapshot_observed_at":"2026-08-08T17:46:47.791950Z","submitted_at":"2025-11-25T11:42:28Z","title":"CostNav: A Navigation Benchmark for Real-World Economic-Cost Evaluation of Physical AI Agents","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.20216","snapshot_observed_at":"2026-08-03T13:51:32.370628Z","title":"Costnav: A navigation benchmark for cost- aware evaluation of embodied agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.370628Z"},"links":{"cited_paper":"/paper/2511.20216","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:10128207fda673616e8175326dfe38df168e57f0935158857bc468433002aa57","observation_id":"20bb36e7-c09a-4e3c-b2c3-a90725d674e2","resolution":{"observed_at":"2026-08-03T13:51:32.370628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.373314Z","title":"Bleu: a method for automatic evaluation of machine translation,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.373314Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:3b8455b6c2cb6725a5428ed5d3534cd40dc60be295ca4893adcc5e963bf475e1","observation_id":"aef5414e-a52d-4001-908f-26ee50a2895c","resolution":{"observed_at":"2026-08-03T13:51:32.373314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.375675Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.375675Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:750c6919922b1b3a4341ebbe621cc0455a36beebedeb3287652ad6c5f49eda0e","observation_id":"d29fd711-c221-46bf-a72e-e2a8eba4bbbc","resolution":{"observed_at":"2026-08-03T13:51:32.375675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T13:51:32.378002Z","title":"Nvila: Efficient frontier visual language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.378002Z"},"links":{"citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:7b26fa72b6910c3f6aa474b572ed22ee5eb6ec338a33121f9e4400950303fd74","observation_id":"614fec00-b304-4677-a16f-853d2d9d3755","resolution":{"observed_at":"2026-08-03T13:51:32.378002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-03T13:51:32.380423Z","title":"Qwen2. 5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T13:51:32.380423Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2512.22867"},"observation_digest":"sha256:ebca18b81c6814381e0a984467462cc1886cb1f160b87954575adfdadaacb754","observation_id":"7257e6a4-4024-4e8e-8f8c-5aadd7f224b1","resolution":{"observed_at":"2026-08-03T13:51:32.380423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.22867","last_updated":"2026-07-03T08:07:47Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T08:51:47.444096Z","submitted_at":"2025-12-28T10:41:39Z","title":"MUSON: A Reasoning-oriented Multimodal Dataset for Socially Compliant Navigation in Urban Environments"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 3 inbound Pith citation observations for arXiv:2512.22867."}