{"as_of":"2026-08-20T07:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c1cadd8dc0a4e2dee06a38c9e404a1c70c83b5bd8ef822a82f42f6d3403c77c5","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:39:42.406991Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14346/citation-record","integrity":"/paper/2505.14346/integrity","json":"/paper/2505.14346/citation-record.json","paper":"/paper/2505.14346"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:55.671648Z","title":"Accessed on March 7th, 2025","venue":null,"work_id":"d0a66cd6-c434-4076-9ebd-200bed06563f","year":2025},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:34.862985Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:1f1664786c106a563f111e4aeb4ecfd1b4191429d57d93ce108a1dc59427b9e5","observation_id":"50c733df-7f08-4a61-9c77-49a021503606","resolution":{"observed_at":"2026-08-07T15:39:55.804426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:55.488038Z","title":"Hiervl: Learning hierarchical video- language embeddings","venue":null,"work_id":"4b2a3b8d-1fdc-481d-80fa-76660cec92c6","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:34.908511Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:8ca5221e3ffc0f6e3168c07c44b350a9711a214f230b28b2ebb5bb847497c581","observation_id":"068715c7-b6cb-4516-9bbf-8dde0a7ad146","resolution":{"observed_at":"2026-08-07T15:39:55.537415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:55.249338Z","title":"Walk detection and step counting on unconstrained smartphones","venue":null,"work_id":"08a0ed2c-2807-4d26-a57a-2b3baada4018","year":2013},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:34.994090Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:c4ad6a48bd8ae8eb7e17e9c5c6d573ab3f8882e8cda03f9ed68a30b7b34dabb8","observation_id":"7a206475-7f7d-409d-909b-ac98fa9b5a62","resolution":{"observed_at":"2026-08-07T15:39:55.357212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:55.044549Z","title":"Ionet: Learning to cure the curse of drift in iner- tial odometry","venue":null,"work_id":"7c58b0e8-9029-4980-bac4-9cc95698b52a","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.083495Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:6e111cc7bf10d70fd6769d7bd2d15a45b6c50c8379a239400a8a593f4108b0a4","observation_id":"dd476cf6-6433-4635-ac89-61c2d284410e","resolution":{"observed_at":"2026-08-07T15:39:55.132961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.07491","last_updated":"2018-09-20T06:48:37Z","snapshot_observed_at":"2026-08-14T18:26:00.962137Z","submitted_at":"2018-09-20T06:48:37Z","title":"OxIOD: The Dataset for Deep Inertial Odometry","version":1},"cited_work":{"arxiv_id":"1809.07491","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.07491","snapshot_observed_at":"2026-08-07T15:39:42.585624Z","title":"OxIOD: The Dataset for Deep Inertial Odometry","venue":"cs.RO","work_id":"8f88fc4d-c8fe-4112-a25f-63467bc4e8cf","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.200561Z"},"links":{"cited_paper":"/paper/1809.07491","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:6643765a6e1efa6ebb0e06377b554227295151d8433dc1fe8c9224d93e4dcf86","observation_id":"192282dc-2e89-4f98-a3a7-564f6d1aa100","resolution":{"observed_at":"2026-08-07T15:39:42.686966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:54.634588Z","title":"Soundingactions: Learning how actions sound from narrated egocentric videos","venue":null,"work_id":"e5b25250-4f9f-4d91-9606-0ed18d17d95a","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.289853Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:877bfc9e33b7656e5e5b57da50bde115c6d0860cd7d7ae923d510b3fb74d89aa","observation_id":"12445029-c4fb-461f-9bf3-fad79d884dfb","resolution":{"observed_at":"2026-08-07T15:39:54.882998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:54.294633Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":"d2babdcd-cc8f-4d4e-aea9-0910c38f9dd4","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.375999Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:e58bbfe8d7e49ef4035ef67b62462dfcc73abd1161b877370c91359eceb39ffb","observation_id":"b2d13a74-5c06-4703-8a5b-c6cbaea4e37b","resolution":{"observed_at":"2026-08-07T15:39:54.424581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:54.026814Z","title":"Scaling egocentric vision: The epic-kitchens dataset","venue":null,"work_id":"a49db011-653d-4290-af90-8fccb691a8b3","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.460251Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:00b3c90c2c2cf87bcfbfbfbd25c72f44dcfc8c2d0fb5e69a56bff59a9f52f350","observation_id":"240f988a-13d1-43e5-bceb-9cabd51da174","resolution":{"observed_at":"2026-08-07T15:39:54.173945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:53.757428Z","title":"Scenefun3d: fine-grained functionality and affordance un- derstanding in 3d scenes","venue":null,"work_id":"15d2d8c4-344d-4deb-9f1c-c78dc376140b","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.548857Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:174b39f1b8e97e23d855892e171383b4a7af412dd1fcdfd2ed1c01f6d13dc1a5","observation_id":"30025a4a-db8b-4c41-b8d2-44c54714d3d4","resolution":{"observed_at":"2026-08-07T15:39:53.889316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T15:39:35.640619Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.640619Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d359511499f12df586f9afa493d3e0c5e7e36eb69fb3a0fc67b3fdccb6540a4c","observation_id":"36a24ec7-68c7-4c1d-9a2b-ca2ca00dbddc","resolution":{"observed_at":"2026-08-07T15:39:35.640619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03567","last_updated":"2024-08-07T06:10:45Z","snapshot_observed_at":"2026-08-16T13:28:03.319961Z","submitted_at":"2024-08-07T06:10:45Z","title":"Unlocking Exocentric Video-Language Data for Egocentric Video Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03567","snapshot_observed_at":"2026-08-07T15:39:35.752090Z","title":"Un- locking exocentric video-language data for egocentric video representation learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.752090Z"},"links":{"cited_paper":"/paper/2408.03567","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d1fff0613930d385a9401ba6e52c23be5322dbc2d55420e354accb82a0e1066d","observation_id":"7555dd37-727f-4b78-af8a-d5708220016a","resolution":{"observed_at":"2026-08-07T15:39:35.752090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13561","last_updated":"2023-10-01T20:16:22Z","snapshot_observed_at":"2026-08-13T14:52:21.014234Z","submitted_at":"2023-08-24T20:42:21Z","title":"Project Aria: A New Tool for Egocentric Multi-Modal AI Research","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13561","snapshot_observed_at":"2026-08-07T15:39:35.842230Z","title":"Project aria: A new tool for egocentric multi-modal ai research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.842230Z"},"links":{"cited_paper":"/paper/2308.13561","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:7062b9ec1b1ecec3d11441fefa730c4bfd142a25e16dc904e9fa9845694c49da","observation_id":"1912a798-b19a-4641-81a5-0ca13b99033d","resolution":{"observed_at":"2026-08-07T15:39:35.842230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:53.476765Z","title":"Actionslam: Using location-related actions as landmarks in pedestrian slam","venue":null,"work_id":"4b77dd21-d46e-494b-a3bc-b668a26d2cc0","year":2012},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.958986Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:16765e1f7ef6f886aae43eb9fb7631c39a36e763c34d7631ec4dd2d3f93ce8dd","observation_id":"5c3bce37-a30b-4d1d-a96f-6f26538a8edf","resolution":{"observed_at":"2026-08-07T15:39:53.639204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:53.222869Z","title":"Positioning method of pedestrian dead reckon- ing based on human activity recognition","venue":null,"work_id":"c52c6ac8-7898-40c0-8b26-e7b78df4b276","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.129370Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:f29b42b6980281b8207fe739837a16bd7854eac49987ed3b2c44847ea64b7dfb","observation_id":"f1a8a41b-37bc-42ff-ad28-686d6c675576","resolution":{"observed_at":"2026-08-07T15:39:53.330866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:53.010083Z","title":"Egovqa-an egocentric video question answer- ing benchmark dataset","venue":null,"work_id":"1161ff60-3427-4bc5-8a9b-f9e0dfc71987","year":2019},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.213956Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:36c4a20db735a26b7912ad4b0a6bde6aae9a219bae56889d373edfb3e3da88c4","observation_id":"c1587f60-b5ec-4761-ba5b-7aac6ef3bf78","resolution":{"observed_at":"2026-08-07T15:39:53.124370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:52.716591Z","title":"Mmg-ego4d: Multimodal generalization in egocentric action recognition","venue":null,"work_id":"93f7ee97-e0a0-4bc5-a5c5-c90e2e63e814","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.312929Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:9cef7eebe58cf5a84086a55b7e35b03a023083913c0be94140a7f57fb83f433b","observation_id":"1c680ab0-ec5a-4ac5-856e-a6af1e9edc7f","resolution":{"observed_at":"2026-08-07T15:39:52.891220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:52.475761Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":"d9fb43af-3e99-417a-9779-d7d2b4373e6f","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.380796Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:00751d2d8b3b874ae412d433ba435756a0d79ec71e563c1ee90c2ba621927197","observation_id":"9834b9cf-28a9-452a-87b8-9428d1b44d2d","resolution":{"observed_at":"2026-08-07T15:39:52.582526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:52.261147Z","title":"Ego-exo4d: Understanding skilled human activity from first-and third-person perspectives","venue":null,"work_id":"9b57b88b-bf5e-4546-b93f-fb2f69fbbec6","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.442471Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:5d8dc39a01134662b399bae28319a6252bd03899f8fc17d5142f15095cf626c4","observation_id":"648d0fc2-2ac1-49ed-a721-a17bdfb85cae","resolution":{"observed_at":"2026-08-07T15:39:52.381446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:52.074630Z","title":"Conceptgraphs: Open-vocabulary 3d scene graphs for per- ception and planning","venue":null,"work_id":"72c41de4-a386-4531-b75c-abfe0448b90f","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.560776Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:276ae5dcd4a59ba04e99acc9e0fc3ad5616eccedf77efb2d72b59013f703b4f2","observation_id":"eb341687-fe32-4e08-b139-0665aed1ded1","resolution":{"observed_at":"2026-08-07T15:39:52.175358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.810518Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"f70f8b7a-86a9-4abf-8229-1d421f4cee1c","year":2016},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.667942Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:22269a9d2f46edd51fe7298fb2c4e0378a00db58bd12a6bcd7b77a6cd84d4b80","observation_id":"4261985c-eaab-4bd7-b5db-61131c8886d7","resolution":{"observed_at":"2026-08-07T15:39:51.923368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.524946Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"c60e3837-e62d-4447-a9cc-0df7dfc47e7b","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.730576Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:beb6491a4525f52bf89385f7095c1e7c0705675b68873940dcdc2e2456e8fbeb","observation_id":"a4492060-62af-46b6-ba41-93286638aa0f","resolution":{"observed_at":"2026-08-07T15:39:51.673144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.261612Z","title":"Ronin: Robust neural inertial navigation in the wild: Benchmark, evaluations, & new methods","venue":null,"work_id":"da8ef707-9085-4e48-b61d-6f8e6ed36baf","year":2020},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.816642Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d429f7277fe15f677924d220869908594a523028b86e8ecdcf1f630bd02d6e56","observation_id":"bc9ed6fb-a028-4d52-a3ee-180e9881c285","resolution":{"observed_at":"2026-08-07T15:39:51.382102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.240124Z","title":"Fusion-dhl: Wifi, imu, and floorplan fusion for dense history of loca- tions in indoor environments","venue":null,"work_id":"e0aa3804-2690-4b59-b80c-3356ce2188b0","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.977749Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:702951f590ae7a5e62835f8a3a8603473f9783ac3d2c53a31e4c1e782a8f18fb","observation_id":"561751ad-9342-4738-a6c8-af999876968d","resolution":{"observed_at":"2026-08-07T15:39:51.244391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.075711Z","title":"Neural inertial localization","venue":null,"work_id":"5d6f0e72-4af2-44e0-9a17-736fde25b4d6","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.089605Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:beff6895c0ce71016580d05e6d2ef505f114d0f55ebab6ba897e32d0f68e4c75","observation_id":"d932512e-9bef-4bfc-bc61-8b1837c16047","resolution":{"observed_at":"2026-08-07T15:39:51.165060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:50.842469Z","title":"Egoexolearn: A dataset for bridging asyn- chronous ego-and exo-centric view of procedural activities in real world","venue":null,"work_id":"9e3b4192-b955-4ab0-9067-e22d54361045","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.160987Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:e881e2988473fba8edb5b90103a957a591598d7c8388519d62fcd3a357d252be","observation_id":"24df2dad-d2e7-463d-b483-fc1c1e80bb1a","resolution":{"observed_at":"2026-08-07T15:39:50.946754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21080","last_updated":"2024-12-30T16:57:05Z","snapshot_observed_at":"2026-08-16T22:23:33.828463Z","submitted_at":"2024-12-30T16:57:05Z","title":"Vinci: A Real-time Embodied Smart Assistant based on Egocentric Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21080","snapshot_observed_at":"2026-08-07T15:39:37.248378Z","title":"Vinci: A real-time embodied smart assistant based on egocentric vision-language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.248378Z"},"links":{"cited_paper":"/paper/2412.21080","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:36e6697fa94f8656afd4418a911894fd5cddd46a607e6559f2c66b43e66d6b37","observation_id":"72f24855-0ec1-4f79-87f8-ae86f6cb6ffc","resolution":{"observed_at":"2026-08-07T15:39:37.248378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:50.681649Z","title":"Video re- cap: Recursive captioning of hour-long videos","venue":null,"work_id":"3010120d-eaaa-45fa-9cac-bb1fcdb43e0c","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.370390Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2c68529635299b24cc9a3f8189663229f0ce626bb495ca258885aef21268c1e4","observation_id":"5e1eff14-63cd-40d1-a92d-434607266873","resolution":{"observed_at":"2026-08-07T15:39:50.760582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:50.414925Z","title":"Posenet: A convolutional network for real-time 6-dof cam- era relocalization","venue":null,"work_id":"6d4c28f8-1b7d-4e0b-9cec-d9434ecfd6a2","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.463530Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:f936fced816714898436b1c50ba5d6a87e759529284fc3931ef6d898a71da50d","observation_id":"704dff94-b0b8-467b-8530-0a2ab857ae9a","resolution":{"observed_at":"2026-08-07T15:39:50.549740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:50.156868Z","title":"Deep learning-based pdr scheme that fuses smartphone sensors and gps location changes","venue":null,"work_id":"b5acaa5d-1f97-48c7-959b-7f3d52ab7373","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.572547Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:23d7bf77d215a046f1577798b6c0710e351a43aa5f80bf3c808209b7b2eeb46d","observation_id":"5000705c-a1bc-49d9-b00a-f22d90966116","resolution":{"observed_at":"2026-08-07T15:39:50.272811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.909166Z","title":"Rtab-map as an open- source lidar and visual simultaneous localization and map- ping library for large-scale and long-term online operation","venue":null,"work_id":"6a34438b-2bb1-48f5-a22c-162288a71224","year":2019},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.657874Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:c82d62d9b3d7eec5320cfd764c1f3a33c56cad9c54f61010d3a8949a06ce1aad","observation_id":"98139734-9047-4a18-a93d-a7801989107e","resolution":{"observed_at":"2026-08-07T15:39:50.045479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.681052Z","title":"Keyframe-based visual–inertial odometry using nonlinear optimization","venue":null,"work_id":"50f14b8c-a7d6-4b41-9617-a8c755c90e7f","year":2015},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.758673Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:894e5ef78a1b9197365ae929bff5284d4b6dff01aec3347288010d53fc527ed9","observation_id":"706ace9a-5447-41d9-a864-9c010d21356f","resolution":{"observed_at":"2026-08-07T15:39:49.788880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.432454Z","title":"A bluetooth/pdr inte- gration algorithm for an indoor positioning system","venue":null,"work_id":"5d131afb-6158-4cd9-b013-7067de084b89","year":2015},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.876233Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:98c00a5c7631ff9f1eb0e0a05da27e2bfc4951169d16b15284bbdd313f36d570","observation_id":"c8cf1c0f-b30a-4324-89dc-4e117ddfdd82","resolution":{"observed_at":"2026-08-07T15:39:49.549468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01670","last_updated":"2022-10-13T03:31:05Z","snapshot_observed_at":"2026-08-16T16:55:28.178235Z","submitted_at":"2022-06-03T16:28:58Z","title":"Egocentric Video-Language Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01670","snapshot_observed_at":"2026-08-07T15:39:37.983698Z","title":"Egocentric video-language pretraining","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.983698Z"},"links":{"cited_paper":"/paper/2206.01670","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:4c856c17e76c3b95f6d4ca53b9f4e4251c202f806a303e9bc21558d6a376e9ca","observation_id":"73604ce4-2222-470b-bfc7-87998e443f22","resolution":{"observed_at":"2026-08-07T15:39:37.983698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15251","last_updated":"2025-05-05T12:16:10Z","snapshot_observed_at":"2026-08-16T12:56:26.309352Z","submitted_at":"2025-02-21T07:02:05Z","title":"SiMHand: Mining Similar Hands for Large-Scale 3D Hand Pose Pre-training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15251","snapshot_observed_at":"2026-08-07T15:39:38.081654Z","title":"Sim- hand: Mining similar hands for large-scale 3d hand pose pre- training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.081654Z"},"links":{"cited_paper":"/paper/2502.15251","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:127c4ee4177455fd010e135e9c4c71a5f2c711116259f290f10bdfea35c66669","observation_id":"c4fe656a-b08b-4edc-b17c-ddad512d7d63","resolution":{"observed_at":"2026-08-07T15:39:38.081654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00343","last_updated":"2024-09-05T11:58:51Z","snapshot_observed_at":"2026-08-16T13:22:29.321173Z","submitted_at":"2024-08-31T04:19:02Z","title":"EgoHDM: An Online Egocentric-Inertial Human Motion Capture, Localization, and Dense Mapping System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00343","snapshot_observed_at":"2026-08-07T15:39:38.208632Z","title":"Egohdm: An online egocentric-inertial human motion capture, localization, and dense mapping system","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.208632Z"},"links":{"cited_paper":"/paper/2409.00343","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:3d984dbac1faf1c42ecc253f7a41a8cd6b6d9a60c61435d81c36eb212eb1afc4","observation_id":"94834aa9-216a-436d-b7b3-351f53c0a7ab","resolution":{"observed_at":"2026-08-07T15:39:38.208632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.254433Z","title":"Single-to-dual-view adaptation for egocentric 3d hand pose estimation","venue":null,"work_id":"50980f29-ad1b-4dfe-9724-9910de01bf7f","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.296172Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:4a6e7e058d3f3937902d365dfe665987f4812f82c05180e5075396fd246fee13","observation_id":"4ce67aba-239d-4247-8808-68853a96b90c","resolution":{"observed_at":"2026-08-07T15:39:49.330232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.103007Z","title":"Tlio: Tight learned inertial odometry","venue":null,"work_id":"94e5ad52-976c-4195-946c-6407f2f2ee67","year":2020},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.392808Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:5d04c3b38b206167a61c676c911d01ca0d3fe708058c373ca7ca506911e1ef27","observation_id":"f4c02532-35f8-4c80-aba3-0fca997c5ee2","resolution":{"observed_at":"2026-08-07T15:39:49.184482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.951686Z","title":"Vsrd: Instance-aware volumetric silhouette rendering for weakly supervised 3d object detection","venue":null,"work_id":"5173a4b4-bf21-4712-8a7f-761bebce3e8b","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.478118Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:fa660e17546bb62ce6b31dff52e669700f75713377f02ad5a3c60b3ea31ca9ae","observation_id":"a05c3491-c3f6-4f0c-b6a6-c25f9b54ab51","resolution":{"observed_at":"2026-08-07T15:39:49.021716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:38.586545Z","title":"Distinctive image features from scale- invariant keypoints","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.586545Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:cbc0fae00411ac62eef54f143bb3b03e09ae5c5484ca0adb050d5de276736e4c","observation_id":"ba5616b4-4719-4ebe-93a6-c7b2e6607fbd","resolution":{"observed_at":"2026-08-07T15:39:38.586545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.771947Z","title":"Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data","venue":null,"work_id":"9ad33352-b857-4eda-8bc7-04428525a226","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.670909Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:4a5e61c0c65cb6ba049df35595685b4cbd58eabef3b03c65f72f4014988ad569","observation_id":"7d43c3fb-2a9f-4470-aea6-bf06522cd40e","resolution":{"observed_at":"2026-08-07T15:39:48.841357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.650234Z","title":"Imu2clip: language-grounded motion sensor translation with multi- modal contrastive learning","venue":null,"work_id":"ad88a9db-0495-4fc1-a0ff-6d8925f487a6","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.784553Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d0b82903b8a404134f379c346d16ddf67e516100c53638159e05cf28550f31bb","observation_id":"989b3ee3-a80c-48db-9426-fc24526a8edd","resolution":{"observed_at":"2026-08-07T15:39:48.702669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.487978Z","title":"A multi- state constraint kalman filter for vision-aided inertial navi- gation","venue":null,"work_id":"d4f97954-107e-468f-9192-9e5ff55f7fa6","year":2007},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.932564Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:00bbced4f9d375289636da703e5ec7b19ce2062169b1c4680dc1ea1c37a8f376","observation_id":"6e64fb19-8b20-44a8-9e91-34a06e694207","resolution":{"observed_at":"2026-08-07T15:39:48.569794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.331293Z","title":"Slip: Self-supervision meets language-image pre- training","venue":null,"work_id":"9fd24f09-d7d4-48da-a52e-6cc02733bd85","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.011528Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:424b45264085463335a3a7336924d7cd0da4e6aa93e6e8875d98737837e4ccef","observation_id":"bc27b2cf-fcf2-4585-814b-139d4ec0978e","resolution":{"observed_at":"2026-08-07T15:39:48.407811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.179829Z","title":"Deep convo- lutional and lstm recurrent neural networks for multimodal wearable activity recognition","venue":null,"work_id":"af6b43d9-b18b-4097-9cd6-dfc2c2145cb2","year":2016},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.109123Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:c856f844ce9bc46597e8def6ad61d13df3668d9ecc17e8bce652b539597e6e60","observation_id":"d9fb2b6c-67a0-4147-a9f3-4151e680e0c3","resolution":{"observed_at":"2026-08-07T15:39:48.256670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.994567Z","title":"Re- view of microsoft hololens applications over the past five years","venue":null,"work_id":"56cd7daa-84bc-44a0-821f-3c496bb69037","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.229177Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:e94e3dc1c337bb6847465c5e57d832cb583410542439efd16234f90cbe015e48","observation_id":"3fa8f81a-0b89-4e9d-b18f-769ebfebc1c0","resolution":{"observed_at":"2026-08-07T15:39:48.104424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.709013Z","title":"Modeling fine-grained hand-object dynamics for egocentric video representation learning","venue":null,"work_id":"0da35377-bab0-44b7-83a1-92352b12d664","year":2025},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.342351Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:4d9d412e78544233d9264de546570fe043bfd495db9f834e3380ffd9189c6db1","observation_id":"6d560b64-bf3f-4996-bc45-9efd306e9264","resolution":{"observed_at":"2026-08-07T15:39:47.845508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.588676Z","title":"Egovlpv2: Egocentric video-language pre-training with fusion in the backbone","venue":null,"work_id":"7b0ec428-99d7-4812-8192-e7d56f241c92","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.428784Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2e0f51ec501876e148d1921db271435833606fe060d284f970942edd070bdb01","observation_id":"b8c8a1c8-68d3-4a79-af2c-54bb5bedaefc","resolution":{"observed_at":"2026-08-07T15:39:47.646535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.474072Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space","venue":null,"work_id":"8f244e4e-4b0c-4991-b5cb-53648dae4ed0","year":2017},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.513629Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:fa9f9223f8c4048616d7329313b61de722bc305fd97da19cf5be760fed307312","observation_id":"697635c8-0f59-46cf-9fff-61a595b50582","resolution":{"observed_at":"2026-08-07T15:39:47.534691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.209776Z","title":"Vins-mono: A robust and versatile monocular visual-inertial state estimator","venue":null,"work_id":"ee87aed0-5817-4eed-a3f8-ed6682e3d885","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.596757Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:3d7e72a12e5985895ac648fc62ed3b25b333cbcc85dc28ca8ec8c834afdcc163","observation_id":"30a782e4-d431-40d4-9e1d-fde2dcff0dda","resolution":{"observed_at":"2026-08-07T15:39:47.366756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.931038Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"cdff8476-0f2a-4506-ac9e-6d93bcecc987","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.683793Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:8f2e1c4728aaccd3a65b4cda03d025555b8911925214df49e05954c901c86b73","observation_id":"7fee0379-1c2a-4d25-adde-4c3256b331df","resolution":{"observed_at":"2026-08-07T15:39:47.068084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.746299Z","title":"Lamar: Benchmarking localization and mapping for augmented reality","venue":null,"work_id":"e6104325-da60-4c4b-9eb5-5f58e1e03073","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.770574Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d47c54803ef90c724c4dd5df5589472ecb11cd7107d740a46cefff6a6d808d9d","observation_id":"3c9449fe-3d87-470e-9ac5-87c1cd7ca8db","resolution":{"observed_at":"2026-08-07T15:39:46.799174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.554117Z","title":"Learning to segment referred objects from narrated egocen- tric videos","venue":null,"work_id":"abbed9a5-3dcb-4b77-87a9-5510abbe1e28","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.853287Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:e45cae316f6add7d729d729c3a1d8128644981dd364e1a2367f4d7967f0624d8","observation_id":"9edc5d0c-dab2-4e6c-918a-4f334c11bd90","resolution":{"observed_at":"2026-08-07T15:39:46.652556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.313227Z","title":"Last-mile navigation using smartphones","venue":null,"work_id":"0ad282e7-c378-4e8f-990d-ae3c6e120642","year":2015},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.932720Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d782da1fd0b7eba14bd7006df0ca033e3bff7c615148570790d4a5e25965b196","observation_id":"3fb5fe28-a35d-407c-8cb2-80c301499d60","resolution":{"observed_at":"2026-08-07T15:39:46.414724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.156534Z","title":"Idol: Iner- tial deep orientation-estimation and localization","venue":null,"work_id":"752169d4-5598-4807-b332-9cc662781b1c","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.009033Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:7313bcf6bf0cde0ee24a3bcee7ea98a825f124a21d5fbacae643150e87c34669","observation_id":"9a0b1dc4-eeb1-46a8-ade0-73a08955b71b","resolution":{"observed_at":"2026-08-07T15:39:46.243566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13631","last_updated":"2023-10-29T14:04:25Z","snapshot_observed_at":"2026-08-16T15:21:36.291027Z","submitted_at":"2023-06-23T17:36:44Z","title":"OpenMask3D: Open-Vocabulary 3D Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13631","snapshot_observed_at":"2026-08-07T15:39:40.122061Z","title":"Open- mask3d: Open-vocabulary 3d instance segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.122061Z"},"links":{"cited_paper":"/paper/2306.13631","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2e8f66e5b08fc59b1da61f87be0a5faf5e4858179e3492a18410ba935f6a6970","observation_id":"c1966ac9-e1d8-48fa-83f7-6b8dfc648469","resolution":{"observed_at":"2026-08-07T15:39:40.122061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:45.974256Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":"7f23dd87-a63b-486c-ab98-8c76557eed6a","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.204535Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:321eb262e2131a6b7d54d67ddf51569bc1eb18cb47b492a0a664255f6aa11e17","observation_id":"146fb7ca-14ff-471a-91dc-93f3c4ada970","resolution":{"observed_at":"2026-08-07T15:39:46.075526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:45.706280Z","title":"Mnas- net: Platform-aware neural architecture search for mobile","venue":null,"work_id":"28459ab2-3172-4421-923b-649e4c94143e","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.289977Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:040df764e6891665598c5f06e10cae93378c4d15449cd8d3a6d34b273b0f6d40","observation_id":"66976ade-a720-45ae-b85a-d49acc33ea79","resolution":{"observed_at":"2026-08-07T15:39:45.843843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:45.416393Z","title":"Strapdown inertial nav- igation technology","venue":null,"work_id":"0b335452-31a4-49ec-8070-bf50423c7d42","year":2004},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.396582Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:718227426e3f962ca85e6e2c149c88c0d0088e07c97088d41b9f9324ae59b257","observation_id":"245daa0d-08d4-4dce-b406-fd9bb2d6d713","resolution":{"observed_at":"2026-08-07T15:39:45.542520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:45.138530Z","title":"Attention is all you need","venue":null,"work_id":"5d26881f-e830-4a0a-9bf5-3cd2d8cfff43","year":2017},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.495621Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:0f2b097ff287ac2cdb1c5fc5b8c04f007dc637692239ee7a29770bf2d5c7ed8a","observation_id":"98c6e625-6dcb-479f-9b10-b55a3f81b08e","resolution":{"observed_at":"2026-08-07T15:39:45.266155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.953806Z","title":"Retrieval-augmented egocentric video captioning","venue":null,"work_id":"920c1a52-e541-45ac-a7c9-e3c1039ec1cc","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.623124Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:c999a28a08153aa1c6151cebbda4882fff04e0f8e5c7f4d921bfbde82d169ca1","observation_id":"ee34bb4b-997e-45fd-a418-9f128b209bd1","resolution":{"observed_at":"2026-08-07T15:39:45.053319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.821801Z","title":"Ulip: Learning a unified representation of language, images, and point clouds for 3d understanding","venue":null,"work_id":"9d809871-8191-4831-8688-2b4753dd24fc","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.725051Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d189a9cc92c22276ac04a224cc935db0a48d10e5ac94bffe77de9ef238b951e5","observation_id":"192092bf-46a4-4191-9d58-df4664ad8fa3","resolution":{"observed_at":"2026-08-07T15:39:44.871510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.625763Z","title":"Ridi: Robust imu double integration","venue":null,"work_id":"75b36d46-3aa7-46cf-b207-4acdde7a9a39","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.826823Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:3d044824c9d33323fe3ca7e0d79c36e3e7b42815a8f71c1d9d71f60705410a5f","observation_id":"f062f437-b254-40ea-8530-85ab3d6cacf9","resolution":{"observed_at":"2026-08-07T15:39:44.714474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.422818Z","title":"Egolocate: Real-time motion capture, localization, and map- ping with sparse body-mounted sensors","venue":null,"work_id":"447ce988-60cb-4c29-a658-1fd185312543","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.975025Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:4a89f9f54ffc642935b56e613c635d2e03d671f0eda3990d43d239a31e235dcd","observation_id":"6bd3b1cc-5d81-4930-b841-bc7ab0234601","resolution":{"observed_at":"2026-08-07T15:39:44.509920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.260477Z","title":"Automatic step detection in the accelerometer signal","venue":null,"work_id":"0daa3d78-85f3-44c0-81ec-9ad4f3456ff0","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.159579Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:076010f9726d59c173cf0670d2739de38f70774f798c363f748ce09103e12e1b","observation_id":"35d1ccc0-71f2-4137-a7e7-18dd0d942d2c","resolution":{"observed_at":"2026-08-07T15:39:44.325536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.888668Z","title":"Re- tailopt: Opt-in, easy-to-deploy trajectory estimation from smartphone motion data and retail facility information","venue":null,"work_id":"60a8c701-80ae-4c60-b56a-4f87db311f2e","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.406044Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:4566317dcac20e4b8af70f82adb75199797db63dbdab98c5d44f1896f41c4a53","observation_id":"3effe24c-4f8f-4134-aa86-1908dc2c39e8","resolution":{"observed_at":"2026-08-07T15:39:43.960819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.731252Z","title":"Imunet: Efficient regression architecture for inertial imu nav- igation and positioning","venue":null,"work_id":"b544f751-0d99-4aa5-9432-15d8bd6bbb92","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.559844Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:68ac504aeaf3b7b613acbb024c6d207d39a82a680056a6fb44ad1ad392853ea8","observation_id":"754a219b-641f-4896-aff7-e78b4556d4ba","resolution":{"observed_at":"2026-08-07T15:39:43.813612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.603594Z","title":"Helping hands: An object-aware ego-centric video recog- nition model","venue":null,"work_id":"a5b22b36-75e4-4d75-a594-d044b40eba45","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.714309Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:616323fe551f0e73f026f3a4f31050661346b51c21933db9f530b3652d9e2dc3","observation_id":"4c73b1e0-7c23-4f1e-b48c-9393b3debf63","resolution":{"observed_at":"2026-08-07T15:39:43.662727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.480378Z","title":"Structural multiplane image: Bridging neural view synthesis and 3d reconstruction","venue":null,"work_id":"47ddfa36-6491-4dfe-a9e0-97feaa184c4e","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.827136Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:71ca61725d8324087efddfc0255d900b6487bf1d46a76174a39a77e6e8afb62f","observation_id":"5070c711-c143-4f4c-a3c3-b2a0d3b4770c","resolution":{"observed_at":"2026-08-07T15:39:43.536362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.241315Z","title":"Masked video and body-worn imu autoencoder for egocentric action recognition","venue":null,"work_id":"8a154cd1-219f-489e-8347-843432758503","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.008973Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2a9d853ece68ba24e8a20e0f186e2f7f9dca8612ced9510886c640299103d42e","observation_id":"7b3c07ef-9967-4e2f-8e4d-addffa783c73","resolution":{"observed_at":"2026-08-07T15:39:43.352003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.025402Z","title":"Learning video representations from large language models","venue":null,"work_id":"185028fc-6a95-441e-8a28-ae119f761075","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.243921Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2bca193ce456a1a08af08b00cf90a946224948acf17fda14c0e57a90bcd93263","observation_id":"4bcaf59f-96b3-42e0-b710-eed5c2608d52","resolution":{"observed_at":"2026-08-07T15:39:43.127335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:42.893197Z","title":"While InternVL scores the highest on some metrics, SLIP generally attains stronger localization accuracy","venue":null,"work_id":"ff79e961-cb15-46c5-b1b0-dd47c0edc586","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.312113Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:09609b7f9936f886451fa2493fdce2e957d44060b7caaf44afc73dc82ec07708","observation_id":"44c7b5d8-0536-47a3-bda6-b47af1ea6b15","resolution":{"observed_at":"2026-08-07T15:39:42.945140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:42.776048Z","title":"The heatmaps featured in the video are interpreted similarly to those shown in Fig","venue":null,"work_id":"6fb5f044-4699-4a40-ba15-dfdbd5a3304c","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.406991Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:4c3e0ff140ce4f25150050e3af2780710bbe5b03af373952a6c1a9fbf923440e","observation_id":"9bb439eb-bf9b-49f4-8a38-ea00ac3b7aab","resolution":{"observed_at":"2026-08-07T15:39:42.833180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:42.134828Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":330,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.134828Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:a5d35f2493dcf397eb9df3a8c17b193c594170e4c3c0fea9d20cb174b30dee0b","observation_id":"08dc1c24-b30f-4b5c-8a91-7df63914776e","resolution":{"observed_at":"2026-08-07T15:39:42.134828Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.113047Z","title":"Springer, 2007","venue":null,"work_id":"59554c27-2fe9-4bc1-8536-c9aac1912e52","year":2007},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.292585Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:93a654b15b7c29246cce98ce5f48305db92eb4b0f1b0ebe89abe71fffc0fefbc","observation_id":"7e411b4a-8c07-4048-8a98-bca4646ed033","resolution":{"observed_at":"2026-08-07T15:39:44.176782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T21:12:49.516238Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":9,"verified_exact":1,"verified_fuzzy":63},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2505.14346."}