{"as_of":"2026-08-10T11:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c09f701a938008c58129368375c411f7465ac5d9afd3353a5049c89473178122","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:38:45.952148Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T14:50:58.269817Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T14:51:08.143302Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"cited_work":{"arxiv_id":"2507.15428","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.15428","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Egoprune: Efficient token pruning for egomotion video reasoning in embodied agent","venue":null,"work_id":"3437e9cb-4a5b-4846-9284-81368c979fd6","year":2025},"citing_paper":{"arxiv_id":"2603.07080","last_updated":"2026-04-29T05:35:06Z","snapshot_observed_at":"2026-07-06T22:48:13.053749Z","submitted_at":"2026-03-07T07:30:35Z","title":"VLN-Cache: Enabling Token Caching for VLN Models with Visual/Semantic Dynamics Awareness","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T14:50:58.269817Z"},"links":{"cited_paper":"/paper/2507.15428","citing_paper":"/paper/2603.07080"},"observation_digest":"sha256:81ec9b7463de5f8c344528a1615d043290726c85b23c58f261b2165965b7c209","observation_id":"3e842103-481d-4aea-9f11-109299d4f7bc","resolution":{"observed_at":"2026-05-15T14:51:08.146628Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.15428/citation-record","integrity":"/paper/2507.15428/integrity","json":"/paper/2507.15428/citation-record.json","paper":"/paper/2507.15428"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T15:38:41.950030Z","title":"L.; Almeida, D.; Altenschmidt, J.; Altman, S.; Anadkat, S.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:41.950030Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:1952d6caf4b3c700a3a2fe427ebcb19f27b896fc95c761afd565c9c098ba40ee","observation_id":"56dbe068-b6cc-4294-a171-d90fb95fe4b1","resolution":{"observed_at":"2026-08-06T15:38:41.950030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:49.455220Z","title":"R.; Singh, G.; Akbari, M.; and Zhang, Y","venue":null,"work_id":"f3af8413-cada-451e-a4b1-7b6e6d89198f","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:41.975235Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:6b7eca3063d27dcd2cca2c7ac83cb10e76601f4d8c36d5f7d23a19246856cba4","observation_id":"f1919ae0-038b-4229-9e6f-8834da671e74","resolution":{"observed_at":"2026-08-06T15:38:49.520371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:42.067642Z","title":"Y.; Rajbhandari, S.; Awan, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.067642Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:e4cbc363be681fa3265bcf228213decdeb520443de17f89bea36d98623c1ae91","observation_id":"b4106f33-cd61-477d-9985-2dba92209a95","resolution":{"observed_at":"2026-08-06T15:38:42.067642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T15:38:42.119523Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.119523Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:7b03d1a1fecf7444a1da2ac54558d8267c58db6a6f6438f9e0e759825c7ae0b8","observation_id":"d4a59c0f-2ef7-47f7-b87d-fdbc293f6f3e","resolution":{"observed_at":"2026-08-06T15:38:42.119523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:49.323772Z","title":null,"venue":null,"work_id":"06cfc211-bec3-4c08-ae26-baf23c9a2a44","year":1981},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.207757Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:30b0ab5cd63721af9d132bb41ea689a273df25153d395041ea8c93ef295f0623","observation_id":"b9207992-90e6-4111-83d2-9a3b5113ca8b","resolution":{"observed_at":"2026-08-06T15:38:49.369512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:49.179847Z","title":null,"venue":null,"work_id":"8efadbcd-2f8a-4759-a2f3-804b36abf31c","year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.291922Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:c706db45fa172f24e23aafadd362f66225e79401b466178701fc09a50f9d68e3","observation_id":"be54bec2-6cd8-4206-b486-fc9dba9a2031","resolution":{"observed_at":"2026-08-06T15:38:49.246604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:49.041903Z","title":null,"venue":null,"work_id":"f9f48e0a-82e3-42b6-bf11-5f5e3d960d0c","year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.382359Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:06c7333ba5ab1d829d6fcefcdb1cca12cfbad852597af5cd1b6b8dabc0fce35b","observation_id":"46ee951a-305b-4d75-af65-8c237b50a789","resolution":{"observed_at":"2026-08-06T15:38:49.099807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:42.477922Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.477922Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:26279571488b7dd0633c2ffab4c0be5c7291514ed28f45995925b8d80b2b15ac","observation_id":"4ac0724a-20f7-47e0-929f-71fbaddbc0a2","resolution":{"observed_at":"2026-08-06T15:38:42.477922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:48.913492Z","title":null,"venue":null,"work_id":"9c8b8513-3b5c-44e7-8481-d271d7be5d96","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.610393Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:6677675aeccc065540e75d09784dcc561c207ac9cdf153014db77dad4cfce179","observation_id":"71180714-fd33-44ba-bd92-53cd72f1e4d0","resolution":{"observed_at":"2026-08-06T15:38:48.958553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T15:38:42.683817Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.683817Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:8a9ad047c5dde59e36b104572ee24fbb41d44eca267b159110edcbb1b8827eba","observation_id":"bfa314a0-0e21-48d5-b840-e651b8a68c41","resolution":{"observed_at":"2026-08-06T15:38:42.683817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:48.747414Z","title":null,"venue":null,"work_id":"d1a848b2-f922-4fa5-8201-7df055b7d822","year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.763419Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:7ebea0c3ec88f48e07bbc1f14cbe584f3abb4c162984dea84591731866e628c2","observation_id":"f05ec387-8055-46a4-83bb-501158dcf80f","resolution":{"observed_at":"2026-08-06T15:38:48.795541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:48.611484Z","title":"J.; Jajal, P.; Davis, J","venue":null,"work_id":"2dba6385-444c-45c2-9d41-d76575f636f0","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.856976Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:abe25fbf95d0e5e92b36d73b344d6e7a7ada4084300b20c37da1a0eee58b296f","observation_id":"a9780ded-e403-457e-91d6-02d58c22698b","resolution":{"observed_at":"2026-08-06T15:38:48.663944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:42.924749Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:42.924749Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:42797ffd0a82e83afaca37b2d45f28ea83ea5f2449650fc2be3bd4d630434c78","observation_id":"a7d86d45-83ed-4223-8015-2a37d398dc58","resolution":{"observed_at":"2026-08-06T15:38:42.924749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-06T15:38:43.006175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.006175Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:c14d84b5ea8a72a316c96d58507ffef7ab5b2e859923c671eef89e950051c335","observation_id":"a1a6c153-3719-4612-bd49-0ed19b041091","resolution":{"observed_at":"2026-08-06T15:38:43.006175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:43.097173Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.097173Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:addc7a96c49a8e04a428c95c5b6779a770514c4688bc937fa8b7a18df4afa79c","observation_id":"63dd22cf-0af1-4028-9032-ea85a420715e","resolution":{"observed_at":"2026-08-06T15:38:43.097173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13956","last_updated":"2025-06-18T08:04:33Z","snapshot_observed_at":"2026-08-07T16:55:46.935677Z","submitted_at":"2025-03-18T06:48:08Z","title":"Improving LLM Video Understanding with 16 Frames Per Second","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13956","snapshot_observed_at":"2026-08-06T15:38:43.162526Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.162526Z"},"links":{"cited_paper":"/paper/2503.13956","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:5967a8aa1bd11076f44cf27be02064332e2d5d0fd6e497d71f1ecda62ab63336","observation_id":"e4edf8d9-2055-4ef3-9d9c-be339becbab4","resolution":{"observed_at":"2026-08-06T15:38:43.162526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:48.477518Z","title":null,"venue":null,"work_id":"ff8f63b1-f5f5-4524-a9be-c62b5ba3ebe5","year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.235342Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:d0aac0db99fde1bf1d8ba38f981c98a864a85a85c6d3f211499c54198b1743da","observation_id":"50284853-06e4-4934-bf48-13725c06e4b8","resolution":{"observed_at":"2026-08-06T15:38:48.537233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:43.315649Z","title":"Q.; Wang, J.; Soldan, M.; Wray, M.; Yan, R.; Xu, E","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.315649Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:5f51dd8bd444fa74900c4421e7cc3cadbebdca9cff72205039b3a3ffed673c3e","observation_id":"e35cbd2a-a4d2-4eb2-9c19-d0ab1dadfcf9","resolution":{"observed_at":"2026-08-06T15:38:43.315649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:48.356720Z","title":null,"venue":null,"work_id":"20c0c927-1f70-416e-b4c2-a41e6536dc8d","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.392303Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:a69f45b2db160737342ed0947dab03c6be6f9b86ad454601667c40185deccb41","observation_id":"5e52042c-45f4-473a-a365-c7f4e223a428","resolution":{"observed_at":"2026-08-06T15:38:48.416500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:43.478608Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.478608Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:071b8328d939ad84b5c903383db9976b77d3187e763e6e7a5350e7b09e36134c","observation_id":"961aa130-3ae2-4b24-acef-df7d4462b668","resolution":{"observed_at":"2026-08-06T15:38:43.478608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-06T15:38:43.542525Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.542525Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:4f1d0ec80e9dabb7e06afb5cad62ccf520d5483f4232dd42b01ad3245a215126","observation_id":"14fd29b8-ade7-4a14-8fe4-a11e9a1f509d","resolution":{"observed_at":"2026-08-06T15:38:43.542525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14504","last_updated":"2025-02-20T12:31:31Z","snapshot_observed_at":"2026-08-08T00:46:02.547013Z","submitted_at":"2025-02-20T12:31:31Z","title":"PLPHP: Per-Layer Per-Head Vision Token Pruning for Efficient Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2502.14504","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.14504","snapshot_observed_at":"2026-08-06T15:38:46.491544Z","title":"PLPHP: Per-Layer Per-Head Vision Token Pruning for Efficient Large Vision-Language Models","venue":"cs.CV","work_id":"08c2882f-cf94-4a06-8084-7e62c8f530b0","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.617403Z"},"links":{"cited_paper":"/paper/2502.14504","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:02f5ffbdb3fb02375defffe52a504e60c592ae827c80eb7c8615cb32f3f006ee","observation_id":"33b96bcb-d5e4-49bb-993f-60a4551697d4","resolution":{"observed_at":"2026-08-06T15:38:46.573996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:48.195661Z","title":"A.; Pistilli, F.; Alliegro, A.; and Averta, G","venue":null,"work_id":"e5d21ef2-cbe2-43db-b901-26347a343423","year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.696743Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:fcaf0ec764e8ae07201dc82aeb227f7fc732382507f8c295f7e442eb191ea45c","observation_id":"d84fe0f1-f01a-4ed3-9463-b8a5cf8bdbea","resolution":{"observed_at":"2026-08-06T15:38:48.278030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:43.802860Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.802860Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:9020898a045de626bfc2afef8b19cd0061b7e529c9ac0e0b4335a0df0ecd2a1d","observation_id":"4b18e449-11f9-476e-a992-3a5f3b0bb5a7","resolution":{"observed_at":"2026-08-06T15:38:43.802860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18003","last_updated":"2024-11-20T02:04:10Z","snapshot_observed_at":"2026-07-06T18:51:49.871551Z","submitted_at":"2024-07-25T12:56:22Z","title":"Keep the Cost Down: A Review on Methods to Optimize LLM' s KV-Cache Consumption","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18003","snapshot_observed_at":"2026-08-06T15:38:43.886353Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.886353Z"},"links":{"cited_paper":"/paper/2407.18003","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:a81d29e8105ef87ecc68b377b093d5b000ec328071e12bef22949cc3cf8a2408","observation_id":"a39092e4-3a0b-44e8-ade1-6d67846053ab","resolution":{"observed_at":"2026-08-06T15:38:43.886353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13807","last_updated":"2024-06-21T09:53:41Z","snapshot_observed_at":"2026-07-06T18:33:54.443005Z","submitted_at":"2024-06-19T20:14:14Z","title":"AlanaVLM: A Multimodal Embodied AI Foundation Model for Egocentric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13807","snapshot_observed_at":"2026-08-06T15:38:43.950532Z","title":"L.; Papaioannou, I.; Eshghi, A.; Konstas, I.; and Lemon, O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:43.950532Z"},"links":{"cited_paper":"/paper/2406.13807","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:ca886fa9951adff1ab7b0a3c66e1745063a844784b73af3cadbf2932ea5d67da","observation_id":"da1fcaa3-c76b-4cb6-a7b7-28e65f9900a1","resolution":{"observed_at":"2026-08-06T15:38:43.950532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:48.018451Z","title":null,"venue":null,"work_id":"f89249df-fbe3-4024-b4e9-296a98fc61ee","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.002709Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:d2bcb32c20a6bf279203161bc44c5710c8e72dae94de014a81e57e1c7e0715ed","observation_id":"1eb42a30-4137-4c27-8820-0aea4ce1dc15","resolution":{"observed_at":"2026-08-06T15:38:48.096699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:47.803642Z","title":null,"venue":null,"work_id":"2ff994da-0e20-42ed-8915-b3cc00a6e5da","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.066794Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:a3085d0b6131a969ab7e9ff6f53ba93b66a15304f8f7873bd5c02e9c8ce10bb9","observation_id":"0857d214-8b09-4b32-bde2-a8db65a697b5","resolution":{"observed_at":"2026-08-06T15:38:47.881301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:47.626702Z","title":null,"venue":null,"work_id":"cbabb7b3-e643-4833-97ab-f8e0ef12355d","year":2022},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.139816Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:bbb61e71e30d94d824df1feb8f9e6aa3fbbfc0fce339c348930c7f9ea9b388ae","observation_id":"182443fa-cc71-4c36-9575-6ad3d9662bb8","resolution":{"observed_at":"2026-08-06T15:38:47.699319Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:44.228748Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.228748Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:29fa738722ffe0e851098aa56d28b4cb0dec324cd8a2646dfe8fa7b6316b675a","observation_id":"07447d08-1456-429d-b99b-4a80fdb0a4a8","resolution":{"observed_at":"2026-08-06T15:38:44.228748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11501","last_updated":"2025-05-29T09:18:35Z","snapshot_observed_at":"2026-08-10T07:38:53.356666Z","submitted_at":"2025-02-17T07:05:36Z","title":"Token Pruning in Multimodal Large Language Models: Are We Solving the Right Problem?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11501","snapshot_observed_at":"2026-08-06T15:38:44.318646Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.318646Z"},"links":{"cited_paper":"/paper/2502.11501","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:0ecf2f4214144e65e281e35d30b4e7901b31452230a18aa2e6a53b7f9bc17af3","observation_id":"47c54d47-f78f-446e-8beb-358f76c9e1b1","resolution":{"observed_at":"2026-08-06T15:38:44.318646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:47.362201Z","title":"H.; Wang, Y.; and Ma, J","venue":null,"work_id":"f1f104bf-e3ba-4924-8d24-f284c317f355","year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.380646Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:ff3ebceab6830fc6eaa2ca99e5ee223317ba3699fd9e4f1ffbbc188d6a467b30","observation_id":"a90730fa-8523-4b70-8c56-9b0562cdcd15","resolution":{"observed_at":"2026-08-06T15:38:47.481198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17247","last_updated":"2025-02-27T11:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T17:59:53Z","title":"PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17247","snapshot_observed_at":"2026-08-06T15:38:44.422057Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.422057Z"},"links":{"cited_paper":"/paper/2410.17247","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:ac9038f10e4c58d3c2e911d98a2f34f398722bfd7a21b4630db6690c1224932d","observation_id":"03b13a67-1de6-4038-bf0c-4304751599c1","resolution":{"observed_at":"2026-08-06T15:38:44.422057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:44.481583Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.481583Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:e06bc72f8cba5552238ac457b2a2f1ac5dc9675559279067e4e5a88fa9fc3f33","observation_id":"547caa49-6551-435d-917b-d1d744db11ba","resolution":{"observed_at":"2026-08-06T15:38:44.481583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:47.163634Z","title":"W.; Han, R.; Fei-Fei, L.; and Xie, S","venue":null,"work_id":"ffa045f7-07b8-44f8-b351-18d61f26df0c","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.548579Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:65b2aeb2b6ec90261a36b9f60a74dad9b0e260fe975375e54b85c0495e24f3df","observation_id":"aeb21ae8-74aa-47d0-a8d8-7f338a969c23","resolution":{"observed_at":"2026-08-06T15:38:47.245362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:46.979838Z","title":null,"venue":null,"work_id":"eb5cae3b-bbea-434a-ba19-af393870b01c","year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.643620Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:449b272c0b9e02407ff2afb1c8693d5f5d029bc1bc740fe86c0191a4ca3b347d","observation_id":"d47c5892-a8bb-4b80-a166-993b6f6cd56d","resolution":{"observed_at":"2026-08-06T15:38:47.075019Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17343","last_updated":"2025-04-24T07:59:46Z","snapshot_observed_at":"2026-08-07T15:59:37.866387Z","submitted_at":"2025-04-24T07:59:46Z","title":"TimeChat-Online: 80% Visual Tokens are Naturally Redundant in Streaming Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17343","snapshot_observed_at":"2026-08-06T15:38:44.871097Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:44.871097Z"},"links":{"cited_paper":"/paper/2504.17343","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:d61e2a7a54c0332e80c46dafa5f29240773ee2c8cb6eae53017a7c7320c7f0b3","observation_id":"d938463f-64c3-4ad2-8bb0-0f1ac0dd97a6","resolution":{"observed_at":"2026-08-06T15:38:44.871097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:45.046021Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.046021Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:02ac93a50b271d7f04c4b8e67af580cd8e43a1f534e5aa293dd583e56b9a45fe","observation_id":"e14d7898-b98d-4291-869d-fcd8db78fdcf","resolution":{"observed_at":"2026-08-06T15:38:45.046021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-07-06T15:38:39.712379Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-06T15:38:45.172437Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.172437Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:38a5463d16ee4240d59577ad2508f986917e93211603b3f2368e6da790f2f9c5","observation_id":"a100daee-a229-48a7-b946-3ef67bac9ee6","resolution":{"observed_at":"2026-08-06T15:38:45.172437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12772","last_updated":"2025-05-05T04:48:45Z","snapshot_observed_at":"2026-07-06T18:47:56.109836Z","submitted_at":"2024-07-17T17:51:53Z","title":"LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12772","snapshot_observed_at":"2026-08-06T15:38:45.376369Z","title":"A.; Hu, K.; Liu, S.; Zhang, Y.; Yang, J.; Li, C.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.376369Z"},"links":{"cited_paper":"/paper/2407.12772","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:c557bf8b856b02f0872cc499617d78b2c0863c0290ad658f50f2761d32e5c998","observation_id":"20eedbe1-69b8-46a6-adc3-00dd90e4df93","resolution":{"observed_at":"2026-08-06T15:38:45.376369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10967","last_updated":"2025-07-01T08:19:08Z","snapshot_observed_at":"2026-08-08T17:11:06.528222Z","submitted_at":"2025-06-12T17:59:09Z","title":"Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10967","snapshot_observed_at":"2026-08-06T15:38:45.462835Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.462835Z"},"links":{"cited_paper":"/paper/2506.10967","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:ba01a67dc8ade1155eb9fe123923e32d89f36775a1e769ab26198a27f0a9970c","observation_id":"00c809f9-844e-4f80-8722-f6bc21ce394c","resolution":{"observed_at":"2026-08-06T15:38:45.462835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-06T15:38:45.527724Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.527724Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:2e8d4969cc1629ba56255944b3f746dacde79c6cfdd1c5e0e9212d8361823ca4","observation_id":"da2a2cfb-ce36-4457-8938-c5ab46742040","resolution":{"observed_at":"2026-08-06T15:38:45.527724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:45.600485Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.600485Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:c2c5ddbba3f8dd1d77bd263f26e0f15e53bdee4cff83852c603add4f98c68533","observation_id":"48628f5e-3680-4cee-90fa-d9a925a913be","resolution":{"observed_at":"2026-08-06T15:38:45.600485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12680","last_updated":"2025-04-17T06:16:11Z","snapshot_observed_at":"2026-08-07T16:01:36.502631Z","submitted_at":"2025-04-17T06:16:11Z","title":"Embodied-R: Collaborative Framework for Activating Embodied Spatial Reasoning in Foundation Models via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12680","snapshot_observed_at":"2026-08-06T15:38:45.707218Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.707218Z"},"links":{"cited_paper":"/paper/2504.12680","citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:1422f11bccbc209c5c6168d90a8df77fe794e069d516e431237a283dd167db72","observation_id":"e755f308-cb24-4476-a818-f080050e9f5a","resolution":{"observed_at":"2026-08-06T15:38:45.707218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:45.796906Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.796906Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:4a33ab65a063620d85079ccb17e731ca3a5fb800c534ecfddea87ba280a78b99","observation_id":"7b476f44-d19b-465c-8478-b0034375e911","resolution":{"observed_at":"2026-08-06T15:38:45.796906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:45.952148Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T15:38:45.952148Z"},"links":{"citing_paper":"/paper/2507.15428"},"observation_digest":"sha256:2f73cad0c4ba617f348d4b3defb64e52fb70e6feb89ba71d40cf8d27616a248f","observation_id":"8824a461-59e1-4733-bc21-eb01bc905533","resolution":{"observed_at":"2026-08-06T15:38:45.952148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.15428","last_updated":"2025-07-21T09:27:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T22:42:41.641573Z","submitted_at":"2025-07-21T09:27:45Z","title":"EgoPrune: Efficient Token Pruning for Egomotion Video Reasoning in Embodied Agent"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2507.15428."}