{"as_of":"2026-08-10T23:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:de002f835365ec598f707b14f98f5262a0783f7a9f0baf7f42c411db1955403a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:55:47.862292Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T18:05:00.962320Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":"2410.06237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bumble: Unifying reasoning and acting with vision-language models for building-wide mobile manipulation","venue":null,"work_id":"2f463d16-11f9-4b5f-9cbe-a563d02b11db","year":2024},"citing_paper":{"arxiv_id":"2502.19417","last_updated":"2025-07-15T17:44:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T18:58:41Z","title":"Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-15T22:53:37.120692Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2502.19417"},"observation_digest":"sha256:137eef487c6eee5c465f337cf44bffbcd39a648bac433de51fe844a5f58140b5","observation_id":"19bdf996-31dd-4e97-9e13-67ad52c450de","resolution":{"observed_at":"2026-05-15T22:53:37.247250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":"2410.06237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bumble: Unifying reasoning and acting with vision-language models for building-wide mobile manipulation","venue":null,"work_id":"2f463d16-11f9-4b5f-9cbe-a563d02b11db","year":2024},"citing_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-22T18:02:23.305313Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2504.16054"},"observation_digest":"sha256:5dfd0ab75ea5eaf1ec0b829bb2c41f54068910f914ca98775a5dead71d7314d8","observation_id":"f97ab4cc-78e7-4a97-a4b3-034f09c98d90","resolution":{"observed_at":"2026-05-22T18:05:00.963893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-08-07T11:55:47.862292Z","title":"Bumble: Unifying reasoning and acting with vision-language models for building-wide mobile manipula- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01174","last_updated":"2025-06-01T21:13:38Z","snapshot_observed_at":"2026-08-10T03:01:56.494818Z","submitted_at":"2025-06-01T21:13:38Z","title":"GraphPad: Inference-Time 3D Scene Graph Updates for Embodied Question Answering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:47.862292Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2506.01174"},"observation_digest":"sha256:979c69fd9d7be0fa0cb54b862b81cec0ce7d71a1fd354e3d1b99ceeec9a482cc","observation_id":"d7281bd9-6ec3-4add-aa20-444ee6eb7638","resolution":{"observed_at":"2026-08-07T11:55:47.862292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-08-07T00:14:10.931859Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-08T23:40:41.478391Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.931859Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:63f7077ef041cbea56f99a9a78ae50a2969e68daa3cbb0d876ae3315a5d7e7c9","observation_id":"cfd060c8-63cc-45e1-93ec-c4f6eb9e9701","resolution":{"observed_at":"2026-08-07T00:14:10.931859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-08-05T12:59:08.298139Z","title":"Bumble: Unifying reasoning and acting with vision-language models for building-wide mobile manipulation.arXiv preprint arXiv:2410.06237, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01106","last_updated":"2025-09-11T12:40:54Z","snapshot_observed_at":"2026-08-07T21:46:58.502468Z","submitted_at":"2025-09-01T03:53:47Z","title":"Robix: A Unified Model for Robot Interaction, Reasoning and Planning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T12:59:08.298139Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2509.01106"},"observation_digest":"sha256:5cb82a32cc167995e86d79758520c442589539ccdb981dbe38762be5d9d844dd","observation_id":"927c008b-31f1-4c62-a208-4ce12561b9aa","resolution":{"observed_at":"2026-08-05T12:59:08.298139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-08-05T12:19:11.828565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01746","last_updated":"2025-09-01T20:00:56Z","snapshot_observed_at":"2026-08-08T07:30:31.082559Z","submitted_at":"2025-09-01T20:00:56Z","title":"Fail2Progress: Learning from Real-World Robot Failures with Stein Variational Inference","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T12:19:11.828565Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2509.01746"},"observation_digest":"sha256:a54d1f9c46dbfbd7c3e723f45e060197c71b760f0d0d7967ba40a22cd4b1794e","observation_id":"a019563c-784b-42e2-a768-e1fddf7d1995","resolution":{"observed_at":"2026-08-05T12:19:11.828565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":"2410.06237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bumble: Unifying reasoning and acting with vision-language models for building-wide mobile manipulation","venue":null,"work_id":"2f463d16-11f9-4b5f-9cbe-a563d02b11db","year":2024},"citing_paper":{"arxiv_id":"2605.00943","last_updated":"2026-05-01T07:11:58Z","snapshot_observed_at":"2026-08-07T23:24:29.615012Z","submitted_at":"2026-05-01T07:11:58Z","title":"ARIS: Agentic and Relationship Intelligence System for Social Robots","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-09T19:24:45.954058Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2605.00943"},"observation_digest":"sha256:48d59cdbaf1b8820f20c0725d7dd27e9c1b5df1229acb7bb7b26697b78f92e89","observation_id":"bd6b9717-148e-4eb2-be04-797c34ffb3df","resolution":{"observed_at":"2026-05-11T15:41:59.154355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-07-11T07:35:42.995772Z","title":"Bumble: Unifying reason- ing and acting with vision-language models for building-wide mobile manipula- tion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05482","last_updated":"2026-07-06T15:47:34Z","snapshot_observed_at":"2026-07-11T07:35:42.743004Z","submitted_at":"2026-07-06T15:47:34Z","title":"TypeGo: An OS Runtime for Embodied Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T07:35:42.995772Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2607.05482"},"observation_digest":"sha256:fbc57441a42b32251dfe4cfaa3c3fa1a9a6114d5bbbae83637a47ce7d7623597","observation_id":"26ad3408-d423-480f-99bf-a308c339486f","resolution":{"observed_at":"2026-07-11T07:35:42.995772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.06237/citation-record","integrity":"/paper/2410.06237/integrity","json":"/paper/2410.06237/citation-record.json","paper":"/paper/2410.06237"},"outbound":[],"paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2410.06237."}