{"as_of":"2026-08-12T14:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e772ebe82aa2f5695ee1c15dcb52e211053a8913a2ee9931c8c8e9cf296dbdb9","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:34:09.950077Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.21250/citation-record","integrity":"/paper/2506.21250/integrity","json":"/paper/2506.21250/citation-record.json","paper":"/paper/2506.21250"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.03094","last_updated":"2023-05-28T07:32:38Z","snapshot_observed_at":"2026-08-07T13:44:24.778030Z","submitted_at":"2022-10-06T17:50:11Z","title":"VIMA: General Robot Manipulation with Multimodal Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03094","snapshot_observed_at":"2026-08-06T22:34:05.695868Z","title":"Vima: General robot manip- ulation with multimodal prompts,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:05.695868Z"},"links":{"cited_paper":"/paper/2210.03094","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:d6786465825466719250787e829fbc1ecfda5e977aa8b8f858abf1a68f787e68","observation_id":"c2e14552-e356-442b-b162-1293a29891e7","resolution":{"observed_at":"2026-08-06T22:34:05.695868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:15.246377Z","title":"Cliport: What and where pathways for robotic manipulation,","venue":null,"work_id":"46fbd73f-bbb2-4f7a-9546-a808663f904f","year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:05.793845Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:17c0a73a674d7b7dd6c54374fb1549eb3f162b01037324a2f429cd101c50113b","observation_id":"d0d6ad18-5a0b-4bac-aa5c-84d75258ecf1","resolution":{"observed_at":"2026-08-06T22:34:15.315662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09676","last_updated":"2024-05-28T01:33:37Z","snapshot_observed_at":"2026-08-12T10:11:26.725767Z","submitted_at":"2023-10-14T22:24:58Z","title":"Mastering Robot Manipulation with Multimodal Prompts through Pretraining and Multi-task Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09676","snapshot_observed_at":"2026-08-06T22:34:05.955444Z","title":"Mastering robot manipulation with multimodal prompts through pretraining and multi-task fine-tuning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:05.955444Z"},"links":{"cited_paper":"/paper/2310.09676","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:46cab0112d8d52fcae5722c2dcce396c5005fd2c8168457dc72c30938985e85e","observation_id":"065e3ccc-7b2c-402e-bdcf-7a848026e07a","resolution":{"observed_at":"2026-08-06T22:34:05.955444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:06.038460Z","title":"Calvin: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:06.038460Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:50a674cac3b885e50280b16a8da96f1f0d5ec7a2288716cf6f4cbad8d82439c0","observation_id":"748f74db-ff43-4a7e-b361-2a4b0746d096","resolution":{"observed_at":"2026-08-06T22:34:06.038460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-08T22:04:13.117781Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-06T22:34:06.269291Z","title":"Palm-e: An embodied multimodal language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:06.269291Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:e2dbf124b367c99ec8c8df49805c8b67d6534c5cda451a2a97d6979251988724","observation_id":"9587ffe8-f932-40e7-9d7a-caf6397504f1","resolution":{"observed_at":"2026-08-06T22:34:06.269291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-06T22:34:06.421490Z","title":"Rt-1: Robotics transformer for real-world control at scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:06.421490Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:33637e0bb0626b407ad5c9f10fb9d9fd6fafe480c7d744a08aaf86ffe0920357","observation_id":"fa26ac5c-497d-4a9d-910e-a243197c516b","resolution":{"observed_at":"2026-08-06T22:34:06.421490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:15.026010Z","title":"Understanding natural language commands for robotic navigation and mobile manipulation,","venue":null,"work_id":"995eb069-3be7-4cec-8048-c776fbc0d789","year":2011},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:06.593137Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:6f16537506f08ec1f43f1beb127293ed039046282696a5724475c2c23008a665","observation_id":"d4972fce-dd48-4144-bd14-997f2c0a6a29","resolution":{"observed_at":"2026-08-06T22:34:15.114337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11176","last_updated":"2023-05-24T04:17:34Z","snapshot_observed_at":"2026-07-06T15:29:20.405296Z","submitted_at":"2023-05-18T17:59:49Z","title":"Instruct2Act: Mapping Multi-modality Instructions to Robotic Actions with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11176","snapshot_observed_at":"2026-08-06T22:34:06.759535Z","title":"Instruct2act: Mapping multi-modality instructions to robotic actions with large language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:06.759535Z"},"links":{"cited_paper":"/paper/2305.11176","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:cea9c8ceb37f713d9e492c03708fc9944b6b5d98bdc00057650faff797030afc","observation_id":"c0190b68-6726-4d51-925c-eb772a4a5cb2","resolution":{"observed_at":"2026-08-06T22:34:06.759535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-11T08:36:53.636356Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-06T22:34:06.871309Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:06.871309Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:a93dceb1e461781367bc95f90dfa722a6ae4d740bd1228fb2451b7bb919d5cdb","observation_id":"8034934a-aed6-4a0c-989f-8d9236232a4b","resolution":{"observed_at":"2026-08-06T22:34:06.871309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:14.870802Z","title":"Policy adaptation from foundation model feedback,","venue":null,"work_id":"8c3593ac-5a07-4ff5-899a-8a83701378e0","year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:06.973647Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:ed4463015c6c60cc02f02ddf56b957a7d7b5a0177ac8d38ae2f024e442e2b895","observation_id":"2dd77612-a29d-4f7d-ac99-7c3666d3cd22","resolution":{"observed_at":"2026-08-06T22:34:14.944666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13826","last_updated":"2023-04-26T20:56:40Z","snapshot_observed_at":"2026-08-12T13:46:26.580523Z","submitted_at":"2023-04-26T20:56:40Z","title":"Programmatically Grounded, Compositionally Generalizable Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13826","snapshot_observed_at":"2026-08-06T22:34:07.098920Z","title":"Programmat- ically grounded, compositionally generalizable robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.098920Z"},"links":{"cited_paper":"/paper/2304.13826","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:29a6743554a28d3635981d9e5225179ebf03bd4f56d20ef15a6d68f1f2fac0e5","observation_id":"4d834f1f-e923-4dc1-b89e-e91ec596f5e3","resolution":{"observed_at":"2026-08-06T22:34:07.098920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11886","last_updated":"2024-01-29T17:28:20Z","snapshot_observed_at":"2026-08-07T09:10:19.330948Z","submitted_at":"2023-06-20T20:59:10Z","title":"SPRINT: Scalable Policy Pre-Training via Language Instruction Relabeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11886","snapshot_observed_at":"2026-08-06T22:34:07.219900Z","title":"Sprint: Scalable policy pre-training via language instruction relabeling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.219900Z"},"links":{"cited_paper":"/paper/2306.11886","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:a9d2d8c945d2b004748e8d720dbf292d034d970d1b5cc8748377b4a182fbad2a","observation_id":"234bbfda-8b85-4b10-aeff-9e19fdb23b8a","resolution":{"observed_at":"2026-08-06T22:34:07.219900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00958","last_updated":"2023-06-01T17:52:23Z","snapshot_observed_at":"2026-08-06T20:32:01.174179Z","submitted_at":"2023-06-01T17:52:23Z","title":"LIV: Language-Image Representations and Rewards for Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00958","snapshot_observed_at":"2026-08-06T22:34:07.321935Z","title":"Liv: Language-image representations and rewards for robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.321935Z"},"links":{"cited_paper":"/paper/2306.00958","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:5d48d1491ab74ece180366d887d5a951748968efb79b35ee64d815abd8d38842","observation_id":"c34df5fc-d3db-4fe0-82bc-95ef4fdce82d","resolution":{"observed_at":"2026-08-06T22:34:07.321935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:14.707172Z","title":"Reward design with language models,","venue":null,"work_id":"2173eee9-429d-4cd7-b05f-cc1c9336bac9","year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.450202Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:5e623bcfbdaf16b480b9aae11a9bc0884dfac54438370f90b9960b06b6a9cc87","observation_id":"1ba05781-4933-44f5-88f4-0c64a23f4219","resolution":{"observed_at":"2026-08-06T22:34:14.792545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-08-07T14:05:45.642543Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-06T22:34:07.558279Z","title":"Language to rewards for robotic skill synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.558279Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:acc23295df3aec840468ea271dea98a82bdf5edfb7d9cb059a7cdefa7a1e74f7","observation_id":"9ac9f634-29b9-4390-89fc-1d9dc1a80649","resolution":{"observed_at":"2026-08-06T22:34:07.558279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:14.559641Z","title":"Learning reward functions from diverse sources of human feedback: Optimally integrating demonstrations and preferences,","venue":null,"work_id":"5f17efd4-b7a1-40ed-8157-1430f783ff91","year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.673660Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:d3daa9fad2706ff24276cc5c6a39086a11ecef3a10bfd222145a9672c1d7d601","observation_id":"13209cc9-00d7-4e39-a934-4804ba8de4c6","resolution":{"observed_at":"2026-08-06T22:34:14.617055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-06T22:34:07.760328Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.760328Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:26bb6b6ecca1f78f274171e207f071fe4f96de397f3e62b6781d377a9dbb8312","observation_id":"3e38b1c1-b8e2-416f-bf70-461e69ae78ae","resolution":{"observed_at":"2026-08-06T22:34:07.760328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:14.394125Z","title":"Self-supervised 6d object pose estimation for robot manipulation,","venue":null,"work_id":"738c40b0-e6dd-4a04-9d5a-7a1489db593b","year":2020},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.831247Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:5bd1932b53c340bbb57ecff6c6a547c8fe2f8f6207213b849930689b37b6eac3","observation_id":"77dc246a-a543-4e9d-a7d4-692476309363","resolution":{"observed_at":"2026-08-06T22:34:14.497384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:14.242851Z","title":"The best of both modes: Separately leveraging rgb and depth for unseen object instance segmentation,","venue":null,"work_id":"ce8b5095-7a01-4011-a485-adeceff8d883","year":2020},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.873574Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:940d16bb2f215217f235f465fa09ee377431a449b6ec78eb5cc7d9f77898cc31","observation_id":"ce8f7226-230e-4956-857a-3aa84e9f4221","resolution":{"observed_at":"2026-08-06T22:34:14.325747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10293","last_updated":"2018-11-28T02:40:54Z","snapshot_observed_at":"2026-08-02T20:30:39.614115Z","submitted_at":"2018-06-27T04:34:30Z","title":"QT-Opt: Scalable Deep Reinforcement Learning for Vision-Based Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.10293","snapshot_observed_at":"2026-08-06T22:34:07.987511Z","title":"Qt- opt: Scalable deep reinforcement learning for vision-based robotic manipulation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:07.987511Z"},"links":{"cited_paper":"/paper/1806.10293","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:d9e212226903f34c8856c8c4e68648f1774510d25f53ea27e5dbd769ec6d7181","observation_id":"bf85238b-03e3-42d7-a6b0-51edb3c2a762","resolution":{"observed_at":"2026-08-06T22:34:07.987511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:14.054851Z","title":"Learning efficient illumination multiplexing for joint capture of reflectance and shape","venue":null,"work_id":"3689efd9-5cd8-4527-a486-023683289efd","year":2019},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.037144Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:f7766968609e045d8acce78c5398754fe4002f8ca8441d01160d2a3b246a3fe3","observation_id":"f7b08611-b7ea-4412-8890-3cd787833f0d","resolution":{"observed_at":"2026-08-06T22:34:14.162748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:13.912252Z","title":"Coarse-to- fine q-attention: Efficient learning for visual robotic manipulation via discretisation,","venue":null,"work_id":"b57c6591-7015-49df-9047-53e62899d726","year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.040499Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:518d6b0cad5fab5e904f08401239b1fc9214e494fc790cf65456f5277533bae2","observation_id":"59912bb7-6d17-4e5a-bfbb-dd1807106524","resolution":{"observed_at":"2026-08-06T22:34:13.981654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:13.728961Z","title":"Transporter networks: Rearranging the visual world for robotic manipulation,","venue":null,"work_id":"60c49341-8e68-4a21-b8cf-826b41845aa4","year":2021},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.044847Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:ef5d13564e65818ee4adec7b20ff645ee167541288b7210a8a8eee8cd32c554e","observation_id":"5d183426-fc16-4556-97bf-a655df7a95fb","resolution":{"observed_at":"2026-08-06T22:34:13.812851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:13.551684Z","title":"Guiding multi-step rearrangement tasks with natural language instructions,","venue":null,"work_id":"bc902326-712f-4de8-bdda-2c0da4ad50c7","year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.073663Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:7b525dc5fccefc457318070edd5203c6abc3eb609dbf074357249dfc8b0dbffb","observation_id":"547e2f39-98ab-4fae-bf8a-038ec002b573","resolution":{"observed_at":"2026-08-06T22:34:13.637993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:13.357637Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":"2e00918d-4cf3-4597-b2e0-f3ed38737e9b","year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.129519Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:a74496121e4dc054dfd94ab2a7d3d21dcc5ca8f79128cadf3e5fa55af5808861","observation_id":"01bb29b4-fd02-4bfe-9631-2b2b85a21ddd","resolution":{"observed_at":"2026-08-06T22:34:13.449950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:13.194305Z","title":"Con- cept2robot: Learning manipulation concepts from instructions and hu- man demonstrations,","venue":null,"work_id":"c80b5c9f-7c44-48da-8037-82238afdc77d","year":2021},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.183203Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:3c4743d634287d07958822c15d1a27a68e65ad817e9686a0efcb98e66becf7cb","observation_id":"69430c70-2470-49a4-a338-8f4d8ac09e5d","resolution":{"observed_at":"2026-08-06T22:34:13.286746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03831","last_updated":"2018-06-11T06:58:19Z","snapshot_observed_at":"2026-08-04T17:24:56.824762Z","submitted_at":"2018-06-11T06:58:19Z","title":"Interactive Visual Grounding of Referring Expressions for Human-Robot Interaction","version":1},"cited_work":{"arxiv_id":"1806.03831","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.03831","snapshot_observed_at":"2026-08-06T22:34:10.216454Z","title":"Interactive Visual Grounding of Referring Expressions for Human-Robot Interaction","venue":"cs.RO","work_id":"5f732fdc-e76e-4e97-8548-f7a022c0be33","year":2018},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.242765Z"},"links":{"cited_paper":"/paper/1806.03831","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:d92f05c4f5aaa089d506efb81885e6b66a976608d7aa70c7f4a4e4582fe7e1e8","observation_id":"5db86166-f70a-4351-a54b-f96026248fd2","resolution":{"observed_at":"2026-08-06T22:34:10.290123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:13.013216Z","title":"Cliport: What and where pathways for robotic manipulation,","venue":null,"work_id":"b4c6633b-6287-408c-a88d-69f11ce01c97","year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.315101Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:f8eda4ec15a3c3b5b06e5f4bfec26ad45556ef8006cdac53e2596600babc338b","observation_id":"76a0802b-89db-4652-b82f-0dc2b57f31ce","resolution":{"observed_at":"2026-08-06T22:34:13.090031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:12.822174Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"cb3621fe-dbf2-47e1-a912-17f0adb2f4b1","year":2021},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.389978Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:4b2e529d79c63b8cc4d3b24a8e8762c7573d6bb9b77d7fc63c21708fe89e399e","observation_id":"5ed296b4-ce06-4836-b864-0cbc8bc4c299","resolution":{"observed_at":"2026-08-06T22:34:12.893955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:08.445110Z","title":"Perceiver-actor: A multi- task transformer for robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.445110Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:ccf795e95952f96cf123334df8d5ec6e852a19ac035cbd9b702346ddf4b2005e","observation_id":"629083fa-5f3e-4f0f-a7a1-7a00f417a996","resolution":{"observed_at":"2026-08-06T22:34:08.445110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07753","last_updated":"2023-05-25T03:50:11Z","snapshot_observed_at":"2026-08-05T02:35:14.331933Z","submitted_at":"2022-09-16T07:17:23Z","title":"Code as Policies: Language Model Programs for Embodied Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07753","snapshot_observed_at":"2026-08-06T22:34:08.491438Z","title":"Code as policies: Language model programs for embodied control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.491438Z"},"links":{"cited_paper":"/paper/2209.07753","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:7a3f9f90b9ee76a829d859ad431d9f791ab7c3cf374e50adf5d06b16312c85ee","observation_id":"9e0b2ec6-732b-4b2d-996a-2dd8b497a725","resolution":{"observed_at":"2026-08-06T22:34:08.491438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:08.570986Z","title":"Language models as zero-shot planners: Extracting actionable knowledge for embodied agents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.570986Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:e0c5dd6702869c322384576e3dbe7c18d9bfbf3920c93f283aad6bc10b05ae00","observation_id":"39d54549-877d-4890-b27b-a23541281d64","resolution":{"observed_at":"2026-08-06T22:34:08.570986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-08-08T09:48:52.583612Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-06T22:34:08.623286Z","title":"Inner monologue: Embodied reasoning through planning with language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.623286Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:6049c9209f8eb03e94c0f4d6c7b2d76b5ac0cc35d70cb8cc79235d56e6ab1681","observation_id":"e7bdd877-3203-4ba2-8011-f48709c8946e","resolution":{"observed_at":"2026-08-06T22:34:08.623286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-06T22:34:08.700073Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.700073Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:2d0497be2d828e05e5d6299718937f9197450c1a36e86727f0f490d50cb6674d","observation_id":"7a3d6bcb-d183-48ad-9c48-f636672f5170","resolution":{"observed_at":"2026-08-06T22:34:08.700073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:12.671821Z","title":"Learning language-conditioned robot behavior from offline data and crowd- sourced annotation,","venue":null,"work_id":"7de58c44-ce2e-4bfd-b195-2d2cd10b0211","year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.802322Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:b393ca752db4d46dd35c28c0460a5bf572bc572f312af7dedfad762430039116","observation_id":"98caaa48-0b48-4956-8934-ec621caa5113","resolution":{"observed_at":"2026-08-06T22:34:12.738882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.00598","last_updated":"2022-05-27T17:52:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-01T17:43:13Z","title":"Socratic Models: Composing Zero-Shot Multimodal Reasoning with Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.00598","snapshot_observed_at":"2026-08-06T22:34:08.897233Z","title":"Socratic models: Composing zero-shot multimodal reasoning with language,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.897233Z"},"links":{"cited_paper":"/paper/2204.00598","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:c117efa174b42abc656018f24d17a3858a6fbc8083430c87c1087e51bea53728","observation_id":"a4496016-f95f-41f5-a63e-85f26d224c9e","resolution":{"observed_at":"2026-08-06T22:34:08.897233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00001","last_updated":"2023-02-27T22:09:35Z","snapshot_observed_at":"2026-08-11T16:00:06.021847Z","submitted_at":"2023-02-27T22:09:35Z","title":"Reward Design with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00001","snapshot_observed_at":"2026-08-06T22:34:08.994748Z","title":"Reward design with language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:08.994748Z"},"links":{"cited_paper":"/paper/2303.00001","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:dec975396728b0511f347f064601a697c7e012bf69727efa8294ca567868ce8c","observation_id":"0e6cf36c-3d6b-4d3e-a5a5-6284597625a8","resolution":{"observed_at":"2026-08-06T22:34:08.994748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:11.997158Z","title":"A survey of imitation learning: Algorithms, recent developments, and challenges,","venue":null,"work_id":"3cfa59d3-7189-4dbd-81da-dc9d57712481","year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.096516Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:f4d0360056f8c2f32d8e48bfe2f89f6683b2ba4f69a1884ff6562967efe3e60f","observation_id":"ac083bd4-4bbf-4156-aa82-4113d1a0b470","resolution":{"observed_at":"2026-08-06T22:34:12.353488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:11.527789Z","title":"Parameter-efficient transfer learning for nlp,","venue":null,"work_id":"77f622f3-dc7d-4248-b2c7-2a021e8b9a31","year":2019},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.163012Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:b9f0837b053ec83716fc6f5e2f897ba43622ef1f5957520fc3dc06a64bf216f6","observation_id":"f159e39c-3ec3-4fb5-8da2-a11a81cba9b0","resolution":{"observed_at":"2026-08-06T22:34:11.702612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:09.262602Z","title":"Grounded language-image pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.262602Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:3d0759a9d55ef2f203bde977472e2f5025adf0508adf10bcfed5ebeba7c8be1b","observation_id":"91df2c20-0ade-4021-954d-30573be608b3","resolution":{"observed_at":"2026-08-06T22:34:09.262602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:11.386873Z","title":"Vicuna: An open- source chatbot impressing gpt-4 with 90%* chatgpt quality,","venue":null,"work_id":"3f65df62-9259-41aa-b353-cc6d51d9cd27","year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.373504Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:f8ff1597373e634f39fcf365d08ba0bd2b9bdb284d976c4ad553ffac8a4ca222","observation_id":"ae8e1eb1-c7d6-4867-be38-d6574c958233","resolution":{"observed_at":"2026-08-06T22:34:11.453831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12223","last_updated":"2023-05-23T10:35:35Z","snapshot_observed_at":"2026-07-06T15:30:05.820261Z","submitted_at":"2023-05-20T16:11:26Z","title":"What Makes for Good Visual Tokenizers for Large Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12223","snapshot_observed_at":"2026-08-06T22:34:09.441859Z","title":"What makes for good visual tokenizers for large language models?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.441859Z"},"links":{"cited_paper":"/paper/2305.12223","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:11e0462878a593d51b79eab8b118b96e40da0522bfae64539c7d6f5aeeca4446","observation_id":"b199ac2d-0a86-4f1d-9bec-73bebedc31fd","resolution":{"observed_at":"2026-08-06T22:34:09.441859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T22:34:09.557338Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.557338Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:765dfe5af9916e345d49056004423105ec4a3a82efcf19e4cb8acd7e57780695","observation_id":"8b9eefd8-ea96-4443-a648-c260ecad85da","resolution":{"observed_at":"2026-08-06T22:34:09.557338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:11.202993Z","title":"Mdetr-modulated detection for end-to-end multi-modal understand- ing,","venue":null,"work_id":"38fbc58a-d32c-413e-9060-069cd6b7e87f","year":2021},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.658313Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:de861111d317aec2090b5d785864b290c9bda8ecc579aa984e4b988f62158d10","observation_id":"f8c97811-981f-4e8f-9488-d5cede496671","resolution":{"observed_at":"2026-08-06T22:34:11.303393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:10.972710Z","title":"Learning to augment synthetic images for sim2real policy transfer,","venue":null,"work_id":"1186027a-3ec8-49b8-96dd-ed68e5e1dfa4","year":2019},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.745308Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:cb9bb537a00b6e05ba5f4db7f2f84ddc59588ad6a36df07dc514644863e02379","observation_id":"934363c5-c57c-40c3-832c-f25e8a42ba4a","resolution":{"observed_at":"2026-08-06T22:34:11.081138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:10.682078Z","title":"A generalist agent,","venue":null,"work_id":"9576aa47-3cd7-4ff1-a8c7-b4b8afe8c67c","year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.851168Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:9d58088968d8d62a5c7ff407b1c410a69eeedc141c88fa587cc8d3b4ee8801a4","observation_id":"079f6813-fe5f-44a9-a0ba-f6a69c21b92a","resolution":{"observed_at":"2026-08-06T22:34:10.851856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:34:10.534148Z","title":"Flamingo: a visual language model for few-shot learning,","venue":null,"work_id":"e1f78c15-14b3-427e-8b49-4f0d4ed3e6b4","year":2022},"citing_paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:09.950077Z"},"links":{"citing_paper":"/paper/2506.21250"},"observation_digest":"sha256:b517d53fc7c0c64bb563931b6b3317f88016342ba242330e65fa80a815a6a9c8","observation_id":"f998f949-044c-4477-8535-9fa6b4067564","resolution":{"observed_at":"2026-08-06T22:34:10.584680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.21250","last_updated":"2025-06-26T13:35:53Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-10T18:22:30.982378Z","submitted_at":"2025-06-26T13:35:53Z","title":"ACTLLM: Action Consistency Tuned Large Language Model"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":23},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2506.21250."}