{"as_of":"2026-08-10T07:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:59509ec097f9f7c7ae4f64b3b85c84c0edc1ef8a085e0bd41a67c31275e874ff","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:21:51.244696Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.08496/citation-record","integrity":"/paper/2507.08496/integrity","json":"/paper/2507.08496/citation-record.json","paper":"/paper/2507.08496"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.570259Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:44.570259Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:3aeb69dbf996c43b16ec94a30ff98991143a2dee8ef7f9e48da2aa8e3e8ec4f9","observation_id":"de51e18a-4ac3-4917-b4b3-b045032243f4","resolution":{"observed_at":"2026-08-06T18:21:44.570259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:59.070578Z","title":null,"venue":null,"work_id":"12f48b05-2f43-4af3-a558-d2c01992211c","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:44.626542Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:4aafe5229b048170b9c34fee0c4e971cc3eeaabc454047a507111253b39c6e72","observation_id":"d3a60039-9acc-4159-8da6-59e85edf3eda","resolution":{"observed_at":"2026-08-06T18:21:59.159967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:58.864447Z","title":null,"venue":null,"work_id":"363fdb7f-39e4-4bc1-b3e0-cbed48af3e99","year":2020},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:44.705572Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:5cd7f779a89c292f7ec77e4045fe2dbe5adb7b9991c5dba3b9bb503956ef3722","observation_id":"1f418d61-9696-4600-904c-87322a01166d","resolution":{"observed_at":"2026-08-06T18:21:58.961744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.812886Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:44.812886Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:17f14a9d105b1ffbb6e5f96c13254d32de573c173f96c23671219511c094658a","observation_id":"d1dd50c5-13ab-40e9-acbc-63f139ccd9e3","resolution":{"observed_at":"2026-08-06T18:21:44.812886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.898908Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:44.898908Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:ad23b16e295451ea7f94a8b98bf0e666c18a46aa2f63314bd61971faadecef5d","observation_id":"9288beff-2e3d-4a6a-8c3d-6a3b1f9dd73f","resolution":{"observed_at":"2026-08-06T18:21:44.898908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-08-06T18:21:44.970567Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:44.970567Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:99a44019143d2e3ba81654402948a547f9ad39e90996c0aae68954bda6419850","observation_id":"8b4f6cab-d886-4e5f-ac84-7fdf180f776c","resolution":{"observed_at":"2026-08-06T18:21:44.970567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11402","last_updated":"2024-10-22T23:13:34Z","snapshot_observed_at":"2026-07-06T19:17:02.745056Z","submitted_at":"2024-09-17T17:59:06Z","title":"NVLM: Open Frontier-Class Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11402","snapshot_observed_at":"2026-08-06T18:21:45.055037Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.055037Z"},"links":{"cited_paper":"/paper/2409.11402","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:75d44814a47a01ac58977f367c9badb74adba499d0f332bd08b0e99d7f8a8363","observation_id":"55102870-4915-4560-a293-9adcb80f0ca4","resolution":{"observed_at":"2026-08-06T18:21:45.055037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:45.121350Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.121350Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:d86d2526e98885a27860f7cf1d4889d79dd21f3910020bd0bdb9b978c0c5028f","observation_id":"7da83e3c-6af5-458e-a354-bc6d3a6371f6","resolution":{"observed_at":"2026-08-06T18:21:45.121350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:58.665290Z","title":null,"venue":null,"work_id":"1ca6d4ff-5c3d-46c6-b7b5-98e648931329","year":null},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.190264Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:c2b9ae14fe5bec8647a32bf511f6be7acf415240808bdae1b33419c138d862b8","observation_id":"40f891bc-5672-4141-8b49-d50202128df4","resolution":{"observed_at":"2026-08-06T18:21:58.751228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:58.312816Z","title":null,"venue":null,"work_id":"c0738390-9fa9-40d3-b5f9-36f15e744297","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.355704Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:4ca9836580f92f4794c9d4b206fda85e096a80a3f202bc9da72ee4add55f4709","observation_id":"25cf6fd1-3e91-4458-abf6-d3a22240f617","resolution":{"observed_at":"2026-08-06T18:21:58.425038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:58.111483Z","title":null,"venue":null,"work_id":"66ba7035-d1a0-4dd9-a9bc-352f6dcfd9ee","year":2025},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.419467Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:8f95ccd8e35a8e8f1af4baecd1d9f23823ac10c9aae12e95a6e259baaa73f830","observation_id":"ea1b7ae1-d044-454e-9ed2-6dd803815844","resolution":{"observed_at":"2026-08-06T18:21:58.185367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.869719Z","title":null,"venue":null,"work_id":"d5e13e42-4421-4eb1-b16a-fbbc593eac66","year":2025},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.510100Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:9185018bfc46ef63a30bf6a98d7b42360274fccac05d8fee1d9e610ed9040e93","observation_id":"67dd072d-4e1d-4e4f-924f-40258e245af0","resolution":{"observed_at":"2026-08-06T18:21:57.985784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.789999Z","title":null,"venue":null,"work_id":"6e04fc80-11c8-441e-a434-5031439fe54c","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.622330Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:818dd1ee38ea3a252f7478672da41969b50cd440489c0a831d178a9c6acbfb3e","observation_id":"a2d50294-f87c-47b3-bbc6-cf5ed050d434","resolution":{"observed_at":"2026-08-06T18:21:57.826628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.726544Z","title":null,"venue":null,"work_id":"55209081-dbb2-47e4-8064-51c847e80f20","year":2022},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.775243Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:17e30841153f76a3e73f0625601d9b571e12b189f7151fa21a04db8637f9a56f","observation_id":"b35522e2-fd7f-4c4b-92aa-12951d693385","resolution":{"observed_at":"2026-08-06T18:21:57.771568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.627204Z","title":null,"venue":null,"work_id":"d2441d4a-d818-49e3-b516-35bed095e9f6","year":null},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.851468Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:9752b671b480f57ba69cd9cde5e3db4c6ffcde50a924db1c7e2b753b7dd54aa1","observation_id":"312ca3f7-0776-4652-927a-2709e8e400a5","resolution":{"observed_at":"2026-08-06T18:21:57.663552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:46.036257Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.036257Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:545d783a4b2b1bc6680e027c696cb50f8e794b8fd6523a15a596eab65024b644","observation_id":"4d986e8d-8962-410c-a1e7-fba22849afac","resolution":{"observed_at":"2026-08-06T18:21:46.036257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.499715Z","title":"Advances in Neural Information Processing Systems 36 (2023), 79081–79094","venue":null,"work_id":"c2f6ff17-553c-4dbe-9478-58dad0602873","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.929141Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:9810cbf9800535c316b3a29824899bd74ad91ef070431d011ce3f7e8a56f7e2a","observation_id":"83edfb12-579f-4ddd-88d0-ca6c4ce8fc09","resolution":{"observed_at":"2026-08-06T18:21:57.580794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.00834","last_updated":"2021-01-29T13:44:14Z","snapshot_observed_at":"2026-08-09T16:42:43.768167Z","submitted_at":"2021-01-29T13:44:14Z","title":"Counterfactual Planning in AGI Systems","version":1},"cited_work":{"arxiv_id":"2102.00834","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.00834","snapshot_observed_at":"2026-08-06T18:21:52.702750Z","title":"Counterfactual Planning in AGI Systems","venue":"cs.AI","work_id":"06f7a7cf-436a-48fd-86e2-37a4e5f3fa32","year":2021},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.204560Z"},"links":{"cited_paper":"/paper/2102.00834","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:c7128ffcbe257f7a5f7c924a64ba820719eee2137ea16964aa4de78ceb7866ae","observation_id":"d0297501-576c-4a55-a56f-bc833b517f97","resolution":{"observed_at":"2026-08-06T18:21:52.762518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.380410Z","title":null,"venue":null,"work_id":"3dfb063f-87d7-4aeb-a257-8a0f049655fc","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.148386Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:dff26ae883b36c3b22f9e759c81af17a95956d81b47af39b8c0ee27369e0ed9a","observation_id":"e940cd0f-f53b-48dd-a6d8-1d92c029d8c9","resolution":{"observed_at":"2026-08-06T18:21:57.451996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.303938Z","title":null,"venue":null,"work_id":"ba35a9a5-1df2-424c-846e-bc764575099f","year":2022},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.451657Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:e99e2546e49c2bf01ce5fef57adebcda304fc342392714b36f3bce68b8071ce7","observation_id":"8f4f3677-ad05-42a1-8f06-a4be3430292a","resolution":{"observed_at":"2026-08-06T18:21:57.333877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:46.302352Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.302352Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:dcfd10e620142987c6927a557cda97c48f1a02e1ab96ecdb401985a6f4c7b762","observation_id":"f20074c7-b984-4847-b974-746f5a7e85e0","resolution":{"observed_at":"2026-08-06T18:21:46.302352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-06T18:21:46.733044Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.733044Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:348d41e08012a29f2405efb006b8b9e12e5aa6d3319f9a4fac2065751a849c37","observation_id":"47d31e5c-7e2e-47d6-b623-71397a896084","resolution":{"observed_at":"2026-08-06T18:21:46.733044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-08-08T09:48:52.583612Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-06T18:21:46.601214Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.601214Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:1ff81ed2c12830bd523766769c164750939f1a315d37129644cda11e9fb5c1e4","observation_id":"42d5a748-a7af-4678-be46-52e92a024a12","resolution":{"observed_at":"2026-08-06T18:21:46.601214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-06T18:21:46.949417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.949417Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:cfa23fd9bcf97d8e0625efcee10e82351ea053f0c435387bc7c97c785e95ec20","observation_id":"4538fcbd-2ec2-4ba8-94e9-b6a0e76935b6","resolution":{"observed_at":"2026-08-06T18:21:46.949417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.208154Z","title":null,"venue":null,"work_id":"f584f9c0-f52d-4496-b244-283f037a5f70","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:46.828028Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:6bf3a09be957bbe8d09053110912088b14477904f16c3238807b7af9a1c9438c","observation_id":"3127d0da-76df-48bf-8f75-9da24455b3d3","resolution":{"observed_at":"2026-08-06T18:21:57.261240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.135680Z","title":null,"venue":null,"work_id":"7ac31e76-cb37-4e9b-b846-375748d7c71f","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.116830Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:591281197f5010f82dc7627eea9eefdba101f91cc47a7ac43884a58b34dc266e","observation_id":"a0a2da3e-07ac-4e11-b916-af72f7b19b3c","resolution":{"observed_at":"2026-08-06T18:21:57.168596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-06T18:21:47.045449Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.045449Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:87d973cf6a016ce283c8863fe078dff1781ff7e9cdcd58da7d4e91a9fe2ecfd6","observation_id":"e25e0201-3283-4438-9f8e-5f5121cef561","resolution":{"observed_at":"2026-08-06T18:21:47.045449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:47.284989Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.284989Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:37f3ba27df5e2c87c5616d83859ab9dc6305bbb2679b0acc1bdbedc7f1773b2f","observation_id":"50f8a404-a11d-4ed2-8c3d-a0ad1c2812ec","resolution":{"observed_at":"2026-08-06T18:21:47.284989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07575","snapshot_observed_at":"2026-08-06T18:21:47.197177Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.197177Z"},"links":{"cited_paper":"/paper/2311.07575","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:a619fea0f790ed88ff780de48c38ad692ebe0c9e4f278af52a46fbb9d0eaec00","observation_id":"768446ef-3ed2-4d7e-9d0c-19b60dcc2fbd","resolution":{"observed_at":"2026-08-06T18:21:47.197177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-06T18:21:47.469042Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.469042Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:ea27769df28d379ff2b2ea1126431fcacd34eec4ba4d7b3094e8987ac43c0160","observation_id":"255dc6f9-6f10-4c13-acb6-2b97f65a8b23","resolution":{"observed_at":"2026-08-06T18:21:47.469042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:57.003519Z","title":null,"venue":null,"work_id":"472f30b3-50d2-467a-9410-316e2f3e3acc","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.394798Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:0392a9e97cba350ca97e6e9e939f8ab1dae34d0953e74c2334a65799023fc407","observation_id":"178569e0-a431-4cfa-912b-a902ac1d7649","resolution":{"observed_at":"2026-08-06T18:21:57.058628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12583","last_updated":"2024-10-16T14:01:22Z","snapshot_observed_at":"2026-08-08T07:11:28.390636Z","submitted_at":"2024-10-16T14:01:22Z","title":"STRUX: An LLM for Decision-Making with Structured Explanations","version":1},"cited_work":{"arxiv_id":"2410.12583","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.12583","snapshot_observed_at":"2026-08-06T18:21:52.437657Z","title":"STRUX: An LLM for Decision-Making with Structured Explanations","venue":"cs.CL","work_id":"aeaa31f8-48be-4c4e-b8ae-a0a3f9ae5b99","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.634914Z"},"links":{"cited_paper":"/paper/2410.12583","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:0b2dff38523c142e110a1b6e7478cc72a7fc08e5ec340beb33839184dfcdf0e0","observation_id":"3b0436a6-5740-4776-8d01-81b4ff07d57f","resolution":{"observed_at":"2026-08-06T18:21:52.513904Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:56.875024Z","title":null,"venue":null,"work_id":"e5f54c82-5d01-4bb2-ba1a-c74e43fd0483","year":2020},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.550941Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:846f526ade848aff9821e12e3ae530baa0d4d847c77d3001fe65ad23cdb0b881","observation_id":"f636e258-24da-4249-bf27-abc01c587ea6","resolution":{"observed_at":"2026-08-06T18:21:56.915471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03003","last_updated":"2024-03-05T14:31:24Z","snapshot_observed_at":"2026-07-06T17:39:53.791209Z","submitted_at":"2024-03-05T14:31:24Z","title":"Feast Your Eyes: Mixture-of-Resolution Adaptation for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03003","snapshot_observed_at":"2026-08-06T18:21:47.820050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.820050Z"},"links":{"cited_paper":"/paper/2403.03003","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:278eaaa0cc97ba8fba41ab0d908b6b3e040bfeca8b30892f9e1fe6cfe8564495","observation_id":"382d78d9-c7aa-49df-baa3-9797b2cf1ffb","resolution":{"observed_at":"2026-08-06T18:21:47.820050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01795","last_updated":"2023-05-02T21:46:44Z","snapshot_observed_at":"2026-08-03T23:35:46.475935Z","submitted_at":"2023-05-02T21:46:44Z","title":"Multimodal Procedural Planning via Dual Text-Image Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01795","snapshot_observed_at":"2026-08-06T18:21:47.730503Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.730503Z"},"links":{"cited_paper":"/paper/2305.01795","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:ccd39b3b84acaec4625081bd1b497197c83c1e031307c1e9741f9520fd897c29","observation_id":"381d6a6b-ef6f-4752-9839-5cb1e98f4cf1","resolution":{"observed_at":"2026-08-06T18:21:47.730503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:56.683217Z","title":null,"venue":null,"work_id":"4229c9b8-1479-4d7d-acec-3fe8d1938a10","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.972327Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:e0a0f97c6114dc9e34c68240a17690bdf12a2fac0a8f88394f1d520049bb8559","observation_id":"2b9446f8-4cdf-4d22-bfb3-39c3394bd966","resolution":{"observed_at":"2026-08-06T18:21:56.741272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:56.778926Z","title":null,"venue":null,"work_id":"6fb955d7-189e-4fff-8201-4b4132e63d3c","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:47.909243Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:5e59943f8890fd39d409d0f2414d49e939e404ff5161ad333aebcdf8d2cdec41","observation_id":"ae7049a4-0ffb-4ff8-89b6-671b094941cb","resolution":{"observed_at":"2026-08-06T18:21:56.823219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-06T18:21:48.130614Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.130614Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:40b8614c97c18608512ad18f0cac552493b1687bd1a0f8bbc72a53ae216d17f2","observation_id":"c81a00d7-54e0-4dfe-bd29-e0018b8af0b2","resolution":{"observed_at":"2026-08-06T18:21:48.130614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:56.594238Z","title":null,"venue":null,"work_id":"b5e1caec-5d76-455e-ad2b-f81c49859459","year":2018},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.029177Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:3f1ccaddc14e4fef42a82891f0dc564957e70c3978c3c8996ecf82385737b8ed","observation_id":"79fb74c5-9b67-477f-954a-6fe79b7b4987","resolution":{"observed_at":"2026-08-06T18:21:56.633666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-06T18:21:48.303361Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.303361Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:e59bcb291c72710ef41b0261c8a446d62ab79663c8f4a47b6986dfae632fa72c","observation_id":"c7c1d50d-27bb-47d0-b34c-3eb5eec05941","resolution":{"observed_at":"2026-08-06T18:21:48.303361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10300","last_updated":"2024-06-01T03:35:22Z","snapshot_observed_at":"2026-08-05T08:31:40.101811Z","submitted_at":"2024-05-16T17:54:15Z","title":"Grounding DINO 1.5: Advance the \"Edge\" of Open-Set Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10300","snapshot_observed_at":"2026-08-06T18:21:48.217230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.217230Z"},"links":{"cited_paper":"/paper/2405.10300","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:c7fa86da8c60d7c90307efde8ce53d219e366f56506b8613e90849b5e8b1d1de","observation_id":"448d2f21-6508-4fab-beb8-07749773831c","resolution":{"observed_at":"2026-08-06T18:21:48.217230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:56.487947Z","title":null,"venue":null,"work_id":"236976e3-c26f-4f7f-9a94-99f54600c2ae","year":2019},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.461774Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:01c2cb22b10a52a815f695fcc54e2f2dcb08c9a5b1cd8f2084ca631e7709949a","observation_id":"f91df066-fb23-416f-80c7-7d6acc8eab16","resolution":{"observed_at":"2026-08-06T18:21:56.541918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05766","last_updated":"2024-06-04T20:55:04Z","snapshot_observed_at":"2026-07-06T17:41:55.780727Z","submitted_at":"2024-03-09T02:27:45Z","title":"FLAP: Flow-Adhering Planning with Constrained Decoding in LLMs","version":3},"cited_work":{"arxiv_id":"2403.05766","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.05766","snapshot_observed_at":"2026-08-06T18:21:52.159012Z","title":"FLAP: Flow-Adhering Planning with Constrained Decoding in LLMs","venue":"cs.CL","work_id":"a8e8bd67-2186-4441-9b9f-073dde652d60","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.407968Z"},"links":{"cited_paper":"/paper/2403.05766","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:e0cab1cebb09b1a6b877b345ceffaa10460ecfd2df2e555300f78fb377d02799","observation_id":"e44564d2-74e2-4c89-95df-10e4106c651a","resolution":{"observed_at":"2026-08-06T18:21:52.259006Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:56.154854Z","title":null,"venue":null,"work_id":"612dc861-6444-4cb7-bbb5-23355e37bd98","year":2020},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.635053Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:2b75f43dee329a5f7486b6db9428be39acfafbc47f5ee90f44b1fe1bce40a91b","observation_id":"47629d3a-09a2-42bd-a089-217e4766fa49","resolution":{"observed_at":"2026-08-06T18:21:56.253166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:56.341819Z","title":null,"venue":null,"work_id":"0e71b9a2-6cb4-4143-9eb1-ba3b1be75da1","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.538941Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:14532198bd52f704597cc714343c84bf2b4db180e6256d0cbb400d83de20197b","observation_id":"960cce1a-f8dc-4ab0-97e4-5e297f4d71fd","resolution":{"observed_at":"2026-08-06T18:21:56.409140Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:55.802727Z","title":null,"venue":null,"work_id":"793716fe-86df-4741-9395-1090e83ed963","year":2022},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.790985Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:a198e00607616b173a0af2c2e3dd9d04a0ccd99bf7ddf32fa57d769f085a0021","observation_id":"2880b169-72af-4688-9d65-b89db8b0448a","resolution":{"observed_at":"2026-08-06T18:21:55.897345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:55.982685Z","title":null,"venue":null,"work_id":"828141e1-f197-4702-8019-fe145ac6db00","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.692673Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:faa0cd943d63dc108aca010c243891f61a063141f995a78229c91d30856d46f2","observation_id":"2e03fc59-f774-418d-adb2-511a521d5dc6","resolution":{"observed_at":"2026-08-06T18:21:56.088891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:55.666748Z","title":null,"venue":null,"work_id":"5df6f148-3512-4af3-a047-37b89431e65c","year":2021},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.978102Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:0a5d9085257b2bb52690236b621045a25a5540f5994a2c5fed73576e698f3e5a","observation_id":"15f1b08c-cfdb-41f7-aa7b-a9d2ab420388","resolution":{"observed_at":"2026-08-06T18:21:55.738252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:48.881030Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:48.881030Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:47679c77cdd351c7a21926c1d1b48bddd47f9f2d30e1840bcbdc67ba545247e5","observation_id":"d244ec0f-50a4-45b1-8273-29df7bdc7a30","resolution":{"observed_at":"2026-08-06T18:21:48.881030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03907","last_updated":"2024-10-04T20:21:40Z","snapshot_observed_at":"2026-08-01T04:13:45.801059Z","submitted_at":"2024-10-04T20:21:40Z","title":"ActPlan-1K: Benchmarking the Procedural Planning Ability of Visual Language Models in Household Activities","version":1},"cited_work":{"arxiv_id":"2410.03907","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03907","snapshot_observed_at":"2026-08-06T18:21:51.989097Z","title":"ActPlan-1K: Benchmarking the Procedural Planning Ability of Visual Language Models in Household Activities","venue":"cs.CL","work_id":"1b390448-ab3e-4555-aaea-7dd1316526c3","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.202777Z"},"links":{"cited_paper":"/paper/2410.03907","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:878d5d553032361861519ec5210f934089cb54d7d4e7748f6d74b6f651afe0bc","observation_id":"16015d9b-6303-4576-b813-2f6613b30d82","resolution":{"observed_at":"2026-08-06T18:21:52.068349Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:55.510888Z","title":null,"venue":null,"work_id":"8ea9d3ae-13c8-4480-bcfe-fcc545602ae0","year":2022},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.091212Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:4c3326910af2b0649ea9f3e37b2cdd0db4e4bcda58b3e5f9a8b29d9ed7110ae7","observation_id":"5708d831-5d80-48f4-be54-22e78eb60cdf","resolution":{"observed_at":"2026-08-06T18:21:55.585682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:49.401390Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.401390Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:f83026c8a8fc740da118b9a3131414b9246cbc8e5c162f9f856e8f7b998fba15","observation_id":"042b9872-1e5b-478e-a056-683d8f24b51a","resolution":{"observed_at":"2026-08-06T18:21:49.401390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T18:21:49.285266Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.285266Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:27e80b139b82c37a695cea94db0e5f4a21af9d1949e1d1843e90e4038dd0ca4d","observation_id":"10aded97-1fa7-4530-b7d3-be0d6110d617","resolution":{"observed_at":"2026-08-06T18:21:49.285266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T18:21:49.626937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.626937Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:d74e33dcb56844083ef5e0519d3d2b7bbe830eb49df5823a1c0c613a670d4928","observation_id":"a3738f7c-9caa-4790-a277-b8df595ff2c7","resolution":{"observed_at":"2026-08-06T18:21:49.626937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03256","last_updated":"2024-09-29T06:00:09Z","snapshot_observed_at":"2026-07-06T19:10:48.519252Z","submitted_at":"2024-09-05T05:22:27Z","title":"E2CL: Exploration-based Error Correction Learning for Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03256","snapshot_observed_at":"2026-08-06T18:21:49.504791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.504791Z"},"links":{"cited_paper":"/paper/2409.03256","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:5fee2a5e10a8e198e766cb991aed846c720b8bdb5de1d145e73a2bf0b7852c0c","observation_id":"d19622c4-52c5-4e47-a46f-90c9700d1814","resolution":{"observed_at":"2026-08-06T18:21:49.504791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:55.072849Z","title":null,"venue":null,"work_id":"449c7a10-1723-458e-bde9-cae1ee25ad04","year":2021},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.785253Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:612e24168e17c93b328bfe75d6df694845b4f704b34fde157ce4daab7a049d14","observation_id":"ee959a1b-8557-4843-b50c-3f50782e9263","resolution":{"observed_at":"2026-08-06T18:21:55.189047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:55.326271Z","title":null,"venue":null,"work_id":"943aa937-04a9-44df-9513-fcd909004606","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.705965Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:2faf70b6fb8762372d7fc8d4ac31d8d6323d4fc4c781d27ec9ddde04b021ab80","observation_id":"4f03097b-8baa-45e1-842d-fb384cbc7f57","resolution":{"observed_at":"2026-08-06T18:21:55.411122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-06T18:21:49.974992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.974992Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:3086bfa3c121ff1aba02678376e30b354a14150f368b66c17c211cb514773a22","observation_id":"a59b773e-e5ad-47c4-999d-0009ac114356","resolution":{"observed_at":"2026-08-06T18:21:49.974992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:49.892524Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:49.892524Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:5be222f5567c732b95807577733933bbdca534c33ab0dc7db32488f73658c538","observation_id":"52418382-3195-49f7-9433-ef79cc2ea618","resolution":{"observed_at":"2026-08-06T18:21:49.892524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:50.171609Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.171609Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:89a138ad9b1c064cc9cb5f15b43112c296ef95262daee49ce25685ee35e03661","observation_id":"fa73e92c-6378-4804-8a69-1145a5b1c8a4","resolution":{"observed_at":"2026-08-06T18:21:50.171609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:54.109337Z","title":null,"venue":null,"work_id":"35e05cce-f4c6-41f7-871c-3a52bb15e939","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.064837Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:d8e489ea28d5065ff9501dd08ea1e7fb2e70cb0f4d8aa8dbf70300835a9f3236","observation_id":"283b3559-40a3-4893-a2ab-0261073de399","resolution":{"observed_at":"2026-08-06T18:21:54.638034Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01493","last_updated":"2025-06-25T13:27:10Z","snapshot_observed_at":"2026-07-06T20:00:14.194746Z","submitted_at":"2024-12-02T13:44:53Z","title":"Learning Adaptive Lighting via Channel-Aware Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01493","snapshot_observed_at":"2026-08-06T18:21:50.498420Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.498420Z"},"links":{"cited_paper":"/paper/2412.01493","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:2b63eb1d3ec3f76087aa5ddb5c4b4146844c843a29fd229cce5887a473ed6f75","observation_id":"4f323420-6eec-404f-9541-3ad9f404edb1","resolution":{"observed_at":"2026-08-06T18:21:50.498420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:53.848479Z","title":null,"venue":null,"work_id":"528729a7-9618-4ae3-93e7-4e1bb889b809","year":null},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.282178Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:eef2ed446e70e300a67ec754cad7b91249abf1ca26d89c60f20c06744c85c9b5","observation_id":"15e53f39-d6cf-4161-9149-abdeca3212b5","resolution":{"observed_at":"2026-08-06T18:21:53.976808Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:50.713158Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.713158Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:87bea92b7231074e2164217397c038f27b6351e04dca9b67d1c7d95be8013578","observation_id":"7282c70b-c68e-4089-ab2f-cdcb5c69e3a2","resolution":{"observed_at":"2026-08-06T18:21:50.713158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13601","last_updated":"2024-05-28T05:36:23Z","snapshot_observed_at":"2026-08-09T14:50:09.702964Z","submitted_at":"2024-01-24T17:10:45Z","title":"MM-LLMs: Recent Advances in MultiModal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13601","snapshot_observed_at":"2026-08-06T18:21:50.798439Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.798439Z"},"links":{"cited_paper":"/paper/2401.13601","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:f2e9c063a7e05d485150d5fd2e8da8f1ed8950248fdc01bdc1e0ddb4261dd70e","observation_id":"beacfd96-9a84-4420-b15a-2568e4b055d1","resolution":{"observed_at":"2026-08-06T18:21:50.798439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.15756","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:51.683918Z","title":null,"venue":null,"work_id":"39fbc4fa-611a-4cb3-9b55-8b6fdbdaf1b0","year":2025},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.585216Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:6b3f64331d903bba0d6381e7d62569c0847d9c1f85bda29cd97749b39810b90e","observation_id":"58767394-874b-4238-a71c-6030e8db97ad","resolution":{"observed_at":"2026-08-06T18:21:51.770078Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:53.407525Z","title":null,"venue":null,"work_id":"0e4b6697-54ee-49d4-abba-18cab55c868f","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:51.032096Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:d00221176bdc9efd3a06e507736a8048ae2f9ef71961fdd423e61b81231d15a3","observation_id":"6574e7e6-688b-47f5-8cb7-ff6328bc68aa","resolution":{"observed_at":"2026-08-06T18:21:53.507027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:53.158737Z","title":null,"venue":null,"work_id":"181327a1-2afd-4323-8cb2-e07bcb1cda75","year":2025},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:51.122714Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:6200b5bd109cc43f2b53c9ae66215811961a7642863e076978ffdba3457ed7e2","observation_id":"a72647bb-ce11-47e9-aadf-69851487f872","resolution":{"observed_at":"2026-08-06T18:21:53.259183Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05047","last_updated":"2024-10-07T14:05:05Z","snapshot_observed_at":"2026-08-09T14:32:54.387212Z","submitted_at":"2024-07-06T11:07:18Z","title":"MFE-ETP: A Comprehensive Evaluation Benchmark for Multi-modal Foundation Models on Embodied Task Planning","version":3},"cited_work":{"arxiv_id":"2407.05047","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.05047","snapshot_observed_at":"2026-08-06T18:21:51.394587Z","title":"MFE-ETP: A Comprehensive Evaluation Benchmark for Multi-modal Foundation Models on Embodied Task Planning","venue":"cs.AI","work_id":"360a3059-d653-44f8-b358-9d20b27f9bba","year":2024},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.906222Z"},"links":{"cited_paper":"/paper/2407.05047","citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:de88167c69344bf2d141ae36faaf9ff75888c195d716be27b30ace5a1874d9a6","observation_id":"abfef92a-a834-42a1-8574-f0094014b7cb","resolution":{"observed_at":"2026-08-06T18:21:51.459545Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:52.961181Z","title":null,"venue":null,"work_id":"f6f53e90-ac33-485c-9eca-c74aff1f3888","year":2023},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:51.244696Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:ccabf7ecb0b05f560be63adfe01ea56127fe2a3362a97085fb3d7ed4c49d861d","observation_id":"35108cd2-4e3b-4608-8caf-14862978782f","resolution":{"observed_at":"2026-08-06T18:21:53.064953Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:58.510578Z","title":null,"venue":null,"work_id":"b82bff93-7fbb-480e-b596-a7c6ec48ff02","year":null},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:45.301234Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:f86e9b8679bc73ee7b673aa4ce82b5c5e298f4dc2c511444a0ec297265b89312","observation_id":"41be7759-a05b-4a56-84d4-dc7e4071ecfa","resolution":{"observed_at":"2026-08-06T18:21:58.583649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:53.592408Z","title":"IEEE Transactions on Image Processing (2025)","venue":null,"work_id":"a8ad9229-86e0-47e7-b85b-c4c9fa03185e","year":2025},"citing_paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:50.402373Z"},"links":{"citing_paper":"/paper/2507.08496"},"observation_digest":"sha256:a1036502ce6615017de54b5cc303b76b7c9956f9ee3c54325a06edb66e0930a9","observation_id":"394c7b69-d444-49de-8e49-57c028e12b0b","resolution":{"observed_at":"2026-08-06T18:21:53.744140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.08496","last_updated":"2025-07-11T11:18:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T18:14:37.908727Z","submitted_at":"2025-07-11T11:18:49Z","title":"LLaPa: A Vision-Language Model Framework for Counterfactual-Aware Procedural Planning"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":6,"verified_fuzzy":2},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2507.08496."}