{"as_of":"2026-08-19T18:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a2e790ff37357e85bd591c7b7140ce5172060b7b8f28acff2a5169c8bc20e1f7","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:17:31.589096Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.05636/citation-record","integrity":"/paper/2508.05636/integrity","json":"/paper/2508.05636/citation-record.json","paper":"/paper/2508.05636"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-08-15T22:57:45.773661Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-05T23:17:29.015615Z","title":"Abouelenin, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.015615Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:cad218c3b7ff0a23e4832e8ccb1b45ae500da37256bdcb696b1a137f96f38379","observation_id":"59b5fdee-b4ce-4e70-ab03-233ec6f28862","resolution":{"observed_at":"2026-08-05T23:17:29.015615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-08-18T11:44:22.813405Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-05T23:17:29.156526Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.156526Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:a865c23a990254af67422ea8e02be7cd1fb33bc8c6bebb14d9869bf6ea9cadfa","observation_id":"b6f73b6c-6183-4e47-906e-13a03c60bb79","resolution":{"observed_at":"2026-08-05T23:17:29.156526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T23:17:29.431156Z","title":"Black, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.431156Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:a5843281375c1335c75fad663596a676e3c85c3536ea4ba28082889fcd70eca4","observation_id":"4ab12c15-ed62-4476-9a44-2dc02a708d4e","resolution":{"observed_at":"2026-08-05T23:17:29.431156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T23:17:29.523657Z","title":"Blattmann, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.523657Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:e12755066089330f3b2fe18aa634b240a44178385d55d9b0a269e53210ab33a1","observation_id":"37cc15a3-dd56-4fc2-b00d-b722cf79a5e1","resolution":{"observed_at":"2026-08-05T23:17:29.523657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06669","last_updated":"2025-08-04T04:50:21Z","snapshot_observed_at":"2026-08-16T04:42:52.370966Z","submitted_at":"2025-03-09T15:40:29Z","title":"AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06669","snapshot_observed_at":"2026-08-05T23:17:29.702586Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.702586Z"},"links":{"cited_paper":"/paper/2503.06669","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:efa1f1127069047c0dede4711d55224b4a763728c553b0df15c96bfb47bd088c","observation_id":"fc9598be-f18b-44ea-be12-1bdc10a518c1","resolution":{"observed_at":"2026-08-05T23:17:29.702586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:17:29.902546Z","title":"Driess, F","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.902546Z"},"links":{"citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:0ef60e22feeb5bf44e271b00da047c6267c60ad5f0745d7b5de7a56c5a760692","observation_id":"44db9e67-0284-474c-8652-11569c5b817d","resolution":{"observed_at":"2026-08-05T23:17:29.902546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.00568","last_updated":"2018-12-03T06:06:25Z","snapshot_observed_at":"2026-08-14T17:49:43.679003Z","submitted_at":"2018-12-03T06:06:25Z","title":"Visual Foresight: Model-Based Deep Reinforcement Learning for Vision-Based Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.00568","snapshot_observed_at":"2026-08-05T23:17:29.979011Z","title":"Ebert, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.979011Z"},"links":{"cited_paper":"/paper/1812.00568","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:6d87c3386be1e20375368da246c5d48a10507db55018cd216e726441dd0ed2c5","observation_id":"ffde45ac-d405-4a1a-8b8d-e3107b4f7df1","resolution":{"observed_at":"2026-08-05T23:17:29.979011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-08-18T07:04:58.690133Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-05T23:17:30.087581Z","title":"Ha and J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.087581Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:4fb72107d24ad0226a1253adc1cc96c85bb0dca63b4987f5a343f97bf610e464","observation_id":"6218c839-8a9a-4818-8bb0-f20bb7c09622","resolution":{"observed_at":"2026-08-05T23:17:30.087581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11176","last_updated":"2023-05-24T04:17:34Z","snapshot_observed_at":"2026-08-16T15:31:55.161030Z","submitted_at":"2023-05-18T17:59:49Z","title":"Instruct2Act: Mapping Multi-modality Instructions to Robotic Actions with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11176","snapshot_observed_at":"2026-08-05T23:17:30.341166Z","title":"Huang, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.341166Z"},"links":{"cited_paper":"/paper/2305.11176","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:a4625cacc576a44eb2616f91df758b4b98f1f55145d78439163e0f70e3a29562","observation_id":"ba2340f1-f0a0-4a76-8b2a-df76d4981e15","resolution":{"observed_at":"2026-08-05T23:17:30.341166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:17:30.443167Z","title":"Huang, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.443167Z"},"links":{"citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:f987f2e101f3359a085467442cc0cb6b9ab99f116220bf647adf8548dd4fdff4","observation_id":"1feaeb50-26d9-41ed-bca0-d97a6494db42","resolution":{"observed_at":"2026-08-05T23:17:30.443167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13503","last_updated":"2024-11-20T17:54:41Z","snapshot_observed_at":"2026-08-12T19:44:40.357419Z","submitted_at":"2024-11-20T17:54:41Z","title":"VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13503","snapshot_observed_at":"2026-08-05T23:17:30.512487Z","title":"Huang, Y","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.512487Z"},"links":{"cited_paper":"/paper/2411.13503","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:91a51e44e6437306e62d3cbc9906d5e396cf4e4038c95400bbec105c91c6ff90","observation_id":"fc63032e-f7ef-4563-910d-04e933280324","resolution":{"observed_at":"2026-08-05T23:17:30.512487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09723","last_updated":"2025-05-14T18:30:53Z","snapshot_observed_at":"2026-08-19T09:18:14.815184Z","submitted_at":"2025-05-14T18:30:53Z","title":"EnerVerse-AC: Envisioning Embodied Environments with Action Condition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09723","snapshot_observed_at":"2026-08-05T23:17:30.695745Z","title":"Jiang, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.695745Z"},"links":{"cited_paper":"/paper/2505.09723","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:f6b795b54c78f5b9e7f98aa2634417df708e4f7d34d64da1f2f04803d41ae9ca","observation_id":"bfbadbb1-b34e-4a09-9a3c-f5c4ca77f152","resolution":{"observed_at":"2026-08-05T23:17:30.695745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T23:17:30.780614Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.780614Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:943928393d44e0e975dc6593dfa2c81d1b785e1d1201f5edccc0d00282898bde","observation_id":"82a54b05-05b0-487e-baa4-a9bbeec5812f","resolution":{"observed_at":"2026-08-05T23:17:30.780614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.10470","last_updated":"2021-08-25T23:42:59Z","snapshot_observed_at":"2026-07-06T11:40:56.544714Z","submitted_at":"2021-08-24T01:38:11Z","title":"Isaac Gym: High Performance GPU-Based Physics Simulation For Robot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.10470","snapshot_observed_at":"2026-08-05T23:17:30.847618Z","title":"Makoviychuk, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.847618Z"},"links":{"cited_paper":"/paper/2108.10470","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:09a2ef5ae3da53d8f3d9abe8b60dae67a2a24b11329df5871609434d438a7c4d","observation_id":"d29d1996-c7da-4d58-9467-7efc3cc43965","resolution":{"observed_at":"2026-08-05T23:17:30.847618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02523","last_updated":"2024-06-04T17:41:31Z","snapshot_observed_at":"2026-08-16T06:47:25.140028Z","submitted_at":"2024-06-04T17:41:31Z","title":"RoboCasa: Large-Scale Simulation of Everyday Tasks for Generalist Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02523","snapshot_observed_at":"2026-08-05T23:17:31.062792Z","title":"Nasiriany, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:31.062792Z"},"links":{"cited_paper":"/paper/2406.02523","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:1f6806cf375b487e6869d7741fc39e4666006d4ba87a19b4f505c383c4bbd94f","observation_id":"dbac4574-998c-4ca5-8e9d-29d6c2859f06","resolution":{"observed_at":"2026-08-05T23:17:31.062792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T23:17:31.139337Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:31.139337Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:0a14b845f8e43ed2ad141f2a5bde5cc74897aaebebed987d94c803e9b99d0864","observation_id":"2d467439-2c95-4b3f-906c-752f7fd4d0ec","resolution":{"observed_at":"2026-08-05T23:17:31.139337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T23:17:31.401428Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:31.401428Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:574bfdf8fa80133fcc6a0dbf82c7c2bed40776e810266998ce6956702cec0b81","observation_id":"6839fd0d-3164-4fbb-b627-9c3e49f5aaa4","resolution":{"observed_at":"2026-08-05T23:17:31.401428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09694","last_updated":"2025-05-18T17:18:18Z","snapshot_observed_at":"2026-08-18T19:30:43.005770Z","submitted_at":"2025-05-14T18:00:19Z","title":"EWMBench: Evaluating Scene, Motion, and Semantic Quality in Embodied World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09694","snapshot_observed_at":"2026-08-05T23:17:31.480573Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:31.480573Z"},"links":{"cited_paper":"/paper/2505.09694","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:3a1599cc7eb8d1ba290230de3148ffdf314ac8f1a2c15a906f84399815e73c5a","observation_id":"f04fd008-207e-4eea-8d1f-860c823a51a4","resolution":{"observed_at":"2026-08-05T23:17:31.480573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24278","last_updated":"2025-04-02T20:24:22Z","snapshot_observed_at":"2026-08-19T12:50:38.181413Z","submitted_at":"2025-03-31T16:23:44Z","title":"AutoEval: Autonomous Evaluation of Generalist Robot Manipulation Policies in the Real World","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24278","snapshot_observed_at":"2026-08-05T23:17:31.589096Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:31.589096Z"},"links":{"cited_paper":"/paper/2503.24278","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:92a4d07cbdbfcc2380fe849f9c46c9f4f50553bba086b2ff56c11b1d6ea3c24d","observation_id":"18b236cf-56d0-42ca-a8f9-c41b95f1f3fd","resolution":{"observed_at":"2026-08-05T23:17:31.589096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-08-05T23:17:29.814945Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":1985,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.814945Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:a8ee5ea4c393b979f662bda9bf97af8380c96eb0c87879805c361811f2c2a2d2","observation_id":"55b19d09-6f06-4958-88f0-886d4394b064","resolution":{"observed_at":"2026-08-05T23:17:29.814945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-08-08T09:48:34.424815Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05363","snapshot_observed_at":"2026-08-05T23:17:30.959740Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.959740Z"},"links":{"cited_paper":"/paper/2410.05363","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:e377d3ca9dde2284b7b95e0c478a4abeb14e42357de881e4ea9d52f3ffc28894","observation_id":"468f7bfc-84f7-40dd-8cfb-4f19a6778545","resolution":{"observed_at":"2026-08-05T23:17:30.959740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14505","last_updated":"2025-01-15T18:57:31Z","snapshot_observed_at":"2026-08-18T22:19:45.911728Z","submitted_at":"2024-07-19T17:58:36Z","title":"T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14505","snapshot_observed_at":"2026-08-05T23:17:31.309031Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:31.309031Z"},"links":{"cited_paper":"/paper/2407.14505","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:908942f9d1a298db0a728a501ccaf23f89f9ddb783ba100c5fc2d29d184e8a68","observation_id":"48546cb2-cd8b-442f-891b-28f49d5ca583","resolution":{"observed_at":"2026-08-05T23:17:31.309031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-05T23:17:29.306232Z","title":"Bjorck, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.306232Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:9b6e06b699e38a66d58376c06f40621c7d42d1719e83038ca4e5e56bba7642b2","observation_id":"e60cf547-581c-4378-a235-8e6cf2419f7a","resolution":{"observed_at":"2026-08-05T23:17:29.306232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-05T23:17:30.199050Z","title":"HaCohen, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.199050Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:c4f67c9ca806ad63a83572cc2042b0d30e820b30b4cbaebc5c7ef3e766b0d196","observation_id":"c7671e54-96e4-4550-8b23-d654ab51b044","resolution":{"observed_at":"2026-08-05T23:17:30.199050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12705","last_updated":"2025-06-17T22:33:35Z","snapshot_observed_at":"2026-07-06T21:26:01.534136Z","submitted_at":"2025-05-19T04:55:39Z","title":"DreamGen: Unlocking Generalization in Robot Learning through Video World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12705","snapshot_observed_at":"2026-08-05T23:17:30.583875Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.583875Z"},"links":{"cited_paper":"/paper/2505.12705","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:0888973629067bfac9b829512a445777e939f6409ceb76e31a951b1f9703cea5","observation_id":"e55c7e97-c410-4feb-adc5-2509b6cdf0ca","resolution":{"observed_at":"2026-08-05T23:17:30.583875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20523","last_updated":"2025-03-26T13:11:35Z","snapshot_observed_at":"2026-08-12T12:54:06.280248Z","submitted_at":"2025-03-26T13:11:35Z","title":"GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20523","snapshot_observed_at":"2026-08-05T23:17:31.228840Z","title":"Russell, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:31.228840Z"},"links":{"cited_paper":"/paper/2503.20523","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:29118ca8edadfb06d55ff3311afd22ba3f0a58cc07d31ef8dec25998db1a288f","observation_id":"b6c18813-d730-4ef2-b420-e49c4df88b94","resolution":{"observed_at":"2026-08-05T23:17:31.228840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:17:30.282437Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:30.282437Z"},"links":{"citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:44dad77bd49f7331cb9db5347e549a6ac4c06b55f2eeb51f7ccb6044f7a24791","observation_id":"0bcdcfeb-4fd5-4635-8c42-52a3ddc9d666","resolution":{"observed_at":"2026-08-05T23:17:30.282437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-05T23:17:29.617937Z","title":"Brohan, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.617937Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:16de5be1ee4fa0e21fc21449f2cadb0320ee2b7b1b90b4762f055a9667f20c24","observation_id":"86b354ab-6a50-45db-9dc5-62f2ebe8fdaa","resolution":{"observed_at":"2026-08-05T23:17:29.617937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T23:17:29.235757Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.235757Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:d3623d9ab9f74598a9f26b3f8e584290892c1d8fed5bcd0f96383f90e9cc498f","observation_id":"3fe20f60-a804-4039-8456-9372d1f683f3","resolution":{"observed_at":"2026-08-05T23:17:29.235757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T23:17:29.081553Z","title":"Agarwal, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T23:17:29.081553Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2508.05636"},"observation_digest":"sha256:18f7ae2d82bf1ce535c965be934183e8da4ac3af4b2f0bd8038f8ca3cba8c8a6","observation_id":"1d82efa8-cf79-4816-a462-52bf55b1e559","resolution":{"observed_at":"2026-08-05T23:17:29.081553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.05636","last_updated":"2025-08-07T17:59:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T23:41:41.661423Z","submitted_at":"2025-08-07T17:59:59Z","title":"FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2508.05636."}