{"as_of":"2026-08-09T15:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:100faee664ef68fe4437efb7e6aa2df97721e4b1e574194d88441d0b224b7eb0","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T19:33:06.822584Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16947/citation-record","integrity":"/paper/2607.16947/integrity","json":"/paper/2607.16947/citation-record.json","paper":"/paper/2607.16947"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:03.470997Z","title":"Videophy: Evaluating physical commonsense for video generation.ICLR, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.470997Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:12bb7b173553577936e7103a2177a8bca5f88361ce880807e521991a406af389","observation_id":"a6a3fe1b-436b-4008-8b80-11e41939d3f9","resolution":{"observed_at":"2026-08-01T19:33:03.470997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06800","last_updated":"2025-03-09T22:49:12Z","snapshot_observed_at":"2026-08-07T17:18:26.824890Z","submitted_at":"2025-03-09T22:49:12Z","title":"VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evaluation in Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06800","snapshot_observed_at":"2026-08-01T19:33:03.502183Z","title":"Videophy-2: A challenging action-centric physical com- monsense evaluation in video generation.arXiv preprint arXiv:2503.06800, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.502183Z"},"links":{"cited_paper":"/paper/2503.06800","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:64b5ba2e0c448591edef7a533f363f40801f5de6873d49223e6c56eb74a359ab","observation_id":"087d6028-ce69-4bf7-bf1d-e1f662b0f4e2","resolution":{"observed_at":"2026-08-01T19:33:03.502183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01973","last_updated":"2018-06-21T14:54:33Z","snapshot_observed_at":"2026-08-07T19:33:19.839652Z","submitted_at":"2018-01-06T05:44:29Z","title":"A Note on the Inception Score","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01973","snapshot_observed_at":"2026-08-01T19:33:03.605167Z","title":"A note on the inception score.arXiv preprint arXiv:1801.01973, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.605167Z"},"links":{"cited_paper":"/paper/1801.01973","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:fc401cce6346387fb5e59abe1f3e8d9873ee79a2759f52589c1c6741ac95f5eb","observation_id":"71184ea0-57c8-477a-a13c-bcbfe7ab3962","resolution":{"observed_at":"2026-08-01T19:33:03.605167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:03.667148Z","title":"Curricu- lum learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.667148Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:e0bad3c4df9747069e3834144f5c2cb0b69f8a379ac5d00a2f47d696d3cc4cc9","observation_id":"edd02ddc-c2b2-4663-87b4-25e00586eeb6","resolution":{"observed_at":"2026-08-01T19:33:03.667148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:03.719052Z","title":"Hierarchical fine-grained preference optimization for physically plausible video generation.NeurIPS, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.719052Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:9a4df514699844cc35278ecc39a6ea31667fe0e3529303e6b09e00cc2c7addcf","observation_id":"8a238d4f-ba5d-4100-83cf-6539782b6a8f","resolution":{"observed_at":"2026-08-01T19:33:03.719052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:03.781879Z","title":"Deep reinforcement learning from human preferences.NeurIPS, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.781879Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:649d87a78e4f4569415adc418d8f83a3f3e710add083ac6f2d4bed136a3d8113","observation_id":"7fda2ce6-4840-46ff-80ad-b5fa2a3d8a07","resolution":{"observed_at":"2026-08-01T19:33:03.781879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:03.837295Z","title":"Understanding world or predicting future? a comprehensive survey of world models.ACM Computing Surveys, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.837295Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:d218193d0f660de00376064c8a46b37ef98384afb7c4afb9c539d56428f6d8e5","observation_id":"887b8781-bf4b-4b97-82d6-9b45a1f262db","resolution":{"observed_at":"2026-08-01T19:33:03.837295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-01T19:33:03.905908Z","title":"Ltx- video: Realtime video latent diffusion.arXiv preprint arXiv:2501.00103, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.905908Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:2867064e9cac752c9e4ee2fec930d761a7d4a0f6fc797108e4b2713a10faa93c","observation_id":"9871ad53-b8de-4fc1-8411-92e610c07b23","resolution":{"observed_at":"2026-08-01T19:33:03.905908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:03.952423Z","title":"Co-teaching: Robust training of deep neural networks with extremely noisy labels","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:03.952423Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:8ee268925fa124d37587b64f8cea813cecd13d31ebdc5eeae26c0636200baf86","observation_id":"95015b73-23a5-49aa-9da1-bc1296c846df","resolution":{"observed_at":"2026-08-01T19:33:03.952423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24702","last_updated":"2026-04-06T10:12:03Z","snapshot_observed_at":"2026-08-02T11:34:44.120596Z","submitted_at":"2025-09-29T12:32:54Z","title":"Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24702","snapshot_observed_at":"2026-08-01T19:33:04.023158Z","title":"En- hancing physical plausibility in video generation by reasoning the implausibility","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.023158Z"},"links":{"cited_paper":"/paper/2509.24702","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:25d773ca0cacb7efa9e05d35a3478432255db62e0291b81278bf18f8728389dc","observation_id":"d567dd91-b786-48dc-b649-aa0fb1935cd4","resolution":{"observed_at":"2026-08-01T19:33:04.023158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.076136Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.076136Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:7abaa68f57cbd1da8a513840a67565dbd16a024135ea44b3d07929b96445a2fd","observation_id":"8158d4b9-be0e-4c0e-aef9-63ccc13b59e9","resolution":{"observed_at":"2026-08-01T19:33:04.076136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.150711Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.150711Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:62fa3164362c69a1d57645c0a241a879236a99079a0dc5286f00554758b20570","observation_id":"6e05dc66-9fa9-4401-a48c-0b677fecd963","resolution":{"observed_at":"2026-08-01T19:33:04.150711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.203949Z","title":"Vistadpo: Video hierarchical spatial-temporal direct preference optimization for large video models.ICML, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.203949Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:c472459d3d81f4b176e82888a5cc31c588d19b3c020c2297f3636ed1ee68ddc3","observation_id":"0f900c9b-332d-43c3-8b0d-3508cb32beae","resolution":{"observed_at":"2026-08-01T19:33:04.203949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.254901Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.254901Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:d2fda3bdada53ec0ca07d5021ac9d50882b39c49d0e539f143e8999f9cb2cbf1","observation_id":"a5320cdd-73f7-4f7d-aebd-51616e968083","resolution":{"observed_at":"2026-08-01T19:33:04.254901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.306812Z","title":"Physmas- ter: Mastering physical representation for video generation via reinforcement learning.arXiv preprint arXiv:2510.13809, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.306812Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:c55b410924112e04c6e8d9492376bf9ea00cc2b286246d11138ea9555a8dd56f","observation_id":"2b247ab9-0498-4b4d-a3a3-7a0971cdf8df","resolution":{"observed_at":"2026-08-01T19:33:04.306812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01690","last_updated":"2025-02-02T16:55:42Z","snapshot_observed_at":"2026-07-06T20:30:31.588538Z","submitted_at":"2025-02-02T16:55:42Z","title":"HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01690","snapshot_observed_at":"2026-08-01T19:33:04.356173Z","title":"Huvidpo: Enhancing video generation through direct preference optimization for human- centric alignment.arXiv preprint arXiv:2502.01690, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.356173Z"},"links":{"cited_paper":"/paper/2502.01690","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:bd86dfbae01324b08340e9a85b5ca0cf52141d7bd4a9178f25367dd85280f567","observation_id":"a1242d1d-aad2-49d6-bc33-af5269cbdd60","resolution":{"observed_at":"2026-08-01T19:33:04.356173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.405951Z","title":"How far is video generation from world model: A physical law perspective.ICML, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.405951Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:b90a328d164a2fca58daf1cab92050b0df10d0c4cce74603c549186e5b1edf5f","observation_id":"3a0372bd-fc77-4664-bfff-66054f3c706c","resolution":{"observed_at":"2026-08-01T19:33:04.405951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.473609Z","title":"Musiq: Multi-scale image quality transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.473609Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:ff70601b5ae08ab9174c5ebcdadfe1d0ec1c71c903fedd674fd4580423cea766","observation_id":"6773beee-a219-4286-b493-11ed4e38bd8d","resolution":{"observed_at":"2026-08-01T19:33:04.473609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-01T19:33:04.553310Z","title":"Hunyuanvideo: A systematic frame- work for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.553310Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:079a14fefa867bb66cd25ef8cdc27ff85ddb373b48a2192ada968e7eeff933d7","observation_id":"ebabb428-24b8-4dd2-9c60-190dd4e7069a","resolution":{"observed_at":"2026-08-01T19:33:04.553310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.628070Z","title":"What about gravity in video generation? post-training newton’s laws with verifiable rewards.arXiv preprint arXiv:2512.00425, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.628070Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:b02a57c4834f899bd9901b441611d031a3f72ca7df01bff5a2ca4c9d5bf5aa05","observation_id":"bf4e3443-4391-4c56-88da-44e702ee31dd","resolution":{"observed_at":"2026-08-01T19:33:04.628070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.730904Z","title":"Videodpo: Omni-preference alignment for video diffusion generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.730904Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:068da9f0d11e0893510a42417e3b5af4181d7e0d8c19ff6f503ff41b01b72e7c","observation_id":"a8d3f609-32ef-4574-b824-891e9147078f","resolution":{"observed_at":"2026-08-01T19:33:04.730904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.809123Z","title":"Physgen: Rigid-body physics-grounded image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.809123Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:eae1fd73fc4076342a522154a8410f7a57f4eb8e619009da8dc08ef2892d588c","observation_id":"6c4b76e3-e405-4e19-a9b4-4d48688ca2a5","resolution":{"observed_at":"2026-08-01T19:33:04.809123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.890848Z","title":"Evalcrafter: Benchmarking and evaluating large video generation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.890848Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:c716f83629a9badbfcb0578f66ddc1adf07e5bfb32cc46d35592cae0375b1ed3","observation_id":"a62b74b1-2aee-4071-882d-6fb82191a20b","resolution":{"observed_at":"2026-08-01T19:33:04.890848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.942221Z","title":"Decoupled weight decay regularization.ICLR, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.942221Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:075cdd0f28fdae9b6400c173e2cef966ae470ec7ac39db1849c69941abea5d4e","observation_id":"ea3bf93e-939d-4aea-8145-326054c90500","resolution":{"observed_at":"2026-08-01T19:33:04.942221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:04.999366Z","title":"Contextanyone: Context-aware diffusion for character-consistent text-to-video generation.arXiv preprint arXiv:2512.07328, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:04.999366Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:e78976b655e130b6b73d16c0299b193d9cfd4c0a6917cbabf957339055ee7840","observation_id":"cbc9f32b-4f2b-4a59-8690-85a7c285c599","resolution":{"observed_at":"2026-08-01T19:33:04.999366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.094341Z","title":"Towards world simulator: Crafting physical commonsense-based benchmark for video generation.ICML, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.094341Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:9fbf32746922b4d358da803776bcd7bc6eee24c67f2111db5bf26e46986ea9a6","observation_id":"3fc6f76b-4a0b-4b80-b235-5728e2041b1f","resolution":{"observed_at":"2026-08-01T19:33:05.094341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.144544Z","title":"Grounding creativity in physics: A brief survey of physical priors in aigc.IJCAI, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.144544Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:0622ab541ddc66987f142239a68edf1bae2d714f53609c019442f6db5f654667","observation_id":"d0be5d56-1ad8-4e9f-920a-4dd982c307a1","resolution":{"observed_at":"2026-08-01T19:33:05.144544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.207245Z","title":"Phymagic: Physical motion-aware gener- ative inference with confidence-guided llm.ECCV, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.207245Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:c3b3dd75049518257c8796a452fff9e8e2b627d2f61f4c915a43a20471fd65da","observation_id":"061a6a70-fa80-4978-a645-3b23ca5a9683","resolution":{"observed_at":"2026-08-01T19:33:05.207245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.259934Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.259934Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:6edab4c578e1c3b0e11e8cc2c77d7f4fb3e12b3fea2331a8afd191991b395468","observation_id":"6f5ed4ad-7f61-41f2-aa0d-4671c3480759","resolution":{"observed_at":"2026-08-01T19:33:05.259934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18655","last_updated":"2025-06-23T13:55:24Z","snapshot_observed_at":"2026-08-08T19:34:49.703472Z","submitted_at":"2025-06-23T13:55:24Z","title":"RDPO: Real Data Preference Optimization for Physics Consistency Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18655","snapshot_observed_at":"2026-08-01T19:33:05.318987Z","title":"Rdpo: Real data preference optimization for physics consistency video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.318987Z"},"links":{"cited_paper":"/paper/2506.18655","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:5f70a69fefe9ff13093c920bb74a7a375759717146a7557485bc7c8f818ddcf3","observation_id":"b9a444ed-ca7e-4b2e-ae46-f04c795ef3b3","resolution":{"observed_at":"2026-08-01T19:33:05.318987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.419885Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.419885Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:884cf485c1ad8a784bf0a4d4a1b6a6ff69112cca64ade01935010263309e090c","observation_id":"7e1f85aa-73b6-4f3c-8b9b-ba87f4bd5895","resolution":{"observed_at":"2026-08-01T19:33:05.419885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.500052Z","title":"Direct preference optimization: Your language model is secretly a reward model.NeurIPS, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.500052Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:15140942a30d059429e347871d839b1382a809624b195f6662d1e236863d85a1","observation_id":"f814d13d-cdfb-4804-8fc9-9e00e61ff88e","resolution":{"observed_at":"2026-08-01T19:33:05.500052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.577629Z","title":"Learning to reweight examples for robust deep learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.577629Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:f9d6452983988bc124ae8d1b6cfe2c9db3901f6cc0833f006a623a2dd5a89f03","observation_id":"fdcf78fb-8165-486d-a569-20becef05731","resolution":{"observed_at":"2026-08-01T19:33:05.577629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.604747Z","title":"Physmotion: Physics-grounded dynamics from a single image.3DV, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.604747Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:2dab6a847c2c3327ff9abe2284ed46efe1ecf71a37332d998fb1f32ba6c1e0bc","observation_id":"04d83f26-fb5c-4d79-8d4f-f91aaca7a98c","resolution":{"observed_at":"2026-08-01T19:33:05.604747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.684476Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.684476Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:d40b59cad804c19f3c193d12db4db51f3816266d3f8d94f80e2e49898a9e6be4","observation_id":"34bcc05b-1983-41c0-9d9c-6510023a03ac","resolution":{"observed_at":"2026-08-01T19:33:05.684476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.729484Z","title":"Fvd: A new metric for video generation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.729484Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:90118c79ca2c80c344ecdd516bf872edd0b509a23c103ef9246f3fc323e09096","observation_id":"5fdf0ac8-a47a-47e0-a89c-bf26150a0fe8","resolution":{"observed_at":"2026-08-01T19:33:05.729484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-01T19:33:05.808898Z","title":"Wan: Open and advanced large- scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.808898Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:2f8039e9787c2c5f9ed79a7ec731107e08f8e7776264726335f467a1766b0e36","observation_id":"a41ef478-eb4d-44c5-9952-46e5f79a4a49","resolution":{"observed_at":"2026-08-01T19:33:05.808898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.873349Z","title":"Wisa: World simulator assistant for physics-aware text-to-video generation.NeurIPS, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.873349Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:b77fb161e0ae573b94d43c6dbde11e9068788a31c9ffd76559e8fdb825808ad7","observation_id":"49383ea5-b189-426b-9a5c-f27972665d5c","resolution":{"observed_at":"2026-08-01T19:33:05.873349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.930580Z","title":"Physcorr: Dual-reward dpo for physics- constrained text-to-video generation with automated preference selection.arXiv preprint arXiv:2511.03997, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.930580Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:ca27e5eb90d7555a5eee4d2140a3b99e21169913788c9fe7982c0e01186b7d06","observation_id":"7391740c-f3f7-4143-94b0-1eb483431fba","resolution":{"observed_at":"2026-08-01T19:33:05.930580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:05.979839Z","title":"A survey on curriculum learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:05.979839Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:d6bbe6fc0a839589c3efbc5e04b65cd4e3cf6987469c1a7439ae80484b3bec36","observation_id":"7ea3549c-c12a-41ff-9994-48fc6a364bf1","resolution":{"observed_at":"2026-08-01T19:33:05.979839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.055870Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation.ICLR, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.055870Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:0b7265bfa8326c390a44ac6599ce47b54e2ae0b0d9095652d657e31a0cc497ec","observation_id":"764d9002-ea7b-4914-a0f7-7f88090c6ee6","resolution":{"observed_at":"2026-08-01T19:33:06.055870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.139938Z","title":"Densedpo: Fine-grained temporal preference optimization for video diffusion models.NeurIPS, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.139938Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:9c00df861b5766cff1d330ce4dd2919e79986b67b1c655f02348c5586aec7bbf","observation_id":"91402689-1297-49cb-a95f-3cdb3840b63c","resolution":{"observed_at":"2026-08-01T19:33:06.139938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.192730Z","title":"Physgaussian: Physics-integrated 3d gaussians for generative dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.192730Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:dcfb22f08b55abdcda0e635078016a424791c069bdc8c63cd50c38853614d305","observation_id":"88d04606-c22b-4eb3-9497-4d47ef09d980","resolution":{"observed_at":"2026-08-01T19:33:06.192730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.267776Z","title":"VideoCLIP: Contrastive pre-training for zero-shot video-text understanding.EMNLP, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.267776Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:380ce3823afc10dce3cdab049af8b09153f1bda00af96d58fe85cf79558d34ad","observation_id":"6d5cf34c-82be-4361-a2cc-3dc6465d72a3","resolution":{"observed_at":"2026-08-01T19:33:06.267776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.320683Z","title":"Phyt2v: Llm-guided iterative self-refinement for physics-grounded text-to-video generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.320683Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:d7b32249314b921416749bf3b34b60fc93e415301da5fa01f848cbf6fe8ef614","observation_id":"6510dc96-b8ac-44ee-8886-146cf0835a7d","resolution":{"observed_at":"2026-08-01T19:33:06.320683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T19:33:06.400190Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.400190Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:841c2d44671dc54a76b9a932277eae4aa598609311196d79e49455fb5ea94533","observation_id":"cc196208-346e-4b50-9750-ffa52975afdf","resolution":{"observed_at":"2026-08-01T19:33:06.400190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.476026Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.476026Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:6c4580146eae9c2d226b58ef5872587aae26f531555b9e594d1086d299778752","observation_id":"f778a3f9-1b68-44d6-bd41-01521821c64b","resolution":{"observed_at":"2026-08-01T19:33:06.476026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.530030Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.ICLR, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.530030Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:27bea97c7263f5649b0ef71c5e56a3678554eea8ad3a1b2d246154081b4860cf","observation_id":"5a910ce3-9d10-47ea-bfb0-1e119d1c9a85","resolution":{"observed_at":"2026-08-01T19:33:06.530030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.601813Z","title":"Inference-time physics alignment of video gener- ative models with latent world models.arXiv preprint arXiv:2601.10553, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.601813Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:5d5ce91df2aa05818d78c2af5cf439dd2cbd878bee7777c12a6ceca34ea87e6c","observation_id":"97c3abd9-e377-4d8b-9f45-b991ee433ea2","resolution":{"observed_at":"2026-08-01T19:33:06.601813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.688570Z","title":"Think before you diffuse: Llms-guided physics-aware video generation.arXiv preprint arXiv:2505.21653, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.688570Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:2e4e0a42ea2c0b5418445983473a1b537b5912e7c29347903e1ad55093b61b26","observation_id":"9aaa0483-d2a5-49e9-bdee-d9e04380b29d","resolution":{"observed_at":"2026-08-01T19:33:06.688570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.757158Z","title":"Physrvg: Physics- aware unified reinforcement learning for video generative models.arXiv preprint arXiv:2601.11087, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.757158Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:dce0253e9f35b737b4989fa75c6686e774081e7edd986c4eb45dcc559c505373","observation_id":"97eadecb-6603-4cb3-aeef-ee588ca478a1","resolution":{"observed_at":"2026-08-01T19:33:06.757158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:33:06.822584Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena.NeurIPS, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T19:33:06.822584Z"},"links":{"citing_paper":"/paper/2607.16947"},"observation_digest":"sha256:b0cab4e2a1e424c798b1d9f5d08e9a79a79301f62c6bbcf94f6cf394bb5ff0e7","observation_id":"ed83d256-f265-4afb-a24f-de02bf6bf18e","resolution":{"observed_at":"2026-08-01T19:33:06.822584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16947","last_updated":"2026-07-18T20:03:50Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:13:12.484072Z","submitted_at":"2026-07-18T20:03:50Z","title":"When Physical Preferences Meet Semantic Constraints: Physical and Semantic Direct Preference Optimization for Text-to-Video Generation"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2607.16947."}