{"as_of":"2026-08-10T13:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5ff3ea7f8f5b2aa7471f50a1c9af1ad52eecb1e9af051cd2a7919bc640d559d4","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:39:50.752373Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03875/citation-record","integrity":"/paper/2608.03875/integrity","json":"/paper/2608.03875/citation-record.json","paper":"/paper/2608.03875"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.519465Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.519465Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:c0bb5f684071afa29cd0be94bea6e1a8dd237fbc4668f13b4427327b34a0fcfa","observation_id":"4279d3ba-80c9-46e0-b426-abdf5d33acce","resolution":{"observed_at":"2026-08-05T10:39:50.519465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.524495Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.524495Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:a8a18f229909631c3888bf6c48b98286f07a07c0a4f45685eafec178684b120c","observation_id":"0c9cea06-160d-489a-b4a6-cc69f83ce696","resolution":{"observed_at":"2026-08-05T10:39:50.524495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.495892Z","title":"2023 , eprint=","venue":null,"work_id":"79cd1952-ed55-42ee-8500-2e325e576e47","year":2023},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.530757Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:b77715cec43c786d7719ce6dc60c32290674ff0ed22ea40c0cb63d54f43d58da","observation_id":"da5d7d47-7bf4-4332-b98b-89c168f7540a","resolution":{"observed_at":"2026-08-05T10:39:51.504100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.470838Z","title":"Forty-second International Conference on Machine Learning , year=","venue":null,"work_id":"b249c955-532b-44dc-9ab7-34b389edf65a","year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.535388Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:ce5088bb94d3bd9d989fdcb8416ca0467a6a33388143f459666551c83b97d8d2","observation_id":"6e93e426-9d50-4590-bab2-519f6f2f0640","resolution":{"observed_at":"2026-08-05T10:39:51.479874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.540135Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.540135Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:d43a145d186a094e5611e55a7f095476f14fbb788767c256735ccbcface1f4c0","observation_id":"eb11ea94-73ad-4046-9771-598b66381d70","resolution":{"observed_at":"2026-08-05T10:39:50.540135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.436942Z","title":"2023 , eprint=","venue":null,"work_id":"5d23174c-7589-4ebd-ac2e-149724ce6f74","year":2023},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.545453Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:27924348bc75ff3fa7b5711b86de32e7d3dcecf31b3655ac9796933764b94cbe","observation_id":"d2ad46b7-3186-4055-81e6-b8a7c2b0c75f","resolution":{"observed_at":"2026-08-05T10:39:51.447292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.410467Z","title":"2022 , eprint=","venue":null,"work_id":"857d540f-bba0-464e-a9f5-7e36f8b55f85","year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.550424Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:02cb1002201a6e57c32fec0e93e6579b1cab8dbf05126716f931e0aa03b7c848","observation_id":"d86fdeef-ecb6-4929-8785-4b3b8a6ad079","resolution":{"observed_at":"2026-08-05T10:39:51.419003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.555423Z","title":"2022 , url=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.555423Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:cc493dbe7ad6bd06bb8d71cf6e9126d62d02efe45f422b0d2774004173f9bac7","observation_id":"f176532b-ce3c-4666-b258-8110c5d44b83","resolution":{"observed_at":"2026-08-05T10:39:50.555423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.374813Z","title":"2024 , eprint=","venue":null,"work_id":"7f396b7c-b4af-489b-9dac-d678a6967b81","year":2024},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.560038Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:c623cbfb61a1d44a1d1cc01bc8e7370d7b09b49c9f241b87d89486cf0b411dfc","observation_id":"1e928e64-4e62-4b2f-868d-9cb07d19d1eb","resolution":{"observed_at":"2026-08-05T10:39:51.383719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.359856Z","title":"2024 , eprint=","venue":null,"work_id":"abf408fa-4ba9-4fb6-8d14-3b2eeba7dd8b","year":2024},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.565505Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:e9ecc8b018710969e73e9cbe3629586d50581bc1924e36b6eb03ed4017693b4b","observation_id":"2de98b43-4866-4f04-ba23-3d47deebec18","resolution":{"observed_at":"2026-08-05T10:39:51.364357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.569787Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.569787Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:02555003d61b11f67aa04b7878ca7b106ab45b9cbb801010f348aaa8f071bae3","observation_id":"a5030185-93e5-4fae-b9d9-f7ef05f35f9f","resolution":{"observed_at":"2026-08-05T10:39:50.569787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.335053Z","title":"2023 , eprint=","venue":null,"work_id":"354810a5-354b-4886-93cc-686ac413a986","year":2023},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.575026Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:31d55e577765995ddb9a270df2b310a5a2c7a898e38caf4c1195a41b7f55dc2f","observation_id":"855f8db7-72fe-466e-9442-0573f39f360f","resolution":{"observed_at":"2026-08-05T10:39:51.339810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.318343Z","title":"2025 , eprint=","venue":null,"work_id":"e29adc00-7542-436b-915d-4bb0ce90ecb9","year":2025},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.579474Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:4efcbba092b22b40c5fea23b46c7d572a8a27704548a09bdc2ef13116116b2d3","observation_id":"5f93d832-d65b-4b71-853f-8ab816697dc6","resolution":{"observed_at":"2026-08-05T10:39:51.323575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.301040Z","title":"2020 , eprint=","venue":null,"work_id":"faf3e9bf-2261-44e0-8365-23c1e6110e53","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.584515Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:6a6cedad639c953822dc222d3bf409ca3f7144a279b3a8678e66377f10cefad8","observation_id":"ff478223-4fa7-4fe5-b643-3fd9402f3f29","resolution":{"observed_at":"2026-08-05T10:39:51.305876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.284653Z","title":"2018 , eprint=","venue":null,"work_id":"a2cd99c3-d606-42c8-9299-9359c61bc96b","year":2018},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.589264Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:3a328723f1854d245fa0431fdfcf0ba0223ff3d76ccc803401aaac6a07785e3b","observation_id":"6108c9d0-7535-4de9-862e-a0a456a15019","resolution":{"observed_at":"2026-08-05T10:39:51.289695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.268236Z","title":"2020 , eprint=","venue":null,"work_id":"65d048c2-17a7-41cd-8bf9-3251dd9eff63","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.594281Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:6bc531e8e3f804ba47ca3cb08f23c5729b55d807a056a9d04b733a8009bc1206","observation_id":"dd945a46-8720-4882-840e-e5b8aac1afd7","resolution":{"observed_at":"2026-08-05T10:39:51.273409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.252026Z","title":"2019 , eprint=","venue":null,"work_id":"8b6ce6ce-ba70-43f5-99c1-5a489b24284e","year":2019},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.598763Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:bf678d1a3fc8f4ac513e51f958f0d0bee43788058987e9790f8c2a3cf4c9c803","observation_id":"92eb70fb-db87-481d-b287-a2be7f460f56","resolution":{"observed_at":"2026-08-05T10:39:51.256752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.237210Z","title":"2020 , eprint=","venue":null,"work_id":"b9d351b5-d0c4-4a73-91f8-53f88103335c","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.603600Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:d7b873e94997b287e0641a1ec044c472861300f21f8c515435dda3fa19f78224","observation_id":"c9a9337f-84fc-44ba-8167-fd02662756f3","resolution":{"observed_at":"2026-08-05T10:39:51.241948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.608134Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.608134Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:206b631f8d37e6c376e5d72ffc62dd84db231b3e2b1681b73f83f5fba3a293c6","observation_id":"1f3c0fa2-603a-41c4-b27e-c554a746c283","resolution":{"observed_at":"2026-08-05T10:39:50.608134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.210970Z","title":"2020 , eprint=","venue":null,"work_id":"68147462-8221-47f9-884e-00db3c072769","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.612961Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:8b7a9e848a4510d981aff3cb03b5408aacf832c1836cedc34fe056658639e64c","observation_id":"d8cb0426-bfd1-4237-b9cd-28a277474898","resolution":{"observed_at":"2026-08-05T10:39:51.215734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.195761Z","title":"2016 , eprint=","venue":null,"work_id":"6116f641-c53b-4720-a9b9-50cd2e1d617c","year":2016},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.617384Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:5758df09f9ff73c844dbe7ec29b258975c846b81c51a82f5a0f797ded902b141","observation_id":"e147877a-9bd5-443a-89e7-d44690e6f953","resolution":{"observed_at":"2026-08-05T10:39:51.200721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.181023Z","title":"2017 , eprint=","venue":null,"work_id":"f1c89a4b-9ace-4e59-a618-68c5daac10a7","year":2017},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.622299Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:d6d9c2013eddeb39ecf31993d9b9e65cac71bba9262810653d64b00e7849070c","observation_id":"852696a5-60c7-4a6b-8e41-a92a6f60ca3d","resolution":{"observed_at":"2026-08-05T10:39:51.185616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.626656Z","title":"and Chopra, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.626656Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:707bc67c565830e5bba8ecdc3d0e975523d95f0353d763b14deed66e5d190e73","observation_id":"af9a05c5-f104-478f-9d2e-3490563e456a","resolution":{"observed_at":"2026-08-05T10:39:50.626656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.631629Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.631629Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:26afb6439b1eb0100c9e750bf42e66d5f547a3a634ee5cb2ead86c32e9500ec2","observation_id":"791ebae3-a422-47de-8c30-7863aa9aadc2","resolution":{"observed_at":"2026-08-05T10:39:50.631629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.146853Z","title":"2020 , eprint=","venue":null,"work_id":"addd4769-1e2a-448e-a1b8-ce8063bec60e","year":2020},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.635768Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:fc3f8ed283e7b00fe005b2beb4fbfeb00357635b7cc9c06b0f1c3f33e6c1977f","observation_id":"6f61f2e8-7695-43d3-a705-016d6c32ac06","resolution":{"observed_at":"2026-08-05T10:39:51.151714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.641243Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.641243Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:b0dd03edb2c324460e1a577dd3cafb81fcc0d19c04cc26cc466e6a2c5e2cc1cb","observation_id":"b3c343aa-00c8-4a2b-ac3a-d9b2a109b67c","resolution":{"observed_at":"2026-08-05T10:39:50.641243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.645676Z","title":"Terry , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.645676Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:3772ccd1a965c484fdae25317e810a5e91a47eb5271c6fff37c936fcbe0c0982","observation_id":"4804c65d-3590-4068-b72a-5631840182cd","resolution":{"observed_at":"2026-08-05T10:39:50.645676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.651522Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.651522Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:4bb9016be032f4ebd0ed060b5d4a8317d7859d2f2481324f5df99c57b5c18a9f","observation_id":"52756f09-709f-447d-838e-b671fbf34fcb","resolution":{"observed_at":"2026-08-05T10:39:50.651522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.101850Z","title":"2021 , eprint=","venue":null,"work_id":"c3aed295-2b5d-4a28-b834-c8a6dee6e787","year":2021},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.656277Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:8a69baf4bf5614f0c90dbc64c77b21b980bdd78fb13d9eff6b7365986a8612ee","observation_id":"bab72f3d-c83a-41bb-9146-2707268ac6b3","resolution":{"observed_at":"2026-08-05T10:39:51.107328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.086221Z","title":"2016 , eprint=","venue":null,"work_id":"0975b401-f1c0-4d67-8af3-6f5bff285894","year":2016},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.660979Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:513a58f0d43514993e639e0a74586e22ff12813730e67890519c4ee5e2730557","observation_id":"ca7abcee-b447-4840-9c8c-31deea35477f","resolution":{"observed_at":"2026-08-05T10:39:51.091116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.666428Z","title":"and Mathieu, Micha","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.666428Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:b3e37920a7b2dec52579cd1d7cb780161bfc6f2953dc793681ca1bd9e48be4d2","observation_id":"a1f17e65-97a5-49a4-a4bf-0d20f3c328e4","resolution":{"observed_at":"2026-08-05T10:39:50.666428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.670958Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.670958Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:1b14c87e0f7069168b27345ee74b958e40b0b9668f049c39e89538c8f795c8ba","observation_id":"62133fbe-576f-4b89-9860-5bcd918ce65d","resolution":{"observed_at":"2026-08-05T10:39:50.670958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22062","last_updated":"2025-08-01T06:40:13Z","snapshot_observed_at":"2026-08-10T12:44:14.015550Z","submitted_at":"2025-07-29T17:59:58Z","title":"Meta CLIP 2: A Worldwide Scaling Recipe","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22062","snapshot_observed_at":"2026-08-05T10:39:50.676419Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.676419Z"},"links":{"cited_paper":"/paper/2507.22062","citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:e7a4a9df0860ff20b87a596f51cb725c0635bf21bf513d41433aba19baa7a4cb","observation_id":"5c7b89bf-88f1-4b03-9f7e-bfa49d0f73af","resolution":{"observed_at":"2026-08-05T10:39:50.676419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.681579Z","title":"and Harada, Daishi and Russell, Stuart J","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.681579Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:607a83150926cd26a2415a21adbed13212433e179665833437063dee095457af","observation_id":"60c8d64b-2833-41cd-a27a-27aaa4bf5b15","resolution":{"observed_at":"2026-08-05T10:39:50.681579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.051240Z","title":"Model-free preference-based reinforcement learning , year =","venue":null,"work_id":"1e483007-24c9-424c-b14e-ef3918bc7f51","year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.686239Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:31bd3e1e0223bfefeccb0a448449e3d89ec3deb3f9c4676f59f315660b81264e","observation_id":"fd6706e6-b98a-4fa7-a407-84757c1a28f9","resolution":{"observed_at":"2026-08-05T10:39:51.055957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.690772Z","title":"Advances in Preference-based Reinforcement Learning: A Review , url=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.690772Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:64d48e8729a0952e7540c3e58e49081f410c1b7893b5bf988f6958ad40a50022","observation_id":"b0ce3377-1c2e-47f9-8df8-3190f9272aca","resolution":{"observed_at":"2026-08-05T10:39:50.690772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:51.035378Z","title":"2022 , eprint=","venue":null,"work_id":"6253fe9b-2546-49b4-87ed-3e71e95205dd","year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.695332Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:3bb61ced76e3bbc7a1b7b5d04d8af49de67f67009a72224df806477196d6eeae","observation_id":"70ec5bae-62db-4930-9eee-39f7ee1f0f28","resolution":{"observed_at":"2026-08-05T10:39:51.040226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.699762Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.699762Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:13459c275fbc7b3afa853052642f92912ef67fc172928a7cad63becb14691763","observation_id":"8d18a458-ddf5-41cf-8804-967c43382758","resolution":{"observed_at":"2026-08-05T10:39:50.699762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.705098Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.705098Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:f90d3bafc92b0c2285008d3d0ca1aad2f6e9ec2e6a5dfe5afb059535371d3642","observation_id":"49fa5bb8-9792-4850-ab0d-5ce27d823c5a","resolution":{"observed_at":"2026-08-05T10:39:50.705098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.709584Z","title":"2016 , eprint=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.709584Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:fffffdaabc83210b483a8c3812d61ebfaba90896d5ab449850f2de55166822ae","observation_id":"21c27120-5b76-477b-bb74-9b219db682ee","resolution":{"observed_at":"2026-08-05T10:39:50.709584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.714563Z","title":"Orbit: A Unified Simulation Framework for Interactive Robot Learning Environments , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.714563Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:292b4114ed989feac0fd46621a83ab44a598bf066ab5ba83761eadb7c0b61186","observation_id":"a3ad831b-8c00-462b-a78e-9ac9868ae026","resolution":{"observed_at":"2026-08-05T10:39:50.714563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.719216Z","title":"doi:10.5281/zenodo.5143773 , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.719216Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:4fc310a9d70968c6a97cdce440868cb6a5f4bbf8dd1969733ef8244fe09a1f1c","observation_id":"3177818c-292a-4d75-b414-b2c617dee1da","resolution":{"observed_at":"2026-08-05T10:39:50.719216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.723949Z","title":"Journal of Machine Learning Research , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.723949Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:025797cb3b5fbaf14ca2b7c0c274efdac90124ac87531ec2f7e3b4a0cd846846","observation_id":"72cd421a-458a-4d36-bff6-c22cc9c9cc1e","resolution":{"observed_at":"2026-08-05T10:39:50.723949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.969562Z","title":"Proceedings of the 5th Conference on Robot Learning , pages =","venue":null,"work_id":"048485f8-085e-4332-977d-b5e2aff3933b","year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.728946Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:06ea53041b3dff7c72520208446a519a24a9b26646abe8657970ffc58d1fe548","observation_id":"8f5c9055-2cf0-4edd-b9e7-feec406362d3","resolution":{"observed_at":"2026-08-05T10:39:50.974416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.734020Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.734020Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:48c90f6e9ea59527ae275ab7cabcd49a81949bdee82509772488a371f149a951","observation_id":"008e05c9-2908-42b9-83f6-ba15edf5f56d","resolution":{"observed_at":"2026-08-05T10:39:50.734020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.943606Z","title":"2017 , eprint=","venue":null,"work_id":"b97f8f43-ea72-42f7-b89a-d021ae85856d","year":2017},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.738647Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:33dd8ac4d02785e4b7b49636974b7c91e2c091f23104a89997ffab7e2bb817a8","observation_id":"fa12b9cf-840e-4cd2-91a3-fa59ef54ee9c","resolution":{"observed_at":"2026-08-05T10:39:50.948927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.926324Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"7788181f-7745-47d8-8595-a144873b7b2d","year":null},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.742948Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:ebab8af0f5d36df4d460781365d778af8aa170838d0805253a7c9be1b878a678","observation_id":"49152e4f-97ec-49e7-a1af-cc5a6c0a0653","resolution":{"observed_at":"2026-08-05T10:39:50.932471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.748020Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.748020Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:ea21568517d4c16cb81d2208ae1f8e7b06bbdaaaf697604752e5bf9cb6d344db","observation_id":"8f86e78d-6c1a-444c-bb78-a82660a1a4bc","resolution":{"observed_at":"2026-08-05T10:39:50.748020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:39:50.900071Z","title":"2025 , eprint=","venue":null,"work_id":"5feec701-791b-46b5-b0c5-bb5a10baf577","year":2025},"citing_paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T10:39:50.752373Z"},"links":{"citing_paper":"/paper/2608.03875"},"observation_digest":"sha256:555708cee047f937f1c6dda3b4a6656f5d1963baf12348fa5cd255662d40e71b","observation_id":"7bd474c2-2496-415d-b125-aad8541e5c83","resolution":{"observed_at":"2026-08-05T10:39:50.906097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03875","last_updated":"2026-08-04T16:15:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T14:24:55.633157Z","submitted_at":"2026-08-04T16:15:12Z","title":"Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2608.03875."}