{"as_of":"2026-08-10T12:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:20db9e10fb73eab9398578f09c0aa4a6d28becbebb79f3b235beb5cbf0202b53","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":44,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:04:31.774244Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:19:12.971623Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T19:09:10.112304Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2503.14734"},"observation_digest":"sha256:57931e2e2edb82b1b2987d260ae22de5fdc1c8f0a42101ac177015a9daf5678d","observation_id":"643b9fc3-cbf4-43c7-81a6-f09073fdd162","resolution":{"observed_at":"2026-05-10T19:09:10.226821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2504.05299","last_updated":"2025-04-07T17:58:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T17:58:57Z","title":"SmolVLM: Redefining small and efficient multimodal models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T20:23:50.552549Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2504.05299"},"observation_digest":"sha256:74b4f70f6a8e8b91353a2a0b926b39b9976efafaac3e286c4b040578beaea8fa","observation_id":"fb435987-89ee-4b47-8080-6a7c1e77b393","resolution":{"observed_at":"2026-05-13T20:23:51.730104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T07:07:56.707005Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T13:41:07.991012Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2504.10479"},"observation_digest":"sha256:076d163f44589342e7c47ab6b77122dad9c8cd537e84c64a4486aa176949b86f","observation_id":"5c37d1f1-2132-4333-af88-222f777f6598","resolution":{"observed_at":"2026-05-10T13:41:08.369391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2505.15659","last_updated":"2025-05-21T15:33:27Z","snapshot_observed_at":"2026-08-10T09:12:51.490663Z","submitted_at":"2025-05-21T15:33:27Z","title":"FLARE: Robot Learning with Implicit World Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T15:59:08.846629Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2505.15659"},"observation_digest":"sha256:e418128c06541aac49fbaf570284109a058c897a89d13af434b840ff9dc19826","observation_id":"a12d6416-3e90-484c-9582-34b747b27507","resolution":{"observed_at":"2026-05-17T15:59:08.936657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-07T15:04:31.774244Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16602","last_updated":"2025-05-22T12:37:47Z","snapshot_observed_at":"2026-08-09T23:20:33.885206Z","submitted_at":"2025-05-22T12:37:47Z","title":"MEgoHand: Multimodal Egocentric Hand-Object Interaction Motion Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:04:31.774244Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2505.16602"},"observation_digest":"sha256:49d315b423608f844e60613c64ab0de3e856029ef9003d51f8eef92493249588","observation_id":"f7161beb-6561-4e9a-8243-92954042ffef","resolution":{"observed_at":"2026-08-07T15:04:31.774244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-07T10:55:14.714418Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04034","last_updated":"2025-06-04T14:56:57Z","snapshot_observed_at":"2026-08-07T10:46:30.489099Z","submitted_at":"2025-06-04T14:56:57Z","title":"Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:55:14.714418Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2506.04034"},"observation_digest":"sha256:b37896465b4d5328b01923b822ef432084596d57bbca74c88236adc4ead07b16","observation_id":"69202f30-68ad-453a-98c2-d64ef031cf78","resolution":{"observed_at":"2026-08-07T10:55:14.714418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-07T10:47:46.925421Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04353","last_updated":"2025-06-04T18:11:59Z","snapshot_observed_at":"2026-08-10T05:27:00.249725Z","submitted_at":"2025-06-04T18:11:59Z","title":"ReXVQA: A Large-scale Visual Question Answering Benchmark for Generalist Chest X-ray Understanding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:47:46.925421Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2506.04353"},"observation_digest":"sha256:5af648ce9a4995fe76ba7e54e316288c10be6b7d498a6f92f6d6f629080e6c34","observation_id":"9c95f372-a496-4127-bad7-6d43e929ea48","resolution":{"observed_at":"2026-08-07T10:47:46.925421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-07T10:27:05.611836Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05328","last_updated":"2025-07-22T07:00:35Z","snapshot_observed_at":"2026-08-08T19:39:48.959316Z","submitted_at":"2025-06-05T17:58:33Z","title":"AV-Reasoner: Improving and Benchmarking Clue-Grounded Audio-Visual Counting for MLLMs","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:27:05.611836Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2506.05328"},"observation_digest":"sha256:dd5d06517fc910b87afd80ddcf72489b5e5a020aeb6b2c9da4fcebd4f19419d6","observation_id":"8ee657c0-142e-46e5-abb7-0f73ee36fc1f","resolution":{"observed_at":"2026-08-07T10:27:05.611836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-07T06:00:58.645840Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06253","last_updated":"2025-06-06T17:25:48Z","snapshot_observed_at":"2026-08-09T07:19:17.693738Z","submitted_at":"2025-06-06T17:25:48Z","title":"Bridging Perspectives: A Survey on Cross-view Collaborative Intelligence with Egocentric-Exocentric Vision","version":1},"reference_index":214,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:58.645840Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2506.06253"},"observation_digest":"sha256:f82c8b14cf9ff37000198a5ab2c1f98e14ca7e41cd9dce40e164e1466ffb8088","observation_id":"dd1c2e60-2032-4a6d-9fd3-542584e3016c","resolution":{"observed_at":"2026-08-07T06:00:58.645840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-07T00:48:30.849435Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12776","last_updated":"2025-06-15T08:58:09Z","snapshot_observed_at":"2026-08-10T10:18:08.457959Z","submitted_at":"2025-06-15T08:58:09Z","title":"Native Visual Understanding: Resolving Resolution Dilemmas in Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:30.849435Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2506.12776"},"observation_digest":"sha256:0a9cde989572ca9f2a232cb7fd2d8ff51b2e28a34b22cd92c184153983b98731","observation_id":"bf36f4bd-1fae-47c5-85ba-3a755db47a5a","resolution":{"observed_at":"2026-08-07T00:48:30.849435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-06T19:30:14.990336Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05513","last_updated":"2025-07-07T22:20:04Z","snapshot_observed_at":"2026-08-09T00:55:25.952612Z","submitted_at":"2025-07-07T22:20:04Z","title":"Llama Nemoretriever Colembed: Top-Performing Text-Image Retrieval Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:30:14.990336Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2507.05513"},"observation_digest":"sha256:cff2e586d204b998a97c283995e7c72412a77672019749703b6256e2a763cc2c","observation_id":"efc8c371-3195-4ec9-8a13-0156566cf750","resolution":{"observed_at":"2026-08-06T19:30:14.990336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2507.05920","last_updated":"2026-04-20T01:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-08T12:05:05Z","title":"High-Resolution Visual Reasoning via Multi-Turn Grounding-Based Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T06:10:57.219445Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2507.05920"},"observation_digest":"sha256:f2087c3f2075eeb48e7c9593138e6cd721d45f4c9187e64590b9ac236a865da6","observation_id":"80b8bca0-a559-4b5b-82a1-f870a84d7c70","resolution":{"observed_at":"2026-05-19T06:12:07.077961Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2507.16815","last_updated":"2025-09-18T16:26:53Z","snapshot_observed_at":"2026-08-03T17:16:24.219569Z","submitted_at":"2025-07-22T17:59:46Z","title":"ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T03:18:14.655384Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2507.16815"},"observation_digest":"sha256:73dc1bc5c3e2ecb3b485ba875cbf5c83f92f812d6b7383d39ff092913df72534","observation_id":"89a3eceb-d827-4ab1-a1f0-98bd559e4348","resolution":{"observed_at":"2026-05-19T03:22:00.910099Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-04T10:18:43.278717Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.10921","last_updated":"2026-05-25T02:35:42Z","snapshot_observed_at":"2026-08-04T10:18:40.408381Z","submitted_at":"2025-10-13T02:32:07Z","title":"FG-CLIP 2: A Bilingual Fine-grained Vision-Language Alignment Model","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-04T10:18:43.278717Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2510.10921"},"observation_digest":"sha256:7fe7c8234019634d91e8dfb8c812d97dcc649157c9758882f4ecc06aa496a9b0","observation_id":"a8a66cdb-7bab-4703-a7d3-0cd63a9a7abc","resolution":{"observed_at":"2026-08-04T10:18:43.278717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-03T18:15:05.687979Z","title":"Eagle 2: Building post- training data strategies from scratch for frontier vision- language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.06276","last_updated":"2026-07-28T07:07:11Z","snapshot_observed_at":"2026-08-10T11:50:46.710342Z","submitted_at":"2025-12-06T03:59:21Z","title":"RefBench-PRO: Perceptual and Reasoning Oriented Benchmark for Referring Expression Comprehension","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T18:15:05.687979Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2512.06276"},"observation_digest":"sha256:8540e55e8cbff61b0ebcd77737d9e0e3f5b3c7f192d9e1363f7bcd2c5b176ecc","observation_id":"9838a444-74c6-4038-9c95-699c7b9eb291","resolution":{"observed_at":"2026-08-03T18:15:05.687979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2604.04161","last_updated":"2026-04-10T12:28:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-05T16:03:32Z","title":"Adaptive Action Chunking at Inference-time for Vision-Language-Action Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T16:57:52.595165Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2604.04161"},"observation_digest":"sha256:dd58351f2d5efdfb9c883c673e31a5115a0bd60368e7a93f055fab84f7211b40","observation_id":"d1917e2a-55b9-4e1f-86c6-14e4f91c05fa","resolution":{"observed_at":"2026-05-13T17:08:01.427266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2604.11589","last_updated":"2026-04-13T15:04:40Z","snapshot_observed_at":"2026-07-06T22:59:59.220594Z","submitted_at":"2026-04-13T15:04:40Z","title":"MLLM-as-a-Judge Exhibits Model Preference Bias","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T15:42:39.226895Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2604.11589"},"observation_digest":"sha256:8d8e242b32a7048d243995cd8f8d40cf385d75c9ef321d8ffe3310ea44780972","observation_id":"a93d5529-c6e7-4497-9232-c89ed5af791d","resolution":{"observed_at":"2026-05-11T10:01:00.015653Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2604.18000","last_updated":"2026-04-20T09:25:30Z","snapshot_observed_at":"2026-08-03T00:50:48.601549Z","submitted_at":"2026-04-20T09:25:30Z","title":"Unmasking the Illusion of Embodied Reasoning in Vision-Language-Action Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T04:27:18.284698Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2604.18000"},"observation_digest":"sha256:f69cf417390d15b5e5f32fc968f37ff5947db8b8faf3310a4cf09675e4a05102","observation_id":"6281c86a-55f1-408d-9855-7556fc46e6a0","resolution":{"observed_at":"2026-05-11T11:56:29.370055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2604.19324","last_updated":"2026-04-21T10:46:42Z","snapshot_observed_at":"2026-07-31T05:48:40.687274Z","submitted_at":"2026-04-21T10:46:42Z","title":"PLaMo 2.1-VL Technical Report","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T03:09:05.436900Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2604.19324"},"observation_digest":"sha256:d6ee2bb857a6e4829bf8cdb63c90cd78f96c75636a03b7e9dcad1a58f7a759eb","observation_id":"aca1b3fb-d015-4f82-8a16-1f6255b734c2","resolution":{"observed_at":"2026-05-11T12:41:05.415340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2604.20012","last_updated":"2026-04-21T21:40:58Z","snapshot_observed_at":"2026-07-06T23:06:31.110859Z","submitted_at":"2026-04-21T21:40:58Z","title":"EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T02:16:08.687340Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2604.20012"},"observation_digest":"sha256:38b1e6dd164e72504ff9deb55d0f8921a9cb6615673f0bd74afdf8416529252f","observation_id":"24eb9b59-7a43-497b-8d15-255c9959a614","resolution":{"observed_at":"2026-05-11T13:11:03.790974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2604.24182","last_updated":"2026-07-05T10:54:06Z","snapshot_observed_at":"2026-08-02T12:46:51.494465Z","submitted_at":"2026-04-27T08:44:12Z","title":"$M^2$-VLA: Boosting Vision-Language Models for Generalizable Manipulation via Layer Mixture and Meta-Skills","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T03:13:36.437080Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2604.24182"},"observation_digest":"sha256:180ee5138563267a2c46580f43112daca2b80419005c6df5091e97fe423c0d27","observation_id":"beaa7510-805d-4dc7-8495-b697f14e6869","resolution":{"observed_at":"2026-05-11T22:11:15.902154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-12T18:17:43.564400Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.24182","last_updated":"2026-07-05T10:54:06Z","snapshot_observed_at":"2026-08-02T12:46:51.494465Z","submitted_at":"2026-04-27T08:44:12Z","title":"$M^2$-VLA: Boosting Vision-Language Models for Generalizable Manipulation via Layer Mixture and Meta-Skills","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T18:17:43.564400Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2604.24182"},"observation_digest":"sha256:8165595f085eb62732c1ba3d56cbc813d9d9f7aa0b2520c5d346d764aec00781","observation_id":"0567caf1-a2b9-4fbb-bd52-d46b7b614b62","resolution":{"observed_at":"2026-07-12T18:17:43.564400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2605.00078","last_updated":"2026-04-30T14:16:15Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T14:16:15Z","title":"Being-H0.7: A Latent World-Action Model from Egocentric Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T20:48:01.461993Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2605.00078"},"observation_digest":"sha256:417c01eea0839beb2d8c6c0712b59400decf60e0f9f58e55bd305d0ce3e315a0","observation_id":"795b5e01-06e5-4f67-800a-b9173d643d11","resolution":{"observed_at":"2026-05-11T15:01:04.535757Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2605.22819","last_updated":"2026-07-23T02:53:47Z","snapshot_observed_at":"2026-08-02T13:29:27.256254Z","submitted_at":"2026-05-21T17:59:45Z","title":"Cambrian-P: Pose-Grounded Video Understanding","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T05:47:13.493461Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2605.22819"},"observation_digest":"sha256:87bf8e624ea485ba5b7c098d792c741721ce898af30dd6020699934741840e79","observation_id":"ab5c764d-f318-4ed5-8c03-84fde4eb26fb","resolution":{"observed_at":"2026-05-22T05:51:09.039957Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-02T13:29:37.689045Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22819","last_updated":"2026-07-23T02:53:47Z","snapshot_observed_at":"2026-08-02T13:29:27.256254Z","submitted_at":"2026-05-21T17:59:45Z","title":"Cambrian-P: Pose-Grounded Video Understanding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T13:29:37.689045Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2605.22819"},"observation_digest":"sha256:d390534be391990de40b58522379a91d373202be844f70ae9539e84cffad5da8","observation_id":"f00be046-e1a3-4d5d-b731-f67b0dd3bc6c","resolution":{"observed_at":"2026-08-02T13:29:37.689045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2605.30282","last_updated":"2026-05-28T17:37:16Z","snapshot_observed_at":"2026-08-07T04:37:19.219534Z","submitted_at":"2026-05-28T17:37:16Z","title":"Gaze2Act: Gaze-Conditioned Vision-Language-Action Policies for Interactive Robot Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T07:12:17.310331Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2605.30282"},"observation_digest":"sha256:90c60be721557fd2a93b233b63a4231081fea66880720531b98e8917db8097c3","observation_id":"a1dccfdb-2fc5-499e-aa8e-0039dfc9a9a4","resolution":{"observed_at":"2026-06-29T07:13:16.123173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.04300","last_updated":"2026-06-03T00:08:44Z","snapshot_observed_at":"2026-07-06T23:44:28.265478Z","submitted_at":"2026-06-03T00:08:44Z","title":"Argus-Retriever: Vision-LLM Late-Interaction Retrieval with Region-Aware Query-Conditioned MoE for Visual Document Retrieval","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T04:55:04.299049Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.04300"},"observation_digest":"sha256:c946f1648db5476e0c889292b179ebb8ce5506aebf0c9e5df501167be8d14fa2","observation_id":"259ad005-488c-469b-b9ca-d1fceaa58521","resolution":{"observed_at":"2026-07-02T10:46:52.601436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.07100","last_updated":"2026-06-30T09:11:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-05T09:51:25Z","title":"LARA: Latent Action Representation Alignment for Vision-Language-Action Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T22:25:17.522240Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.07100"},"observation_digest":"sha256:1fdd83bc058e42627b5108e570aaf09c282012a3f040b030e277c78d171db6fc","observation_id":"a4df8f36-caaa-4b12-b784-cc83d247761f","resolution":{"observed_at":"2026-07-02T16:47:09.560724Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.07100","last_updated":"2026-06-30T09:11:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-05T09:51:25Z","title":"LARA: Latent Action Representation Alignment for Vision-Language-Action Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-01T07:17:42.045939Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.07100"},"observation_digest":"sha256:357035c7966c6ddffc23f5b7ef7c4b13aee39e9014ccea496397646cabcff94a","observation_id":"0d094686-c576-419d-b534-cf8f0dc5eba9","resolution":{"observed_at":"2026-07-01T08:35:34.490432Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.07383","last_updated":"2026-07-17T05:50:11Z","snapshot_observed_at":"2026-08-02T12:15:07.996580Z","submitted_at":"2026-06-05T15:21:41Z","title":"RhinoVLA Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T21:36:15.806974Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.07383"},"observation_digest":"sha256:fb5d97d493715882cff19483cda55df95d18b0271eb89906068004151a6d33e9","observation_id":"a8d772a3-ca21-4a45-827c-67057ce3c2fe","resolution":{"observed_at":"2026-07-02T19:17:17.961610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.07383","last_updated":"2026-07-17T05:50:11Z","snapshot_observed_at":"2026-08-02T12:15:07.996580Z","submitted_at":"2026-06-05T15:21:41Z","title":"RhinoVLA Technical Report","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T07:14:14.918962Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.07383"},"observation_digest":"sha256:9225036832ef88b6259bd6ab98fb163439921e49b6932f9ddb29ce18d3620387","observation_id":"e796f94f-66b2-473b-b200-e7143df6901f","resolution":{"observed_at":"2026-07-01T07:15:29.790701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-12T14:51:51.552221Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07383","last_updated":"2026-07-17T05:50:11Z","snapshot_observed_at":"2026-08-02T12:15:07.996580Z","submitted_at":"2026-06-05T15:21:41Z","title":"RhinoVLA Technical Report","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T14:51:51.552221Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.07383"},"observation_digest":"sha256:7232c4ae8b8468d58db97707c77777ef70ae0edec33a1030fa689aaea0bdf5c4","observation_id":"e8fd853e-026a-450a-83e8-87e71c406e24","resolution":{"observed_at":"2026-07-12T14:51:51.552221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-02T12:15:09.422092Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07383","last_updated":"2026-07-17T05:50:11Z","snapshot_observed_at":"2026-08-02T12:15:07.996580Z","submitted_at":"2026-06-05T15:21:41Z","title":"RhinoVLA Technical Report","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T12:15:09.422092Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.07383"},"observation_digest":"sha256:34b90f67209a920215b815b2a6c17a5f824a57480270fd318de5692cdfb7e6e8","observation_id":"eb234e85-e580-44b9-9b56-f51854879b04","resolution":{"observed_at":"2026-08-02T12:15:09.422092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-02T11:31:34.532750Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.14409","last_updated":"2026-07-20T07:32:26Z","snapshot_observed_at":"2026-08-05T17:41:55.223171Z","submitted_at":"2026-06-12T12:45:18Z","title":"Hy-Embodied-0.5-VLA: From Vision-Language-Action Models to a Real-World Robot Learning Stack","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:31:34.532750Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.14409"},"observation_digest":"sha256:7a6bf584536412e324afa88051517ec34f5a7b1baba99927f34e838a5c9ca335","observation_id":"171f1d79-6b59-477e-a1a0-3e6a776128c1","resolution":{"observed_at":"2026-08-02T11:31:34.532750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.17256","last_updated":"2026-06-15T20:00:20Z","snapshot_observed_at":"2026-08-01T18:51:15.199353Z","submitted_at":"2026-06-15T20:00:20Z","title":"Contrastive Action-Image Pre-training for Visuomotor Control","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T03:16:33.702802Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.17256"},"observation_digest":"sha256:443c44e8f0b78f0f4bb4ee7077c7065971b5dec5c3664654ecc6efe0abed7b8d","observation_id":"313f98a4-7fe9-46e9-9c18-f6f97753a115","resolution":{"observed_at":"2026-07-03T18:08:46.890780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.19100","last_updated":"2026-07-01T09:15:37Z","snapshot_observed_at":"2026-08-02T22:09:19.055769Z","submitted_at":"2026-06-17T14:11:41Z","title":"AMALIA-VL: A Native European Portuguese Open-Source Vision and Language Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T21:22:53.792778Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.19100"},"observation_digest":"sha256:ebccfb7d68f99974ae832c3c0da9a17746421195ef613580f2104e581047817f","observation_id":"f7e7ce41-e1b1-4cd2-9f29-0f8129e4e3ae","resolution":{"observed_at":"2026-07-04T00:19:12.973201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.19100","last_updated":"2026-07-01T09:15:37Z","snapshot_observed_at":"2026-08-02T22:09:19.055769Z","submitted_at":"2026-06-17T14:11:41Z","title":"AMALIA-VL: A Native European Portuguese Open-Source Vision and Language Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-01T07:34:37.974692Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.19100"},"observation_digest":"sha256:db54dce2fa2c3837ca54f5329ca6d7f166ea06659d21f6ff93ae40270886fac8","observation_id":"f50f10c1-97d0-44ab-b35b-e4b0aceedd0e","resolution":{"observed_at":"2026-07-01T07:35:28.776187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.19100","last_updated":"2026-07-01T09:15:37Z","snapshot_observed_at":"2026-08-02T22:09:19.055769Z","submitted_at":"2026-06-17T14:11:41Z","title":"AMALIA-VL: A Native European Portuguese Open-Source Vision and Language Model","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-02T22:15:14.561596Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.19100"},"observation_digest":"sha256:6ca07f84c9d6720d0c165c3f0abfdfd06a6c59c144d9e026ea0c5b5bbcea676c","observation_id":"07013e9d-7be1-4c34-be0f-fb8793c908e6","resolution":{"observed_at":"2026-07-02T22:17:24.983536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2501.14818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-04T00:19:12.971623Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models","venue":null,"work_id":"5cbec930-7d2e-4f47-b9c7-5d240d89a2cc","year":2025},"citing_paper":{"arxiv_id":"2606.29812","last_updated":"2026-06-29T05:45:18Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:45:18Z","title":"Consistency as Inductive Bias: Learning Cross-View Invariance for Robust Multimodal Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T06:10:41.786328Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2606.29812"},"observation_digest":"sha256:f10a02e38028168e49a1aef8bd6d416f5e56d97ad79a5582e0f36597d5f5ddc4","observation_id":"6216653f-a7f8-4ae9-841c-fe29cc09c9ee","resolution":{"observed_at":"2026-06-30T06:14:19.226773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-13T02:39:58.984385Z","title":"arXiv:2501.14818 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09488","last_updated":"2026-07-10T15:05:21Z","snapshot_observed_at":"2026-08-06T01:56:09.982388Z","submitted_at":"2026-07-10T15:05:21Z","title":"SigLIP-HD by Fine-to-Coarse Supervision","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-13T02:39:58.984385Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2607.09488"},"observation_digest":"sha256:38e6706fb712060e424312055d2028ad3d190317f52e5f3bcdebb8db92437372","observation_id":"ec7f7cdf-df4a-49c9-801e-0dfa5d771377","resolution":{"observed_at":"2026-07-13T02:39:58.984385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-01T14:39:52.460914Z","title":"arXiv preprint arXiv:2501.14818 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18709","last_updated":"2026-07-22T05:33:17Z","snapshot_observed_at":"2026-08-08T18:57:26.098275Z","submitted_at":"2026-07-21T05:05:01Z","title":"RoboInter1.5: A Holistic Intermediate Representation Suite for Embodied World Modeling and Robotic Manipulation","version":2},"reference_index":248,"source":"arxiv_source","source_observed_at":"2026-08-01T14:39:52.460914Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2607.18709"},"observation_digest":"sha256:f5661f5748a95b6cd075722c8e5948e9493f756d5e21af05b786b7adee81eddf","observation_id":"8932aa1e-f882-4ecb-a368-4cadb38513a2","resolution":{"observed_at":"2026-08-01T14:39:52.460914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-31T23:29:10.232317Z","title":"arXiv preprint arXiv:2501.14818 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23969","last_updated":"2026-07-30T13:06:27Z","snapshot_observed_at":"2026-08-03T18:36:45.105550Z","submitted_at":"2026-07-27T03:36:45Z","title":"LeapBot-WA: World-Anchor Action Models via Predictive Latent Alignments","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-31T23:29:10.232317Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2607.23969"},"observation_digest":"sha256:b8aa52f3e75f5d6c68a9c6896d5de9570f0c446800ef9276d933aaa919699e09","observation_id":"f2480c1d-4f46-46f1-8207-fa855b5c8fbd","resolution":{"observed_at":"2026-07-31T23:29:10.232317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-07-31T08:51:24.633040Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28394","last_updated":"2026-08-01T08:11:08Z","snapshot_observed_at":"2026-08-06T23:11:29.841318Z","submitted_at":"2026-07-30T15:48:16Z","title":"Hand-Object Interaction in the Age of Large Foundation Models:Reconstruction, Generation, and Embodied Transfer","version":1},"reference_index":182,"source":"pdf_text","source_observed_at":"2026-07-31T08:51:24.633040Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2607.28394"},"observation_digest":"sha256:d8b1a0fae63bfdc60ee45cc7c03be3cf917cc53920480c9f72b0c3446f30c17d","observation_id":"7603044c-0348-4171-bf87-e0a8335079a6","resolution":{"observed_at":"2026-07-31T08:51:24.633040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14818","snapshot_observed_at":"2026-08-04T01:23:07.841255Z","title":"Eagle 2: Building post-training data strategies from scratch for frontier vision-language models.arXiv preprint arXiv:2501.14818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28394","last_updated":"2026-08-01T08:11:08Z","snapshot_observed_at":"2026-08-06T23:11:29.841318Z","submitted_at":"2026-07-30T15:48:16Z","title":"Hand-Object Interaction in the Age of Large Foundation Models:Reconstruction, Generation, and Embodied Transfer","version":2},"reference_index":168,"source":"pdf_text","source_observed_at":"2026-08-04T01:23:07.841255Z"},"links":{"cited_paper":"/paper/2501.14818","citing_paper":"/paper/2607.28394"},"observation_digest":"sha256:b3ba1549f5294937e3fd49afc559b66c6285cd37168be95a2acec2357012358c","observation_id":"e127f1b8-c197-423c-b864-fa7806f336bb","resolution":{"observed_at":"2026-08-04T01:23:07.841255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14818/citation-record","integrity":"/paper/2501.14818/integrity","json":"/paper/2501.14818/citation-record.json","paper":"/paper/2501.14818"},"outbound":[],"paper":{"arxiv_id":"2501.14818","last_updated":"2025-01-20T18:40:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T02:17:30.272046Z","submitted_at":"2025-01-20T18:40:47Z","title":"Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 44 inbound Pith citation observations for arXiv:2501.14818."}