{"as_of":"2026-08-10T06:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3e7bc96697497512f9dbc437f4f69c4ce484ce835e43f5b05cbdc45c58f54c4","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:51:44.389472Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17423/citation-record","integrity":"/paper/2505.17423/integrity","json":"/paper/2505.17423/citation-record.json","paper":"/paper/2505.17423"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:51.928539Z","title":"Guidelines for Human-AI Interaction","venue":null,"work_id":"dc5995b1-3577-47ba-a857-ff442fa90842","year":2019},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.511041Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:e5d56e75306292621992c68cfe6821b5e3257070bc411b8225c0f852c2ba81f1","observation_id":"49220b88-9493-4178-bf8b-d0f7a271e0ac","resolution":{"observed_at":"2026-08-07T14:51:52.030966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:51.663754Z","title":"Interactive machine learning for health informatics: when do we need the human-in-the-loop?","venue":null,"work_id":"5b38457e-19da-40e8-a906-d2a3c72ca0da","year":2016},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.600983Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:5fa76c936ebafb3e329c4b860d0a1f83d0890db75c7bfdcfd7c19568a290ddeb","observation_id":"a9172750-c9af-4489-bae2-c78f5ea2f04a","resolution":{"observed_at":"2026-08-07T14:51:51.792252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:51.473362Z","title":"Accelerating Human-in-the-loop Machine Learning: Challenges and Opportunities","venue":null,"work_id":"fc18e852-372e-429f-a2fc-c9b7923ba174","year":2018},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.716868Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:7a3149c41c4802b5cc92edcea01f71a72efba98f597ee877fb5109e5b0c0fd0d","observation_id":"9fbd5389-dd34-42b1-bb09-026050f5adc2","resolution":{"observed_at":"2026-08-07T14:51:51.554860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:51.357315Z","title":"Is human oversight to AI systems still possible?","venue":null,"work_id":"e039feed-3e22-498b-b250-8fa49757e1b0","year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.830627Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:4d80102294a57846190690e55db38a633cfbb100bdb41adb058b5b8f9fa2acaa","observation_id":"90cebc33-f8af-4f92-8e31-b9f5e9c2ac14","resolution":{"observed_at":"2026-08-07T14:51:51.386036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:51.228199Z","title":"Msr-vtt: A large video description dataset for bridging video and language","venue":null,"work_id":"70e14312-d03f-43ec-8091-1bd42b17e71c","year":2016},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.920292Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:2e3974fc42d2755cc0afbacbe1a388cc3ae6e503071ca83616649b064e15acca","observation_id":"e81406be-37a8-4b30-8a71-fb371207192e","resolution":{"observed_at":"2026-08-07T14:51:51.304695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:51.004980Z","title":"VaTeX: A Large-Scale, High-Quality Multilingual Dataset for Video-and-Language Research","venue":null,"work_id":"84d3820c-75ba-40be-aac4-6577dd46c319","year":2019},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:39.999548Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:cdb6d15a2ce4ce50b7b109d7ce555cc41083270911e5c832573811faa7cfd2a1","observation_id":"ae3e5244-84f4-48f0-a8f6-680217e8fdf5","resolution":{"observed_at":"2026-08-07T14:51:51.141413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:50.722276Z","title":"AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark","venue":null,"work_id":"d9fb6d2b-ec86-4b8a-a106-829e2de73f7f","year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:40.085169Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:066176bc442573d0663444a46d3e66a7363b57caa140cf09063e65734515ec83","observation_id":"719113d0-51aa-4297-b4f2-267cfe8784b7","resolution":{"observed_at":"2026-08-07T14:51:50.882596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:50.508680Z","title":"Spoken moments: Learning joint audio-visual representations from video descriptions","venue":null,"work_id":"1376a9c3-7daf-4a42-bca5-17a38cf64b52","year":2021},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:40.232182Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:7ad7dd2b6dfd2ac3e3a2b75ffc74ec3b3995a4a89a663d84db47bd5951efa1f1","observation_id":"5bd27a9e-2d9f-4c79-878b-ad8cead6cead","resolution":{"observed_at":"2026-08-07T14:51:50.606412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-07T10:46:08.274157Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-07T14:51:40.343560Z","title":"Tishby, F","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:40.343560Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:f593f73d9b1beb2b39bbf7b6b47fab12fec4cf70714292b4d0b5afd46e6dd28c","observation_id":"8d251635-e99c-4bc4-a15e-e31ffdcd0149","resolution":{"observed_at":"2026-08-07T14:51:40.343560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:50.308935Z","title":"Longvideobench: A benchmark for long-context interleaved video-language understanding","venue":null,"work_id":"4f74aac4-77a4-4e96-8de6-5d1b6c5dc620","year":2024},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:40.467881Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:dccdd2d76456a3a2d50248a206fb88e8279a5495eb885622c023b5f5edee3ef1","observation_id":"ec8a3853-1f31-4d01-aca9-1d8173b75dbf","resolution":{"observed_at":"2026-08-07T14:51:50.397693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:50.131703Z","title":"Sutd-trafficqa: A question answering benchmark and an efficient network for video reasoning over traffic events","venue":null,"work_id":"4b125814-9d4e-40d9-90e0-ae2d86f286b0","year":2021},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:40.590922Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:cde4dd0f56f99392ae3f8e36fe471a37a9cc6a9ceb1fce8bf1f69f60d63cd3aa","observation_id":"bbdcb7b3-e7c3-475c-a4b4-1961cdc9063c","resolution":{"observed_at":"2026-08-07T14:51:50.238310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:49.965139Z","title":null,"venue":null,"work_id":"0569beba-f5a6-406e-8f76-069e8068b537","year":1983},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:40.677382Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:4e9827311ec6fe920622702460d9950ed038637725942ce000f3b23290e033a8","observation_id":"44416897-5462-4e49-8832-5d7784d9b0fa","resolution":{"observed_at":"2026-08-07T14:51:50.057142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:49.816047Z","title":"Video Question Answering via Gradually Refined Attention over Appearance and Motion","venue":null,"work_id":"6d56ba7e-d383-4b3a-bdf8-cd0aeff5ae38","year":2017},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:40.851746Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:e78e9e09e22e99841aebea6dbcb4d3c27aba4d80dee941aa38b998a1d5045788","observation_id":"9c6ec737-306a-4ba6-935b-25cd33f882c2","resolution":{"observed_at":"2026-08-07T14:51:49.881862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:49.631249Z","title":"Zhong, J","venue":null,"work_id":"1c1ef656-cc85-4410-8ce0-37bd472ab1de","year":null},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:40.994197Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:d615df6869325a239ef7b80873b9d172e54d45560e153f027cb72fe009165d68","observation_id":"688cffe1-9477-4b68-8ce2-f2750817840c","resolution":{"observed_at":"2026-08-07T14:51:49.687275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10513","last_updated":"2024-11-25T17:04:20Z","snapshot_observed_at":"2026-08-10T04:07:10.688835Z","submitted_at":"2024-11-15T17:44:27Z","title":"Any2Any: Incomplete Multimodal Retrieval with Conformal Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10513","snapshot_observed_at":"2026-08-07T14:51:41.239819Z","title":"Any2Any: Incomplete Multimodal Retrieval with Confor- mal Prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.239819Z"},"links":{"cited_paper":"/paper/2411.10513","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:0f67f76f4ee76e09f61f586f3a21b8a501d7fbd4f5e7c025bdcd2ac3371253b9","observation_id":"fd53eb52-d8d4-49b4-a34a-98a4b99111d7","resolution":{"observed_at":"2026-08-07T14:51:41.239819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:49.455380Z","title":"Exploiting Distribution Constraints for Scalable and Efficient Image Retrieval","venue":null,"work_id":"0f7d62f9-062a-470a-92c0-8ae889c61099","year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.352489Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:09efad63158576cffd584aa1bfe3148cc2c6973085c2920772c23a534f04b30f","observation_id":"f43473e9-3224-440a-95ab-f8ed8b93e761","resolution":{"observed_at":"2026-08-07T14:51:49.544848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:49.260618Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":"82899959-6cd8-4e48-912c-a80484b1a055","year":2004},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.515962Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:4583fb0132d8299d07a75e1d334c70b4294cfa072b3077c0aaf96374eda37e90","observation_id":"4fbc5f13-c389-422f-be2b-21b2b91b6de4","resolution":{"observed_at":"2026-08-07T14:51:49.340276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:49.094457Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"ed1242f4-57f4-488a-9a5c-7c77d9e4461e","year":2002},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.631047Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:a5ebebca297152911bfc93c6897bb2609565a0d2eb076ffce92628185b0057c1","observation_id":"635206b1-81ba-4f35-9c00-0d8f011aea03","resolution":{"observed_at":"2026-08-07T14:51:49.163779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:48.935700Z","title":"Cider: Consensus-based image descrip- tion evaluation","venue":null,"work_id":"12e85a2e-5242-4728-979d-29009c6465e9","year":2015},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.740626Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:b47d0a0df82bcd09872bbb41e9497cb22195ef4dd83f6356371bdaf8014ffd31","observation_id":"a07e2bdc-1dae-4354-b442-8739e3c721b7","resolution":{"observed_at":"2026-08-07T14:51:49.009383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:48.818105Z","title":"Information-Theoretic Distillation for Reference-less Summa- rization","venue":null,"work_id":"040568ca-ff16-4e78-9af0-ff110e6e4b3d","year":2024},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.826266Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:a79e5cea2b2868f7c506e3589fa6f8e9a5852d41a02af03998cd8a2cd7fda662","observation_id":"6c0edb5d-f4dc-4c8b-9032-4984865cfcd4","resolution":{"observed_at":"2026-08-07T14:51:48.865981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:48.707690Z","title":"Human-agent cooperation in games under incomplete information through natural language communication","venue":null,"work_id":"b075a02f-2a68-4ad5-8db4-74d1be6daa73","year":2024},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.939869Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:764fdac8af5224356368a08bd595470a328fe5631529d6f02bf541165981bba7","observation_id":"4c48bba6-a395-4c41-b72b-e73fc1c4f414","resolution":{"observed_at":"2026-08-07T14:51:48.755572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:48.554690Z","title":"Comparing automatic and human evaluation of NLG systems","venue":null,"work_id":"9f10416d-9acf-41b8-b94a-a95d9299227d","year":2006},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.043294Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:32e40adef40cff3e8d6af17c2dbe4b41530012fd921def056cc62fce2a83326b","observation_id":"bc2e319b-7f77-4d25-8ccc-def1e4b99808","resolution":{"observed_at":"2026-08-07T14:51:48.624370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:48.431608Z","title":"Can machine translation systems be evaluated by the crowd alone","venue":null,"work_id":"f12a9d3a-da19-48d5-9708-62e8ffe2e874","year":2017},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.137460Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:f74362d765f079174d4a6821fa4e210e3119016a2e6594ec589645a5f5231ed9","observation_id":"c0231c56-a143-45c3-8ddc-379b9aa2c2b4","resolution":{"observed_at":"2026-08-07T14:51:48.481949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:48.281494Z","title":"Automatic summarization","venue":null,"work_id":"600c7c9b-0dc1-4048-a67c-5c7de92600e1","year":2011},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.217373Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:45fbdb5883f4879a718618754eab525ed763e263352d276641b83bb317806a2b","observation_id":"21a8f900-77f8-4510-b260-485b58be59be","resolution":{"observed_at":"2026-08-07T14:51:48.347022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15044","last_updated":"2023-05-24T11:34:39Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T11:34:39Z","title":"Is Summary Useful or Not? An Extrinsic Human Evaluation of Text Summaries on Downstream Tasks","version":1},"cited_work":{"arxiv_id":"2305.15044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.15044","snapshot_observed_at":"2026-08-07T14:51:44.879118Z","title":"Is Summary Useful or Not? An Extrinsic Human Evaluation of Text Summaries on Downstream Tasks","venue":"cs.CL","work_id":"63b76c11-66b4-4f94-bd32-dbee1722aa8c","year":2023},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.332451Z"},"links":{"cited_paper":"/paper/2305.15044","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:a4c417ccc5bbf1a86985ab8e4db211f6c2ff30d912e5c7f3430ea9bf9bfd8693","observation_id":"a06ab028-05fa-4991-bfef-bce0ac788a22","resolution":{"observed_at":"2026-08-07T14:51:44.915230Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:48.130109Z","title":"The speed-accuracy tradeoff: history, physiology, methodology, and behavior","venue":null,"work_id":"46ad5804-a3cc-4289-b090-dd8b80450b72","year":2014},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.450453Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:db7da2dacaf1376db171bd178ffa1374fed3677c06aa4375e102f524f2be22b4","observation_id":"8a2d31ab-69cb-4d45-bbb7-c9731bcdd86b","resolution":{"observed_at":"2026-08-07T14:51:48.198032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:47.954279Z","title":"A cortical information bottleneck during decision- making","venue":null,"work_id":"8613dd9d-0492-4925-aac7-fc23e8f67f47","year":2023},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.560533Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:9bfb52b91942394a0b9ae9b841b9c210e6943cca70f598790f9e3a9d703fe1b3","observation_id":"e658a2f7-22dd-48dc-a1ea-55652148f237","resolution":{"observed_at":"2026-08-07T14:51:48.035567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.07405","last_updated":"2019-09-20T16:39:51Z","snapshot_observed_at":"2026-07-06T08:22:13.221343Z","submitted_at":"2019-09-16T18:00:24Z","title":"BottleSum: Unsupervised and Self-supervised Sentence Summarization using the Information Bottleneck Principle","version":2},"cited_work":{"arxiv_id":"1909.07405","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.07405","snapshot_observed_at":"2026-08-07T14:51:44.713918Z","title":"BottleSum: Unsupervised and Self-supervised Sentence Summarization using the Information Bottleneck Principle","venue":"cs.CL","work_id":"c2d1b5fe-cae3-4b10-ad6d-da984ed21d75","year":2019},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.676433Z"},"links":{"cited_paper":"/paper/1909.07405","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:799963aeab1ae7d4216153ae238d66ab98f432aec0ac9d50eb979c93cfc806cc","observation_id":"02eb5440-324f-439e-a76f-29796b020e4b","resolution":{"observed_at":"2026-08-07T14:51:44.767295Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05511","last_updated":"2022-06-11T12:12:20Z","snapshot_observed_at":"2026-08-07T13:01:53.600360Z","submitted_at":"2022-06-11T12:12:20Z","title":"Improving the Adversarial Robustness of NLP Models by Information Bottleneck","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05511","snapshot_observed_at":"2026-08-07T14:51:42.792706Z","title":"Improving the adversarial robustness of NLP models by information bottleneck","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.792706Z"},"links":{"cited_paper":"/paper/2206.05511","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:d7aeafebeb3e1330e862610d394bd10e92b2fb68e79433e7e59a93ba5e1e2b7d","observation_id":"a572c567-f59f-4d07-ada3-de646ceaa9f6","resolution":{"observed_at":"2026-08-07T14:51:42.792706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:47.820937Z","title":"Applying the information bottleneck principle to unsu- pervised clustering of discrete and continuous image representations","venue":null,"work_id":"91212d8d-7e3a-4964-9055-13f7ebf2846f","year":2003},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.899810Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:39400ab496836d8bef55da2030db50bd162d00095b6db8760fc8581e68828727","observation_id":"5f596466-14aa-4343-b049-6c9c5572b1f6","resolution":{"observed_at":"2026-08-07T14:51:47.873003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:47.681704Z","title":"Deep learning and the information bottleneck principle","venue":null,"work_id":"1e2aa128-3837-47ef-9d0c-2772eb2358db","year":2015},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:42.980157Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:8f6ee91a6ead869ae8b138e09bd5f80f768b3c99da0dd5c2a486120189275182","observation_id":"a2f0dbb8-e2d4-4ec2-9d08-c9bb25fc20a9","resolution":{"observed_at":"2026-08-07T14:51:47.742369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:47.485027Z","title":"How does information bottleneck help deep learning?","venue":null,"work_id":"5c0c0930-8ebe-46c9-9501-ec43533b8405","year":2023},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.074134Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:452c28f4ae91516c792c9ec05256439bdfae085077b228ce58af434c0de02ebb","observation_id":"d085b73a-65a4-47e9-b1c9-67849d236ac4","resolution":{"observed_at":"2026-08-07T14:51:47.601357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:47.240894Z","title":"The information bottleneck problem and its applications in machine learning","venue":null,"work_id":"b242677a-a8b6-497c-ab39-f8184b85ee4f","year":2020},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.144699Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:0372f4dcfe0595f5bf5177ddc5e207ad69a7e53cfdba43e43ff1f726219749f4","observation_id":"2722d7c5-b8b4-41dd-bca7-9d1a3c4afdea","resolution":{"observed_at":"2026-08-07T14:51:47.348736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:47.055188Z","title":"Multimodal Information Bottleneck: Learning Minimal Sufficient Unimodal and Multimodal Representations","venue":null,"work_id":"1610c9fe-bc6a-4d67-809c-b9f9017d40da","year":2023},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.260012Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:29ac1cd4d15fdf8e9128752b944fc2c2cfe4f1563e7b5e96768d5b1b8f359622","observation_id":"8377f2c6-eb7a-47b5-a033-9870c034560a","resolution":{"observed_at":"2026-08-07T14:51:47.145279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:46.881894Z","title":"Representation Learning In Deep RL Via Discrete Information Bottleneck","venue":null,"work_id":"4c1d2738-c116-40d3-8e8b-c95d96747e92","year":2023},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.364681Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:c13c60952278f5d4428af43cced9f321ab8b39cea203f87de43a73f16091ede4","observation_id":"701f31b1-cca4-423c-a7bb-95142e37a07b","resolution":{"observed_at":"2026-08-07T14:51:46.971772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:46.732044Z","title":"Normalized (pointwise) mutual information in collocation extraction","venue":null,"work_id":"bfab0bdd-6bcc-4c52-b424-903faa2a0892","year":2009},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.424240Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:111d7a19f280134bab6616f9c209a63bab1907799a4ca645b100253185adf798","observation_id":"d3017a8f-982c-4ad0-86cd-c280f85bdb02","resolution":{"observed_at":"2026-08-07T14:51:46.807982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:46.543914Z","title":"Term-weighting approaches in automatic text retrieval","venue":null,"work_id":"c6a7af03-52ba-4092-9c51-f32abba7c88f","year":1988},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.478606Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:81fa0baa2dd730c66bc81edb11bc56ff676fdd19fa7d3917409df2e49a66fc08","observation_id":"0a5fb7f4-6494-4f28-837a-5dbd215f3588","resolution":{"observed_at":"2026-08-07T14:51:46.634865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:46.400748Z","title":null,"venue":null,"work_id":"95459089-8b8c-40a0-adbd-83a6da9f7f85","year":2004},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.569750Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:5c6263ccbbef35ab6ede38e5ef29d308817458342154fd5ae9764f6cc8eef779","observation_id":"fda0405d-34fc-41e7-9d8d-e241b3898cd6","resolution":{"observed_at":"2026-08-07T14:51:46.451367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:46.256524Z","title":"https : / / github","venue":null,"work_id":"0afbf394-887c-4726-b6fa-0be5effb4ed1","year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.658755Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:8a0a7ac6c446755364f4ad2a8ac06466b032b3da6e64dd75bc6f0518344f02fc","observation_id":"99be6e40-865f-43e3-ac3b-8247af8f3bc0","resolution":{"observed_at":"2026-08-07T14:51:46.311668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:51:43.722400Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.722400Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:85a02ce8401a8bb4a12abb5a90c8735df8509944b8057906295ab4cf9e9ffa7e","observation_id":"f77a0f09-33ac-46a7-8c72-3ae712cc69b4","resolution":{"observed_at":"2026-08-07T14:51:43.722400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:46.113818Z","title":"https://github","venue":null,"work_id":"42586e27-b044-4766-956e-627e7ad284ac","year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.806364Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:e881bb71496291da452e511cb0f3218da9c23269df09cb8895ce4cdd62a62a2a","observation_id":"8891bb47-ca2b-4fbb-8724-1cb6697ffb79","resolution":{"observed_at":"2026-08-07T14:51:46.166650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:45.916589Z","title":"Prolific. ac—A subject pool for online experiments","venue":null,"work_id":"20025965-a3b4-40c1-b73d-25e0fb0ae6a1","year":2018},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.882000Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:04c214b04f1c27dfbb61447f879a025fe51db2b65cc872792a636431d999fb94","observation_id":"b4a3af8c-9014-46e7-ad9d-b443c6608905","resolution":{"observed_at":"2026-08-07T14:51:46.028072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:45.667089Z","title":"The proof and measurement of association between two things","venue":null,"work_id":"5ae48667-95c1-45b5-9cae-97f1e6e9c64a","year":1961},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:43.952145Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:5215d29fbe42a6c015b2c42baf402ed04686cee2ece00fe4cf4959e0351025dd","observation_id":"27160cff-ad73-448b-a068-c9b1d1b73cd1","resolution":{"observed_at":"2026-08-07T14:51:45.787163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:45.356041Z","title":"RouteLLM: Learning to Route LLMs from Preference Data","venue":null,"work_id":"a99458e6-2d91-4f64-8594-52d36d4c3633","year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:44.049142Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:177faf639427ebb22000a4f4ced46518f3f4676462d4aa3f9f6039c6141d0698","observation_id":"b64ab7bc-8688-4793-82c0-d3f2ceca322b","resolution":{"observed_at":"2026-08-07T14:51:45.480937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:51:45.149766Z","title":"Mixture-of-experts with expert choice routing","venue":null,"work_id":"e9367968-df3f-4658-88cb-558c024d186e","year":2022},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:44.109370Z"},"links":{"citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:b9f798ae64c64f0f47f358ee6755e8dd0191ab04dc1ff711997001143ad488d8","observation_id":"52266535-f053-42f1-90b2-cc140e37dad4","resolution":{"observed_at":"2026-08-07T14:51:45.226000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08570","last_updated":"2024-02-13T16:14:32Z","snapshot_observed_at":"2026-08-09T13:06:45.985830Z","submitted_at":"2024-02-13T16:14:32Z","title":"Online Foundation Model Selection in Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08570","snapshot_observed_at":"2026-08-07T14:51:44.173717Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:44.173717Z"},"links":{"cited_paper":"/paper/2402.08570","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:c4a6bf41ab0b1a84ba9e2a2abad179d16f8c6c2d8d130bcf2d8267aa1872c86a","observation_id":"984a2508-16a6-48a2-8c3b-a86fa09c1829","resolution":{"observed_at":"2026-08-07T14:51:44.173717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T14:51:44.270249Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:44.270249Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:900136fac5d66dcea739978a4c4390740292df0c9a084f732bf3c213ad3f3401","observation_id":"822023ef-72e4-4818-a6fb-0a8c6d76f737","resolution":{"observed_at":"2026-08-07T14:51:44.270249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-07T14:51:44.389472Z","title":"self-supervised learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:44.389472Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:908209a953f62480d4d2e577ae0e34c3a5cb943a77589c53fe54eb20db5b4e81","observation_id":"316e5b31-197b-41f0-a4a1-8706a1e0a564","resolution":{"observed_at":"2026-08-07T14:51:44.389472Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01225","last_updated":"2022-11-02T05:25:06Z","snapshot_observed_at":"2026-07-30T11:11:52.165985Z","submitted_at":"2022-03-02T16:34:09Z","title":"Video Question Answering: Datasets, Algorithms and Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.01225","snapshot_observed_at":"2026-08-07T14:51:41.113713Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.113713Z"},"links":{"cited_paper":"/paper/2203.01225","citing_paper":"/paper/2505.17423"},"observation_digest":"sha256:43b64cd3165a22535b851e62e75d0293f361fd176a24919646b310d46e3333d6","observation_id":"3f4b82f5-3fb3-4486-8689-5137f6397767","resolution":{"observed_at":"2026-08-07T14:51:41.113713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17423","last_updated":"2026-07-13T15:08:47Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T04:07:34.034332Z","submitted_at":"2025-05-23T03:11:29Z","title":"VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":37},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2505.17423."}