Pith. sign in

Paper Citation Record · LEDGER

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning

As of 9 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 1 inbound Pith citation observation for arXiv:2506.14907.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.14907 v1

Coverage vector

measured 54 of 54 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T00:13:39.624185Z

measured 55 of 55 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-05-12T02:24:12.349405Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-12T07:41:27.623339Z

Reference resolution

54 of 54 outbound references displayed

  • verified exact1
  • verified fuzzy5
  • unresolved48
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 7092c52b-5bca-473c-9826-8149a8b766be · outbound

This paper cites an unresolved cited work.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:13:41.901593Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T00:13:31.914954Z digest=sha256:6c88950934ea964e5068b51f2411b601098cae90426f42c7b2615c18446a0511

Observation a6445511-1020-4d41-bf05-90d35ac66653 · outbound

This paper cites Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:32.009011Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:32.009011Z digest=sha256:df31384dcd1427a1bc187fb2d5da5a1d212fe2323d960b4f133cc34da027eec1

Observation 9a406960-5b41-49e5-ab7d-faf1c48482fa · outbound

This paper cites Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736, 2022.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736, 2022

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:32.220329Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:32.220329Z digest=sha256:ae95d9a7ebd72c571146d15ee66f53b715173b80f23c2364156981a6407ef90d

Observation 99ab7755-a867-4a3f-a010-852e7f934c84 · outbound

This paper cites OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:32.352115Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:32.352115Z digest=sha256:a983c37e9d7bc13422de52ac26f4c9d3e5dc999915fafd2e26d9ec9306ac8a7b

Observation edb2f5a2-d2e2-418c-9825-522082cb27e5 · outbound

This paper cites Qwen2.5-VL Technical Report.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Qwen2.5-VL Technical Report

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:32.538218Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:32.538218Z digest=sha256:17844a6eca6fbed61bff2452356c07bd1073c74ef4c2c26580ba33719a8d92d8

Observation 28e8f5b2-f541-40ab-bddc-7ac53985a7e9 · outbound

This paper cites R1-v: Reinforcing super generaliza- tion ability in vision-language models with less than $3.https://github.com/Deep-Agent/ R1-V, 2025.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning R1-v: Reinforcing super generaliza- tion ability in vision-language models with less than $3.https://github.com/Deep-Agent/ R1-V, 2025

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:32.756391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:32.756391Z digest=sha256:0d090dd2aabed2cd90553c8b44833053b9eba156a119a1fb44705c556bff9bab

Observation 184742c6-bfff-4dff-b576-0814a270fcff · outbound

This paper cites Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:32.948421Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:32.948421Z digest=sha256:2053af3e3ae7947d1a5a9484ff10351f7504183399ee3e1350c2ea365389ae9f

Observation 9654d880-b9d4-40cc-9421-ba067ee95d51 · outbound

This paper cites How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites.Science China Information Sciences, 67(12):220101, 2024.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites.Science China Information Sciences, 67(12):220101, 2024

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:33.133533Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:33.133533Z digest=sha256:9709b33cac6d2482143fd4be9ba6d32a624e23a88e1ab5533465af8eb9c8ffc5

Observation 81d95e07-7c81-4516-aee5-534b3670bf48 · outbound

This paper cites Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:33.262709Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:33.262709Z digest=sha256:7c2cb4f0535960fccb066f858fdf0327213998c604c09e3c8b7ce27041d0af91

Observation 2e8e6fc8-a836-430b-a708-30f8d4e9fa8c · outbound

This paper cites OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:33.384064Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:33.384064Z digest=sha256:99dc0403661464e88e05b701cef5e241412f93c2ade8f507f8e6746ea949352b

Observation f041fc3e-2fd4-49b4-ac1e-f3b8011fc45b · outbound

This paper cites Vlmevalkit: An open-source toolkit for evaluating large multi-modality models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Vlmevalkit: An open-source toolkit for evaluating large multi-modality models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:33.524376Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:33.524376Z digest=sha256:05353942ae0894461b80c8f7840a9d3229e33f69886b3d16050489599fa7c3fd

Observation 1433762e-0e14-48f1-9b58-26362d305067 · outbound

This paper cites Blink: Multimodal large language models can see but not perceive.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Blink: Multimodal large language models can see but not perceive

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:33.648674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:33.648674Z digest=sha256:84799f2604508542f2151a1d80edeb987a0c95d75a2c2cca3b00e09e7a831ed4

Observation de473be6-df96-4f94-8e09-42e1161ac5ac · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:33.821384Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:33.821384Z digest=sha256:437f3ea9a182f6ebab188e7af6f776a0c110eaf5974a09437958854f158e8665

Observation 7ba9abc4-c2b4-418a-97f2-d52f1800de0d · outbound

This paper cites Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:33.957683Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:33.957683Z digest=sha256:95a491392b2ac913b807e52cb07002994204390020af75de7c0ba9361a8f3e2e

Observation 478156f5-7241-4773-a1a2-e247ff7c9487 · outbound

This paper cites MANTIS: Interleaved Multi-Image Instruction Tuning.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning MANTIS: Interleaved Multi-Image Instruction Tuning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:34.087876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:34.087876Z digest=sha256:3320081bde3917d46d33fb69ea6748f91afbeb7b34063ca4cc582772fd13609a

Observation ec0b58ea-ebb6-455b-8d00-5f57b13f99a5 · outbound

This paper cites Remi: A dataset for reasoning with multiple images.Advances in Neural Information Processing Systems, 37:60088– 60109, 2024.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Remi: A dataset for reasoning with multiple images.Advances in Neural Information Processing Systems, 37:60088– 60109, 2024

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:13:41.668514Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T00:13:34.221237Z digest=sha256:d6fb9e6ab9bfa9fc991bed4b308f5dd9add62b7c472a99f5e72a4a9125aa1e16

Observation 1e62c27f-6b19-485b-bdc4-9715a2074995 · outbound

This paper cites MIMIC-IT: Multi-Modal In-Context Instruction Tuning.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning MIMIC-IT: Multi-Modal In-Context Instruction Tuning

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:34.402388Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:34.402388Z digest=sha256:b0f5ed833f614fcc919eae9646edc360b8875500aa721560310cc1f30df3d68b

Observation e53a2749-ad2a-4335-a6f2-d026a31666f3 · outbound

This paper cites LLaVA-OneVision: Easy Visual Task Transfer.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning LLaVA-OneVision: Easy Visual Task Transfer

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:34.565255Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:34.565255Z digest=sha256:39ce850630fc7c98da3ab4a50aa494d5462a0bfd25ebc3faee8573eebe1d85fc

Observation aa1eb206-ca7b-4363-b8fd-77b9c0e6ef69 · outbound

This paper cites LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:34.729605Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:34.729605Z digest=sha256:0cd30a6bad2b65101e8c502cb68646f46cb57b159577e8815d2f1d72d1ea7733

Observation 2274912a-62dd-498c-9c8a-40ea3cd393f8 · outbound

This paper cites Migician: Revealing the Magic of Free-Form Multi-Image Grounding in Multimodal Large Language Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Migician: Revealing the Magic of Free-Form Multi-Image Grounding in Multimodal Large Language Models

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:34.937970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:34.937970Z digest=sha256:b027581af43d0c246b9630ebb2ef7c6686165f425bbc7f4c061df1802cbd22c7

Observation 8e90f3af-d9cf-4891-82ab-e32038325b4b · outbound

This paper cites From System 1 to System 2: A Survey of Reasoning Large Language Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning From System 1 to System 2: A Survey of Reasoning Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:35.115254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:35.115254Z digest=sha256:fc6a23869fd6323ddfa6954a6f6579e6901c85228d59c30696c4728315e11c3a

Observation 6a1a9c86-15d6-4581-8f42-f0c60376f761 · outbound

This paper cites Improved baselines with visual instruction tuning.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Improved baselines with visual instruction tuning

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:35.298768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:35.298768Z digest=sha256:8b84886d8792791663be2f1fc9bc610c364bf4b9d75f601d3fdf95453e6c324d

Observation c824f2f8-60bc-48b9-b6c8-08237dc06a80 · outbound

This paper cites Noisyrollout: Reinforcing visual reasoning with data augmentation.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Noisyrollout: Reinforcing visual reasoning with data augmentation

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:35.442727Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:35.442727Z digest=sha256:1c670504cef810f6cf8958e96f0e70d65d6894572ae53da1403073f44461b17a

Observation d4ca0f18-ef2c-4ad0-934b-34a7904cc1df · outbound

This paper cites Visual-RFT: Visual Reinforcement Fine-Tuning.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Visual-RFT: Visual Reinforcement Fine-Tuning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:35.595022Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:35.595022Z digest=sha256:e2661959233a9d485a54fe1bc14866e261c7739a2de68b374e531715b7754942

Observation 2ff7774c-4b31-439e-9014-b250ba33e0d9 · outbound

This paper cites MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:35.700936Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:35.700936Z digest=sha256:c30dc6f7b9d114731bba8d4203a1d48d4d16a358dc65e734472ed6dc584ad236

Observation 7e8f4daf-9202-42bd-bce7-898792bd8cbc · outbound

This paper cites MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:35.879349Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:35.879349Z digest=sha256:b54353974526437581b0f1e1ed41220cb40602785a59e5bb62f0550c6931c3b9

Observation bdadbe14-78f8-4313-9062-86a97b7c5f15 · outbound

This paper cites MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:36.034767Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:36.034767Z digest=sha256:3311aa99fb89e1c74544623701169745cf1f744632b0e53f83680f4417d2522a

Observation d624d141-7b69-4ce4-92d1-14900e371b1d · outbound

This paper cites Compositional chain-of- thought prompting for large multimodal models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Compositional chain-of- thought prompting for large multimodal models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:36.207581Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:36.207581Z digest=sha256:f5b8a8757f717aa051fd6f8a4ab6781258ee2646e0e2883db0cecdca0baca2af

Observation b003eea8-f02f-44ca-b787-9f27e783d4f9 · outbound

This paper cites LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:36.315527Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:36.315527Z digest=sha256:83da91c4ab253f0a30775336ed62165d679858e56105e04a37285dd3077a83c8

Observation 62e16628-6758-4883-802e-bb8abce82333 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:36.455699Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:36.455699Z digest=sha256:e8cb510f1fd742878c7b945ac86b440c2421fe398da10412f2bec7a9abc0cc6a

Observation 90c1b662-c989-420d-b621-aa1b4ad3a9b6 · outbound

This paper cites VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:36.582059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:36.582059Z digest=sha256:12ef6a93f5a316483d8b13e6b7422a5d63bb2467e0b749ad544ce32ff3193ad5

Observation b60d486f-3e83-4dfc-82a1-882f978f8b58 · outbound

This paper cites HybridFlow: A Flexible and Efficient RLHF Framework.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning HybridFlow: A Flexible and Efficient RLHF Framework

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:36.715006Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:36.715006Z digest=sha256:405e9fbc971ae1f3465b2db3a7ffd7007fbecefe27c9101a4364c818ca186200

Observation fbe8e408-d38e-4d83-b997-b3745f1fca6d · outbound

This paper cites Generative multimodal models are in-context learners.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Generative multimodal models are in-context learners

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:36.849148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:36.849148Z digest=sha256:8428a913ed5637b9d574febc080b0acd87264c0d5e50def02311e19f44edbbec

Observation 3ce6b951-cd47-4683-884f-15b36ff612f0 · outbound

This paper cites Reason-rft: Reinforcement fine-tuning for visual reasoning.arXiv preprint arXiv:2503.20752, 2025.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Reason-rft: Reinforcement fine-tuning for visual reasoning.arXiv preprint arXiv:2503.20752, 2025

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:36.989656Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:36.989656Z digest=sha256:0a5ca1ac5960546f7b727da7d4bdfff3ea393b5a5391645c1b174a3b39c31862

Observation 1ab728e6-e5c3-49aa-9bf2-89d59bb4acb3 · outbound

This paper cites Gemini: A Family of Highly Capable Multimodal Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Gemini: A Family of Highly Capable Multimodal Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:37.117863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:37.117863Z digest=sha256:c7dd6e2b9732165268726aafb5e04bf4a3541373835fe6f55e19a398d39c786e

Observation fd78d89e-0a1d-4c24-9d28-09fb75ad6012 · outbound

This paper cites Identifying and Mitigating Position Bias of Multi-image Vision-Language Models.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Identifying and Mitigating Position Bias of Multi-image Vision-Language Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:37.269158Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:37.269158Z digest=sha256:0012245ad8391c374b05b6940004691305118e5ac803ed93117f7bc750df61c8

Observation ba28c4ed-87bd-4f28-8a1e-0dc9d73bc252 · outbound

This paper cites MuirBench: A Comprehensive Benchmark for Robust Multi-image Understanding.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning MuirBench: A Comprehensive Benchmark for Robust Multi-image Understanding

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:37.427098Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:37.427098Z digest=sha256:13b7ab0b1f7fc593f58eef87842308ab6185daa5cf66f9ae8247849138d7ef52

Observation 1964cd2d-2e29-4943-8abb-0bb44abc25d2 · outbound

This paper cites VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:37.599695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:37.599695Z digest=sha256:16b7e6d926f8a7a8e455d074542ec4d7ebe0d7e84092a2a530c7a82704722088

Observation f441ceca-fd9d-4f93-be5f-703d0c7dc510 · outbound

This paper cites Measuring multimodal mathematical reasoning with math-vision dataset.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Measuring multimodal mathematical reasoning with math-vision dataset

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:37.725734Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:37.725734Z digest=sha256:28e5750dc939238610c7089258078132675ad8058d28eccdd0ab4d76a4a9c2ec

Observation 8d44726a-0687-4b8f-8626-30727eb0e571 · outbound

This paper cites MV-MATH: Evaluating Multimodal Math Reasoning in Multi-Visual Contexts.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning MV-MATH: Evaluating Multimodal Math Reasoning in Multi-Visual Contexts

Reference 40

Resolution
verified exact
local_arxiv, observed 2026-08-07T00:13:39.956964Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T00:13:37.882009Z digest=sha256:936e21808c9269ac57857d68d29409376c5df60d0cdb19e2ef1099a6913174ca

Observation 1a54b7a3-06ed-4e51-9bac-347642c2cbbc · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:37.984565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:37.984565Z digest=sha256:57427dc61219584a7cc5f2e49be439396dbca5d049d3a21391351f7e79a43347

Observation b17b943e-74b1-4da0-b8b0-fa9175c1f749 · outbound

This paper cites DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:38.129961Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:38.129961Z digest=sha256:c5905b7685130bc70b3134f11c45902c638727e2271459bad503ee2db5c6e710

Observation 7a55003c-15a0-438a-849e-98e537465ebb · outbound

This paper cites R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:38.298726Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:38.298726Z digest=sha256:71769e96ad774fa97e215c4facb9eb44fe4a961df4d0357e1d641f7103cf47c1

Observation 7dcb0f31-3bf2-4cea-bf6c-bd8fbc64ad49 · outbound

This paper cites Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:38.425045Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:38.425045Z digest=sha256:88847b7f84b7a6f4f672ff467d8388d74a8747ca06b27e711f0d4572d6cc26c8

Observation 318971f5-3c8e-4986-9e14-17882b99da2e · outbound

This paper cites Perception-R1: Pioneering Perception Policy with Reinforcement Learning.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Perception-R1: Pioneering Perception Policy with Reinforcement Learning

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:38.613601Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:38.613601Z digest=sha256:c0a3c5f89df8d2f61c5cc57314c9158c306473eb1b3eaeee2bc570d983a08147

Observation 8660b85e-6440-41bf-bfad-4132c46f346c · outbound

This paper cites R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:38.760957Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:38.760957Z digest=sha256:0ec7c6e42c2da31c239824e8d06381c0586625f957cb5436370bc2bc023fd375

Observation e96dd684-1d67-49e9-ade6-dc48f2146cc4 · outbound

This paper cites Weaving Context Across Images: Improving Vision-Language Models through Focus-Centric Visual Chains.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Weaving Context Across Images: Improving Vision-Language Models through Focus-Centric Visual Chains

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:38.864735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:38.864735Z digest=sha256:e276b1261561eb67a4289f6d2df0f7efdfeaf0cb48469c994b17419d67bfe066

Observation 04c97516-3cfc-4ad1-b5ff-7318ad84af4b · outbound

This paper cites Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? InEuropean Conference on Computer Vision, pages 169–186.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? InEuropean Conference on Computer Vision, pages 169–186

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:38.951679Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:38.951679Z digest=sha256:314b868a48ad26f4d339305b59b9cc61bbbf95cf1cc4a5c707e07e91de28389a

Observation d101a7d7-f6ae-4f1b-b221-7b6c73884ae8 · outbound

This paper cites R1-Zero's "Aha Moment" in Visual Reasoning on a 2B Non-SFT Model.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning R1-Zero's "Aha Moment" in Visual Reasoning on a 2B Non-SFT Model

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-07T00:13:39.058338Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:13:39.058338Z digest=sha256:7d3b0a71fc0380d375224fcdd09b07445da30082ed17b26995daa377e6a36646

Observation 71e1be06-232f-4421-a9e0-465fa8439e73 · outbound

This paper cites <image> <image> <image>.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning <image> <image> <image>

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:13:41.417822Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T00:13:39.156891Z digest=sha256:1c353b611f783cc75a59c34317fe9d34c1132eb3ab53dbcb6460be7614ad3c64

Observation 658e9f6c-80b5-417d-ae13-dc24caa3edd0 · outbound

This paper cites A", "B",.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning A", "B",

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:13:41.203753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T00:13:39.231536Z digest=sha256:afcb6191662b4ca9227c5ca775f647d635ef0df902c4bd19befe7fba48c60db5

Observation 0489e2ff-37dc-4717-83b3-87d0ffaefcc4 · outbound

This paper cites question.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning question

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:13:41.009674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T00:13:39.382669Z digest=sha256:798cfe6934fea64372e4b0417657931407a3c726edb7ef429426dd3b71b3b00d

Observation e6222173-1915-4f3d-bf24-b3597aaff662 · outbound

This paper cites an unresolved cited work.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning Unresolved cited work

Reference 53

Resolution
unresolved
raw_fallback, observed 2026-08-07T00:13:40.815528Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T00:13:39.502807Z digest=sha256:c19cf62a0115ea3d0a6dce48fdf6d3f0598d84573b43f1f56388ced2d3daa747

Observation 49b31685-98cd-4e34-ac50-81f53b919c9b · outbound

This paper cites should_change.

PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning should_change

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:13:40.469684Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T00:13:39.624185Z digest=sha256:ca58238602aa7b77323b4eff7fc5d186dafea72b2f1e8b77546c99808d802cd1

Pith citing papers

Observation b6ea3834-aab7-4c19-9a34-08b612d1218e · inbound

Reflection Anchors for Propagation-Aware Visual Retention in Long-Chain Multimodal Reasoning cites this paper.

Reflection Anchors for Propagation-Aware Visual Retention in Long-Chain Multimodal Reasoning PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning

Reference 32

Resolution
verified exact
arxiv_id, observed 2026-05-12T07:41:27.635779Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-12T02:24:12.349405Z digest=sha256:c9313edb6abc9441ee49177bc714c375436f0e5199e7e8d7c1da0981480a93c4