RFCLLM: Evaluating LLMs' Reasoning Ability of Network Protocol State Machines
A new arXiv paper, RFCLLM, evaluates how well large language models reason about network protocol state machines, testing 16 protocols across 4 tasks and 1482 task queries. The study compares each LLM's implicit finite-s…