ソラナのスループット向上策(並列実行、ステート圧縮、帯域拡張など)は、あくまで「並列化できる部分」を対象にした改善です。
solanaの最大ボトルネックは本当はCPU1コアのヘルツを上げれないから、並列できない直列処理がずっと続いた時にそのボトルネックに引きずられることなんだから。

ローカル手数料市場が対処しているのは「経済的な混雑」、つまりどのトランザクションを先に処理するか、どの取引が高い手数料を払ってでも優先されるかという、需要側の調整です。人気DEXプールを避けて別の口座に取引を逃がせば、その個々の取引は安く速く処理されます。

でも今話しているボトルネックは、そこより一段下のレイヤーの話です。リーダーがブロックに含める全トランザクション(混雑した口座のものも、空いている口座のものも含めて)を、決定論的な順序に確定させる処理と、その順序に従ってネットワーク全体のバリデータがステート遷移を検証・リプレイする処理は、どの口座を触っているかに関係なく、ブロックに入る全トランザクションに対して逐次的に発生します。つまり「混雑を避けて空いている口座で取引する」という選択は、経済的な優先順位付けの話であって、ブロック全体の逐次処理そのものをスキップさせる話ではありません。

言い換えると、ローカル手数料市場は「誰が先に処理されるか」という順番待ちの列を分散させる仕組みであって、「列に並んだ後、1人ずつ確認して処理する係員が1人しかいない」という構造そのものは変えられません。混雑を局所化しても、ブロックに詰め込まれるトランザクションの総量が増えれば、その全量を捌く逐次処理パート(順序確定とリプレイ)の所要時間は増え、それが400msなどのブロックタイムの枠に収まらなくなった時点で、口座がどこであろうと関係なく、ネットワーク全体の処理速度がその1コアの性能に律速されます。

だからこそこのボトルネックは、手数料市場をどう設計しても、需要側の工夫では回避できない、供給側(ハードウェア)の物理的な限界の話だ、というのが的確な指摘なのです。