Stealing Reasoning Traces from Proprietary LLM APIs
Paper LLMs & Texto

Stealing Reasoning Traces from Proprietary LLM APIs

Encrypted reasoning traces shared across sessions and models can be intercepted and injected into weaker models to extract proprietary reasoning, private data, hidden hazards, and…

Hugging Face · Daily Papers ·Alexander Panfilov, David Schmotz · ·▲ 5 upvotes

Este artigo está em destaque na seleção diária de papers do Hugging Face, curada pela comunidade de pesquisa em IA.

Autores: Alexander Panfilov, David Schmotz, Ilia Shumailov, Luca Beurer-Kellner, Joachim Schaeffer, Ameya Prabhu

  • 5 upvotes da comunidade
  • Temas: chain-of-thought, encrypted reasoning traces, decryption jailbreak, anti-distillation, PII extraction, invisible prompt injection

Resumo

Resumo original (em inglês), extraído do paper:

Encrypted reasoning traces shared across sessions and models can be intercepted and injected into weaker models to extract proprietary reasoning, private data, hidden hazards, and hidden prompts.

Onde ler

compartilhar: