Papers Decodificados

RSS →

Toda semana, o paper de IA que mais importa — explicado para C-Level em português, sem matemática e sem hype, com consequência de negócio.

§1 O que o paper afirma §2 Por que importa para o negócio §3 O que fazer a respeito §4 Limite da evidência
arXiv:2501.12948 [cs.CL] 4 jul 2026 6 min

Raciocínio de fronteira por 5% do custo: o que o DeepSeek-R1 muda no seu orçamento de IA

DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Para a diretoria: O custo de raciocínio avançado caiu uma ordem de grandeza — e o modelo é aberto. Se sua estratégia de IA assume que capacidade de ponta exige contrato com um único fornecedor americano, ela envelheceu.

LLMsCustoOpen weights
Fonte ↗ [huggingface.co] 4 jul 2026 7 min

A mesma GPU, 60–85% mais rápida por usuário: o ganho de inferência que não exige trocar de modelo

DSpark: Confidence-Scheduled Speculative Decoding with Semi-Autoregressive Generation

Para a diretoria: Um novo método de decodificação da DeepSeek entrega 60–85% mais velocidade por usuário na mesma infraestrutura — sem trocar o modelo e sem perder qualidade (a resposta é matematicamente idêntica). Para quem serve IA em escala, é menos custo por token e latência que desbloqueia produtos antes inviáveis. Ressalva: os ganhos de produção são auto-reportados e dependem da infra da própria DeepSeek.

InfraCustoOpen weights
arXiv:2606.11690 [cs.DC] 4 jul 2026 7 min

A conta do 'rodar em casa' está errada: por que o custo real de inferência varia até 36×

Beyond Per-Token Pricing: A Concurrency-Aware Methodology for LLM Infrastructure Cost Estimation

Para a diretoria: A planilha que diz que rodar IA em casa é mais barato que a API quase sempre assume a GPU 100% ocupada — e ela nunca está. No mesmo hardware, o custo por token varia até 36× conforme o volume de tráfego. Em tráfego baixo, a economia do self-hosting evapora: pode custar mais caro que o fornecedor.

InfraCustoOpen weights
arXiv:2212.04356 [eess.AS] 27 jun 2026 5 min

Por que o Whisper transformou cada ligação do seu call center em dado estruturado

Robust Speech Recognition via Large-Scale Weak Supervision

Para a diretoria: Transcrição de voz em português deixou de ser projeto de P&D e virou commodity de infraestrutura. A pergunta certa mudou de "conseguimos transcrever?" para "o que fazemos com 100% das ligações transcritas?".

SpeechContact centerPT-BR