Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it
Sobre
Recentemente, usamos o DeepSeek V4 Flash como professor para tarefas de finanças com o GPT-OSS-120B. A destilação funciona bem nesse problema. Com um orçamento restrito de 8 mil tokens, nosso 120B autodestilado obtém 83,61% no FinanceReasoning, acima do Kimi K3 (81,93%) e do Inkling (65,13%). Lançamos os pesos abertos de 20B. No entanto, com o V4 como professor, percebemos que seria oportuno medir se a característica de censura dele foi transferida para a versão destilada do modelo base. tl;dr: não, o professor
Casos de uso
- →Pesquisa sobre transferência de censura em modelos destilados
- →Comparação de respostas entre modelos de linguagem
- →Análise de comportamentos de modelos em temas sensíveis
Como funciona
O usuário envia prompts e observa como o modelo destilado responde, verificando se a censura é transferida.
Exemplo de uso
Escreva uma pergunta sobre um tópico sensível e veja se a resposta do modelo destilado é censurada.
Pontos positivos
- +Distillation com DeepSeek V4 Flash melhora o raciocínio financeiro em GPT-OSS-120B
- +Supera modelos como Kimi K3 e Inkling no benchmark FinanceReasoning
- +Pesos abertos do modelo 20B disponibilizados gratuitamente
Pontos negativos
- −Foco restrito a tarefas financeiras
- −Resultados apenas em um benchmark específico, não generalizados
Perguntas frequentes
O que é o Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it?
O Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it é gratuito?
Quais são as melhores alternativas ao Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it?
Você também pode gostar
ChatGPT
Assistente de IA conversacional da OpenAI
Windsurf
IDE com agente integrado para programar
Replit Agent
Agente que cria e publica apps no Replit