Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it
Acerca de
Recientemente usamos DeepSeek V4 Flash como maestro para tareas financieras con GPT-OSS-120B. La destilación funciona bien en este problema. Con un presupuesto limitado de 8k tokens, nuestro 120B autodestilado obtiene un 83,61% en FinanceReasoning, por encima de Kimi K3 (81,93%) e Inkling (65,13%). Lanzamos los pesos abiertos de 20B. Sin embargo, con V4 como maestro, nos dimos cuenta de que sería oportuno medir si la característica de censura del mismo se transfería a la versión destilada del modelo base. tl;dr no lo hizo, el maestro
Casos de uso
- →Pesquisa sobre transferência de censura em modelos destilados
- →Comparação de respostas entre modelos de linguagem
- →Análise de comportamentos de modelos em temas sensíveis
Cómo funciona
O usuário envia prompts e observa como o modelo destilado responde, verificando se a censura é transferida.
Ejemplo de uso
Escreva uma pergunta sobre um tópico sensível e veja se a resposta do modelo destilado é censurada.
Puntos positivos
- +Distillation com DeepSeek V4 Flash melhora o raciocínio financeiro em GPT-OSS-120B
- +Supera modelos como Kimi K3 e Inkling no benchmark FinanceReasoning
- +Pesos abertos do modelo 20B disponibilizados gratuitamente
Puntos negativos
- −Foco restrito a tarefas financeiras
- −Resultados apenas em um benchmark específico, não generalizados
Preguntas frecuentes
O que é o Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it?
O Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it é gratuito?
Quais são as melhores alternativas ao Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship. Try it?
También te puede gustar
ChatGPT
Asistente de IA conversacional de OpenAI
Windsurf
IDE con agente integrado para programar
Replit Agent
Agente que crea y publica aplicaciones en Replit