Pontos principais
- A API oferece um único modelo sem censura acessível via SDKs padrão da OpenAI com uma janela de contexto de 100.000 tokens.
- O preço é transparente: $0.25 por 1 milhão de tokens de entrada e $1.00 por 1 milhão de tokens de saída, sem mensalidades.
- O serviço oferece streaming e chamada de funções, mas não oferece embeddings, imagens ou ajuste fino.
- Cada nova conta recebe $0.50 em crédito de teste, válido por sete dias, sem necessidade de cartão de crédito.
O que significa sem censura?
No contexto de modelos de linguagem grandes, "sem censura" geralmente se refere a um modelo que foi ajustado ou instruído para reduzir ou eliminar os mecanismos de recusa encontrados em modelos comerciais como GPT-4 ou Claude. Quando você faz uma pergunta a um modelo sem censura sobre um tópico controverso, um hobby de nicho ou um tema maduro, é menos provável que ele responda com um "Não posso discutir isso" genérico ou um longo aviso de segurança.
É importante esclarecer o que isso não significa. O modelo não é completamente anárquico. Ele ainda segue instruções e mantém a coerência lógica. A principal diferença é que ele prioriza responder ao seu prompt específico em vez de aderir a um conjunto predefinido de políticas de conteúdo. Por exemplo, se você pedir uma descrição detalhada de um evento histórico que alguns provedores possam considerar sensível, um modelo sem censura provavelmente fornecerá o relato histórico completo sem ressalvas.
No entanto, existem limites. Nossa API impõe um limite rígido de conteúdo: solicitações contendo conteúdo sexual envolvendo menores são bloqueadas. Esta é uma linha de base de segurança padrão que se aplica a todas as entradas. Para conteúdo adulto legal, comentários políticos ou ficção criativa, o modelo visa fornecer respostas diretas e sem restrições. Isso o torna ideal para casos de uso onde você deseja a saída bruta do modelo sem camadas intermediárias de filtragem.
Por que usar um modelo sem censura?
Desenvolvedores escolhem modelos sem censura por várias razões práticas. Primeiro, isso reduz a carga cognitiva da engenharia de prompts. Você não precisa criar prompts complexos para contornar os gatilhos de recusa. Se você quer que um modelo escreva uma história com temas maduros ou analise uma posição política controversa, pode perguntar diretamente. Isso é particularmente valioso para escrita criativa, aplicativos de role-playing e pesquisa, onde nuances são frequentemente perdidas nos filtros de segurança.
- Liberdade criativa: Gere histórias, roteiros ou diálogos sem se preocupar com o modelo recusando continuar devido a uma palavra-chave ou tema específico.
- Pesquisa e análise: Obtenha resumos imparciais de tópicos controversos sem que o modelo injete sua própria narrativa "segura".
- Eficiência de custos: Modelos sem censura são frequentemente menores ou mais eficientemente ajustados para tarefas específicas, o que pode levar a custos menores em comparação com modelos comerciais grandes e de propósito geral.
No entanto, existem compensações. Modelos sem censura podem ocasionalmente produzir saídas menos rigorosas factualmente ou mais propensas a alucinações porque não são penalizados tão fortemente por se desviar dos fatos estabelecidos. Eles também carecem do estilo de conversa refinado que os grandes provedores poliram em seus produtos. Se você precisa de um modelo que se desculpe educadamente por erros menores ou adira estritamente às diretrizes de voz da marca, um modelo sem censura pode parecer muito bruto. Mas se você precisa de dados ou conteúdo diretos e sem filtros, esta abordagem é altamente eficaz.
Gemma vs. GPT e Claude
Ao comparar uma API Gemma sem censura com serviços como GPT-4 ou Claude, as diferenças estão na arquitetura, política e preços. Modelos comerciais são geralmente maiores, mais caros e altamente filtrados. São feitos para uso empresarial geral, onde segurança e alinhamento de marca são essenciais. Nossa API Gemma sem censura é feita para desenvolvedores que querem controle sobre a saída sem pagar por um conjunto amplo de recursos que talvez não usem.
| Recurso | API Gemma sem censura | Modelos comerciais (GPT/Claude) |
|---|---|---|
| Filtragem de conteúdo | Mínima; limite rígido para conteúdo menor | Estrita; recusas frequentes |
| Modelo de precificação | Pagamento por uso, crédito pré-pago | Por token, frequentemente baseado em assinatura |
| Janela de contexto | 100.000 tokens | Variável (ex.: 128k+ para alguns modelos comerciais) |
| Pesos abertos | Sim | Não (proprietário) |
Modelos comerciais oferecem ecossistemas robustos com embeddings, visão e áudio. Nossa API foca exclusivamente em conclusão de texto. Se você precisa de recursos multimodais, precisará de outro provedor. No entanto, para geração de texto puro, nossa API oferece um endpoint sem censura que funciona com os mesmos SDKs. A principal vantagem é a transparência: você sabe exatamente o que está obtendo — um único modelo poderoso que não responde de forma condescendente quando você faz uma pergunta madura.
Como conectar a API
Conectar-se à nossa API é direto porque é totalmente compatível com OpenAI. Você pode usar os SDKs oficiais da OpenAI para Python, Node.js ou qualquer outra linguagem que suporte o protocolo OpenAI. As únicas alterações necessárias são a URL base e a chave de API.
Primeiro, faça login em uma conta em gemma4api.com para obter sua chave de API. Em seguida, configure seu cliente para apontar para nossa URL base: https://api.gemma4api.com/v1. Use o identificador do modelo uncensored em suas solicitações. Isso garante que o modelo que atenderá sua solicitação seja nossa variante Gemma sem censura.
- URL base:
https://api.gemma4api.com/v1 - ID do modelo:
uncensored - Endpoint:
POST /v1/chat/completions
Esta configuração permite que você substitua nossa API em projetos existentes com alterações mínimas de código. A API suporta parâmetros padrão como temperature, max_tokens e stop. Ela também suporta chamada de funções, permitindo que você defina ferramentas que o modelo pode invocar. Isso a torna adequada para construir agentes ou fluxos de trabalho complexos que exigem saída estruturada.
Streaming e chamada de funções
Nossa API suporta streaming e chamada de funções, oferecendo flexibilidade para diferentes casos de uso. O streaming é ativado definindo o parâmetro stream como true na sua requisição. Isso retorna dados em blocos conforme são gerados, o que é essencial para interfaces de usuário em tempo real onde você deseja exibir o texto conforme ele é escrito.
A chamada de funções permite definir um esquema para as funções que o modelo pode chamar. Quando o modelo decide que uma função é necessária, ele retorna um objeto estruturado com o nome da função e os argumentos. Você então executa a função e passa o resultado de volta ao modelo para a próxima interação. Isso é poderoso para construir aplicações que interagem com sistemas externos, como bancos de dados, calendários ou APIs personalizadas.
Ambos os recursos funcionam perfeitamente com o formato compatível com OpenAI. Você não precisa aprender um novo protocolo ou escrever analisadores personalizados. A API cuida da formatação JSON para chamadas de ferramentas e do SSE (Server-Sent Events) para streaming. Isso reduz o tempo de desenvolvimento e garante compatibilidade com ferramentas e bibliotecas existentes.
Preços e Limites
Nossos preços são transparentes e diretos. Não há assinaturas mensais ou taxas ocultas. Você paga apenas pelos tokens que usa, com crédito pré-pago que nunca expira.
- Tokens de entrada: $0.25 por 1 milhão de tokens
- Tokens de saída: $1.00 por 1 milhão de tokens
Você pode recarregar sua conta a partir de $10. Oferecemos bônus para depósitos maiores: +5% de crédito bônus para depósitos de $50 ou mais, e +10% de crédito bônus para depósitos de $100 ou mais. Isso significa que você obtém mais valor pelo seu dinheiro conforme escala.
Existem limites específicos a considerar. Você tem direito a 300 requisições por minuto por chave de API. O tamanho do corpo da requisição é limitado a 8 MB. Cada conta é limitada a uma chave de API, que pode ser regenerada a qualquer momento se necessário. Isso garante uso justo e previne abusos. O crédito de teste de $0,50 é válido por 7 dias e não requer cartão de crédito, facilitando o teste da API antes de se comprometer.
Privacidade e Uso de Dados
A privacidade é uma consideração importante para muitos desenvolvedores. Nossa API requer apenas um e-mail e senha para criar uma conta. Não coletamos números de telefone nem exigimos informações de pagamento para o teste. Sua chave de API é o único identificador para seu uso.
Em relação aos seus dados, não usamos seus prompts para treinamento. Esta é uma diferença significativa em relação a alguns provedores comerciais que podem usar dados de entrada para melhorar seus modelos. Suas conversas permanecem privadas para sua conta. Não compartilhamos seus dados com terceiros, a menos que exigido por lei. Isso torna nossa API adequada para aplicações sensíveis onde a privacidade dos dados é crítica.
Além disso, nosso modelo sem censura não infere preferências de conteúdo com base no seu uso. Cada requisição é processada independentemente, garantindo comportamento consistente. O limite rígido de conteúdo sexual envolvendo menores é aplicado uniformemente, mas, caso contrário, seus dados são seus. Não mantemos logs de suas conversas além do necessário para faturamento e depuração, e você pode solicitar a exclusão dos seus dados a qualquer momento.
Casos de Uso Comuns
APIs sem censura são ideais para uma variedade de aplicações. Aqui estão alguns casos de uso comuns onde nossa API se destaca:
- Escrita Criativa: Gere romances, roteiros ou contos com temas maduros sem que filtros de conteúdo interrompam o fluxo.
- Jogos de RPG: Crie NPCs dinâmicos que respondam naturalmente a qualquer tópico, incluindo violência, romance ou debate político.
- Extração de Dados: Extraia informações de texto sem que o modelo se recuse a processar certas palavras-chave ou entidades.
- Pesquisa: Analise tópicos controversos ou eventos históricos com viés ou filtragem mínimos.
Esses casos de uso se beneficiam da capacidade do modelo de fornecer respostas diretas e sem filtros. Por exemplo, em um jogo de RPG, o NPC pode reagir a uma ação violenta do jogador sem dizer: "Neste contexto fictício, é aceitável." O modelo simplesmente responde como o personagem faria. Da mesma forma, na extração de dados, o modelo pode processar qualquer texto, independentemente de seu conteúdo, tornando-o versátil para conjuntos de dados diversos.
Comece Hoje
Começar com a API Gemma sem censura é simples. Visite gemma4api.com e faça o cadastro com seu e-mail e senha. Você receberá uma chave de API imediatamente, junto com $0,50 em crédito de teste válido por 7 dias. Nenhum cartão de crédito é necessário para o teste.
Use a chave de API para configurar seu cliente compatível com OpenAI. Aponte-o para https://api.gemma4api.com/v1 e use o ID do modelo uncensored. Faça sua primeira requisição e veja a diferença. Se precisar de mais capacidade, recarregue sua conta com criptomoedas (USDT ou USDC). Bônus estão disponíveis para depósitos maiores.
Nossa API foi feita para desenvolvedores que desejam controle, transparência e saída sem censura. Seja você está construindo uma ferramenta de escrita criativa, um assistente de pesquisa ou um jogo de RPG, nossa API fornece a base que você precisa. Cadastre-se hoje e comece a explorar as possibilidades da IA sem censura.
Perguntas e respostas
O modelo é de pesos abertos?
Sim, o modelo é de pesos abertos, o que significa que sua arquitetura e pesos são acessíveis. No entanto, ele é hospedado em nossos servidores, então você o acessa via API, em vez de executá-lo localmente, a menos que baixe os pesos você mesmo.
Posso usar várias chaves de API?
Não, cada conta é limitada a uma chave de API. Você pode regenerar a chave a qualquer momento, o que revogará a chave antiga. Isso simplifica o gerenciamento e a segurança.
Existem taxas ocultas?
Não, não há assinaturas mensais ou taxas ocultas. Você paga apenas pelos tokens que usa, com crédito pré-pago que nunca expira. Os bônus são aplicados automaticamente para depósitos maiores.
Qual é o tamanho da janela de contexto?
A janela de contexto é de 100.000 tokens, o que inclui tanto o prompt quanto a conclusão. Isso permite conversas longas ou o processamento de documentos grandes.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.