IRYX™empresa
Conheça:
Iryx 1.0
Diz-se:
ái-riks, com Y
Produto:
Iryx API v1

Iryx 1.0 decide.

Nosso primeiro modelo de decisão. Você envia uma situação e as perguntas que quer responder, com as opções possíveis. O Iryx escolhe a resposta de cada pergunta e diz o quanto tem certeza. Não escreve texto: decide.

Medido no gabarito próprio da Iryx, em 23.09.2026, em textos curtos em português. Ao lado de outros nove sistemas: veja onde ele se sai bem e onde fica atrás.

Resposta:~74 msmediana por pedido, pela API
Contas:99,4%exato, 970 de 976
Prova principal:82%225 perguntas
Provas cegas:73–86%2 provas, domínios novos

Como funciona

Três passos. Você pergunta, o Iryx decide e diz o quanto tem certeza, e você escolhe quando o sistema pode agir sozinho.

  1. [ 01 · você envia ]

    O contexto e as perguntas.

    O contexto é a situação: uma mensagem, um registro, um JSON. Junto vão as perguntas, cada uma com as opções possíveis. São três tipos: escolher uma opção, sim ou não, um nível numa escala.

    > contexto Comprei um tênis na loja de vocês semana passada e veio no número errado. [...] Consigo trocar até sexta? > perguntas
    assunto?escolher uma: troca ou devolução · entrega atrasada · pagamento · cancelamento · dúvida sobre produto
    precisa de resposta hoje?sim ou não
    tom do cliente?escala: calmo · preocupado · irritado · furioso
  2. [ 02 · o iryx decide ]

    Uma resposta por pergunta.

    Para cada pergunta, o Iryx devolve a opção escolhida, a confiança (de 0 a 1) e o espectro: a chance de cada opção, não só da escolhida.

    < decisões
    assuntotroca ou devolução · 0,93
    resposta hojesim · 0,71
    tompreocupado · 0,95
  3. [ 03 · você define o limite ]

    Acima do limite, age. Abaixo, uma pessoa confere.

    Você escolhe a confiança mínima para o sistema agir sozinho. O que ficar abaixo vai para uma pessoa. A faixa (alta, média, baixa) é o corte que a Iryx recomenda.

    limite do exemplo: 0,80
    troca ou devolução · 0,93age sozinho
    preocupado · 0,95age sozinho
    resposta hoje: sim · 0,71pessoa confere

Exemplo: a troca de tênis do Teste agora, um teste real de 24.09.2026, com uma mensagem inventada. Os três tipos de pergunta e os valores são os daquele teste. O limite de 0,80 é só um exemplo: quem define é você.

Glossário

Decisão
Cada pergunta respondida. É também a unidade de cobrança.
Contexto
A situação que você envia: uma mensagem, um registro, um JSON.
Confiança
Um número de 0 a 1 que diz o quanto o Iryx tem certeza da opção escolhida.
Espectro
A chance de cada opção possível, e não só da escolhida.
Faixa
Alta, média ou baixa: o corte de confiança que a Iryx recomenda. Na baixa, confira antes de agir.
Resposta tipada
A resposta vem sempre num formato fixo (uma das opções, sim ou não, um nível da escala), que o software usa direto, sem interpretar texto.

Teste agora

Um contexto entra, as decisões saem. Cada uma com o valor, a confiança e o espectro inteiro. A faixa diz quando conferir.

Escolha uma mensagem:

Teste agora · sessão 001REC
Ver o pedido na API POST /v1/decide

< decisões

Entrada:
contexto + decisões
Saída:
valor, confiança, espectro
Caso:
teste real
Demonstração
Respostas prontas: esta página não chama o modelo.
Teste real
A troca de tênis foi feita em 24.09.2026, com uma mensagem inventada. Ficou guardado o valor escolhido em cada decisão; o resto do espectro aparece somado.
Exemplos
A cobrança em dobro e o comentário de loja são exemplos ilustrativos.
Faixa
Alta, média ou baixa: o corte de confiança que a Iryx recomenda, calculado nesta página. Na baixa, confira antes de agir.

[ números · gabarito próprio ]

Números do Iryx 1.0

Quase o mesmo acerto dos maiores modelos, em uma fração do tempo por caso. Nas contas, acerta todas. Dez sistemas, as mesmas perguntas, o gabarito próprio da Iryx.

Sistemas:
10
Perguntas:
até 425
Gabarito:
próprio
Respostas:
21–22 e 30.09.2026
Medido:
22–23 e 30.09.2026

Quase o mesmo acerto,
uma fração do tempo.

Na prova principal inteira, 82,2%, contra 84,9% a 88,4% dos modelos de uso geral. Por caso, ~90 ms; os modelos de uso geral, de 802 a 4.747 ms, medidos em lote: não é o tempo de um pedido. O Nimble 9B, aberto, de 568 a 1.790 ms numa placa de vídeo pequena, de casa. Os mesmos casos para todos, na mesma ordem em todos os gráficos.

Acerto no gabarito próprio da Iryx. * No tempo, entra o agente ou a linha de comando que chamou o modelo, em lotes: não é o tempo de um pedido.

~74 mspor pedido de ~3 decisões, na mediana, pela API, sem passar pela internet e com a conexão mantida aberta; com conexão nova a cada pedido, ~90 ms. Os outros foram chamados por outros caminhos: veja a tabela.
82,2%na prova principal inteira (225 perguntas: contas + texto). Os modelos de uso geral acertam de 84,9% a 88,4%; o Jev 1.13, 80,9%; o Nimble 9B, 71,6% (68,4% no q4).
970 de 976nas contas, em duas provas lacradas, onde a verdade é a conta. Nas 33 que os dez sistemas fizeram, o Iryx acertou todas; os outros nove, de 14 a 31.
CH 02 · 10 segundos no tempo mediano · 10 sistemasREC
00,0 spor pedido * em lote

Como ler

Cada quadrado é um caso completo, com ~3 decisões, no tempo mediano de cada sistema. É uma ilustração do tempo por caso, não medida de vazão. Iryx: 200 pedidos, 23.09.2026. GPT-5.5, GPT-5.6 Luna e Nimble 9B: 30.09.2026. Os outros: 300 casos, 21.09.2026.

Iryx, Jev 1.13 e Nimble 9B

Por pedido, pela API, com conexão nova a cada pedido. O Jev passa pela internet, com TLS; o Iryx, não: a diferença entre os dois não é só do modelo. Com a conexão mantida aberta, o Iryx fica em ~74 ms. O Nimble 9B roda localmente, pelo Ollama, numa placa de vídeo pequena, de casa: não representa uma placa adequada.

* Em lote

Os seis modelos de uso geral foram chamados em lotes, por um agente ou pela linha de comando. O tempo é o do lote dividido pelos casos, com a partida do programa: não é o tempo de um pedido. No lote, os casos saem juntos, no fim.

Todos os números

Acerto dos dez sistemas no gabarito próprio da Iryx, em cada prova
SistemaContas
33
PrincipalCega 1
100
Cega 2
100
Só texto
192
Inteira
225
Iryx 1.0100%79,2%82,2%86%73%
Jev 1.1357,6%84,9%80,9%87%92%
Nimble 9B42,4%76,6%71,6%86%88%
Nimble 9B q442,4%72,9%68,4%86%87%
Claude Opus 593,9%87,5%88,4%96%97%
Claude Fable 5.187,9%88,5%88,4%96%93%
GPT-6 Astra90,9%86,5%87,1%95%96%
GPT-5.6 Sol87,9%87,5%87,6%96%95%
GPT-5.6 Luna87,9%84,4%84,9%86%91%
GPT-5.584,8%87,0%86,7%92%93%

Acerto no gabarito próprio da Iryx; o número sob cada prova é o de perguntas. A principal inteira soma as 33 contas às 192 de texto. Respostas de 21.09.2026 (contas, principal e cega 1) e de 22.09.2026 (cega 2), medidas em 22 e 23.09.2026; as do GPT-5.5, do GPT-5.6 Luna e dos dois Nimble 9B, e as do GPT-5.6 Sol na cega 2, respostas e medida em 30.09.2026.

Tempo por caso e como cada sistema foi chamado
SistemaTempo por caso
mediana
CasosComo foi chamado
Iryx 1.090 ms200API, sem passar pela internet, um pedido por vez, conexão nova a cada pedido (com a conexão mantida aberta: 74 ms)
Jev 1.13412 ms300API do fornecedor, pela internet, conexão nova a cada pedido
Nimble 9B1.790 ms—API local do Ollama (/v1/systemone), um pedido por vez, numa placa de vídeo pequena, de casa, em que o modelo não cabe inteiro (parte na memória do processador)
Nimble 9B q4568 ms—igual, na versão comprimida (q4), que cabe inteira na mesma placa
Claude Opus 5802 ms*300
em 6 lotes
agente, em lotes de 50; tempo do lote ÷ 50
Claude Fable 5.11.515 ms*300
em 6 lotes
agente, em lotes de 50; tempo do lote ÷ 50
GPT-6 Astra4.069 ms*300
em 30 lotes
linha de comando da OpenAI, em lotes de 10, raciocínio baixo; tempo do processo ÷ 10
GPT-5.6 Sol4.747 ms*300
em 30 lotes
linha de comando da OpenAI, em lotes de 10, raciocínio baixo; tempo do processo ÷ 10
GPT-5.6 Luna2.714 ms*—linha de comando (Codex), em lotes de 10; tempo do lote ÷ 10
GPT-5.52.491 ms*—linha de comando (Codex), em lotes de 10; tempo do lote ÷ 10

Um caso é um pedido com ~3 decisões. Iryx medido em 23.09.2026; GPT-5.5, GPT-5.6 Luna e Nimble 9B, em 30.09.2026; os outros, em 21.09.2026. — = sem número. O Iryx e o Jev 1.13 foram medidos com conexão nova a cada pedido, mas o tempo do Jev inclui a ida e volta pela internet e o aperto de mão TLS, e o do Iryx não inclui: a diferença entre os dois não é só do modelo. Nos lotes, o tempo de cada lote dividido pelos casos dele vale para todos os casos do lote. * Inclui o agente ou o programa que chamou o modelo, e a partida dele: não é o tempo de um pedido. Os modelos de uso geral receberam o mesmo enunciado; outra configuração pode dar outro número. O Nimble 9B é um modelo aberto (Apache 2.0), com 9 bilhões de parâmetros; o q4 é a versão comprimida dele. O tempo dele foi medido numa placa de vídeo pequena, de casa, em que a versão inteira não cabe e parte fica na memória do processador: não representa o tempo numa placa adequada ao modelo. Claude é marca da Anthropic; GPT, da OpenAI. Os nomes só identificam o sistema medido. Nenhuma dessas empresas participou nem endossa esta comparação.

Leitura. Em texto não existe gabarito neutro: este é o da Iryx, e outro gabarito pode dar outra ordem. Nas contas, a verdade é a conta: o Iryx acertou as 33. Em texto, os modelos de uso geral ficam à frente em todas as provas, com um só empate (o GPT-5.6 Luna, na cega 1) e a maior distância na cega 2, com um tempo por caso muito maior, medido em lote e com a partida do programa: não é o tempo de um pedido. Com 100 perguntas, diferença de até ~7 pontos cabe na margem de erro; com 192 ou 225, até ~5; nas 33 contas, a margem é bem maior. Na cega 2, o Iryx fica atrás de todos: 73%, contra 87% a 97% dos outros nove. O Nimble 9B, aberto e bem menor, fica atrás do Iryx no texto da principal, empata na cega 1 e fica à frente na cega 2. Tudo em textos curtos em português; os outros sistemas podem ter mudado depois.

Iryx 1.0 ou modelo de uso geral?

[ iryx ]

Quando o Iryx serve melhor

  • Alto volume: muitas decisões por dia, cobradas uma a uma.
  • Tempo real: a resposta precisa sair em milissegundos.
  • Respostas fechadas: escolher uma opção, sim ou não, um nível numa escala.
  • Custo previsível: preço por decisão, e não por token.
  • Saber quando conferir: a confiança diz quando uma pessoa deve olhar.

[ uso geral ]

Quando um modelo de uso geral serve melhor

  • Texto livre: escrever, resumir, traduzir, explicar.
  • Conversas e tarefas abertas, sem uma lista de opções.
  • Acerto máximo em texto: quando ele importa mais que o tempo e o custo. Nas provas de texto desta página, eles acertam mais.

Onde o Iryx 1.0 pode atuar

Uma decisão em milissegundos, por frações de centavo. Isso muda o que é possível automatizar. Exemplos ilustrativos de aplicação. Os valores de confiança mostram o formato da resposta e não são resultados medidos.

[ wearables · saúde ]

Saúde em tempo real.

Rápido e barato o bastante para decidir a cada leitura do sensor, e não uma vez por dia.

Contexto:
leitura fora do padrão
Decisão:
alertar alguém? sim
Confiança:
0,93
Ação:
avisar um familiar ou profissional

[ empresas · sistemas ]

Sistemas que se organizam.

Milhares de eventos por minuto, triados no momento em que chegam.

Contexto:
novo registro no sistema
Decisão:
prioridade: alta
Confiança:
0,89
Ação:
encaminhar ao financeiro

[ desenvolvimento ]

Para quem cria sistemas.

Uma chamada à API, uma resposta tipada. O software age direto na decisão, sem interpretar texto.

Contexto:
dados da aplicação
Decisão:
opção B
Confiança:
0,95
Ação:
seguir o fluxo B

[ tempo · rotina ]

Mais tempo livre.

Mensagens, tarefas e pedidos triados automaticamente. Só chega até você o que precisa de você.

Contexto:
nova mensagem
Decisão:
precisa de você? não
Confiança:
0,91
Ação:
arquivar e resumir

[ segurança ]

Resposta em milissegundos.

Quando cada segundo conta, a decisão sai na hora. Abaixo do limite de confiança, uma pessoa confere.

Contexto:
evento de sensor descrito em texto
Decisão:
acionar o serviço? sim
Confiança:
0,88
Ação:
acionar o serviço de segurança

Planos

Cobrança por decisão, nunca por token. Sem plano grátis: o Teste agora mostra o produto sem conta. No anual, 2 meses grátis. Até a plataforma entrar no ar, a pré-reserva é por e-mail.

[ plus ]

Plus

R$ 110 por mês

ou R$ 1.100 por ano, com 2 meses grátis

Decisões por mês:
3.600.000
Excedente:
R$ 0,030 por mil
Pré-reserva↗

[ ultra ]

Ultra

R$ 490 por mês

ou R$ 4.900 por ano, com 2 meses grátis

Decisões por mês:
17.000.000
Excedente:
R$ 0,029 por mil
Pré-reserva↗

[ business ]

Business

R$ 1.990 por mês

ou R$ 19.900 por ano, com 2 meses grátis

Decisões por mês:
70.000.000
Excedente:
R$ 0,028 por mil
Pré-reserva↗

[ business dedicado ]

Business dedicado

a partir de R$ 4.900 por mês

Para volume alto ou uma configuração sob medida. O formato é definido em conversa com a Iryx.

Pré-reserva↗

[ crédito avulso ]

Crédito avulso

R$ 0,033 por mil decisões

Sem mensalidade. Recarga mínima de R$ 50.

Pré-reserva↗

Preços em reais. A unidade é a decisão: um pedido com três decisões conta três. O excedente de cada plano custa o preço por mil dele. O volume do Business é confirmado na conversa.

[ calculadora ]

Quanto custa o seu volume?

Digite quantas decisões você espera por mês. A conta usa só os preços mensais desta página e mostra o plano mais barato para esse volume.

Um pedido com três decisões conta três.

    Estimativa com os preços mensais; no anual, 2 meses grátis. O excedente de cada plano custa o preço por mil dele. Crédito avulso: recarga mínima de R$ 50. O volume do Business é confirmado na conversa.

    Para onde vamos

    Direção, não resultado medido.

    [ consistência de marca ]

    A peça respeita o sistema?

    O Iryx conferindo se uma peça segue o design system (cor, tipografia, espaço), com um número de confiança. Entram os dados da peça, como o arquivo de design os descreve; sai sim ou não, e qual regra quebrou.

    Frente:
    direção de arte
    Status:
    pesquisa

    [ direção de arte em escala ]

    Mil peças, uma estética.

    Decisões pequenas e rápidas que mantêm a mesma estética em milhares de peças.

    Frente:
    sistemas de peças
    Status:
    pesquisa

    [ segunda opinião ]

    O agente pergunta. O Iryx decide.

    Agentes de software consultando o Iryx antes de agir, com a faixa de confiança dizendo quando parar e perguntar a uma pessoa.

    Frente:
    agentes
    Status:
    uso interno

    [ triagem de briefing ]

    Chegou um pedido. Que peça é essa?

    O briefing em texto entra; saem o tipo de peça, o formato e a urgência, cada um com a confiança. Na faixa baixa, uma pessoa confere antes de a produção começar.

    Frente:
    produção
    Status:
    ideia

    [ direção do briefing ]

    Que direção de arte o briefing pede?

    O briefing e as direções de arte da marca entram; sai a direção mais provável, com a confiança, e se a peça precisa passar pelo diretor de arte. Na faixa baixa, quem decide é o diretor.

    Frente:
    direção de arte
    Status:
    ideia

    [ evolução do modelo ]

    Novas versões, respostas mais precisas.

    Seguimos aprimorando o Iryx para acertar mais em texto e ser mais preciso onde a confiança hoje cai. Sem data e sem número prometido: uma versão nova só entra no ar depois de medida.

    Frente:
    modelo
    Status:
    contínuo

    Como o Iryx foi feito:

    Como começar

    O painel ainda não está no ar. Por enquanto, tudo começa por e-mail.

    1. Faça a pré-reserva

      Conte o que você quer decidir e em que volume.

    2. Escolha o plano

      Plus, Ultra, Business ou crédito avulso. A Iryx ajuda a estimar o volume de decisões por mês.

    3. Chame a API

      Com a chave em mãos, um pedido POST /v1/decide leva o contexto e as decisões. Volta o valor, a confiança e o espectro de cada uma.

    Perguntas

    O que é o Iryx 1.0?

    Um modelo de decisão. Recebe um contexto e perguntas fechadas (escolher uma opção, sim ou não, um nível numa escala) e devolve cada resposta com a confiança medida e o espectro inteiro. Não escreve texto.

    Como se pronuncia?

    Ái-riks, como no inglês EYE-riks. Escreve-se com Y: I, R, Y, X.

    O que conta como uma decisão?

    Cada pergunta respondida. Um pedido com três decisões conta três. A cobrança é por decisão, nunca por token.

    Tem plano grátis?

    Não. O Teste agora, nesta página, mostra o produto sem conta e sem crédito. Para uso contínuo, os planos começam em R$ 110 por mês, e o crédito avulso começa com uma recarga de R$ 50.

    Onde ele ainda fica atrás?

    Em texto. Na prova principal sem as contas, acerta 79,2% (192 perguntas); o Jev 1.13 e os modelos de uso geral, de 84,4% a 88,5% (o Nimble 9B, aberto e menor, 76,6%). Na prova cega 2, acerta 73%, contra 87% a 97% dos outros nove sistemas (100 perguntas). Na cega 1, os modelos de uso geral acertam de 86% a 96%, contra 86% (100 perguntas): o GPT-5.6 Luna empata. Onde há conta, acertou as 33. Quando a confiança cai na faixa baixa, confira antes de agir. Medido em 22, 23 e 30.09.2026, no gabarito próprio da Iryx.

    O que acontece com o que eu mando?

    Hoje, a API não guarda o contexto nem as respostas: lê, decide na memória e responde. O registro de cada pedido guarda só dados de operação: a hora, o método, a rota, o status, o id do pedido, o número de decisões e a duração, e o tipo do erro quando algo falha. O serviço hospedado ainda não está no ar; as regras dele vão estar nos termos de uso antes do primeiro cliente.

    Funciona em inglês?

    A API aceita qualquer texto. Os números desta página foram medidos em textos curtos em português; em inglês, a qualidade ainda não foi medida.

    Como ele foi feito?

    Sigiloso.