CASCADE · Serviços de Business Intelligence

É Assim que Seu Futuro em IA Começa.

A IA privada não está chegando — ela já está ao seu alcance. O CASCADE é a plataforma que a traz para dentro da sua organização. O scanner é onde todo projeto começa: uma leitura precisa do seu hardware e a especificação de implantação que define seu stack desde o primeiro dia.

One-time · Windows 10/11 · Your license key arrives by email

Resultados Que Realmente Fazem Sentido

Depois de escanear, o CASCADE mostra exatamente quais modelos sua GPU consegue rodar — e se vão rodar totalmente na GPU (rápido), em modo híbrido, ou só na CPU.

Escaneamento em um clique
Análise visual do hardware
Seu YAML de hardware
Nenhum conhecimento técnico necessário
  • Nome da GPU, VRAM, status CUDA, versão do driver
  • Núcleos da CPU, threads, clock e RAM total
  • Modelo recomendado (ex: mistral:7b-instruct-q4_K_M)
  • Modo de inferência e faixa estimada de tokens/seg
  • Tier do stack (Lite / Standard / Full) e componentes incluídos
CASCADE — Hardware Analysis

GPU

NVIDIA RTX 4060 Ti

8 GB VRAM · CUDA 12.4 · driver 551.23

CPU / RAM

Intel Core i7-12700K

12 cores · 20 threads · 3.60 GHz · 32 GB RAM

Recommendation

mistral:7b-instruct-q4_K_M

full-gpu25–45 t/sStandard tier

Três caminhos. Um destino.

IA Privada, Seja Qual For Seu Hardware

A maioria das estações de trabalho de PMEs não consegue rodar um modelo de 13B ou 70B localmente — e não precisam. O CASCADE mostra exatamente onde você está, e nós levamos você até o resto do caminho.

Caminho 01

Implantação Local

Sua GPU é forte o suficiente para rodar modelos open-source diretamente no seu hardware — sem dependência de nuvem, sem mensalidade de API, com capacidade total offline. Você nos envia o YAML gerado pelo seu scan, e nós montamos manualmente um conjunto de modelos pré-carregados, ajustado exatamente para aquela máquina — codificadores, modelos de raciocínio e um modelo de chat que sua GPU realmente consegue rodar com velocidade. Ele chega configurado e pronto; você nunca precisa mexer no Ollama ou escolher um modelo.

  • Um conjunto de modelos selecionado e pré-carregado a partir do seu scan — dimensionado para sua VRAM, sem achismos
  • Pesquise seus próprios arquivos, com privacidade — aponte para seus casos, registros ou contratos; nada é enviado a lugar nenhum
  • Uma janela de chat integrada — faça perguntas em linguagem natural e receba respostas extraídas diretamente dos seus arquivos
  • Nenhum projeto de TI — entregue já configurado; basta abrir e começar a trabalhar, sem login em nada
  • Inferência completa por GPU — rápida, privada e com capacidade offline
  • Configuração única, sem custo recorrente de computação
Agende uma Chamada sobre Implantação Local →

Caminho 02

Traga Sua Própria Chave (BYOK)

Já tem uma chave de API — Anthropic, OpenAI, Gemini, NVIDIA NIM, OpenRouter ou outro provedor? Aponte o SALT Agent diretamente para ela. Você mantém a chave, a cobrança e a conta — nada passa por um servidor da Fourier. Nós cuidamos da integração; você mantém o controle.

  • Funciona com qualquer provedor relevante — Anthropic, OpenAI, Gemini, NVIDIA NIM, OpenRouter e outros
  • Você é dono da chave e da relação de cobrança diretamente
  • Mesmas automações da Implantação Local — só muda o backend de inferência
  • Geralmente a opção de nuvem mais barata quando o hardware local não é mais suficiente
Agende uma Consultoria BYOK →

Caminho 03

Membro NVIDIA Inception

Acesso a Desenvolvedor NVIDIA

A Fourier Systems é membro do Programa NVIDIA Inception, o que nos dá acesso direto aos recursos de desenvolvedor da NVIDIA e ao catálogo NGC — infraestrutura de IA de nível enterprise que a maioria das empresas não consegue acessar sozinha.

100+ Modelos

Llama, Mistral, DeepSeek, Nemotron, Gemma e mais

Nível Gratuito

1.000 créditos incluídos, 40 req/min, nunca expira

Compatível com OpenAI

Mesmo formato de API — uma linha de código para trocar de modelo

Multimodal

Modelos de texto, visão, voz, busca e biologia

Programa NVIDIA Inception — A Fourier Systems é membro do acelerador corporativo da NVIDIA para empresas de software orientadas a IA. Sem participação societária, sem taxas. Pergunte sobre nosso piloto de dev/test de 90 dias e baixo custo — uma forma de testar essa arquitetura antes de um projeto maior.
Agende uma Chamada sobre Acesso Developer →

Seu primeiro passo no CASCADE

Pronto para Conhecer Sua Máquina?

Rode o scanner. Receba a especificação do seu hardware. Entre em um futuro onde a inteligência da sua organização roda de forma privada, nos seus termos.

One-time · Windows 10/11 · Your license key arrives by email

Perguntas Frequentes

O CASCADE envia algum dado para a nuvem?+
Não. O wizard roda inteiramente na sua máquina local. Ele lê métricas de hardware pelas APIs do Windows e todo o processamento acontece localmente. Nada é transmitido pela rede.
Como eu consigo o CASCADE?+
Digite seu e-mail e escolha Brasil (R$25, Pix ou cartão) ou Internacional (US$5, cartão) — você será levado a um checkout seguro. Após o pagamento, sua chave de licença chega por e-mail e você é redirecionado para sua página de download. Não é necessário criar conta.
Preciso ser desenvolvedor ou ter experiência técnica?+
Não. O wizard abre uma interface gráfica — não há linha de comando. Se você sabe clicar com o botão direito em um arquivo e selecionar "Executar com PowerShell", você consegue usar o CASCADE.
Quais versões do Windows são suportadas?+
Windows 10 e Windows 11. O PowerShell 5.1 já vem incluído por padrão em ambos. Nenhuma instalação adicional é necessária.
Para que serve o arquivo YAML?+
O arquivo exportado cascade_config.yaml é a especificação do seu hardware — um registro preciso da sua GPU, VRAM, modelos recomendados e configurações de implantação. Você o mantém para sua própria referência. É também a partir dele que construímos sua implantação: nos envie esse arquivo e pré-carregamos um conjunto de modelos ajustado exatamente ao seu hardware — nada superdimensionado, nada que não vá rodar.
E se minha GPU não for NVIDIA?+
O CASCADE suporta GPUs AMD e Intel Arc com detecção de VRAM via registro. A inferência acelerada por CUDA exige uma GPU NVIDIA, mas a inferência apenas por CPU funciona em qualquer hardware.