Saltar para o conteúdo
FenixIAm by AIworks 2028 FenixIAm

Centro de Inteligência Edição de setembro de 2026 6 peças

O que é preciso saber antes de pôr a IA a trabalhar.

Guias e análises escritos a partir da experiência de construir agentes para negócios reais: como medir, o que a norma exige, que modelo escolher e onde não convém usar IA. Para quem tem de decidir, sem fumo.

01Formação

Como medir um roleplay comercial sem se enganar

· 2 min de leitura

Uma nota sem a frase que a sustenta não ajuda ninguém a melhorar. Critérios observáveis, citações literais e evolução no tempo: é assim que um ensaio se transforma em aprendizagem.

Critérios que se possam ouvir

O primeiro erro é avaliar o que não se vê. «Atitude positiva» ou «segurança» dependem de quem ouve. Um bom critério descreve um comportamento que se pode apontar na transcrição: «pergunta pela necessidade antes de apresentar o produto», «reformula a objeção antes de lhe responder», «propõe um próximo passo com data». Entre oito e dez critérios chegam; com mais, o relatório transforma-se em ruído.

Cada critério precisa de uma escala com âncoras. Se vai de 0 a 10, é preciso escrever o que é um 3, um 6 e um 9, com exemplos. Sem âncoras, dois avaliadores, humanos ou não, pontuam a mesma conversa de forma diferente.

Cada nota, com a sua citação

Uma nota só serve se chegar com a frase que a justifica e o minuto em que foi dita. A citação permite ao comercial perceber o que fez bem ou mal, e ao formador verificar se a avaliação é justa. Se o sistema não encontrar uma frase que sustente a nota, a nota não deveria existir.

Nos setores regulados é precisa mais uma verificação: se o que se afirmou sobre o produto está correto segundo a documentação oficial. Uma conversa brilhante com um dado falso é um risco, não um êxito.

A evolução, não a fotografia

Uma sessão isolada diz pouco: influem o cenário, o dia e o cliente simulado. O que importa é a tendência no mesmo cenário ao longo de várias sessões, que critérios melhoram e quais estagnam. Convém subir a dificuldade do cliente simulado só quando os critérios básicos se aguentam.

Enviesamentos a vigiar

  • Premiar a extensão: falar mais não é vender melhor. Um critério de escuta compensa-o.
  • O efeito de halo: um bom arranque não deve inflacionar o resto. Cada critério é pontuado com a sua própria citação.
  • Os erros de transcrição: um sotaque ou uma linha com ruído podem penalizar quem não o merece. As notas baixas revêem-se com o áudio.
  • Premiar o guião: recitar o argumentário não é escutar. Avalia-se se a resposta encaixa no que o cliente disse.
  • Julgar a pessoa em vez da conversa: mede-se o que foi dito, não como se sentia quem o disse.

Por último, calibra. De tempos a tempos, um formador pontua à mão uma amostra de sessões e compara a sua nota com a do sistema. Se divergirem, ajustam-se as âncoras; não se força o resultado.

Voltar ao índice

02Regulamentação

O Regulamento Europeu da IA e a formação com IA: o que já se aplica e o que chega em 2027

· 2 min de leitura

Desde 2 de agosto de 2026 é obrigatório avisar que se está a falar com uma IA. A 2 de dezembro de 2027 chegam as obrigações de risco elevado para os sistemas que avaliam trabalhadores. Isto é o que convém fazer já.

Já se aplica: avisar que é uma IA

O artigo 50.º do Regulamento (UE) 2024/1689 aplica-se desde 2 de agosto de 2026. Exige que quem conversa com um sistema de IA o saiba, salvo quando isso é evidente pelo contexto. Num roleplay de formação o contexto costuma deixá-lo claro, mas não convém depender disso: um aviso no início de cada sessão, por escrito e de viva voz, elimina a dúvida. Além disso, os fornecedores de sistemas que geram áudio, imagem, vídeo ou texto sintéticos têm de os marcar de forma legível por máquina.

Já era proibido: deduzir como se sente o trabalhador

Desde fevereiro de 2025, o artigo 5.º proíbe no local de trabalho e nas instituições de ensino os sistemas que deduzem o estado de espírito ou os sentimentos de uma pessoa a partir da voz, da cara ou de outros dados biométricos, salvo por razões médicas ou de segurança. Para a formação comercial isto significa algo muito concreto: o sistema pode avaliar o que foi dito e como a conversa foi conduzida, mas não pode concluir que o comercial estava nervoso, inseguro ou aborrecido.

Chega em dezembro de 2027: risco elevado

O Regulamento considera de risco elevado os sistemas destinados a supervisionar e avaliar o desempenho e o comportamento dos trabalhadores. Depois da alteração de 2026 (Regulamento (UE) 2026/1744), essas obrigações aplicam-se a partir de 2 de dezembro de 2027: gestão de riscos, documentação técnica, registos e supervisão humana e, para a empresa que o utiliza, informar previamente os trabalhadores afetados e os seus representantes.

A classificação depende da utilização prevista e convém analisá-la com um consultor. Um ensaio privado cujo resultado só a pessoa que pratica vê está longe desse cenário. Se as notas alimentam avaliações de desempenho, incentivos ou decisões sobre a carreira de alguém, o sistema cai em cheio nele.

O que fazer já

  • Avisar no início de cada sessão que a outra parte é uma IA, mesmo que pareça óbvio.
  • Rever os critérios de avaliação e retirar qualquer um que dependa de adivinhar como a pessoa se sente.
  • Separar o ensaio privado da avaliação e decidir por escrito que resultados a empresa vê e com que finalidade.
  • Pedir o consentimento de cada pessoa antes de partilhar os seus resultados.
  • Documentar desde já os critérios, as fontes e quem revê as notas: é a base do que será exigido em 2027.
  • Explicar a quem usa e supervisiona o sistema o que a ferramenta faz e o que não faz.

Este texto é orientativo e não substitui o aconselhamento jurídico de cada caso.

Voltar ao índice

03Setor público

IA na contratação pública: preparar, verificar e redigir, sim; decidir, não

· 2 min de leitura

A IA pode poupar horas em cada processo de contratação. O que não pode é ocupar o lugar de quem assina. Onde está a linha e como se desenha um sistema que a respeite.

Um processo de contratação é, em boa parte, trabalho documental: reunir dados dispersos, calcular montantes, verificar que nada falta e redigir documentos que seguem modelos conhecidos. Aí a IA acrescenta muito. Mas o processo termina em atos administrativos que alguém tem de fundamentar e assinar, e essa responsabilidade não se delega numa máquina.

Sim: preparar

Extrair da memória descritiva, do orçamento ou de contratos anteriores os dados de que o processo precisa: objeto, duração, lotes e preços unitários. Propor o cálculo do valor estimado com a sua decomposição, para que o técnico o reveja em vez de o construir de raiz.

Sim: verificar

Confirmar que estão todos os documentos que o tipo de contrato exige, por exemplo o relatório de insuficiência de meios num contrato de serviços; que os números batem certo entre documentos e que os prazos são coerentes. Se faltar alguma coisa, o processo não deve avançar: um bloqueio claro evita erros que depois custam uma impugnação.

Sim: redigir

Gerar os rascunhos da memória justificativa, dos relatórios e dos cadernos de encargos a partir dos modelos da entidade, com o seu nome e o seu brasão, prontos a rever em Word e Excel. O técnico corrige e assina; o rascunho poupa-lhe a parte mecânica.

Não: decidir, adjudicar nem fiscalizar

A necessidade do contrato, o procedimento e os critérios são decididos pelo órgão competente para contratar. A apreciação das propostas que depende de juízos de valor cabe ao júri ou à comissão de peritos, e a adjudicação, ao órgão competente. A fiscalização é tarefa do controlo financeiro. A IA pode assinalar que uma proposta parece anormalmente baixa, mas apreciá-lo exige pedir esclarecimentos ao concorrente e decidir de forma fundamentada. Isso faz uma pessoa.

Se alguma vez se automatizar uma atuação, a lei espanhola 40/2015 obriga a fixar antes que órgão é competente e quem responde por ela. Quando a IA só prepara, verifica e redige, o responsável continua a ser quem assina, e o sistema deve deixá-lo claro.

Como se reconhece um bom desenho

  • Cada dado extraído indica de que documento vem.
  • Cada rascunho pode ser editado antes de ser assinado.
  • Os bloqueios explicam o que falta e porquê.
  • No fim, o processo completo é exportado num pacote que qualquer pessoa pode rever.
Voltar ao índice

04Modelos

Radar de modelos, setembro de 2026: o que vigiar e como escolher

· 2 min de leitura

Setembro trouxe uma geração nova em quase todos os grandes fornecedores. Que famílias convém acompanhar e um método para escolher modelo por tarefa, custo e latência que resista à próxima novidade.

As famílias que convém vigiar

A OpenAI estreou a geração GPT-6, com um modelo de referência para o raciocínio e dois níveis mais leves para o trabalho diário e o grande volume. A Anthropic renovou a sua gama alta com o Claude Opus 5.5, forte em tarefas longas e em agentes que usam ferramentas. A Google renova o Gemini Flash a cada poucas semanas, já na versão 3.8, e publica modelos específicos para voz em direto e leitura em voz alta. A xAI lançou o Grok 4.7. A DeepSeek mantém a pressão no custo com modelos de pesos abertos, e os melhores modelos abertos (Qwen, GLM, Kimi e outros) já competem com modelos fechados de há poucos meses. A Mistral continua a ser a opção europeia de referência.

Escolher por tarefa, não por ranking

As classificações gerais mudam todas as semanas e medem coisas de que talvez não precises. É mais útil arrumar as tarefas do negócio em três grupos:

  • Raciocínio difícil e pouco frequente, como analisar um contrato, rever um relatório longo ou planear: compensa o modelo mais capaz, mesmo que seja mais lento e mais caro.
  • Trabalho diário de volume médio, como redigir, resumir, classificar ou avaliar uma conversa com uma grelha: um modelo intermédio costuma dar a mesma qualidade por muito menos.
  • Grande volume ou resposta imediata, como extrair campos ou falar ao telefone: modelos leves ou de baixa latência. Em voz, o que importa é responder em menos de um segundo e não atropelar a pessoa.

Custo e latência medem-se, não se supõem

O preço por token engana: um modelo barato que precisa de três tentativas ou escreve respostas muito longas acaba por custar mais. O que conta é o custo por tarefa terminada e bem feita. Por isso convém medir o custo de cada mensagem em produção e fixar um limite mensal por agente. Na latência, mede o tempo até à primeira palavra e não apenas o total, sobretudo em voz.

Um método que dura

Guarda uma bateria de vinte ou trinta casos reais com a resposta esperada. Quando sair um modelo novo, corre-a, compara qualidade, custo e tempo com o atual e decide. Se mudar de modelo obriga a refazer o agente, o problema não é o modelo, é a arquitetura: o agente deve mudar de modelo com um ajuste, e convém ter um segundo modelo preparado para o caso de o primeiro falhar.

Voltar ao índice

05Atendimento

Voz de IA na hotelaria: o que funciona de noite e o que não funciona

· 2 min de leitura

Entre a meia-noite e o pequeno-almoço, a receção de muitos hotéis depende de uma só pessoa ou de ninguém. Uma rececionista de voz ajuda muito nalgumas coisas e nada noutras. Isto é o que aprendemos a preparar uma receção de demonstração.

O que funciona

  • As perguntas frequentes a qualquer hora: horário do pequeno-almoço, hora de saída, estacionamento, wifi ou como chegar. São a maioria das chamadas noturnas e têm resposta fixa.
  • Atender na língua do hóspede. Quem liga de madrugada de outro país agradece ser compreendido à primeira, e a receção de voz muda de língua sem mudar de número.
  • Tomar nota de pedidos: saída tardia, um berço, um táxi cedo. A IA não confirma o que não pode confirmar; deixa o pedido escrito, com quarto, hora e língua, para que a equipa da manhã o resolva logo à primeira hora.
  • Libertar o rececionista da noite, que pode atender quem está ao balcão.

O que não funciona e não deve ser tentado

  • As urgências. Um problema de saúde, um incêndio ou uma situação de segurança passam de imediato para uma pessoa ou para o 112. A IA não avalia nem tranquiliza nesses casos: transfere.
  • Os pagamentos por telefone. Nunca se pedem nem se ditam dados de cartão a uma voz de IA. Se for preciso pagar, envia-se uma ligação segura ou paga-se na receção.
  • Confirmar disponibilidade ou preços sem ligação ao motor de reservas. Se o sistema não vê o inventário real, diz que toma nota e que será confirmado; não inventa.
  • As reclamações delicadas. Um hóspede zangado de madrugada precisa de alguém que possa decidir uma compensação. A IA regista o caso e encaminha-o.

Três regras de desenho

Primeira: avisar desde o primeiro segundo que é uma rececionista de IA. O Regulamento Europeu da IA exige-o desde agosto de 2026 e, além disso, evita mal-entendidos. Segunda: deixar sempre uma saída para uma pessoa ou, se não houver ninguém, para um telefone de piquete. Terceira: medir. Cada chamada deve terminar numa ficha estruturada, com quem ligou, o que pediu, em que língua e em que estado fica, para que a equipa da manhã não tenha de ouvir gravações.

Bem pensada, a voz de IA não substitui a receção: cobre as horas em que ninguém atende e entrega o trabalho arrumado a quem chega de manhã.

Voltar ao índice

06Privacidade

Privacidade desde a conceção na avaliação de equipas

· 2 min de leitura

Se uma equipa teme o que a empresa vai ver dos seus ensaios, vai praticar menos e pior. A privacidade não trava a formação: é a condição para que funcione.

Consentimento pessoa a pessoa

Cada pessoa decide se partilha os seus resultados individuais com a empresa, e pode mudar de ideias. A pergunta é feita de forma clara, separada de outros avisos e sem consequências por dizer que não. Enquanto não houver consentimento, os resultados dessa pessoa não aparecem com o seu nome em nenhum relatório e, se o retirar, deixam de ser mostrados a partir desse momento.

É a aplicação direta do princípio da proteção de dados desde a conceção do RGPD (artigo 25.º): o privado é o ponto de partida e partilhar é uma decisão ativa.

Os grupos pequenos não se mostram

Um relatório agregado pode denunciar uma pessoa se o grupo for pequeno. Se uma equipa tem três membros e dois partilham as suas notas, a média revela a do terceiro. Por isso os grupos de três pessoas ou menos não se mostram nos consolidados, e quem não deu o seu consentimento só conta em totais que não permitem identificá-lo.

Os ensaios pessoais são privados

Há ensaios que só servem a quem os faz: preparar uma conversa difícil, uma negociação ou uma entrevista. Esses ensaios não chegam a nenhum painel da empresa. Se a pessoa quiser mostrá-los, decide ela. Quem sabe que o seu ensaio é privado atreve-se a praticar aquilo em que é mais fraco, que é justamente o que mais precisa.

O que se mede e o que não

Avalia-se a conversa, não a pessoa: o que foi dito, se a metodologia foi seguida e se os dados estavam corretos. Não se deduz como alguém se sente a partir da voz, algo que o Regulamento Europeu da IA proíbe no trabalho. E os critérios são públicos para quem é avaliado: ninguém deveria receber uma nota com regras que não conhece.

Lista de verificação

  • Finalidade escrita: para que se usam os resultados e para que não se usam.
  • Consentimento individual, revogável e registado.
  • Uma dimensão mínima de grupo em todos os relatórios agregados.
  • Acessos por função: o formador vê o que precisa para formar e a direção vê tendências.
  • Um prazo de conservação de gravações e transcrições, definido e aplicado.
  • O direito de cada pessoa a ver as suas próprias sessões.
Voltar ao índice

Se alguma destas peças descreve o teu caso, falemos.

Mostramos-te como o resolvemos na Fenix, com um caso parecido com o teu.