Notícias
89 notícias
qm: o que muda na prática — e o que ainda precisa ser provado
Quando vários funcionários e departamentos usam agentes, memória, credenciais, arquivos e permissões tendem a se misturar. QM cria isolamento por pessoa e espaço colaborativo, administração central, skills compartilháveis…
Agentes decidem sem trilha auditável — e o grafo tenta provar o porquê
A Saraiva.AI apurou o que a Semantica entrega de fato — infraestrutura MIT graph-native com knowledge graph, proveniência W3C PROV-O, memória compartilhada e decisão como objeto de primeira…
Agentes entregam UI que funciona e ainda falha no acabamento
Auditor determinístico e read-only para React/shadcn executa 60 checks, gera score 0–100 com evidência, separa fixes, decisions e advisories e integra CI; a apuração revela o fluxo de…
Agentes ganham controle, mas segurança ainda exige prova
A Corsair reúne integrações open source, OAuth, credenciais cifradas, permissões por operação, aprovações humanas, webhooks e isolamento multi-tenant para agentes agirem sem receber chaves brutas. A análise aponta…
Agentes longos acertam a tarefa errada e fecham mal a sessão
A coleção MIT khazix-skills estrutura padrões leader e neat-freak para Claude Code, Codex e outros agentes; a Saraiva.AI avalia Goal Contract e Closeout Contract como pré e pós-flight,…
Agentes podem falhar em silêncio, e o iFixAi quer expor isso
Ferramenta independente audita agentes de IA com inspeções adversariais e operacionais, nota de A a F e scorecard; a Saraiva.AI decidiu transformá-la em produto, mas alerta para custos,…
Agentes travam em tarefas longas, e este harness entra em teste
O LongHorizon-Harness propõe separar planejamento, execução e auditoria para manter objetivos e progresso verificado em tarefas de desktop e CLI; a Saraiva.AI decidiu testá-lo, mas aponta limites de…
Agentlas-OS promete portabilidade, mas ainda enfrenta prova decisiva
Sistema local-first propõe criar, empacotar, rotear, executar e verificar agentes portáveis entre runtimes; Saraiva.AI recomenda teste, com auditoria de scripts, permissões e dependência do Agent Cloud em foco.
Airi avança, mas ainda precisa provar uso empresarial
A plataforma self-hosted reúne personagem digital, voz em tempo real, avatar, memória, plugins e ferramentas; a versão 0.10.x amplia Computer Use, mas há riscos, custos e recursos experimentais.
Anydoc entra no radar, mas OCR ainda é limite
Biblioteca Rust local-first converte documentos empresariais em Markdown para LLMs, com bindings multiplataforma e Agent Skill; Saraiva.AI decidiu testar a ferramenta, enquanto avalia limites de OCR, dependência externa…
Busca de emprego com IA avança, mas resultados ainda exigem prova
O ai-job-search organiza pesquisa de vagas, ranking, currículo, cartas, checagem ATS e entrevistas em Claude Code, mas seus conectores são dinamarqueses e o desempenho divulgado é autorrelato.
Buzz promete organizar agentes, mas ainda carrega riscos
A plataforma reúne humanos, agentes, workflows, repositórios e eventos sob protocolo, identidade e log comuns, com desktop, relay, CLI JSON, ACP, YAML, Git e auditoria; a Saraiva.AI recomenda…