Vai al contenuto
Federico MeiniSistemi real-time, agenti AI e altro
  • Servizi
  • Progetti
  • Blog
  • Chi sono
EN
  • Servizi
  • Progetti
  • Blog
  • Chi sono
  • Contatti
Lavoriamo insieme→(si apre in una nuova scheda)
← Tutti gli articoli

#llm-evals

  • 16 set 2026

    Testare un agent di triage medico con LangWatch Scenario e pytest

    Come testo un agent AI di triage medico con LangWatch Scenario: utente simulato, criteri per il judge, conversazioni libere o a copione, in pytest e in CI.

    8 min di lettura#ai-agents#llm-evals#python

    →
  • 14 lug 2026

    Progettare agenti AI che sanno quando passare la mano: ad altri agenti, alle regole, alle persone

    Un’architettura pratica per agenti AI con handover sicuro: passaggi tra agenti, motore di regole deterministico per decisioni critiche, tool in sandbox ed eval.

    9 min di lettura#ai-agents#multi-agent#guardrails

    →
  • 30 giu 2026

    Eval con simulazioni: far interpretare l’utente a un LLM per testare il tuo chatbot prima degli utenti reali

    Come costruire eval con simulazioni per chatbot LLM: utenti simulati con persona, rubriche LLM-as-judge, tassi di errore nei flussi critici e ciclo di feedback.

    9 min di lettura#ai-agents#llm-evals#llm-as-judge

    →

Disponibile per progetti freelance

Hai un sistema che deve scalare, o un agente di cui ti devi poter fidare?

Parliamone →(si apre in una nuova scheda)Come lavoro

Servizi

  • WhatsApp Business Platform
  • Sistemi real-time
  • PostgreSQL ed Elasticsearch
  • Agenti AI ed eval
  • Agentic coding

Sito

  • Progetti selezionati
  • Blog
  • Chi sono
  • Contatti

Altrove

  • GitHub
  • LinkedIn
  • Email
  • RSS

Per le macchine

  • llms.txt
  • llms-full.txt
  • Sitemap
© 2026 Federico Meini · P.IVA IT01966540492Niente cookie. HTML statico, analytics senza cookie.