Els agents d'IA són sistemes capaços de planificar i executar tasques de diversos passos per assolir un objectiu, sense necessitat de supervisió humana en cada acció. A diferència d'un model de llenguatge que només respon a una consulta, un agent decideix què fer, en quin ordre i quines eines utilitzar per aconseguir-ho.
El seu funcionament se sol basar en tres capacitats clau:
- Raonament: descomponen un objectiu complex en subtasques gestionables.
- Ús d'eines: invoquen APIs, cercadors, bases de dades o executen codi.
- Memòria: conserven el context entre passos per mantenir la coherència.
Importen perquè amplien l'abast de la IA des de la simple generació de text cap a l'acció autònoma, fet que permet automatitzar fluxos de treball sencers. Un exemple pràctic seria un agent que rep l'encàrrec d'organitzar un viatge: busca vols, compara preus, reserva allotjament i elabora un itinerari, encadenant decisions pel seu compte. El matís rellevant és que aquesta autonomia també introdueix riscos d'errors acumulats, per la qual cosa convé definir límits i punts de control.