TaLTaC_2 è composto da un insieme di strumenti che consentono lo studio di qualsiasi tipo di dati di natura linguistica, raccolti in forma di collezione di testi come un unico Corpus, utilizzando le tecniche della statistica testuale (*). Questo approccio consente di studiare informazioni non strutturate presenti in una base documentale di ampie dimensioni (centinaia o migliaia di pagine, o file anche di 100MB), unitamente a informazioni strutturate (variabili quantitative o qualitative) contenute in un database ad essa associato