Models fundacionals
Un model fundacional, o model de base, és un model d'inteligència artificial entrenat en una gran cantitat de senyes de diferents dominis no etiquetats (generalment per mig d'aprenentage autosupervisado) que dona com resultat un model que es pot adaptar a una àmplia gama de tasques .[1][2] Els models fundacionals han transformat el desenroll dels sistemes de IA des de la seua introducció en 2018. Els primers eixemples de models fundacionals varen ser grans models de llenguage pre-entrenats tals com BERT i GPT-3 . Usant les mateixes idees, s'han construït models específics de domini que usen seqüències d'atres tipos de tokens, com a còdics mèdics.[3] Posteriorment, s'han produït models fundacionals multimodales, inclosos DALL-E, Flamingo,[4] i Florence. El Centre d'Investigació de Models Fundacionals (CRFM) del Institute for Human-Centered Artificial Intelligence de l'Universitat de Stanford (HAI) va popularisar el terme.[1]
Definicions
[editar | editar còdic]El Centre d'Investigació sobre Models Fundacionals (CRFM) de l'Institut d'Inteligència Artificial Centrada en el Ser Humà (HAI) de l'Universitat de Stanford va falcar el terme «modele fundacional» en agost de 2021[5] per a referir-se a «qualsevol model que s'entrene en un conjunt de senyes multidominio de gran escala (generalment per mig d'entrenament autosupervisado) que puga adaptar-se (afinarse) a una àmplia gama de tasques. Es va optar pel terme «modele fundacional» en lloc de «model fonamental» per a donar a entendre que estos són com el "fonament" per a models específics i no són, explicitamente, font de principis fonamentals donat el seu caràcter emergent i incomplet.
A mida que els governs regulen els models fundacionals, han sorgit noves definicions llegals.
- En Estats Units, l'Orde Eixecutiva sobre el Desenroll i Us Segur i Confiable de l'Inteligència Artificial ho definix com «un model de IA que s'entrena en gran cantitat de senyes; generalment usant la autosupervisión; conté a lo manco decenes de mils de millons de paràmetros i és aplicable en una àmplia gama de contexts».[6]
- En l'Unió Europea, lel Reglament sobre Inteligència Artificial ho definix com un «model de IA que s'entrena en senyes de varis dominis a gran escala, està dissenyat per a la generalisació dels resultats i pot adaptar-se a una àmplia gama de tasques».[7]
- En el Regne Unit, l'informe AI Foundation Models: Initial Report [8] ho definix com «un tipo de tecnologia de IA que s'entrena en grans cantitats de senyes i que pot adaptar-se a una àmplia gama de tasques i operacions.»
Referències
[editar | editar còdic]- ↑ 1,0 1,1 «Introducing the Center for Research on Foundation Models (CRFM)». Stanford HAI. Consultat el 2022-06-11.
- ↑ Goldman. «Foundation models: 2022’s AI paradigm shift» (en en-us). VentureBeat. Consultat el 2022-10-24.
- ↑ Journal of Biomedical Informatics.113
- 103637.ISSN 1532-0480.doi:10.1016/j.jbi.2020.103637.
- ↑ Erro en la seqüencia d'órdens: no existix el mòdul «Citas».
- ↑ «Introducing the Center for Research on Foundation Models (CRFM)».
- ↑ «Executive Order on the Safe, Secure, and Trustworthy Development and Use of Artificial Intelligence».
- ↑ «Reglamente sobre Inteligència Artificial de l'Unió Europea».
- ↑ Competition and Markets Authority. «AI Foundation Models: Initial Report.».
Referències
[editar | editar còdic]
- Este artícul conté una traducció derivada de «Modelos fundacionales» de Wikipedia en castellà publicada baix la Llicència de documentació lliure de GNU i la Llicència Creative Commons Reconeiximent-CompartirIgual 4.0 Internacional.