The Fort Worth Press - La diversidad del español, enloquecedora para la inteligencia artificial

USD -
AED 3.672503
AFN 65.501385
ALL 80.67799
AMD 366.015789
AOA 916.999757
ARS 1498.3668
AUD 1.418188
AWG 1.8
AZN 1.673275
BAM 1.693927
BBD 2.01578
BDT 123.66241
BHD 0.37746
BIF 2989.511247
BMD 1
BND 1.280737
BOB 11.909804
BRL 5.109035
BSD 1.000788
BTN 95.326229
BWP 13.483
BYN 2.975429
BYR 19600
BZD 2.012836
CAD 1.393404
CDF 2270.487483
CHF 0.81128
CLF 0.023253
CLP 915.169712
CNY 6.747602
CNH 6.747502
COP 3140.65
CRC 454.372228
CUC 1
CUP 26.5
CVE 95.50102
CZK 21.025701
DJF 178.218336
DKK 6.481301
DOP 58.351233
DZD 132.831209
EGP 50.298596
ERN 15
ETB 161.835245
EUR 0.866977
FJD 2.21245
FKP 0.739377
GBP 0.74075
GEL 2.609874
GGP 0.739377
GHS 11.749575
GIP 0.739377
GMD 73.497167
GNF 8789.343311
GTQ 7.636312
GYD 209.597305
HKD 7.84656
HNL 26.827536
HRK 6.531035
HTG 130.862572
HUF 317.162008
IDR 17844
ILS 3.00392
IMP 0.739377
INR 95.41795
IQD 1311.10909
IRR 1374725.000003
ISK 123.300461
JEP 0.739377
JMD 158.943667
JOD 0.708993
JPY 159.377503
KES 129.369732
KGS 87.450343
KHR 4057.787748
KMF 425.999917
KRW 1417.302223
KWD 0.309029
KYD 0.834059
KZT 466.596512
LAK 22602.730828
LBP 89623.502715
LKR 335.424976
LRD 180.637171
LSL 16.19373
LTL 2.95274
LVL 0.60489
LYD 6.377994
MAD 9.332883
MDL 17.394053
MGA 4286.462867
MKD 53.287083
MMK 2099.437721
MNT 3594.800745
MOP 8.087684
MRU 40.143431
MUR 47.040143
MVR 15.45009
MWK 1735.458809
MXN 17.1494
MYR 4.0923
MZN 63.905001
NAD 16.19373
NGN 1362.459921
NIO 36.827564
NOK 9.47625
NPR 152.5317
NZD 1.703325
OMR 0.384501
PAB 1.000784
PEN 3.380579
PGK 4.425005
PHP 61.271498
PKR 277.852831
PLN 3.72784
PYG 5957.092994
QAR 3.648379
RON 4.544101
RSD 101.747982
RUB 81.99785
RWF 1470.257068
SAR 3.745256
SBD 8.065696
SCR 13.702941
SDG 600.498776
SEK 9.51179
SGD 1.281205
SLE 24.59346
SOS 571.992794
SRD 37.750497
STD 20697.981008
STN 21.219929
SVC 8.757183
SZL 16.191029
THB 33.157503
TJS 9.242228
TMT 3.51
TND 2.933756
TRY 47.739901
TTD 6.788528
TWD 32.278502
TZS 2649.998042
UAH 44.895264
UGX 3727.714047
UYU 40.316993
UZS 11941.84974
VES 755.7624
VND 26136.5
VUV 118.84778
WST 2.733733
XAF 568.142114
XAG 0.015455
XAU 0.000229
XCD 2.70255
XCG 1.803749
XDR 0.706586
XOF 568.129812
XPF 103.29163
YER 238.402149
ZAR 16.25083
ZMK 9001.197483
ZMW 18.720065
ZWL 321.999592
La diversidad del español, enloquecedora para la inteligencia artificial
La diversidad del español, enloquecedora para la inteligencia artificial / Foto: © AFP/Archivos

La diversidad del español, enloquecedora para la inteligencia artificial

La inteligencia artificial necesitará mucho alimento para que todo hablante del español se pueda dirigir a ella con naturalidad, teniendo en cuenta sus 21 variedades nacionales, acentos, subacentos y jergas como la gaditana o el lunfardo.

Tamaño del texto:

Uno de los temas centrales del IX Congreso Internacional de la Lengua Española (CILE) que se celebra en la ciudad andaluza de Cádiz del lunes al jueves es la inteligencia artificial, y el acto inaugural dejó un momento que da una idea del trecho que tienen que recorrer las máquinas.

Fue cuando el alcalde de la ciudad anfitriona, José María González Santos, más conocido como Kichi, le deseó a los participantes que lo pasen bien, en pura habla gaditana.

"Señoras y señores, estén al 'liquindoi', aprovechen 'la collá' y la 'conviá', disfruten del 'tangai', para que cuando les toque 'guannajarse' puedan decir con orgullo que este congreso ha sido un 'bastinazo'", lanzó Kichi.

Pues bien, esto es lo que transcribió uno de los programas más populares del mundo: "señoras y señores, China lindo y aproveche la ***** y la cumbia y disfruten del tangai para que cuando les toque guardarse puedan decir con orgullo que este congreso ha sido un partidazo".

Esto, explicó a la AFP Virginia Bertolotti, lingüista uruguaya, "es una muestra de que si alimentamos las inteligencias artificiales con algo que es relativamente plano, como es internet, hay cosas que hacen muy bien, pero hay cosas que no pueden hacer".

"Si yo le digo 'hazme un diálogo entre gauchos del siglo XIX', hace cualquier cosa", sostuvo esta catedrática de la Universidad de la República, miembro de la Academia de Letras de Uruguay.

- Correctores incorrectos -

La inteligencia artificial es la "disciplina científica que se ocupa de crear programas informáticos que ejecutan operaciones comparables a las que realiza la mente humana", según la definición de la Real Academia de la Lengua (RAE), que la eligió palabra del año en 2022.

Es un campo con mucho en juego, indicó el ministro español de Asuntos Exteriores, José Manuel Albares, cuando advirtió que hay que "posicionar el español en el núcleo central de la Inteligencia Artificial (IA), en el metaverso".

Muchos de los inventos de esta nueva disciplina son ya de uso común, como los correctores, los traductores, o los redactores o "chatbots".

El problema de estas herramientas, advirtió el director de la Real Academia de la Lengua, Santiago Muñoz Machado, es que estos instrumentos "no usan el canon panhispánico de la lengua, sino el canon de Silicón Valley".

"Hemos advertido en la Academia que lo que nos corrige ese corrector, normalmente no es correcto, y no son juegos de palabras, es exactamente así", ahondó.

El remedio, explicó Bertolotti, sería "sofisticar" la gran cantidad de datos que la inteligencia artificial barre de internet, mediante "muchos materiales que son pequeños corpus de especialidades, que hemos ido trabajando en investigación lingüística".

"El habla de la calle, el habla cotidiana, en el caso del español, que es una lengua de mucho espesor cultural, con una gran distribución geográfica, no necesariamente está capturado por el tipo de datos que se suelen utilizar para entrenar a las inteligencias artificiales", argumentó la lingüista.

- El problema de la lista de la compra -

Asunción Gómez-Pérez, miembro de la RAE y asesora en inteligencia artificial del gobierno de España, cree que podría acabar dándose el caso de que unas variantes del español acaben siendo más dominantes que otras en la inteligencia artificial.

"Los modelos del lenguaje que estamos utilizando ahora se nutren de grandes cantidades de textos que han sido escritos por personas las cuales pertenecen a ciertos países y utilizan cierto vocabulario", explicó a la AFP.

"Cuantos más textos haya de una variante, más posibilidades tiene esa variedad de ser la aceptada", concluyó Gómez-Pérez.

Si acaba siendo el caso, esas avanzadillas domésticas de la inteligencia artificial que son Siri y Alexa sufrirán para entender que cuando se les pide que incluyan en la lista del supermercado ejotes, agujas, chauchas, frijoles verdes, navajitas o judías verdes, se les está pidiendo exactamente lo mismo.

A.Nunez--TFWP