The China Mail - IA generativa recorre a livros para crescer

USD -
AED 3.672999
AFN 63.000181
ALL 80.450377
AMD 363.439993
ANG 1.790365
AOA 917.999936
ARS 1515.594499
AUD 1.41985
AWG 1.8
AZN 1.704511
BAM 1.712962
BBD 2.013821
BDT 122.932477
BGN 1.683441
BHD 0.37695
BIF 3000
BMD 1
BND 1.277595
BOB 10.867156
BRL 5.168706
BSD 0.99986
BTN 95.678145
BWP 13.595481
BYN 3.027431
BYR 19600
BZD 2.01093
CAD 1.410403
CDF 2310.000597
CHF 0.824665
CLF 0.024397
CLP 963.329699
CNY 6.71135
CNH 6.711803
COP 3291.29
CRC 453.685538
CUC 1
CUP 26.5
CVE 97.249756
CZK 21.441303
DJF 177.71947
DKK 6.5683
DOP 59.450415
DZD 133.955972
EGP 51.401801
ERN 15
ETB 161.000393
EUR 0.87825
FJD 2.24975
FKP 0.750528
GBP 0.75515
GEL 2.615013
GGP 0.750528
GHS 11.584985
GIP 0.750528
GMD 73.999893
GNF 8750.000282
GTQ 7.63211
GYD 209.186734
HKD 7.84355
HNL 26.915006
HRK 6.619598
HTG 130.683635
HUF 320.940286
IDR 17857.65
ILS 3.03393
IMP 0.750528
INR 95.88465
IQD 1310.5
IRR 1374575.000035
ISK 121.230243
JEP 0.750528
JMD 157.538176
JOD 0.708974
JPY 158.319989
KES 129.46968
KGS 87.449797
KHR 4057.488949
KMF 433.000293
KPW 900.000318
KRW 1366.360157
KWD 0.30926
KYD 0.833209
KZT 444.620586
LAK 22424.999952
LBP 89550.000063
LKR 328.955608
LRD 172.824965
LSL 16.360113
LTL 2.95274
LVL 0.60489
LYD 6.375007
MAD 9.60075
MDL 17.695844
MGA 4399.999898
MKD 53.88149
MMK 2099.577364
MNT 3597.923561
MOP 8.077068
MRU 40.059762
MUR 47.880393
MVR 15.449698
MWK 1737.0003
MXN 17.527603
MYR 4.079715
MZN 63.90989
NAD 16.360284
NGN 1325.459859
NIO 36.659726
NOK 9.49177
NPR 153.084711
NZD 1.762816
OMR 0.384482
PAB 0.99986
PEN 3.377497
PGK 4.448503
PHP 62.810226
PKR 277.549763
PLN 3.844797
PYG 5925.912951
QAR 3.643053
RON 4.634397
RSD 103.282996
RUB 84.752647
RWF 1473
SAR 3.755068
SBD 8.000512
SCR 13.828601
SDG 601.498216
SEK 9.927485
SGD 1.27991
SHP 0.755002
SLE 24.650247
SLL 20969.491881
SOS 571.500781
SRD 37.822499
STD 20697.981008
STN 21.675
SVC 8.748774
SYP 13002.000254
SZL 16.359782
THB 33.41019
TJS 9.253737
TMT 3.51
TND 2.948497
TOP 2.40776
TRY 48.827403
TTD 6.795649
TWD 31.834205
TZS 2649.998016
UAH 44.878367
UGX 3889.609025
UYU 40.078651
UZS 11837.49757
VES 852.43145
VND 26010.5
VUV 118.348377
WST 2.752527
XAF 576.094155
XAG 0.015517
XAU 0.000233
XCD 2.70255
XCG 1.801955
XDR 0.707052
XOF 576.094155
XPF 105.206766
YER 236.649909
ZAR 16.326978
ZMK 9001.195448
ZMW 19.472654
ZWL 321.999592
SSP 5712.590503
MXV 1.986512
IA generativa recorre a livros para crescer
IA generativa recorre a livros para crescer / foto: © AFP

IA generativa recorre a livros para crescer

Para expandir o negócio dos direitos autorais, o mundo editorial começa a assinar contratos com empresas de tecnologia para permitir que os seus livros alimentem as necessidades crescentes da inteligência artificial generativa.

Tamanho do texto:

A grande editora americana HarperCollins acaba de propor a alguns dos seus autores um contrato com uma sociedade de inteligência artificial para que esta possa usar os seus livros para treinar o seu modelo de IA generativa.

Em um e-mail consultado pela AFP, a empresa tecnológica, cuja identidade é confidencial, propõe 2.500 dólares (14.530 reais) por cada livro selecionado para treinar o seu modelo de linguagem durante um período de três anos.

Para produzir todos os tipos de conteúdo, esta tecnologia precisa ser alimentada continuamente com uma grande quantidade de dados.

Contactada pela AFP, a editora confirmou a operação.

"A HarperCollins fechou um acordo com uma empresa de tecnologia de inteligência artificial para autorizar o uso limitado de determinados títulos (…) para treinar modelos de IA, a fim de melhorar sua qualidade e desempenho", escreveu.

A editora especificou que o acordo "limita claramente a produção de modelos que respeitem os direitos autorais".

A oferta gerou opiniões divergentes no setor e escritores como o americano Daniel Kibblesmith rejeitaram-na categoricamente.

"Provavelmente faria isso por um bilhão de dólares. Faria isso por uma quantia de dinheiro que não me obrigaria a trabalhar mais, porque esse é o objetivo final desta tecnologia", publicou na rede social Bluesky.

- Novos materiais -

A HarperCollins é um dos maiores atores do setor a dar esse passo, mas não o primeiro.

A editora americana de livros científicos Wiley deu acesso "ao conteúdo de livros acadêmicos e profissionais publicados para uso específico na formação desses modelos por 23 milhões de dólares (133 milhões de reais) a uma grande empresa de tecnologia", disse a companhia em março durante a apresentação de seus resultados financeiros.

Este tipo de colaboração evidencia os problemas ligados ao desenvolvimento da inteligência artificial generativa, treinada com enormes quantidades de dados recolhidos na Internet, o que pode resultar em possíveis violações de direitos autorais.

Para Giada Pistilli, chefe de ética da Hugging Face, plataforma franco-americana de IA de acesso livre, o anúncio é um avanço, porque o conteúdo dos livros passa a ser monetizado. Mas lamenta a margem de negociação limitada para os autores.

"O que veremos é um mecanismo de acordos bilaterais entre empresas de novas tecnologias e editoras ou proprietários de direitos autorais, quando na minha opinião seria necessário um diálogo mais amplo para incluir todas as partes envolvidas", afirma.

"Viemos de muito longe", comenta Julien Chouraqui, diretor jurídico do sindicato editorial francês SNE. "É um progresso: o fato de haver um acordo significa que houve um diálogo e uma vontade de alcançar um equilíbrio no uso de dados de origem que estão protegidos por direitos autorais e que vão gerar valor", afirma.

Os editores de imprensa também estão se organizando para enfrentar esse problema. No final de 2023, o jornal americano The New York Times processou a OpenAI, criadora do programa ChatGPT, e a Microsoft, sua principal investidora, por violação de direitos autorais.

Outros veículos de comunicação optaram por fechar acordos com esta empresa pioneira em IA.

As empresas de tecnologia podem não ter outra opção senão investir a fundo para melhorar os seus produtos, já que suas bases de dados e materiais para treinar os seus modelos estão esgotando.

A imprensa americana publicou recentemente que os novos modelos em desenvolvimento dão sinais de ter atingido o seu limite, especialmente no Google, Anthropic e OpenAI.

"Na Internet, você coleta material lícito e ilícito e muito conteúdo pirateado. Isso implica um problema jurídico. Sem esquecer o problema da qualidade dos dados", afirma Julien Chouraqui, do SNE.

"Para que o desenvolvimento de um mercado seja alcançado sobre uma base virtuosa, todos os atores devem estar envolvidos", destaca.

I.Ko--ThChM