The China Mail - IA generativa recorre a livros para crescer

USD -
AED 3.672504
AFN 66.503991
ALL 80.629676
AMD 365.091035
AOA 917.000367
ARS 1491.937897
AUD 1.417435
AWG 1.80125
AZN 1.70397
BAM 1.691649
BBD 2.00813
BDT 123.418242
BHD 0.375989
BIF 2985.079791
BMD 1
BND 1.277602
BOB 11.849673
BRL 5.083304
BSD 0.997016
BTN 94.875232
BWP 13.457596
BYN 2.968819
BYR 19600
BZD 2.00519
CAD 1.39545
CDF 2262.50392
CHF 0.80949
CLF 0.023206
CLP 913.315746
CNY 6.747604
CNH 6.743285
COP 3142.844787
CRC 453.228387
CUC 1
CUP 26.5
CVE 95.372573
CZK 20.982104
DJF 177.546166
DKK 6.46804
DOP 58.20179
DZD 132.308956
EGP 49.631449
ERN 15
ETB 160.923669
EUR 0.86495
FJD 2.20855
FKP 0.740916
GBP 0.742583
GEL 2.610391
GGP 0.740916
GHS 11.700039
GIP 0.740916
GMD 73.503851
GNF 8756.649224
GTQ 7.607144
GYD 208.588851
HKD 7.842304
HNL 26.723176
HRK 6.518804
HTG 130.363707
HUF 314.060388
IDR 17801
ILS 2.99985
IMP 0.740916
INR 95.210504
IQD 1306.058902
IRR 1375550.000352
ISK 123.340386
JEP 0.740916
JMD 158.335856
JOD 0.70904
JPY 157.80604
KES 129.014401
KGS 87.450384
KHR 4049.647537
KMF 426.00035
KRW 1407.860383
KWD 0.30866
KYD 0.830861
KZT 467.275008
LAK 22510.919863
LBP 89282.792025
LKR 334.420274
LRD 179.959348
LSL 16.197552
LTL 2.95274
LVL 0.60489
LYD 6.341738
MAD 9.29222
MDL 17.337716
MGA 4254.638239
MKD 53.215413
MMK 2099.750695
MNT 3597.347644
MOP 8.056654
MRU 40.080439
MUR 47.070378
MVR 15.450378
MWK 1728.841413
MXN 17.13645
MYR 4.090104
MZN 63.905039
NAD 16.197552
NGN 1364.860377
NIO 36.690741
NOK 9.51237
NPR 151.800372
NZD 1.701115
OMR 0.382693
PAB 0.997016
PEN 3.376465
PGK 4.406003
PHP 60.705038
PKR 276.796523
PLN 3.719205
PYG 5928.296501
QAR 3.644596
RON 4.536304
RSD 101.492021
RUB 81.598409
RWF 1466.072741
SAR 3.744756
SBD 8.065696
SCR 14.449077
SDG 600.503676
SEK 9.480804
SGD 1.278038
SLE 24.603667
SOS 569.822255
SRD 37.866504
STD 20697.981008
STN 21.191022
SVC 8.723782
SZL 16.194265
THB 33.050369
TJS 9.197509
TMT 3.51
TND 2.929032
TRY 47.697504
TTD 6.757774
TWD 32.250604
TZS 2639.622886
UAH 44.653894
UGX 3714.050945
UYU 40.133201
UZS 11924.058297
VES 755.762404
VND 26204.5
VUV 119.414824
WST 2.733661
XAF 567.363231
XAG 0.015731
XAU 0.00023
XCD 2.70255
XCG 1.796912
XDR 0.705618
XOF 567.363231
XPF 103.152705
YER 238.403589
ZAR 16.14632
ZMK 9001.203584
ZMW 18.818492
ZWL 321.999592
IA generativa recorre a livros para crescer
IA generativa recorre a livros para crescer / foto: © AFP

IA generativa recorre a livros para crescer

Para expandir o negócio dos direitos autorais, o mundo editorial começa a assinar contratos com empresas de tecnologia para permitir que os seus livros alimentem as necessidades crescentes da inteligência artificial generativa.

Tamanho do texto:

A grande editora americana HarperCollins acaba de propor a alguns dos seus autores um contrato com uma sociedade de inteligência artificial para que esta possa usar os seus livros para treinar o seu modelo de IA generativa.

Em um e-mail consultado pela AFP, a empresa tecnológica, cuja identidade é confidencial, propõe 2.500 dólares (14.530 reais) por cada livro selecionado para treinar o seu modelo de linguagem durante um período de três anos.

Para produzir todos os tipos de conteúdo, esta tecnologia precisa ser alimentada continuamente com uma grande quantidade de dados.

Contactada pela AFP, a editora confirmou a operação.

"A HarperCollins fechou um acordo com uma empresa de tecnologia de inteligência artificial para autorizar o uso limitado de determinados títulos (…) para treinar modelos de IA, a fim de melhorar sua qualidade e desempenho", escreveu.

A editora especificou que o acordo "limita claramente a produção de modelos que respeitem os direitos autorais".

A oferta gerou opiniões divergentes no setor e escritores como o americano Daniel Kibblesmith rejeitaram-na categoricamente.

"Provavelmente faria isso por um bilhão de dólares. Faria isso por uma quantia de dinheiro que não me obrigaria a trabalhar mais, porque esse é o objetivo final desta tecnologia", publicou na rede social Bluesky.

- Novos materiais -

A HarperCollins é um dos maiores atores do setor a dar esse passo, mas não o primeiro.

A editora americana de livros científicos Wiley deu acesso "ao conteúdo de livros acadêmicos e profissionais publicados para uso específico na formação desses modelos por 23 milhões de dólares (133 milhões de reais) a uma grande empresa de tecnologia", disse a companhia em março durante a apresentação de seus resultados financeiros.

Este tipo de colaboração evidencia os problemas ligados ao desenvolvimento da inteligência artificial generativa, treinada com enormes quantidades de dados recolhidos na Internet, o que pode resultar em possíveis violações de direitos autorais.

Para Giada Pistilli, chefe de ética da Hugging Face, plataforma franco-americana de IA de acesso livre, o anúncio é um avanço, porque o conteúdo dos livros passa a ser monetizado. Mas lamenta a margem de negociação limitada para os autores.

"O que veremos é um mecanismo de acordos bilaterais entre empresas de novas tecnologias e editoras ou proprietários de direitos autorais, quando na minha opinião seria necessário um diálogo mais amplo para incluir todas as partes envolvidas", afirma.

"Viemos de muito longe", comenta Julien Chouraqui, diretor jurídico do sindicato editorial francês SNE. "É um progresso: o fato de haver um acordo significa que houve um diálogo e uma vontade de alcançar um equilíbrio no uso de dados de origem que estão protegidos por direitos autorais e que vão gerar valor", afirma.

Os editores de imprensa também estão se organizando para enfrentar esse problema. No final de 2023, o jornal americano The New York Times processou a OpenAI, criadora do programa ChatGPT, e a Microsoft, sua principal investidora, por violação de direitos autorais.

Outros veículos de comunicação optaram por fechar acordos com esta empresa pioneira em IA.

As empresas de tecnologia podem não ter outra opção senão investir a fundo para melhorar os seus produtos, já que suas bases de dados e materiais para treinar os seus modelos estão esgotando.

A imprensa americana publicou recentemente que os novos modelos em desenvolvimento dão sinais de ter atingido o seu limite, especialmente no Google, Anthropic e OpenAI.

"Na Internet, você coleta material lícito e ilícito e muito conteúdo pirateado. Isso implica um problema jurídico. Sem esquecer o problema da qualidade dos dados", afirma Julien Chouraqui, do SNE.

"Para que o desenvolvimento de um mercado seja alcançado sobre uma base virtuosa, todos os atores devem estar envolvidos", destaca.

I.Ko--ThChM