Tag: Common Crawl


  • Common Crawl AI-datasæt fjernes – to millioner nyhedsartikler forsvinder

    Common Crawl-datasættet står nu over for skærpet granskning, efter at rettighedshavere har presset på for at få fjernet mere end to millioner scrapede nyhedsartikler. Tiltaget markerer en af de mest betydningsfulde ophavsretsudfordringer i AI-træningsområdet til dato. Udviklere og store modelbyggere står derfor over for voksende pres for at undersøge, hvordan de indsamler data, og sikre…