{主关键词}

一 | Singer Jimmy Buffett, who died Friday at the age of 76, battled skin cancer for years before his death, according to a statement on his website.Buffet suffered from Merkel cell cancer, which he was diagnosed with four years before his death, his website said. Merkel cell cancer is very rare, according to the National Cancer Institute. Risk factors include sun exposure, having a weak immune system and being older than 50. It tends to grow quickly and spread at an early stage to nearby lymph nodes and then to lymph nodes or skin in other parts of the body, including the lungs, brain, bones and other organs. Buffet continued to perform during his treatment. His last show was a surprise appearance in Rhode Island in early July, according to his website. In 2022, Buffett rescheduled tour dates because of health issues and a "brief hospitalization." Those tour dates were meant to take place at the end of 2022 and were rescheduled for 2023. In May, he canceled a South Carolina concert after being hospitalized.

二 | 英国“City AM”网站7月29日报道,伦敦一家珍本书商收到两笔来自匿名邮箱的异常大额专业书籍询价,买家拒绝透露身份和用途。

三 | 欧洲大陆的古董书商还报告了数千册冷门书的匿名订单。报道将这场抢购称为“反乌托邦式”的搜寻。

四 | 匿名买家很快露出踪迹。

五 | 8月17日,“404 Media”刊出追踪调查表明,货物最终被送入亚马逊拉斯维加斯LAS8仓库代号VGT3的区域,而该区域的徽标是一只抓着书的霸王龙。亚马逊员工在内部论坛证实,VGT3的工作就是切书脊、高速扫描并销毁实体书。亚马逊确认其通过商业渠道购书以开发和改进产品与服务,但未明确这批书的具体用途。 模型崩溃阴影下的选择 AI公司为何对旧书如此饥渴?2024年7月24日,《自然》杂志在线发表论文认为,模型反复在上一代模型生成的数据上训练,会发生模型崩溃。

六 | 一开始,那些不常见、属于少数派的内容会先消失;到最后,模型输出的东西会越来越单一,只剩单调的模式。保留一定比例的真实人类数据可以缓解“崩溃”,不过,真实人类数据正变得越来越稀缺。 提供搜索引擎优化的新加坡软件公司Ahrefs,在2025年4月分析90万个新建英文网页时,发现74.2%含AI生成内容,其中绝大部分为人机混合,纯AI生成占2.5%;AI代码审查公司Graphite研究则显示,2024年11月AI生成文章数量首次超过人类撰写的文章,此后占比稳定在五成左右。 人们立刻注意到,在2022年ChatGPT发布之前出版的图书,天然不含AI文本——这正是ISBNdb所谓“保证”的含义。 这些书籍的价值还不止于“干净”。Anthropic一位联合创始人曾表示,公司内部认为书籍能教模型“如何写好”,而非低质量的网络腔。ISBNdb的兜售话术更直白:“世界上最好的AI训练数据就在书架上……书籍代表经过策展、同行评审、特定领域的人类知识。

七 | ” 在美国现行版权法框架下,这套操作甚至被法院认为合法:买下实体书意味着合法取得,扫描后销毁是一对一替换,不产生额外数字副本,美国法律下近乎无懈可击。但这只是版权意义上的合规,无法回答另一个问题:大量实体书被永久销毁,是否意味着人类公共知识财富的不可逆流失? 合法使用与文化代价之争 美国法律基本倾向AI公司一侧。上文提到的“巴茨诉Anthropic案”中,美国加州北区联邦法院法官于2025年6月裁定AI公司扫描毁书不违法,但从提供免费电子书的LibGen网站及其他盗版渠道下载700余万册图书,不构成合理使用。

八 | 2025年9月,Anthropic就盗版部分达成至少15亿美元和解,每部作品约3000美元。该和解于2026年7月20日获法院最终批准,最终确定的作品清单约48.2万部。这一裁决也等于为“Project Panama”式操作颁发了通行证。 非议随之从版权溢出到文化领域。被销毁的书里有没有存世稀少的珍本?目前虽未被核实,但有书商担忧,一些流传极少的书籍可能在匿名大宗采购中悄然消失。问题的核心在于:毁书是不可逆的,对文献学而言,毁掉的就是实物。而在法律层面,AI公司依然可以声称其合法购得的文献,处置权也属于买家。文化保护的诉求与财产权的行使只能继续碰撞。 正是在这样的真空地带,争议持续发酵。美国国会没有专门针对AI训练数据版权的统一立法,靠判例逐案划定边界,“合法购得即可销毁”的裁决客观上为毁书打开了方便之门,也为日后的声讨与诉讼埋下伏笔。 与之相对,我国早在2023年8月15日就施行《生成式人工智能服务管理暂行办法》,第七条明确要求训练数据来源合法、不得侵害知识产权,并要求增强数据的真实性、准确性、客观性、多样性。 把规则立在产业狂奔之前,让规范引导技术发展与权益保护并行。当数百万本旧书在大洋彼岸被切碎之时,制度先行的价值正愈发清晰。(记者 张梦然)。
Current article:http://u6qc6x.cesangrangshunzashuangruijiu.pics/list_2b5gaq/omsed6h.html
Published on:20:14:21
我的网站热门国内