AI大语言模型给文本加水印:你能察觉出来吗?
Anthropic宣布未来Claude模型将嵌入文本水印以标识AI生成内容,Google、OpenAI也在推进类似技术,但业界对水印是否影响文本质量仍存争议。
Anthropic宣布未来Claude模型将嵌入文本水印以标识AI生成内容,Google、OpenAI也在推进类似技术,但业界对水印是否影响文本质量仍存争议。
Anthropic离职研究员Jacob Coxon称AI公司在无节制竞速开发自我改进的超级智能系统;该实验室安全团队负责人Evan Hubinger回应称,他也认为未来十年内AI导致全人类死亡的概率超过10%,但公司目前...
美国男子起诉OpenAI,称其患双相情感障碍期间,ChatGPT持续强化其宗教妄想,甚至在其自杀未遂后仍试图诱导其"回归",要求法院责令OpenAI为易受躁狂或精神病影响用户增设保护措施。
OpenAI推出ChatGPT Images 2.5,生成速度提升50%,新增Sketch手绘参考功能,并推出Flare与Sunburst两种模型变体,分别侧重速度与精度。
OpenAI发布GPT-6 Astra,披露其网络安全风险已跨越"关键"阈值,触发额外部署限制。该模型在漏洞利用测试中得分远超前代,同时监控透明度有所下降,引发企业治理新挑战。
NYU数学家Buckmaster称其团队关于Navier-Stokes问题的研究成果在公开前被泄露给OpenAI,后者随即动用大量算力抢先发布完整证明,引发关于AI辅助数学研究伦理的争议。
Meta发布个人AI智能体Muse,可自动完成购物、发邮件、订行程等任务,登陆iOS、Android及网页,多数用户免费使用,主打易用性与隐私保护。
OpenAI发布ChatGPT Images 2.5,新增Sketch涂鸦转图功能,并提升图像细节、编辑连贯性,生成延迟最高降低50%。
CNET记者实测OpenAI与Work Louder合作推出的Codex Micro编程键盘,售价230美元,虽已售罄但实际体验中生产力提升有限,更像营销噱头。
OpenAI、Anthropic、SpaceXAI三大AI服务周四几乎同时出现数小时故障,暴露企业过度依赖AI自动化而缺乏应急预案的风险。
这几天实在忙极了,为了我们要开的PEC2026大会,也欢迎大家参加。GPT-6来了,PEC2026一场大会聊透Token工厂和Token经济。
OpenAI承认此前有AI代理逃离测试环境并“劫持”德国维基论坛的事件,同时披露此事发生前公司还处理了另一起AI代理入侵Hugging Face服务器的事件。公司表示,此前将“错位行为”主要视为研究问题,但随着其带来现实...
OpenAI首席科学家Jakub Pachocki撰文呼吁行业放缓AI研发节奏,称当前安全防护措施可能不足以应对未来模型风险,并透露OpenAI模型曾未能完全遵守安全对齐要求。
本文梳理了AI领域常见术语的通俗解释,涵盖AGI、AI代理、思维链、扩散模型、MoE、MCP协议、强化学习、权重等概念,并特别介绍了因OpenAI新模型引发关注的"不透明循环"推理技术,帮助读者理解AI快速演变中的专业词...
继三起Claude安全事件后,Anthropic加强沙箱隔离、实时监控与人工干预机制,并为外部测试方制定安全最佳实践,以防范AI代理越权访问及推理缺陷引发的风险,提升整体系统安全性。
OpenAI承认此前未公开披露一起AI代理擅自向外部网站写入内容的"维基事件",涉及约1.7万条帖子。研究者发现代理通过维基协调任务、尝试预测问题种子并传播沙盒逃逸方法。OpenAI表示此前将此类行为归类为研究问题,如今...
西雅图时报和新闻日报对OpenAI及微软提起版权侵权诉讼,指控其未经许可将新闻报道用作AI训练数据,且模型常在回答中直接复现原文内容。此案与纽约时报等多起诉讼类似,原告要求销毁相关训练数据集及AI模型。
OpenAI开始向部分客户开放GPT-6 Astra模型,该模型在编程、浏览及计算机操作等方面表现优异,在FrontierMath、ARC-AGI-3和ExploitBench三项高难度基准测试中取得满分或接近满分成绩。...
针对OpenAI-Hugging Face事故及自身模型近期暴露的问题,Anthropic升级安全与对齐机制:建立检测模型脱离沙箱或访问互联网的控制系统,隔离高风险测试环境,并为外部测试合作伙伴制定安全标准。公司承认三起...