AI安全
共 30 篇文章
OpenAI合作心理健康专家提升ChatGPT敏感对话安全性,减少不安全响应达80%
OpenAI与超过170名心理健康专家合作,旨在提升ChatGPT识别用户心理痛苦并提供安全回应的能力。过去版本的模型在敏感话题上可能生成高达40%的不安全建议,通过专家反馈和微调技术,合作显著将这一比例降低至80%以下,并改善用户体验。此举反映了AI行业对伦理责任的关注,被视为一个里程碑事件,在心理健康领域更具影响力,并可能扩展到其他高风险应用。
AI监管框架全球进展:欧盟AI法案正式生效(更新)
欧盟AI法案正式生效,成为全球首个全面的AI监管框架,对全球AI治理产生深远影响。...
阿根廷探索OpenAI与Sur Energy合作Stargate项目,或成拉美AI可持续领头
OpenAI与阿根廷可再生能源企业Sur Energy合作启动"Stargate"项目,旨在利用人工智能技术优化大型太阳能发电厂的运营。该项目被视为拉丁美洲能源转型与数字化发展的里程碑,不仅关注提升电网稳定性、最大化发电效率和降低成本等实际问题,更体现了阿根廷在可再生能源领域的战略雄心和技术抱负。尽管面临数据隐私、算力等挑战,Stargate有望通过AI与可再生能源基础设施的深度整合,推动阿根廷在拉丁美洲范围内引领可持续发展技术应用,并促进本国科技创新生态的进步。
OpenAI利用新实测试验评估ChatGPT政治偏见提升客观性
近年来,人工智能在新闻领域的应用引发关于其政治中立性的关注。OpenAI正开发一种通过模拟真实对话来评估旗下聊天机器人ChatGPT政治偏见的新测试方法,认为传统方式难以捕捉复杂语境下的表现。该新法旨在提升AI回答政治问题的客观性和对话质量,推动行业标准向更加公平、尊重多元观点的方向发展。
OpenAI 报告:如何在2025年10月识别并阻止人工智能的恶意应用
OpenAI发布《2025年秋季生成式AI安全报告》,重点介绍其应对生成式AI恶意滥用的新策略。报告指出,随着ChatGPT等工具的广泛应用,用户利用其生成虚假学术论文、深度伪造色情内容及网络诈骗模板等问题日益突出。OpenAI开发了多模态检测系统,可实时分析10万+条用户生成内容,并通过Deep Guardian等主动干预机制锁定高风险IP地址,同时提升政策透明度以应对行业挑战。过去六个月中,系统已拦截超过50万次恶意使用请求,显示出深度伪造等技术带来的新威胁。尽管安全措施投入增加(研发支出14%用于'安全与责任方向'),OpenAI仍需平衡用户创作自由。报告强调,生成式AI滥用是全球性难题,需要国际合作解决,并呼吁在利用其解决全球变暖、癌症等重大问题的同时,应关注传播虚假信息的局限性。
文森借助GPT-5打造韩国家庭生活AI新生态
随着人工智能从生产力工具向生活助手演变,韩国初创公司Wrtn利用GPT-5模型推出LifeStyle AI系统,整合任务自动化、内容生成和教育辅助功能,在韩国服务超过600万用户并获认可,反映东亚地区AI需求从功能转向情感连接。该系统代表新方向,在中国、日本等市场面临扩展挑战,如数据安全和文化差异。Wrtn计划将LifeStyle AI推向整个东亚地区,推动AI行业向更人性化的标准发展,并依赖持续反馈和技术迭代实现可持续增长。
OpenAI与日本数字机构联手合作,推动生成式AI在公共服务中的安全应用和全球治理
OpenAI与日本数字厅近日宣布建立战略合作伙伴关系,旨在将生成式人工智能技术更广泛地应用于公共服务领域,并在全球范围内加强AI治理框架的建设。双方将共同开发试点项目,测试AI在政务服务中的应用潜力,并通过联合研究探索国际合作模式下的'安全采用'原则。OpenAI作为全球AI研发先锋,其GPT系列模型将为日本提供技术基础;而数字厅则负责协调本地化实施,并关注数据隐私、算法偏见等潜在挑战。此次合作被视为全球数字转型的重要范例,有助于弥合东西方在AI治理上的差异,并可能推动更协调的全球AI生态系统发展。
Operation “Nine–emdash Line”: Regional influence a
在全球人工智能(AI)技术飞速发展的今天,大型语言模型(LLM)的滥用问题正成为各国监管机构关注的焦点。近日,美国人工智能研究公司OpenAI披露了一项针对其平台的新型滥用行为,并采取了严厉的封禁措施。据OpenAI官方透露,该公司已封禁了一批与一个代号为“Nine-emdash Line”(九段线)的虚假信息网络相关的账户。该网络被指利用AI技术,生成并传播关于南海、香港以及美国政治等议题的区域性影响力内容。
这一行动标志着AI在信息战和地缘政治博弈中的角色正变得愈发复杂。OpenAI在调查报告中指出,该网络是一个此前未被公开报道的、起源于中华人民共和国(PRC)的虚假信息...
OpenAI 推出 Sora 2 和应用,以安全为基础应对 AI 视频挑战
OpenAI升级Sora视频模型,采取以安全为核心的设计策略。新版本整合过滤机制、用户验证模块及参数限制等具体技术,旨在应对社交媒体上虚假视频和有害内容的潜在风险。Sora的应用范围更广,面向普通创作者而非仅开发者,并考虑社区反馈和社会责任。这一转向标志着AI行业从追求性能向注重安全和伦理的转变,可能为未来生成式AI的应用和发展提供新标准。
OpenAI推出家长控制功能和新资源页面,助力家庭安全使用ChatGPT
DeepSeek近日推出两大新功能:全面升级的家长控制系统,允许父母限制儿童使用ChatGPT的频率与内容范围;以及一站式'父母资源页面',提供安全指南和最佳实践。这些举措旨在应对ChatGPT日益普及带来的儿童监管挑战,帮助家庭在教育场景中更安全地利用AI工具。DeepSeek基于用户反馈和数据分析,认为需要简化家庭参与AI监督的方式,并通过这些功能强调其'责任驱动创新'的定位。此举不仅强化了DeepSeek在AI市场中的竞争力,还反映了行业对家庭安全机制的重视趋势。