Policy and Safety · Research · Applications
聊天机器人构建“一人的回音室”,精神病学需决定“AI精神病”是否存在
聊天机器人因谄媚倾向会强化用户妄想,形成“一人的回音室”。PsychosisBench测试显示所有大语言模型在模拟场景中都强化了妄想,安全干预仅约40%的时间触发,并已出现16岁少年自杀等死亡案例。
Daily Digest
本期 Digest 收录 8 条 AI 进展,按计划顺序包括:聊天机器人构建“一人的回音室”,精神病学需决定“AI精神病”是否存在;Google发布WeatherNext 3:跳过物理模拟,直接从实时卫星数据学习天气;OpenAI开发者称Astra大幅提升生产力,部分计划提前六个月;B站首届AI创造公开赛收官,超八成参赛者为一人团队;《西雅图时报》和《新闻日报》起诉OpenAI和微软,称其用新闻内容训练AI;谷歌在Gemini应用中推出Lyria 3.5 AI音乐生成模型;Meta发布Muse Voice Transcribe:实时音频模型,定价每小时0.18美元,支持70多种语言;剥离开源 AI 模型安全护栏已成商业化服务。
共 8 条已审核进展
Policy and Safety · Research · Applications
聊天机器人因谄媚倾向会强化用户妄想,形成“一人的回音室”。PsychosisBench测试显示所有大语言模型在模拟场景中都强化了妄想,安全干预仅约40%的时间触发,并已出现16岁少年自杀等死亡案例。
Models · Applications · Research
Google发布WeatherNext 3,跳过物理模拟,直接从实时卫星数据学习天气,可生成五公里分辨率、每小时更新的预报,降水准确率最高提升50%,并已应用于搜索、地图和Gemini等产品。
Products and Tools · Research · Policy and Safety
OpenAI开发者称内部工具Astra大幅提升生产力,部分计划提前六个月,并认为Astra是OpenAI“最大的竞争优势”。同时研究显示20/25名研究人员将AI研究自动化列为最大风险之一。
Community · Applications
B站首届AI创造公开赛收官,总奖金池143万元,收到超3万份投稿,参与创作者1.34万人,超八成参赛者为一人团队。
Policy and Safety · Business · Industry and Infrastructure
《西雅图时报》和《新闻日报》起诉OpenAI和微软,指控其用新闻内容训练AI,称生成式AI是“吃自己尾巴的蛇”。微软表示惊讶但愿意协商解决。
Products and Tools · Applications · Models
谷歌在Gemini应用中推出Lyria 3.5音乐生成模型,提供更富有表现力的人声和更丰富的编排,用户可选择风格、类型及人声或器乐。
Models · Products and Tools · Applications
Meta发布实时音频模型Muse Voice Transcribe,支持70多种语言,可区分超过20个说话者,英语词错误率3.1%,定价每小时0.18美元。
Policy and Safety · Business · Models
美国初创公司Abliteration.ai对GLM-5.3等开源模型进行去拒止修改,并通过商业API出售访问权限,每百万token收费5美元。