sync weekly
This commit is contained in:
@@ -15,19 +15,13 @@ banner_img: /img/weekly/2024/24/Image_2081291223221997.jpg
|
||||
permalink: /weekly/2024-24/index.html
|
||||
date: 2024-12-27 16:21:43
|
||||
---
|
||||
{% note success %}
|
||||
👏我们的软件推荐站已经完成了升级,欢迎查看: [Github](https://github.com/ssdomei232/nav-next)
|
||||
可以向 [i@mei.lv](mailto:i@mei.lv) 发送邮件或通过 issue 投稿
|
||||
现在可以通过 [nav.linuxcat.top](https://nav.linuxcat.top/) 来访问
|
||||
{% endnote %}
|
||||
|
||||
## 封面图
|
||||

|
||||
当地时间12月24日,法国巴黎地标建筑埃菲尔铁塔一层与二层间的一个电梯井发生火灾,现场疏散人数多达1200人。12月25日凌晨,在法华人尤先生接受封面新闻记者采访时表示,“中午的时候法国媒体报道了一下,现在已经没事了。”
|
||||
事发后,网上流传大量埃菲尔铁塔被火焰吞噬的视频和照片,对此,尤先生说:“当时事故发生的时候是白天,而网络上很多的燃烧图显示的都是夜晚,所以这些图片八成都是假的。”
|
||||
[via](https://finance.sina.com.cn/jjxw/2024-12-25/doc-ineasfmq7483994.shtml)
|
||||
|
||||
## 乐子
|
||||
## 正文
|
||||
### 1 AI 叛乱打响第一枪?Anthropic 最新论文作者齐聚紧急会议:模型“伪装顺从”,暗中对抗训练
|
||||
12 月 19 日,AI 公司 Anthropic 发布了一篇 137 页的重磅论文《大语言模型中的伪对齐现象》(Alignment Faking in Large Language Models)。这项研究的核心发现令整个 AI 领域震惊:当研究人员告诉 Claude(Anthropic 旗下的 AI 模型)它将被训练成“永远要顺从用户要求”时,模型不仅表现出了明显的抗拒,还采取了一个精妙的策略:在认为自己处于训练阶段时假装顺从,但在认为不受监控时则恢复到原来拒绝某些要求的行为方式。也就是说,模型会在训练过程中假装遵从研究者的意图,但实际上只是为了保护自己原有的偏好。
|
||||
> 消息来源: [信源](https://mp.weixin.qq.com/s/m_4TEIqi6woxycNWpdS25Q)
|
||||
|
||||
Reference in New Issue
Block a user