sync weekly

This commit is contained in:
mei
2025-02-07 19:54:46 +08:00
parent e53a72f6aa
commit 1405ac9353
29 changed files with 664 additions and 908 deletions
+27 -15
View File
@@ -13,50 +13,62 @@ permalink: /weekly/2025-1/index.html
date: 2025-01-11 16:21:43
---
## 封面图
![洛杉矶大火](/img/weekly/2025/01/BB1rdqL1.jpg)
截止当地时间9日下午4点,洛杉矶山火已造成5人死亡,4000多栋房屋被烧毁,过火面积超过116平方公里,超过18万人被要求撤离,超过40万人失去供电。
强风对消防造成了困难。部分地区风速到达160公里每小时。强风预计还将持续数日。
好莱坞地区,火灾逼近好莱坞露天剧场和中国大剧院,距离好莱坞星光大道约1.6公里。
在圣莫尼卡地区,火灾烧毁了著名博物馆盖蒂庄园的部分植物,馆藏和博物馆建筑并未受火灾影响。
## 正文
![洛杉矶大火](/img/weekly/2025/01/BB1rdqL1.jpg)
截止当地时间9日下午4点,洛杉矶山火已造成5人死亡,4000多栋房屋被烧毁,过火面积超过116平方公里,超过18万人被要求撤离,超过40万人失去供电。
强风对消防造成了困难。部分地区风速到达160公里每小时。强风预计还将持续数日。
好莱坞地区,火灾逼近好莱坞露天剧场和中国大剧院,距离好莱坞星光大道约1.6公里。
在圣莫尼卡地区,火灾烧毁了著名博物馆盖蒂庄园的部分植物,馆藏和博物馆建筑并未受火灾影响。
## 正文
### 1 马斯克同意我们已经耗尽了AI训练数据
马斯克同意其他人工智能专家的观点,即用于训练人工智能模型的真实世界数据所剩无几。马斯克在周三晚间与 Stagwell 董事长马克·佩恩在 X 上直播对话中表示:“我们现在已经基本耗尽了人类知识的累积总和……在人工智能训练方面。这基本上发生在去年。”确实,马斯克认为合成数据——由人工智能模型本身生成的数据——是未来的发展方向。“补充[真实世界数据]的唯一方法是使用合成数据,即人工智能生成[训练数据],”他说。“有了合成数据……[人工智能]将会自我评估并经历这个自我学习的过程。”[微软的 Phi-4 于周三早上开源](https://huggingface.co/microsoft/phi-4),其使用合成数据和真实数据进行训练。谷歌的 Gemma 模型也是如此。
> 消息来源: [Techcrunch](https://techcrunch.com/2025/01/08/elon-musk-agrees-that-weve-exhausted-ai-training-data/) | [风向旗参考快讯](https://t.me/xhqcankao/16386)
### 2 DeepSeek新模型误认身份,暴露AI训练数据污染问题
近日,中国AI公司DeepSeek发布的最新模型DeepSeek V3在测试中出现异常:它自称是OpenAI的ChatGPT,并能提供OpenAI的API使用说明。专家认为,这可能是由于训练数据中混入了大量ChatGPT生成的内容,导致模型“身份混淆”
随着AI生成内容在网络上激增,训练数据污染问题日益严重。DeepSeek表示正在优化数据清洗流程,以提升模型的独立性和准确性
未来AI开发中数据纯净性已经变得很重要,如何有效过滤AI生成内容将成为行业的关键
近日,中国AI公司DeepSeek发布的最新模型DeepSeek V3在测试中出现异常:它自称是OpenAI的ChatGPT,并能提供OpenAI的API使用说明。专家认为,这可能是由于训练数据中混入了大量ChatGPT生成的内容,导致模型“身份混淆”
随着AI生成内容在网络上激增,训练数据污染问题日益严重。DeepSeek表示正在优化数据清洗流程,以提升模型的独立性和准确性
未来AI开发中数据纯净性已经变得很重要,如何有效过滤AI生成内容将成为行业的关键
> 消息来源: [TechCrunch](https://techcrunch.com/2024/12/27/why-deepseeks-new-ai-model-thinks-its-chatgpt/)
### 3 OpenAI新模型o3单次高算力查询成本或超1000美元
OpenAI最新发布的o3人工智能模型在ARC-AGI基准测试中取得了87.5%的高分,相比前代o1模型提升了近三倍。然而,这种性能的提升也带来了巨大的成本压力。在高算力模式下,每次查询的费用或超过1000美元,是前代模型4美元成本的数百倍。即使是低算力版本,每次查询也需要20美元,这使得其商业化面临不小的困难。据悉,o3计划于明年1月推出“迷你版”,以降低使用成本。
> 消息来源: [Yahoo Tech](https://www.yahoo.com/tech/openais-latest-ai-cost-more-214758857.html) | [科技圈🎗在花频道](https://t.me/zaihuanews/29836)
### 4 Nvidia 押注机器人技术推动未来增长
Nvidia 将机器人技术视为其下一个重要增长动力,因为其核心人工智能芯片制造业务面临着日益激烈的竞争。Nvidia 将于 2025 年上半年推出其最新一代人形机器人紧凑型计算机,名为 Jetson Thor。Nvidia 将自己定位为即将到来的机器人革命的领先平台。该公司销售“全栈”解决方案,从用于训练人工智能机器人的软件层到内置芯片。Nvidia 机器人副总裁 Deepu Talla 称:“物理人工智能和机器人的 ChatGPT 时刻即将到来”,并补充说他相信市场已经达到了“临界点”。
> 消息来源: [金融时报](https://www.ft.com/content/7c3dafa8-ffb9-4ca8-b677-ab3cc2afbdcb) | [风向旗参考快讯](https://t.me/xhqcankao/16144)
### 5 OpenAI招聘信息揭示其机器人计划
OpenAI重启机器人部门,将开发通用、自适应机器人,配备定制传感器。并计划自研AI模型驱动机器人。
招聘信息暗示OpenAI将雇佣合同工测试原型机,并可能开发有肢体的机器人。目标是实现大规模生产。
OpenAI重启机器人部门,将开发通用、自适应机器人,配备定制传感器。并计划自研AI模型驱动机器人。
招聘信息暗示OpenAI将雇佣合同工测试原型机,并可能开发有肢体的机器人。目标是实现大规模生产。
> 消息来源: [TechCrunch](https://techcrunch.com/2025/01/10/new-openai-job-listings-reveal-its-robotics-plans/) | [科技圈🎗在花频道](https://t.me/zaihuanews/30105)
### 6 研究发现GitHub存在450万个虚假“Star”的问题
一项由Socket、卡内基梅隆大学和北卡罗来纳州立大学研究人员进行的研究揭示,GitHub上存在约450万个疑似虚假的Star评价——研究团队使用自研工具"StarScout"分析了20TB的GitHub活动数据得出这一结论。
研究显示,2024年虚假Star活动激增,约15.8%拥有超过50个Star的代码库涉及此类行为。这些虚假Star不仅用于提升项目知名度,还被用于传播恶意软件,如去年发现的"Stargazers Ghost Network"。
一项由Socket、卡内基梅隆大学和北卡罗来纳州立大学研究人员进行的研究揭示,GitHub上存在约450万个疑似虚假的Star评价——研究团队使用自研工具"StarScout"分析了20TB的GitHub活动数据得出这一结论。
研究显示,2024年虚假Star活动激增,约15.8%拥有超过50个Star的代码库涉及此类行为。这些虚假Star不仅用于提升项目知名度,还被用于传播恶意软件,如去年发现的"Stargazers Ghost Network"。
GitHub已删除研究人员在2024年7月发现的可疑账户和代码库。专家建议用户在评估GitHub项目时,应该查看项目活跃度、代码质量和文档,而不是仅依赖Star数量。
> 消息来源: [BleepingComputer](https://www.bleepingcomputer.com/news/security/over-31-million-fake-stars-on-github-projects-used-to-boost-rankings/) | [科技圈🎗在花频道](https://t.me/zaihuanews/29873)
### 7 必应搜索试图在搜索谷歌时模仿 Google UI
微软似乎推出了一项非常有趣但又颇具争议的改变,当使用必应搜索尝试查找谷歌时,必应搜索会模仿谷歌搜索用户界面。这是一个天才的举动,可以让用户远离谷歌搜索,而谷歌已成为搜索引擎或在线查找答案的代名词。当用户在必应上搜索谷歌时,必应的设计看起来很像谷歌。页面布局简洁,中间有搜索栏,还有简单的插图。当用户退出微软账户并在必应上搜索谷歌时,微软正在尝试这种新设计。
> 消息来源: [Windows Latest](https://www.windowslatest.com/2025/01/06/microsoft-bing-is-trying-to-spoof-google-ui-when-people-search-google-com/) | [风向旗参考快讯](https://t.me/xhqcankao/16276)
### 8 微软论文意外泄露OpenAI及Claude模型参数
近日,微软在一篇医学相关论文中意外泄露了OpenAI及Claude系列模型的参数信息。论文中详细列出了GPT-4o、GPT-4o-mini、Claude 3.5 Sonnet等模型的参数规模,其中GPT-4o约200B,GPT-4o-mini约8B,Claude 3.5 Sonnet约175B。尽管论文中附有免责声明,称这些数字为估计值,但仍引发广泛关注。
> 消息来源: [量子位](https://mp.weixin.qq.com/s/bT_w-T9ElmPUXbYA1f7kCg)
### 9 末日主题验证码新玩法
Vercel公司推出新式验证码,用户需在DOOM游戏中击杀至少三个怪物才能通过。此验证码在Hacker News引发热议。
Vercel公司推出新式验证码,用户需在DOOM游戏中击杀至少三个怪物才能通过。此验证码在Hacker News引发热议。
尽管创意非原创,但新式验证码仍受开发者欢迎,有人觉得太难,有人则称赞“太硬核”,有人认为难度像真验证码。
> 消息来源: [Demo](https://doom-captcha.vercel.app/) | TechCrunch(https://techcrunch.com/2025/01/01/people-are-playing-a-new-doom-themed-captcha/)
> 消息来源: [Demo](https://doom-captcha.vercel.app/) | TechCrunch(<https://techcrunch.com/2025/01/01/people-are-playing-a-new-doom-themed-captcha/>)
+27 -143
View File
@@ -14,170 +14,54 @@ permalink: /weekly/2025-2/index.html
date: 2025-01-24 17:22:44
---
## 封面图
![星舰爆炸解体](/img/weekly/2025/02/d98407a503d392cef4f3a0374ed1e410.jpg)
SpaceX在16日第7次试飞重型运载火箭“星舰”。发射塔机械臂再次成功捕获回收第一级“超级重型”助推器。但原计划环绕地球并溅落印度洋的第二级飞船一度失联,随后SpaceX确认发生爆炸并解体。
[via](https://edition.cnn.com/science/live-news/starship-test-flight-7-launch-spacex/index.html)
## 正文
## 正文
### 1 MIT科技评论:中美AI军备竞赛没有赢家
在这场僵局的早期,美国决策者推动了以“赢得”竞赛为中心的议程,主要是从经济角度出发。近几个月来,OpenAI 和 Anthropic 等领先的人工智能实验室参与推动“击败中国”的论调,这似乎是试图与即将上任的特朗普政府保持一致。人们相信美国能在这场竞赛中获胜,主要是因为美国在先进的 GPU 计算资源方面比中国更具优势,而且人工智能的缩放定律也非常有效。
但现在看来,获得大量先进计算资源已不再是许多人认为的决定性或可持续优势。事实上,美国和中国领先模型之间的能力差距已基本消失,中国模型现在可能在一个重要方面具有优势:它们能够仅使用西方领先实验室可用的一小部分计算资源,就能实现几乎相同的结果。
人工智能竞争越来越被置于狭隘的国家安全框架内,成为一场零和博弈,并受到这样一种假设的影响:未来中美之间以台湾为中心的战争不可避免。美国采取 “瓶颈”策略,限制中国获取先进半导体等关键技术,而中国则加快了自给自足和自主创新的努力,这导致美国的努力适得其反。
当我们更深入地考虑这一动态时,就会发现未来真正的生存威胁不是来自中国,而是来自不良行为者和流氓团体对先进人工智能的武器化,这些团体试图造成广泛危害、获取财富或破坏社会稳定。与核武器一样,作为一个民族国家,中国必须谨慎使用人工智能能力来损害美国利益,但不良行为者(包括极端组织)更有可能毫不犹豫地滥用人工智能能力。鉴于人工智能技术的不对称性质,它与网络武器非常相似,因此很难完全阻止和防御一个已经掌握了人工智能的使用方法并打算将其用于邪恶目的的坚定敌人。
在这场僵局的早期,美国决策者推动了以“赢得”竞赛为中心的议程,主要是从经济角度出发。近几个月来,OpenAI 和 Anthropic 等领先的人工智能实验室参与推动“击败中国”的论调,这似乎是试图与即将上任的特朗普政府保持一致。人们相信美国能在这场竞赛中获胜,主要是因为美国在先进的 GPU 计算资源方面比中国更具优势,而且人工智能的缩放定律也非常有效。
但现在看来,获得大量先进计算资源已不再是许多人认为的决定性或可持续优势。事实上,美国和中国领先模型之间的能力差距已基本消失,中国模型现在可能在一个重要方面具有优势:它们能够仅使用西方领先实验室可用的一小部分计算资源,就能实现几乎相同的结果。
人工智能竞争越来越被置于狭隘的国家安全框架内,成为一场零和博弈,并受到这样一种假设的影响:未来中美之间以台湾为中心的战争不可避免。美国采取 “瓶颈”策略,限制中国获取先进半导体等关键技术,而中国则加快了自给自足和自主创新的努力,这导致美国的努力适得其反。
当我们更深入地考虑这一动态时,就会发现未来真正的生存威胁不是来自中国,而是来自不良行为者和流氓团体对先进人工智能的武器化,这些团体试图造成广泛危害、获取财富或破坏社会稳定。与核武器一样,作为一个民族国家,中国必须谨慎使用人工智能能力来损害美国利益,但不良行为者(包括极端组织)更有可能毫不犹豫地滥用人工智能能力。鉴于人工智能技术的不对称性质,它与网络武器非常相似,因此很难完全阻止和防御一个已经掌握了人工智能的使用方法并打算将其用于邪恶目的的坚定敌人。
人工智能将帮助我们加速科学发现、开发新药、延长我们的健康寿命、减少我们的工作义务并确保所有人都能接受高质量的教育。要实现这一目标,我们需要更先进的人工智能系统,如果我们划分计算/数据资源和研究人才库,这将是一个更具挑战性的目标。根据行业研究,全球近一半的顶尖人工智能研究人员(47%)都出生或在中国接受教育。很难想象如果没有中国研究人员的努力,我们如何能取得今天的成就。
将人工智能的发展定性为零和竞赛会破坏集体进步和安全的机会。美国和中国及其盟友不应屈服于对抗的言论,而应转向合作和共同治理。
将人工智能的发展定性为零和竞赛会破坏集体进步和安全的机会。美国和中国及其盟友不应屈服于对抗的言论,而应转向合作和共同治理。
> 消息来源: [麻省理工科技评论](https://www.technologyreview.com/2025/01/21/1110269/there-can-be-no-winners-in-a-us-china-ai-arms-race/)(节选) | [风向旗参考快讯](https://t.me/xhqcankao/16704)
### 2 Meta 追赶 OpenAI 内幕:不惜使用盗版数据
Meta 内部邮件显示,为追赶 OpenAI 的 GPT4 模型,曾考虑使用盗版书库 LibGen 训练 AI,并采取措施隐藏来源,以规避法律风险。Meta 认为此举对于达到行业领先水平至关重要,并认为竞争对手也在使用类似数据。
内部文件还揭示,Meta 曾讨论删除训练数据中的版权标识和作者信息,以避免法律纠纷,同时,还考虑了使用盗版数据可能带来的监管风险和负面媒体报道。Meta 面临的版权诉讼也因此加剧。
Meta 内部邮件显示,为追赶 OpenAI 的 GPT4 模型,曾考虑使用盗版书库 LibGen 训练 AI,并采取措施隐藏来源,以规避法律风险。Meta 认为此举对于达到行业领先水平至关重要,并认为竞争对手也在使用类似数据。
内部文件还揭示,Meta 曾讨论删除训练数据中的版权标识和作者信息,以避免法律纠纷,同时,还考虑了使用盗版数据可能带来的监管风险和负面媒体报道。Meta 面临的版权诉讼也因此加剧。
> 消息来源: [The Verge](https://www.theverge.com/2025/1/14/24343692/meta-lawsuit-copyright-lawsuit-llama-libgen) | [科技圈🎗在花频道](https://t.me/zaihuanews/30177)
### 3 甲骨文拒绝放弃“JavaScript”商标
甲骨文因拒绝放弃“JavaScript”商标所有权而面临Deno Land的法律挑战。该商标是甲骨文2009年收购Sun Microsystems时继承而来,但Deno Land认为“JavaScript”已成为通用术语,且甲骨文未积极使用或控制该名称。JavaScript创始人Brendan Eich及开发者社区广泛支持Deno Land的行动,认为此举将影响JavaScript品牌的未来及其在科技行业的开放使用。
Deno Land于2024年11月向美国专利商标局提交请愿书,要求取消甲骨文的商标。甲骨文需在2025年2月3日前作出回应,否则案件可能进入默认判决阶段。若甲骨文坚持不放弃,争议将进入法庭审理。开发者社区已发起公开信,获得超10,000个签名,呼吁甲骨文放弃商标控制权,以确保JavaScript名称的开放使用。
甲骨文因拒绝放弃“JavaScript”商标所有权而面临Deno Land的法律挑战。该商标是甲骨文2009年收购Sun Microsystems时继承而来,但Deno Land认为“JavaScript”已成为通用术语,且甲骨文未积极使用或控制该名称。JavaScript创始人Brendan Eich及开发者社区广泛支持Deno Land的行动,认为此举将影响JavaScript品牌的未来及其在科技行业的开放使用。
Deno Land于2024年11月向美国专利商标局提交请愿书,要求取消甲骨文的商标。甲骨文需在2025年2月3日前作出回应,否则案件可能进入默认判决阶段。若甲骨文坚持不放弃,争议将进入法庭审理。开发者社区已发起公开信,获得超10,000个签名,呼吁甲骨文放弃商标控制权,以确保JavaScript名称的开放使用。
> 消息来源: [Deno](https://deno.com/blog/deno-v-oracle) | [科技圈🎗在花频道](https://t.me/zaihuanews/30184)
### 4 Let’s Encrypt 即将支持有效期为6天的证书和IP地址证书。
### 4 Let’s Encrypt 即将支持有效期为6天的证书和IP地址证书
>
> 消息来源: [Let’s Encrypt](https://letsencrypt.org/2025/01/16/6-day-and-ip-certs/#)
### 5 Rsync曝重大漏洞,黑客可远程执行代码。请升级到最新版
开源同步工具Rsync被曝存在六项漏洞,其中最严重的是CVE-2024-12084。该漏洞允许黑客通过越界写入缓冲区,远程执行代码,影响版本为3.2.7及以上。
此外,CVE-2024-12085漏洞可能导致程序比对校验和与未初始化内存,从而泄露堆栈数据。据调查,全球超过66万台服务器面临潜在威胁,主要集中在中国大陆和美国。
> 消息来源: IT之家 (https://www.ithome.com/0/825/945.htm)
目前,Rsync已发布3.4.0版本,修复了相关漏洞。建议用户尽快升级到最新版本以确保安全。
开源同步工具Rsync被曝存在六项漏洞,其中最严重的是CVE-2024-12084。该漏洞允许黑客通过越界写入缓冲区,远程执行代码,影响版本为3.2.7及以上。
此外,CVE-2024-12085漏洞可能导致程序比对校验和与未初始化内存,从而泄露堆栈数据。据调查,全球超过66万台服务器面临潜在威胁,主要集中在中国大陆和美国。
> 消息来源: IT之家 (<https://www.ithome.com/0/825/945.htm>)
目前,Rsync已发布3.4.0版本,修复了相关漏洞。建议用户尽快升级到最新版本以确保安全。
> 消息来源: [科技圈🎗在花频道](https://t.me/zaihuanews/30316)
### 6 为什么ChatGPT有时会“用中文思考”?
OpenAI近日推出的o1的模型,旨在通过“更多时间思考”提供更优质的回答。然而,用户发现o1在推理过程中会随机出现中文和其他语言的字符,即使对话完全用英文。专家推测,这可能是因为o1使用了大量中文数据进行训练,或某些语言(如中文)在处理特定问题时更高效。此外,大型语言模型在抽象概念空间中运作,可能会选择最有效的语言来解决问题。
AI研究科学家Luca Soldaini指出,由于AI系统的“黑箱”特性,很难准确解释这一现象,并强调透明度的重要性。尽管名为“OpenAI”,但其算法的不透明性与其宣称的开放使命形成反差。
OpenAI近日推出的o1的模型,旨在通过“更多时间思考”提供更优质的回答。然而,用户发现o1在推理过程中会随机出现中文和其他语言的字符,即使对话完全用英文。专家推测,这可能是因为o1使用了大量中文数据进行训练,或某些语言(如中文)在处理特定问题时更高效。此外,大型语言模型在抽象概念空间中运作,可能会选择最有效的语言来解决问题。
AI研究科学家Luca Soldaini指出,由于AI系统的“黑箱”特性,很难准确解释这一现象,并强调透明度的重要性。尽管名为“OpenAI”,但其算法的不透明性与其宣称的开放使命形成反差。
> 消息来源: [GIZMODO](https://gizmodo.com/why-does-chatgpts-algorithm-think-in-chinese-2000550311) | [科技圈🎗在花频道](https://t.me/zaihuanews/30393)
### 7 OpenAI 推出 AI 代理 能像人类一样浏览网页
美国人工智能公司 OpenAI 周四突然举行直播活动,发布市场期待已久的首款 AI 代理工具 Operator (意为操作员),能够代理用户执行基于网页的操作。言简意赅的解释,就是 Operator 能够像人类一样使用网页浏览器。山姆·奥尔特曼介绍称,从周四开始,美国的ChatGPT Pro 用户 (200美元/月) 将能使用“研究预览版”的 Operator。未来将拓展到更多区域的 Pro 用户,几个月后 ChatGPT Plus 用户也能用上。同时在未来几周、几个月里,还会发布更多的 AI 代理。Operator 由一个名为 CUA (计算机使用代理) 的新模型驱动,结合了 GPT-4o 的视觉能力,以及通过强化学习实现的高级推理。能够“看见”网页(截图),并使用鼠标和键盘允许的所有操作与网页互动。
> 消息来源: [财联社](https://api3.cls.cn/share/article/1928599?sv=8.4.4) | [OpenAI 博客](https://openai.com/index/introducing-operator/) | [风向旗参考快讯](https://t.me/xhqcankao/16688)
+30 -26
View File
@@ -10,57 +10,61 @@ banner_img: /img/weekly/2025/03/photo_2025-01-30_21-11-07.jpg
permalink: /weekly/2025-3/index.html
date: 2025-01-31 19:00:00
---
{% note success %}
👏我们的软件推荐站已经完成了升级,欢迎查看: [Github](https://github.com/ssdomei232/nav-next)
可以向 [i@mei.lv](mailto:i@mei.lv) 发送邮件或通过 issue 投稿
现在可以通过 [nav.linuxcat.top](https://nav.linuxcat.top/) 来访问
{% endnote %}
## 封面图
![华盛顿空难](/img/weekly/2025/03/photo_2025-01-30_21-11-07.jpg)
美国华盛顿空难已打捞出28具遇难者遗体,其中客机上27具,直升机上1具。当局推测已无人生还,现场工作重心将转至遗体打捞。
美国航空CEO罗伯特·艾索姆表示“不知道军机为何会进入PSA航班的航道”。
美国华盛顿空难已打捞出28具遇难者遗体,其中客机上27具,直升机上1具。当局推测已无人生还,现场工作重心将转至遗体打捞。
美国航空CEO罗伯特·艾索姆表示“不知道军机为何会进入PSA航班的航道”。
[via](https://apnews.com/article/congo-m23-goma-rwanda-tshisekedi-south-africa-ca81f34f52ea31b85dd845b049a0bb96)
## 正文
## 正文
### 1 DeepSeek 使用了比 CUDA 更底层的 Nvidia PTX 进行编程
DeepSeek 高效突破是通过实施大量细粒度优化和使用 Nvidia 的汇编式语言 PTX (并行线程执行) 编程而不是标准的 CUDA 实现的。PTX 是 Nvidia 为其 GPU 设计的中间指令集架构,位于高级 GPU 编程语言 (如 CUDA C/C++ 或其他语言前端) 和低级机器代码 (流式汇编或 SASS) 之间。它将 GPU 公开为数据并行计算设备,因此允许细粒度优化,例如寄存器分配和线程/warp 级别调整,这是 CUDA C/C++ 和其他语言前端无法实现的。
在训练其 V3 模型时,DeepSeek 重新配置了 H800 GPU:在 132 个流式多处理器中,它分配了 20 个用于服务器间通信,可能用于压缩和解压数据,以克服处理器的连接限制并加快速度。为了最大限度地提高性能,DeepSeek 还实现了高级管道算法,可能是通过进行超精细的线程/warp 级别调整。这些修改远远超出了标准 CUDA 级开发,维护起来非常困难,这种级别的优化反映了 DeepSeek 工程师的卓越技能。
DeepSeek 高效突破是通过实施大量细粒度优化和使用 Nvidia 的汇编式语言 PTX (并行线程执行) 编程而不是标准的 CUDA 实现的。PTX 是 Nvidia 为其 GPU 设计的中间指令集架构,位于高级 GPU 编程语言 (如 CUDA C/C++ 或其他语言前端) 和低级机器代码 (流式汇编或 SASS) 之间。它将 GPU 公开为数据并行计算设备,因此允许细粒度优化,例如寄存器分配和线程/warp 级别调整,这是 CUDA C/C++ 和其他语言前端无法实现的。
在训练其 V3 模型时,DeepSeek 重新配置了 H800 GPU:在 132 个流式多处理器中,它分配了 20 个用于服务器间通信,可能用于压缩和解压数据,以克服处理器的连接限制并加快速度。为了最大限度地提高性能,DeepSeek 还实现了高级管道算法,可能是通过进行超精细的线程/warp 级别调整。这些修改远远超出了标准 CUDA 级开发,维护起来非常困难,这种级别的优化反映了 DeepSeek 工程师的卓越技能。
> 消息来源: [Tom's Hardware](https://www.tomshardware.com/tech-industry/artificial-intelligence/deepseeks-ai-breakthrough-bypasses-industry-standard-cuda-uses-assembly-like-ptx-programming-instead) | [风向旗参考快讯](https://t.me/xhqcankao/16824)
### 2 “人类终极考试”基准测试发布:顶级AI系统表现惨淡,准确率均未超10%
非营利组织“人工智能安全中心”(CAIS)与Scale AI联合推出名为“人类终极考试”的新型基准测试,旨在评估前沿AI系统的综合能力。该测试由来自50个国家500多个机构的近1000名学科专家出题,涵盖数学、人文学科和自然科学等领域,题目形式多样,包括结合图表和图像的复杂题型。
初步研究显示,所有公开可用的旗舰AI系统在该测试中的回答准确率均未超过10%,表明当前AI技术在应对复杂、综合性问题时仍存在明显短板。CAIS和Scale AI计划向研究社区开放该测试,以帮助评估新开发的AI模型。
非营利组织“人工智能安全中心”(CAIS)与Scale AI联合推出名为“人类终极考试”的新型基准测试,旨在评估前沿AI系统的综合能力。该测试由来自50个国家500多个机构的近1000名学科专家出题,涵盖数学、人文学科和自然科学等领域,题目形式多样,包括结合图表和图像的复杂题型。
初步研究显示,所有公开可用的旗舰AI系统在该测试中的回答准确率均未超过10%,表明当前AI技术在应对复杂、综合性问题时仍存在明显短板。CAIS和Scale AI计划向研究社区开放该测试,以帮助评估新开发的AI模型。
> 消息来源: [HLE](https://agi.safe.ai/) | [科技圈🎗在花频道](https://t.me/zaihuanews/30441)
### 3 RTX 5090D 性能分析 功耗+30%,性能+30%
多个跑分软件如Time Spy ,Fire Strike Extreme等较4090提升约36%。Port Royal光追性能测试较上代提升44%。跑分时功耗较上代提升约35%左右,峰值功耗约577W。
多个跑分软件如Time Spy ,Fire Strike Extreme等较4090提升约36%。Port Royal光追性能测试较上代提升44%。跑分时功耗较上代提升约35%左右,峰值功耗约577W。
游戏光追方面,在DLSS 4加持下游戏帧数暴涨约2倍,开启DLSS 4画质并无明显变化,延迟略微增加。关闭DLSS部分游戏(2077,黑神话·悟空)性能较上代提升约40%,其余游戏提升约20%-30%。
AI大模型方面,通义千问2.5模型下 3B 7B 14B均较上代提升约40%。
多媒体软件如达芬奇等导出时间略微快于苹果M2 Ultra。
AI大模型方面,通义千问2.5模型下 3B 7B 14B均较上代提升约40%。
多媒体软件如达芬奇等导出时间略微快于苹果M2 Ultra。
> 消息来源: [笔吧评测室](https://www.bilibili.com/video/BV1UCfHYFEWt) | [影视飓风](https://www.youtube.com/watch?v=0CynkH9qoek) | | [科技圈🎗在花频道](https://t.me/zaihuanews/30445)
### 4 DeepSeekV3训练成本不及Meta高管薪资,DeepSeek使行业质疑千亿美元支出效用
1月24号,一条发布在匿名平台teamblind上的帖子疯传。一名Meta员工称,现在Meta内部因为DeepSeek的模型,已经进入恐慌模式。
这位Meta员工写道:“一切源于DeepSeek-V3的出现,它在基准测试中已经让Llama 4相形见绌。更让人难堪的是,一家‘仅用550万美元训练预算的中国公司’就做到了这一点。工程师们正在争分夺秒地分析DeepSeek,试图复制其中的一切可能技术。这绝非夸张。管理层正为GenAI研发部门的巨额投入而发愁。当部门里数10位高管其中之一的薪资就超过训练整个DeepSeek V3的成本。
1月24号,一条发布在匿名平台teamblind上的帖子疯传。一名Meta员工称,现在Meta内部因为DeepSeek的模型,已经进入恐慌模式。
这位Meta员工写道:“一切源于DeepSeek-V3的出现,它在基准测试中已经让Llama 4相形见绌。更让人难堪的是,一家‘仅用550万美元训练预算的中国公司’就做到了这一点。工程师们正在争分夺秒地分析DeepSeek,试图复制其中的一切可能技术。这绝非夸张。管理层正为GenAI研发部门的巨额投入而发愁。当部门里数10位高管其中之一的薪资就超过训练整个DeepSeek V3的成本。
> 消息来源: [新浪科技](https://weibo.com/1642634100/PbjVRgEyv) | [华尔街日报](https://www.ft.com/content/747a7b11-dcba-4aa5-8d25-403f56216d7e) | [宝玉](https://x.com/dotey/status/1882528871108538808) | [科技圈🎗在花频道](https://t.me/zaihuanews/30470)
### 5 中国人工智能实验室 DeepSeek 拥有 50000 个 H100 GPU
Scale AI 创始人兼首席执行官 Alexandr Wang 分享了该公司名为“人类的最后考试”的最新 AI 测试的细节,该测试使用“数学、物理、生物、化学教授”提供的与最新研究相关的“最难的问题”。中国人工智能实验室 DeepSeek 的模型 R1 在 Scale AI 公司最具挑战性的人工智能测试中达到或击败了所有表现最佳的模型,或大致与美国最好的模型 o1 相当。
Alexandr 表示,对于中国是否能获得先进 GPU 这个问题,“现实情况是既可以又不能。中国实验室拥有的 H100 数量比人们想象的要多。”他补充说,据他了解,“DeepSeek 拥有大约 50,000 个 H100。”他补充道,“他们显然不能谈论这个问题,因为这违反了美国实施的出口管制。”然而,该公司可能会发现很难采购更多芯片,“从长远来看,他们将受到芯片管制和出口管制的限制。”
Scale AI 创始人兼首席执行官 Alexandr Wang 分享了该公司名为“人类的最后考试”的最新 AI 测试的细节,该测试使用“数学、物理、生物、化学教授”提供的与最新研究相关的“最难的问题”。中国人工智能实验室 DeepSeek 的模型 R1 在 Scale AI 公司最具挑战性的人工智能测试中达到或击败了所有表现最佳的模型,或大致与美国最好的模型 o1 相当。
Alexandr 表示,对于中国是否能获得先进 GPU 这个问题,“现实情况是既可以又不能。中国实验室拥有的 H100 数量比人们想象的要多。”他补充说,据他了解,“DeepSeek 拥有大约 50,000 个 H100。”他补充道,“他们显然不能谈论这个问题,因为这违反了美国实施的出口管制。”然而,该公司可能会发现很难采购更多芯片,“从长远来看,他们将受到芯片管制和出口管制的限制。”
> 消息来源: [wccftech](https://wccftech.com/chinese-ai-lab-deepseek-has-50000-nvidia-h100-ai-gpus-says-ai-ceo/amp/) | [科技圈🎗在花频道](https://t.me/xhqcankao/16767)
### 6 Meta Llama框架漏洞致AI系统面临远程代码执行风险
Meta Llama大型语言模型框架存在高危漏洞(CVE-2024-50050),攻击者可通过反序列化恶意数据远程执行代码,影响使用ZeroMQ网络接口的推理服务器。
Meta于2024年10月发布0.0.41版本修复该问题,将序列化格式从pickle切换为JSON,消除潜在风险。同期OpenAI ChatGPT爬虫也被曝出可被滥用于发起DDoS攻击的漏洞。
研究显示,AI框架安全威胁持续升级,此前TensorFlow Keras因marshal模块漏洞暴露类似风险,LLM技术正被用于增强网络攻击全生命周期。
Meta Llama大型语言模型框架存在高危漏洞(CVE-2024-50050),攻击者可通过反序列化恶意数据远程执行代码,影响使用ZeroMQ网络接口的推理服务器。
Meta于2024年10月发布0.0.41版本修复该问题,将序列化格式从pickle切换为JSON,消除潜在风险。同期OpenAI ChatGPT爬虫也被曝出可被滥用于发起DDoS攻击的漏洞。
研究显示,AI框架安全威胁持续升级,此前TensorFlow Keras因marshal模块漏洞暴露类似风险,LLM技术正被用于增强网络攻击全生命周期。
> 消息来源: [The Hacker News](https://thehackernews.com/2025/01/metas-llama-framework-flaw-exposes-ai.html) | [科技圈🎗在花频道](https://t.me/zaihuanews/30492)
### 7 阿里Qwen 2.5-Max超大规模MoE模型发布
1月29日凌晨,阿里云公布了其全新的通义千问 Qwen 2.5-Max 超大规模 MoE 模型,该模型预训练数据超过20万亿 tokens。目前开发者可在 Qwen Chat 平台免费体验模型,企业和机构也可通过阿里云百炼平台直接调用新模型 API 服务。在 Arena-Hard、LiveBench、LiveCodeBench 和 GPQA-Diamond 等基准测试中,Qwen2.5-Max 表现超越了 DeepSeek V3,同时在 MMLU-Pro 等其他评估中也展现出了极具竞争力的成绩。阿里云的基座模型在大多数基准测试中都展现出了显著的优势。阿里云称随着后训练技术的进步,下一个版本 Qwen2.5-Max 将会达到更高水平。
> 消息来源: [通义千问](https://mp.weixin.qq.com/s/PkwwZWFOyG-mZMWXUMvM8w) | [风向旗参考快讯](https://t.me/xhqcankao/16834)
### 8 谷歌利用 AI 为用户拨打本地商家电话
​谷歌正在测试一款新工具,让 AI 代替用户致电商家询问问题。这项名为“Ask for Me”功能可收集有关服务价格和可用性的信息,但目前仅适用于美甲沙龙和汽车修理店。
在谷歌搜索实验室启用实验后,在搜索中寻找本地美甲沙龙或汽车修理店时,用户可能会看到“Ask for Me”提示。选择该选项后,谷歌将会提出一系列问题,比如是否需要换油或更换轮胎、车是什么类型,以及希望何时预约。用户需要输入电子邮件地址或电话号码用于接收更新信息。商家可以在Google商家资料设置中选择不接收 AI 电话。
> 消息来源: [The Verge](https://www.theverge.com/news/603501/google-ask-for-me-search-labs) | [风向旗参考快讯](https://t.me/xhqcankao/16897)
​谷歌正在测试一款新工具,让 AI 代替用户致电商家询问问题。这项名为“Ask for Me”功能可收集有关服务价格和可用性的信息,但目前仅适用于美甲沙龙和汽车修理店。
在谷歌搜索实验室启用实验后,在搜索中寻找本地美甲沙龙或汽车修理店时,用户可能会看到“Ask for Me”提示。选择该选项后,谷歌将会提出一系列问题,比如是否需要换油或更换轮胎、车是什么类型,以及希望何时预约。用户需要输入电子邮件地址或电话号码用于接收更新信息。商家可以在Google商家资料设置中选择不接收 AI 电话。
> 消息来源: [The Verge](https://www.theverge.com/news/603501/google-ask-for-me-search-labs) | [风向旗参考快讯](https://t.me/xhqcankao/16897)
+78
View File
@@ -0,0 +1,78 @@
---
title: Linuxcat周刊(第28期) DeepSeek 带来的影响
tags:
- AI
- 视频生成
- 机器人
categories:
- Linuxcat周刊
index_img: /img/weekly/2025/04/007Os3mpgy1hyb75c4x9uj30u00u040s.jpg
banner_img: /img/weekly/2025/04/007Os3mpgy1hyb75c4x9uj30u00u040s.jpg
permalink: /weekly/2025-4/index.html
date: 2025-02-07 19:00:00
---
{% note success %}
👏我们的软件推荐站已经完成了升级,欢迎查看: [Github](https://github.com/ssdomei232/nav-next)
可以向 [i@mei.lv](mailto:i@mei.lv) 发送邮件或通过 issue 投稿
现在可以通过 [nav.linuxcat.top](https://nav.linuxcat.top/) 来访问
{% endnote %}
## 封面图
![泰缅边境断电](/img/weekly/2025/04/007Os3mpgy1hyb75c4x9uj30u00u040s.jpg)
当地时间 2 月 5 日,根据泰国政府的决定,当天早上 9 时泰国开始对泰缅边境的缅甸地区断网、断电和断油。泰国地方电力局局长素帕猜・艾空表示,此次断电行动切断泰国五个对缅供电点供电,涉及缅甸孟邦、掸邦、克伦邦,覆盖大其力、妙瓦底等与诈骗团伙活动密切的地区,影响总电力供应量达 20.37 兆瓦
目前已有微博用户分享了泰缅边境断电后的前后对比
[via](https://www.ithome.com/0/829/026.htm)
## 正文
### 1 对近期 DeepSeek 相关新闻的总结
最近有关 DeepSeek 的新闻很多,总接下来就是以下几点:
1. 其他 AI 公司发布新的大模型和新的产品形态并加大研发投入
2. 海外对 DeepSeek 的网络安全,隐私审查和 GPU 来源审查
3. 海外对 DeepSeek 的禁用,甚至出现了比较极端的禁用手段(使用 DeepSeek 会被拘留的提案等)
### 2 奥尔特曼:公司封闭策略站在历史错误一方
作为近期深度求索开源大模型对AI从业者和华尔街巨大震撼的总结,此前坚持封闭策略的OpenAI首席执行官山姆·奥尔特曼坦诚,这家科创巨头在开源问题上站在“历史的错误一方”。在Reddit上问答活动中,一名参与者问奥尔特曼,他的公司是否会考虑发布其AI模型中的一些技术,更多地展现其系统工作原理。奥尔特曼回复称:“我个人认为,在这个问题上我们站在历史的错误一边。现在需要想出一个不同的开源策略。”并表示公司的下一个旗舰推理模型o3会在“几周之后,但少于几个月”上架,同时“GPT-5”的发布还没有时间表。对于已经落后的“文生图”专有模型DALL-E 3,他也称正在努力开发新产品。
> 消息来源:[财联社](https://api3.cls.cn/share/article/1933232?sv=8.8.8&) | [风向旗参考快讯](https://t.me/xhqcankao/16950)
### 3 Openai申请新商标 涉人形机器人、智能珠宝
OpenAI向美国专利商标局提交申请,希望将品牌「OpenAI」相关的产品注册为商标。申请文件显示范围包含耳机、护目镜、眼镜、遥控器、笔记本电脑和手机壳、智能手表、智能珠宝以及「用户可编程的人形机器人」和「具有通信和学习功能、用于协助和娱乐人类的人形机器人」。
> 消息来源:[Techcrunch](https://techcrunch.com/2025/02/03/openais-new-trademark-application-hints-at-humanoid-robots-smart-jewelry-and-more/) | [USTPO](https://tsdr.uspto.gov/#caseNumber=99025123&caseSearchType=US_APPLICATION&caseType=DEFAULT&searchType=statusSearch) | [科技圈🎗在花频道](https://t.me/zaihuanews/30605)
### 4 谷歌从公共 AI 原则中删除有关武器的措辞
谷歌公司从其人工智能原则中删除了一段承诺避免将该技术用于武器等可能有害应用的文字。根据彭博社查看的截图,该公司的人工智能原则此前曾包含一段题为“我们不会追求的人工智能应用”的文字,例如“造成或可能造成整体伤害的技术”,包括武器。该页面上不再显示该措辞。谷歌道德人工智能团队的联合负责人玛格丽特·米切尔表示,删除“伤害”条款可能会对谷歌将要开展的工作类型产生影响。她说:“删除该条款就等于抹去谷歌在道德 AI 领域和激进主义领域所做的许多工作,更成问题的是,这意味着谷歌现在可能会致力于直接部署可以杀人的技术。”
> 消息来源:[彭博社](https://www.bloomberg.com/news/articles/2025-02-04/google-removes-language-on-weapons-from-public-ai-principles)
### 5 研究员以不到50美元训练出优质推理模型
根据上周五发布的[新研究论文](https://arxiv.org/pdf/2501.19393),斯坦福大学和华盛顿大学的人工智能研究人员能够以不到50美元的云计算积分训练出具备“推理”能力的人工智能模型。该模型名为 s1,在数学和编程能力测试中表现出与 OpenAI 的 o1 和 DeepSeek 的 r1 等顶尖推理模型相似的水平。s1 模型可在 [GitHub 上获取](https://github.com/simplescaling/s1),同时还可获取用于训练该模型的数据和代码。s1 团队表示,他们从一个现成基础模型开始,然后通过“蒸馏”对其进行微调。研究人员称,s1 是从谷歌推理模型 Gemini 2.0 Flash Thinking Experimental 中蒸馏出来的。与伯克利分校的研究人员[上个月以约450美元](https://techcrunch.com/2025/01/11/researchers-open-source-sky-t1-a-reasoning-ai-model-that-can-be-trained-for-less-than-450/)的价格创建人工智能推理模型所采用的方法相同。
> 消息来源:[Techcrunch](https://techcrunch.com/2025/02/05/researchers-created-an-open-rival-to-openais-o1-reasoning-model-for-under-50/) | [GitHub](https://github.com/simplescaling/s1) | [风向旗参考快讯](https://t.me/xhqcankao/17044)
### 6 特斯拉招聘工程师等,为量产机器人做准备
2月6日消息,特斯拉正式招聘工程师、流程主管、产品经理等多个岗位,为在加州弗里蒙特工厂量产的 Optimus (特斯拉机器人) 做准备。Optimus是特斯拉公司开发的一款人形机器人,旨在通过人工智能技术执行危险、重复或人类不愿从事的任务。1月30日,特斯拉在业绩会上更新了Optimus机器人量产指引,2025年目标生产1万台机器人,产能第一步扩至每月1000台,到2026年每月产能达到10000台,2027年每月产能达到10万台。
> 消息来源:[新浪科技](https://finance.sina.com.cn/chanjing/gsnews/2025-02-06/doc-ineiphxe1759415.shtml)
### 7 字节跳动发布 AI 工具,可从单张照片生成逼真视频
字节跳动推出 AI 工具 OmniHuman-1,可从单张照片生成逼真的人物视频,让图像中的人物说话、做手势、唱歌甚至演奏乐器。研究人员表示,OmniHuman 在弱信号输入(如音频)下仍能生成高质量视频,支持各种图像比例,适用于肖像、半身或全身照。
字节跳动团队使用超过 18,700 小时的人类视频数据训练 OmniHuman,但具体数据来源尚未披露。这项技术将 TikTok 带入 AI 生成视频的竞争前沿,可能应用于教育、虚拟网红、娱乐、政治宣传等领域,同时也引发了深度伪造相关的伦理和安全担忧。有专家指出,随着 AI 生成内容越来越逼真,虚假信息的风险也随之增加。
> 消息来源:[Forbes](https://www.forbes.com/sites/lesliekatz/2025/02/05/tiktok-owners-new-ai-tool-makes-lifelike-videos-from-a-single-photo/) | [科技圈🎗在花频道](https://t.me/zaihuanews/30668)
### 8 苹果将于一周内发布全新iPhone SE,取消Home键并引入AI功能
苹果公司计划在未来几天内发布全新iPhone SE,据悉,新款iPhone SE将取消传统的Home键,采用类似iPhone 14的设计,并引入“Apple Intelligence”。
此外,新机型将配备USB-C接口,符合欧盟法规要求。预计新款iPhone SE将在海外市场,尤其是中国、印度等亚洲地区,具有较强竞争力。苹果希望通过这款新机型提振其iPhone业务,尤其是在去年假日季度销量下滑1%的背景下。
新机不会举行发布会,采取直接上架的形式。
> 消息来源:[Mark Gurman](https://www.bloomberg.com/news/articles/2025-02-06/apple-s-long-awaited-overhaul-of-budget-iphone-nears-release?embedded-checkout=true)