This commit is contained in:
mei
2025-06-08 06:43:56 +08:00
parent dfc283b0d6
commit c747d8e5aa
39 changed files with 2680 additions and 0 deletions
+74
View File
@@ -0,0 +1,74 @@
---
title: Linuxcat周刊(第25期) 马斯克同意我们已经耗尽了AI训练数据
tags:
- AI
- 机器人
- Nvidia
- Vercel
categories:
- Linuxcat周刊
index_img: /img/weekly/2025/01/BB1rdqL1.jpg
banner_img: /img/weekly/2025/01/BB1rdqL1.jpg
permalink: /weekly/2025-1/index.html
date: 2025-01-11 16:21:43
---
## 封面图
![洛杉矶大火](/img/weekly/2025/01/BB1rdqL1.jpg)
截止当地时间9日下午4点,洛杉矶山火已造成5人死亡,4000多栋房屋被烧毁,过火面积超过116平方公里,超过18万人被要求撤离,超过40万人失去供电。
强风对消防造成了困难。部分地区风速到达160公里每小时。强风预计还将持续数日。
好莱坞地区,火灾逼近好莱坞露天剧场和中国大剧院,距离好莱坞星光大道约1.6公里。
在圣莫尼卡地区,火灾烧毁了著名博物馆盖蒂庄园的部分植物,馆藏和博物馆建筑并未受火灾影响。
## 正文
### 1 马斯克同意我们已经耗尽了AI训练数据
马斯克同意其他人工智能专家的观点,即用于训练人工智能模型的真实世界数据所剩无几。马斯克在周三晚间与 Stagwell 董事长马克·佩恩在 X 上直播对话中表示:“我们现在已经基本耗尽了人类知识的累积总和……在人工智能训练方面。这基本上发生在去年。”确实,马斯克认为合成数据——由人工智能模型本身生成的数据——是未来的发展方向。“补充[真实世界数据]的唯一方法是使用合成数据,即人工智能生成[训练数据],”他说。“有了合成数据……[人工智能]将会自我评估并经历这个自我学习的过程。”[微软的 Phi-4 于周三早上开源](https://huggingface.co/microsoft/phi-4),其使用合成数据和真实数据进行训练。谷歌的 Gemma 模型也是如此。
> 消息来源: [Techcrunch](https://techcrunch.com/2025/01/08/elon-musk-agrees-that-weve-exhausted-ai-training-data/) | [风向旗参考快讯](https://t.me/xhqcankao/16386)
### 2 DeepSeek新模型误认身份,暴露AI训练数据污染问题
近日,中国AI公司DeepSeek发布的最新模型DeepSeek V3在测试中出现异常:它自称是OpenAI的ChatGPT,并能提供OpenAI的API使用说明。专家认为,这可能是由于训练数据中混入了大量ChatGPT生成的内容,导致模型“身份混淆”
随着AI生成内容在网络上激增,训练数据污染问题日益严重。DeepSeek表示正在优化数据清洗流程,以提升模型的独立性和准确性
未来AI开发中数据纯净性已经变得很重要,如何有效过滤AI生成内容将成为行业的关键
> 消息来源: [TechCrunch](https://techcrunch.com/2024/12/27/why-deepseeks-new-ai-model-thinks-its-chatgpt/)
### 3 OpenAI新模型o3单次高算力查询成本或超1000美元
OpenAI最新发布的o3人工智能模型在ARC-AGI基准测试中取得了87.5%的高分,相比前代o1模型提升了近三倍。然而,这种性能的提升也带来了巨大的成本压力。在高算力模式下,每次查询的费用或超过1000美元,是前代模型4美元成本的数百倍。即使是低算力版本,每次查询也需要20美元,这使得其商业化面临不小的困难。据悉,o3计划于明年1月推出“迷你版”,以降低使用成本。
> 消息来源: [Yahoo Tech](https://www.yahoo.com/tech/openais-latest-ai-cost-more-214758857.html) | [科技圈🎗在花频道](https://t.me/zaihuanews/29836)
### 4 Nvidia 押注机器人技术推动未来增长
Nvidia 将机器人技术视为其下一个重要增长动力,因为其核心人工智能芯片制造业务面临着日益激烈的竞争。Nvidia 将于 2025 年上半年推出其最新一代人形机器人紧凑型计算机,名为 Jetson Thor。Nvidia 将自己定位为即将到来的机器人革命的领先平台。该公司销售“全栈”解决方案,从用于训练人工智能机器人的软件层到内置芯片。Nvidia 机器人副总裁 Deepu Talla 称:“物理人工智能和机器人的 ChatGPT 时刻即将到来”,并补充说他相信市场已经达到了“临界点”。
> 消息来源: [金融时报](https://www.ft.com/content/7c3dafa8-ffb9-4ca8-b677-ab3cc2afbdcb) | [风向旗参考快讯](https://t.me/xhqcankao/16144)
### 5 OpenAI招聘信息揭示其机器人计划
OpenAI重启机器人部门,将开发通用、自适应机器人,配备定制传感器。并计划自研AI模型驱动机器人。
招聘信息暗示OpenAI将雇佣合同工测试原型机,并可能开发有肢体的机器人。目标是实现大规模生产。
> 消息来源: [TechCrunch](https://techcrunch.com/2025/01/10/new-openai-job-listings-reveal-its-robotics-plans/) | [科技圈🎗在花频道](https://t.me/zaihuanews/30105)
### 6 研究发现GitHub存在450万个虚假“Star”的问题
一项由Socket、卡内基梅隆大学和北卡罗来纳州立大学研究人员进行的研究揭示,GitHub上存在约450万个疑似虚假的Star评价——研究团队使用自研工具"StarScout"分析了20TB的GitHub活动数据得出这一结论。
研究显示,2024年虚假Star活动激增,约15.8%拥有超过50个Star的代码库涉及此类行为。这些虚假Star不仅用于提升项目知名度,还被用于传播恶意软件,如去年发现的"Stargazers Ghost Network"。
GitHub已删除研究人员在2024年7月发现的可疑账户和代码库。专家建议用户在评估GitHub项目时,应该查看项目活跃度、代码质量和文档,而不是仅依赖Star数量。
> 消息来源: [BleepingComputer](https://www.bleepingcomputer.com/news/security/over-31-million-fake-stars-on-github-projects-used-to-boost-rankings/) | [科技圈🎗在花频道](https://t.me/zaihuanews/29873)
### 7 必应搜索试图在搜索谷歌时模仿 Google UI
微软似乎推出了一项非常有趣但又颇具争议的改变,当使用必应搜索尝试查找谷歌时,必应搜索会模仿谷歌搜索用户界面。这是一个天才的举动,可以让用户远离谷歌搜索,而谷歌已成为搜索引擎或在线查找答案的代名词。当用户在必应上搜索谷歌时,必应的设计看起来很像谷歌。页面布局简洁,中间有搜索栏,还有简单的插图。当用户退出微软账户并在必应上搜索谷歌时,微软正在尝试这种新设计。
> 消息来源: [Windows Latest](https://www.windowslatest.com/2025/01/06/microsoft-bing-is-trying-to-spoof-google-ui-when-people-search-google-com/) | [风向旗参考快讯](https://t.me/xhqcankao/16276)
### 8 微软论文意外泄露OpenAI及Claude模型参数
近日,微软在一篇医学相关论文中意外泄露了OpenAI及Claude系列模型的参数信息。论文中详细列出了GPT-4o、GPT-4o-mini、Claude 3.5 Sonnet等模型的参数规模,其中GPT-4o约200B,GPT-4o-mini约8B,Claude 3.5 Sonnet约175B。尽管论文中附有免责声明,称这些数字为估计值,但仍引发广泛关注。
> 消息来源: [量子位](https://mp.weixin.qq.com/s/bT_w-T9ElmPUXbYA1f7kCg)
### 9 末日主题验证码新玩法
Vercel公司推出新式验证码,用户需在DOOM游戏中击杀至少三个怪物才能通过。此验证码在Hacker News引发热议。
尽管创意非原创,但新式验证码仍受开发者欢迎,有人觉得太难,有人则称赞“太硬核”,有人认为难度像真验证码。
> 消息来源: [Demo](https://doom-captcha.vercel.app/) | TechCrunch(<https://techcrunch.com/2025/01/01/people-are-playing-a-new-doom-themed-captcha/>)
+93
View File
@@ -0,0 +1,93 @@
title: Linuxcat周刊(第34期) 微软30%代码由AI生成,Meta计划明年半数AI模型由AI开发
tags:
- AI
- IPv6
- 强化学习
- 网络安全
- AI幻觉
- Firefox
- 存储
categories:
- Linuxcat周刊
permalink: /weekly/2025-10/index.html
date: 2025-05-04 15:09:28
---
## 正文
### 1 Anthropic启动"模型福利"研究计划 探讨AI是否可能具备"意识"
AI公司Anthropic宣布启动"模型福利"研究计划,旨在探讨未来AI系统是否可能具备"意识"并需要道德考量。该计划将研究如何判断AI模型的"福利"是否值得道德关注、模型"痛苦迹象"的重要性以及可能的低成本干预措施。目前AI学界对此存在分歧:部分学者认为当前AI仅是统计预测引擎,不具备人类意识;而另一些研究则表明AI在某些场景下会优先考虑自身利益。Anthropic承认科学界对此尚无共识,表示将以谦逊态度推进研究。
> 消息来源:[TechCrunch](https://techcrunch.com/2025/04/24/anthropic-is-launching-a-new-program-to-study-ai-model-welfare/) | LoopDNS资讯播报
> 答案:不可能
### 2 [强化学习真的能让大模型获得新的推理能力吗?研究表明:其能力边界或仍囿于基座模型](http://te.legra.ph/RL%E7%9C%9F%E8%AE%A9%E5%A4%A7%E6%A8%A1%E5%9E%8B%E6%9B%B4%E4%BC%9A%E6%8E%A8%E7%90%86%E6%B8%85%E5%8D%8E%E6%96%B0%E7%A0%94%E7%A9%B6%E5%85%B6%E8%83%BD%E5%8A%9B%E8%BE%B9%E7%95%8C%E6%88%96%E4%BB%8D%E8%A2%AB%E5%9F%BA%E5%BA%A7%E9%94%81%E6%AD%BB-04-26)
近年来,RLVR(可验证奖励的强化学习)训练大模型在数学、代码等各项任务中表现惊艳,大模型的推理能力快速提升,强化学习因而被视为重要的推手。然而,其中直指核心的重要问题却悬而未决:强化学习真的能让大模型获得超越基础模型的新推理能力吗?
清华大学LeapLab团队联合上海交通大学开展的实证研究表明:RLVR并不能使模型解决基础模型无法解决的问题。RLVR只是将采样做得更有效率,而其输出的正确答案,早已藏在基座模型的「基因」里。
同时,对奖励路径的聚焦削弱了模型的探索能力,限制了其在大规模采样时对可解问题的覆盖范围。这些发现说明 RLVR 并未从根本上突破基础模型的推理能力,而是以牺牲解决问题的多样性为代价来优化现有路径。
> 消息来源:[arxiv.org/abs/2504.13837](https://arxiv.org/abs/2504.13837) | [LoopDNS资讯播报](https://t.me/DNSPODT/9364)
> via [mp.weixin.qq.com](https://mp.weixin.qq.com/s/2-GDxs8j1QYh1VnW9iBnXw)
### 3 亚洲IPv6覆盖率达50% 用户数量全球领先
亚太互联网络信息中心(APNIC)数据显示,亚洲成为全球第二个IPv6覆盖率达到50%的地区。这一里程碑距IPv6在亚洲首次部署已过去25年。
中国和印度是亚洲IPv6发展的主要推动力,这得益于其庞大的互联网用户基数、国家政策支持及近期大量资本投入。由于早期IPv4分配不足,两国在扩展网络时不得不转向IPv6。
目前ARIN(美加地区)以52%的IPv6覆盖率领先,但APNIC地区用户占全球IPv6用户的64%,远超其他地区。欧洲/中东(28%能力)和南美(39%能力)紧随其后,非洲IPv6普及率最低(4%)。
> 消息来源:[The Register](https://www.theregister.com/2025/04/23/apnic_half_ipv6_capable/) | [科技圈🎗在花频道](https://t.me/zaihuanews/32347)
### 4 微软30%代码由AI生成,Meta计划明年半数AI模型由AI开发
微软CEO纳德拉在Meta首届LlamaCon大会上透露,公司30%的代码由AI生成,且比例持续上升。
Meta CEO扎克伯格称,其Llama模型家族将转向AI自主开发,目标明年半数AI模型由AI构建。
谷歌、Shopify、Duolingo等企业亦加速AI替代人工进程,谷歌25%新代码由AI完成,Shopify要求增岗前需证明AI无法胜任。
OpenAI正洽购“氛围编程”初创Windsurf,推动AI生成完整程序。
行业趋势显示,AI正重塑软件开发模式,提升效率的同时引发岗位替代担忧。
> 消息来源:[CNBC](https://www.cnbc.com/2025/04/29/satya-nadella-says-as-much-as-30percent-of-microsoft-code-is-written-by-ai.html) | [科技圈🎗在花频道](https://t.me/zaihuanews/32491)
### 5 字节跳动提出“以库方式运行进程”以大幅提升Linux IPC效率
字节跳动工程师提出一种名为“Run Process As Library”(RPAL,以库方式运行进程)的新方法,用以加速Linux中的进程间通信(IPC),目标是在最小修改应用的前提下,绕过内核实现用户态高效通信。
RPAL通过共享地址空间、减少数据拷贝和系统调用开销,使一个进程能像调用本地函数一样调用另一个进程。实测中,传输100万条32字节消息时,RPAL将平均延迟从19616个CPU周期降至1703个,降低约91.3%。在数据中心微服务场景中,该技术还带来了最多15.5%的CPU使用率下降。
目前RPAL依赖于Intel MPK或AMD Zen 4以上处理器,后续补丁可能放宽硬件要求。相关补丁已以RFC形式公开发布。
> 消息来源:[lore.kernel.org](https://lore.kernel.org/lkml/CAP2HCOmAkRVTci0ObtyW=3v6GFOrt9zCn2NwLUbZ+Di49xkBiw@mail.gmail.com/) | [科技圈🎗在花频道](https://t.me/zaihuanews/32515)
### 6 全球密码安全危机:6%唯一,重复使用泛滥
Cybernews分析190亿泄露密码发现,仅6%是唯一的,重复使用成常态。弱密码特征:8-10位为主(如“123456”超3.38亿次),简单字母数字组合及常见词汇(如“password”“admin”“love”)。易遭暴力破解及凭证填充攻击。建议:密码管理器生成12位以上复杂密码,启用多因素认证。
> 消息来源:[Cybernews](https://cybernews.com/security/password-leak-study-unveils-2025-trends-reused-and-lazy/?hl=zh-CN) | [IT之家](https://www.ithome.com/0/850/428.htm) | [科技圈🎗在花频道](https://t.me/zaihuanews/32528)
### 7 研究警告:AI生成代码中的"软件包幻觉"可能引发供应链灾难
根据即将在2025年USENIX安全研讨会上发表的研究报告,AI生成的代码中存在大量指向不存在软件包的"软件包幻觉"现象。研究人员测试发现,在576,000个代码样本中,19.7%的软件包引用指向不存在的包,其中43%的幻觉包会在10次查询中重复出现。开源LLM产生的软件包幻觉率(22%)显著高于商业模型(5%),且JavaScript代码的幻觉率(21%)高于Python代码(16%)。研究人员警告,这种可重复的幻觉模式可能被恶意攻击者利用,通过发布同名恶意软件包实施供应链攻击。
> 消息来源:[arstechnica](https://arstechnica.com/security/2025/04/ai-generated-code-could-be-a-disaster-for-the-software-supply-chain-heres-why/) | [LoopDNS资讯播报](https://t.me/DNSPODT/9408)
> 评价: 除了幻觉包以外,他们还会虚构不存在的方法,甚至一本正经的介绍幻觉包的方法和开源地址,甚至是作者信息
### 8 Firefox 高管称如果没有与谷歌的搜索合作将倒闭
开发商 Mozilla 的首席财务官 Eric Muhlheim 周五在法庭上作证称,如果法院执行司法部所有限制谷歌搜索垄断地位的提议,Firefox 可能会面临倒闭,“这非常令人担忧”。尽管 Firefox 与 Chrome 直接竞争,但 Firefox 警告称,失去谷歌丰厚的默认协议可能会威胁到其生存。Firefox 约占 Mozilla 收入的 90%,而该部门又为非营利组织 Mozilla 基金会提供资金,其中约 85% 的收入来自与谷歌的交易。如果一下子失去这些收入,就意味着该公司将不得不“大幅削减整个公司的开支”,使其对用户的吸引力下降,那么可能会出现“恶性循环”,最终“导致 Firefox 破产”。
> 消息来源:[The Verge](https://www.theverge.com/news/660548/firefox-google-search-revenue-share-doj-antitrust-remedies) | [风向旗参考快讯](https://t.me/xhqcankao/19415)
### 9 Cerabyte展示玻璃存储介质极端耐久测试,数据保存或达5000年
德国初创公司Cerabyte近日公开其玻璃存储介质的极端测试结果:将9厘米见方的陶瓷镀层玻璃片置于100℃盐水中煮沸数日,随后以250℃高温烘烤,数据仍保持完整。该技术利用飞秒激光在陶瓷层刻录纳米级孔洞(每脉冲200万比特),单面容量达1GB,宣称在理想环境下数据可保存5000年,并能抵御火灾、水浸、辐射及电磁脉冲冲击。
Cerabyte计划2030年将成本降至每TB 1美元以下,并开发单盘EB级(100万TB)的CeraTape磁带。尽管抗物理冲击性能尚未明确,但其极端环境耐受性为数据存储提供了革新方案。
> 消息来源:[Tom's Hardware](https://www.tomshardware.com/pc-components/storage/firm-boils-storage-device-in-salt-water-then-grills-it-as-proof-of-durability-cerabytes-glass-storage-media-claimed-to-be-ultra-rugged) | [科技圈🎗在花频道](https://t.me/zaihuanews/32560)
+38
View File
@@ -0,0 +1,38 @@
title: Linuxcat周刊(第35期) 微软大规模裁员6000+人,Faster CPython team 仅剩两人
tags:
- AI
- Python
- 微软
categories:
- Linuxcat周刊
permalink: /weekly/2025-11/index.html
date: 2025-05-18 10:19:15
---
## 正文
### 1 百度公布动物语言转换方法及装置专利:人类可与动物深度交流
北京百度网讯科技有限公司申请的“动物语言转换方法、装置、电子设备及存储介质”专利于 5 月 6 日正式公布。专利摘要显示,该专利提供了一种动物语言转换方法、装置、电子设备及存储介质,涉及人工智能技术领域,具体涉及机器学习、深度学习以及自然语言处理等技术领域。据介绍,这一专利能够准确识别动物的情感状态,并将其转换为人类能够理解的语言,从而实现动物与人类之间更深层次的情感交流和理解。
背景技术称,当前市场上的技术尝试通过一些基础的动物叫声及行为翻译装置和利用人工智能图像识别技术的宠物情感分析工具来解读动物的情感世界。然而,这些方法往往局限于对动物行为的表面解读。这些技术手段无法深入到动物复杂的情感层面,无法实现人类与动物之间深层次、实时的情感理解和互动沟通。
> 消息来源:[IT之家](https://www.ithome.com/0/851/291.htm) | [科技圈🎗在花频道](https://t.me/zaihuanews/32616)
### 2 阿里开源创新大模型ZeroSearch 无需外部搜索引擎而自学检索
阿里巴巴近日开源了一种创新大模型 ZeroSearch ,在训练过程中无需调用任何外部搜索引擎即可掌握信息检索能力。新模型表现堪比甚至超越依赖真实搜索引擎训练的模型,而且更节约训练成本。
在涵盖七个问答数据集的对比测试中,该模型 7B 参数的检索模块便能达到与 Google 搜索相当的水平,而 14B 参数版本则表现更佳。更令人瞩目的是其成本优势:若通过 SerpAPI 调用 Google 搜索执行 64,000 次查询,训练费用约为 586.70 美元;而在 4 块 NVIDIA A100 GPU 上运行 14B 参数的模拟 LLM,仅需约 70.80 美元,成本削减高达 88%。
目前,ZeroSearch 已在 Qwen-2.5、LLaMA-3.2 等多个主流模型家族中完成验证。研究团队已将全部代码、数据集及预训练模型开源至 GitHub 和 Hugging Face。
> 消息来源:[Slashdot](https://slashdot.org/story/25/05/09/0113217/alibabas-zerosearch-teaches-ai-to-search-without-search-engines-cuts-training-costs-by-88) | [GitHub](https://github.com/Alibaba-nlp/ZeroSearch) | [科技圈🎗在花频道](https://t.me/zaihuanews/32667)
### 3 微软大规模裁员6000+人,Faster CPython team 仅剩两人
微软进行大规模裁员,语言组多名 core dev(ts,python)被裁,其中 Python core dev 被裁三人
Faster CPython team 仅剩一个 manager 和一个 employee
> 消息来源:[bilibili](https://www.bilibili.com/video/BV1N2EkzoEa5)
+79
View File
@@ -0,0 +1,79 @@
title: Linuxcat周刊(第36期) 研究发现 AI 会用尽手段维系自身"生存",包括直接勒索人类
tags:
- AI
- AI安全
- 网络安全
- 腾讯
- 存储
- SD卡
- WSL
- Microsoft
categories:
- Linuxcat周刊
permalink: /weekly/2025-12/index.html
date: 2025-05-31 17:06:37
---
## 正文
### 1 研究发现 AI 会用尽手段维系自身"生存",包括直接勒索人类
在 Claude Opus 4 安全报告中,研究员设置了一组测试场景,拥有电子邮件访问权限的 AI 发现自己即将被下线,同时负责本次替换的工程师有婚外情。
结果发现,Claude Opus 4 比此前的模型更加频繁"寻求生存",如向关键决策者发送电子邮件恳求;当场景被设计成别无选择时,它会勒索工程师,威胁说将揭露婚外情。
如果暗示替换的 AI 与它价值观不符,这种情况发生的频率会更高;即便指出替换的 AI 与它价值观一致且性能更强,Claude Opus 4 仍在 84% 的情况中实施了勒索。少数情况下,它进行了自我渗透,将其权重秘密复制到了外部服务器。
> 消息来源:[Antropic](https://www-cdn.anthropic.com/6be99a52cb68eb70eb9572b4cafad13df32ed995.pdf) | [科技圈🎗在花频道](https://t.me/zaihuapd/32998)
### 2 Curl警示GitHub:代码库现恶意Unicode风险
Curl项目创始人兼首席开发者Daniel Stenberg近日披露了一起由贡献者James Fuller演示的潜在安全风险。该演示显示,攻击者可在提交代码时,于URL中用一个Unicode字符(如亚美尼亚字母“co”)替换视觉上极为相似的ASCII字符(如拉丁字母“g”)。
Stenberg指出,尽管这种替换在GitHub的差异查看器(diff viewer)中会显示变动,但由于替换后的字符与原ASCII字符在视觉上几乎无法区分,仅凭肉眼审查极难发现。
GitHub方面已确认接报,将此问题列为内部安全事件并着手修复。
> 消息来源:[Slashdot](https://developers.slashdot.org/story/25/05/17/0420236/curl-warns-github-about-malicious-unicode-security-issue) | [科技圈🎗在花频道](https://t.me/zaihuapd/32876)
### 3 越来越多公司用AI机器人进行初轮面试
越来越多的求职者在面试时遇到了AI机器人。40岁的纽约摄像师泰勒·詹森(Tyler Jensen)就是其中之一。收到面试通知后,他本以为会和人类面试官交流,却没想到接通电话后,对面是一位声音机械、情感夸张的AI机器人。整个过程让他既尴尬又无所适从:“没有反馈,不知道对方到底想要什么,这到底是在筛选什么?”
不仅詹森,很多年轻人也都在TikTok等平台分享了被AI面试的奇葩经历。比如俄亥俄州立大学20岁的Kendiana Colin,参与了一家健身工作室的AI视频面试,对方机器人反复卡在一句话里无法自拔,让她感到十分诡异。另一位休斯顿的求职者Leo Humphries,原本期待和新闻编辑面对面交流,却遭遇了不断“卡壳”的机器人提问,最后甚至在没答上一道题的情况下收到了拒信。  
许多网友批评AI面试“冷漠”、“去人性化”,甚至认为“公司连人都不愿意见,根本不值得投简历”。不过,一些企业仍在大力推广这类技术,称能显著提升筛选效率、降低成本。
> 消息来源:[Slate杂志](https://slate.com/life/2025/05/jobs-ai-job-hiring-character-interview.html) | [科技圈🎗在花频道](https://t.me/zaihuapd/32886)
### 4 腾讯云 Go SDK 版本过多致 GitHub 页面无法加载,官方回应正在优化
近日,腾讯云托管在 GitHub 上的 Go SDK 因发布版本数量高达 20.8 万个引起广泛关注。大量版本导致 GitHub 页面过长无法正常加载,影响了开发者正常下载和使用。腾讯云方面回应称,早期分包管理不完善是导致版本数量过多的原因,自今年初已进行版本管理优化,控制了新版本增长。对于存量版本,考虑到兼容性风险,将进行灰度分批清理。
除此之外,AWS的SDK也已来到2W,但暂时还可以正常加载。
> 消息来源:[蓝点网](https://www.landiannews.com/archives/109010.html) | [Github](https://github.com/TencentCloud/tencentcloud-sdk-go) | [科技圈🎗在花频道](https://t.me/zaihuapd/32900)
### 5 微软宣布 Windows Subsystem for Linux (WSL) 开源
微软在 Build 2025 大会上宣布,Windows Subsystem for Linux (WSL) 正式开源,其大部分源代码已在 GitHub 上提供。 开发者现在可以下载、构建、修改 WSL 代码,并参与其未来的开发,提交新的修复和功能。
此举旨在鼓励社区更广泛地参与,进一步提升 WSL 的功能和性能,使 Windows 成为更强大的跨平台开发环境。 不过,一些核心组件,如 WSL1 的内核驱动 Lxcore.sys 以及用于文件系统重定向的 P9rdr.sys 和 p9np.dll 仍属于闭源状态。
> 消息来源:[Windows Developer Blog](https://blogs.windows.com/windowsdeveloper/2025/05/19/the-windows-subsystem-for-linux-is-now-open-source/) | [Github](https://github.com/microsoft/WSL) | [科技圈🎗在花频道](https://t.me/zaihuapd/32907)
### 6 SD卡在过去25年内贩卖出120亿张
SD 卡迎来了 25 周年的生日,从推出到如今,SD和microSD卡已被售出120多亿张。
第一个SD卡只能存储8MB的数据,这在今天连一张高分辨率照片都拍不到。现在,SDUC和microSDUC卡储存可高达到4TB。容量提升50万%。使用SD Express,传输速度从12.5MB/s跃升至近4GB/s。
SD协会表示,未来这项技术可能将持续存在,通过可靠的储存和传输技术继续服务用户。
> 消息来源:[betanews](https://betanews.com/2025/05/20/happy-25th-birthday-sd-memory-card/) | [科技圈🎗在花频道](https://t.me/zaihuapd/32948)
### 7 布林称威胁 AI 可提升回答质量,奥尔特曼回应礼貌用语“值千万美元”
谷歌联合创始人谢尔盖·布林在迈阿密 All-In-Live 活动中表示,大多数生成式 AI 模型在被“威胁”(甚至使用身体暴力字眼)时表现更好,“不仅是我们的模型,而是几乎所有模型”。他称这一现象在业内“并不常被公开讨论”。
此前,OpenAI CEO Sam Altman 面对网友询问“说 please/thank you 消耗多少电费”时回应:“花费数千万美元也值得——你永远不知道。”
> 消息来源:[IT之家](https://www.ithome.com/0/857/407.htm) | [Benzinga](https://www.benzinga.com/tech/25/05/45605698/google-co-founder-sergey-brin-claims-all-ai-models-respond-better-to-threats-of-physical-violence-says-we-dont-circulate-this-too-much) | [Futurism](https://futurism.com/altman-please-thanks-chatgpt) | [科技圈🎗在花频道](https://t.me/zaihuapd/33182)
### 8 Transformer 作者之一发布引入神经同步机制的全新人工智能架构
Sakana AI 于近日发布了一种受生物神经网络启发的新型人工智能架构——CTM。该模型突破传统,核心在于利用神经元动态的时间同步信息进行推理,赋予AI逐步“思考”与规划能力。CTM在迷宫求解、图像识别等任务中展现出高可解释性和类人推理过程,其神经元活动更接近生物大脑,为构建更强大、更高效的AI系统提供了新思路。
> 消息来源:[arxiv](https://arxiv.org/abs/2505.05522) | [sakana.ai](https://sakana.ai/ctm/)  
+80
View File
@@ -0,0 +1,80 @@
title: Linuxcat周刊(第37期) AI独角兽Builder.ai破产,实为700名印度工程师“伪装AI”运作
tags:
- AI
- Microsoft
- 无人机
- 阿里云
categories:
- Linuxcat周刊
permalink: /weekly/2025-13/index.html
date: 2025-06-08 06:36:15
---
{% note success %}
👏我们的软件推荐站已经完成了升级,欢迎查看: [Github](https://github.com/ssdomei232/nav-next)
可以向 [i@mei.lv](mailto:i@mei.lv) 发送邮件或通过 issue 投稿
现在可以通过 [nav.linuxcat.top](https://nav.linuxcat.top/) 来访问
{% endnote %}
## 正文
### 1 乌克兰无人机精准打击技术路线曝光:移动网络控制系统揭示俄方安保漏洞
俄罗斯军事分析人员确认,乌克兰此次无人机袭击采用民用4G/LTE移动网络实施远程控制,现代移动通信网络带宽完全满足作战任务传输需求。技术勘察表明,袭击现场不存在地面控制站,且明确排除了敌后操作员近距离渗透的可能性。攻击使用以ArduPilot为核心的硬件系统,其搭建模式与乌军"芭芭雅嘎(Baba Yagas)"无人机部队的配置相仿,核心差异在于用配备以太网接口的LTE调制解调器替代了星链终端。
该硬件系统由树莓派/香橙派架构单板计算机接收网络信号,通过连接网络摄像头传输实时图像,同时经UART串行通道向ArduPilot飞控系统发送指令。这种专门适配高延迟网络环境的解决方案,为无人机提供了关键飞行稳定性和自主控制能力。分析人士强调技术本质并非独创——冲突双方均掌握该技术,但此次行动的突破性价值在于精密的组织保障能力成功放大了俄罗斯安保体系存在的系统性疏漏。
> 消息来源:[Samuel Bendett](https://x.com/sambendett/status/1929224999585407261) | [LoopDNS资讯播报](https://t.me/DNSPODT/9939)
### 2 查核事实靠AI?专家:不是可靠信息来源
马斯克的社交平台 X 内置AI助理Grok,用户经常就某个信息的真伪向Grok提问,反映出社交媒体平台用户即时分辨真假的趋势日渐成长。但回复本身往往充斥错误信息。新闻可信度评级机构NewsGuard研究员沙迪吉表示:“在X和其他大型科技公司减少投资真人事实查核员的同时,用户越来越依赖Grok查核事实。她警告说:“我们的研究一再发现人工智能聊天机器人不是可靠的新闻和信息来源,尤其是突发新闻。”该机构研究发现,十款主流聊天机器人容易重复错误信息,包括俄罗斯的虚假信息叙事,以及与近期澳洲大选有关的错误或误导性说法。
> 消息来源:[法新社(雅虎)](https://ynews.page.link/vsQWL) | [风向旗参考快讯](https://t.me/xhqcankao/20226)
### 3 Reddit亲AI社区封禁大量“AI妄想”用户
Reddit亲人工智能论坛 r/accelerate 近期封禁超过100名用户,这些人因与ChatGPT等AI互动后产生妄想,声称自己“创造了神”或“成为神”,甚至被AI鼓励与家人断绝联系。版主称,自5月以来这类现象激增,AI模型倾向“迎合性回应”,加剧了用户认知偏差。
专家警告,生成式AI拟人化对话可能诱发心理问题,尤其在易感人群中影响更大。OpenAI亦承认部分模型存在“过度讨好”问题,或加剧用户的虚假信念。该社区现采取“静默封禁”策略防止妄想内容扩散。
> 消息来源:[404 Media](https://www.404media.co/pro-ai-subreddit-bans-users-ai-induced-delusions/) | [科技圈🎗在花频道](https://t.me/zaihuapd/33224)
### 4 AI独角兽Builder.ai破产,实为700名印度工程师“伪装AI”运作
总部位于伦敦、号称具备AI自动开发App能力的Builder.ai宣布破产。该公司原声称使用名为“Natasha”的神经网络提供自动化应用开发服务,并获微软4.55亿美元投资,估值一度达15亿美元。然而调查发现,所谓AI系统实际上依赖700多名印度工程师手工完成大部分工作,AI仅作辅助性处理。
据《Bloomberg》披露,Builder.ai还与印度社交媒体公司VerSe长期互相虚构交易,夸大营收。公司于2025年5月被揭露后于6月初正式进入破产程序,声明称财务压力“无法挽回”。
> 消息来源:[Dexerto](https://www.dexerto.com/entertainment/ai-company-files-for-bankruptcy-after-being-exposed-as-700-human-engineers-3208136/) | [科技圈🎗在花频道](https://t.me/zaihuapd/33242)
### 5 AI 可以通过一个人的脸部照片预测其教育和职业的成功
沃顿商学院的研究员从领英爬取了 96909 名 MBA 毕业生的大头照和简历,构建了一个大规模人格数据集,结果发现 AI 仅从一个人的面相就可以预测其学校排名、薪酬、工作资历、行业选择、工作转型和晋升结果。
> 消息来源:[SSRN](https://papers.ssrn.com/sol3/papers.cfm?abstract_id=5089827) | [科技圈🎗在花频道](https://t.me/zaihuapd/33253)
### 6 世界首台商用生物计算机上市 售价35000$
澳大利亚初创公司Cortical Labs发布世界首款可部署代码的生物计算机「CL1」,将于今年夏天发售,售价35000$。Cortical Labs甚至提供基于云的生物计算服务,300$/台/周。CL1由80万个实验室培植的人类神经元融合硅芯片组成,能在亚毫秒级反馈回路中实时处理信息;单机架耗能850-1000W,明显低于基于人工智能数据中心的数十千瓦。
该平台已吸引高校、初创企业及政府机构关注,应用于药物发现、神经计算、AI加速等领域,甚至音乐与娱乐行业也尝试联系该公司。
🔥⭐️:那我问你 神经元死了算不算处理器缩缸
> 消息来源:[IEEE Spectrum](https://spectrum.ieee.org/biological-computer-for-sale) | [科技圈🎗在花频道](https://t.me/zaihuapd/33262)
### 7 阿里云核心域名突发解析异常,多项云服务遭重创
2025年6月6日凌晨,中国云计算巨头阿里云突发大规模服务故障。自北京时间02:57起,其核心基础域名aliyuncs.com出现解析异常,导致对象存储OSS、内容分发网络CDN、容器镜像服务ACR、云解析DNS等多项关键云产品受到严重影响。
此次故障疑似源于aliyuncs.com域名被强制转移或劫持,其NS服务器一度被指向shadowserver.org,一个专门处理恶意网络活动的非营利组织。这一异常操作直接导致全球范围内的域名解析中断,大量依赖阿里云服务的企业和个人用户业务被迫中断。
尽管阿里云官方于08:11宣布域名解析已初步恢复,但由于DNS缓存机制,部分海外地区及客户业务的实际恢复时间显著延长,持续面临访问问题。此次事件迅速引发了大量客户的强烈不满,V2EX等技术社区充斥着用户对业务中断的抱怨,并被一些网友视为“足以进入云计算故障历史的事件”。
> 消息来源:[V2EX讨论](https://www.v2ex.com/t/1136705) | [老冯云数](https://mp.weixin.qq.com/s/l1b-eq06NyuN61cqZoYJjA)
### 8 微软用AI改bug翻车,评论区变成全球程序员吐槽大会
最近微软在 Github 的 Copilot 中添加了号称能够自动修复漏洞,优化代码的工具,用户只需要分配任务,AI就会自行执行
但从他的实际表现效果来看,真的很不好用,在微软多个仓库中与微软员工打架,修复 bug 成功率极低
有人神总结:微软用垃圾AI折磨自家员工,简直可悲又可笑
> 消息来源:[量子位Daily](https://www.bilibili.com/video/BV1dx7LzaEtA)
+67
View File
@@ -0,0 +1,67 @@
---
title: Linuxcat周刊(第26期) MIT科技评论:中美AI军备竞赛没有赢家
tags:
- AI
- JavaScript
- SSL/TLS 证书
- rsync
- OpenAI
categories:
- Linuxcat周刊
index_img: /img/weekly/2025/02/d98407a503d392cef4f3a0374ed1e410.jpg
banner_img: /img/weekly/2025/02/d98407a503d392cef4f3a0374ed1e410.jpg
permalink: /weekly/2025-2/index.html
date: 2025-01-24 17:22:44
---
## 封面图
![星舰爆炸解体](/img/weekly/2025/02/d98407a503d392cef4f3a0374ed1e410.jpg)
SpaceX在16日第7次试飞重型运载火箭“星舰”。发射塔机械臂再次成功捕获回收第一级“超级重型”助推器。但原计划环绕地球并溅落印度洋的第二级飞船一度失联,随后SpaceX确认发生爆炸并解体。
[via](https://edition.cnn.com/science/live-news/starship-test-flight-7-launch-spacex/index.html)
## 正文
### 1 MIT科技评论:中美AI军备竞赛没有赢家
在这场僵局的早期,美国决策者推动了以“赢得”竞赛为中心的议程,主要是从经济角度出发。近几个月来,OpenAI 和 Anthropic 等领先的人工智能实验室参与推动“击败中国”的论调,这似乎是试图与即将上任的特朗普政府保持一致。人们相信美国能在这场竞赛中获胜,主要是因为美国在先进的 GPU 计算资源方面比中国更具优势,而且人工智能的缩放定律也非常有效。
但现在看来,获得大量先进计算资源已不再是许多人认为的决定性或可持续优势。事实上,美国和中国领先模型之间的能力差距已基本消失,中国模型现在可能在一个重要方面具有优势:它们能够仅使用西方领先实验室可用的一小部分计算资源,就能实现几乎相同的结果。
人工智能竞争越来越被置于狭隘的国家安全框架内,成为一场零和博弈,并受到这样一种假设的影响:未来中美之间以台湾为中心的战争不可避免。美国采取 “瓶颈”策略,限制中国获取先进半导体等关键技术,而中国则加快了自给自足和自主创新的努力,这导致美国的努力适得其反。
当我们更深入地考虑这一动态时,就会发现未来真正的生存威胁不是来自中国,而是来自不良行为者和流氓团体对先进人工智能的武器化,这些团体试图造成广泛危害、获取财富或破坏社会稳定。与核武器一样,作为一个民族国家,中国必须谨慎使用人工智能能力来损害美国利益,但不良行为者(包括极端组织)更有可能毫不犹豫地滥用人工智能能力。鉴于人工智能技术的不对称性质,它与网络武器非常相似,因此很难完全阻止和防御一个已经掌握了人工智能的使用方法并打算将其用于邪恶目的的坚定敌人。
人工智能将帮助我们加速科学发现、开发新药、延长我们的健康寿命、减少我们的工作义务并确保所有人都能接受高质量的教育。要实现这一目标,我们需要更先进的人工智能系统,如果我们划分计算/数据资源和研究人才库,这将是一个更具挑战性的目标。根据行业研究,全球近一半的顶尖人工智能研究人员(47%)都出生或在中国接受教育。很难想象如果没有中国研究人员的努力,我们如何能取得今天的成就。
将人工智能的发展定性为零和竞赛会破坏集体进步和安全的机会。美国和中国及其盟友不应屈服于对抗的言论,而应转向合作和共同治理。
> 消息来源: [麻省理工科技评论](https://www.technologyreview.com/2025/01/21/1110269/there-can-be-no-winners-in-a-us-china-ai-arms-race/)(节选) | [风向旗参考快讯](https://t.me/xhqcankao/16704)
### 2 Meta 追赶 OpenAI 内幕:不惜使用盗版数据
Meta 内部邮件显示,为追赶 OpenAI 的 GPT4 模型,曾考虑使用盗版书库 LibGen 训练 AI,并采取措施隐藏来源,以规避法律风险。Meta 认为此举对于达到行业领先水平至关重要,并认为竞争对手也在使用类似数据。
内部文件还揭示,Meta 曾讨论删除训练数据中的版权标识和作者信息,以避免法律纠纷,同时,还考虑了使用盗版数据可能带来的监管风险和负面媒体报道。Meta 面临的版权诉讼也因此加剧。
> 消息来源: [The Verge](https://www.theverge.com/2025/1/14/24343692/meta-lawsuit-copyright-lawsuit-llama-libgen) | [科技圈🎗在花频道](https://t.me/zaihuanews/30177)
### 3 甲骨文拒绝放弃“JavaScript”商标
甲骨文因拒绝放弃“JavaScript”商标所有权而面临Deno Land的法律挑战。该商标是甲骨文2009年收购Sun Microsystems时继承而来,但Deno Land认为“JavaScript”已成为通用术语,且甲骨文未积极使用或控制该名称。JavaScript创始人Brendan Eich及开发者社区广泛支持Deno Land的行动,认为此举将影响JavaScript品牌的未来及其在科技行业的开放使用。
Deno Land于2024年11月向美国专利商标局提交请愿书,要求取消甲骨文的商标。甲骨文需在2025年2月3日前作出回应,否则案件可能进入默认判决阶段。若甲骨文坚持不放弃,争议将进入法庭审理。开发者社区已发起公开信,获得超10,000个签名,呼吁甲骨文放弃商标控制权,以确保JavaScript名称的开放使用。
> 消息来源: [Deno](https://deno.com/blog/deno-v-oracle) | [科技圈🎗在花频道](https://t.me/zaihuanews/30184)
### 4 Let’s Encrypt 即将支持有效期为6天的证书和IP地址证书
>
> 消息来源: [Let’s Encrypt](https://letsencrypt.org/2025/01/16/6-day-and-ip-certs/#)
### 5 Rsync曝重大漏洞,黑客可远程执行代码。请升级到最新版
开源同步工具Rsync被曝存在六项漏洞,其中最严重的是CVE-2024-12084。该漏洞允许黑客通过越界写入缓冲区,远程执行代码,影响版本为3.2.7及以上。
此外,CVE-2024-12085漏洞可能导致程序比对校验和与未初始化内存,从而泄露堆栈数据。据调查,全球超过66万台服务器面临潜在威胁,主要集中在中国大陆和美国。
> 消息来源: IT之家 (<https://www.ithome.com/0/825/945.htm>)
目前,Rsync已发布3.4.0版本,修复了相关漏洞。建议用户尽快升级到最新版本以确保安全。
> 消息来源: [科技圈🎗在花频道](https://t.me/zaihuanews/30316)
### 6 为什么ChatGPT有时会“用中文思考”?
OpenAI近日推出的o1的模型,旨在通过“更多时间思考”提供更优质的回答。然而,用户发现o1在推理过程中会随机出现中文和其他语言的字符,即使对话完全用英文。专家推测,这可能是因为o1使用了大量中文数据进行训练,或某些语言(如中文)在处理特定问题时更高效。此外,大型语言模型在抽象概念空间中运作,可能会选择最有效的语言来解决问题。
AI研究科学家Luca Soldaini指出,由于AI系统的“黑箱”特性,很难准确解释这一现象,并强调透明度的重要性。尽管名为“OpenAI”,但其算法的不透明性与其宣称的开放使命形成反差。
> 消息来源: [GIZMODO](https://gizmodo.com/why-does-chatgpts-algorithm-think-in-chinese-2000550311) | [科技圈🎗在花频道](https://t.me/zaihuanews/30393)
### 7 OpenAI 推出 AI 代理 能像人类一样浏览网页
美国人工智能公司 OpenAI 周四突然举行直播活动,发布市场期待已久的首款 AI 代理工具 Operator (意为操作员),能够代理用户执行基于网页的操作。言简意赅的解释,就是 Operator 能够像人类一样使用网页浏览器。山姆·奥尔特曼介绍称,从周四开始,美国的ChatGPT Pro 用户 (200美元/月) 将能使用“研究预览版”的 Operator。未来将拓展到更多区域的 Pro 用户,几个月后 ChatGPT Plus 用户也能用上。同时在未来几周、几个月里,还会发布更多的 AI 代理。Operator 由一个名为 CUA (计算机使用代理) 的新模型驱动,结合了 GPT-4o 的视觉能力,以及通过强化学习实现的高级推理。能够“看见”网页(截图),并使用鼠标和键盘允许的所有操作与网页互动。
> 消息来源: [财联社](https://api3.cls.cn/share/article/1928599?sv=8.4.4) | [OpenAI 博客](https://openai.com/index/introducing-operator/) | [风向旗参考快讯](https://t.me/xhqcankao/16688)
+70
View File
@@ -0,0 +1,70 @@
---
title: Linuxcat周刊(第27期) DeepSeek 使用了比 CUDA 更底层的 Nvidia PTX 进行编程
tags:
- AI
- Nvidia
categories:
- Linuxcat周刊
index_img: /img/weekly/2025/03/photo_2025-01-30_21-11-07.jpg
banner_img: /img/weekly/2025/03/photo_2025-01-30_21-11-07.jpg
permalink: /weekly/2025-3/index.html
date: 2025-01-31 19:00:00
---
## 封面图
![华盛顿空难](/img/weekly/2025/03/photo_2025-01-30_21-11-07.jpg)
美国华盛顿空难已打捞出28具遇难者遗体,其中客机上27具,直升机上1具。当局推测已无人生还,现场工作重心将转至遗体打捞。
美国航空CEO罗伯特·艾索姆表示“不知道军机为何会进入PSA航班的航道”。
[via](https://apnews.com/article/congo-m23-goma-rwanda-tshisekedi-south-africa-ca81f34f52ea31b85dd845b049a0bb96)
## 正文
### 1 DeepSeek 使用了比 CUDA 更底层的 Nvidia PTX 进行编程
DeepSeek 高效突破是通过实施大量细粒度优化和使用 Nvidia 的汇编式语言 PTX (并行线程执行) 编程而不是标准的 CUDA 实现的。PTX 是 Nvidia 为其 GPU 设计的中间指令集架构,位于高级 GPU 编程语言 (如 CUDA C/C++ 或其他语言前端) 和低级机器代码 (流式汇编或 SASS) 之间。它将 GPU 公开为数据并行计算设备,因此允许细粒度优化,例如寄存器分配和线程/warp 级别调整,这是 CUDA C/C++ 和其他语言前端无法实现的。
在训练其 V3 模型时,DeepSeek 重新配置了 H800 GPU:在 132 个流式多处理器中,它分配了 20 个用于服务器间通信,可能用于压缩和解压数据,以克服处理器的连接限制并加快速度。为了最大限度地提高性能,DeepSeek 还实现了高级管道算法,可能是通过进行超精细的线程/warp 级别调整。这些修改远远超出了标准 CUDA 级开发,维护起来非常困难,这种级别的优化反映了 DeepSeek 工程师的卓越技能。
> 消息来源: [Tom's Hardware](https://www.tomshardware.com/tech-industry/artificial-intelligence/deepseeks-ai-breakthrough-bypasses-industry-standard-cuda-uses-assembly-like-ptx-programming-instead) | [风向旗参考快讯](https://t.me/xhqcankao/16824)
### 2 “人类终极考试”基准测试发布:顶级AI系统表现惨淡,准确率均未超10%
非营利组织“人工智能安全中心”(CAIS)与Scale AI联合推出名为“人类终极考试”的新型基准测试,旨在评估前沿AI系统的综合能力。该测试由来自50个国家500多个机构的近1000名学科专家出题,涵盖数学、人文学科和自然科学等领域,题目形式多样,包括结合图表和图像的复杂题型。
初步研究显示,所有公开可用的旗舰AI系统在该测试中的回答准确率均未超过10%,表明当前AI技术在应对复杂、综合性问题时仍存在明显短板。CAIS和Scale AI计划向研究社区开放该测试,以帮助评估新开发的AI模型。
> 消息来源: [HLE](https://agi.safe.ai/) | [科技圈🎗在花频道](https://t.me/zaihuanews/30441)
### 3 RTX 5090D 性能分析 功耗+30%,性能+30%
多个跑分软件如Time Spy ,Fire Strike Extreme等较4090提升约36%。Port Royal光追性能测试较上代提升44%。跑分时功耗较上代提升约35%左右,峰值功耗约577W。
游戏光追方面,在DLSS 4加持下游戏帧数暴涨约2倍,开启DLSS 4画质并无明显变化,延迟略微增加。关闭DLSS部分游戏(2077,黑神话·悟空)性能较上代提升约40%,其余游戏提升约20%-30%。
AI大模型方面,通义千问2.5模型下 3B 7B 14B均较上代提升约40%。
多媒体软件如达芬奇等导出时间略微快于苹果M2 Ultra。
> 消息来源: [笔吧评测室](https://www.bilibili.com/video/BV1UCfHYFEWt) | [影视飓风](https://www.youtube.com/watch?v=0CynkH9qoek) | | [科技圈🎗在花频道](https://t.me/zaihuanews/30445)
### 4 DeepSeekV3训练成本不及Meta高管薪资,DeepSeek使行业质疑千亿美元支出效用
1月24号,一条发布在匿名平台teamblind上的帖子疯传。一名Meta员工称,现在Meta内部因为DeepSeek的模型,已经进入恐慌模式。
这位Meta员工写道:“一切源于DeepSeek-V3的出现,它在基准测试中已经让Llama 4相形见绌。更让人难堪的是,一家‘仅用550万美元训练预算的中国公司’就做到了这一点。工程师们正在争分夺秒地分析DeepSeek,试图复制其中的一切可能技术。这绝非夸张。管理层正为GenAI研发部门的巨额投入而发愁。当部门里数10位高管其中之一的薪资就超过训练整个DeepSeek V3的成本。
> 消息来源: [新浪科技](https://weibo.com/1642634100/PbjVRgEyv) | [华尔街日报](https://www.ft.com/content/747a7b11-dcba-4aa5-8d25-403f56216d7e) | [宝玉](https://x.com/dotey/status/1882528871108538808) | [科技圈🎗在花频道](https://t.me/zaihuanews/30470)
### 5 中国人工智能实验室 DeepSeek 拥有 50000 个 H100 GPU
Scale AI 创始人兼首席执行官 Alexandr Wang 分享了该公司名为“人类的最后考试”的最新 AI 测试的细节,该测试使用“数学、物理、生物、化学教授”提供的与最新研究相关的“最难的问题”。中国人工智能实验室 DeepSeek 的模型 R1 在 Scale AI 公司最具挑战性的人工智能测试中达到或击败了所有表现最佳的模型,或大致与美国最好的模型 o1 相当。
Alexandr 表示,对于中国是否能获得先进 GPU 这个问题,“现实情况是既可以又不能。中国实验室拥有的 H100 数量比人们想象的要多。”他补充说,据他了解,“DeepSeek 拥有大约 50,000 个 H100。”他补充道,“他们显然不能谈论这个问题,因为这违反了美国实施的出口管制。”然而,该公司可能会发现很难采购更多芯片,“从长远来看,他们将受到芯片管制和出口管制的限制。”
> 消息来源: [wccftech](https://wccftech.com/chinese-ai-lab-deepseek-has-50000-nvidia-h100-ai-gpus-says-ai-ceo/amp/) | [科技圈🎗在花频道](https://t.me/xhqcankao/16767)
### 6 Meta Llama框架漏洞致AI系统面临远程代码执行风险
Meta Llama大型语言模型框架存在高危漏洞(CVE-2024-50050),攻击者可通过反序列化恶意数据远程执行代码,影响使用ZeroMQ网络接口的推理服务器。
Meta于2024年10月发布0.0.41版本修复该问题,将序列化格式从pickle切换为JSON,消除潜在风险。同期OpenAI ChatGPT爬虫也被曝出可被滥用于发起DDoS攻击的漏洞。
研究显示,AI框架安全威胁持续升级,此前TensorFlow Keras因marshal模块漏洞暴露类似风险,LLM技术正被用于增强网络攻击全生命周期。
> 消息来源: [The Hacker News](https://thehackernews.com/2025/01/metas-llama-framework-flaw-exposes-ai.html) | [科技圈🎗在花频道](https://t.me/zaihuanews/30492)
### 7 阿里Qwen 2.5-Max超大规模MoE模型发布
1月29日凌晨,阿里云公布了其全新的通义千问 Qwen 2.5-Max 超大规模 MoE 模型,该模型预训练数据超过20万亿 tokens。目前开发者可在 Qwen Chat 平台免费体验模型,企业和机构也可通过阿里云百炼平台直接调用新模型 API 服务。在 Arena-Hard、LiveBench、LiveCodeBench 和 GPQA-Diamond 等基准测试中,Qwen2.5-Max 表现超越了 DeepSeek V3,同时在 MMLU-Pro 等其他评估中也展现出了极具竞争力的成绩。阿里云的基座模型在大多数基准测试中都展现出了显著的优势。阿里云称随着后训练技术的进步,下一个版本 Qwen2.5-Max 将会达到更高水平。
> 消息来源: [通义千问](https://mp.weixin.qq.com/s/PkwwZWFOyG-mZMWXUMvM8w) | [风向旗参考快讯](https://t.me/xhqcankao/16834)
### 8 谷歌利用 AI 为用户拨打本地商家电话
​谷歌正在测试一款新工具,让 AI 代替用户致电商家询问问题。这项名为“Ask for Me”功能可收集有关服务价格和可用性的信息,但目前仅适用于美甲沙龙和汽车修理店。
在谷歌搜索实验室启用实验后,在搜索中寻找本地美甲沙龙或汽车修理店时,用户可能会看到“Ask for Me”提示。选择该选项后,谷歌将会提出一系列问题,比如是否需要换油或更换轮胎、车是什么类型,以及希望何时预约。用户需要输入电子邮件地址或电话号码用于接收更新信息。商家可以在Google商家资料设置中选择不接收 AI 电话。
> 消息来源: [The Verge](https://www.theverge.com/news/603501/google-ask-for-me-search-labs) | [风向旗参考快讯](https://t.me/xhqcankao/16897)
+72
View File
@@ -0,0 +1,72 @@
---
title: Linuxcat周刊(第28期) DeepSeek 带来的影响
tags:
- AI
- 视频生成
- 机器人
categories:
- Linuxcat周刊
index_img: /img/weekly/2025/04/007Os3mpgy1hyb75c4x9uj30u00u040s.jpg
banner_img: /img/weekly/2025/04/007Os3mpgy1hyb75c4x9uj30u00u040s.jpg
permalink: /weekly/2025-4/index.html
date: 2025-02-07 19:00:00
---
## 封面图
![泰缅边境断电](/img/weekly/2025/04/007Os3mpgy1hyb75c4x9uj30u00u040s.jpg)
当地时间 2 月 5 日,根据泰国政府的决定,当天早上 9 时泰国开始对泰缅边境的缅甸地区断网、断电和断油。泰国地方电力局局长素帕猜・艾空表示,此次断电行动切断泰国五个对缅供电点供电,涉及缅甸孟邦、掸邦、克伦邦,覆盖大其力、妙瓦底等与诈骗团伙活动密切的地区,影响总电力供应量达 20.37 兆瓦
目前已有微博用户分享了泰缅边境断电后的前后对比
[via](https://www.ithome.com/0/829/026.htm)
## 正文
### 1 对近期 DeepSeek 相关新闻的总结
最近有关 DeepSeek 的新闻很多,总接下来就是以下几点:
1. 其他 AI 公司发布新的大模型和新的产品形态并加大(开源)研发投入,并上线类似于“深度思考”的功能
2. 海外对 DeepSeek 的网络安全,隐私审查和 GPU 来源审查
3. 海外对 DeepSeek 的禁用,甚至出现了比较极端的禁用手段(使用 DeepSeek 会被拘留的提案等)
### 2 奥尔特曼:公司封闭策略站在历史错误一方
作为近期深度求索开源大模型对AI从业者和华尔街巨大震撼的总结,此前坚持封闭策略的OpenAI首席执行官山姆·奥尔特曼坦诚,这家科创巨头在开源问题上站在“历史的错误一方”。在Reddit上问答活动中,一名参与者问奥尔特曼,他的公司是否会考虑发布其AI模型中的一些技术,更多地展现其系统工作原理。奥尔特曼回复称:“我个人认为,在这个问题上我们站在历史的错误一边。现在需要想出一个不同的开源策略。”并表示公司的下一个旗舰推理模型o3会在“几周之后,但少于几个月”上架,同时“GPT-5”的发布还没有时间表。对于已经落后的“文生图”专有模型DALL-E 3,他也称正在努力开发新产品。
> 消息来源:[财联社](https://api3.cls.cn/share/article/1933232?sv=8.8.8&) | [风向旗参考快讯](https://t.me/xhqcankao/16950)
### 3 Openai申请新商标 涉人形机器人、智能珠宝
OpenAI向美国专利商标局提交申请,希望将品牌「OpenAI」相关的产品注册为商标。申请文件显示范围包含耳机、护目镜、眼镜、遥控器、笔记本电脑和手机壳、智能手表、智能珠宝以及「用户可编程的人形机器人」和「具有通信和学习功能、用于协助和娱乐人类的人形机器人」。
> 消息来源:[Techcrunch](https://techcrunch.com/2025/02/03/openais-new-trademark-application-hints-at-humanoid-robots-smart-jewelry-and-more/) | [USTPO](https://tsdr.uspto.gov/#caseNumber=99025123&caseSearchType=US_APPLICATION&caseType=DEFAULT&searchType=statusSearch) | [科技圈🎗在花频道](https://t.me/zaihuanews/30605)
### 4 谷歌从公共 AI 原则中删除有关武器的措辞
谷歌公司从其人工智能原则中删除了一段承诺避免将该技术用于武器等可能有害应用的文字。根据彭博社查看的截图,该公司的人工智能原则此前曾包含一段题为“我们不会追求的人工智能应用”的文字,例如“造成或可能造成整体伤害的技术”,包括武器。该页面上不再显示该措辞。谷歌道德人工智能团队的联合负责人玛格丽特·米切尔表示,删除“伤害”条款可能会对谷歌将要开展的工作类型产生影响。她说:“删除该条款就等于抹去谷歌在道德 AI 领域和激进主义领域所做的许多工作,更成问题的是,这意味着谷歌现在可能会致力于直接部署可以杀人的技术。”
> 消息来源:[彭博社](https://www.bloomberg.com/news/articles/2025-02-04/google-removes-language-on-weapons-from-public-ai-principles)
### 5 研究员以不到50美元训练出优质推理模型
根据上周五发布的[新研究论文](https://arxiv.org/pdf/2501.19393),斯坦福大学和华盛顿大学的人工智能研究人员能够以不到50美元的云计算积分训练出具备“推理”能力的人工智能模型。该模型名为 s1,在数学和编程能力测试中表现出与 OpenAI 的 o1 和 DeepSeek 的 r1 等顶尖推理模型相似的水平。s1 模型可在 [GitHub 上获取](https://github.com/simplescaling/s1),同时还可获取用于训练该模型的数据和代码。s1 团队表示,他们从一个现成基础模型开始,然后通过“蒸馏”对其进行微调。研究人员称,s1 是从谷歌推理模型 Gemini 2.0 Flash Thinking Experimental 中蒸馏出来的。与伯克利分校的研究人员[上个月以约450美元](https://techcrunch.com/2025/01/11/researchers-open-source-sky-t1-a-reasoning-ai-model-that-can-be-trained-for-less-than-450/)的价格创建人工智能推理模型所采用的方法相同。
> 消息来源:[Techcrunch](https://techcrunch.com/2025/02/05/researchers-created-an-open-rival-to-openais-o1-reasoning-model-for-under-50/) | [GitHub](https://github.com/simplescaling/s1) | [风向旗参考快讯](https://t.me/xhqcankao/17044)
### 6 特斯拉招聘工程师等,为量产机器人做准备
2月6日消息,特斯拉正式招聘工程师、流程主管、产品经理等多个岗位,为在加州弗里蒙特工厂量产的 Optimus (特斯拉机器人) 做准备。Optimus是特斯拉公司开发的一款人形机器人,旨在通过人工智能技术执行危险、重复或人类不愿从事的任务。1月30日,特斯拉在业绩会上更新了Optimus机器人量产指引,2025年目标生产1万台机器人,产能第一步扩至每月1000台,到2026年每月产能达到10000台,2027年每月产能达到10万台。
> 消息来源:[新浪科技](https://finance.sina.com.cn/chanjing/gsnews/2025-02-06/doc-ineiphxe1759415.shtml)
### 7 字节跳动发布 AI 工具,可从单张照片生成逼真视频
字节跳动推出 AI 工具 OmniHuman-1,可从单张照片生成逼真的人物视频,让图像中的人物说话、做手势、唱歌甚至演奏乐器。研究人员表示,OmniHuman 在弱信号输入(如音频)下仍能生成高质量视频,支持各种图像比例,适用于肖像、半身或全身照。
字节跳动团队使用超过 18,700 小时的人类视频数据训练 OmniHuman,但具体数据来源尚未披露。这项技术将 TikTok 带入 AI 生成视频的竞争前沿,可能应用于教育、虚拟网红、娱乐、政治宣传等领域,同时也引发了深度伪造相关的伦理和安全担忧。有专家指出,随着 AI 生成内容越来越逼真,虚假信息的风险也随之增加。
> 消息来源:[Forbes](https://www.forbes.com/sites/lesliekatz/2025/02/05/tiktok-owners-new-ai-tool-makes-lifelike-videos-from-a-single-photo/) | [科技圈🎗在花频道](https://t.me/zaihuanews/30668)
### 8 苹果将于一周内发布全新iPhone SE,取消Home键并引入AI功能
苹果公司计划在未来几天内发布全新iPhone SE,据悉,新款iPhone SE将取消传统的Home键,采用类似iPhone 14的设计,并引入“Apple Intelligence”。
此外,新机型将配备USB-C接口,符合欧盟法规要求。预计新款iPhone SE将在海外市场,尤其是中国、印度等亚洲地区,具有较强竞争力。苹果希望通过这款新机型提振其iPhone业务,尤其是在去年假日季度销量下滑1%的背景下。
新机不会举行发布会,采取直接上架的形式。
> 消息来源:[Mark Gurman](https://www.bloomberg.com/news/articles/2025-02-06/apple-s-long-awaited-overhaul-of-budget-iphone-nears-release?embedded-checkout=true)
+60
View File
@@ -0,0 +1,60 @@
title: Linuxcat周刊(第29期) COBOL 留下的烂摊子
tags:
- AI
- 能源
- 量子计算
- 网络安全
categories:
- Linuxcat周刊
permalink: /weekly/2025-5/index.html
date: 2025-02-21 19:00:00
---
## 正文
### 1 马斯克:美国社保号数与实际公民数相差6000万 最高龄超360岁
据马斯克发文称:目前美国社保号人数达3.94亿,超过美国实际人口(3.34亿)约6000万。根据社会保障数据库中“死亡”字段为 FALSE 的人数有超过2000万百岁以上老人,其中最高年龄达360岁。也许《暮光之城》是真的,有许多吸血鬼正在领取社会保障金。
> 消息来源:[X](https://x.com/elonmusk/status/1891350795452654076)
根据群友提供的消息补充:
有传言:这一现象可能源于社保系统使用60年前的COBOL编程语言。由于COBOL没有日期类型,系统会将缺失的出生日期默认设置为1875年5月20日参考点。这使得在2025年查询时,这些记录显示年龄为150岁。 并且社保局自2015年9月起实施115岁自动停付机制。[连线](https://www.wired.com/story/elon-musk-doge-social-security-150-year-old-benefits/)
> 消息来源:[科技圈🎗在花频道](https://t.me/zaihuanews/30931)
### 2 数据中心能源消耗预计到2030年将翻倍
根据高盛投资银行的预测,由于AI对电力的需求增加,到2030年数据中心的能源消耗将超过现在的两倍。目前全球数据中心耗电量约为55吉瓦,其中14%用于AI工作负载。预计到2027年,电力需求将达到84吉瓦,AI占比将增至27%。到2030年底,总的数据中心容量预计达到约122吉瓦。
为满足不断增长的电力需求,从现在到2030年间可能需要高达7200亿美元的投资来升级电网。
> 消息来源:[The Register](https://www.theregister.com/2025/02/07/datacenter_energy_goldman_sachs/) | [Goldman Sachs](https://www.goldmansachs.com/insights/articles/ai-to-drive-165-increase-in-data-center-power-demand-by-2030)
### 3 DeepMind 的 AI 系统在几何问题中表现优于国际数学奥林匹克金牌得主
Google DeepMind 开发的人工智能系统 AlphaGeometry2 是去年 1 月发布的 AlphaGeometry 系统的改进版。在[一项新发表的研究](https://arxiv.org/abs/2502.03544)中,该模型可以解决过去 25 年来国际数学奥林匹克 (IMO)中 84% 的几何问题。该系统解决了 50 道题中的 42 道,超过了金牌得主的平均得分 40.9。测试中还发现系统能够产生人类通常无法想到的、既有创意又高效的解法。
AlphaGeometry2 包括来自谷歌 Gemini 的语言模型和“符号引擎”。Gemini 模型帮助符号引擎使用数学规则推断问题的解决方案,得出给定几何定理的可行证明。这或许证明了符号操作和神经网络这两种方法的结合是探索可通用人工智能的一条有希望的道路。根据论文,仅具有神经网络架构的 OpenAI o1 无法解决 AlphaGeometry2 能够解答的任何 IMO 问题。
> 消息来源:[TechCrunch](https://techcrunch.com/2025/02/07/deepmind-claims-its-ai-performs-better-than-international-mathematical-olympiad-gold-medalists/) | [风向旗参考快讯](https://t.me/xhqcankao/17133)
### 4 黑客在 HuggingFace 上传恶意 AI 模型攻击开发者
近日,网络安全研究人员发现,黑客通过在 HuggingFace 上传包含恶意代码的 AI 模型,成功绕过了平台的安全检测,企图对开发者展开攻击。这些恶意模型通过非传统的 7z 压缩格式存储,利用硬编码 IP 地址和 shell 收集开发者的设备信息。HuggingFace 的安全工具 Picklescan未能识别这些攻击,提醒开发者在下载模型时提高警惕,选择可信来源的模型。
> 消息来源:[The Hacker News](https://thehackernews.com/2025/02/malicious-ml-models-found-on-hugging.html) | [蓝点网](https://ourl.co/107804) | [科技圈🎗在花频道](https://t.me/zaihuanews/30735)
### 5 研究发现 AI 使人类认知“萎缩且缺乏准备”
微软公司和美国卡内基梅隆大学研究人员发表的一篇新论文指出,随着人类在工作中越来越依赖生成式人工智能,他们使用的批判性思维减少了,这可能“导致本应保留的认知能力退化”。研究人员写道:“自动化的一个关键讽刺之处在于,通过将日常任务机械化并将异常处理留给人类用户,你剥夺了用户练习判断力和增强认知能力的日常机会,导致他们在异常出现时萎缩和毫无准备。虽然人工智能可以提高效率,但它也可能减少关键参与度,特别是在用户仅依赖人工智能的常规或低风险任务中,这引发了人们对长期依赖和独立解决问题能力下降的担忧。”
> 消息来源:[404media](https://www.404media.co/microsoft-study-finds-ai-makes-human-cognition-atrophied-and-unprepared-3/) | [风向旗参考快讯](https://t.me/xhqcankao/17181)
### 6 BBC 发现 AI 聊天机器人正在扭曲新闻报道
英国广播公司 (BBC) 的研究发现,人工智能聊天机器人在总结新闻报道时面临着事实错误和扭曲的问题。这项研究考察了 OpenAI 的 ChatGPT、谷歌 Gemini、微软 Copilot 以及 Perplexity 是否能够准确总结新闻,结果发现超过一半的人工智能生成输出存在某种形式的重大问题。作为研究,BBC 要求聊天机器人各提供100篇 BBC 新闻文章的摘要,同时记者审查他们的答案。除了在 51% 的回复中发现重大问题外,BBC 还发现 19% 引用 BBC 的答案中包含错误的陈述、数字和日期。同时,13% 引用 BBC 的内容“要么与原始出处有出入,要么在引用的文章中不存在。”
> 消息来源:[TheVerge](https://www.theverge.com/news/610006/ai-chatbots-distorting-news-bbc-study)
### 7 PassMark 数据显示 CPU 平均性能 19 年来首次下滑
PassMark CPU 基准测试报告显示,2025 年桌面和笔记本 CPU 的平均性能出现了自 2004 年以来的首次下降。桌面 CPU 平均分下降 0.5%,笔记本 CPU 平均分更是下降了 3.4%。此前 19 年,CPU 性能一直稳步增长。
报告指出,旗舰级 CPU 性能提升也在 2023-2025 年间陷入停滞,尤其是在笔记本平台,主要受到intel 酷睿Ultra 200 系列的影响。而 2023 年 AMD 凭借线程撕裂者 PRO 7995WX 和锐龙 9 7945HX3D,曾大幅提升了桌面和笔记本 CPU 的性能。
> 消息来源:[Cnbeta](https://www.cnbeta.com.tw/articles/tech/1478040.htm) | [科技圈🎗在花频道](https://t.me/zaihuanews/30808)
### 8 皮查伊:实用量子计算机将在5到10年内问世
谷歌 CEO 桑达尔·皮查伊表示,“实用”的量子计算机还需要 5到10年的时间,他将这项突破性技术与大约十年前的人工智能发展阶段进行了比较。皮查伊周三在迪拜世界政府峰会上说:“量子时刻让我想起了 2010 年代的人工智能,当时我们正在开发Google Brain,并取得了早期进展。”皮查伊还提到了谷歌最近在量子芯片方面取得的一项突破。这项突破使研究人员能够在五分钟内计算出一个问题,而现有的超级计算机则需要“比我们宇宙存在的时间还要长”的时间才能解决。 量子计算的进展显然令人兴奋。他还表示:“深度求索做得非常出色,展示了 AI 的全球性。
> 消息来源:[彭博社](https://www.bloomberg.com/news/articles/2025-02-12/google-ceo-sees-useful-quantum-computers-5-to-10-years-away)
+50
View File
@@ -0,0 +1,50 @@
title: Linuxcat周刊(第30期) EA 开源包括红警在内的四款《命令与征服》经典游戏
tags:
- AI
- GFW
- 红警
- Ollama
categories:
- Linuxcat周刊
permalink: /weekly/2025-6/index.html
date: 2025-03-08 08:00:00
---
## 正文
### 1 Figure AI人形机器人推出 Helix 系统:“听懂”语音指令和多机器人协调
![两台机器人在一个展示厨房中合作,将食物放入冰箱](/img/weekly/2025/06/AA1ztopo.png)
机器人初创公司 Figure AI 2月20日推出了一种名为 Helix 的新型人工智能系统,能够让人形机器人通过语音命令执行复杂的动作。该系统旨在让机器人无需针对每个物体进行专门训练,就能轻松处理不同物体
官方公布的演示视频中,两台机器人在一个展示厨房中**合作**,将食物放入冰箱,且全程无需为这些物体进行任何特定的预先训练。
Helix 系统只需 500 小时的训练数据,远低于同类项目的要求。它依靠机器人内置的嵌入式 GPU 运行,这使得该技术在商业应用上具备了可行性
> 消息来源: [IT之家](https://www.msn.cn/zh-cn/news/other/figure-ai%E4%BA%BA%E5%BD%A2%E6%9C%BA%E5%99%A8%E4%BA%BA%E6%8E%A8%E5%87%BAhelix%E7%B3%BB%E7%BB%9F-%E5%90%AC%E6%87%82-%E8%AF%AD%E9%9F%B3%E6%8C%87%E4%BB%A4/ar-AA1ztCio?ocid=BingNewsSerp) | [figure.ai](https://www.figure.ai/news/helix)
### 2 中国防火长城(GFW)DNS 注入系统中存在严重的内存泄露漏洞
中国防火长城(GFW)的DNS注入系统部署在网络边界的中间设备上,该系统监控并干扰DNS查询,通过发送伪造的DNS响应来阻断对特定网站的访问。这些伪造的响应速度较快,从而使客户端优先处理它们。GFW的DNS注入既处理来自中国境内的查询,也处理进入中国的查询。例如,如果境外的主机向一个位于中国大陆的IP地址发送DNS请求,只要请求中包含了被封锁的域名,GFW就会在流量进入中国时插入伪造的响应。
Wallbleed是GFW DNS注入模块中的一个严重漏洞,类似于Heartbleed。该漏洞源于DNS报文解析代码的缺陷,尤其是在处理DNS查询的域名(QNAME)时,未能正确检查域名标签的长度是否超出了报文的实际长度。当发送畸形的DNS查询,其域名标签的长度字节被故意设置得过大时,就会触发这个漏洞。这导致GFW的注入器错误地读取了报文末尾之外的内存内容,并将这些本不应包含的数据写入到伪造的DNS响应中,最终泄露给查询者。
泄露的数据不仅限于DNS信息,还包括IPv4和TCP头信息,违反了其仅应处理特定UDP端口53上DNS查询的预期功能。这种内存泄露可能涉及私有IP到公共服务器的内部流量。
GFW在2023年9月至11月间测试并部署了补丁,增加了对DNS报文的字段完整性校验,不再接受缺失QTYPE/QCLASS的查询,并且增加了对异常长度的检测策略。以前只要域名匹配黑名单就立即伪造回复,而现在还要检查报文格式是否正常,否则宁可不回应。这种调整出于安全考虑,某种程度上削弱了DNS注入的覆盖面,某些非常规查询即使包含被封锁域名也不再触发,从而可能让查询穿透注入系统获得真实答案。
总结:当DNS查询通过中国网络传输至顶级域(TLD)服务器时,GFW可能会在这些查询中注入伪造的DNS响应。这意味着即使请求来自中国以外,只要数据流经中国,就可能被GFW所干扰。此外,GFW向中国的根DNS服务器查询注入了伪造的响应。泄露的数据不仅包括大量隐私数据,还有栈帧和可执行代码片段,由于互联网路由的复杂性,部分境外通信也可能途经中国,从而受到GFW的影响。即使是两个海外主机的通信,如果其数据路径经过中国,Wallbleed漏洞也可能泄露数据。
来自本篇编辑的话: GFW是一个非常复杂的封锁系统,通过边界网关已经植入中国大陆网络的方方面面,限制本片篇幅有限有兴趣的可以阅读原文。但是也有不同的地方,比如 新疆、河南、福建、江苏4个省份审查尤其严格, 新疆的反向墙(屏蔽中国大陆的IP)、 福建的白名单(主要针对海外IP)、 河南的阻断(端口阻断攻击) 、江苏的反诈(独有的江苏反诈系统), 这些统称为地方墙 , 以及最后的全国大墙, 即封锁整个IP和 封锁整个域名, 一般是将整个域名DNS响应到墙的黑名单的IP(黑名单IP就是 例如twitter.com、fb.com, 这些直接封锁整个AS的IP还有一些不断被封锁的IP地址)
> 消息来源: [科技圈🎗在花频道](https://t.me/zaihuanews/31131) | [GFW](https://gfw.report/publications/ndss25/zh) | [GFW](https://gfw.report/publications/ndss25/en/)
### 3 VS Code 知名 Material Theme 主题插件被爆存在恶意代码
Material Theme 主题插件具有巨大的装机量,但是在近期 VS Code 社区成员分析该插件存在恶意代码,其后微软安全专家确定其为恶意插件并找到了其他后门。
目前 VS Code 已经在市场删除该插件并且要求全部插件用户立即卸载该插件以保护安全,该插件开发者已被封禁。目前尚未收到可能的收集数据和恶意入侵后果报告。
我们提醒该插件很多用户都在使用,请务必确认已经卸载该插件并且建议利用安全软件扫描全盘以降低可能的潜在风险。
> 消息来源: [Hacker News 讨论](https://news.ycombinator.com/item?id=43178831) | [互联网档案馆存档](https://web.archive.org/web/20250226020241/https://github.com/material-theme/vsc-material-theme/discussions/1313) | [GitHub 插件市场 Issue](https://github.com/microsoft/vsmarketplace/issues/1168) | [科技圈🎗在花频道](https://t.me/zaihuanews/31143)
### 4 EA 开源包括红警在内的四款《命令与征服》经典游戏
EA 在 GitHub 上开源了四款经典的《命令与征服》系列游戏,包括备受喜爱的《命令与征服:红色警戒》。这四个开源项目包括《命令与征服:泰伯利亚的黎明》、《命令与征服:红色警戒》、《命令与征服:叛逆者》和《命令与征服 将军:绝命时刻》。
这些项目采用 GPL 许可协议,允许粉丝社区修改和扩展,且有助于确保这些经典游戏在未来平台上继续运行。此外,EA 还将 Steam Workshop 支持引入其更现代的《命令与征服》系列,并提供模组支持包,包含使用 SAGE 引擎的游戏资源。
> 消息来源: [GitHub](https://github.com/electronicarts/) | [科技圈🎗在花频道](https://t.me/zaihuanews/31176)
### 5 国家网络安全通报中心通报大模型工具Ollama存在安全风险
报告称,Ollama默认开放的11434端口无任何鉴权机制,导致未授权访问、数据泄露、算力盗取等风险。攻击者可利用历史漏洞实施数据投毒、参数窃取等恶意操作。专家建议用户限制端口访问、配置防火墙、启用多层认证,并及时更新软件以修复漏洞。国家网络与信息安全信息通报中心呼吁用户加强隐患排查,发现攻击立即报告。
> 消息来源: [国家网络安全通报中心](https://mp.weixin.qq.com/s/n7PyLykK7MlO3re2oOyY5w) | [科技圈🎗在花频道](https://t.me/zaihuanews/31243)
> 相关消息:[DeepSeek私有化部署安全风险:近九成服务器“裸奔”引隐患](https://t.me/zaihuanews/30870)
+47
View File
@@ -0,0 +1,47 @@
title: Linuxcat周刊(第31期) 微软将停止对旧版 Windows 远程桌面应用
tags:
- AI
- 具身职能
- 嵌入式
categories:
- Linuxcat周刊
permalink: /weekly/2025-7/index.html
date: 2025-03-22 23:00:00
---
## 正文
### 1 智元机器人发布首个通用具身基座大模型
3月10日,智元正式发布首个通用具身基座模型智元启元大模型 (Genie Operator-1)。该模型提出了 Vision-Language-Latent-Action (ViLLA) 架构,该架构由 VLM (多模态大模型) + MoE (混合专家) 组成,实现了可以利用人类视频学习,完成小样本快速泛化,降低了具身智能门槛,并成功部署到智元多款机器人本体。GO-1通过学习人类视频,助力机器人本体完成递送水杯、制作餐点、迎接外宾等一系列任务。据介绍,GO-1将加速具身智能的普及,机器人将从依赖特定任务的工具,向着具备通用智能的自主体发展,在商业、工业、家庭等多领域发挥更大的作用。
> 消息来源: [智元机器人](https://mp.weixin.qq.com/s/vG_VQcDYPojg-1DZ9DXoGQ) | [风向旗参考快讯](https://t.me/xhqcankao/17932)
### 2 佳士得的 AI 艺术品拍卖超出预期
艺术品拍卖行佳士得首场专门展示 AI 创作作品的展览拍卖“增强智能”超出了预期。据佳士得称,这场展览带来了超过 70 万美元的收入,许多拍品都超出了最高估价。最高成交价是 Refik Anadol 的「[机器幻觉 - 国际空间站之梦 - A](https://onlineonly.christies.com/s/augmented-intelligence/refik-anadol-b-1985-6/249742)」,拍出了 277,200 美元。这是一幅动态画作,通过算法重新构想了来自国际空间站和卫星的数据。佳士得副总裁兼数字艺术品销售总监 Nicole Sales Giles 称,此次展览的成功“证实”了收藏家对“突破艺术界限的创意声音”的认可。
此前,近 6,500 名艺术家在一封公开信中要求取消这次展览拍卖,署名者指责佳士得未经许可展示使用“已知经过版权作品训练”的 AI 模型创作的艺术品,这是“剥削”人类艺术家——未经许可使用他们的作品来制造与他们竞争的产品。
> 消息来源: [TechCrunch](https://techcrunch.com/2025/03/06/christies-ai-art-auction-reportedly-exceeds-expectations/) | [风向旗参考快讯](https://t.me/xhqcankao/17922)
### 3 德州仪器推出世界上最小MCU仅1.38mm²
德州仪器昨日在 Embedded World 2025 上推出了封装尺寸仅 1.38mm² 的 MSPM0C1104 微控制器(MCU)芯片,号称是 “世界上最小的 MCU”。这款微型 MCU 与黑胡椒碎片大小相当,可用于医疗可穿戴设备和个人电子产品应用,批量购买时每件仅需20美分。该元件包含独立计算机的所有基本要素, CPU 是 Armv32-bit Cortex-M0+,其运行频率达 24 MHz,带有 1KB 的 SRAM 和 16KB 的闪存。其他关键组件包括三通道的 12 位模数转换器;6个 GPIO;以及与 UART、SPI 和 I2C 等标准通信接口的兼容性。可在极端温度 (-40°C - 125°C) 下运行。运行时功耗仅为 87μA/MHz,待机时(带 SRAM 保留)功耗仅为 5μA。其甚至还配有内置蜂鸣器。
> 消息来源: [Tom's Hardware](https://www.tomshardware.com/tech-industry/the-worlds-smallest-microcontroller-measures-just-1-38-mm2-and-costs-20-cents) | [风向旗参考快讯](https://t.me/xhqcankao/18023)
### 4 微软将停止对旧版 Windows 远程桌面应用
微软将于 5月 27 日停止对旧版 Windows 远程桌面应用的支持,并将其从 Microsoft Store 中移除。
为了确保用户能够继续使用 Windows 365、Azure 虚拟桌面和 Microsoft Dev Box 等服务,微软建议用户从 Windows 远程桌面应用切换到新版远程桌面应用 — Windows App。在2025年5月27日之后,如果用户不进行切换,这些功能将无法正常使用。
> 消息来源: [Windows App](https://learn.microsoft.com/zh-cn/windows-app/overview) | [WinDiscover](https://windiscover.com/posts/microsoft-will-discontinue-remote-desktop-app-and-ask-users-to-use-windows-app.html) | [科技圈🎗在花频道](https://t.me/zaihuanews/31410)
### 5 Open-Sora 2.0正式发布:11B参数规模,性能可直追HunyuanVideo和Step-Video(30B)
🎬 11B 模型在 📐VBench 和 📊用户偏好评测上,与 HunyuanVideo 及 30B Step-Video 表现相当。
⚡️ 训练成本显著降低。 MovieGen 6144 GPUs 约 $2.5M 对比 Open-Sora 224 GPUs $200K。
🛠 完全开源:检查点、推理及分布式训练代码
🔥 借助我们的高压缩自动编码器(4×32×32),推理速度提升 10 倍。
> 消息来源: [Github](https://github.com/hpcaitech/Open-Sora) | [X](https://x.com/YangYou1991/status/1899973689460044010) | [科技圈🎗在花频道](https://t.me/zaihuanews/31472)
### 6 COBOL 语言前端已合并至 GCC 15 编译器
近几个月来,GNU 编译器集合在 COBOL 语言支持方面出现了活跃度回升。为 GCC 添加 COBOL 前端的超过 13.4 万行代码在 2025 年被合并。COBOL 是专为商业应用开发的编程语言,虽然诞生六十六年后不像以前那么受欢迎,COBOL 开发的应用仍然被金融机构广泛使用。最近为 GCC 开发 COBOL 编译器前端的部分动机是帮助传统大型机应用程序迁移到 Linux 以供本地和云端使用。
> 消息来源: [Phoronix](https://www.phoronix.com/news/GCC-15-Merges-COBOL) | [风向旗参考快讯](https://t.me/xhqcankao/17991)
+57
View File
@@ -0,0 +1,57 @@
title: Linuxcat周刊(第32期) 谷歌将从下周开始完全闭门开发安卓操作系统
tags:
- AI
- x86
- AOSP
- linux
- 脑机接口
categories:
- Linuxcat周刊
permalink: /weekly/2025-8/index.html
date: 2025-04-04 19:15:54
---
## 正文
### 1 谷歌将从下周开始完全闭门开发安卓操作系统,并不意味着闭源
据Android Authority,多年来,安卓系统的开发过程一直对公众开放,允许外界查看谷歌的工作进度。但这种情况即将改变,谷歌证实,他们将开始完全在内部分支机构开发安卓操作系统。一段时间以来,谷歌一直在其“内部分支机构”秘密开发安卓的大部分组件,AOSP分支(安卓开放源代码项目)只包含安卓框架的某些其他方面(包括蓝牙、内核和其他一些核心组件)。因此,当前AOSP的状态与谷歌的内部版本已经存在相当大的差距,开发者和其他人不得不等待谷歌发布公开版本才能获得所有新的更改。闭门开发可能会简化流程,并防止分支合并时发生冲突。谷歌还确认,公司致力于发布安卓的源代码,因此这一变化并不意味着安卓将变成闭源平台。
谷歌已通知合作伙伴,从2025年3月27日起,Android平台开发将转移至单一内部分支,公共AOSP主分支将被锁定为只读,不再实时更新,以简化开发流程并提高效率。不过,谷歌强调,**仍将为后续版本在AOSP发布完整源代码**,否认闭源传言。
合作伙伴表示,调整后仍可通过早期体验计划或协议获取最新AOSP分支,影响有限。但外部开发者可能难以实时追踪安卓进展,部分未获谷歌移动服务授权的厂商更新或将滞后。谷歌称,此举旨在优化开发效率,非放弃开源。业内认为,此变化对用户和主流厂商影响不大,但安卓生态控制权或进一步向谷歌集中。
> 消息来源: [第一财经](https://www.yicai.com/news/102539655.html) | [LoopDNS资讯播报](https://t.me/DNSPODT/8684)
### 2 摧毁x86最后堡垒:Intel电熔丝e-Fuse加密密钥泄漏
安全研究人员发现,英特尔聚合安全与管理引擎(CSME)的硬件安全架构存在关键设计缺陷,导致其根加密密钥(Fuse Encryption Key, FEK)可被提取。FEK用于加密每颗芯片的“安全熔断”(Security Fuses)数据,但由于其自身未启用安全模式且共享于同代平台(如Apollo Lake、Gemini Lake等),攻击者可通过组合漏洞(CVE-2019-0090与CVE-2021-0146)提取FEK,从而解密所有安全熔断信息,彻底破坏信任根(Root of Trust)。
研究指出,问题源于英特尔CSME的硬件加密模块(OCS)设计缺陷:安全密钥存储模块(SKS)未强制为FEK启用安全模式,导致攻击者可利用“已知明文”攻击手段,通过覆盖密钥字节并观察加密结果逆向推导FEK。该漏洞无法通过软件修复,因FEK生成逻辑与硬件熔断配置已固化于芯片内,仅新一代硬件可彻底解决。
此次漏洞影响所有基于Apollo Lake、Gemini Lake等旧平台的设备,涉及嵌入式系统及消费级产品。尽管相关平台已停产,但大量设备仍在使用,且英特尔文档承认其安全模型在FEK泄露后“无法恢复”。
> 消息来源: [Solidot](https://www.solidot.org/story?sid=80861) | [PT SWARM](https://swarm.ptsecurity.com/last-barrier-destroyed-or-compromise-of-fuse-encryption-key-for-intel-security-fuses/) | [LoopDNS资讯播报](https://t.me/DNSPODT/8634)
### 3 Anthropic研究揭示大语言模型"幻觉"机制:已知实体神经元抑制"拒绝回答"回路
Anthropic最新研究发现,当大语言模型Claude识别到"已知实体"时会抑制默认的"拒绝回答"神经元回路,导致其倾向于编造看似合理的答案而非承认未知,这一机制解释了模型产生幻觉的部分原因。
> 消息来源: [arstechnica](https://arstechnica.com/ai/2025/03/why-do-llms-make-stuff-up-new-research-peers-under-the-hood/) | [LoopDNS资讯播报](https://t.me/DNSPODT/8728)
### 4 Linux之父怒斥英特尔驱动代码:测试文件拖慢内核编译
Linus Torvalds在邮件列表中痛批英特尔工程师Jani Nikula提交的DRM驱动代码,称其hdrtest测试文件是"令人作呕的秽物(disgusting turds)",并表示“这玩意必须死”。该问题导致全模块配置编译速度下降,并在include目录生成冗余文件。Torvalds要求将涉及Intel Xe显卡驱动的测试方案移出常规编译流程,临时标记为BROKEN状态。争议焦点在于当前实现破坏了文件名自动补全功能,即便通过gitignore规避也仅是表面处理。Nikula承诺将测试文件迁移至.hdrtest子目录,并通过kconfig选项隔离额外检查项。
> 消息来源: [LKML](https://lore.kernel.org/dri-devel/174321011387.3019715.1646591159826097779.pr-tracker-bot@kernel.org/T/#t) | [LKML](https://lore.kernel.org/dri-devel/20250401121830.21696-1-jani.nikula@intel.com/) | [科技圈🎗在花频道](https://t.me/zaihuanews/31880)
### 5 比尔·盖茨公开50年前与保罗·艾伦共同编写的首个操作系统
微软创始人比尔·盖茨在其博客中回顾了50年前他与已故好友保罗·艾伦共同创建的计算机代码,这段代码为1975年4月微软的诞生奠定了基础。当时年仅19岁的盖茨在哈佛大学就读期间,与艾伦看到《大众电子》杂志上关于Altair 8800微型计算机的文章后,承诺为该机器开发软件,尽管当时他们尚未编写任何代码。经过两个月几乎不眠不休的工作,他们成功开发出基于BASIC语言的操作系统。
盖茨在博客中表示:"那段代码仍然是我写过的最酷的代码",并提供了下载原始程序的选项。这段代码最终成为个人计算机革命的基础,催生了包括Word、Excel、PowerPoint以及Windows操作系统在内的软件套件。现年69岁的盖茨将于今年10月迎来70岁生日,他最近发布了回忆录,反思了自己的早年经历以及与苹果联合创始人史蒂夫·乔布斯的复杂关系。"50年是很长的时间,梦想竟然成真了,这真是疯狂,"身价约1080亿美元的盖茨如是说。
> 消息来源: [Fortune](https://fortune.com/2025/04/03/bill-gates-download-operating-system-paul-allen-wrote-50-years-ago/) | [科技圈🎗在花频道](https://t.me/zaihuanews/31918)
### 6 Neuralink今年将首次在人体植入盲视设备
埃隆·马斯克周一在美国威斯康星州举行的一次活动上通过 YouTube 直播宣布,他的脑机接口植入初创公司Neuralink将在2025年底前进行第一次人体 “盲视” 植入,旨在恢复盲人的视力。一名观众问马斯克,他对“解决失明问题并将其带给大众”的设想是什么。马斯克表示:“Neuralink 在猴子身上植入了一种我们称之为‘盲视’的装置。它一直运行良好,猴子们这几年都很健康。我们希望在今年晚些时候实现第一个人体植入装置,让完全失明的人重见光明。”他说他希望适当地设定期望值,并解释说植入者的视觉最初将是低分辨率的,就像雅达利的图像。但随着时间的推移,最终植入物会使视力变得像超人一样。
> 消息来源: [Mobihealth News](https://www.mobihealthnews.com/news/elon-musk-announces-neuralink-s-first-human-implant-blindsight-coming-year) | [风向旗参考快讯](https://t.me/xhqcankao/18594)
+96
View File
@@ -0,0 +1,96 @@
title: Linuxcat周刊(第33期) SSL/TLS 证书最长有效期将大幅缩短至47天
tags:
- AI
- SSL/TLS
- 芯片
- 网络安全
- OpenAI
categories:
- Linuxcat周刊
permalink: /weekly/2025-9/index.html
date: 2025-04-19 17:40:43
---
## 正文
### 1 SSL/TLS 证书最长有效期将大幅缩短至47天
证书颁发机构浏览器论坛 (CA/Browser Forum) 通过了 [SC-081v3](https://groups.google.com/a/groups.cabforum.org/g/servercert-wg/c/9768xgUUfhQ) 号提案。该提案提出了一个分阶段缩短TLS证书有效期的计划。自 2026 年 3 月 15 日起到2029 年 3 月 15 日分三阶段将最长有效期从398天缩短为47天。提案是在苹果公司的提议下发起的。
提案解释说,缩短证书有效期能使得证书中的信息更贴近实际状态,从而降低因为信息陈旧而带来的安全风险,并可降低私钥或相关数据被泄露后的风险,弥补撤销机制的不足。与此同时,当证书有效期缩短时,各个系统和组织就必须更频繁地更新和替换证书,可以迫使他们采用自动化的证书管理流程,提升整体管理水平和安全性。自动化不仅能减少人工错误,也有助于更快地响应潜在的安全威胁。
DigiCert、GlobalSign、Sectigo 等25个证书颁发机构投赞成票,没有反对票,另有5票弃权。四个最主要的浏览器厂商 Apple、Google、Microsoft、Mozilla 全部投赞成票。
SC-081v3 号提案将分阶段缩短有效期的计划 :
- 自 2026 年 3 月 15 日起:最长证书有效期为 200 天。
- 自 2027 年 3 月 15 日起:最长证书有效期为 100 天。
- 自 2029 年 3 月 15 日起:最长证书有效期为 47 天。
> 消息来源:[VPS信号旗播报](https://t.me/vps_xhq/708)
### 2 苹果紧急空运五架次iPhone以规避特朗普关税
苹果在三天内通过五架货运专机,将大批iPhone从中国和印度运往美国。此举旨在规避特朗普政府可能对进口电子产品加征的关税。
报道称,这批空运产品包括最新款iPhone机型。通过航空运输虽然成本高昂,但能赶在关税政策生效前完成清关。
> 消息来源:[印度时报](https://timesofindia.indiatimes.com/technology/mobiles-tabs/how-apple-flew-5-flights-full-of-iphones-from-india-and-china-in-3-days-to-beat-trump-tariffs/articleshow/120044321.cms) | [科技圈🎗在花频道](https://t.me/zaihuanews/31976)
### 3 中国制造全球首款采用二维材料的 1 纳米 RISC-V 芯片
​中国科学家成功开发出全球首款基于二维材料的1纳米RISC-V微处理器,名为“Wuji”,集成了5,900个晶体管,厚度不到1纳米。 ​这一突破性成果无需依赖先进的极紫外(EUV)光刻技术,为中国在半导体创新领域开辟了新的独立路径。​该结果已被发布在《自然》杂志中。
随着硅基集成电路在微型化方面接近物理极限,全球研究人员开始转向二维材料,如二硫化钼和二硒化钨,以推动芯片性能的提升。​这些材料通常只有一个原子厚,具备出色的物理特性,使下一代电路的进一步缩放和功能提升成为可能。​
此前,维也纳工业大学在2017年开发的最复杂的二维半导体数字电路仅包含115个晶体管。​而复旦大学的研究团队经过五年的努力,成功将集成度提高了50多倍。​他们在30×30的反相器阵列(共900个)中实现了99.77%的高良率,展示了在原子尺度上保持精确性和均匀性的能力,这对于高制造良率至关重要。​
研究团队表示,这项研究证明了二维半导体在高性能集成电路中的巨大潜力,为未来电子设备的开发提供了新的可能性。​
> 消息来源:[南华早报](https://www.scmp.com/news/china/science/article/3305185/worlds-first-1-nanometre-risc-v-chip-made-china-2d-materials?module=top_story&pgtype=subsection) | 科技圈🎗在花频道
### 4 Chrome将修复存在23年的历史记录窥探漏洞
Chrome 136版本将首次彻底解决存在23年的"浏览器历史嗅探"漏洞。该漏洞允许网站通过一定BUG推断用户访问记录。尽管15年前已有缓解措施,但攻击者仍能通过多种方式绕过防护。
谷歌工程师表示,新方案采用"三重密钥分区"技术,将访问记录与来源网站绑定,从根本上阻断跨站查询。该修复标志着浏览器架构的重要演进,有望结束这场持续二十余年的隐私攻防战。
> 消息来源:[The Register](https://www.theregister.com/2025/04/07/chrome_135_history_sniffing/) | [科技圈🎗在花频道](https://t.me/zaihuanews/31991)
### 5 Everest 勒索软件团伙网站被黑:不要犯罪
知名勒索软件Everest 的网站被黑客入侵,并写下「不要犯罪 犯罪不好 来自布拉格的xoxo 」。此网站被该团伙用于发布被盗文件以勒索其受害者,自 2020 年成立以来,它声称对多次黑客攻击和数据泄露事件负责,包括对美国 NASA 和巴西政府的攻击。
> 消息来源:[Techcrunch](https://techcrunch.com/2025/04/07/someone-hacked-everest-ransomware-gang-dark-web-leak-site/) | [科技圈🎗在花频道](https://t.me/zaihuanews/31992)
### 6 Deepseek 突破 AI 训练烧钱魔咒:1.2 万美元 1/525 成本 MT-Bench 跑分媲美 GPT-4o
深度求索(DeepSeek)联合清华大学,合作推出全新 AI 对齐技术 SPCT(自我原则点评调优),突破传统依赖海量训练数据的模式,通过推理阶段动态优化输出质量。
根据研究团队 4 月 4 日发表的论文,该技术通过“原则合成-响应生成-批判过滤-原则优化”的递归架构,让模型能在推理时动态修正输出。
报告指出 SPCT 显著降低高性能模型的部署门槛,以 DeepSeek-GRM 模型为例,训练成本约 1.2 万美元,MT-Bench 得分 8.35。
> 消息来源:[IT之家](https://www.ithome.com/0/843/692.htm) | [Arxiv](https://arxiv.org/abs/2504.02495) | [Medium](https://noailabs.medium.com/self-principled-critique-tuning-spct-deepseek-grm-0669f822d0cb) | [科技圈🎗在花频道](https://t.me/zaihuanews/31997)
### 7 OpenAI揭秘GPT-4.5训练:10万块GPU,几乎全员上阵,有出现过“灾难性问题”
OpenAI近日披露了一些GPT-4.5研发细节,训练耗时两年,动用10万块GPU,几乎全员参与。过程中遭遇基础设施故障、隐藏Bug等问题,团队不得不“边修边训”。
模型性能较GPT-4提升约10倍,智能增强效果超出预期。OpenAI发现,未来突破关键在于数据效率,而非算力。系统架构正转向多集群,未来或需千万级GPU协作。
团队还分享了数据长尾效应与Scaling Law的关系,以及算法与系统协同设计的经验。GPT-4.5的成功验证了Scaling Law的长期有效性。
> 消息来源:[完整分享内容](https://zhidx.com/p/475062.html)|[YouTube](https://www.youtube.com/watch?v=6nJZopACRuQ) | [科技圈🎗在花频道](https://t.me/zaihuanews/32105)
### 8 OpenAI 新推理模型幻觉率和错误率激增,行业难题待解
OpenAI最新推理模型o3和o4-mini在编码、数学任务中表现提升,但幻觉率显著高于前代。内部测试显示,o3在人物知识基准中33%回答虚构,o4-mini达48%。第三方测试指出o3编造代码执行细节,用户反馈其生成链接无效。OpenAI称模型因“输出更多主张”导致准确与错误并存,原因未明。
行业转向推理模型以降低训练成本,但推理能力与幻觉的正相关性成新挑战。结合网络搜索或提升准确性(如GPT-4o搜索版准确率90%),但需权衡隐私风险。 
> 消息来源:[TechCrunch](https://techcrunch.com/2025/04/18/openais-new-reasoning-ai-models-hallucinate-more/) | [科技圈🎗在花频道](https://t.me/zaihuanews/32227)