云展动力首页|
定位中[更换]
EN
中文
APP下载
云展动力
数字孪生
大数据获客
人工智能
分类目录

最新最全行业头条及行业动态

三星Galaxy S25系列手机磁吸便携卡包海外开售,首发价约109元人民币
IT之家 1 月 30 日消息,三星宣布旗下 Galaxy S25 系列手机适用的官方磁吸便携卡包(型号为:GP-TOU024SAG)现已在海外开售,相应卡包目前仅可选黑色一款配色,标注定价 29.99 美元,首发价为 14.99 美元(IT之家备注:当前约 109 元人民币)。 三星表示,这款便携卡包采用人造皮革饰面,可容纳 2-3 张信用卡 / 借记卡 / 会员卡,其通过了通用三星 C&T 磁性钱包认证,在吸附到手机背面时不会挡住手机摄像头,但官方称可能会对手机闪光灯拍摄起到一定影响,因此三星建议用户使用闪光灯拍照时移除相应卡包。 此前,三星还为其 S25 系列手机推出了三合一无线充电器和车载充电器,但系列手机本身并不支持 Qi2 磁吸无线充电,需要用户通过搭配内置 Qi2 磁铁的专用手机壳,才能实现 Qi2 磁吸充电。
孙正义又要投OpenAI,1800亿
编译 | ZeR0 编辑 | 漠影 智东西1月30日消息,据英国《金融时报》报道,日本软银集团正在洽谈向OpenAI投资至多250亿美元(约合人民币1813亿元),这笔交易将使软银成为OpenAI最大的财务支持者。 上周美国总统特朗普宣布,软银、OpenAI、甲骨文将牵头成立一家合资企业Stargate(星际之门),未来四年投资5000亿美元(约合人民币3.6万亿元)建设AI基础设施。(特朗普宣布AI巨型项目:3.6万亿!) 据多位了解谈判情况的人士透露,软银正在洽谈直接向OpenAI投资150亿至250亿美元,此前已承诺向“星际之门”项目投资逾150亿美元(约合人民币1088亿元)。几位直接了解该交易的人士称,软银对OpenAI的股权投资可能涵盖后者对美国AI基础设施项目的承诺。 最终,软银可能会在与OpenAI的合作上投入超过400亿美元(约合人民币2901亿元)。 一位知情人士称:“谈判正在进行中,软银可能向OpenAI投资的初始股权金额是一个不断变化的目标。” 交易尚未最终敲定。 马斯克等科技大佬此前曾质疑如何承担建造“星际之门”的巨额成本。 多位接近该项目的人士称,软银集团创始人兼CEO孙正义持有OpenAI大量股份并履行“星际之门”承诺的计划已经过OpenAI高管和董事会的审查。 软银对“星际之门”和OpenAI的潜在投资已讨论数月。如果孙正义投资400亿美元或更多,这将成为他迄今最大的投资之一,超过软银向失败的众创空间集团WeWork注资的160亿美元。 OpenAI已在多轮融资中筹集了约200亿美元,其中包括来自其主要支持者微软的约130亿美元。在去年10月宣布获得66亿美元(约合人民币463亿元)融资后,其估值冲破1570亿美元(约合人民币1.1万亿元),成为AI产业无可争议的“巨无霸”独角兽。 据外媒去年11月报道,在10月向OpenAI注资约5亿美元后,软银再度向OpenAI投资15亿美元,合计收购了OpenAI 20亿美元(约合人民币145亿元)的股份。 OpenAI联合创始人兼CEO萨姆·阿尔特曼一直在探索减少公司对微软计算资源依赖的方法,包括开发自家芯片以及与甲骨文等其他云提供商合作。作为“星际之门”协议的一部分,微软同意放弃作为OpenAI独家云服务提供商。 据知情人士透露,“星际之门”项目总融资额的1/5左右预计将以股权形式筹集。该项目还需要以其资产和现金流作为抵押借入数千亿美元,采用通常用于大型基础设施项目的融资结构。 OpenAI董事会也正在进行复杂的谈判,希望将其转变为一家营利性公司,旨在从投资者那里再筹集数百亿美元。 软银和OpenAI拒绝置评。
魅族手机系统服务无法访问,正全力抢修中
IT之家 1 月 30 日消息,今日有多名魅族用户反馈称,魅族手机突然无法访问所有的系统应用,只要是系统自带的都加载不出来,重启也无效。随后,魅族 FlymeAIOS 官方回应称: 用户朋友们春节好,因服务器异常,魅族手机的 Aicy 语音、天气、应用商店、游戏中心等系统服务当前无法访问,工程师正在全力抢修中,稍后即将恢复正常,给大家带来困扰深表歉意。 截至IT之家发稿,魅族手机系统服务仍未完全恢复。
DeepSeek被美国质疑偷窃,OpenAI称掌握违规证据,论文曝突破英伟达护城河
春节期间,一场关于 DeepSeek 的风波正在 AI 圈掀起波澜。 据彭博社最新报道,微软安全研究人员在去年秋天发现,一些可能与 DeepSeek 相关的个人通过 OpenAI 的 API 大规模提取数据。 知情人士透露,作为 OpenAI 的技术合作伙伴和最大金主,微软在发现这一情况后立即通知了 OpenAI。 报道称,这种行为可能违反 OpenAI 的服务条款。因为 OpenAI 的服务条款明确规定,用户不得未经授权使用自动化或程序化方法从其服务中提取数据。 即使 DeepSeek 获得了某种形式的 API 访问权限,但如果其使用方式超出了 OpenAI 授权的范围,比如用于非法或未经授权的商业目的,也可能被视为违反服务条款。 另外,据外媒金融时报报道,OpenAI 称有证据表明,中国 AI 公司 DeepSeek 借助 OpenAI 的模型来开发自己的开源 AI 产品,此举可能违反了 OpenAI 的服务条款。 OpenAI 认为 DeepSeek 的行为已经超出了可接受的范围,因为他们是在利用 OpenAI 的技术来打造一个竞品。 对于相关置评请求,OpenAI 未作回应,微软拒绝评论,而 DeepSeek 方也暂未回应。 值得一提的是,此前许多外界人士认为通过模型蒸馏技术,DeepSeek可能在训练过程中使用了 ChatGPT 等模型的输出数据作为训练材料,而这些数据中的「知识」被迁移到 DeepSeek 自己的模型中。 事实上,这种做法在 AI 领域并不罕见。 但质疑者关注的是 DeepSeek 是否在未充分披露的情况下使用了 OpenAI 模型的输出数据。这似乎在 DeepSeek-V3 的自我认知上也有所体现。 早前就有用户发现,当询问模型的身份时,它会将自己误认为是 GPT-4。 DeepSeek 团队在最新模型 R1 的技术报告中明确表示未使用 OpenAI 模型的输出数据,并表示通过强化学习和独特的训练策略实现了高性能。 例如,采用了多阶段训练方式,包括基础模型训练、强化学习(RL)训练、微调等,这种多阶段循环训练方式有助于模型在不同阶段吸收不同的知识和能力。 彭博社报道还指出,美国 AI 事务主管 David Sacks 近期在接受 Fox News 采访时表示,有「确凿证据」表明,DeepSeek 利用 OpenAI 模型的输出数据来开发自身技术。 不过,Sacks 并未提供具体的证据。近期,美国多名官员也表示 DeepSeek有「偷窃」嫌疑,正对其影响开展国家安全调查。 针对 David Sacks 的言论,OpenAI 的回应则比较保守。其发言人表示「我们知道,来自中国的公司以及其他一些企业,始终在尝试『蒸馏』美国领先 AI 公司的模型。」 该发言人强调,作为 AI 领域的领先者,OpenAI 已采取相应对策来保护其知识产权,其中包括对前沿能力的严格筛选,决定哪些功能可以公开发布。他们认为与美国政府密切合作对于保护最先进的 AI 模型至关重要。 就在这场争议风波持续发酵之际,外媒的目光也开始转向 DeepSeek 更早发布的开源 V3 模型,后者则通过技术报告详细披露了相关的深度底层优化细节。 据外媒扒出,V3 模型的开发甚至绕过了 CUDA,通过对英伟达 GPU 低级汇编语言 PTX 进行优化,从而实现了最大性能。 PTX 是英伟达 GPU 的中间指令集架构,能够实现寄存器分配、线程 / 线程束级别调整等细粒度优化。如果说 CUDA 是与英伟达 GPU 对话的「高级语言」,那么 PTX 就像是一种「机器底层语言」。 想象你在玩一个游戏机。通常情况下,我们只需要用手柄(就像 CUDA)就能玩游戏,这很方便,但可能无法发挥游戏机的全部实力。 而 PTX 就像是打开了游戏机的后盖,直接调整里面的各种配件和线路。虽然这样做很复杂,需要懂得很多专业知识,但是可以让游戏机跑得更快、性能更好。 更通俗的解释是,PTX 就是一种能够让开发者「掀开 GPU 的盖子」,直接调教其内部运作方式的工具。这就像是改装汽车,不是简单地踩油门,而是直接调教发动机的每个零件,以榨取最大性能。 DeepSeek 在训练 V3 模型时,对 H800 GPU 进行了重新配置,包括划分出 20 个 SM 用于服务器间通信,以及实现了流水线算法,优化能力远超常规 CUDA 开发水平。而倘若这一技术属实,或将撼动英伟达构筑已久的护城河。 图片截图来自 DeepSeek v3 技术报告 不过,PTX 虽然能极大地优化性能,但也对开发团队提出了更高的要求。相比之下,英伟达的护城河 CUDA 凭借其开发便捷性和快速迭代的优势,仍然是大多数开发者的首选。 更重要的是,PTX 优化往往需要针对特定型号的硬件进行定制。 这种「量体裁衣」式的优化策略虽然效果显著,但也大大增加了开发难度和维护成本。这也解释了为什么在可预见的未来,CUDA 仍将在主流开发中占据主导地位。 但在既有规则之外寻求突破,往往就是颠覆的开始,DeepSeek 这次在海内外掀起的技术浪潮或将有望撬动整个 AI 产业链的既有秩序。
手机也能拍大片:大疆Osmo Mobile 7云台渲染图曝光,AI追踪、双版本齐发
IT之家 1 月 30 日消息,科技媒体 dronexl 于 1 月 28 日发布博文,分享了大疆 Osmo Mobile 7 手机云台的宣传图片,展示了标准版和专业版两种型号,预计将在未来几周内发布。 大疆于 2022 年 9 月推出 Osmo Mobile 6 手机云台,上市时售价为 799 元,IT之家查询大疆官网,该产品售价为 599 元,预估标准版 Osmo Mobile 7 售价维持 799 元,而专业版因其附加功能预计价格更高。这种双版本策略是大疆手机云台产品线的新尝试。 标准版与专业版共有的功能: 保留了磁吸手机安装系统,支持宽度达 3.3 英寸的手机。 控制布局包括用于精确云台移动和菜单导航的摇杆,以及用于快速访问基本功能的专用录制和存储按钮。 配备小型显示面板(可能是 LED 或 OLED),提供电池寿命、活动功能和连接状态等信息,是对 Osmo Mobile 6 状态面板的增强。 内置三脚架支脚,延续了大疆对多功能性的关注。 其他共享功能包括:用于快速自拍模式和横向 / 纵向切换的相机翻转开关;食指控制的触发按钮;USB-C 充电功能;左侧的变焦控制;以及随附的便携包。 专业版 Osmo Mobile 7 具备更强悍的功能,手柄侧面的精密手动对焦和变焦轮,可实现更流畅的相机控制,提供更好的变焦和跟焦能力,从而实现更复杂的拍摄构图。 此外专业版将集成专用的目标跟踪相机硬件,相较于当前型号中的 ActiveTrack 6.0 系统是一次重大升级,意味着在各种挑战性场景下,目标跟踪将更加可靠,甚至可能由 AI 驱动。 专业版还包含 DJI Mic Mini 麦克风,以提升拍摄或视频博客时的录音质量,此外还配备伸缩延长杆,它基于 Osmo Mobile 6 推出的 8.5 英寸延长杆概念,但针对内容创作者市场进行了改进。IT之家附上相关图片如下:
提升观影体验:One UI更新扩展至更多三星电视型号
IT之家 1 月 30 日消息,三星于 2024 年 10 月,面向 S90C、S95C、S90D 和 S95D 等旗舰机型,发布了适用于电视的全新 One UI。根据 Reddit 用户反馈,三星在 2025 年扩大适配范围,意味着更多用户可以体验到新系统带来的便利和改进。 Reddit 用户报告称,2023 年款三星 QLED 4K QE1 电视已收到 One UI 更新推送,表明三星正在将其最新的智能电视系统扩展到更广泛的用户群体。IT之家附上图片如下: 用户可以通过以下步骤检查更新:设置 » 所有设置 » 支持 » 软件更新 » 立即更新,更新过程可能需要几分钟,更新期间断电可能会损坏电视,因此请确保电视连接到带有备用电源的插座。 随着 One UI 更新覆盖到更多经济型电视,三星确保了拥有各种型号电视的客户都能享受到更流畅、更直观的体验,对于拥有三星电视的用户,也可以检查它是否已安装 One UI。
起售价499美元:谷歌Pixel 9a手机被曝3月19日预售,26日发货
IT之家 1 月 30 日消息,科技媒体 Android Headline 昨日(1 月 29 日)发布博文,曝料称谷歌 Pixel 9a 手机将于 2025 年 3 月 19 日开启预售,3 月 26 日开始发货,并于同一天在实体店上架销售。 美国市场 128GB 版本售价 499 美元,256GB 版本售价 599 美元,如果消费者想要支持 mmWave 5G 的 Verizon 版本,需要额外再支付 50 美元。 Pixel 9a 系列机型与 Pixel 8a 的起售价相同,但 256GB 版本涨价 40 美元,至 599 美元(当前约 4349 元人民币)。 这延续了谷歌去年 8 月自 Pixel 9 系列开始采用的新定价策略,即 256GB 版本的价格比 128GB 版本高出 100 美元(当前约 726 元人民币)。 参数方面,IT之家此前报道,Pixel 9a 将配备 5100mAh 容量的电池,这也是谷歌迄今为止在 Pixel 智能手机中配备的最大容量电池。 Pixel 9a 将继续采用较小尺寸的 6.285 英寸 Actua 显示屏,峰值亮度达 2700 尼特,HDR 亮度 1800 尼特;该机将搭载 Tensor G4 处理器,配备 8GB 内存,并提供 128GB 或 256GB 存储空间。 此外,谷歌今年还对主摄进行了升级,放弃了 64MP 传感器,换成了 4800 万像素 Quad Dual Pixel 摄像头,还将配备 1300 万像素的超广角摄像头,同样没有长焦摄像头。
Nothing Phone(3a)Pro工程机谍照曝光,采用后置三摄设计
IT之家 1 月 30 日消息,消息源 Sanju Choudhary 现已放出一张 Nothing Phone(3a)Pro 手机的外观谍照,虽然该机带有保密壳,不过依然可以看到这款手机采用三摄设计。 ▲ 图源 Sanju Choudhary 该机摄像头谍照与IT之家先前报道 Nothing Phone(3a)Pro 参数相符,即这款手机后置 5000 万像素主摄像头、800 万像素超广角摄像头和 5000 万像素长焦摄像头(2 倍光学变焦)。 另参考先前报道,Nothing Phone(3a)5G 有望提供两种配置,分别为 8GB RAM + 128GB 存储空间和 12GB RAM + 256GB 存储空间。而 Nothing Phone(3a)Pro 5G 仅提供 12GB RAM + 256GB 存储空间一种配置。 其他方面,Nothing Phone(3a)将搭载骁龙 7s Gen 3 芯片,配备 6.8 英寸全高清 + AMOLED 显示屏,支持 120Hz 刷新率。
vivo Y59手机现身海外数据库:配6.72英寸120Hz面板、搭8GBRAM
IT之家 1 月 30 日消息,vivo 旗下一款型号为 Y59 5G 的手机现已现身印度 BIS 数据库,这款手机具体型号为 V2443,预计将于近期在海外上市。 这款手机定位低端,主要用于接替现款 Y58 机型,该机预计将配备一块 6.72 英寸 2408x1080 分辨率 120Hz LCD 面板,机身配备 8GB RAM 和 128GB 存储空间。不过目前该机的外观图还未公布,预计将继续延续 Y58 手机的设计。 除此之外,IT之家注意到 vivo 还有一款型号为 T4x 5G 的手机通过认证,该机主要取代 T3x 手机,作为比较,vivo T3x 手机配备 6.72 英寸面板,搭载骁龙 6 Gen 1 处理器,配备 4/8GB RAM。
Anthropic CEO 最新万字长文:不认为 DeepSeek 本身是对手,美国要加强芯片出口管制
今天凌晨,Anthropic CEO Dario Amodei 在 X 平台发布了一篇万字长文,回应了近期围绕在 DeepSeek 的诸多风波事件。 在这篇博客中,Amodei 表示不认为 DeepSeek 本身是对手,但同时却又喊话美国要加强芯片出口管制。 面对 Amodei 疑似「破防」的行为,X 网友在评论区贴脸输出: 附上原文编译: 几周前,我曾提出应加强美国对华芯片出口管制。如今,中国 AI 公司 DeepSeek 竟然在某些方面以更低成本接近了美国最前沿的 AI 模型。 在这篇文章中,我不会讨论 DeepSeek 是否真的威胁到 Anthropic 等美国 AI 企业(尽管我认为,关于中国 AI 取代美国领导地位的某些说法被夸大了)¹。 相反,我想探讨一个问题:DeepSeek 的技术突破是否削弱了对芯片出口管制的必要性?我的答案是否定的。事实上,我认为这反而更加凸显了出口管制的重要性²。 出口管制的核心目标是确保国家在 AI 发展中保持领先。需要明确的是,管制政策并不是为了回避中美 AI 竞争。 最终,如果美国及其他国家希望在 AI 领域占据主导地位,就必须拥有比中国更先进的模型。但与此同时,我们也不应该在可以避免的情况下,让中国政府获得技术优势。 AI 发展的三大核心动态 在讨论政策问题之前,我想先介绍 AI 系统的三个关键发展动态,这对理解 AI 产业至关重要: 1. 缩放规律(Scaling Laws) AI 领域的一个核心规律是,随着训练规模的扩大,模型的表现会持续平稳提升。我和我的联合创始人在 OpenAI 工作时,就曾率先记录并验证过这一现象。简单来说,在其他条件相同的情况下,增加训练计算量(compute)会让 AI 在各种认知任务上的表现更好。例如: 价值 100 万美元 的 AI 可能能解决 20% 的关键编程任务 价值 1000 万美元 的 AI 可能能解决 40% 价值 1 亿美元 的 AI 可能能解决 60% 这些差异在实际应用中会带来巨大影响——计算量增加 10 倍,可能意味着 AI 水平从本科生提升到博士生。因此,各家公司都在投入巨额资金训练更强的模型。 2. 计算效率提升(Shifting the Curve) AI 领域不断涌现出各种大大小小的创新,使得 AI 训练和推理更加高效。这些创新可能涉及模型架构改进(例如对 Transformer 结构的优化)、更高效的计算方式(提升硬件利用率)以及新一代 AI 计算芯片。 这些优化会整体提升 AI 的训练效率,也就是「Shifting the Curve」: 如果某项技术带来 2 倍的计算提升(Compute Multiplier,CM),那么原本需要 1000 万美元 训练出的 40% 代码解决能力,现在只需要 500 万美元;原本 1 亿美元 的 60% 代码解决能力,现在只需要 5000 万美元。 各大 AI 公司不断发现这样的 CM 提升: 小幅优化(约 1.2 倍):常见的微调优化 中等优化(约 2 倍):架构改进或算法优化 大幅优化(约 10 倍):重大技术突破 由于 AI 智能水平的提升价值极高,这种效率提升通常不会降低总训练成本,反而会促使企业投入更多资金,训练更强的模型。许多人误以为 AI 会像传统产品那样「先贵后便宜」,但 AI 并不是一个固定质量的商品——当计算效率提高后,行业不会减少计算消耗,而是更快地追求更强的 AI。 在 2020 年,我的团队发表了一篇论文,指出算法进步带来的计算效率提升速度约为每年 1.68 倍。但目前这一速度可能已经加快到每年 4 倍,并且这一估算还未考虑硬件进步的影响。 3. 推理成本的降低(Inference Cost Reduction)训练效率的提升同样会影响 AI 推理(即模型在运行时的计算成本)。过去几年,我们已经看到 AI 的推理成本持续下降,同时性能不断提升。例如 Claude 3.5 Sonnet(发布于 GPT-4 之后 15 个月),在几乎所有基准测试上都超越了 GPT-4,但其 API 价格仅为 GPT-4 的 1/10。 3、范式转变(Shifting the Paradigm) AI 训练的扩展方式并非一成不变,有时核心扩展对象会发生变化,或者训练过程中会引入新的扩展方法。 在 2020-2023 年间,AI 训练的主要扩展方向是预训练模型,这些模型主要基于大规模互联网文本数据进行训练,在此基础上进行少量额外的微调训练,以提升特定能力。 进入 2024 年,利用强化学习(Reinforcement Learning, RL)训练模型生成思维链(Chain of Thought, CoT) 成为 AI 训练的新焦点。 Anthropic、DeepSeek,以及 OpenAI(2024 年 9 月发布的 o1-preview 模型)等公司发现,这种训练方式可以显著提升模型在某些客观可衡量任务上的表现,特别是在数学推理、编程竞赛、以及类似数学和编程的复杂逻辑推理。 新的训练范式采用两阶段方法,先训练传统预训练模型,使其具备基础能力。其次,通过强化学习(RL) 增强模型的推理能力。 由于这种 RL 训练方法仍然较新,当前所有公司在 RL 阶段的投入都较少,因此仍处于早期规模化阶段。仅从 10 万美元扩展到 100 万美元的训练投入,就能带来巨大性能提升。 企业正在迅速推进 RL 训练的扩展,预计很快将达到数亿美元甚至数十亿美元级别。目前,我们正处于一个独特的「交叉点」(crossover point),AI 训练正在经历重要的范式转变,由于 RL 训练仍处于早期扩展阶段,因此可以在短时间内实现快速性能突破。 DeepSeek 的模型 上述三大 AI 发展动态可以帮助我们理解 DeepSeek 最近发布的模型。 大约一个月前,DeepSeek 推出了「DeepSeek-V3」,这是一个纯预训练模型,即前文第 3 点中提到的第一阶段模型。随后,上周他们又发布了 「R1」,在 V3 的基础上增加了第二阶段训练。虽然外界无法完全了解这些模型的内部细节,但以下是我对这两次发布的最佳理解。 DeepSeek-V3 才是 DeepSeek 近期的真正创新,早在一个月前就值得引起关注(我们当时确实注意到了)。 作为一个纯预训练模型,DeepSeek-V3 在某些关键任务上的表现接近美国最先进的 AI 模型,但训练成本要低得多。(不过,我们发现 Claude 3.5 Sonnet 在某些关键任务上仍然明显更强,特别是现实世界中的编程能力。) DeepSeek 团队能够做到这一点,主要依赖于一系列真正出色的工程创新,特别是在计算效率优化方面,包括「键-值缓存」(Key-Value Cache)管理的创新优化,提高了模型在推理过程中的效率,以及对「专家混合模型」(Mixture of Experts, MoE)技术的突破性应用,使其在大规模 AI 模型中的表现优于以往。 然而,我们需要更仔细地分析: DeepSeek 并没有「用 600 万美元⁵完成了美国 AI 公司花费数十亿美元才能做到的事情」。就我能代表的 Anthropic 而言,Claude 3.5 Sonnet 是一个中等规模的模型,训练成本为几千万美元(具体数字我不会透露)。此外,关于 3.5 Sonnet 训练过程中使用了更大、更昂贵的模型的传言并不属实。Sonnet 的训练是在 9 到 12 个月前进行的,而 DeepSeek 的模型是在去年 11 月至 12 月训练的。 尽管如此,Sonnet 在许多内部和外部评测中仍然明显领先。因此,更准确的说法应该是:「DeepSeek 以相对较低的成本训练出了一个接近 7 到 10 个月前的美国模型性能的模型,但成本远没有人们所说的那么低。」 如果按照过去的趋势,AI 训练成本每年大约下降 4 倍,那么在正常情况下——比如 2023 年和 2024 年的成本下降趋势——我们可以预期,现在的模型训练成本应该比 3.5 Sonnet 或 GPT-4o 低 3 到 4 倍。而 DeepSeek-V3 的性能仍然逊色于这些美国最前沿的模型——大约差 2 倍(这个估计对 DeepSeek-V3 来说已经相当慷慨了)。这意味着,如果 DeepSeek-V3 的训练成本比一年前的美国顶级模型低 8 倍,那也是正常的,符合趋势的,并不是什么意外突破。 事实上,DeepSeek-V3 的成本下降幅度甚至比 GPT-4 到 Claude 3.5 Sonnet 的推理价格下降幅度(10 倍)还要小,而 3.5 Sonnet 本身比 GPT-4 还要强。这一切都说明,DeepSeek-V3 既不是技术上的革命性突破,也没有改变大语言模型(LLM)的经济模式,它只是符合现有成本下降趋势的一个正常案例。 不同之处在于,这次率先实现预期成本下降的是一家中国公司。这在历史上是第一次发生,因此具有重要的地缘政治意义。不过,美国 AI 公司很快也会跟上这一趋势,而且它们并不是通过复制 DeepSeek 来实现的,而是因为它们自身也在沿着既定的成本下降曲线前进。 无论是 DeepSeek 还是美国 AI 公司,现在都拥有比训练它们现有主力模型时更多的资金和芯片。这些额外的芯片被用于研发新的模型技术,有时也会用于训练尚未发布、或者需要多次尝试才能完善的大型模型。 据报道(尽管我们无法确认其真实性),DeepSeek 实际上拥有 50000 片 Hopper 代 GPU⁶,而我估计这大约是美国主要 AI 公司 GPU 规模的 1/2 到 1/3(例如,这个数量比 xAI 的「Colossus」集群少 2 到 3 倍)⁷。这 50000 片 Hopper GPU 的成本大约在 10 亿美元左右。 因此,DeepSeek 作为一家公司(而不仅仅是某个单一模型的训练费用)的总投入,并没有与美国 AI 研究实验室有巨大的差距。 值得注意的是,「扩展曲线」(scaling curve)的分析其实有些过于简化了。不同的模型各有特点,擅长的领域也不同,而扩展曲线的数值只是一个粗略的平均值,忽略了许多细节。 就我所了解的 Anthropic 的模型而言,正如我之前提到的,Claude 在代码生成和与用户进行高质量互动方面表现极佳,许多人甚至将其用于个人建议或支持。在这些方面,以及其他一些特定任务上,DeepSeek 根本无法与之相比,而这些差距并不会直接反映在扩展曲线的数据中。 上周发布的 R1 让公众高度关注,并导致英伟达股价下跌约 17%。但从创新或工程角度来看,R1 远不如 V3 令人兴奋。 R1 只是在训练中增加了第二阶段——强化学习(这一点在上一部分的 #3 中有提到),本质上是对 OpenAI 在 o1 版本中的方法的复现(两者的规模和效果似乎相近)⁸。不过,由于目前仍处于扩展曲线的早期阶段,多家公司都有可能训练出类似的模型,前提是它们有一个强大的预训练基础模型。 在 V3 现有的基础上训练出 R1 可能成本非常低。因此,我们正处于一个有趣的「交叉点」:在这个阶段,多个公司都能训练出优秀的推理能力模型。但这种情况不会持续太久,随着模型继续沿扩展曲线向上发展,这种「门槛较低」的窗口期将很快结束。 芯片出口管制 以上分析其实只是为我真正关注的话题做铺垫——对中国的芯片出口管制。结合前面的事实,我认为当前的情况如下: AI 训练的趋势是,企业会投入越来越多的资金来训练更强大的模型。虽然训练同等智能水平模型的成本在不断下降,但 AI 模型的经济价值实在太高,因此节省下来的成本几乎立即被重新投入,以训练更强大的模型,而整体支出仍然保持在原来的高额水平。 DeepSeek 研发的效率优化方法,如果美国实验室还没有掌握,那么很快也会被美中双方的实验室应用于训练价值数十亿美元的 AI 模型。这些新模型的表现将比原本计划训练的多亿美元级模型更强,但投入依然会是数十亿美元,并且这个数字还会持续上升,直到 AI 智能水平超越几乎所有人在几乎所有领域的能力。 要打造这样比几乎所有人都更聪明的 AI,需要数百万颗芯片、至少数百亿美元的资金,并且最有可能在 2026-2027 年实现。DeepSeek 的最新发布并不会改变这个趋势,因为它们的成本下降幅度仍然在预期范围内,这一点早已纳入行业的长期计算。 这意味着,到 2026-2027 年,世界可能会出现两种截然不同的局面,在美国,多家公司肯定会拥有所需的数百万颗芯片(成本高达数百亿美元)。问题在于,中国是否也能获得数百万颗芯片⁹。 如果中国能够获得数百万颗芯片,我们将进入一个双极世界(bipolar world),即美国和中国都拥有强大的 AI 模型,推动科学技术以前所未有的速度发展——我称之为「数据中心里的天才国家」(countries of geniuses in a datacenter)。 但双极世界未必会长期保持平衡。即使中美 AI 技术暂时相当,中国可能会投入更多的人才、资金和精力来将 AI 技术应用于军事领域。再加上中国庞大的工业基础和军事战略优势,这可能使中国不仅在 AI 领域取得主导地位,甚至在全球各个领域占据领先。 如果中国无法获得数百万颗芯片,我们至少暂时会进入一个单极世界(unipolar world),即只有美国及其盟友掌握最先进的 AI 模型。这个单极局面是否会持续并不确定,但至少有可能出现这样一种情况:由于 AI 系统可以帮助构建更强的 AI,短暂的领先可能会被转化为长期优势¹⁰。在这种情况下,美国及其盟友可能会在全球舞台上取得决定性并长期的主导地位。 因此,严格执行的出口管制¹¹是阻止中国获取数百万颗芯片的唯一有效手段,也是决定世界最终是单极还是双极格局的最重要因素。 DeepSeek 的成功并不意味着出口管制失效。正如我之前所说,DeepSeek 实际上拥有相当可观的芯片资源,因此他们能够开发并训练出强大的模型并不令人意外。他们在资源上并没有比美国 AI 公司受到更大的限制,出口管制也并不是促使他们「创新」的主要原因。他们只是非常优秀的工程师,而这正说明了中国在 AI 领域是美国的严峻竞争对手。 DeepSeek 的成功也并不意味着中国可以一直通过走私获得所需的芯片,或者出口管制存在无法堵住的漏洞。我认为,出口管制从来就不是为了阻止中国获得几万颗芯片。10 亿美元的经济活动可以隐藏,但 100 亿美元甚至 10 亿美元的活动就难以掩盖了,而要偷偷运送上百万颗芯片在物理上也可能极为困难。 我们还可以看看目前 DeepSeek 被报道所拥有的芯片类型。据 SemiAnalysis 分析,DeepSeek 现有的 50000 片 AI 芯片是 H100、H800 和 H20 的混合。 H100 自推出以来就受到出口管制的限制,因此如果 DeepSeek 拥有 H100,那它们必然是通过走私获得的。(不过,值得注意的是,英伟达曾表示 DeepSeek 的 AI 进展「完全符合出口管制规定」)。 H800 在 2022 年最初的出口管制政策下仍可出口,但在 2023 年 10 月政策更新后被禁止,因此这些芯片可能是在禁令生效前运送的。 H20 在训练方面效率较低,但在推理(采样)方面更高效,目前仍允许出口,但我认为它也应该被禁止。 综上所述,DeepSeek 拥有的 AI 芯片主要包括目前尚未被禁(但应该被禁)的芯片、在被禁之前获得的芯片、可能通过走私获取的少量芯片。 这实际上表明了出口管制正在发挥作用,并且在不断调整优化:如果出口管制完全无效,DeepSeek 现在很可能会拥有一整批顶级的 H100 芯片。然而,事实并非如此,这说明政策正在逐步堵住漏洞。如果我们能够足够快地加强管控,就可能阻止中国获得数百万颗芯片,从而提高美国维持 AI 领先地位、形成单极世界的可能性。 关于出口管制和美国国家安全,我想明确一点: 我并不认为 DeepSeek 本身是对手,我也不是专门针对这家公司。从他们接受采访时的表现来看,DeepSeek 的研究人员看起来像是聪明、充满好奇心的工程师,他们只是想开发出有用的技术。 出口管制是我们最强有力的手段之一,能够阻止这种情况发生。有人认为,AI 技术变得越来越强、性价比越来越高,是一个应该放松出口管制的理由——但这完全没有道理。 脚注 1 关于模型蒸馏:在这篇文章中,我不对有关 DeepSeek 是否对西方模型进行蒸馏的报道发表任何看法。我仅基于 DeepSeek 论文中提供的信息,假设他们确实按照自己所述的方式训练了模型。 2 DeepSeek 的发布并不影响英伟达:事实上,我认为 DeepSeek 模型的发布显然不会对英伟达造成负面影响,而英伟达股价因此下跌约 17% 让我感到困惑。从逻辑上讲,DeepSeek 的发布对英伟达的影响甚至比对其他 AI 公司的影响还要小。但无论如何,我这篇文章的主要目的是为出口管制政策辩护。 3 关于 R1 训练方式的细节:更精确地说,R1 是一个预训练模型,并且仅进行了少量的强化学习(RL)训练,这种做法在推理范式变革前的模型中很常见。 4 DeepSeek 在某些特定任务上表现较强:但这些任务范围非常有限。 5 关于 DeepSeek 论文中提到的「600 万美元训练成本」:这个数据是 DeepSeek 论文中引用的,我在这里暂且接受,并不对其真实性提出质疑。不过,我质疑的是将此与美国 AI 公司的训练成本直接对比的合理性。600 万美元仅指训练某个具体模型的成本,但 AI 研发的整体成本要远远高于这个数字。此外,我们也无法完全确定 600 万美元的真实性——虽然模型规模可以验证,但训练时使用的 token 数量等因素却难以核实。 6 关于 DeepSeek 现有芯片的更正:在一些采访中,我曾说 DeepSeek 拥有 「50,000 片 H100」,但这实际上是对相关报道的不准确概括,在此更正。H100 是目前最知名的 Hopper 架构芯片,所以我当时假设报道所指的就是 H100。但实际上,Hopper 系列还包括 H800 和 H20,DeepSeek 拥有的是这三种芯片的混合,总数为 50000 片。虽然这个事实并不会改变整体情况,但仍值得澄清。我在讨论出口管制时会更详细地分析 H800 和 H20 的问题。 10 出口管制的目标:这里需要明确一点,目标并不是剥夺中国从 AI 科技进步中获益的机会——AI 在科学、医疗、生活质量等领域的突破,理应造福所有人。真正的目标是防止这些国家在军事领域取得主导地位。
CounterPoint报告2024中国手机市场销量:华为同比增36%强势领跑、小米增10%、vivo增6%
IT之家 1 月 30 日消息,市场调查机构 CounterPoint Research 于 1 月 28 日发布博文,报告称 2024 年中国智能手机销量同比增长 1.5%。 根据 Counterpoint 的中国智能手机周度销量追踪数据,2024 年中国智能手机销量同比增长 1.5%。但市场表现并不均衡,年初和年末都相对疲软,不及上年同期;不过,从第 5 周到第 36 周,销量普遍好于去年同期。IT之家附上图片如下: 细分到品牌方面,各主要品牌的业绩差异显著。华为同比增长高达 36%,领跑市场;小米和 vivo 分别同比增长 10% 和 6%;与之形成对比的是,苹果、OPPO 和荣耀的销量同比分别下滑了 13%、9% 和 3%。 中国政府已将智能手机等电子产品纳入国家消费补贴范围,旨在刺激内需,这将有望推动 2025 年手机销量的增长。 总结而言,2024 年中国智能手机市场销量同比小幅增长,但品牌表现分化明显,华为强势领跑。展望 2025,消费补贴政策利好市场,但经济下行压力仍不容忽视,未来发展仍需谨慎观望。
深挖Pixel 4a手机“死亡更新”事件,谷歌限制电压导致续航骤降
IT之家 1 月 30 日消息,科技媒体 Android Authority 今天(1 月 30 日)发布博文,跟进 Pixel 4a 手机“死亡更新”后续,发现谷歌的最新更新降低了 Pixel 4a 的电池电压,导致电池容量下降。 IT之家此前报道,Pixel 4a 手机在系统更新后出现电池续航骤降问题,被用户称为“死亡更新”。 安全专家和开发者 Hector Martin 对此展开了调查,发现谷歌的最新更新降低了 Pixel 4a 的电池电压,导致电池容量下降。 更新前,Pixel 4a 的电池可以充电至最高 4.44 伏;更新后,系统将最高电压限制在 3.95 伏。 Martin 指出,3.87V 标称电压的锂聚合物电池,最高电压通常在 4.45V 左右。原先的设置并没有问题,而现在的设置过于保守。 通常手机厂商会允许电池充电至接近最大电压,以保证用户获得最佳续航体验。谷歌在更新后限制了 Pixel 4a 的电池电压,导致用户体验下降。 电池电压降低意味着电池能够储存的能量减少,从而导致续航时间缩短,需要更频繁地充电。 并非所有 Pixel 4a 手机都受此影响,问题主要出现在使用特定厂商电池的机型上。Pixel 4a 主要使用两种不同厂商生产的电池,分别为 ATL 和 LSN,此次“死亡更新”问题主要影响使用 LSN 电池的机型。 用户可以通过电池 QR 码旁的数字识别电池型号。8230015901 为 ATL(未受影响),8230020501 为 LSN(受影响)。Martin 建议用户在更换电池时选择 ATL 的电池。
又一车企妥协:阿尔法·罗密欧即将放弃2027年全面电动化目标
快科技1月30日消息,日前,阿尔法·罗密欧宣布将放弃2027年在北美全面实现电动化的目标,转而采用多种动力形式并举的战略,其中包括燃油车。 阿尔法·罗密欧北美区负责人表示,目前市场环境下,要求经销商仅销售电动汽车是不可行的,因为这将使经销商面临生存困境。 此前,大众、奔驰、保时捷、沃尔沃、路特斯等车企也因市场条件和客户需求变化,纷纷调整了全面电动化的目标。 例如,沃尔沃曾计划2030年全面停售内燃机汽车,但现已调整目标; 路特斯放弃了2028年全面电动化的计划,转向推出“超级混动”车型; 保时捷表示电动汽车销量占比目标的实现将推迟; 奔驰将电动车销售占比计划推迟到2030年; 福特和通用汽车也分别推迟了电动汽车生产计划。
告别颗粒感:三星改善Galaxy S25 Ultra手机屏幕,已无抹布屏问题
IT之家 1 月 30 日消息,消息源 @i冰宇宙 昨日(1 月 29 日)发布微博,表示三星 Galaxy S25 Ultra 在低亮度下,已解决抹布屏问题,大幅减少颗粒感,而且屏幕均匀性还很好。 消息源对比了三星 Galaxy S25 Ultra、三星 Galaxy S24 Ultra 的屏幕,可以很容易地发现,Galaxy S24 Ultra 屏幕在低亮度下的颜色表现完全不同,这种情况被称为颗粒状纹理或颗粒感,在微博中将其描述为抹布屏。IT之家附上截图如下: 三星改进 Galaxy S25 Ultra 手机上的显示技术,成功解决了 S24 Ultra 使用的 M13 材料组 OLED 面板上的颗粒感问题。
丰田2024年汽车销量1080万辆,同比下降3.7%仍坐全球头把交椅
IT之家 1 月 30 日消息,丰田汽车公司今日宣布 2024 年销量达 1080 万辆(包括日野、大发等子品牌),蝉联全球销量最高的汽车制造商,这是其连续第五年蝉联这一位置。 丰田去年的全球销量同比下降了 3.7%。销量的下降主要源于日本市场的萎缩,尤其受到了大发认证测试程序治理问题的影响。 据路透社报道,德国竞争对手大众汽车集团本月早些时候发布的报告显示,其去年销量同比下降了 2.3%,略高于 900 万辆,部分原因是其在削减成本的同时,还需应对中国市场的价格竞争。 丰田母品牌(IT之家注:包括丰田和雷克萨斯)的销量在 2024 年下降了 1.4%,降至 1020 万辆,主要受到日本市场两位数下滑的拖累。 尽管丰田整体销量创下新纪录,且部分受益于美国市场对混合动力车型的需求,但在中国市场,其销量却下降了 6.9%,原因是市场竞争激烈,价格战愈演愈烈。 在丰田、雷克萨斯品牌的销量中,混合动力车型占比创历史新高,达到了 40.8%。纯电动车型则占比为 1.4%。
全球首次,沃达丰使用普通智能手机完成卫星视频通话
IT之家 1 月 30 日消息,据路透社报道,当地时间 1 月 29 日,沃达丰宣布通过卫星在偏远地区使用普通智能手机成功进行了全球首个视频通话,并计划于今年晚些时候及 2026 年在欧洲推广这一技术,为更多用户提供服务。 本周一,沃达丰的首席执行官马尔格丽塔・德拉・瓦莱接到了公司工程师罗温・切斯梅尔的电话。后者当时位于没有任何网络信号的威尔士山区。 德拉・瓦莱在周三接受采访时表示:“我们使用了唯一能够提供全面移动体验的卫星服务。借助普通设备,用户不仅可以打语音电话、发短信,还能进行视频通话。我们的目标是尽快将这项服务推广给用户。” 据IT之家了解,沃达丰借助 AST SpaceMobile 的五颗 BlueBird 卫星,在低地球轨道提供最高可达 120Mbps 的传输速度,适用于标准智能手机。 沃达丰也是 AST SpaceMobile 的投资者之一,其他投资者还包括 AT&T、Verizon、谷歌等知名企业。
特斯拉单车销售成本达到了历史最低水平 一辆车仅25万元
快科技1月30日消息,今天特斯拉发布了2024年第四季度及全年财报。 财报显示,在第四季度,特斯拉单车销售成本达到了历史最低水平,低于35000美元(约合人民币25.3万元)。 特斯拉解释道,这主要得益于原材料成本的改善,这帮助特斯拉部分抵消了提供有吸引力的金融和租赁方案所做的投入。 财报还提到,2024年第四季度,特斯拉在车辆交付和能源存储设备装机量方面均创下了纪录。预计Model Y将在2024年再次成为包含所有车型在内的全球最畅销车型。 特斯拉此前还表示,正在为推出更加经济的新车型做准备,并给出时间展望——将在2025年上半年开始推出。
搅动电动车市场:特斯拉2025上半年将推平价车型,预估约3万美元
IT之家 1 月 30 日消息,在今天召开的财报电话会议上,特斯拉公司宣布解锁新里程碑,车辆平均制造成本首次降至 3.5 万美元(当前约 25.4 万元人民币)以下。特斯拉公司还计划在 2025 年上半年推出新款“平价车型”,售价会比 Model 3 和 Model Y 更低。 特斯拉 2024 年经历了销量下滑和利润下降,但公司对 2025 年充满信心,计划推出更经济的车型并推进自动驾驶技术。 2024 年特斯拉全球销量十年来首次出现下滑,第四季度营收 257.07 亿美元,低于华尔街预期的 272 亿美元。第四季度净利润下降 71% 至 23 亿美元。 2024 年全年净利润下降至 84 亿美元,同比下降 23%,较 2022 年创纪录的 141 亿美元更是大幅下降 40%。尽管如此,2024 年总收入仍略有增长,达到 977 亿美元,比上一年创下的纪录略增 1%。 特斯拉计划在 2025 年上半年推出“更实惠”的车型。这些新车型将结合下一代平台和现有平台的部件,并在现有生产线上生产。该车售价尚未确定,不过汽车媒体预估售价可能会在 3 万美元(IT之家备注:当前约 21.8 万元人民币)左右。 特斯拉在电话会议中透露,这些新车型将结合下一代平台和现有平台的部件,并在现有生产线上生产,这种生产方式虽然成本降低幅度低于预期,但可以更高效地提升产量。 在自动驾驶方面,特斯拉计划于 6 月在得克萨斯州奥斯汀推出付费的无人监督 FSD(Full-Self Driving)服务。马斯克希望在年底将这项服务扩展到其他美国城市,但首先需要在得克萨斯州证明系统的安全性,并向监管机构证明其自动驾驶模式比人工驾驶更安全。 此外,马斯克还透露,多家汽车制造商对特斯拉的 FSD 系统感兴趣,但未透露具体细节。
上市四年来首次改款:2025款比亚迪海豚实车曝光
快科技1月30日消息,2025款比亚迪海豚的实车曝光,展示了明显的外观变化和性能升级。 新车在前脸设计上进行了大幅调整,采用新造型的大灯和重新设计的前包围,侧面配备隐藏式车门把手,车尾延续海洋网家族风格的尾灯造型,尾灯内部细节也进行了优化。 尺寸方面,新款海豚的长宽高分别为4280 x 1770×1570毫米,轴距为2700毫米,相比现款,车身长度有所增加。 动力方面,新款海豚提供型号为TZ200XSW的驱动电机,最大功率为130kW,搭载45.12千瓦时和60.48千瓦时的电池组,提供纯电续航410公里、420公里和520公里三种版本。 此外,新款海豚还增加了选装配置,如黑色车顶、全景天幕、黑色外后视镜保护罩等,并在智能驾驶方面进行了升级,提供三目摄像头、前翼子板摄像头等配置。 目前,2025款比亚迪海豚的官方指导价为9.98万至12.98万元。
vivo V50 5G手机渲染图首曝:骁龙7 Gen 3芯片,玫瑰红配色吸睛
IT之家 1 月 30 日消息,消息源 Yogesh Brar 昨日(1 月 29 日)在 X 平台发布推文,分享了 vivo V50 5G 手机的首张高清渲染图,并透露该机的关键规格参数。 颜色方面,曝光的渲染图展示了“玫瑰红”颜色的 vivo V50 5G 手机,消息称灵感源自印度婚礼。此前消息称,vivo 还会为该机推出蓝色和灰色版本。 外观方面,手机背面左上角是一个大型椭圆形相机模组,内部采用圆形布局,容纳了双摄像头传感器和蔡司标志,下方则是环形 LED 闪光灯。V50 的边缘采用曲面设计,边角圆润。音量键和电源键位于机身右侧。 Yogesh 还透露,V50 将采用类似 vivo X200 Pro 的四曲面屏幕,并有望成为同级别中最薄的手机。 规格方面,IT之家援引博文介绍,V50 将共享 vivo S20 手机配置,只是 S20 采用直屏,而 V50 采用曲面屏。 消息称 vivo V50 5G 手机将配备 6.67 英寸 FHD+ AMOLED 显示屏,支持 120Hz 刷新率,是搭载与 vivo S20 和 vivo V40 相同的骁龙 7 Gen 3 处理器。 相机方面,该机配备后置 5000 万像素主摄像头和 5000 万像素副摄像头,前置 8000 万像素摄像头(vivo S20 后置为 5000 万 + 800 万像素组合)。 电池方面,该机内置 6000mAh 电池(额定容量 5870mAh),支持 90W 快充(vivo S20 电池容量为 6500mAh,同样支持 90W 快充,而 vivo V40 电池容量为 5500mAh)。 存储方面,该机预估提供 8GB+128GB、8GB+256GB 和 12GB+512GB 三种存储版本。