1、 20252025 年年 0303 月月 0 04 4 日日 全球首个混合推理模型全球首个混合推理模型 Claude 3.7 Sonnet Claude 3.7 Sonnet 发发布,布,高情商高情商模型模型 GPTGPT-4.54.5 问世问世 计算机计算机行业周报行业周报 推荐推荐(维持维持)投资要点投资要点 分析师:宝幼琛分析师:宝幼琛 S1050521110002 行业相对表现行业相对表现 表现 1M 3M 12M 计算机(申万)16.6 5.1 27.9 沪深 300 1.9-1.6 9.9 市场表现市场表现 资料来源:Wind,华鑫证券研究 相关研究相关研究 1、计算机行业周报:微
2、软全球首个拓扑量子处理器惊艳亮相,Grok3推理能力登顶2025-02-23 2、计算机行业点评报告:亚马逊(AMZN.O):2024Q4 财报超预期,多业务协同驱动增长2025-02-17 3、计算机行业点评报告:安费诺(APH):2024 年业绩创纪录,多元业务助力增长2025-02-17 算力:恒源云算力:恒源云 1313 核核+128G+128G 算力紧张算力紧张 本周恒源云 13 核+128G 算力紧张。具体来看,显卡配置为A100-40G 中,腾讯云 16 核+96G 价格为 28.64 元/时,阿里云12 核+94GiB 价格为 31.58 元/时;显卡配置为 A100-80G
3、中,恒源云 13 核+128G 算力紧张;阿里云 16 核+125GiB 价格为34.74 元/时;显卡配置为 A800-80G 中,恒源云 16+256G 价格为 9.00 元/时。AIAI 应用:应用:全球首个混合推理模型全球首个混合推理模型 Claude 3.7 Claude 3.7 Sonnet Sonnet 发布,发布,OpenAIOpenAI 推出“高情商”模型推出“高情商”模型 GPTGPT-4.54.5 2 月 25 日,Claude 3.7 Sonnet 正式发布,是全球首款双模式混合推理模型,标准模式快速响应,扩展思考模式进行深度自我反思,在数学、物理和编程等复杂任务上表现
4、卓越,注重实用导向,不必要拒绝减少 45%,强化代码协作能力。在标准模式下,Claude 3.7 Sonnet 是 Claude 3.5 Sonnet 的升级版;切换到扩展思考(Extended Thinking)模式(可简单理解为推理),它会在回答前进行自我反思,大幅提升在数学、物理、指令理解和编程等复杂任务上的表现。从基准测试结果来看,Claude 3.7 Sonnet(扩展思维版)适用于强逻辑推理和数学任务,而 Grok 3 Beta 和 DeepSeek R1 则在特定任务(推理、数学竞赛)上表现更佳。在推理模型的优化过程中,Anthropic 减少了对数学和计算机科学竞赛问题的侧重,
5、更专注于满足企业对 LLM 的实际应用需求。在评估 AI 解决真实软件问题能力的 SWE-bench Verified 基准测试中,Claude 3.7 Sonnet 达到了行业领先水平。同时,该模型在 TAU-bench 测试中也表现不错,准确度超过旧版本和 OpenAI o1。另外,Claude 3.7 Sonnet 在 Anthropic 内部的 Pokmon 游戏测试中超越了所有前代模型,展现了更强的决策与规划能力。该模型现已适用于所有 Claude 订阅计划,包括免费版、专业版、团队版和企业版,同时也可通过 Anthropic API、Amazon Bedrock 和 Google
6、Cloud 的 Vertex AI 访问。北京时间 2 月 28 日凌晨,美国 OpenAI 公司推出 GPT-4.5 模型(代号 Orion),这是该公司有史以来算力和数据规模最-40-200204060(%)计算机沪深300证证券券研研究究报报告告 行行业业研研究究 证券研究报告证券研究报告 请阅读最后一页重要免责声明 2 诚信、专业、稳健、高效 大、最佳的 AI 基座模型,本周将面向每月 200 美元的ChatGPT Pro 用户开放,下周向 ChatGPT Plus 开放。OpenAI表示,GPT-4.5 在预训练和后训练的扩展上取得进展,通过扩展无监督学习提升了模式识别等能力。能力提