DeepSeek

行业首款 DeepSeek 量产车型落地，消息称岚图知音、梦想家已深度融合 R1 大模型

岚图知音车机云端还将持续融合和蒸馏DeepSeek R1模型。基于对DeepSeek做模型蒸馏，岚图一方面可以优化车机的智能化体验，做到技术的快速迭代；同时还可以降低智能座舱的开发和使用成本。

Andrej Karpathy 最新视频盛赞 DeepSeek：R1 正在发现人类思考的逻辑并进行复现

继近日斯坦福李飞飞、Percy Liang 等人推出 S1 后，李飞飞的学生、OpenAI 早期成员与前特斯拉 AI 总监也录制了一期最新长达 3 小时的长视频上传到 YouTube，深入浅出地从神经网络的起源、GPT-2、ChatGPT 到最近 DeepSeek-R1 介绍了 AI 大模型的系列进化：视频链接：，视频讲解十分通俗易懂，即使没有技术背景的观众也能轻松理解！尤其是在视频的第 2 个小时开始，他对最近爆火的 DeepSeek-R1 论文进行了深入介绍，并直言 DeepSeek R1 在性能方面与 OpenAI 的模型不相上下，它的出现推动了 RL 技术的发展。除了盛赞 DeepSeek-R1 的技术创新外，Andrej Karpathy 还对纯 RL 的学习能力给予了高度评价，但又指出 RL 非常非常擅长发现一种方法来“欺骗”模型，阻碍了 RLHF 成为专业技术的步伐。

《麻省理工科技评论》点评中国AI“四剑客”，每家都媲美DeepSeek

春节期间，DeepSeek 一跃成为全球瞩目的焦点。它以仅约十分之一的超低训练成本，成功推出了性能与OpenAI o1近乎相当的开源模型，对全球科技领域带来巨大冲击，先后引发美国科技股的大幅下跌，以及硅谷科技巨头和各国政要的纷纷回应，如今全球各大芯片厂商和智算云服务厂商更是积极响应、跟进适配。半个月来，DeepSeek相关话题热度居高不下，热搜频频，已成为全球科技、经济乃至政治领域的重要话题。

全球化钓鱼攻击:DeepSeek仿冒网站遍布六国，用户需警惕

奇安信XLab实验室2月6日发布最新安全报告，揭示了一波针对DeepSeek用户的大规模网络钓鱼活动。数据显示，仿冒DeepSeek的钓鱼网站数量已超过2000个，且仍在持续增长。根据报告，在2024年12月1日至2025年2月3日期间，共发现2650个仿冒DeepSeek的域名。

架构创新×模型创新！清微智能全面适配DeepSeek模型推理和训练

随着大模型技术向多场景渗透，算力需求呈现「大规模、高弹性、低成本」三重挑战。清微智能基于全球领先的可重构计算架构（CGRA）推出可重构算力芯片RPU（Reconfigurable Processing Unit），实现单机高效运行千亿级参数模型推理和训练，以动态硬件重构、全栈优化及高能效比，重新定义国产AI芯片的性价比标杆。新年伊始，DeepSeek的惊艳亮相，不仅在科技圈掀起巨浪，其影响还涉及到经济、社会、政策等多个维度，相关企业迅速跟进。

华人研究团队揭秘：DeepSeek-R1-Zero或许并不存在「顿悟时刻」

自我反思（尤其是肤浅的）有时对模型性能的助益不大。在过去这半个月里，关于 DeepSeek 的一切都会迅速成为焦点。一项非常鼓舞人心的发现是：DeepSeek-R1-Zero 通过纯强化学习（RL）实现了「顿悟」。

DeepSeek 用的 GRPO 占用大量内存？有人给出了些破解方法

自 DeepSeek-R1 发布以来，群组相对策略优化（GRPO）因其有效性和易于训练而成为大型语言模型强化学习的热门话题。 R1 论文展示了如何使用 GRPO 从遵循 LLM（DeepSeek-v3）的基本指令转变为推理模型（DeepSeek-R1）。 GRPO 是一种在线学习算法（online learning algorithm），它通过使用训练过程中由训练模型自身生成的数据来进行迭代改进。

国产大模型DeepSeek爆火，崛起背后大模型专利申请激增

近日，国产大模型DeepSeek爆火全网，凭借“低成本、高性能”的技术优势，其成为全球科技市场关注的焦点。创始人梁文锋介绍，团队主要由国内高校毕业生和没毕业的博士生组成。过硬的创新成果表明，今天的中国，正在成为顶尖人才成长的沃土、原创性创新的策源地。

感谢DeepSeek，ChatGPT开始公开o3思维链，但不完整

奥特曼兑现了承诺。 DeepSeek 带来的压力已经传递给了每一个科技公司。最近一段时间，很多生成式 AI 产品正在加速更新技术。

DeepSeek 爆红引发业界“狂欢”，第三方厂商嗅到商机跟风售卖 AI 网课 / 外设获利颇丰

国产 AI 公司深度求索开发的 AI 大模型 DeepSeek 在网络上成为爆款，作为一款开源、免费的大模型，尽管深度求索公司本身还未实现盈利，但目前已有大量其他厂商嗅到商机，打着“DeepSeek”旗号开始跟风“挣钱”。

DeepSeek R1 集成难题完美解决：Deepseek4j 已开源

一、为什么需要 deepseek4j？ 1.1 现有框架的局限性思维链内容丢失：R1 最核心的推理过程完全被忽略响应模式不兼容：无法处理"思考在前、结论在后"的输出模式参数限制：temperature、top_p 等关键参数设置失效流式处理不完善：用户体验欠佳虽然笔者上篇博客介绍了如何使用 WebFlux 直接调用 DeepSeek API，但这种方式存在一些问题：开发成本高：直接调用 API 或改造现有框架需要处理大量细节，包括请求构建、响应解析、错误处理等。一不做二不休，为了彻底解决这些问题，笔者基于 OpenAI4J[1] 项目的优秀架构，打造了一个专门面向 DeepSeek 的开箱即用方案 DeepSeek4J[2]增强支持 DeepSeek 独有的思维链和账单特性增加 Project Reactor 的全面响应式支持提供集成 Spring Boot Starter，提供自动配置二、核心特性 ✨ 完整保留思维链能力、账单🚀 响应式流式处理🛠 简单优雅的 API 设计📦 开箱即用的 Spring Boot 集成，同时支持 2.x / 3.x💡 内置调试页面🔍 详细的请求响应日志🔧 灵活的代理配置⚡️ 响应式编程支持三、快速开始 3.1 添加依赖复制3.2 配置参数复制3.3 基础使用复制3.4 进阶配置复制

行业首款 DeepSeek 量产车型落地，消息称岚图知音、梦想家已深度融合 R1 大模型

Andrej Karpathy 最新视频盛赞 DeepSeek：R1 正在发现人类思考的逻辑并进行复现

《麻省理工科技评论》点评中国AI“四剑客”，每家都媲美DeepSeek

全球化钓鱼攻击:DeepSeek仿冒网站遍布六国，用户需警惕

架构创新×模型创新！清微智能全面适配DeepSeek模型推理和训练

华人研究团队揭秘：DeepSeek-R1-Zero或许并不存在「顿悟时刻」

DeepSeek 用的 GRPO 占用大量内存？有人给出了些破解方法

国产大模型DeepSeek爆火，崛起背后大模型专利申请激增

感谢DeepSeek，ChatGPT开始公开o3思维链，但不完整

DeepSeek 爆红引发业界“狂欢”，第三方厂商嗅到商机跟风售卖 AI 网课 / 外设获利颇丰

DeepSeek R1 集成难题完美解决：Deepseek4j 已开源

联想集团正与 DeepSeek 探讨更多深入合作可能性，股价创历史新高

优必选：正验证 DeepSeek 技术在人形机器人应用场景中的有效性

钉钉 AI 助理接入 DeepSeek：可选 R1、V3 等三种模型，支持深度思考

亚马逊 CEO：AI 成本因 DeepSeek 技术大幅降低

钉钉 AI 助理接入 DeepSeek，可自主选择 R1、V3 等三种模型

算力告急！DeepSeek暂停API充值，两大模型价格策略同步调整

钉钉AI助理接入DeepSeek，支持深度思考

DeepSeek

行业首款 DeepSeek 量产车型落地，消息称岚图知音、梦想家已深度融合 R1 大模型

Andrej Karpathy 最新视频盛赞 DeepSeek：R1 正在发现人类思考的逻辑并进行复现

《麻省理工科技评论》点评中国AI“四剑客”，每家都媲美DeepSeek

全球化钓鱼攻击:DeepSeek仿冒网站遍布六国，用户需警惕

架构创新×模型创新！清微智能全面适配DeepSeek模型推理和训练

华人研究团队揭秘：DeepSeek-R1-Zero或许并不存在「顿悟时刻」

DeepSeek 用的 GRPO 占用大量内存？有人给出了些破解方法

国产大模型DeepSeek爆火，崛起背后大模型专利申请激增

感谢DeepSeek，ChatGPT开始公开o3思维链，但不完整

DeepSeek 爆红引发业界“狂欢”，第三方厂商嗅到商机跟风售卖 AI 网课 / 外设获利颇丰

DeepSeek R1 集成难题完美解决：Deepseek4j 已开源

联想集团正与 DeepSeek 探讨更多深入合作可能性，股价创历史新高

优必选：正验证 DeepSeek 技术在人形机器人应用场景中的有效性

钉钉 AI 助理接入 DeepSeek：可选 R1、V3 等三种模型，支持深度思考

​亚马逊 CEO：AI 成本因 DeepSeek 技术大幅降低

​钉钉 AI 助理接入 DeepSeek，可自主选择 R1、V3 等三种模型

算力告急！DeepSeek暂停API充值，两大模型价格策略同步调整

钉钉AI助理接入DeepSeek，支持深度思考

亚马逊 CEO：AI 成本因 DeepSeek 技术大幅降低

钉钉 AI 助理接入 DeepSeek，可自主选择 R1、V3 等三种模型