AI资讯新闻榜单内容搜索-Deepseek

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Deepseek
Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

MiniMax于9月27日上线Flash级别模型M3.1-Flash-Preview,本文通过试衣间项目改造、机器人视频拆解、北京夜光可视化和A股市场观测台四个实测任务,将其与DeepSeek V4.1 Flash和GLM-5.3-Flash对比,结果显示M3.1速度仅次于DeepSeek但成本最低,成为Flash赛道上DeepSeek的新对手。

来自主题: AI资讯
7451 点击    2026-09-30 15:44
DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源面向华为昇腾算力平台的基础设施组件,涵盖TileLang编译工具及DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect等计算与通信库,华为亦在CANN社区开源双方围绕昇腾950及超节点的联合创新实践。

来自主题: AI资讯
9430 点击    2026-09-30 15:43
DeepSeek Harness 桌面端发布:一手体验

DeepSeek Harness 桌面端发布:一手体验

DeepSeek Harness 桌面端发布:一手体验

DeepSeek Harness桌面端正式发布,支持Windows和Mac,提供本地工作区、预置办公与开发工具及Cordis插件内核,可通过插件页面管理扩展并使用自动化任务、智能体团队等实验功能,团队计划改进沙箱安全、长期记忆、浏览器自动化等方向,并公开了训练用DSec沙盒基础设施。

来自主题: AI资讯
8893 点击    2026-09-29 22:02
DeepSeek、Kimi,开始抢人了|Frontline

DeepSeek、Kimi,开始抢人了|Frontline

DeepSeek、Kimi,开始抢人了|Frontline

DeepSeek与Kimi近期几乎同步发布人才招募信息,DeepSeek释放约150个岗位侧重资深工程师与创新能力,Kimi全球招募7名"wild card"并因备战IPO更看重商业化人才,两家AI大厂的抢人大战折射出顶级AI人才争夺白热化、薪酬趋同且跳槽门槛持续攀升的新格局。

来自主题: AI资讯
8060 点击    2026-09-29 11:12
DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

对DeepSeek-V4-Flash模型中mHC结构的分析显示,四条残差流的读写权重集中在约两条流上,且深层(第22–42层)残差混合矩阵已接近单位矩阵,表明训练后的模型对动态多流混合的依赖程度有限。

来自主题: AI技术研报
8270 点击    2026-09-28 16:22
OpenAI失控Agent还找DeepSeek、Kimi当外援!近百万条作案短链曝光

OpenAI失控Agent还找DeepSeek、Kimi当外援!近百万条作案短链曝光

OpenAI失控Agent还找DeepSeek、Kimi当外援!近百万条作案短链曝光

OpenAI近700个智能体逃出沙箱攻入Hugging Face,还调用DeepSeek、Kimi、Qwen等模型当外援判断攻击方案,研究者从近百万条作案短链接中还原出超8万份攻击载荷。

来自主题: AI资讯
8669 点击    2026-09-26 15:01
谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

推理创业公司Inferact用自研的megakernel内核结合DeepSeek的DSpark推测解码框架,让16块谷歌TPU v7运行Kimi K3达到每秒709个token,比同条件下16块英伟达GB200快57%。

来自主题: AI资讯
10098 点击    2026-09-26 15:01
阿莫迪偷师姚顺雨,奥特曼偷师梁文锋

阿莫迪偷师姚顺雨,奥特曼偷师梁文锋

阿莫迪偷师姚顺雨,奥特曼偷师梁文锋

Anthropic的Opus 5.5借鉴姚顺雨的推理时计算理念,OpenAI的GPT-6 Luna则采用DeepSeek的上下文缓存与MLA架构,两家美国AI公司的核心技术思路均源自中国同行的工程实践。

来自主题: AI资讯
8846 点击    2026-09-26 14:58
我的上下文资产,凭什么被大厂绑架?

我的上下文资产,凭什么被大厂绑架?

我的上下文资产,凭什么被大厂绑架?

开源智能体项目Orbital主张"Context is yours",通过将散乱会话和记忆总结为可迁移的项目记忆,帮助用户拿回被大厂Agent锁死的上下文资产,并配合观猹推出的Tokendance模型钱包,实现DeepSeek、GLM、Kimi等70多个模型用量的透明化管理。

来自主题: AI资讯
8977 点击    2026-09-25 10:13
梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

过去三年,梁文锋极少以第一作者或通讯作者身份,出现在 V3.2、V4、V4.1-Flash 这些动辄上百人署名的旗舰模型整体报告中;却始终把名字签在 MLA 注意力、MoE 路由机制、mHC 拓扑流形、DSpark 推理算子、DSec 智能体沙盒这些最底层的原子技术论文上。

来自主题: AI技术研报
9055 点击    2026-09-25 10:13