AI资讯新闻榜单内容搜索-Deepseek

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Deepseek
Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

GLM-5.3-Flash将Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力放入同一架构,表明大模型Attention机制正从各公司独立押注的技术路线,转变为可在同一模型中分工组合的设计选项。

来自主题: AI技术研报
6831 点击    2026-09-25 10:11
梁文锋用沙盒开启RSI

梁文锋用沙盒开启RSI

梁文锋用沙盒开启RSI

DeepSeek联合清华大学发布论文公开Agent训练沙盒基础设施DSec,梁文锋署名,论文第6节揭示DeepSeek已部分实现RSI(递归自我改进)闭环,Agent可在沙盒中自主构建训练环境,标志着Agent沙盒成为下一代云基础设施的新战场。

来自主题: AI资讯
8698 点击    2026-09-25 10:10
PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

是石科技自研Meta-Infer高效推理引擎通过内核补齐、算子通信重构、并行调优与缓存复用等纯软件手段,在不改动模型前提下将DeepSeek-V4.1-Flash在PCIe显卡上的推理吞吐提升近7倍,该方法论同样适用于DeepSeek-V4-Flash、GLM5.3及国产GPU。

来自主题: AI资讯
8062 点击    2026-09-25 10:09
突发:DeepSeek Harness出桌面版了!

突发:DeepSeek Harness出桌面版了!

突发:DeepSeek Harness出桌面版了!

DeepSeek Harness推出桌面版,虽未经官方正式宣布但已通过苹果签名公证,内置智能体团队、语音输入等6个插件并提供标准、PTC、极简、创造四种工作模式,但目前仅支持macOS。

来自主题: AI资讯
8866 点击    2026-09-25 07:59
500亿元!DeepSeek接近完成第二轮融资,年化营收快速增长

500亿元!DeepSeek接近完成第二轮融资,年化营收快速增长

500亿元!DeepSeek接近完成第二轮融资,年化营收快速增长

DeepSeek接近完成500亿元人民币的第二轮融资,其年化营收在融资启动后显著增长,且公司近期迎来首任CFO并推进上市筹备工作。

来自主题: AI资讯
9155 点击    2026-09-24 16:12
马卡龙的下注:把模型后训练,做成企业服务

马卡龙的下注:把模型后训练,做成企业服务

马卡龙的下注:把模型后训练,做成企业服务

Mind Lab(马卡龙)正式发布面向企业的模型后训练与推理平台 Mint Recursive,将其从 Macaron V1.1 训练实践中沉淀的 MinT 底层系统、自动化训练与迭代管线以托管服务形式开放给企业,支持 GLM、Qwen、DeepSeek、Kimi、MiniMax 等开源基座及监督微调、强化学习、全参数训练和 LoRA。

来自主题: AI资讯
9420 点击    2026-09-24 10:10
DeepSeek新论文公开Agent训练!梁文锋署名

DeepSeek新论文公开Agent训练!梁文锋署名

DeepSeek新论文公开Agent训练!梁文锋署名

大模型训练拼的是算力,Agent训练拼的是环境。

来自主题: AI技术研报
9261 点击    2026-09-23 18:04
8万亿,梁文锋也开始卷“超大”

8万亿,梁文锋也开始卷“超大”

8万亿,梁文锋也开始卷“超大”

DeepSeek正训练约2万亿参数的新模型,并计划将后续模型参数规模进一步推至8万亿,加入新一轮超大参数模型竞赛。

来自主题: AI资讯
9537 点击    2026-09-23 16:08