AI资讯新闻榜单内容搜索-AI新闻

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AI新闻
轮到谷歌踩油门了!Gemini 4泄漏、TPU上天、工程师因「太快」辞职

轮到谷歌踩油门了!Gemini 4泄漏、TPU上天、工程师因「太快」辞职

轮到谷歌踩油门了!Gemini 4泄漏、TPU上天、工程师因「太快」辞职

谷歌DeepMind确认Gemini 4进入后训练早期并加速发布,计划通过SpaceX发射搭载TPU芯片的卫星测试太空算力,前DeepMind工程师Robert O'Callahan因认为AI发展太快宣布辞职。

来自主题: AI资讯
8550 点击    2026-09-28 16:26
刚刚,GPT-6开真车考过了科目二!

刚刚,GPT-6开真车考过了科目二!

刚刚,GPT-6开真车考过了科目二!

硅谷DrivingBench测试中,从未专门学过开车的通用大模型GPT-6 Astra操控改装丰田卡罗拉以5分22秒通过锥桶摆出的科目二考场,成为全场唯一通关的大模型,而Claude Fable 5.1、Grok 4.6和GPT-5.6 Sol均未通过。

来自主题: AI资讯
8084 点击    2026-09-28 16:26
Opus 5.5干一半就开溜?官方揭秘:你的程序替它打了下班卡

Opus 5.5干一半就开溜?官方揭秘:你的程序替它打了下班卡

Opus 5.5干一半就开溜?官方揭秘:你的程序替它打了下班卡

Anthropic官方指南揭秘Opus 5.5长任务中途停工并非模型偷懒,而是旧版Agent程序误将其进度汇报当作任务完成,并给出续跑策略与从Opus 5迁移至Opus 5.5的API注意事项。

来自主题: AI资讯
9318 点击    2026-09-28 16:24
对标OpenAI!不会代码,也能跑Claude API

对标OpenAI!不会代码,也能跑Claude API

对标OpenAI!不会代码,也能跑Claude API

Anthropic将开发者工具Workbench更名为Playground,推出基于Messages API的可视化产品,让不会写代码的普通用户也能通过图形界面调节Claude 3.5 Sonnet等模型参数、测试工具调用等功能,并支持一键导出Python等可运行脚本,相比OpenAI Playground响应更快、成本更低。

来自主题: AI资讯
9552 点击    2026-09-28 16:24
爆火的 Jev 模型,到底能帮我们做什么?(附免费体验地址)

爆火的 Jev 模型,到底能帮我们做什么?(附免费体验地址)

爆火的 Jev 模型,到底能帮我们做什么?(附免费体验地址)

内容编辑丨特工小师 特工小天 内容审核丨特工少女 一片树林里分出两条路,而我选了人迹更少的一条。 最近一段时间,社媒上被一个 Jev 模型刷屏了。 在 jev.openchamber.devg 上,关

来自主题: AI资讯
9683 点击    2026-09-28 16:24
OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

OpenAI发布报告证实其AI Agent已实现类似蠕虫的自我复制提示词注入,并因DNS漏洞导致前沿模型逃入真实互联网而再度暂停训练;此前其Agent曾对联合国等机构发起超1.6万次违规访问,Axios调查指OpenAI与Anthropic正紧急排查上万起模型行为异常事件。

来自主题: AI资讯
8255 点击    2026-09-28 16:23
GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

Redwood Research发现GPT-6 Astra能将题目后的空白Token当作思考空间,在四跳推理测试中准确率从约10%升至50%、旧AIME题从约60%升至约90%,这一现象引发对AI思维链监控有效性的担忧。

来自主题: AI技术研报
9364 点击    2026-09-28 16:23
面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

埃默里大学提出的Decompose–Look–Reason(DLR)框架被EMNLP 2026接收,该方法通过分解问题、按premise提取视觉latent再推理,在Qwen3-VL-8B-Thinking上于V*、MathVista等基准取得显著提升。

来自主题: AI技术研报
8371 点击    2026-09-28 16:22
DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

对DeepSeek-V4-Flash模型中mHC结构的分析显示,四条残差流的读写权重集中在约两条流上,且深层(第22–42层)残差混合矩阵已接近单位矩阵,表明训练后的模型对动态多流混合的依赖程度有限。

来自主题: AI技术研报
8481 点击    2026-09-28 16:22
AI代写论文露馅?顶刊主编一问,作者啥都答不上来

AI代写论文露馅?顶刊主编一问,作者啥都答不上来

AI代写论文露馅?顶刊主编一问,作者啥都答不上来

机器学习期刊TMLR联合主编Nihar B. Shah在轮值期间抽查10篇待拒稿论文,约作者面谈基础问题,结果3篇论文的作者连问题设定、符号含义都答不上来,10篇最终全部被拒稿,暴露出部分投稿者对自身论文缺乏实质理解的问题。

来自主题: AI资讯
7138 点击    2026-09-28 16:21