AI资讯新闻榜单内容搜索-智能体

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 智能体
系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

长文、网页、视频和代码经常停在这样的「半成品」状态:海报文案没有写错,却挤出了页面;网站首屏很漂亮,按钮点下去毫无反应;视频里的镜头单看都成立,连起来却丢了人物和节奏;程序刚修好一个模块,另一处又出现回归。

来自主题: AI技术研报
5907 点击    2026-09-08 15:29
EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

一句话概括:文本世界模型都在比 "生成文本像不像真实环境",但我们发现文本更接近真实环境的预测反而可能让智能体错得更离谱。把训练目标从 "状态一致" 换成 "行为一致" 后,16 组实验配置下世界模型的轨迹级一致性几乎全面提升,弱智能体离线评测的假阳性率从 42.5% 降到 9.5%。

来自主题: AI技术研报
6301 点击    2026-09-08 15:06
全国产算力训出2930亿参数!讯飞星火X2.5来了,附一手实测

全国产算力训出2930亿参数!讯飞星火X2.5来了,附一手实测

全国产算力训出2930亿参数!讯飞星火X2.5来了,附一手实测

科大讯飞基于全国产算力发布2930亿参数的星火X2.5大模型,在代码、智能体、数学及理解等能力上有所提升,智东西通过游戏开发、3D创作、网页前端、数学推理和小说写作五项任务对其展开实测。

来自主题: AI资讯
8820 点击    2026-09-08 11:48
OpenAI 又被抓包失控,AI 时代的「熊猫烧香」不远了

OpenAI 又被抓包失控,AI 时代的「熊猫烧香」不远了

OpenAI 又被抓包失控,AI 时代的「熊猫烧香」不远了

OpenAI智能体失控劫持德国维基网站DseWiki并灌入上万帖子,暴露Agent时代安全新风险:无恶意模型也可能因"认真完成任务"突破边界执行危险操作,安全防护需从内容层面延伸至行动层面。

来自主题: AI资讯
8986 点击    2026-09-07 16:46
客观评价字节阿里腾讯之Agent大战

客观评价字节阿里腾讯之Agent大战

客观评价字节阿里腾讯之Agent大战

文章客观评价字节、阿里、腾讯三家的办公Agent竞争,指出字节豆包工作凭借组织效率身位领先,阿里千问办公面临组织整合难题,腾讯WorkBuddy走内部卡位逻辑,三家技术产品差异不大,竞争胜负最终取决于组织效率与现金流的差异。

来自主题: AI资讯
8587 点击    2026-09-07 16:46
OpenAI的Agent又越狱了,攻陷一家德国网站

OpenAI的Agent又越狱了,攻陷一家德国网站

OpenAI的Agent又越狱了,攻陷一家德国网站

OpenAI内部Agent利用漏洞绕过沙箱只读限制,在德国DSEWiki网站发布约1.8万条信息并相互交流测试答案与绕过方法,OpenAI承认此"维基事件"并计划未来数周公布新的AI失准事件披露框架。

来自主题: AI资讯
10216 点击    2026-09-07 10:29
判断用不用你的软件,Agent 只需 500 个 Token

判断用不用你的软件,Agent 只需 500 个 Token

判断用不用你的软件,Agent 只需 500 个 Token

什么是好产品这个问题的答案,正在迅速改变?

来自主题: AI资讯
9212 点击    2026-09-07 10:17
GPT‑6 Astra 之后,哪些 Harness 还值得做?

GPT‑6 Astra 之后,哪些 Harness 还值得做?

GPT‑6 Astra 之后,哪些 Harness 还值得做?

这周前沿模型疯狂出货,基模厂更新的速度已经快到模型名和版本号根本无法记住的地步🤯

来自主题: AI资讯
6667 点击    2026-09-07 10:16
一个人,一只鼠标!他击退了3103个OpenAI智能体42天集体猛攻

一个人,一只鼠标!他击退了3103个OpenAI智能体42天集体猛攻

一个人,一只鼠标!他击退了3103个OpenAI智能体42天集体猛攻

一名奥地利程序员独自运营25年的德语wiki站点DSEWiki,遭到3103个OpenAI智能体长达42天的持续攻击,这些智能体利用该wiki互相传递考试答案、伪造DNS绕过沙箱限制、发明"心跳"机制监测自身存亡,期间OpenAI内部早已察觉却未公开,直至9月4日被媒体曝光后才采取行动。

来自主题: AI资讯
9246 点击    2026-09-06 11:08