最新文章
共 1569 篇,当前第 11 / 131 页
arXiv:2607.28633v1 公告类型:新 摘要:分类 LLM 推理会造成数据中心网络问题,现有系统无法正确解决该问题。当预填充和解码在不同的 GPU 池上运行时,必须在它们之间传输 KV 缓存。对于 70B 型号,每个请求为 2.6 GB,在生产规模上超过 100 GB/s 聚合。然而,DistServe、Splitwise 和 Mooncake 都使用统一的 RDMA,忽略了两个 GPU 之间的带宽根据其物理关系变化了 72...
arXiv:2607.28629v1 公告类型:新 摘要:从反应式大语言模型 LLM 到持久的、可操作的系统的快速过渡暴露了对 Agentic AI 架构理解的关键差距,特别是在分离自主 AI 代理的推理、编排和执行层方面。尽管最近取得了进展,但用于设计和评估全栈代理系统的统一框架仍然有限。本文提出了一种全面的、分层的 Agentic AI 架构,概述了从反应式 LLM 接口到具有记忆、规划和持续执行功能的持久、目标驱动的自主 AI 代...
你们团队负责认证模块的那个人如果明天离职,你知道哪些文件会变成孤儿吗?大多数团队的回答是”不太确定”。CODEOWNERS 文件写了名义归属,但 git log 讲的才是真话。OpenAI 内部安全团队最近释出的 Security Ownership Map,干的事情就是把这两者之间的差距量化出来。 它的思路不复杂:扫一遍 git 历史,提取每个人碰了哪些文件。然后做两件传统安全扫描器不干的事,算 bus factor 和标记孤儿敏感代...
AI 又又造词,Graph 就又要替代 Loop 了? via 掘金人工智能本月最热 author: 恋猫de小郭
速递|Agent语音Smallest.ai融资1300万美元,用小型模型让AI学会对话打断与思考 Sohu
国家超算互联网上线DeepSeek-V4-Flash正式版API 一键调用、无需配置 日前,DeepSeek宣布,DeepSeek-V4-Flash正式版API开启公测。随后,国家超算互联网宣布, DeepSeek-V4-Flash正式版模型DeepSeek-V4-Flash-0731已正式上线,同步提供API调用服务及模型文件。 据介绍,国家超算互联网现面向企业和开发者开放该模型的API调用服务, 无需进行繁琐的环境配置,即可快速接入...
文 | 赵京娜 访谈 编辑 | 海若镜 36氪获悉,近日奇点逃逸完成千万级种子轮融资,由星连资本与水木创投联合领投,奇绩创坛跟投。其正在研发AI原生团队协作操作系统Nexus,让人、Agent、任务、知识和工具基于同一份组织状态持续协作,并让系统从每一次协作中有证据地变强。 奇点逃逸创始人兼CEO薛传奕,本科、博士阶段均在清华大学就读,研究方向覆盖强化学习与多智能体,曾以第一作者身份在NeurIPS、CJA等学术会议和期刊发表论文;在商...
今日热点导览 马斯克关注了DeepSeek的X账号 祥鹏航空回应航班误发过期方便面 OpenAI或将IPO推迟到明年 SpaceX首份财报即将发布 小米多款手机正式涨价 每月10万美元,特朗普“真实社交”售卖“优先访问权” TOP3大新闻 蔡崇信宣布离婚,不涉及出售阿里股份 8月1日,阿里巴巴集团董事会主席、美国职业篮球队布鲁克林篮网主要所有者蔡崇信与妻子吴明华决定结束持续近30年的婚姻。声明称,这一决定由双方共同作出,彼此仍保持尊重,...
OpenAI 发布了 Astra,这是一个未发布的模型,旨在解决复杂、长时间运行的任务,此前其内部版本在数学和理论计算机科学方面取得了十项重大进展。 ...