最新文章
共 1563 篇,当前第 10 / 131 页
巨头集体押注Work Agent,AI编程之后又一个应用赛道崛起了? 财联社
快科技8月3日消息,博主定焦数码透露, 华为鸿蒙7对千元机机型的适配攻坚力度远超外界预期。许多原本只在高端机型上才有的功能,也将逐步下放至千元档设备。 华为正尽最大可能将流畅体验普及到下沉市场,让更多用户受益。 目前,鸿蒙7已开启Beta版报名。此次适配机型中已包含千元档的畅享90系列,用户可前往“升级尝鲜”入口提交信息参与测试,这一举措也进一步印证了华为对中低端设备体验优化的重视程度。 资料显示,鸿蒙7首次亮相于2026年华为开发者大...
OpenAI下一代模型Astra:10项开放问题新突破 成本2000美元 via cnBeta.COM - 中文业界资讯站 author: 稿源:机器之心
智东西 作者 | 王涵 编辑 | 漠影 从年初的“小龙虾”OpenClaw爆火出圈开始,Agent的爆发便势不可挡。 从单一模型的阶段性训练与推理,到大模型训练、多模型协同推理和海量Agent持续运行……AI任务正在进入一个“永远在线”的新阶段。 在2026世界人工智能大会(WAIC 2026)上,中国工程院院士、清华大学计算机科学与技术系教授郑纬民曾提出,单智能体的Token消耗量可达传统对话应用的 百倍至千倍级 。随着海量Agent...
OpenAI下一代AI攻克10项菲尔兹奖级难题 via cnBeta.COM - 中文业界资讯站 author: 稿源:新智元
人工智能 有开发者在本地部署 Kimi K3 模型,仅需 8.24GB 内存就可以实现运行,只是运行速度为 33 秒 / Token 注意看单位。如果将内存提升到 128GB 则可以实现 20 秒 / Token,不过这也基本是性能上限,继续堆内存无法继续提高效率。目前开发者已经将基于 C99 开发的推理引擎开源,有兴趣的用户可以研究看看。查看全文:https://ourl.co/114176
arXiv:2607.28633v1 公告类型:新 摘要:分类 LLM 推理会造成数据中心网络问题,现有系统无法正确解决该问题。当预填充和解码在不同的 GPU 池上运行时,必须在它们之间传输 KV 缓存。对于 70B 型号,每个请求为 2.6 GB,在生产规模上超过 100 GB/s 聚合。然而,DistServe、Splitwise 和 Mooncake 都使用统一的 RDMA,忽略了两个 GPU 之间的带宽根据其物理关系变化了 72...
arXiv:2607.28629v1 公告类型:新 摘要:从反应式大语言模型 LLM 到持久的、可操作的系统的快速过渡暴露了对 Agentic AI 架构理解的关键差距,特别是在分离自主 AI 代理的推理、编排和执行层方面。尽管最近取得了进展,但用于设计和评估全栈代理系统的统一框架仍然有限。本文提出了一种全面的、分层的 Agentic AI 架构,概述了从反应式 LLM 接口到具有记忆、规划和持续执行功能的持久、目标驱动的自主 AI 代...
你们团队负责认证模块的那个人如果明天离职,你知道哪些文件会变成孤儿吗?大多数团队的回答是”不太确定”。CODEOWNERS 文件写了名义归属,但 git log 讲的才是真话。OpenAI 内部安全团队最近释出的 Security Ownership Map,干的事情就是把这两者之间的差距量化出来。 它的思路不复杂:扫一遍 git 历史,提取每个人碰了哪些文件。然后做两件传统安全扫描器不干的事,算 bus factor 和标记孤儿敏感代...
AI 又又造词,Graph 就又要替代 Loop 了? via 掘金人工智能本月最热 author: 恋猫de小郭