智象未来CTO姚霆:多媒体创作Agent的技术底座已经成型 | GenAICon 2026
主讲人:姚霆智猩猩整理编辑:六六当AI开始不只是回答问题,而能帮你完成整个创作流程时,我们的创作方式也悄然发生改变。近10年大模型不断突破,从文字对话到图像生成,再到视频创作,AI的能力让人眼花缭乱。但更让人兴奋的是Agent时代的到来——我们不再需要一个个独立工具,而是拥有一个可以理解我们的想法并能执行创意的...
2026-07-16 10:15:42
旧内存再利用?详解Meta最新发布的Vistara芯片
本文授权转载自公众号SDNLAB数据中心里有一个长期被低估的矛盾:服务器的CPU利用率还远未饱和,网络带宽也绰绰有余,但内存已经告急,新的任务再也塞不进去了。据Meta统计,在其数百万台服务器构成的超算集群里,有高达43.7%的服务器内存容量受限。内存已成为拖垮业务、拉高成本、增加碳排放的核心瓶颈,核心问题集中三点:...
2026-07-15 17:32:50
OCS:AI数据中心里的“光学立交桥”
过去几年,AI芯片的故事讲得最多的是GPU、HBM、先进封装和光模块。但当大模型越做越大,真正让数据中心“跑起来”的,不只是单颗芯片有多强,而是成千上万颗芯片能不能像一个整体一样协同工作。这就引出了一个正在升温的新词:OCS,Optical Circuit Switch,光电路交换机,也常被称为全光交换机。听起来很“通信”,但它其实和...
2026-07-14 17:10:45
NVIDIA 全模态世界模型 Cosmos 3 与 BlackWell GPU 加速物理 AI|公开课
智猩猩出品策划:家祥物理 AI 正在从数字世界走向现实世界。 与生成文本或代码不同,物理 AI 面向辅助驾驶、机器人等真实世界中的自主系统。这些系统需要在物理环境中完成实时感知、理解、推理与执行复杂动作,其开发涉及数据生成、仿真、策略训练、评估和部署等复杂工作流。当前,物理 AI 正加速落地智能汽车辅助驾驶、工...
2026-07-14 15:15:41
技术设计与商业路径:NVIDIA Vera CPU到底不同在哪里?
核心观点1. Chiplet 架构与长尾延迟陷阱核心问题:Chiplet 架构的跨 Die 数据跳转会引入不可预测的长尾延迟,导致显存内的 KV Cache 被提前逐出,触发 GPU 频繁进行重计算,直接降低 GPU 的 Token Goodput(有效吞吐量)。运行机制:智能体应用的核心特征是多轮、长程的“GPU 推理-CPU 调度-GPU 推理”间歇性会话。在 CPU 执...
2026-07-13 18:44:54
HBM之父金正浩教授:AI本质就是内存
韩国KAIST教授金正浩在访谈中解释GPU利用率偏低的原因,指出AI计算的大量时间消耗在数据读取、传输和等待,单纯增加算力难以解决系统瓶颈。图片来源:韩国MoneyGuide访谈「即使安装100万台NVIDIA GPU,实际工作时间也只有10%」被称为HBM之父的KAIST金正浩教授在最近的一次采访中说道。其余90%的时间,GPU都在等待内存中的数...
2026-07-10 19:13:53
下周三开讲!NVIDIA RTX PRO Blackwell 桌面 GPU 加速 AI 与专业视觉计算|公开课
智猩猩出品策划:家祥从本地大模型微调与推理、生成式 AI 设计开发,到数据科学挖掘分析与 3D 仿真建模,专业用户对桌面工作站的 AI 算力需求正呈现指数级增长。但传统桌面 GPU 受限于显存容量、AI 计算吞吐量及多任务并行处理能力,存在明显性能瓶颈,无法适配日趋复杂的桌面端 AI 开发与专业视觉计算场景。NVIDIA RTX PRO...
2026-07-10 18:27:20
AI推理芯片架构,看这一篇就够了!
00简介自2022年以来,五家初创公司——Cerebras、Groq、SambaNova、Etched和Tenstorrent——专门设计了用于LLM推理的芯片。它们的共同认知是:NVIDIA的GPU专为训练优化(通过大规模并行计算数十亿个参数),而推理则遵循截然不同的逻辑——顺序执行、对延迟敏感,并受限于内存带宽。到2026年的情况是:Cerebras声称其Llama 3.1 40...
2026-07-09 18:02:21
AlphaZero核心作者最新访谈:分布式协作才是智能体经济的未来
智猩猩整理编辑:绿鲤鱼不久前,一个 AI 助手实际上指的是一个大语言模型。你问它一个问题,它给你一个答案,但无法自行执行任务或处理相关工作。随着 AI Agent 的出现,这一切都在改变。虽然 Google DeepMind 在开发智能体方面有着悠久的历史,可以追溯到游戏中的强化学习,但对于我们大多数人来说,这一话题其实还没有真...
2026-07-08 14:34:44
AI 的下一场竞争,不再只是 GPU,而是数据流与内存架构
文章转载自公众号:柏睿数据本文只做学术/技术分享,如有侵权,联系删文。市场观察 | HBM / DDR / SEFS Memory Pool / NVMe 四层Memory Fabric架构四层架构分工• HBM:计算核心加速区,承载当前层Tensor、激活值、Attention热点,目标是让GPU拿到最热数据。• DDR:常驻内存与缓冲区,承载Resident Layer、KV Cache、Metadat...
2026-07-07 17:48:49
杨立昆最新演讲:Scaling Up是世界模型接下来第一要务
智猩猩整理编辑:六六什么是智能?过去几年,大模型的发展让人们越来越倾向于将智能与知识画上等号。模型掌握的事实越来越多,参数规模越来越大,能够回答的问题也越来越复杂,仿佛只要继续沿着这条道路前进,真正的智能终将作为一种涌现能力自然出现。但Yann LeCun(杨立昆)对此并不完全认同。2026年5月在苏黎世联邦理工...
2026-07-06 19:29:28
AI 算力时代,玻璃正在变成芯片的“光纤立交桥”
过去谈 AI 算力,大家最熟悉的是 GPU、HBM、先进封装。但随着大模型越做越大,真正让数据中心“堵车”的地方,已经不只是芯片算得快不快,而是数据能不能在芯片、板卡、机柜之间高速搬运。如果把 AI 集群比作一座超级城市,GPU 是高楼大厦,HBM 是仓库,交换芯片是交通枢纽,那么光纤和光互联就是高速公路。问题在于,高速公...
2026-07-04 15:40:59
从网络视角看英伟达Vera Rubin NVL72的变化
文章转载自公众号:西贝吹风本文只做学术/技术分享,如有侵权,联系删文。在2026年CES展会上,英伟达发布了以Vera Rubin NVL72机柜级系统为核心的Rubin平台,该平台由六款专为打造AI超级计算机而设计的全新芯片组成。相信大家这两天也看到了不少的相关报道,今天我们主要从网络的视角来分析一下Vera Rubin NVL72有哪些不同...
2026-07-02 19:49:49
百T争霸:博通、思科、英伟达、迈威,进入102.4T交换芯片时代
2024年初我写过一篇的文章,介绍了当时全球最顶级的51.2T交换机芯片,时隔2年,交换芯片进入了102.4T时代,同样是这四家公司的产品。在AI大模型狂飙突进的今天,算力的尽头不再单纯是GPGPU\算力芯片,而是连接它们的网络。当单集群规模迈向10万卡、甚至百万卡时,当红的“前浪”51.2T交换芯片遇到他的“后浪”。102.4T,这个数...
2026-07-01 21:06:57
中国版龙虾“实在Agent”,开启企业级智能体新范式|实在智能联创张俊九「AgenticAICon 2026」预告
7月2-3日,智猩猩主办的2026中国AI智能体大会(AgenticAICon 2026)将在杭州君悦酒店正式举行。实在智能联合创始人、CMO张俊九已确认出席,将在7月2日主会场下午的企业级AI智能体专题论坛带来演讲,主题为《中国版龙虾“实在Agent”,开启企业级智能体新范式》。 Part.1嘉宾介绍张俊九,曾任摩托罗拉高级工程师、中国电信翼支...
2026-07-01 11:48:44
从单智能体到智能体互联网,开放协议驱动的智能体连接基础设施|ANP开源社区发起人常高伟「AgenticAICon 2026」预告
7月2-3日,智猩猩主办的2026中国AI智能体大会(AgenticAICon 2026)将在杭州君悦酒店正式举行。ANP开源社区发起人、杭州向量共识创始人常高伟已确认出席,将在7月3日分会场二上午的多智能体协同技术研讨会带来演讲,主题为《从单智能体到智能体互联网:开放协议驱动的智能体连接基础设施》。 Part.1嘉宾介绍常高伟,ANP开源...
2026-06-30 21:20:45
AI软件工厂—AI时代自动化软件开发的实践与思考|杭州迅速智能CEO熊继斌「AgenticAICon 2026」预告
7月2-3日,智猩猩主办的2026中国AI智能体大会(AgenticAICon 2026)将在杭州君悦酒店正式举行。杭州迅速智能CEO熊继斌已确认出席,将在7月2日主会场下午的企业级AI智能体专题论坛带来演讲,主题为《AI软件工厂—AI时代自动化软件开发的实践与思考》。 Part.1演讲嘉宾Part.2演讲主题《AI软件工厂—AI时代自动化软件开发的实践...
2026-06-30 13:24:25
可插拔光模块的绝地反击:XPO 能否终结 CPO/NPO 之争?
当 AI 算力以指数级速度狂飙,数据中心的 “血管”—— 光通信网络正面临前所未有的压力。带宽不够、散热炸锅、运维困难…… 一个个难题让云计算大厂和设备商焦头烂额。就在 CPO(共封装光学)被视为下一代光通信终极方案时,OFC 2026 上突然杀出的 XPO,给整个行业投下了一颗震撼弹。TeraHop 将在本次展会上首次演示业界首款 12....
2026-06-29 18:40:51
阿里技术大牛组团分享!杭州AI智能体大会终极议程揭晓,60+嘉宾齐聚中国硅谷
距离2026中国AI智能体大会开幕只剩3天。60+位嘉宾、2天议程、1场开幕式+2大论坛+7场闭门研讨会+展览区+交流晚宴——我们把这份沉甸甸的议程反复梳理,提炼出本届大会最值得关注的10大亮点。如果你还在犹豫要不要来参会,这10条会帮你做决定。大会十大亮点亮点一:下半年国内首场AI智能体产业技术峰会上半年,OpenClaw的横空出...
2026-06-29 17:03:11
下一代XPU模组设计 & 超节点展望
文章转载自公众号:企业存储技术本文只做学术/技术分享,如有侵权,联系删文。近年来,AI大模型的规模以超摩尔定律的速度扩张,单个训练集群中的XPU(GPU/AI加速器)数量从数十颗迅速攀升至数百乃至上千颗,这对芯片之间的互连带宽、信号完整性、系统功耗与散热工程提出了前所未有的挑战。目前,业界头部厂商已经在Scale-up...
2026-06-28 20:05:16
百度Comate架构师李杨:人机协同的AI原生开发范式革命及落地|AgenticAICon 2026
7月2-3日,智猩猩主办的2026中国AI智能体大会(AgenticAICon 2026)将在杭州君悦酒店正式举行。百度Comate架构师李杨已确认出席,将在7月2日分会场一下午的Coding Agent技术研讨会带来演讲,主题为《人机协同的AI原生开发范式革命及落地》。 Part.1嘉宾介绍李杨,百度资深研发工程师,云端开发平台(iCoding)的技术负责人...
2026-06-28 12:53:19
告别“中转站”:GPU P2P通信,解锁多卡算力的隐形钥匙
文章转载自公众号:TWCL探微芯联本文只做学术/技术分享,如有侵权,联系删文。在大模型与超算时代,单张GPU早已不堪重负。但当我们将几十、上百张GPU堆在一起,你是否想过这样一个问题:GPU之间的数据传输,真的够快吗?在早期的“多卡协作”模式中,数据交互必须经过一条漫长的路径:源GPU显存 → 主机内存 → CPU调度 → 目标G...
2026-06-27 18:29:16
华为大模型算法专家领衔!DeepResearch Agent研讨会议程揭晓,拆解走向自主可靠研究的关键路径
深度研究智能体正在成为大模型 Agent 发展的重要方向。相比早期以问答、摘要和一次性检索为主的 AI 应用,Deep Research Agent 更强调在开放信息环境中完成复杂、长链条、可验证的研究任务,它需要主动拆解问题、持续搜索资料、跨来源比对证据、管理长上下文、调用工具、修正中间结论,并最终形成结构化、可信赖的研究输出...
2026-06-27 11:59:31
AI超节点集群的分布式未来:从铜退光进到全解构
各类万亿参数MOE(混合专家)大模型疯狂涌现的今天,算力需求已经不能单靠优化单个GPU来解决,而是需要将成百上千张GPU拧成一股绳。这股绳怎么拧?这就是AI超节点服务器要解决的核心问题。从Scale-up(垂直扩展)的视角来看,超节点正在经历一场从“物理大一统”向“光网络解构”的深刻变革。01铜缆的物理极限与光的“降维打击”...
2026-06-26 21:10:12
智猩猩开放日启动,首场解锁“Token工厂”!
据国家数据局统计,国内Token市场迎来爆发式增长,2024年初市场日均Token调用量约1000亿,2025年底攀升至100万亿,2026年3月已突破140万亿,两年间实现超千倍增长。作为大模型信息处理的基础计量单位,Token现已成为评判算力利用效率、企业商业价值及AI产业核心竞争力的关键指标。其生产与交付的完整技术体系,被行业定义为...
2026-06-26 19:09:53
快手Agent研发专家何菱:从任务执行到应用流通,Agent走入桌面的范式跃迁|AgenticAICon 2026
7月2-3日,智猩猩主办的2026中国AI智能体大会(AgenticAICon 2026)将在杭州君悦酒店正式举行。快手基础大模型与应用部Agent研发专家何菱已确认出席,将在7月3日主会场上午的AI智能体产品创新论坛带来演讲,主题为《从任务执行到应用流通:Agent走入桌面的范式跃迁》。 Part.1嘉宾介绍何菱,快手Agent研发专家。深耕AI应用...
2026-06-26 08:00:00
CPO 为什么难:AI 集群里的光链路预算问题
文章转载自公众号:平生半导体本文只做学术/技术分享,如有侵权,联系删文。如果把 AI 数据中心只理解成“堆更多 GPU”,很容易漏掉另一个正在变硬的瓶颈:数据怎么在芯片之间移动。当数千到数万颗加速芯片被组织成一个训练或推理集群,单颗芯片的峰值算力并不会自动变成系统吞吐。芯片之间、交换芯片之间、机柜之间的数据流...
2026-06-25 20:09:00
龙虾Hermes后首场AI智能体大会终极议程公布,同期7场研讨会拆解Harness、自进化等核心范式
Agentic AI浪潮奔涌而至,全新技术范式加速迭代,一场重塑产业生产力的变革已然到来。在此时代风口下,2026中国AI智能体大会(AgenticAICon 2026)将于7月2-3日在杭州隆重启幕。本次大会由智东西旗下智猩猩发起主办,为期两天,由开幕式+论坛+研讨会+交流晚宴+展览区组成,将以“范式跃迁 重塑世界”为主题,邀请60+位重量级...
2026-06-25 19:05:47
北大袁粒:没有多模态原生统一,就没有世界模型 | GenAICon 2026
主讲人:袁粒 智猩猩整理 编辑:六六 过去十年,我们几乎默认接受了一条简单的规律:数据越多,模型越强。这种“规模即能力”的信念,推动了深度学习一路从图像识别走向大语言模型,也塑造了今天生成式AI的基本形态。但问题也在这里慢慢显现——当模型越来越“聪明地说话”,它是否真的更接近“理解世界”?在2026中国生成式AI大会...
2026-06-25 15:15:44
利用 NVIDIA Omniverse NuRec × SimOne4.0 构建物理 AI 时代的仿真基础设施|深度对话
智猩猩出品策划:家祥物理 AI 正从 "数字世界" 迈向 "物理世界"。然而,这一跃迁面临着三大核心挑战:一是虚拟空间中训练的模型与真实世界之间存在巨大的 Sim-to-Real (仿真到现实)鸿沟;二是数据匮乏,缺乏人、机、环境深度共融的复杂交互数据;三是真实世界数据存在 "只能回放、无法交互" 的局限,难以形成可持续的数据...
2026-06-25 10:01:01