面对面

“眼见为实”有回响,“眼见为实”有回响_我的网站

我们相爱吧

一 |     财联社7月21日讯(记者 付静)“我们真正关注的是Token性价比:在保证模型效果和服务质量的前提下,以更低的综合成本生成更多高质量Token。

二 | ”2026世界人工智能大会(WAIC)期间,云天励飞-U(688343.SH)方面在接受财联社记者采访时表示。      如今,在中国各大口岸,每天都能看到这样的景象:各国游客拖着行李箱,举着手机,兴奋地拍下入关后见到的第一块中文路牌。

三 |          当下,模型层面训推规模迈向万卡,应用侧C端多款智能体涌现,AI进化为生产生活“搭子”,B端的人工智能真实场景落地也在加速。在这些需求的带动下,产业链频频传递出“算力供不应求”信号。  当过境免签“朋友圈”越扩越大,“到中国去看看”从一句口号变成越来越多人的行动。

四 |          财联社记者多方采访获悉,算力进入“拼系统”时代,构建超节点、超集群已经成为主流做法,且收获了下游各行业的积极反应。

五 | 与此同时,TPU路线正在同步发力,华东地区首座国产TPU千卡智算集群已经落成。多种方案涌现背后,产业最关心的则是Token性价比。         “超节点是未来几年重点方向” 下游已给出积极反应          WAIC期间,华为昇腾950超节点(Atlas 950 SuperPoD)真机、超节点集群Atlas 950 SuperCluster、首个全国产十万卡AI超集群曙光8000(登峰)真机、燧原科技与中兴通讯(000063.SZ)联合打造的正交架构方案“云燧ESL64-O”超节点、阿里云磐久AL128超节点服务器、沐曦股份-U(688802.SH)新一代AI超节点曦景S600、摩尔线程-U(688795.SH)MTT C256超节点、壁仞科技(06082.HK)分布式解耦架构超节点方案、百度智能云超节点“天池”等格外吸睛。         华为昇腾950超节点 图片来源:财联社记者/摄          “云燧 ESL64-O”超节点 图片来源:受访者供图          中兴超节点方案 图片来源:受访者供图          中国电子云则发布了自研的翎枢6020轻量型、翎枢6032平衡型、翎枢6064性能型三款超节点产品。2026年上半年,免签入境外国人达1781.5万人次,占入境外国人的77.7%,较去年同期增长30.6%。

六 |          中国电子信息产业集团有限公司首席科学家、中国电子云总工程师朱国平介绍,翎枢超节点将千百张GPU融合为单一逻辑超级单卡,通过Tbps级超高带宽、百纳秒级超低时延、统一内存编址提升算力释放效率。翎枢超节点覆盖20-64卡黄金算力区间,相比其他超节点方案,优势在于成本更低、生态开放,可兼容现有风冷、液冷机房。  海外博主眼中的中国  在海外社交媒体上搜索China Travel(中国游),从2024年4月到2026年4月间播放量最高的前100个视频为我们勾勒出一幅生动的中国图景。  各具特色的中国城市,是海外博主偏爱的拍摄对象。         云天励飞方面也告诉财联社记者,公司未来三年计划推出DeepVerse100P、DeepVerse100D和DeepVerse100L三款芯片,分别针对Prefill、Decode Attention和Decode FFN进行优化,未来在此基础上构建面向万卡异构集群的分离式AI推理基础设施。

七 | 在这100个视频中,62%的视频把镜头对准了大中城市的特色,包括北京恢宏的文化遗产、上海摩登的街道建筑、重庆魔幻的立体交通;有24%的视频深入县城乡村;还有14%的主题是旅途本身,内容以骑行、搭车过程中看到的风景、遇到的人为主。

八 |          财联社记者采访获悉,产业链下游已对超节点、超集群产品有了积极反应。中科曙光(603019.SH)方面提供的数据显示,曙光8000集群正式上线首周即需求爆满,应用满载运行,目前日均处理作业数突破15万个,单日处理作业峰值超过50万个。  镜头里的场景同样丰富。48%的视频拍摄的是现代化的城市天际线和便捷的基础设施,37%记录下从火锅到早茶的各色“中国味道”,36%对准了兵马俑等经典文化符号,而中国百姓对异乡来客的热情友好,也出现在32%的视频中。

九 | 截至目前,曙光8000已完成近千项超智融合应用适配,覆盖大模型训练、高通量推理、科学计算等多个万卡级规模场景。  这些画面拼凑出的,是一个没有滤镜、满满烟火气的中国。

十 | 没有华丽的解说词,没有精致的摄影构图,更没有刻意的交谈,博主们只是举着镜头一路走一路拍,却在不知不觉中,让世界看到了一个更加真实的中国。  在播放量高达2300万的视频《这是世界上最大的国家(之一)》里,一位居住在重庆的墨西哥网友热情介绍了这座城市的巨变,话题从旅游攻略一路聊到“适不适合定居”“好不好找工作”。海外网友对中国的兴趣,早已不局限于“好美”“好酷”这类感受性的浅尝辄止,而是开始认真琢磨:我能不能也去看看,甚至留下来?这种从略知一二到渴望参与的转变,正是China Travel最宝贵的成果。  评论区里的中国  在超过25万条评论中,一半以上充满了正面情感,“thanks”(感谢)、“love”(爱)、“great”(太棒了)这些暖意融融的词汇频频出现。一位网友在看完视频后写道:“中国太赞了,非常干净、安全,食物既美味又便宜。有铁路、高速等令人惊叹的基础设施,即使身在小地方也能轻松前往另一个城市。         上线后快速满载,意味着科研机构、企业和开发者对超大规模、高质量算力的现实需求正在加速释放,也表明十万卡级算力已开始持续承接更加广泛的科研和产业任务。

十一 | ”在这些海外网友眼中,视频里的中国,俨然成了他们理想生活的蓝本。         据悉,曙光8000采用全球首创的高密度机柜结构,单个计算单元算力密度较其他超节点提升20倍,在有限空间内实现更高算力部署;自研scaleFabric类IB原生RDMA高速互连技术,实现十万卡规模稳定互连。

十二 |          另据媒体报道,华为昇腾384超节点目前已商用落地750多套,规模应用于互联网、运营商、金融、教育、医疗、交通、制造等行业。         一位算力从业者告诉财联社记者,内部连接是超节点及算力集群发展面临的核心问题。  许多被部分西方媒体长期误导的外国民众,在看到真实的中国后,将批评的矛头直接对准了“阴暗滤镜”本身。“超节点架构、超节点内部的连接,这可能是我们现在包括未来几年重点(攻克)方向,核心是要解决GPU或TPU之间高速互联的问题,通过交换芯片提供单个节点大容量,比如可以提供64卡、128卡这种超大规模的连接,在这个基础上组建更大的千卡、万卡集群。

十三 | ”          据悉,在AI算力基础设施与数据中心网络架构中,Scale-Up、Scale-Out和Scale-Across分别为三种不同层次的扩展模式:Scale-Up(纵向扩展)聚焦于超节点内部的紧密耦合,Scale-Out(横向扩展)侧重于集群之间的规模扩张,Scale-Across(跨域互联)则致力于数据中心之间的广域协同,旨在打破单数据中心的物理极限。         “Scale-Out相对来说更成熟,Scale-Up的挑战更大,这是我们要重点解决的。现在单个GPU Scale-Up领域的带宽都达到TB的级别,单交换机的交换容量可能要达到100T以上。不少海外网友直接在评论区质问:“为什么我以前从没看过这样的中国?”  China Travel视频评论区里的每一条有价值的发言都会激起“涟漪”,二级评论回复率非常高。

十四 | 解决了这个问题之后,才能组成大规模的集群。大规模集群要为芯片解决的,就是把极限带宽提高。走进这些对话,“people”(人民,33140次)、“Chinese”(中国人,27022次)、“city”(城市,22426次)、“food”(食物,14029次)、“culture”(文化,4461次)、“car”(汽车,2242次)等关键词反复跃入眼帘。从人与人的温暖相遇,到城市空间的切身体验;从舌尖上的百味中国,到文化深处的探寻与感悟;从令人惊叹的科技应用,到日常出行的便利舒适……这些高频词勾勒出的,是海外网友对中国社会生活面貌的集体关注。”前述从业者介绍。  在一则深入四川大凉山的视频评论区里,有网友介绍了当地百姓走出大山、住进政府免费安置房、学习新技能的经历。601条评论围绕这一话题展开跨国对话。         财联社记者也从中兴通讯方面获悉,针对AI大模型规模化落地的网络升级要求,其构建的智能算力网络底座,主要聚焦Scale-Out机间网络(优化单集群内部通信效率,实现稳定降本、调优增效)与Scale-Across跨域互联(实现跨数据中心、跨地域的算力资源高效调度)两大核心场景。一位印度网友感叹:“希望我们国家也有这样的远见。         TPU路线同步发力 产业最关心Token性价比          除了近几年持续热门的GPU路线,财联社记者还了解到,杭州电信、中兴通讯与中昊芯英联合打造了华东地区(杭州)首座国产TPU千卡智算集群,该集群亦是中国电信体系内首个大规模国产TPU集群部署项目。

十五 |          “选择做千卡集群而不是万卡集群,是因为我们想把它做成试验田。我们先把千卡级的软件栈系统集成到千卡集群上,在Token Factory上能提供不错的服务,在服务逐步做透的情况下逐步开展二期、三期。未来,我们也希望逐步从千卡向万卡集群迈进,在万卡集群上运行国产模型的训练推理,而且满足所有商用需求所需要的性价比。”中昊芯英创始人、CEO杨龚轶凡告诉财联社记者。”一位美国网友则反思:“中国用发展教育来解决社会问题,我们却没有这么做。”当来自不同国家的网友在同一则视频下交流各自国家的发展路径,评论区便不再只是情感交流的场域,而成为一个微型的“全球治理研讨空间”。这种有深度的国际对话,正是打破信息茧房、推动世界客观认识中国的关键力量。

十六 |   人们心里的中国  研究这些视频可以发现,“现实和媒体说的不一样”频繁出现在标题里,越来越多China Travel视频正在用真实画面撕掉那些试图污名化中国的标签。  一段播放量达1350万次的视频《媒体不会向你展示的中国》,记录了一位海外博主从甘肃搭便车到北京的旅程。         谈及GPU与TPU两条路线如何选择,中国电信杭州分公司智算中心总经理王良表示,“并不见得每个芯片都是全能选手,不同芯片在不同场景下有独特的长处,比如TPU擅长做张量运算,我们评估推理能力是TPU的长处。镜头里,路上的交警负责地帮助了这位异乡人,把他带到高速服务区,递上午饭,还帮他拦下顺风车。”          王良还介绍,“上述TPU千卡集群落地后运行得很好,尤其是今年的Token风口起来以后,市场上对Token的需求量很大。博主的表情从最初的警惕不安,到后来放心地与警务人员一起吃饭、说笑。  在这条视频的评论区里,一条留言引来550条讨论:“没人袭击你、偷你的东西、侮辱你、跟你撒谎、谋杀你,没人报警,警察没有逮捕你。最近(我们)和中昊芯英测试完PD分离,这一技术把TPU的优势进一步放大,已经比较满足当初的设计目标。每个人都对你很好,警察也试图帮助你,让你搭了好几趟车,吃了顿饭。

十七 | ”  在许多海外网友的认知中,警察往往与暴力联系在一起。但当他们看到一名中国警察在高速公路上送来饭菜时,旧有的认知开始松动。这是China Travel的力量,也是真实的力量:在具体的温情面前,偏见往往不攻自破。”          据悉,该集群基于“泰则®”智算平台构建,将面向大模型训练、AI推理、科学计算等场景提供全自主算力支撑,该集群二期规划今年9月上线投产。  另一则视频《我忽略了媒体并访问了中国》同样引发了热烈讨论。“          王良进一步谈到,调优将是一项非常重要的工作。博主带着紧张与怀疑来到中国,乘坐磁悬浮列车、游览外滩、走进市井生活,最后在镜头前坦言:“此行消解了大量偏见。

十八 | ”评论区里,网友纷纷批评某些西方媒体的不实报道和某些博主的偏颇视角。他介绍,“现在所有的大模型厂商、芯片厂商,都是拿出百米冲刺的速度在跑马拉松,芯片厂商每年都会发布一个新版本,而大模型厂商每个季度都会发一个新版本,这里面的适配工作量是很大的。在这里,“反污名”已经远不只是中国网民的自我辩护,而成为海外网民自发形成的共识。我们在持续的调优工作中发现,从年初到现在,TPU集群通过调优实现了超过10倍的效率提升。  从免签名单越来越长,到China Travel视频屡破千万播放,再到评论区里日益客观理性的声音,中国推进高水平对外开放正在结出看得见的硕果。原来每百万Token的成本如果是100元,现在就差不多能降到10元以下。

十九 | 那些评论区里的真诚喜爱与对“阴暗滤镜”的自发质疑,正是“眼见为实”的回响。

|   当然,被看见必然意味着被审视,被喜爱也必然意味着被期待。那些关于旅游体验有待提升的中肯建议,照见的是一个“可以被打磨得更好的自己”。

|   开放是一面镜子,让我们看清自身的不足;开放也是一座桥梁,让中国和世界在真实的交往中双向奔赴。用可信、可爱、可敬的形象消解偏见,用坦诚的胸怀接纳建议,每一次相遇都会变成共同的成长。

|   (本文来源:经济日报 作者:王天铮 岳小琪 作者单位:中国政法大学)。”          WAIC期间,多位受访的算力产业人士均谈及了Token成本问题。

|          对于模型厂商、AI应用企业和算力运营方而言,真正影响商业化效率的是在一定时间和成本条件下,能够稳定生成多少有效Token。

|          财联社记者另从AI基础设施及智算云提供商九章云极方面了解到,AI从技术竞赛迈向规模交付,主要面临四个核心卡点:算力成本高企、多芯片计价割裂、GPU利用率困于30%红线、研发缺乏标准化体系。         据悉,九章智算云在全球范围内已部署12个数据中心,算力总规模约22 EFLOPS,配备6600余张GPU卡,具备日产64亿词元(Token)的生产能力。从产出量看,DeepSeek-V4是当前产出最大的模型,日产24.5亿TOKEN,占比38%,随后依次为KIMI 2.5、Qwen-3.5、GLM-5、MiniMax-2.5。

| 其弹性算力体系,已使得某头部模型厂商的项目综合成本最高节省了82.1%。         云天励飞方面则告诉财联社记者,降低Token成本是一项系统工程,从底层的IP、EDA、芯片设计和封装测试,到服务器、互联、软件栈和算力平台,再到模型及应用,各环节都会影响最终的Token生成效率。

|          据了解,目前国内主流大模型的公开API价格已明显分层。根据不同模型能力和服务方式,常规文本模型的输入价格大致为每百万Token几角钱至十余元,输出价格大致为每百万Token一两元至数十元。         “现在的问题不是将百万Token成本价格从2毛降到1毛,更多的是提升Token价值,这是算力基建和模型要协力解决的问题。如果价值的问题可以解决,定价2块或10块大家都不觉得贵。”前述算力从业者也表示。         (财联社记者 付静)。

|

Current article:http://www.qiniaohongfangfoguisenzhai.cyou/qwk/hgj.htm

Published on:15:47:04


我的网站最近更新

我的网站热门资讯