正义的伙伴原创文学网 - 纯净的绿色文学家园 !

正义的伙伴(全文在线阅读>

正义的伙伴

650位杭州人参加了一场“体质大考”,结果出人意料_我的网站

马大帅

一 |     想想美国的顶尖人工智能开发者吧。    常干力气活,身体差不了?乌建荣在做体测牛涛在做体测 记者 江玥 摄近日,滨江区浦沿街道新生社区的监测点,身高体重仪、台阶测试器、握力计一字排开,29个社区的650位居民排队“考试”。他们将心血、汗水和巨额资金倾注到每一个前沿模型的新版本中。“金鸡独立”站不住了55岁的牛涛站在闭眼单脚站立测试区,晃得厉害。他是安徽人,2009年来到杭州,在浦沿街道负责社区秩序管理。他一直认为,“我常常干力气活,身体应该差不了。然而,他们几乎来不及喘口气,竞争对手就已经追了上来。如果只是收费的竞争对手紧追不舍,情况已经够糟了。”但2021年第一次被社区叫来参加体质监测时,他就被“闭眼单脚站立”的动作难住了。但像Anthropic和OpenAI这样的公司还必须全力冲刺,才能勉强领先那些免费提供模型的实验室几步。“金鸡独立,闭眼站不住了。         7月16日,中国初创公司月之暗面(Moonshot AI)发布了Kimi K3——一个仅比Anthropic和OpenAI的最新作品Fable和Sol分别略逊一筹的模型。

二 | 其参数(或称“权重”)将在本月晚些时候免费公开,这意味着它可以被下载并在任何能够运行的服务器上使用。”他挠挠头,“年轻的时候,站1分钟没问题的。”这几年,牛涛对自己的身体有了更清晰的认识:“肺活量变好了,但平衡性没以前好。7月19日,中国互联网巨头阿里巴巴(Alibaba)也发布了其通义千问(Qwen)模型系列新成员的预览版,该公司称其性能仅次于Fable。平时没时间锻炼,全靠工作活动筋骨。”退休老人的肌肉量让年轻人自愧不如“80千克力。”握力测试区,63岁的乌建荣一出手,旁边排队的人都侧过头来看。

三 | 这位退休的行政人员,肌肉量让不少年轻人都自愧不如。

四 | 乌建荣退休前在温州工作,2023年女儿把他接来杭州。         根据研究公司Epoch AI的分析,最强大的开源权重模型(通常来自中国)落后于技术前沿仅几个月(见图表)。这些系统的采用正在迅速扩大。5月,在热门模型市场OpenRouter上,客户使用美国顶尖实验室提供的系统量与使用中国顶尖实验室的系统量大致相当——以tokens(行业首选输出单位)消耗量计算。他从小就喜欢运动,退休后时间充裕,生活安排得满满当当:早晨8点到9点半打太极,周一唱歌,周五朗诵,平时还参加社区的乒乓球、羽毛球活动。到了6月,美国模型的使用量增加了三分之二——但中国模型增加了两倍。         这不仅引起美国领先模型制造商的警觉,也引起美国政府的担忧,他们担心国家在AI领域失去领先地位并为黑客攻击创造新机会。据说特朗普(Trump)政府内部一些人正在推动各种措施来减缓中国模型的传播,例如将其制造商加入贸易黑名单或警告美国公司不要使用它们。然而,美国政府在授予Fable和Sol等先进模型访问权方面的不可预测做法,也在刺激人们采用中国的开源权重替代方案。“朗诵不算运动啦?”面对邻居的调侃,他认真反驳,“唱歌朗诵实际上都是运动,你的气息带动整个身体运动。”不过,从运动科学角度看,朗诵属于呼吸训练,确实不是传统意义上的体育运动。

五 | 社区组织体测活动,乌建荣每次都积极报名参加。“大家一般不聊成绩,但会留意一下别人的体测结果。

六 | ”他笑着说,测试数据就像一面镜子,能照出平时锻炼的不足,“比如握力,人家都四五十,你才十几,那肯定肌肉不行,缺乏锻炼。

七 |          甚至在K3发布之前,中国的开源权重模型就已引起全球关注。

八 | ”他的80千克力握力,是靠常年规律运动练出来的:太极练平衡,朗诵练气息,乒乓球练反应。GLM-5.2是另一家中国实验室Z.ai于6月推出的模型,在执行所谓的智能体任务(agentic tasks,如创建软件)方面,比美国另一家顶级模型制造商Google目前提供的任何产品都要出色。来自另两家中国实验室DeepSeek和MiniMax的模型也很受欢迎。

九 | 根据Firefox浏览器制造商Mozilla的报告,开源权重模型在推理和复杂智能体工作方面仍落后于前沿,但现在被普遍认为对许多任务“足够好”(good enough)。         它们的成本也低得多——在公司应对AI不断上升的成本时,这是一个重要优势。他的柔韧度,也得益于每天雷打不动的太极拉筋。

十 | 十项指标反映平时锻炼的效果有哪些人来测?这场监测覆盖20~39岁、40~59岁、60~69岁三个年龄段,并按体力与非体力人群细分抽样。都有哪些项目?十项指标按照功能分区有序进行:身高、体重、肺活量、台阶指数、坐位体前屈、握力、纵跳、闭眼单脚站立、俯卧撑(男)/仰卧起坐(女)、选择反应时。台阶指数测试区,参与者要在固定节奏下完成3分钟上下台阶,随后测量心率恢复情况。许多居民说,今年心率恢复比去年更快,心肺耐力的提升用数据“说了算”。另一家研究公司Artificial Analysis追踪选定模型在其一系列测试中执行每项任务的成本。力量测试环节,30岁的徐先生肺活量达到5192毫升,俯卧撑一口气做了100个。

十一 | “坚持锻炼还是有效果,这一年一周三次羽毛球,不打球就跳绳,交叉练习。DeepSeek提供的最强系统平均每个任务花费0.04美元。尚未开源的K3平均每个任务花费0.95美元。Fable的用户预计需要支付2.75美元。

十二 |          部分成本差异来自几乎任何云提供商都可以出售对开源权重模型的访问权,从而压低利润率。闭眼单脚站立区,有人站得稳稳当当,有人则摇摇晃晃十几秒就“投降”。握力计前,有人捏出80千克力,有人只有十几千克力,数据比镜子还诚实,反映出每个人平时锻炼的实际效果。柔韧性测试区,56岁的孔灿凤轻松推过脚尖。例如,DeepSeek以每百万tokens 0.28美元的价格提供其v4 flash模型的访问权,而最便宜的第三方提供商则提供每百万0.18美元的价格。         更重要的是,许多开源权重模型的训练特别注重运行效率,部分原因是中国实验室因美国对先进芯片的限制而在获取计算能力方面面临挑战。

十三 | “这几年,我每天坚持练太极、架腿拉伸。”她说,“坚持了一年,筋松多了,腰也不酸了。闭眼单脚站立,我能稳稳超过60秒。像“专家混合”(mixture of experts)模型这样的创新——仅激活AI系统中与查询相关的部分——已被开源权重开发者广泛采用,DeepSeek和阿里巴巴等实验室在这一技术上取得了重大进展。         然而,开源权重模型的吸引力更深层次。

十四 | 由于美国政府仓促试图将Fable模型仅限美国公民使用,导致该模型在全球范围内三周无法使用,这促使许多公司审视自己对单一实验室的依赖。这鼓励他们尝试可以通过多个提供商访问、甚至可能在内部服务器上运行的开源权重替代方案。Mozilla首席技术官Raffi Krikorian指出,这一事件起到了“警示射击”(shot across the bow)的作用。         (注:本文编译自《经济学人》7月22日文章,原链接:https://www.economist.com/business/2026/07/21/americas-ai-labs-are-under-threat-from-cheap-chinese-rivals)。”不是为测而测“以前觉得自己身体还行,一测才知道柔韧性这么差。”“今年肺活量涨了1000多毫升,这一年球没白打。”居民们的感慨,道出了体质监测的意义:不是为测而测,而是测完之后要告诉每个人,你可以练什么、怎么练。体测现场,许多参与者测试完就迫不及待地在社交平台分享体验,带动更多邻里关注自己的体质数据。一场监测,正在点燃一个街道的健康热情。“早些年,组织起来得挨个催,如今,居民的报名意愿越来越强。

十五 | ”浦沿街道文体中心副主任曾丽华说,“去年,体测的合格率在90%以上,但大家的柔韧度普遍较差。去年开始,街道就针对性开设了中老年柔韧训练班、青年力量提升班等课程。

十六 | ”曾丽华介绍,接下来,浦沿街道将运用今年这份“体质报告”,在去年开设的中老年柔韧训练班、青年力量提升班基础上,继续优化课程内容与教学安排,完善面向不同人群的健身指导服务。

Current article:http://zro5.cuntoujuefourantapai.cfd/list_pc1u/f8dm.html

Published on:04:17:07


顶一下
(0)
0%
踩一下
(0)
0%
------分隔线----------------------------