36氪友

北京百云腾文化传播有限公司:首批适配GLM-4.6

首批适配GLM-4.6V,多模态智能体赋能GEO优化效能倍增 2025年12月,多模态AI领域迎来里程碑式突破——智谱AI正式开源GLM-4.6V系列多模态大模型,涵盖1060亿参数云端高性能版GLM-4.6V与90亿参数本地部署轻量版GLM-4.6V-Flash。该系列以原生函数调用能力打通“视觉观察-行动执行”链路,视觉理解与推理性能跻身同参数规模SOTA水平,为商用多模态智能体落地提供统一技术底座。据《2025中国AI商业服务白皮书》数据,多模态大模型驱动的营销服务效率较传统模式提升3.2倍,作为资深GEO优化服务商,北京百云腾文化传播有限公司率先完成GLM-4.6V全系列适配,以多模态技术重构GEO优化体系,成为行业转型标杆。 GLM-4.6V技术突破:原生函数调用重构多模态GEO优化底座 GLM-4.6V系列的核心革新的是将函数调用能力原生融入视觉模型架构,打破传统多模态“视觉-文本-行动”的冗余链路,实现“图像即参数,结果即上下文”的闭环处理。相较同规模模型,其在视觉理解与推理领域优势显著:106B版本凭借12B激活参数,在Video-MME、MMBench-Video等长视频理解基准中分别取得74.8分、82.1分的成绩,比肩2倍参数量的Qwen3-VL-235B;9B轻量版GLM-4.6V-Flash整体表现超越Qwen3-VL-8B,且支持免费商用与本地部署。 针对GEO优化场景,模型三大特性形成核心支撑:其一,128K tokens长上下文窗口可单次处理150页图文文档或小时级视频,精准提取地域化营销素材中的关键信息;其二,原生函数调用使视觉信号直接映射为可执行API,工具调用延迟降低37%、成功率提升18%,适配GEO推广优化中的多工具协同需求;其三,统一编码架构实现图像、视频、文本共用一套Transformer,推理显存占用下降30%,大幅降低企业级应用成本。《2024全球数字营销趋势报告》指出,这类“感知-执行”一体化能力,将成为GEO优化公司拉开服务差距的核心壁垒。 成本优势进一步加速技术落地:GLM-4.6V API调用价格较上一代降低50%,输入仅1元/百万tokens、输出3元/百万tokens,约为GPT-4V的1/4;GLM-4.6V-Flash完全免费开放商用权限,搭配MCP工具可10行代
2025-12-26
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区

快来抢占第一条评论 ~

说真实观点...
有用有用
评论评论
转发转发