韩国企业引入海外 AI 模型遇成本难题,三星等巨头实施 Token 配额制
Token成本高企,三星电子被迫实施配额制
韩国企业引入海外AI模型后,遭遇了意想不到的“成本陷阱”。三星、SK等巨头虽然通过企业合同开放了Claude、Gemini、ChatGPT等美国模型的访问权限,但Token使用费迅速膨胀,导致企业不得不对员工实施严格的每日或每月配额限制。例如,三星电子内部已开始推行分级配额制——普通员工每日仅能使用有限次数的AI对话,超出部分需申请审批。这种“先开放后收紧”的尴尬局面,极大削弱了AI工具本应带来的效率提升,甚至引发员工不满。
企业自救:提示词优化与本地部署并行
面对Token成本压力,韩国软件企业开始多管齐下降低成本。一方面,通过组合提示词优化技术,减少每次调用所需的Token数量;另一方面,部署LLM网关对请求进行缓存和过滤,避免重复计算。此外,一些企业将高频使用的模型进行本地化部署,利用开源模型或缩微版模型处理日常任务,仅对复杂问题调用海外模型。这种方法可将成本降低30%至50%,但需要额外的基础设施投入,对中小企业仍有门槛。
政府出手:5万亿韩元押注主权AI,摆脱依赖
韩国政府意识到,依赖海外AI模型不仅面临成本问题,更存在供应链安全风险。Anthropic和OpenAI的出口管制已敲响警钟。为此,韩国科学技术信息通信部计划在补充预算到位后,斥资5万亿韩元(约218.9亿元人民币)购买10000块NVIDIA Rubin GPU,交由单一精英团队使用,目标在2027年上半年完成先进模型开发。这一举措旨在利用HBM出口带来的税收红利,加速培养自主AI能力,减少对海外模型的依赖。
双轨并行:自主能力与外部合作并举
在最新发布的AI蓝图中,韩国明确采取“双轨并行”战略:一方面构建自主AI能力,包括基础模型、基础设施、数据治理及GPU供应体系;另一方面与OpenAI、Anthropic等前沿开发者保持战略合作,通过技术引进提升运营成熟度和成本效率。例如,OpenAI与三星、SK海力士及韩国科学技术信息通信部合作建设下一代AI数据中心。这种“两条腿走路”的思路,既解决了短期成本痛点,又为长期竞争力打下基础。