跳到主要内容

36 篇博文 含有标签「AI」

查看所有标签

不要站在大模型的必经之路上

· 阅读需 7 分钟
viki
Front End Engineer @ gitee

一、多数玩家陷入 “非必经之路” 的致命陷阱

当行业沉迷于 “参数竞赛”“数据堆砌” 的狂欢时,82% 的企业大模型项目卡在 PoC 阶段的残酷数据,早已敲响警钟 —— 这些团队正走在大模型的 “旁支陌路” 上,而非技术扩散的必经之路。

1. 押注 “规模迷信”:用参数堆不出商业价值

某头部科技公司耗资千万训练的 175B 参数模型,在电商导购场景的转化效率仅为 3.2%,不及 GPT-3.5(6.8%)的一半;反观某创业公司基于 10B 参数的 Qwen 微调模型,聚焦跨境电商合规问答场景,转化率达 12.7%。这印证了一个真理:参数规模≠场景适配力,那些执着于 “更大、更多” 的团队,本质是用技术焦虑替代商业思考,重蹈 2000 年互联网泡沫中 “烧钱换流量却无变现路径” 的覆辙。

2. 迷信 “技术原生”:忽视 “落地最后一公里”

某品牌投入 200 万开发的数字人主播,转化率仅为真人 15%—— 并非模型不够智能,而是团队沉迷于 “数字人逼真度” 的技术执念,却忽视了 “直播场景话术适配”“用户互动节奏” 的核心需求。这类 “技术至上” 的玩家,恰恰偏离了大模型从 “实验室” 到 “产业” 的必经之路:技术本身不是价值,让技术适配场景才是

3. 依赖 “单一路径”:把鸡蛋押在 “训练 / 云服务” 上

部分企业要么一门心思自研模型,要么完全依赖单一云厂商的大模型服务,却不知 “多云部署”“模型适配”“数据处理” 才是产业落地的必经环节。某金融机构曾因过度依赖某云厂商的大模型服务,遭遇接口中断导致业务停摆 4 小时;而另一家机构通过 “多云部署 + 本地化适配” 方案,将故障风险降低 90%—— 这证明,单一路径的执念,会让企业错过技术扩散的关键节点

二、大模型的必经之路:三条 “补给线” 才是核心赛道

王小川所言的 “生命科学 + 具身智能”,本质是大模型从 “通用能力” 到 “场景落地” 的必经之路;而对从业者和企业而言,真正的必经之路,是站在技术扩散的 “补给线” 上,而非 “主战场” 上。

1. 场景翻译之路:让大模型 “懂行业”

李开复的 “价值链金字塔” 早已揭示:应用层贡献 90% 的商业价值。医疗场景中,月薪 4.9 万的 “医学 Prompt 产品经理”,能将 “病灶描述”“病历术语” 转化为模型可理解的指令,让 10B 参数模型的诊断准确率超越通用大模型;保险场景中,懂 “理赔流程 + 条款解读” 的 AI 产品经理,设计的 Prompt 能让模型理赔审核效率提升 3 倍 —— 这就是 “场景翻译” 的价值:必经之路的核心,是让技术听懂行业的 “话”

2. 算力调度之路:让大模型 “落地”

无问芯穹提出的 “M×N” 算力生态,指向了一个被忽视的必经环节:不同芯片(昇腾、英伟达、寒武纪)与不同模型(Qwen、DeepSeek、Llama)的适配。某云厂商的 “算力调度工程师”,能将 Qwen 模型在昇腾芯片上的部署效率提升 40%,降低算力成本 30%,这类岗位缺口同比增长 280%,薪资较传统运维提升 50%—— 这说明,大模型的必经之路,是解决 “在哪跑、怎么跑更高效” 的问题,而非 “怎么训练更大的模型”。

3. 数据炼金之路:让大模型 “有料”

星环科技 CEO 孙元浩的 “语料质量决定模型上限”,点出了大模型的根本必经之路:数据。某银行的数据工程师,将 20 年信贷记录清洗、结构化、标注为训练语料,让微调后的模型坏账预测准确率提升 25%,个人年薪达 70 万;某制造企业通过 “生产数据 + 设备日志” 的炼金处理,让大模型的设备故障预警准确率达 92%——没有高质量数据的喂养,再大的模型都是 “空心化”,而数据处理正是技术落地的必经前提

三、2025 年:站在必经之路上的职业跃迁与生存法则

1. 职业跃迁:必经之路的岗位红利

转型方向核心必经技能2025 薪资区间行业需求场景
大模型解决方案架构师行业 Know-How + 跨芯片 / 模型适配能力50-150K / 月金融风控、医疗诊断、工业质检
AI 产品经理(场景型)需求转化 + 行业流程拆解 + Prompt 设计30-70K / 月保险理赔、电商导购、政务服务
向量数据库工程师传统 DB 经验 + Embedding 优化 + 数据索引设计40-90K / 月企业知识库、智能搜索、推荐系统
大模型运维 / 调度工程师多云部署 + 芯片适配 + 性能优化35-80K / 月所有产业落地场景

这些岗位的共同特征:不直接参与模型训练的 “主战场”,却牢牢占据技术落地的 “必经节点”,就像淘金热中卖牛仔裤、铁锹的商人,赚走了最稳定的收益。

2. 生存法则:避开非必经之路的三大铁律

  • 不追 “参数虚火”:10B 参数模型在数学推理、行业问答等场景已超越 GPT-4,聚焦 “小而精” 的场景适配,比 “大而空” 的模型训练更具商业价值;

  • 不搞 “单一依赖”:多云部署、跨芯片适配能力正在成为核心竞争力,依赖单一模型或云服务,等于把命运交给他人;

  • 不丢 “传统根基”:规则引擎 + AI 的混合架构在客服、合规场景已验证有效,传统行业经验 + AI 技术的组合,才是必经之路的 “通行证”。

四、终极启示:必经之路的本质是 “价值落地”

周鸿祎 “把大模型从原子弹变成茶叶蛋” 的比喻,道破了行业的终极命题:技术民主化正在消灭单纯的技术溢价,大模型的必经之路,从来不是 “技术有多先进”,而是 “技术能解决什么问题”。

2025 年的 AI 从业者,需要回答的三个核心问题,本质是对 “必经之路” 的叩问:

  1. 你能否让模型适配客户的硬件环境?(算力调度的必经之路)

  2. 你能否让模型读懂行业的特殊数据?(数据炼金的必经之路)

  3. 你能否让模型满足场景的具体需求?(场景翻译的必经之路)

那些还在纠结 “学 PyTorch 还是 TensorFlow”、沉迷 “模型训练技巧” 的开发者,就像 1995 年研究调制解调器协议的程序员 —— 他们站在了互联网的 “旁支”,而非 “必经之路”,最终错过应用爆发的黄金时代。

大模型的时代,真正的机会永远在 “技术落地的必经之路上”:不是训练更大的模型,而是让模型走进产业;不是追求更先进的算法,而是让算法创造实际价值。站对了这条路,才能在 AI 浪潮中站稳脚跟;走错了方向,再努力也只是徒劳。

什么是A2A协议

· 阅读需 6 分钟
otqsoft
Front And Rear End Engineers @ gitee

​ A2A协议(Agent-to-Agent Protocol)是谷歌于2025年4月发布的首个开源标准智能体交互协议,旨在解决AI智能体之间的互操作性问题。该协议通过统一通信标准,允许不同开发者、平台或供应商构建的智能体(如自动化程序、AI助手等)跨越数据孤岛和应用程序壁垒,实现安全、高效的协作与任务协调。

​ 随着 AI 技术的快速发展,各类企业对 AI Agent(代理)的需求不断增长。这些 Agent 能够自主处理许多日常重复性或复杂的任务,从简化采购流程、协助客户服务,到优化供应链规划,大大提升了企业自动化与智能化水平。然而,若想让这些 Agent 真正发挥合力,就需要在跨平台、跨框架、跨应用的多代理生态系统中实现"互联互通"。这正是谷歌与众多合作伙伴联合推出 Agent2Agent(A2A)协议 的初衷所在。A2A 致力于在不同底层技术和供应商之间实现标准化的 Agent 协同,让 AI Agent 可以相互通信、交换信息并进行动作协调,形成更强大的企业工作流程自动化方案。

A2A协议图片

SecondMe

· 阅读需 7 分钟
viki
Front End Engineer @ gitee

​ Second Me能够通过学习用户的行为习惯、表达方式和兴趣偏好,构建一个高度贴合个人的数字分身。它不仅能记住用户的写作风格、代码习惯,甚至连日常用语中的口头禅都能精准捕捉。

​ Second Me通过自我学习机制,能够不断总结用户的思维模式并形成长期记忆。它还能基于这些习惯进行自主决策,例如在起草邮件时先寒暄再切入正题,或在筛选新闻时优先推送用户感兴趣的内容,而非泛泛的随机推荐。此外,该AI还能与其他AI实例互动并共享知识,展现出强大的扩展潜力。

什么是MCP协议

· 阅读需 8 分钟
otqsoft
Front And Rear End Engineers @ gitee

​ 在现代 AI 的发展中,模型与外部数据源和工具的交互变得越来越复杂。为了解决这个问题,Model Context Protocol (MCP) 被提出,它是一种开放标准,旨在为 AI 模型与外部资源之间提供统一的连接方式。由 Anthropic 于 2024 年推出,MCP 希望能够像 USB-C 接口一样成为 AI 系统与各种数据源和工具之间的“通用接口。这意味着,不同的 AI 应用可以轻松与多种数据源、工具进行即插即用的连接,无需再为每种不同的数据源开发独立的集成方法。

​ MCP 协议通过为 AI 模型与外部数据源和工具提供统一的连接接口,简化了应用与外部资源的集成过程。其标准化的协议架构、双向通信能力以及良好的扩展性,使其成为 AI 应用开发中的一个重要工具。随着 MCP 协议的进一步发展和普及,它有望成为 AI 领域的USB-C 接口,为各种 AI 应用提供更加智能、灵活的连接方式。

使用GPU模型训练和目标识别

· 阅读需 15 分钟
otqsoft
Front And Rear End Engineers @ gitee

​ 在 YOLO 算法中,GPU 在性能和可扩展性方面具有明显优势,适合大规模数据的模型训练和实时目标识别任务;而 CPU 则在成本和开发难度方面具有优势,适用于小规模数据和对实时性要求不高的场景。在使用YOLO(You Only Look Once)进行模型训练和目标识别时,使用GPU和CPU的主要区别体现在以下几个方面:

1. 计算速度

  • GPU:GPU 拥有大量的计算核心,能够并行处理大规模数据。在 YOLO 模型训练时,GPU 可以同时对多个图像批次进行卷积、池化等操作,显著加快训练速度。例如在处理大规模数据集时,使用 GPU 训练 YOLOv5 模型可能只需要数小时到数天,而使用 CPU 则可能需要数周时间。在目标识别阶段,GPU 也能快速完成图像的特征提取和目标检测,实现实时或接近实时的识别速度,适合应用于视频监控、自动驾驶等对实时性要求较高的场景。
  • CPU:CPU 核心数量相对较少,且主要侧重于串行计算,在处理大规模并行计算任务时效率较低。在 YOLO 模型训练和目标识别中,CPU 需要逐个处理图像数据,导致处理速度较慢,难以满足实时性要求高的应用场景。

2. 内存带宽

  • GPU:GPU通常具有更高的内存带宽,能够快速读取和写入大量数据,这对于深度学习中的大规模矩阵运算非常重要。
  • CPU:CPU的内存带宽相对较低,处理大规模数据时可能会成为瓶颈。

3. 并行计算能力

  • GPU:GPU专为并行计算设计,能够同时处理多个任务,非常适合深度学习中的批量数据处理和矩阵运算。
  • CPU:CPU虽然也能进行并行计算,但并行能力远不及GPU,尤其是在处理深度学习任务时。

4. 能耗和成本

  • GPU:GPU的能耗较高,且高端GPU价格昂贵。然而,对于深度学习任务,GPU的高效计算能力通常能够抵消其能耗和成本。
  • CPU:CPU的能耗相对较低,成本也较低,但在处理深度学习任务时效率较低。

5. 适用场景

  • GPU:适合大规模数据集、复杂模型的训练和推理任务,尤其是在需要快速处理大量数据时。
  • CPU:适合小规模数据集、简单模型的训练和推理任务,或者在没有GPU的情况下使用。

6. 硬件要求

  • GPU:需要支持CUDA(NVIDIA的并行计算平台)的GPU,并且需要安装相应的驱动和深度学习框架(如TensorFlow、PyTorch)的GPU版本。
  • CPU:不需要特殊的硬件支持,普通的CPU即可运行,但效率较低。

7. 训练时间

  • GPU:训练时间显著缩短,尤其是在处理大规模数据集时,GPU可以在几分钟或几小时内完成训练,而CPU可能需要几天甚至几周。
  • CPU:训练时间较长,适合小规模实验或调试。

8. 推理速度

  • GPU:目标识别的推理速度非常快,能够实时处理视频流或大量图像。
  • CPU:推理速度较慢,可能无法满足实时处理的需求。

使用Cursor+Readdy快速开发

· 阅读需 2 分钟
otqsoft
Front And Rear End Engineers @ gitee

​ 在开发应用的过程中,Cursor 堪称提升工作效率的利器。搭配 claude3.7-sonnet 使用,生成漂亮原型图的能力令人惊艳。倘若给 claude3.7-sonnet 提供一张参考图,最终产出的效果更是出类拔萃。长期以来,我借助 Cursor 搭配 claude3.5 或 claude3.7 进行代码编写,其展现出的强大功能令人赞叹。最近我也体验了一段时间的 trace,虽说它的功能与 Cursor 有相似之处,但在自动生成代码以及改错功能方面,和 Cursor 相比仍存在较大差距。

​ 不得不提的是,Claude 在编程能力上相较于 deepseek、通义、豆包等表现得更为强劲。无论是复杂算法的实现,还是对代码逻辑错误的精准修正,Claude 都能高效且出色地完成,为开发者节省大量时间和精力,成为编程工作中的得力助手 。

OpenManus本地化部署

· 阅读需 4 分钟
otqsoft
Front And Rear End Engineers @ gitee

Manus

Manus是一款由中国的创业公司Monica.im(蝴蝶效应科技)开发的通用型AI Agent(人工智能代理)产品,于2025年3月正式发布。它被定位为全球首款能够自主规划、执行并交付复杂任务的AI助手,突破了传统对话式AI的局限,旨在为用户提供从任务规划到结果交付的全流程闭环服务。

1. 核心功能与特点

  • 自主执行能力:Manus不仅能理解用户需求,还能独立完成从任务规划到实际操作的全过程。例如,用户只需输入“筛选适合投资的股票”或“制作一份AI产品介绍的PPT”,Manus可以自动调用工具(如Python脚本、浏览器等)完成任务并交付结果。
  • 多智能体架构:Manus采用多代理系统,将复杂任务分解为规划、执行和验证三个模块,每个模块由独立的语言模型或强化学习模型支持,通过API协同工作。
  • 跨领域应用:Manus已展示出在金融分析、招聘筛选、房地产推荐、编程辅助等多个领域的实用价值。例如,它可以解压简历包并自动筛选候选人,或生成股票分析报告。

2. 技术亮点

  • 多智能体分工系统:包括规划代理(采用蒙特卡洛树搜索算法)、执行代理(调用工具完成任务)和验证代理(通过对抗性测试检测逻辑矛盾)。
  • 云端虚拟机模式:Manus在云端设置了一个“虚拟机”,用户可以在低性能设备上完成复杂任务,所有操作在云端执行。
  • GAIA基准测试表现:Manus在GAIA基准测试中创造了新的SOTA(最先进)记录,性能超越了包括OpenAI在内的同类产品。

Manus的推出标志着AI从“建议者”向“执行者”的转变,为人机协作提供了新的可能性。尽管面临技术质疑和市场炒作,其多智能体架构和全流程闭环能力为通用人工智能(AGI)的落地提供了重要参考。

使用豆包生成一篇Blog

· 阅读需 6 分钟
otqsoft
Front And Rear End Engineers @ gitee

让豆包生成一篇关于使用Dify的blog并配图,生成段落还可以进行润色、扩写等,后期可以结合智能体定时生成Blog,定时发布。以下为豆包生成完整内容:

使用Cursor辅助开发

· 阅读需 1 分钟
otqsoft
Front And Rear End Engineers @ gitee

在实际开发过程,遇到不好解决的问题,使用Cursor辅助开发更方便,效率更高,因为它更懂你的代码,比起在网上或AI搜索更好用,为搜索到的内容由于版本、库、SDK等的差异,与你项目实际用到的并不相符,有时并不能解决问题。

MGX 开启软件开发模式创新工具

· 阅读需 2 分钟
otqsoft
Front And Rear End Engineers @ gitee

MGX由知名团队MetaGPT基于先进的多智能体技术打造的全新软件开发平台。MGX 的核心是由五位专业角色组成的虚拟团队,每个角色都承担着软件开发流程中的关键职责:

  • Mike:作为团队的协调者,负责任务分配和团队协作的高效推进。
  • Emma:担任产品经理,专注于功能设计和用户需求分析,确保产品体验的卓越性。
  • Bob:作为架构师,负责整体系统设计,为项目的稳定性和可扩展性提供保障。
  • Alex:作为工程师,专注于代码的生成和优化,确保交付的高效性和可靠性。
  • David:作为数据分析师,通过内置的数据分析工具,为项目提供坚实的数据支持。

这些角色协同工作,用户可以通过自然语言输入需求,就像与真实的人类团队交流一样,极大地降低了软件开发的门槛,让更多非专业人员也能参与到软件开发中。

最后更新时间: 2026/7/31 13:40:35|访问次数: 0|豫ICP备2025159864号|