登录社区云,与社区用户共同成长
邀请您加入社区
【摘要】某企业部门从4人裁至1人,通过AI自动化处理重复性工作,实现高效运转。员工小陈将43项工作分类,34项固定套路工作交由AI处理,如新闻摘要、竞品报告和PPT制作。他采用分步实施策略:先解决最耗时的3项任务,每周节省8小时;随后串联各环节形成半自动流程。关键经验:1)保留人工审核环节;2)越忙越需搭建系统;3)从单点突破到流程串联。最终实现80%重复工作自动化,将周三工作时间从全天压缩至70
本文记录了minillava多模态大模型的三阶段微调实验:1)使用视觉描述和VQA数据对齐视觉语言模型,冻结视觉编码器和语言模型,训练投影层;2)用多模态指令数据微调投影层并添加LoRA适配器;3)采用DPO优化指令跟随能力。实验使用4张3090显卡进行分布式训练,实现了验证集监控和最优模型保存机制,通过选择性参数存储节省显存。作者将持续更新多模态大模型学习笔记,相关代码和配置已开源。该工作为多模
本文总结了第16周训练的多模态大语言模型(MLLM)的整理与部署工作。原模型仅保存了project和LoRA参数,image encoder和LLM仍需加载官方权重,导致部署维护困难。本周通过将LoRA合并到基础LLM中,统一保存为Hugging Face标准格式model.safetensors,便于使用transformers库加载和vLLM服务部署。文章提供了模型转换脚本、配置定义及处理代码
本文介绍了一个基于FastAPI和vLLM的多模态HTTP服务架构设计。服务采用分层设计:FastAPI负责业务逻辑(图片上传、限流、日志等),vLLM专注模型推理。主要特点包括:1) 通过请求队列控制并发;2) IP级限流;3) 图片预处理;4) 业务与模型解耦,支持独立扩展。服务提供/chat接口接收图片和问题,返回模型响应,并支持通过环境变量配置各项参数。这种分层架构提高了系统的可维护性和扩
RAG—文档解析——切片——入milvus向量库
摘要:本文详细介绍了二分查找算法的实现及优化。在有序数组中查找目标值时,通过设置左右指针i和j,计算中间值m进行比较。针对三个关键问题进行了分析:1)循环条件应为i<=j而非i<j,否则可能漏查边界值;2)处理大数组时使用无符号右移>>>计算m,避免整数溢出;3)改进代码可读性,统一使用小于号比较。文章提供了Java实现代码,并通过注释说明优化点,包括边界条件和中间值
本文介绍了Java中Set接口及其主要实现类HashSet、LinkedHashSet和TreeSet的特性与底层机制。HashSet基于HashMap实现,通过hashCode和equals方法去重,具有动态扩容机制;LinkedHashSet继承HashSet,通过双向链表维护插入顺序;TreeSet基于TreeMap实现,通过Comparator或Comparable接口实现排序和去重。文章
本文介绍了Java集合框架中的Map接口及其实现类。Map存储键值对,具有key不可重复、value可重复、允许null值等特点。重点分析了HashMap的底层机制(数组+链表+红黑树)和扩容规则(初始16,2倍扩容)。对比了Hashtable(线程安全、不允许null)与HashMap的区别,并介绍了Properties类(继承Hashtable,用于处理.properties配置文件)。最后给
摘要:泛型(参数化类型)用于约束数据类型,提高类型安全性和效率。语法包括声明(如class 类<K,V>)和实例化(如List<String>)。注意事项:泛型只能是引用类型;可传入子类类型;不指定类型时默认为Object。自定义泛型包括泛型类(成员可用泛型,数组不能初始化)和泛型方法(调用时确定类型)。继承方面,泛型不具备继承性,但可通过通配符<?>、<
本文详解Java GUI的委派事件模型,重点剖析键盘监听实现。事件处理包含事件源、事件对象和事件监听器三要素,键盘监听通过实现`KeyListener`接口的`keyTyped`、`keyPressed`和`keyReleased`三个方法完成。通过键盘控制小球移动的完整实例,演示了方向键和WASD键的响应处理,涵盖焦点设置、边界检查等实战要点。文章还介绍了多键处理、`KeyBindings`替代
我们将探讨两种创建线程的方式(继承Thread类与实现Runnable接口),分析synchronized关键字的实现原理,研究互斥锁的工作机制,并学习如何避免常见的并发陷阱。多线程编程正是实现这一目标的关键技术,它不仅能提升程序的响应速度,还能优化资源利用,是现代软件开发中不可或缺的一环。我们将通过经典的"售票系统"案例展示线程同步的实际应用,通过"死锁"示例警示并发编程中的常见陷阱,并介绍线程
本文介绍了Java文件操作与IO流的基础知识。主要内容包括:1) 文件与文件流概念,文件在程序中以流的形式操作;2) 创建文件的三种方式及获取文件信息的方法;3) IO流原理与分类,包括节点流和处理流的区别及优势;4) 字节流操作,重点讲解InputStream及其常用子类的使用方法。通过代码示例演示了如何读取单个字节和多个字节,强调了资源关闭的重要性。全文系统性地讲解了Java文件IO的核心概念
连接池到底选 HikariCP 还是 Druid,参数怎么调。本文从零开始,先讲连接池原理(30秒理解),再分别给出 HikariCP 和 Druid 的 Maven 依赖、Java 原生配置、Spring Boot 配置,附核心参数详解和最大连接数计算公式。最后提供两者选型对照表,以及三种最常见的连接池报错(连接超时、Too many connections、链路断开)的排查与修复方案。跟着操作
Codex可通过SSH连接的方式连接云端主机,可以实现个人电脑本地在云端实时操作的功能,但本功能需要云端配置有codex环境,针对云端网络环境问题、本地无法使用GPT账号登录问题,现有解决方式可以使用CC-Switch进行解决,通过配置双端Codex,可以实现云端执行,本地同步对话的功能,避免因为本地网络波动造成的对话终止。