Cloning your Discord friends with Large Language Models2 days agohttps://blog.pixelmelt.dev/clone-your-friends/该项目使用RTX 3090在Discord聊天数据上训练了Mistral 7b模型,取得了幽默但实际价值有限的结果。数据通过过滤低质量消息、单次@消息、无回复内容及会话终结项进行清洗,随后采用sharegpt格式转化为JSONL,用于Axolotl框架的训练。训练耗时6小时,历经10个轮次,生成的低秩适配模型(LoRA)被导入oobabooga,用以创建能够模仿朋友们聊天风格的Discord机器人。
Liquid AI releases a 230M model optimized for phones, Raspberry Pi, and robotsa month agohttps://www.liquid.ai/blog/lfm2-5-230mLFM2.5-230M是一个小巧、快速的模型,适用于智能体工作流的微调和部署,可在包括云GPU和CPU在内的各种设备上实现快速推理。该模型基于19万亿个token进行预训练,并通过监督微调、直接偏好优化和多领域强化学习进行后训练,平衡了能力与适应性。模型在类人机器人上进行了技能选择测试,利用英伟达的SONIC框架将自然语言指令转换为结构化计划。基准测试显示,LFM2.5-230M在知识理解、指令遵循、数据提取和工具使用任务上与更大模型竞争或表现更优。它支持跨生态系统(如llama.cpp、MLX、vLLM和ONNX)的快速推理,针对CPU和GPU性能进行优化,以实现低延迟和高吞吐量。LFM2.5-230M采用开放权重,可在Hugging Face上获取,设计用于大规模数据提取或轻量级设备端工作负载,但不适用于推理密集型任务。