登录社区云,与社区用户共同成长
邀请您加入社区
Provider 抽象落地时可以引入有限的错误类别,例如 configuration、authentication、rate_limit、timeout、invalid_response 和 unavailable,并保持面向设备的提示稳定。需要比较的指标不只是“有回答”:还包括首个模型响应耗时、总调用次数、超时回退、答案长度、TTS 是否收到完整句、同一设备历史是否隔离,以及切换 Provide
本文探讨了从传统推荐系统到基于大模型的对话式推荐系统(CRS)的技术演进。传统推荐系统主要依赖协同过滤、基于内容和混合推荐等方法,而基于大模型的CRS通过多轮对话、自然语言理解、深度语义理解等12项特性显著提升了用户体验。文章重点介绍了CRS的技术架构设计,特别是大模型底座层(包括通用大模型和推荐微调大模型)如何为系统提供语言理解、个性化推荐和跨领域知识整合等核心能力。这种架构使CRS能够实现更智
本文介绍了如何在星图GPU平台上自动化部署🏮 DeepSeek-OCR · 万象识界镜像,实现智能文档解析功能。通过Kubernetes Helm Chart一键部署,用户可快速搭建OCR服务,应用于文档数字化、图像转Markdown等场景,显著提升处理效率。
现在DeepSeek可谓是刷爆全网不少小伙伴都表示要体验一下!这几天更是有清华大学团队发布超详细DeepSeek使用手册菌菌已经第一时间给大家整理收集了!
deepseek-ai/DeepSeek-R1 (github.com)[2501.12948v1] DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning (arxiv.org)[DeepSeek-R1: Incentivizing Reasoning Capability in LLM
本文介绍了如何在星图GPU平台上自动化部署DeepSeek-OCR-2镜像,构建可水平扩展的OCR微服务。该方案利用Kubernetes集群实现服务的自动扩缩容,并通过vLLM加速推理。部署后,用户可通过Gradio前端界面轻松上传图片或PDF文件,快速完成文字识别任务,适用于文档数字化、信息提取等场景。
本文介绍了如何在星图GPU平台上自动化部署DeepSeek-OCR-2镜像,构建高可扩展的OCR服务。该方案利用Kubernetes集群实现服务的水平扩展与弹性伸缩,能够高效处理大量文档识别任务,典型应用场景包括PDF文件批量文字提取与自动化信息录入。