登录社区云,与社区用户共同成长
邀请您加入社区
作为AI工厂战略的核心落地载体,Alaya Token依托智算集群资源底座,贯通模型研发、智能封装到规模化交付全链路,为开发者与企业提供标准化、可计量、按需付费的一站式Token算力服务。此举标志着九章云极“AI工厂”战略在模型生态建设上再落关键一子,继智谱GLM-5.2、DeepSeek-V4 Flash之后,其Token工厂的“多模型矩阵”已覆盖当前国内头部开源模型梯队。目前,Alaya To
vLLM(Vectorized Large Language Model Serving System)是由加州大学伯克利分校团队开发的高性能、易扩展的大语言模型推理引擎。它专注于通过创新的内存管理和计算优化技术,实现高吞吐、低延迟、低成本的模型服务。
UI-TARS 是字节跳动推出的新一代原生图形用户界面(GUI)代理模型,支持跨平台自动化交互,具备强大的感知、推理、行动和记忆能力,能够通过自然语言指令完成复杂任务。
我们相信,随着训练框架的持续优化与普及,智能体将逐步跨越“能跑通 Demo”的初级阶段,迈向“持续自主进化”的新阶段。未来,AReaL 团队将持续在系统可用性、训练引擎效率、AI 辅助开发与多模态智能体训练等方向发力,致力于打造面向 Agentic AI 时代的高性能 RL 基础设施。传统的强化学习训练系统多为同步模式,在每一轮训练中需要等待所有推理任务完成后再更新模型,这不仅限制了训练吞吐,也造
KittenTTS是一款开源的轻量级文本转语音模型,体积仅25MB,支持CPU运行无需GPU。该模型提供多种高质量语音选项,适合实时语音合成,但目前仅支持英文(输入中文会输出"chinese letter")。可通过pip安装,但在使用中可能遇到pydantic版本冲突等问题,可通过设置HF镜像加速解决。开发者需注意该模型尚不支持中文语音合成。
在大语言模型(LLM)的微调过程中,强化学习(RL)扮演着至关重要的角色。传统的近端策略优化(PPO)算法虽然被广泛应用于LLM的微调,但其在处理大规模模型时面临着巨大的计算和存储负担。PPO算法需要维护一个与策略模型大小相当的价值网络来估计优势函数,这在大模型场景下会导致显著的内存占用和计算代价。例如,在数十亿甚至千亿参数的语言模型上应用PPO时,价值网络的训练和更新会消耗大量的计算资源,使得训
MaxKB(Max Knowledge Base)是一款基于大语言模型(LLM)和检索增强生成(RAG)技术的开源知识库问答系统,由1Panel团队开发。
RT-DETR是基于Transformer的目标检测模型,由百度于2023年发布。它采用端到端设计,无需手工设计锚框(anchor-free),支持实时推理(30 FPS以上),并在COCO数据集上达到高精度(如mAP@0.5达53.1%)。实时性能:优化Transformer解码器,减少计算开销。高精度:利用注意力机制处理多尺度特征。灵活性:支持自定义backbone(如ResNet、Swin
今日凌晨,通义千问团队正式开源了 Qwen3 大模型,并且一口气发布了 8 个型号,其中包括 0.6B、1.7B、4B、8B、14B、32B 以及 30B-A3B 和 235B-A22B,使用者可以根据自己的业务情况,选择合适的版本进行使用。更让人惊喜的是,最新的 Qwen3 系列模型具备,全面满足复杂问题处理与全球化应用需求。PS:Qwen3 也是国内首个「混合推理模型」,「快思考」与「慢思考」
12月1日,首届“通义千问AI挑战赛”开赛,参赛者可免费畅玩通义开源模型家族,包括刚刚发布的720亿参数模型Qwen-72B。主办方为参赛者提供价值50万元的免费云上算力和丰厚奖金。赛事分为算法和Agent两大赛道,前者聚焦通义千问大模型的微调训练,希望通过高质量的数据探索开源模型的代码能力上限,后者鼓励开发者基于通义千问大模型和魔搭社区的Agent-Builder框架开发新一代AI应用,促进大模
HAMi 通过灵活、可靠、按需、弹性的 GPU 虚拟化机制,提升算力资源利用率,并可插拔式、轻量化、无侵入地部署在公有云、私有云与混合云环境中。基于长期深耕云原生、分布式系统与 AI Infra 领域的实践积累,Jimmy 形成了清晰的行业判断:随着大模型与 AI Agent 进入规模化落地阶段,制约系统扩展性与可持续性的核心要素,已从单一的模型能力转向算力全生命周期的管理能力,包括算力的计量、分
BuildingAI 是一款面向 AI 开发者、AI 创业者和先进组织打造的开源积木式 AI 应用搭建系统。通过可视化配置界面(Do It Yourself)零代码搭建具备智能体、MCP、RAG 管道、知识库、大模型聚合、上下文工程等原生 AI 能力,以及用户注册、会员订阅、算力计费等商业闭环能力的原生企业智能体应用。
凭借大数据、大算力的「大力出奇迹」,各类大模型「智能涌现」,再一次诠释了「数据是新时代的石油」。然而随着 ChatGPT 等各类大模型的应用,暴露出的隐私安全与数据要素流通问题引发广泛关注。数据流通与隐私安全的关键技术路径 —— 隐私计算技术和产业迎来突破发展新动力。隐语开源一周年专场 Meetup 剧透2022 年 7 月 4 日,隐语正式开源,至今已开源一周年啦 ???? 在开源一周年之际,我
高性能大模型的打造,是一项复杂的系统性工程一个好的基础能够让你在学习的道路上事半功倍,但绝对不是学习的终点,大模型技术也不外如是。大模型的进阶学习路线那么怎么才能打造一款能够在企业生产中使用的大模型呢?而这就属于大模型技术的进阶;如果说大模型的基础是能够做出来一个大模型,那么大模型的进阶就是怎么把大模型做的更好。下面也将从几个方面介绍一下大模型的进阶:模型优化硬件加速分布式并行计算
2025年AI发展将呈现三大核心趋势:一是算法创新推动成本降低,以DeepSeek为代表的开源模型使AI技术民主化;二是AI Agent崛起成为生产力工具,数字劳动力时代即将到来;三是全球监管框架加速建立,推动AI进入规范发展新阶段。这些趋势标志着AI将从算力竞赛转向算法优化,从对话工具升级为生产力助手,并在监管护航下实现可持续发展。
CPG-3576开发板搭载RK3576CPU,具有6TOPSNPU算力。板载双千兆网口,支持3路视频输出和摄像头输入,适合AI应用和物联网场景,如智能网关、软路由器、智能安防、人脸识别等应用。
面对这一挑战,OpenCloudOS 社区确立了“重心在OS,延展至AI”的技术原则,以及“成为' AI时代最好用的OS'” 的目标,聚焦打磨OS内核、调度器、驱动兼容性、安全模块等传统优势领域,为AI工作负载提供独特的OS层价值,通过三大关键举措和多项技术创新,显著降低触及和利用异构算力的门槛,让开发者或企业能更专注于算法与模型的创新。用户在选择 HAI 服务时,可直接选用该镜像,瞬间获得一个稳
openFuyao亮相2025沙中开源与AI科技峰会,向与会沙中企业、技术专家、开源爱好者分享了多样化算力集群软件生态的前沿进展与实践成果,为推动沙中算力技术生态合作奠定基础,助力开源技术走出去,建立国际影响力。
openEuler性能验证测试表明,该系统在多架构硬件环境下表现优异。测试采用x86和ARM双平台,验证了CPU、内存、存储及异构计算能力。结果显示openEuler能准确识别不同硬件架构,存储性能测试中顺序读写速度达1GB/s以上,随机读写IOPS超10万。GPU加速测试确认了其对NVIDIA显卡的良好支持,CUDA计算能力验证通过。测试数据表明openEuler具备优秀的跨平台兼容性和高性能表
等领域的优势 —— 从支持 AI 项目全流程开发的协作功能,到助力开发者降低研发门槛的资源支持,全方位呈现了 AtomGit 如何为开发者提供 “一站式” 工具支撑,为 AIGC 创作注入开源动力。期间,众多开发者驻足咨询,就 AI 项目托管、多团队协同、算力资源对接等需求展开深入交流,现场互动氛围热烈。此次参会,AtomGit 不仅同步了 AIGC 产业最新趋势,更与产业链伙伴建立了紧密联结。生
点击卡片“大数据实战演练”,选择“设为星标”或“置顶”回复“资料”可领取独家整理的大数据学习资料!回复“Ambari知识库”可领取独家整理的Ambari学习资料!回复“deepseek”可领取干货资料以及知识库!DeepSeek开源周首日重磅发布!首个项目FlashMLA解锁H800算力极限,AI推理速度飙升2025年2月24日,DeepSeek正式启动为期五天的“开源周”,首个亮相的“王炸级”项
系统可将单张算力卡实现10%粒度的细粒度切分,并支持对虚拟化后的算力单元进行监控。XPU监控(XPU-Exporter):面向XPU虚拟化资源定制的监控组件,从硬件资源中采集算力性能指标,并将其转换为标准的Promethues格式,提供Metrics接口,最终可集成到集群的Prometheus生态中。显存/算力控制模块:负责硬件资源显存和算力两类资源的申请,分配与回收,通过限制应用程序使用硬件资源
之前的VideoSmart产品瞄准的是流媒体视频机顶盒(STB)市场,但VS680瞄准的是更广泛的智能家居设备。音频处理器可以驱动智能音箱或声音条,但当与DLA结合时,它除了为基于云的数字助理提供前端之外,还可以处理设备上的语音功能。香蕉派BPI-M6是香蕉派社区在2022年推出的新一代单板计算机,它采用深蕾半导体(Synaptics) VS680四核Cortex-A73 (2.1GHz)和一个C