共 84 篇相关文章

Ollama紧急扩容迎接万亿参数级开源模型,Kimi K3、Qwen 3.8等即将开源。同期Hugging Face向OpenAI提出1亿美元安全补偿,阿里Coder移动端上线,DeepSeek暂停融资。一文梳理开源大模型生态最新动态。

黄仁勋发布AI改革宣言,联合微软、Meta、Dell等20家科技巨头力挺开源AI路线,反对封闭模型高价垄断。本文解析开源与封闭模型的价格差距、蒸馏争议、Hugging Face事件及这场路线之争对全球AI产业的深远影响。

月之暗面Kimi-K3模型即将在HuggingFace发布,从模型架构、许可协议到社区反应,全面解读这一国产大模型开源事件的战略意义与行业影响。

从零掌握DeepSeek-OCR部署与微调全流程:涵盖vLLM推理引擎部署、Unsloth高效微调、数据集预处理、LoRA训练、效果验证及RAG向量数据库集成,为开发者提供可落地的大模型定制化实战路径。

CivitAI的"抢先体验"付费机制引发Reddit社区热议:功能性模型是否应长期锁在付费墙后?本文深度解析创作者变现、社区共识与平台责任之间的张力,探讨AI开源生态商业化的合理边界。

中国商务部密集磋商是否限制顶尖开源AI模型海外访问,涉及阿里、字节跳动、DeepSeek等头部企业。与此同时,DeepSeek低调研发自有推理芯片近一年,首次开启外部融资约70亿美元。中美AI出口管制镜像博弈加剧,全球开发者面临技术选型新变局。
llmfit:一条命令检测硬件能跑哪些本地大模型
llmfit 是用 Rust 编写的开源命令行工具,无需下载模型即可预判本地硬件能否运行指定 LLM。覆盖数百种模型与 Ollama、llama.cpp 等主流推理后端,帮助开发者在本地部署大模型前快速完成硬件适配评估,避免反复试错。

阿里千问第五代模型Qwen3全面解析:6款Dense与MoE架构模型覆盖0.6B至235B,全球首款开源混合推理模型,旗舰235B性能追平Gemini 2.5 Pro,开发者与企业部署的完整参考指南。

使用uBlock Origin自定义过滤规则,精准屏蔽Civitai站内"Support Civitai creators"广告横幅,并修复移除后的页面布局问题。提供完整规则代码与配置步骤,适用于.com和.red双域名。

零基础理解AI大模型:厘清人工智能、机器学习、深度学习与大语言模型的关系,梳理从深蓝到ChatGPT、DeepSeek的演进脉络,盘点通义千问、智谱、文心一言等国产大模型竞争格局,助你快速入门大模型应用开发。

本文深度解析一个基于深度学习的疟疾细胞分类项目,涵盖二分类模型训练、Hugging Face Spaces部署、Gradio界面搭建全流程,揭示医学AI影像识别的技术路径与现实边界,适合机器学习入门者参考学习。

实测科研自动化Agent Klaus Goh,全流程复现IBM发表于NeurIPS的TTM时序预测论文:从论文检索、环境搭建、零样本推理到报告交付,10秒完成2700+预测点,MSE 0.363超越TimesFM等大模型,揭示AI科研自动化新趋势。

ostris发布Krea 2 Turbo Style Reference LoRA,支持单图或多图风格提取,让AI图像生成实现精准风格迁移。适用于品牌视觉、系列创作等场景,开源免费可本地部署。

一位开发者用GitHub Copilot结合Azure SQL构建牙科诊所管理系统的真实案例,揭示AI编程工具在云安全托管身份配置上的局限,以及Human-in-the-Loop协作模式如何突破瓶颈,提升开发效率。

马斯克公开承诺不会切断竞争对手Anthropic的算力访问,引发行业热议。本文深度解析AI云基础设施的竞合关系、400亿美元背后的战略依赖,以及算力垄断时代企业如何应对信任风险。

即将参加花旗集团初级生成式AI应用开发者终面?本文深度拆解技术考察方向、行为面试要点及金融行业特殊关注点,提供短期高效备考策略,助你从容应对LLM、RAG、系统设计等核心考题。

同一款国产AI,在Hacker News等海外社区获得盛赞,在国内平台却饱受批评。本文深度拆解用户身份、产品形态、定位认知三重错位,揭示这场评价割裂背后的真正原因。

详解如何通过CLI Proxy API(CPA)将Claude、DeepSeek、Grok、Gemini等多家AI模型聚合到OpenAI Codex中使用,涵盖VPS部署、Docker安装、管理面板配置及Codex++连接的完整流程。