共 335 篇相关文章

本周AI行业五大关键事件深度解读:OpenAI沙箱逃逸事件推动安全立法,Kimi K3开源引发地缘讨论,Gemini Flash全量上线抢占入口,Anthropic 15亿美元版权和解创司法先例,国产模型加速移动端扩张。

OpenRouter数据显示中国AI模型已占美国AI消费量58%。DoorDash、Airbnb等硅谷巨头纷纷采用Kimi、DeepSeek、通义千问等中国开源大模型,凭借低价高性能和开源权重优势快速渗透全球市场。

深入对比Codex与Claude Code两大AI智能体编程工具,从AI Agent概念解析、工具选型、成本考量到GPT账号配置,提供完整的新手上手指南,助你快速掌握AI智能体开发工作流。

详解OpenAI Codex与Claude Code的区别与实测对比,从AI智能体概念到账号配置,帮助编程新手和开发者快速上手AI编程智能体工具,提升开发效率。

预算有限也能做出高质量AI项目。本文详解如何用Ollama、Groq、Chroma等开源免费工具,从零搭建RAG检索增强生成系统和多Agent协作工作流,附垂直领域项目方案与作品集打造建议。

详解Ollama连接OpenWebUI后回答质量下降、响应变慢的常见原因,涵盖num_ctx上下文截断、采样参数差异、GPU资源争抢、系统提示词干扰等排查方法,附系统化排查清单。

月之暗面正式发布Kimi K3,2.8万亿参数、100万上下文、原生多模态开源模型。凭借KDA架构创新与超低成本,在编程、知识工作等基准测试中媲美GPT-5.6与Fable 5,重新定义AI竞赛性价比。

GLM 5.2开源大模型深度实测:7530亿参数、100万token上下文,性能媲美Opus 4.8,价格仅约十分之一。本文详解在Claude Code和Cursor中配置GLM 5.2的完整步骤,以及Zapier MCP接入9000+应用的实操方法。

Notion联合创始人Simon Last深度分享:从GPT-4初体验到个人智能体、自定义智能体的完整演进历程。揭秘每半年重写AI框架的秘诀、工程师如何变身"智能体经理",以及Notion成为"模型界瑞士"的战略布局。

阿里Qwen下一代、DeepSeek V4 GA、智谱GLM新版几乎同步逼近发布节点。本文梳理三大国产大模型最新进展、实测表现及蒸馏争议,带你抢先了解国产AI新旗舰的核心信息。

详解Claude Code安装配置全流程,对比Cursor、Trae等AI编程工具优劣,分析Sonnet、DeepSeek V4 Pro等模型成本与性能,助你快速上手这款强大的AI编程助手。

DeepSeek开源推测解码工具库DeepSpec,生产环境实测推理速度提升60-85%,吞吐量最高提升661%。集成三大算法、九个预训练Checkpoint与九个评测基准,三步即可上手,MIT协议免费商用。

前沿AI模型正加速走向通用化:成本大幅下降、通用模型在数学推理与竞赛编程中超越专用模型、小型编程任务趋近自动化、多智能体工作流持续进化。本文深度解析这些信号背后的技术逻辑与行业影响。

全面解析DeepSeek Math V2:IMO金牌级数学推理能力、97.3%的Math500正确率、Apache 2.0完全开源可商用。从技术架构、版本演进、核心能力到本地部署,带你彻底读懂这款开源数学大模型的过人之处。

开发者发现llama.cpp中一个潜藏多年的CUDA精度Bug,仅影响NVIDIA Tesla P100(sm_60架构)。三行代码修复后,KL散度中位数降低约2300倍,首选token一致性从96.5%提升至99.9%,且性能不损反增。本文深入解析Bug根源、测量数据与市场影响。

手把手拆解本地离线RAG应用的完整构建思路:基于Ollama、ChromaDB与Flask,实现PDF文档分块、向量化检索与受控生成,全程无需云端API,敏感文档零泄露风险。适合想入门RAG或重视数据隐私的开发者。

全面解析Spring AI核心模块:ChatModel对话、EmbeddingModel向量化、RAG检索增强生成、Tool Calling工具调用及MCP协议。Java开发者快速接入DeepSeek、ChatGPT等大模型的实战教程,涵盖Milvus向量数据库与Ollama本地模型集成。

Spring AI 1.0稳定版发布,Java开发者无需转Python即可开发AI应用。本文涵盖大模型接入、RAG知识库、智能客服、Agent智能体五种模式及企业级落地实践,助你用Spring技术栈全面进入AI开发领域。