共 259 篇相关文章

月之暗面Kimi K3正式接入Telnyx Inference API,开发者可通过统一接口调用Kimi K3的长上下文与中文理解能力。本文解析Kimi K3技术定位、Telnyx推理平台价值及中国大模型出海趋势。

Ollama紧急扩容迎接万亿参数级开源模型,Kimi K3、Qwen 3.8等即将开源。同期Hugging Face向OpenAI提出1亿美元安全补偿,阿里Coder移动端上线,DeepSeek暂停融资。一文梳理开源大模型生态最新动态。

解读DeepSeek创始人梁文峰罕见对话记录,深入分析DeepSeek以愿景驱动团队、战略克制聚焦AGI、坚持开源的核心哲学,以及这套理念对中美AI竞争格局的深层意义。

中国开源模型如Kimi K3、DeepSeek以极低价格逼近美国闭源模型性能,本文深度分析从性能收敛到价格竞争再到估值重估的传导链条,拆解美国AI泡沫的真正来源与三个关键跟踪信号。

英伟达CEO黄仁勋公开为AI开源模型辩护,称知识蒸馏是合法学习方式而非抄袭,高度评价DeepSeek和Kimi等中国模型。联合微软、Meta等20多家企业发公开信支持开源AI,OpenAI和谷歌缺席。深度解析黄仁勋力挺开源背后的技术信念与商业逻辑。

OpenRouter数据显示中国AI模型已占美国AI消费量58%。DoorDash、Airbnb等硅谷巨头纷纷采用Kimi、DeepSeek、通义千问等中国开源大模型,凭借低价高性能和开源权重优势快速渗透全球市场。

深入对比Codex与Claude Code两大AI智能体编程工具,从AI Agent概念解析、工具选型、成本考量到GPT账号配置,提供完整的新手上手指南,助你快速掌握AI智能体开发工作流。

详解OpenAI Codex与Claude Code的区别与实测对比,从AI智能体概念到账号配置,帮助编程新手和开发者快速上手AI编程智能体工具,提升开发效率。

详解OpenAI Codex的核心功能与实际使用体验,对比Claude Code的优劣,分享DeepSeek配置避坑技巧,为开发者提供AI编程工具选型与上手的实用建议。

深度解读月之暗面Kimi-K3技术报告,分析其长上下文处理、MoE架构设计、推理能力提升等核心技术突破,探讨国产大模型在全球AI竞争中的定位与发展趋势。

月之暗面Kimi-K3模型即将在HuggingFace发布,从模型架构、许可协议到社区反应,全面解读这一国产大模型开源事件的战略意义与行业影响。

面对AI风口,Java开发者如何从传统CRUD后端转型为AI应用开发者?本文解析AI+国家战略、中国AI追赶逻辑,并给出夯实Java基础、补齐大模型应用能力的实用转型路径。

Rocky是一款极简透明的开源编程智能体,核心Loop仅几百行Python代码,原生集成DeepSeek搜索与Research模式,内置SWE基准测试环境,适合学习Coding Agent原理、文献调研与可复现的Agent实验。

无ChatGPT账号也能用Codex!本文详解如何通过Codex++管理工具,将DeepSeek、豆包等国产大模型接入Codex,包含Base URL配置、API Key获取、Token充值全流程步骤。

本文通过真实Python副业接单案例,详解如何用DeepSeek等AI大模型提升网站逆向分析效率:从绕过反调试、定位加密参数、识别ob混淆,到让AI一键还原SM2/SM4国密代码。掌握"人工定位+AI还原"的高效接单方法论。
TradingSpy:本地优先开源AI交易助手,数据隐私不妥协
TradingSpy是一款本地运行、隐私优先的开源AI交易助手,无需上传数据至云端。本文深度解析其架构设计、开源价值与局限性,帮助交易者评估是否适合自己的需求。

jlens-gguf是一款开源工具,将Anthropic雅可比透镜(Jacobian Lens)可解释性方法引入GGUF与llama.cpp生态,支持模型内部观测、实时引导(steering)及abliteration操作,兼容dense与MoE架构,让本地推理用户也能探索大模型内部机制。

小米悄然在Hugging Face上传MiMo-V2.5-DFlash权重,附带独立MTP模型,有望解决llama.cpp兼容问题,让300B超大模型本地推理速度翻倍。社区正期待GGUF量化转换。