Appearance
共 33 篇文章
2026年5月7日,云知声发布山海知医慧保大模型,专为医疗和保险场景深度定制,医保编码对齐准确率提升23.4%,政策问答能力提升12.6%,已上线Token Hub平台开放API,支持医保基金监管和商业保险风控,为医疗+保险双领域提供AI解决方案。
无问芯穹再获超7亿元融资。平台上线160+大模型,日均Token调用量较去年底增长20倍。CEO夏立雪提出AI生产力公式,AGI基础设施是Token经济「炼化厂」。
深入实测GPT-5.5 Instant:ChatGPT新默认模型,幻觉降低52.5%,回复更简洁,记忆增强,数学推理81.2分
详解Luma AI的UNI-1.1模型:推理+生成一体化架构,价格腰斩,阿迪达斯/马自达已签单
深入解析SubQ模型和SSA架构,13人团队如何用亚二次方稀疏注意力实现1000倍算力降低,1200万token上下文
英伟达NVIDIA Build平台90+模型全部免费,支持DeepSeek/Kimi/GLM等,一个Key通吃所有模型。限速40次/分钟,不限总量。
DeepSeek V4深度使用指南,Max思考提示词+HTML小球双摆实测对比+国产化产业链分析,V4优势与擅长领域全面解读。
大模型工程六层术语地图:模型结构/上下文缓存/推理服务/量化压缩/硬件系统/应用工程,70+核心术语完整解析,应用工程师必备概念地图。
LLMFit+Ollama本地大模型部署完整教程,llmfit硬件检测+Ollama拉模型+CanIRun.ai快速摸底+Qwen3.5:35B实测,告别盲目试错。
本地大模型部署完整指南,7大核心参数:上下文长度/GPU卸载/Batch Size/Temperature/预加载/量化,以Qwen3.5-9B为例,适配16GB内存。
2026年4月29日,英伟达发布全模态大模型,能在几秒内生成黄仁勋3分钟演讲,吞吐量是同类模型9倍。
科大讯飞总裁吴晓如宣布,2026年10月将在华为昇腾950平台上发布国产旗舰大模型。这是算力国产化的关键一步。
普林斯顿学者刘壮最新访谈引发热议。他认为大模型架构差异正在缩小,数据质量和规模才是决定模型能力的根本因素。
2026年4月,小米开源万亿参数大模型,采用MIT协议并提供1M上下文窗口。性能接近DeepSeek但略有差距,小米以开源换生态的策略明显。
2026年4月,银河通用发布LDA大模型,实现跨本体世界动作模型,不同机器人形态可以共享一套操作策略。这被业界视为具身智能的GPT-2时刻。
GPT之父Alec Radford带队发布130亿参数模型talkie,训练数据仅来自1931年之前的旧文献。这个从未接触过现代编程语言的模型,竟能写出可运行的Python代码。实验证明大模型的推理能力可能远超训练数据的边界。
量子位2026年4月28日报道,当整个行业还在卷大模型参数、烧算力、拼Token消耗时,一家中国AI公司已经实打实地靠大模型帮客户赚到真金白银。核心模式是将AI嵌入客户的业务闭环中,让AI从「聊天工具」变为「赚钱机器」。
量子位报道零犀科技在大模型行业率先实现规模盈利。这家公司不做基础大模型,而是用大模型打造AI销售Agent,按效果付费。2025年已实现正现金流,客户续费率超过90%。在普遍烧钱的大模型行业里,这是一个难得的商业化成功样本。
2021年商汤科技以"AI领域全球最大IPO"登陆港交所,市值近3000亿港元。四年后,商汤市值缩水至不足800亿,而前高管闫俊杰创立的MiniMax在2026年初上市,市值一度突破4100亿港元。AI四小龙的黄昏与大模型新贵的黎明,是中国AI产业代际更替的缩影。
2026-04-27分析指出,最强大模型保质期越来越短,领先不再是稳态,追赶也并非线性,AI竞争进入新常态。
2026年4月27日GPT-5.5 Pro视觉智商145撞倒门萨门槛,AI智力天花板崩了,大模型能力再创新高。
Anthropic官方承认Claude存在降智问题,越聊越傻,3个bug全曝光,大模型对话质量引发关注。
2026年4月26日DoNews报道AI幻觉越来越多智障率已让人无法容忍,生成式AI的致命缺陷暴露,可靠性问题亟待解决。
2026年4月26日量子位发布DeepSeek V4报告深度解读,484天换代之路全公开,中国AI展现出惊人的研发速度和执行力。
DeepSeek V4发布Pro与Flash两款模型,100万上下文、开放权重。本文对比两款模型选择建议、API接入教程、Claude Code配置方法。
2026年4月《金融时报》披露DeepSeek融资细节:200亿美元估值象征性融资,核心目的是给员工股票期权定价留住人才,梁文锋不缺钱缺的是算力和稳定性。
2026年4月24日美团万亿模型LongCat-2.0-Preview开放测试,全程基于国产算力集群训练,对标GPT-4水平,MoE架构,继LongCat-Flash后美团大模型再升级。
2026年4月24日蚂蚁发布万亿模型Ling-2.6-1T,主打快思考不依赖推理链,综合智能对标GPT-5.4非推理版,近期将开源,API已上线。
2026年4月24日OpenAI发布GPT-5.5,Terminal-Bench达82.7%首破编程AI天花板,与英伟达GB200/GB300联合设计,知识工作和科研领域全面领先。
DeepSeek-V4预览版正式上线并开源,1M上下文成标配,Agent Coding超越Sonnet 4.5直追Opus 4.6非思考模式。详解V4-Pro与V4-Flash双版本、三大架构革新、API价格与迁移指南。
小米发布迄今最强模型MiMo-V2.5系列并开启公测,多模态能力再升级。
2026年4月20日,阿里发布 Qwen 3.6-Max 预览版,智能体编程能力显著提升,SkillsBench 涨 9.9 分,在六大编程基准中表现最强。预览版已上线 Qwen Studio。
2026年4月17日,DeepSeek启动成立两年多来首次外部融资,目标估值100亿美元,募资至少3亿美元。此前多次拒绝红杉、高瓴、腾讯、阿里,现在为何开门?V4模型即将发布,人才流失压力加剧。