当前标签:大语言模型
Abliteration.ai
Abliteration.ai 是一个专为专业团队设计的LLM提供商,通过减少模型拒绝行为,让安全研究人员、红队、信任与安全团队及ML工程师能够运行敏感查询、测试AI应用漏洞、分类内容并大规模生成合成训练数据。
ESP32-AI 亮相:8MB PSRAM 运行 2890 万参数模型,设想离线调配出最佳咖啡
ESP32-S3在仅有8MB PSRAM的硬件上成功运行2890万参数的大语言模型,推理速度达9.5 tok/s,完全离线,为嵌入式AI开辟了全新可能,甚至让人憧憬离线调配一杯完美咖啡。
SpaceXAI 2T 模型 Grok 4.6 预计 8 月 7 日内推出
SpaceXAI 2T参数模型Grok 4.6预计8月7日内推出,马斯克透露其性能将超越Grok 4.5并挑战Kimi K3。
如何让大语言模型思考得更准确
适度思考与外部知识增强,能让大模型在事实问答中更准确,而高效推理技术与分步拆解则进一步提升了可靠性与效率。
腾讯混元大语言模型和多模态团队合并,统一由姚顺雨管理
腾讯正式将大语言模型与多模态团队合并,统一由前OpenAI研究员姚顺雨管理,并新成立AI Infra与AI Data等部门,加速AI研发体系重构。
AIsa
AIsa是为AI代理提供模型网关、技能和机器支付的能力层平台,旨在简化代理开发与自动化执行。
CodeGateway
CodeGateway 是一个兼容 OpenAI 的 AI 网关,支持 Claude、GPT 等多种模型,只需更换一个 base_url 即可对接。
蜜崽检索
蜜崽检索是一款专为英文文献检索设计的AI智能体,提供精准、高效的学术搜索与内容提炼服务。
DiffMind
DiffMind是一款支持一次性提问、同时获得多个主流AI模型回答的智能对比工具
MiniMax M3 模型正式开源:原生多模态、百万上下文
MiniMax M3 模型正式开源,成为国内首个集百万上下文、原生多模态与顶级编程能力于一身的旗舰大模型,API 与权重即将全面开放。
AI真能学会心算?隐式思维链首次得到理论证明,Stuart Russell参与
伯克利与普林斯顿团队首次严格证明隐式思维链(ICoT)在数学上有效,可将推理成本从线性降至对数级别,为低延迟推理开辟理论路径。
牛津、英伟达等提出记忆压缩新范式:训练时让模型学会断舍离
牛津大学、英伟达等机构提出记忆压缩新范式,通过训练时让模型主动学会“断舍离”KV缓存,实现128K长文本加速2.7倍、2M上下文加速35倍,性能不打折。
谷歌 AI 摘要频现低级拼写错误,大语言模型固有缺陷难根治
谷歌AI摘要近期被用户发现包含“S”“H”“A”“T”等无意义字母组合及明显拼写错误,暴露出大语言模型在生成文本时缺乏“遗忘机制”与上下文校验能力的根本缺陷。
“Token”必须死?
AI发展的核心范式——Token化,正面临结构性挑战,连续空间范式被证实可行,或将颠覆现有产业格局。
Query Fan-Out Optimizer
Query Fan-Out Optimizer 是一款揭示大语言模型在检索网络来源时所使用的隐藏子查询的工具。
Council Chat
Council Chat是一个多AI聚合对话平台,让你在统一界面同时使用Chat、Council和Agent等多种AI模型,无需再纠结选择单一AI。
腾讯吐司
腾讯吐司是腾讯推出的AI应用生成工具,能将创意快速转化为可直接运行的App。
QoderWake
QoderWake是阿里巴巴Qoder平台打造的全天候AI数字员工,为企业提供7×24小时智能服务与自动化运营支持。
Tokeny
Tokeny — 你的AI全能搭子,多模型自由切换,Skill技能一键安装,MCP插件无限扩展,覆盖搜索、设计、数据分析、文档生成全场景,数据本地存储,隐私零收集,安全可控。
NottoAI
NottoAI 是一个多模型统一订阅平台,可访问 GPT-5.4、Claude 等 16 余种高级 AI 模型。
OfoxAI
Unified API gateway to access 100+ LLMs like GPT, Claude, and Gemini.
FinGPT
FinGPT是一款专注于金融领域的开源大语言模型,旨在提供高质量的语言理解和生成能力,服务于金融信息处理与智能分析。
DeepSeek
DeepSeek是一个备受关注的国产开源大模型平台,提供高质量的语言处理能力,适用于多种应用场景。
美国医学会旗下期刊:现阶段 AI 难以直接应用于临床决策,早期诊断错误率达到 80%
现阶段AI在医疗早期诊断中错误率高达80%,难以替代医生独立决策。
天工AI助手
天工AI助手是一款基于双千亿级大语言模型的对话式人工智能助手。
Panofy
Panofy是一个无需复杂设置即可训练无限AI代理的平台,帮助用户自动化工作流程、加速研究并快速生成文档。
哈萨比斯:ChatGPT把AI带上了“邪路”
哈萨比斯批评ChatGPT引导AI走向“邪路”,引发行业对生成式AI发展路径的深思。
GLM 5
GLM 5是一款拥有7450亿参数的超大规模AI模型,致力于提升智能体能力与复杂推理表现。
Llama 3
Llama 3是由Meta推出的最新一代开源大型语言模型,具有强大的语言理解和生成能力。
超能文献
超能文献是一款医学文献智能搜索引擎,由深圳数野科技开发,旨在通过AI技术提升医学研究者的文献检索效率。