OCC-RAG: компактные модели, которые отвечают только по источникамПривет, Хабр! На связи команда Optimal Cognitive Core (OCC) из AIRI. Развитие языковых моделей в последние годы определяется масштабом: каждое новое поколение вмещает в веса всё больше знаний о мире. Но огромная доля практических задач выигрывает тогда, когда модель демонстрирует не свою энциклопедичность, а способность рассуждать и анализировать предоставленный контекст. Из этого наблюдения и выросло OCC — наше семейство компактных языковых моделей (SLM), которые имеют сильные когнитивные способности, не обладая при этом большим багажом «вызубренной» информации. В этой статье расскажем о первой модели нашего семейства, OCC‑RAG, которая оптимизирована под задачу контекстного Q&A. Мы выложили два чекпойнта, OCC‑RAG-0.6B и OCC‑RAG-1.7B (плюс ONNX‑ и GGUF‑сборки). При размере 0.6 и 1.7 млрд. параметров, соответственно, они отвечают на равных или лучше моделей общего назначения, которые в 2–6 раз больше, а по верности контекс...
Related
Greater Manchester refuses Palantir's NHS data contract — and says it can do better itselfhttps://www.wired.com/story/th...
Greater Manchester refuses Palantir's NHS data contract — and says it can do better itselfhttps://www.wired.com/story/the-single-english-county-saying-no-to-palantir/The UK governm...
Que recopila los LLM sobre tihttps://proton.me/lumo/ai/ai-paper-trail#IA #AI
Que recopila los LLM sobre tihttps://proton.me/lumo/ai/ai-paper-trail#IA #AI
Melanie Mitchell on why AI doesn't think or reason like humans — and why our metrics are misleading ushttps://www.quanta...
Melanie Mitchell on why AI doesn't think or reason like humans — and why our metrics are misleading ushttps://www.quantamagazine.org/are-we-thinking-correctly-about-ai-intelligence...