Příchod Copilotu do ekosystému Microsoftu změnil způsob, jakým vyhledáváme znalosti a jak s nimi pracujeme. Klíčem je kombinace lexikálního a sémantického vyhledávání s kontextem Microsoft Graphu , aby každý dotaz vracel relevantnější, vysvětlitelnější a bezpečnější výsledky ve vaší organizaci.
Pokud máte zájem o maximalizaci této funkce, je nezbytné pochopit, jak se sémantický index vytváří, jak informace proudí mezi Copilotem, Graphem a aplikacemi a jaká omezení, zabezpečení a řízení platí. Dozvíte se také, kdy použít vyhledávací API Copilota a jak připravit sémantické modely v Power BI tak, aby umělá inteligence optimálně fungovala v dotazech v přirozeném jazyce, generování metrik DAX a vyhledávání obsahu.
Co je lexikální a sémantický index v Copilotu?
Microsoft 365 Copilot vytváří a spravuje hybridní index, který kombinuje lexikální a sémantické signály z dat klientů. Tento index je podáván z Microsoft Graphu a chápe vztahy, kontext a sociální signály (spolupráce, blízkost, oprávnění) pro personalizaci relevance pro každého uživatele.
Na sémantické úrovni se používají vektory – číselné reprezentace textu nebo jiných atributů – umístěné ve vícerozměrných prostorech, kde jsou seskupeny podobné prvky. To umožňuje vyhledání souvisejícího obsahu i bez přesné shody slov , zachycení skloňovaných tvarů, synonym a dokonce i zamýšleného významu fráze.
Sémantické indexování existuje koexistuje s tradičním vyhledáváním: dotazy se provádějí pomocí klíčových slov a navíc sémantické podobnosti . Copilot v praxi kombinuje oba přístupy, aby ukotvil odpovědi jazykového modelu se skutečnými daty nájemníků.
Celý proces je navržen s ohledem na bezpečnost, dodržování předpisů a ochranu soukromí. Odpovědi zahrnují pouze obsah, ke kterému již máte přístup , a to s použitím stejného modelu oprávnění jako Microsoft 365. Organizační a geografické hranice jsou respektovány v souladu s nastavením klienta.
Jak informace proudí mezi aplikacemi Copilot, Graph a dalšími

Když odešlete požadavek z aplikace Microsoft 365, Copilot přijme dotaz, přistupuje k Graphu a sémantickému indexu a obohatí výzvu, kterou odešle do LLM. Po obdržení počáteční odpovědi modelu ji porovná s Graph/index, aby zahrnul nedávná data a příkazy aplikace před zobrazením výsledku.
Tento cyklus zahrnuje šifrování při přenosu (HTTPS) a šifrovaná data v klidovém stavu. Ani dotazy, ani obsah používaný k podpoře odpovědí se nepoužívají k trénování základních LLM , což posiluje ochranu soukromí firem a dodržování předpisů (GDPR, EU Data Boundary atd.).
V současné době se indexy generují na úrovni klienta a uživatele. Index klienta zahrnuje textový obsah ze SharePointu Online a bude rozšířen; index uživatelů přidává signály z jejich „pracovního prostředí“ (např. e-maily a dokumenty, které zmiňují nebo komentují), a to vždy s respektováním oprávnění.
Vytváření a aktualizace těchto indexů probíhá automaticky: k jejich aktivaci není nutný žádný administrativní zásah . Obsah SharePointu určený pro spolupráci více uživatelů je denně znovu indexován; změny v již indexovaných dokumentech se projeví téměř okamžitě.
Podporované typy obsahu a frekvence aktualizací
Sémantické porozumění se aplikuje na více zdrojů Microsoft 365. Na úrovni uživatele to zahrnuje osobní poštovní schránky a soubory OneDrive/SharePoint (Word, PowerPoint, PDF, stránky ASPX, OneNote). Na úrovni klienta to zahrnuje textové dokumenty (Word, PPT, PDF, ASPX, OneNote) a data z konektorů Graph.
Existují některé důležité výjimky: delegované nebo sdílené poštovní schránky nejsou v indexu uživatelů podporovány a obsah archivovaný v poštovních schránkách nebo SharePointu se nezpracovává. Na obou úrovních závisí konečná viditelnost na skutečných oprávněních každé osoby.
Pokud jde o aktuálnost dat, nejprve se provede jejich počáteční indexace . Od té doby se denně přidávají nové dokumenty ze spolupracujících webů a aktualizace již indexovaných položek se projeví okamžitě , takže odpovědi jsou založeny na nejnovějších verzích.
Sémantická analýza není „všechno nebo nic“: Copilot kombinuje lexikální signály (klíčová slova) s vektorovou podobností , aby klasifikoval výsledky a ukotvil odpovědi s citacemi dokumentů, e-mailů nebo stránek, které podporují konečný návrh.
Nastavení administrace, vyloučení a vyhledávání
Sémantické indexování je automaticky povoleno a nelze jej zakázat jako vylepšení služby Microsoft Search . Existuje však několik způsobů, jak připravit prostředí: kontrola nastavení spolupráce SharePointu, modelu oprávnění nebo použití ochrany před únikem informací (DLP) s Microsoft Purview k vyloučení citlivých dat.
Pokud vaše organizace nepoužívá DLP a potřebujete vyloučit konkrétní web ze SharePointu Online nebo si projít návod, jak spravovat SharePoint Online pomocí Copilotu , můžete ho označit tak, aby se nezobrazoval ve výsledcích vyhledávání (Nastavení webu > Vyhledávání a offline dostupnost > „Ne“ v části „Povolit zobrazení tohoto webu...“). Tento proces můžete také automatizovat pomocí PowerShellu pro více webů.
V centru pro správu Microsoft 365 jsou „závěry položek“ a „závěry osob“ ve výchozím nastavení povoleny . Jejich zakázáním ztratíte personalizaci a signály, které zlepšují relevanci (například relevantní kolegové odvození z distribuce nebo organizačního schématu).
Nezapomeňte, že model oprávnění Microsoft 365 je základem: Copilot nikdy nezpřístupňuje obsah bez autorizace . Pokud dochází k nadměrnému vystavení v důsledku širokých odkazů („kdokoli v mé organizaci“), zkontrolujte správu sdílení a zvažte použití Advanced Management for SharePoint k auditu a nápravě přístupu.
Konektory, soukromí, úložiště a šifrování BYOK
Konektory Copilot umožňují začlenit externí obsah do Microsoft Graphu a zároveň zachovat oprávnění . V ideálním případě by tato data měla být bohatá na text, aby se maximalizovala sémantická efektivita; mohou se nacházet lokálně nebo ve veřejných/privátních cloudech.
Pokud jde o ochranu soukromí a dodržování předpisů, Copilot respektuje GDPR a geografické hranice . Index uživatelů je hostován tam, kde se nachází jejich poštovní schránka; index klientů je uložen v izolovaném kontejneru v oblasti webu SharePoint. V případě EU Data Boundary se index nachází v datových centrech EU/EFTA.
Pro zákazníky s možností „Přineste si vlastní klíč“ (BYOK) podporuje Copilot šifrování s vlastními klíči a sémantické indexování je automaticky povoleno bez jakýchkoli dalších kroků. V žádném případě data použitá k informování odpovědí netrénují podkladové modely.
Pokud potřebujete další vrstvy, použijte Purview Information Protection, štítky citlivosti a zásady uchovávání nebo minimalizace dat . Omezení nepotřebného obsahu zlepšuje zabezpečení i přesnost vyhledávání.
Vyhledávací API od Copilota: Kdy ho použít a jak z něj vytěžit maximum
Vyhledávací API od Copilota poskytuje hybridní (sémantické + lexikální) vyhledávání na OneDrivu pro práci nebo školu s dotazy v přirozeném jazyce. Je ideální pro vlastní aplikace, které chtějí vyhledávat dokumenty bez replikace nebo správy indexů mimo Microsoft 365.
Z hlediska zabezpečení a dodržování předpisů se API jeví jako „na místě“ a zachovává oprávnění a řízení . Pokud si uživatel nemůže zobrazit dokument v M365, nezíská ho ani prostřednictvím API, což zabraňuje únikům dat a zjednodušuje dodržování předpisů.
Licence: Je k dispozici bez dalších nákladů pro uživatele s doplňkem licence Microsoft 365 Copilot . V současné době nepodporuje uživatele bez tohoto doplňku a podporovaným zdrojem dat je OneDrive pro práci nebo školu.
- Dobré postupyposkytuje kontext v konzultaci, vyhýbá se příliš obecným otázkám a používá jasný přirozený jazyk.
- FiltrováníPři použití filtru filterExpression s cestou zadejte úplnou cestu k OneDrivu (ne odkaz pro sdílení).
Relevantní aktuální omezení: dotaz až 1500 znaků , maximální velikost stránky 100, až 200 požadavků na uživatele/hodinu, omezená podpora pro výrazy cest ve filtru a žádné sémantické vyhledávání netextového obsahu (tabulky, obrázky, grafy).
- Omezení velikostisémantika v souborech .docx/.pptx/.pdf až do 512 MB; v ostatních příponách až do 150 MB.
- Typy souborů se sémantikou: aspx, docx, pptx, pdf, onepart, doc, html, eml, mp4, loop, one, fluid, png, jpg, json, csv, xml, ppt.
Vyhledávání Copilot vs. Copilot Chat a vs. Vyhledávání Microsoft

„Vyhledávání Copilot“ se v aplikaci Microsoft 365 Copilot zobrazuje jako univerzální vyhledávací modul , který vám umožní rychle najít to, co potřebujete, s kontextovými, sémantickými a personalizovanými výsledky.
Copilot Chat je naproti tomu konverzační a slouží k hlubšímu uvažování, tvorbě obsahu a plnění úkolů. Copilot Search je optimalizován pro rychlost a objevování; chat pro rozpracování a akci.
A co tradiční Vyhledávání Microsoft? Vyhledávání Copilot nabízí moderní, sémantické prostředí napříč M365 a zdroji třetích stran (prostřednictvím konektorů) s přímou integrací chatu a vylepšenou personalizací. Vyhledávání Microsoft se zaměřuje na klasická klíčová slova a vertikály.
Přístup a způsobilost: Pokud máte platnou licenci Microsoft 365 Copilot , zobrazí se vám vyhledávání Copilot na webu, počítači a mobilním zařízení bez nutnosti jakéhokoli nastavení. Zabezpečení a ochrana osobních údajů jsou stejné jako v Copilotu: žádný obsah není zveřejněn bez povolení.
Copilot pro vyhledávání obsahu v Power BI
V samostatném prostředí Copilotu umožňuje Power BI vyhledávat v sestavách, sémantických modelech, aplikacích a datových agentech . Vyhledávání využívá metadata (název, popis, pracovní prostor) a obsah v rámci prvků (názvy stránek, vizuální nadpisy, textová pole atd.).
Pro kategorizaci obsahu využívá Copilot signály, jako jsou oblíbené, nedávné otevření, oblíbenost a schválení nebo členství v aplikaci. Také automaticky generuje popis, pokud jej autor nedefinoval.
Můžete lépe usnadnit vyhledávání přidáním jasných popisů, jedinečných klíčových slov a štítků schválení . Označení položky jako oblíbené je explicitním signálem důležitosti a pomáhá jí zobrazovat se ve výsledcích vyhledávání výše.
Omezení: Copilot respektuje cílové skupiny aplikací a skrytá pole/prvky, nenavrhuje sémantické modely označené jako nerozpoznatelné bez přímého přístupu a některé scénáře (přístup přes skupiny M365) budou zahrnuty v budoucích verzích. Přímé změny prvků se obvykle projeví přibližně do 5 minut; nepřímé změny (například přejmenování pracovního prostoru) mohou trvat až 24 hodin.
Sémantické modely v Power BI připravené pro umělou inteligenci: vývoj a využití
Aby Copilot „rozuměl“ vašim datům v Power BI, musí být sémantický model dobře navržen : jasné názvy, správné vztahy, standardizované míry, užitečné hierarchie a synonyma sladěná s jazykem firmy.
Kladení otázek ohledně dat z Copilotu pomáhá s průzkumem a ověřováním. Odpovědi v chatu jsou však statické a nenahrazují kvalitní zprávu s vizuály, které se aktualizují s každou změnou modelu. Použijte to k ověření, jak dobře Copilot interpretuje entity a míry.
V zobrazení dotazů DAX může Copilot navrhovat dotazy , generovat vzestupné míry z dotazu a vysvětlovat koncepty DAX. Je to obzvláště užitečné pro učení vzorů, refaktoring a dokumentaci s komentáři, i když je vhodné validovat kód a být opatrný při používání proměnných.
Jazykové modelování (synonyma a sémantické vztahy) je klíčové. Pomocí nástroje Copilot můžete navrhovat synonyma a později je upřesňovat, přičemž platná synonyma můžete sdílet v celé organizaci. Generování popisů měr je také užitečné pro zlepšení dokumentace a porozumění.
Příprava dat pro AI v Power BI: Schéma AI, testované odpovědi a instrukce
Doporučený pracovní postup pro přípravu modelu v Power BI Desktopu zahrnuje několik kroků. Nejprve zjednodušte datové schéma : skryjte technická nebo redundantní pole, vyhněte se duplicitním názvům mezi tabulkami a minimalizujte nepoužívané objekty, které způsobují nepořádek.
Dále si nastavte ověřené odpovědi : fráze nebo často kladené otázky, které namapujete na vizuální podobu nebo „oficiální“ definici. Když se někdo zeptá na něco, co odpovídá těmto frázím, Copilot bude reagovat konzistentně a schváleným způsobem, aby se vyhnul nejednoznačnosti.
Třetím pilířem jsou instrukce pro umělou inteligenci , krátké texty, které Copilota usměrňují k prioritám, interním definicím a nuancím domény. Například co znamená „aktivní zákazník“, které metriky upřednostnit před vedením nebo ekvivalence mezi pojmy („příležitosti“, „leady“, „obchody“).
Před sdílením důkladně otestujte pomocí nástroje Copilot: položte typické otázky, ověřte, zda používáte správná pole ve zjednodušeném schématu, a upravte pokyny a ověřené odpovědi na základě vašich pozorování. Publikujte zprávu a přidejte popisy do zprávy i modelu pro lepší vyhledávání.
Nakonec označte model jako připravený pro AI v kompatibilním pracovním prostoru (Fabric/Premium). Tím se optimalizuje zážitek z Copilotu („Chat s vašimi daty“), vylepší se interpretace přirozeného jazyka a usnadní se automatické generování vizuálů a metrik.
Vláda a bezpečnost aplikované na sémantické vyhledávání
Přestože sémantické indexování nemění oprávnění, správa dat zůstává klíčová . Minimalizujte zastaralá data, používejte štítky citlivosti, používejte DLP k dočasnému omezení přístupu a zkontrolujte postupy sdílení, abyste zabránili jejich nadměrnému vystavení.
Organizace s pokročilými potřebami se mohou spolehnout na Microsoft Purview pro uchovávání dat, klasifikaci a prevenci ztrát a na Advanced Management for SharePoint pro audit a opravu starších nebo nadměrně otevřených oprávnění.
Pokud pracujete s geografickými hranicemi nebo evropskými požadavky, můžete se pro ukládání a zpracování indexů spolehnout na EU Data Boundary a pro šifrování s vaším vlastním klíčem na BYOK. Slib společnosti Copilot je jasný: odpovědi jsou „uzemněny“ obsahem, ke kterému již máte právo přístupu.
Praktická doporučení pro zvládnutí sémantického vyhledávání
Myslete přirozeným jazykem, ale s jasným záměrem: uveďte v dotazu dostatečný kontext a vyhněte se příliš obecným termínům. To pomáhá sémantickému přeřazení vybrat nejlepší podmnožinu obsahu.
V Power BI investujte do modelu: dobře pojmenujte věci, definujte standardní míry, vytvářejte hierarchie a vše dokumentujte . To výrazně zlepšuje kvalitu odpovědí Copilota a snižuje počet dotazů adresovaných technickému týmu.
Pro vlastní aplikace zvažte vyhledávací API od Copilota: nabízí sémantiku na webu se zachovaným zabezpečením a správou . Pro přesnost zkontrolujte limity (velikost souborů, typy, kvóta na uživatele) a filtrujte podle úplných cest k OneDrivu.
A konečně, konsolidujte řízení: ponechte si, co je nezbytné, označte, co je citlivé, a sdílejte pouze to, co je nezbytné . Sémantické vyhledávání funguje nejlépe v organizovaných prostředích s čistými schématy.
Díky všemu výše uvedenému se sémantické vyhledávání s Copilotem stává spolehlivou „zkratkou“ k firemním znalostem: enginem, který rozumí záměru, respektuje oprávnění a poskytuje odpovědi se skutečnými dokumenty a který v kombinaci s Power BI a jeho přípravou pro umělou inteligenci umožňuje klást otázky, zkoumat a rozhodovat se s menším třením a větší jistotou.