Contribució als mètodes d'obtenció i representació de vistes d'objectes reals per aplicacions interactives.
Bibliographic record
Abstract
En aquesta tesi s'han realitzat una serie d'experiments per tal de cercar, identificar, caracteritzar i comparar diversos metodes d'obtencio de vistes d'objectes reals per aplicacions interactives de realitat augmentada, telepresencia o altres que puguin idear-se en el futur. Durant el desenvolupament dels metodes trobats, de naturalesa diversa, han sorgit dificultats que han fet aprofundir aquest treball en l'ambit de la geometria de la sintesi de vistes, la reconstruccio de l'estructura tridimensional dels objectes, l'acceleracio de certs algoritmes amb l'ajut del maquinari existent o la portabilitat de les dades a traves de la xarxa. Concretament, s'han identificat tres metodes que poden satisfer els requeriments plantejats. El primer, acces a vistes d'objectes comprimides en fitxers, es basa en l'organitzacio de les dades presentada, la capacitat de compressio dels algoritmes i el suport del maquinari a la tasca de descompressio. El segon metode, reconstruccio tridimensional i projeccio emprant el coprocessador grafic, aprofita les altes prestacions d'aquests ultims, impulsats per les necessitats del mercat. El tercer, seleccio d'un conjunt representatiu de vistes i interpolacio entre elles, aprofita les propietats de la rectificacio de tres vistes i l'exactitud de la interpolacio de vistes si es disposa d'un mapa de disparitat prou dens. Aquesta necessitat ha connectat aquest metode amb el segon, al que cal el model tridimensional reconstruit, ja que hi ha una equivalencia entre les dues expressions de la informacio. Per la comparacio dels resultats dels metodes estudiats, s'han seguit tres criteris: - El primer, obviament, el de la qualitat de les vistes obtingudes de l'objecte. Ha calgut identificar les principals fonts d'error en els processos i cercar uns avaluadors d'aquest error. A mes d'aquests numerics se n'han cercat de subjectius ja que el destinatari de les vistes sera un esser huma. - El temps d'obtencio d'una vista (important per la interactivitat), projectat a les plataformes tecnologiques existents o previsibles. - La mida de les dades necessaries per cadascun dels metodes, que limitara la portabilitat de la visualitzacio dels objectes. Durant la realitzacio d'aquesta tesi, s'han realitzat algunes contribucions, la majoria d'elles ja publicades, que es poden resumir en: - Disseny d'una metodologia per la representacio d'objectes a partir de conjunts de vistes i metodes de sintesi. En aquesta metodologia s'ha presentat un protocol per l'adquisicio i ordenacio de les dades, idees per la seleccio del conjunt minim de vistes, un criteri per gravar la minima informacio necessaria, ajuts a l'obtencio de la informacio tridimensional de l'escena necessaria, i un algoritme rapid i general de sintesi de vistes. - Supressio de les restriccions geometriques del metode de sintesi per rectificacio de tres vistes, permetent generalitzar la ubicacio de la camera virtual i optimitzar la distancia del pla de reprojeccio per maximitzar l'area de la vista interpolada. - Especificacio de l'algoritme de sintesi de vistes pel metode de rectificacio de tres vistes, de forma que es pugui implementar amb processadors tipus DSP o conjunts d'instruccions especifiques dels processadors CISC, per assolir les necessitats de les aplicacions interactives. - Presentacio d'un metode de refinament de models tridimensionals obtinguts per space carving mitjancant estereovisio. El metode combina dues tecniques conegudes de visio per ordinador obtenint un millor resultat en la reconstruccio tridimensional. - Acceleracio del metode de reconstruccio tridimensional per projeccio de voxels amb la utilitzacio de mapes de distancia, estructures en arbre i el coprocessador grafic present en els computadors personals. Els resultats obtinguts en la tesi s'han adaptat per aplicar-se a un projecte de simulacio de situacions de conduccio en carreteres amb realitat augmentada, desenvolupat per la UPC i la Universitat de Toronto i un segon de representacio remota de vistes d'objectes arqueologics, desenvolupat per la UPC, la UB i un conjunt d'universitats estrangeres.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame distilled prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. Learned from the 10,348 direct Codex labels and 10,348 direct Gemma labels. Candidate is the union of thresholded teacher heads; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels or direct frontier model labels.
Codex and Gemma teacher scores by category
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.002 | 0.002 |
| Meta-epidemiology (narrow) | 0.002 | 0.001 |
| Meta-epidemiology (broad) | 0.002 | 0.001 |
| Bibliometrics | 0.000 | 0.001 |
| Science and technology studies | 0.001 | 0.000 |
| Scholarly communication | 0.001 | 0.001 |
| Open science | 0.001 | 0.000 |
| Research integrity | 0.001 | 0.001 |
| Insufficient payload (model declined to judge) | 0.010 | 0.002 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; both teacher heads agree on what is shown here.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".